Catalogue de modèles
Catalogue de modèles open source
Filtrez les modèles ouverts par taille, besoin en mémoire et licence — nous déployons n’importe lequel d’entre eux en privé, sur votre matériel.
| Modèle | Paramètres | VRAM min. | Licence | Idéal pour |
|---|---|---|---|---|
| Phi-3.5 mini | 3.8B | 4 GB | MIT | Edge et embarqué |
| Mistral 7B | 7B | 6 GB | Apache 2.0 | Assistants rapides |
| Llama 3.1 8B | 8B | 8 GB | Llama 3.1 | Copilotes et chat |
| Qwen 2.5 7B | 7B | 8 GB | Apache 2.0 | Chat multilingue |
| Gemma 2 9B | 9B | 10 GB | Gemma | Tâches légères |
| Gemma 2 27B | 27B | 20 GB | Gemma | Qualité équilibrée |
| Qwen 2.5 32B | 32B | 24 GB | Apache 2.0 | Raisonnement et analyse |
| Mixtral 8x7B | 47B MoE | 24 GB | Apache 2.0 | Débit et RAG |
| Llama 3.3 70B | 70B | 40 GB | Llama 3.3 | Raisonnement de haute qualité |
| Qwen 2.5 72B | 72B | 40 GB | Qwen | Tâches complexes |
| Mixtral 8x22B | 141B MoE | 80 GB | Apache 2.0 | Charges d’entreprise |
| Llama 3.1 405B | 405B | Multi-GPU | Llama 3.1 | Qualité maximale |
| DeepSeek R1 | 671B MoE | Multi-GPU | MIT | Raisonnement de pointe |
| Falcon 180B | 180B | Multi-GPU | Falcon | Service à grande échelle |
Aucun modèle ne correspond à votre filtre.
VRAM minimale indicative pour une inférence quantifiée ; nous dimensionnons le matériel exact selon le cas d’usage.