Aller au contenu
Catalogue de modèles

Catalogue de modèles open source

Filtrez les modèles ouverts par taille, besoin en mémoire et licence — nous déployons n’importe lequel d’entre eux en privé, sur votre matériel.

Modèle Paramètres VRAM min. Licence Idéal pour
Phi-3.5 mini 3.8B 4 GB MIT Edge et embarqué
Mistral 7B 7B 6 GB Apache 2.0 Assistants rapides
Llama 3.1 8B 8B 8 GB Llama 3.1 Copilotes et chat
Qwen 2.5 7B 7B 8 GB Apache 2.0 Chat multilingue
Gemma 2 9B 9B 10 GB Gemma Tâches légères
Gemma 2 27B 27B 20 GB Gemma Qualité équilibrée
Qwen 2.5 32B 32B 24 GB Apache 2.0 Raisonnement et analyse
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Débit et RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Raisonnement de haute qualité
Qwen 2.5 72B 72B 40 GB Qwen Tâches complexes
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Charges d’entreprise
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Qualité maximale
DeepSeek R1 671B MoE Multi-GPU MIT Raisonnement de pointe
Falcon 180B 180B Multi-GPU Falcon Service à grande échelle

VRAM minimale indicative pour une inférence quantifiée ; nous dimensionnons le matériel exact selon le cas d’usage.