Catalog de modele
Catalog de modele open-source
Filtrează modelele deschise după dimensiune, memorie necesară și licență — le implementăm pe oricare dintre ele privat, pe hardware-ul tău.
| Model | Parametri | VRAM minim | Licență | Ideal pentru |
|---|---|---|---|---|
| Phi-3.5 mini | 3.8B | 4 GB | MIT | Edge și dispozitive |
| Mistral 7B | 7B | 6 GB | Apache 2.0 | Asistenți rapizi |
| Llama 3.1 8B | 8B | 8 GB | Llama 3.1 | Copiloți și chat |
| Qwen 2.5 7B | 7B | 8 GB | Apache 2.0 | Chat multilingv |
| Gemma 2 9B | 9B | 10 GB | Gemma | Sarcini ușoare |
| Gemma 2 27B | 27B | 20 GB | Gemma | Calitate echilibrată |
| Qwen 2.5 32B | 32B | 24 GB | Apache 2.0 | Raționament și analiză |
| Mixtral 8x7B | 47B MoE | 24 GB | Apache 2.0 | Debit și RAG |
| Llama 3.3 70B | 70B | 40 GB | Llama 3.3 | Raționament de înaltă calitate |
| Qwen 2.5 72B | 72B | 40 GB | Qwen | Sarcini complexe |
| Mixtral 8x22B | 141B MoE | 80 GB | Apache 2.0 | Sarcini de întreprindere |
| Llama 3.1 405B | 405B | Multi-GPU | Llama 3.1 | Calitate maximă |
| DeepSeek R1 | 671B MoE | Multi-GPU | MIT | Raționament de vârf |
| Falcon 180B | 180B | Multi-GPU | Falcon | Operare la scară mare |
Niciun model nu corespunde filtrului.
VRAM minim orientativ pentru inferență cuantizată; dimensionăm hardware-ul exact în funcție de caz.