Catalogo modelli
Catalogo di modelli open-source
Filtra i modelli aperti per dimensione, memoria richiesta e licenza: li distribuiamo tutti in privato, sul tuo hardware.
| Modello | Parametri | VRAM minima | Licenza | Ideale per |
|---|---|---|---|---|
| Phi-3.5 mini | 3.8B | 4 GB | MIT | Edge e dispositivo |
| Mistral 7B | 7B | 6 GB | Apache 2.0 | Assistenti rapidi |
| Llama 3.1 8B | 8B | 8 GB | Llama 3.1 | Copiloti e chat |
| Qwen 2.5 7B | 7B | 8 GB | Apache 2.0 | Chat multilingue |
| Gemma 2 9B | 9B | 10 GB | Gemma | Attività leggere |
| Gemma 2 27B | 27B | 20 GB | Gemma | Qualità bilanciata |
| Qwen 2.5 32B | 32B | 24 GB | Apache 2.0 | Ragionamento e analisi |
| Mixtral 8x7B | 47B MoE | 24 GB | Apache 2.0 | Throughput e RAG |
| Llama 3.3 70B | 70B | 40 GB | Llama 3.3 | Ragionamento di alta qualità |
| Qwen 2.5 72B | 72B | 40 GB | Qwen | Attività complesse |
| Mixtral 8x22B | 141B MoE | 80 GB | Apache 2.0 | Carichi aziendali |
| Llama 3.1 405B | 405B | Multi-GPU | Llama 3.1 | Qualità massima |
| DeepSeek R1 | 671B MoE | Multi-GPU | MIT | Ragionamento di frontiera |
| Falcon 180B | 180B | Multi-GPU | Falcon | Servizio su larga scala |
Nessun modello corrisponde al filtro.
VRAM minima indicativa per inferenza quantizzata; dimensioniamo l’hardware esatto in base al caso d’uso.