Vai al contenuto
Catalogo modelli

Catalogo di modelli open-source

Filtra i modelli aperti per dimensione, memoria richiesta e licenza: li distribuiamo tutti in privato, sul tuo hardware.

Modello Parametri VRAM minima Licenza Ideale per
Phi-3.5 mini 3.8B 4 GB MIT Edge e dispositivo
Mistral 7B 7B 6 GB Apache 2.0 Assistenti rapidi
Llama 3.1 8B 8B 8 GB Llama 3.1 Copiloti e chat
Qwen 2.5 7B 7B 8 GB Apache 2.0 Chat multilingue
Gemma 2 9B 9B 10 GB Gemma Attività leggere
Gemma 2 27B 27B 20 GB Gemma Qualità bilanciata
Qwen 2.5 32B 32B 24 GB Apache 2.0 Ragionamento e analisi
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Throughput e RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Ragionamento di alta qualità
Qwen 2.5 72B 72B 40 GB Qwen Attività complesse
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Carichi aziendali
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Qualità massima
DeepSeek R1 671B MoE Multi-GPU MIT Ragionamento di frontiera
Falcon 180B 180B Multi-GPU Falcon Servizio su larga scala

VRAM minima indicativa per inferenza quantizzata; dimensioniamo l’hardware esatto in base al caso d’uso.