Săriți la conținut
Catalog de modele

Catalog de modele open-source

Filtrează modelele deschise după dimensiune, memorie necesară și licență — le implementăm pe oricare dintre ele privat, pe hardware-ul tău.

Model Parametri VRAM minim Licență Ideal pentru
Phi-3.5 mini 3.8B 4 GB MIT Edge și dispozitive
Mistral 7B 7B 6 GB Apache 2.0 Asistenți rapizi
Llama 3.1 8B 8B 8 GB Llama 3.1 Copiloți și chat
Qwen 2.5 7B 7B 8 GB Apache 2.0 Chat multilingv
Gemma 2 9B 9B 10 GB Gemma Sarcini ușoare
Gemma 2 27B 27B 20 GB Gemma Calitate echilibrată
Qwen 2.5 32B 32B 24 GB Apache 2.0 Raționament și analiză
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Debit și RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Raționament de înaltă calitate
Qwen 2.5 72B 72B 40 GB Qwen Sarcini complexe
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Sarcini de întreprindere
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Calitate maximă
DeepSeek R1 671B MoE Multi-GPU MIT Raționament de vârf
Falcon 180B 180B Multi-GPU Falcon Operare la scară mare

VRAM minim orientativ pentru inferență cuantizată; dimensionăm hardware-ul exact în funcție de caz.