Ga naar inhoud
Modelcatalogus

Catalogus van open-source modellen

Filter open modellen op omvang, geheugenbehoefte en licentie — we implementeren ze allemaal privé, op uw eigen hardware.

Model Parameters Min. VRAM Licentie Geschikt voor
Phi-3.5 mini 3.8B 4 GB MIT Edge en apparaat
Mistral 7B 7B 6 GB Apache 2.0 Snelle assistenten
Llama 3.1 8B 8B 8 GB Llama 3.1 Copiloten en chat
Qwen 2.5 7B 7B 8 GB Apache 2.0 Meertalige chat
Gemma 2 9B 9B 10 GB Gemma Lichte taken
Gemma 2 27B 27B 20 GB Gemma Gebalanceerde kwaliteit
Qwen 2.5 32B 32B 24 GB Apache 2.0 Redeneren en analyse
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Doorvoer en RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Hoogwaardig redeneren
Qwen 2.5 72B 72B 40 GB Qwen Complexe taken
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Zakelijke workloads
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Maximale kwaliteit
DeepSeek R1 671B MoE Multi-GPU MIT Geavanceerd redeneren
Falcon 180B 180B Multi-GPU Falcon Grootschalige uitrol

Indicatieve minimale VRAM voor gekwantiseerde inferentie; we bepalen de exacte hardware per use case.