Zum Inhalt springen
Modellkatalog

Katalog quelloffener Modelle

Filtern Sie offene Modelle nach Größe, Speicherbedarf und Lizenz — jedes davon setzen wir privat auf Ihrer Hardware ein.

Modell Parameter Min. VRAM Lizenz Am besten für
Phi-3.5 mini 3.8B 4 GB MIT Edge und Gerät
Mistral 7B 7B 6 GB Apache 2.0 Schnelle Assistenten
Llama 3.1 8B 8B 8 GB Llama 3.1 Copilots und Chat
Qwen 2.5 7B 7B 8 GB Apache 2.0 Mehrsprachiger Chat
Gemma 2 9B 9B 10 GB Gemma Leichte Aufgaben
Gemma 2 27B 27B 20 GB Gemma Ausgewogene Qualität
Qwen 2.5 32B 32B 24 GB Apache 2.0 Schlussfolgern und Analyse
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Durchsatz und RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Hochwertiges Schlussfolgern
Qwen 2.5 72B 72B 40 GB Qwen Komplexe Aufgaben
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Unternehmenslasten
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Maximale Qualität
DeepSeek R1 671B MoE Multi-GPU MIT Spitzen-Schlussfolgern
Falcon 180B 180B Multi-GPU Falcon Betrieb im großen Maßstab

Richtwert für den minimalen VRAM bei quantisierter Inferenz; die genaue Hardware dimensionieren wir je Anwendungsfall.