Прескочете към съдържанието
Каталог с модели

Каталог с модели с отворен код

Филтрирайте отворените модели по размер, нужна памет и лиценз — внедряваме всеки от тях частно, на вашия хардуер.

Модел Параметри Мин. VRAM Лиценз Подходящ за
Phi-3.5 mini 3.8B 4 GB MIT Edge и устройства
Mistral 7B 7B 6 GB Apache 2.0 Бързи асистенти
Llama 3.1 8B 8B 8 GB Llama 3.1 Асистенти и чат
Qwen 2.5 7B 7B 8 GB Apache 2.0 Многоезичен чат
Gemma 2 9B 9B 10 GB Gemma Леки задачи
Gemma 2 27B 27B 20 GB Gemma Балансирано качество
Qwen 2.5 32B 32B 24 GB Apache 2.0 Разсъждение и анализ
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Пропускливост и RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Висококачествено разсъждение
Qwen 2.5 72B 72B 40 GB Qwen Сложни задачи
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Корпоративни натоварвания
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Максимално качество
DeepSeek R1 671B MoE Multi-GPU MIT Челно разсъждение
Falcon 180B 180B Multi-GPU Falcon Работа в голям мащаб

Ориентировъчна минимална VRAM за квантувано извеждане; точният хардуер се оразмерява според случая на употреба.