Saltar para o conteúdo
Catálogo de modelos

Catálogo de modelos open-source

Filtre modelos abertos por tamanho, memória necessária e licença — implementamos qualquer um deles de forma privada, no seu hardware.

Modelo Parâmetros VRAM mínima Licença Ideal para
Phi-3.5 mini 3.8B 4 GB MIT Edge e dispositivo
Mistral 7B 7B 6 GB Apache 2.0 Assistentes rápidos
Llama 3.1 8B 8B 8 GB Llama 3.1 Copilotos e chat
Qwen 2.5 7B 7B 8 GB Apache 2.0 Chat multilingue
Gemma 2 9B 9B 10 GB Gemma Tarefas leves
Gemma 2 27B 27B 20 GB Gemma Qualidade equilibrada
Qwen 2.5 32B 32B 24 GB Apache 2.0 Raciocínio e análise
Mixtral 8x7B 47B MoE 24 GB Apache 2.0 Débito e RAG
Llama 3.3 70B 70B 40 GB Llama 3.3 Raciocínio de alta qualidade
Qwen 2.5 72B 72B 40 GB Qwen Tarefas complexas
Mixtral 8x22B 141B MoE 80 GB Apache 2.0 Cargas empresariais
Llama 3.1 405B 405B Multi-GPU Llama 3.1 Qualidade máxima
DeepSeek R1 671B MoE Multi-GPU MIT Raciocínio de fronteira
Falcon 180B 180B Multi-GPU Falcon Serviço em grande escala

VRAM mínima indicativa para inferência quantizada; dimensionamos o hardware exato para cada caso de uso.