Bonsai 27B
O primeiro grande modelo multimodal da classe 27B a rodar localmente em um smartphone, comprimido para 3,9 GB a partir do Qwen3.6 27B da Alibaba via quantização extrema
Bonsai 27B
O primeiro grande modelo multimodal da classe 27B a rodar localmente em um smartphone, comprimido para 3,9 GB a partir do Qwen3.6 27B da Alibaba via quantização extrema
Kimi K3 edição open source
O maior modelo de linguagem open source do mundo, da Moonshot AI: 2,8 trilhões de parâmetros, multimodalidade nativa e contexto de 1 milhão de tokens, líder global em programação
Zhipu GLM-5.2
Novo modelo carro-chefe da Zhipu, lançado em código aberto sob licença MIT: compete com os melhores modelos fechados em programação e tarefas de longo prazo, adaptado ao hardware chinês
Osaurus
Runtime AI nativo do macOS de código aberto, executa modelos e gerencia agentes localmente, dados e privacidade permanecem totalmente no seu Mac
Gemini 3.6 Flash
Modelo principal eficiente do Google DeepMind para a era dos agentes, mais potente e eficiente em tokens em programação, trabalho do conhecimento e tarefas multimodais
Panshi Scientific Foundation Model 2.0
Modelo científico especializado integral da Academia Chinesa de Ciências, fornece uma base inteligente de alta credibilidade e explicável para a pesquisa científica
SenseNova U1 Pro
Modelo multimodal nativo flagship da SenseTime, especializado em criação de imagens e textos complexos com qualidade de entrega e saída nativa 8K
Qwen3.8
Novo modelo multimodal flagship de 2,4 trilhões de parâmetros do Alibaba Tongyi Qianwen, especializado em engenharia de código e produtividade profissional, versão preview já disponível com pesos open source prometidos
Muse Spark 1.1
Modelo de raciocínio multimodal flagship da Meta AI, projetado para tarefas Agent e programação, contexto de um milhão de tokens, preço de um quarto da concorrência
AI21 Jamba2
Família de modelos híbridos SSM-Transformer de código aberto da AI21 Labs de Israel, focados em confiabilidade empresarial e eficiência de memória com contexto de 256K
Gemini 5
Google DeepMind lançou em julho de 2026 seu modelo flagship Gemini 3.5 Pro, com 2 milhões de tokens de contexto e raciocínio estendido Deep Think
GPT-7
A família de modelos frontier mais poderosa da OpenAI atualmente, GPT-5.6 (Sol/Terra/Luna), redefine a execução de tarefas complexas com fluxos de trabalho agentivos e ferramentas nativas
Claude Opus 6
A linha flagship frontier da Anthropic Opus, especializada em raciocínio de longo alcance, agente autônomo prolongado e autocalibração honesta
Grok 6
xAI iniciou uma guerra de preços no segundo semestre de 2026 com o Grok 4.5 (1,5 trilhão de parâmetros, focado em programação e Agent), Grok 4.6 (2 trilhões de parâmetros) assumirá em agosto
Upstage Solar 2
Segunda geração do modelo de linguagem principal da Upstage da Coreia, Solar Pro 2, com 31 bilhões de parâmetros, executável em uma única GPU, domina o coreano e com implementação empresarial robusta
Fireworks 2
Plataforma cloud de inferência e treinamento para modelos open source criada pela equipe original do PyTorch, especializada em personalizar inteligência exclusiva sobre dados privados empresariais
DeepSeek V4.5
Versão iterativa do modelo principal da DeepSeek lançada em julho de 2026, com melhorias em código, textos longos em chinês e consistência multiturno, continuando a estratégia de código aberto e preços baixos
Claude Opus 5
Novo modelo emblemático Opus da Anthropic lançado em julho de 2026, com contexto de milhões de tokens e capacidade de codificação agentic excepcional, considerado pela empresa como o modelo de programação mais poderoso do mundo, aproximando-se das capacidades do Fable 5 por cerca de metade do preço
Gemini 4.5 Pro
Modelo principal de alto desempenho do Google com contexto longo de milhões de tokens e compreensão multimodal completa
SenseTime SenseNova 6
Família LLM multimodal nativa de 6ª geração da SenseTime, arquitetura unificada para raciocínio profundo em texto, imagem, vídeo e voz
iFlyTek Spark 6
Modelo cognitivo da iFlyTek treinado em computação nacional, excepcional em voz e educação
Baidu Ernie 5.5
Assistente AI versátil da Baidu, especializado em perguntas de conhecimento chinês, criação literária e raciocínio lógico
Qwen3.5-Coder
Modelo de código aberto da família Qwen 3.5 da Alibaba, 7B/32B, contexto 256K, Apache 2.0
Grok 5.5
Assistente AI em tempo real da xAI, o único conectado nativamente ao fluxo de dados do X
Nemotron Ultra 253B
Modelo de raciocínio de 253B da NVIDIA, rivaliza com modelos fechados, utilizável comercialmente
Gemma 5
Última família de modelos de peso aberto do Google DeepMind (Apache 2.0, do celular ao servidor)
Claude Haiku 5
Modelo mais rápido e barato da Anthropic, custo e latência mínimos com capacidade de codificação quase flagship
Mistral Codestral 2
Modelo de código de 2ª geração da Mistral, relicenciado Apache 2.0 para auto-hospedagem e uso comercial
Xiaomi MiMo 2
Família LLM de código aberto da Xiaomi para a era dos agentes, utilizável comercialmente a preços muito mais baixos