Bonsai 27B
Le premier grand modèle multimodal de classe 27B à fonctionner localement sur smartphone, compressé à 3,9 Go à partir de Qwen3.6 27B d'Alibaba par quantification extrême
Bonsai 27B
Le premier grand modèle multimodal de classe 27B à fonctionner localement sur smartphone, compressé à 3,9 Go à partir de Qwen3.6 27B d'Alibaba par quantification extrême
Kimi K3 édition open source
Le plus grand modèle open source au monde, publié par Moonshot AI : 2 800 milliards de paramètres, multimodalité native et contexte d'un million de tokens, au sommet mondial en programmation
Zhipu GLM-5.2
Nouveau modèle phare de Zhipu, publié en open source sous licence MIT : rivalise avec les meilleurs modèles fermés en codage et tâches de long terme, adapté aux puces chinoises
Osaurus
Runtime IA natif macOS open source, exécute des modèles et gère des agents localement, les données et la vie privée restent entièrement sur votre Mac
Gemini 3.6 Flash
Modèle principal efficace de Google DeepMind pour l'ère des agents, plus puissant et économe en tokens en programmation, travail du savoir et tâches multimodales
Panshi Scientific Foundation Model 2.0
Modèle scientifique spécialisé complet de l'Académie chinoise des sciences, fournissant une base intelligente haute crédibilité et explicable pour la recherche scientifique
SenseNova U1 Pro
Modèle multimodal natif flagship de SenseTime, spécialisé dans la création d'images et de textes complexes de qualité livrable et sortie native 8K
Qwen3.8
Nouveau modèle multimodal phare de 2,4 billions de paramètres d'Alibaba Tongyi Qianwen, spécialisé dans l'ingénierie du code et la productivité professionnelle, version preview disponible avec poids open source promis
Muse Spark 1.1
Modèle de raisonnement multimodal phare de Meta AI, conçu pour les tâches Agent et le codage, contexte d'un million de tokens, prix au quart de la concurrence
AI21 Jamba2
Famille de modèles hybrides SSM-Transformer open source d'AI21 Labs (Israël), axée sur la fiabilité enterprise et l'efficacité mémoire avec contexte 256K
Gemini 5
Google DeepMind a publié en juillet 2026 son modèle phare Gemini 3.5 Pro, avec 2 millions de tokens de contexte et le raisonnement étendu Deep Think
GPT-7
La famille de modèles frontier la plus puissante d'OpenAI actuellement, GPT-5.6 (Sol/Terra/Luna), redéfinit l'exécution de tâches complexes avec des workflows agentiques et des outils natifs
Claude Opus 6
La gamme flagship frontier d'Anthropic Opus, spécialisée dans le raisonnement à longue portée, l'agent autonome prolongé et l'auto-calibration honnête
Grok 6
xAI a déclenché une guerre des prix au second semestre 2026 avec Grok 4.5 (1,5 billion de paramètres, spécialisé dans le code et Agent), Grok 4.6 (2 billions de paramètres) prendra le relais en août
Upstage Solar 2
Deuxième génération du modèle de langage phare d'Upstage (Corée), Solar Pro 2, 31 milliards de paramètres, exécutable sur un seul GPU, domine le coréen avec un déploiement enterprise solide
Fireworks 2
Plateforme cloud d'inférence et d'entraînement pour modèles open source créée par l'équipe originale de PyTorch, spécialisée dans la personnalisation d'une intelligence exclusive sur données privées d'entreprise
DeepSeek V4.5
Version itérative du modèle phare de DeepSeek lancée en juillet 2026, avec des améliorations en code, textes longs en chinois et cohérence multitép, poursuivant la stratégie open source et de prix planchers
Claude Opus 5
Nouveau modèle phare Opus d'Anthropic lancé en juillet 2026, avec un contexte de millions de tokens et des capacités de codage agentiques exceptionnelles, considéré par l'entreprise comme le modèle de programmation le plus puissant au monde, approchant les capacités de Fable 5 pour environ la moitié du prix
Gemini 4.5 Pro
Modèle phare haute performance de Google avec un contexte long de millions de tokens et une compréhension multimodale complète
Aleph Alpha Columbus
Plateforme AI souveraine d'Aleph Alpha pour les entreprises et gouvernements européens, centrée sur la conformité et l'explicabilité
NetEase Yuyan 2
LLM de jeu de rôle chinois de NetEase Fuxi, spécialisé dans la génération d'histoires et le dialogue de personnages
SenseTime SenseNova 6
Famille LLM multimodale native de 6e génération de SenseTime, architecture unifiée pour le raisonnement profond sur texte, image, vidéo et voix
iFlyTek Spark 6
Modèle cognitif d'iFlyTek entraîné sur des capacités de calcul nationales, exceptionnel en voix et éducation
Baidu Ernie 5.5
Assistant AI polyvalent de Baidu, spécialisé dans les questions de connaissance chinoise, la création littéraire et le raisonnement logique
Qwen3.5-Coder
Modèle ouvert spécialisé code de la famille Qwen 3.5 d'Alibaba, 7B/32B, contexte 256K, Apache 2.0
Grok 5.5
Assistant AI en temps réel de xAI, le seul connecté nativement au flux de données de X
Nemotron Ultra 253B
Modèle de raisonnement 253B de NVIDIA, rivalise avec les modèles fermés, utilisable commercialement
Gemma 5
Dernière famille de modèles à poids ouverts de Google DeepMind (Apache 2.0, du mobile au serveur)
Claude Haiku 5
Le modèle le plus rapide et le moins cher d'Anthropic, coût et latence minimes avec des capacités de codage proches du fleuron
Mistral Codestral 2
Modèle de code 2e génération de Mistral, relicencié Apache 2.0 pour auto-hébergement et usage commercial