Modèles
Toutes les sorties de modèles d'IA, de la plus récente à la plus ancienne.
2026
35 modèles- OpenAI lance GPT-6 Sol et GPT-6 LunaConçu avec les méthodes d'Astra, GPT-6 Sol offre une « fiabilité de niveau Astra » avec environ deux fois moins d'erreurs que GPT-5.6 Sol, tandis que Luna vise les tâches à fort volume et à faible coût ; tous deux coûtent moitié moins cher que la série 5.6.
- Anthropic publie Claude Opus 5.5Claude Opus 5.5 égale Fable 5.1 sur la plupart des tâches avec un contexte d'un million de tokens, est 30 % plus rapide, baisse ses prix d'API de 20 % à 4 $/20 $ par million de tokens et a obtenu 66,4 % sur Terminal-Bench 4.0, contre 57,9 % pour GPT-6 Astra.
- SpaceXAI publie Grok 4.7Grok 4.7 est passé à un modèle de base plus grand d'environ 2 100 milliards de paramètres, avec un apprentissage par renforcement plus long sur des tâches de plusieurs heures et un nouvel ensemble de garde-fous, au même tarif de 2 $/6 $ que Grok 4.6.
- Alibaba publie Qwen3.8-Omni-FlashQwen3.8-Omni-Flash est un modèle omnimodal accessible uniquement par API, doté d'un contexte d'un million de tokens, d'un raisonnement audio-vidéo natif et de l'utilisation d'outils, destiné aux applications agentiques.
- DeepSeek publie V4.1-Flash avec vision nativeDeepSeek-V4.1-Flash, le plus petit modèle de sa nouvelle famille d'architecture V4.1, a ajouté une compréhension visuelle multimodale native avec une inférence plus rapide et un débit plus élevé, disponible via l'API DeepSeek.
- OpenAI lance GPT-6 AstraGPT-6 Astra, dont OpenAI a dit qu'il marque probablement le début de l'AGI, s'est imposé en utilisation d'ordinateur, en codage et en science, et a été son premier modèle classé « Critical » en cybersécurité selon son Preparedness Framework ; il a d'abord été déployé en préversion limitée avant d'arriver dans les offres payantes de ChatGPT, l'API, Azure et AWS.
- Google lance Gemini 3.8 Flash et Gemini 3.8 Flash CyberTroisième version Flash de Google en six semaines, elle améliore l'ingénierie logicielle, les tâches agentiques et le raisonnement en plusieurs étapes par rapport à 3.7 Flash, aux côtés d'une variante Cyber réservée à des défenseurs agréés.
- Meta publie Muse Spark 1.3Muse Spark 1.3 a amélioré le codage agentique et les tâches de long terme tout en utilisant environ 20 % d'appels d'outils et environ 25 % de tokens en moins que la 1.2, et est disponible dans Muse Code et la Meta Model API, avec des poids fermés.
- Anthropic publie Claude Fable 5.1 et Mythos 5.1La deuxième génération de la gamme de classe Mythos d'Anthropic est arrivée trois mois après Fable 5, avec des lectures de cache moins chères réduisant les coûts habituels d'environ 25 % et des garde-fous générant 60 % de faux positifs en cybersécurité en moins ; Mythos 5.1 reste réservé aux programmes d'accès de confiance.
- DeepSeek V4-Pro sort de préversionDeepSeek a rendu V4-Pro disponible pour tous sur son application, son site web et son API avec le checkpoint V4-Pro-0813 axé sur les agents, prenant en charge un contexte d'un million de tokens et des sorties de 384 000 tokens.
- Google publie Gemini 3.7 FlashArrivé 23 jours après 3.6 Flash, Gemini 3.7 Flash est passé de 49 % à 65,3 % sur DeepSWE pour la moitié du prix de lancement, tandis que le Gemini 3.5 Pro promis restait retardé.
- SpaceXAI publie Grok 4.6Grok 4.6, conçu pour les agents de longue durée et le codage avec un contexte de 500 000 tokens, a égalé GPT-5.6 Sol sur l'Artificial Analysis Intelligence Index, à un point de Claude Fable 5.
- Meta publie Muse Spark 1.2 et l'agent de codage Muse CodeMeta Superintelligence Labs a livré Muse Spark 1.2, axé sur le codage, avec Muse Code, un agent de codage en terminal qui exécute des sous-agents en parallèle, puis s'est engagé à publier les poids de Muse Spark 1.2.
- Alibaba lance Qwen3.8-Max, un modèle phare de 2 400 milliards de paramètresQwen3.8-Max, un MoE nativement multimodal comptant 2 400 milliards de paramètres au total dont 95 milliards actifs, avec un contexte d'un million de tokens, est devenu le modèle le plus performant d'Alibaba, qui revendique des scores de benchmark rivalisant avec Anthropic.
- Anthropic publie Claude Opus 5Claude Opus 5 s'est approché des performances de pointe de Fable 5 pour moitié prix, a pris la tête du classement d'Artificial Analysis à son lancement et a ajouté un réglage de l'effort sélectionnable par l'utilisateur.
- Google lance Gemini 3.6 FlashGemini 3.6 Flash a amélioré ses scores en codage, en contexte long et en utilisation d'ordinateur tout en produisant environ 17 % de tokens de sortie en moins que 3.5 Flash, et a été lancé avec Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, axé sur la sécurité.
- OpenAI rend publics GPT-5.6 Sol, Terra et LunaAprès avoir réservé GPT-5.6 à des partenaires de confiance depuis le 26 juin à la demande du gouvernement américain, OpenAI a ouvert au public sa famille GPT-5.6 à trois niveaux, emmenée par le modèle phare Sol dédié au codage, à la science et à la cybersécurité.
- SpaceXAI publie Grok 4.5Grok 4.5, construit sur un modèle de base de 1 500 milliards de paramètres et présenté par Musk comme « de classe Opus » mais plus rapide et moins cher, a été lancé à 2 $/6 $ par million de tokens dans l'API de xAI, Grok Build et Cursor.
- Anthropic publie Claude Sonnet 5Présenté comme le Sonnet le plus agentique, Claude Sonnet 5 offre des performances proches d'Opus 4.8 pour un coût moindre, avec un contexte d'un million de tokens, et est devenu le modèle par défaut des utilisateurs Free et Pro.
- Anthropic publie Claude Fable 5, un modèle public de classe MythosAnthropic a lancé Claude Fable 5, son premier modèle de classe Mythos accessible à tous, doté de garde-fous qui basculent sur Opus 4.8 dans les domaines à haut risque, ainsi que Claude Mythos 5 pour des utilisateurs de cybersécurité agréés.
- Microsoft dévoile MAI-Thinking-1, son premier modèle de raisonnement phareÀ la Build 2026, Mustafa Suleyman a présenté sept modèles MAI maison emmenés par MAI-Thinking-1, un MoE d'environ 1 000 milliards de paramètres entraîné de zéro sans données d'OpenAI, qui selon Microsoft égale Opus 4.6 sur SWE-Bench Pro.
- Anthropic publie Claude Opus 4.8Opus 4.8 a progressé par rapport à Opus 4.7 au même prix, a pris la tête des benchmarks d'utilisation d'ordinateur et d'agents de navigation, a ajouté les workflows dynamiques dans Claude Code et a réduit des deux tiers le prix du mode Fast ; Anthropic a indiqué que l'accès aux modèles de classe Mythos n'était plus qu'à quelques semaines.
- Google I/O 2026 : Gemini 3.5 Flash et Gemini OmniGoogle a lancé Gemini 3.5 Flash, qui selon lui surpasse Gemini 3.1 Pro sur les benchmarks de codage et agentiques à la vitesse de Flash, a présenté les modèles Gemini Omni capables de générer de la vidéo et a livré Antigravity 2.0.
- DeepSeek publie une préversion de V4 avec un contexte d'un million de tokensDeepSeek a publié en open source V4-Pro (1 600 milliards de paramètres, dont 49 milliards actifs) et V4-Flash (284 milliards), qui s'appuient sur une nouvelle attention hybride compressée réduisant fortement le calcul en contexte long et le cache KV.Open source
- OpenAI publie GPT-5.5GPT-5.5 visait les tâches agentiques de long terme faisant appel à des outils et a été déployé auprès des utilisateurs payants de ChatGPT et de Codex, GPT-5.5 Pro et l'accès API suivant un jour plus tard.
- Anthropic publie Claude Opus 4.7Opus 4.7 a amélioré le codage agentique, la vision et le suivi des instructions au tarif d'Opus 4.6, Anthropic reconnaissant qu'il reste en deçà de Mythos, non publié.
- Meta Superintelligence Labs dévoile Muse SparkMuse Spark, premier modèle de MSL et premier modèle de pointe propriétaire de Meta, est un modèle de raisonnement nativement multimodal conçu en neuf mois sous la direction d'Alexandr Wang, qui fait tourner l'application Meta AI.
- Anthropic dévoile Claude Mythos Preview et le Project GlasswingAnthropic a révélé Claude Mythos Preview, un modèle d'un niveau supérieur à Opus qui a découvert de manière autonome des milliers de vulnérabilités zero-day, et l'a écarté d'une diffusion publique, le réservant aux défenseurs via le Project Glasswing avec des partenaires dont AWS, Apple, Google, Microsoft et Nvidia.
- Mistral publie Mistral Small 4Mistral Small 4, un MoE ouvert de 119 milliards de paramètres, a réuni dans un seul modèle le raisonnement de Magistral, la vision de Pixtral et le codage agentique de Devstral.Open source
- OpenAI lance GPT-5.4 Thinking et ProOpenAI a publié GPT-5.4, présenté comme son modèle de pointe le plus performant et le plus efficace pour le travail professionnel, avec un contexte allant jusqu'à un million de tokens dans l'API ; les variantes mini et nano ont suivi le 17 mars.
- Google publie Gemini 3.1 ProGemini 3.1 Pro a plus que doublé le score ARC-AGI-2 de Gemini 3 Pro, atteignant 77,1 % (vérifié), en visant le raisonnement complexe et les tâches agentiques de long terme.
- Anthropic publie Claude Sonnet 4.6Sonnet 4.6 a offert des performances proches d'Opus et un contexte d'un million de tokens au tarif de Sonnet, devenant le modèle par défaut des utilisateurs Free et Pro dans Claude et Cowork.
- Alibaba publie Qwen3.5, un modèle multimodal à poids ouvertsQwen3.5, un modèle vision-langage natif MoE clairsemé de 397 milliards de paramètres (17 milliards actifs) prenant en charge 201 langues, a été publié en poids ouverts aux côtés d'un Qwen3.5-Plus propriétaire, avec l'IA agentique en ligne de mire.Open source
- Anthropic publie Claude Opus 4.6Claude Opus 4.6 s'est imposé en codage agentique, utilisation d'ordinateur, recherche et finance, et a introduit une fenêtre de contexte d'un million de tokens ainsi que les équipes d'agents dans Claude Code.
- OpenAI publie GPT-5.3-CodexLancé quelques minutes après Opus 4.6, GPT-5.3-Codex a réuni les chaînes d'entraînement de Codex et de GPT-5 en un modèle d'agent de codage généraliste plus rapide et plus pilotable.
2025
35 modèles- Google fait de Gemini 3 Flash le modèle Gemini par défautGemini 3 Flash offre des performances proches de Gemini 3 Pro avec la latence et le coût d'un modèle Flash, et devient le modèle par défaut de l'app Gemini et du mode IA de Search.
- OpenAI lance GPT-5.2 après un « code rouge » interneOpenAI a publié GPT-5.2, en progrès sur les tâches professionnelles, la programmation et les contextes longs, quelques semaines après que Sam Altman a déclaré un « code rouge » pour répondre à Gemini 3 de Google.
- Mistral publie Mistral 3, une famille de modèles à poids ouvertsMistral a lancé Mistral Large 3, un MoE multimodal de 675 milliards de paramètres (41 milliards actifs), ainsi que les modèles denses Ministral 3 de 14, 8 et 3 milliards de paramètres, tous sous licence Apache 2.0.Open source
- DeepSeek publie V3.2 et V3.2-SpecialeDeepSeek a publié V3.2 sous licence MIT, son premier modèle intégrant la réflexion à l'utilisation d'outils, ainsi que V3.2-Speciale, gourmand en calcul, qui aurait selon l'entreprise atteint le niveau médaille d'or à l'IMO et à l'IOI 2025.
- Anthropic lance Claude Opus 4.5 à un prix 67 % plus basClaude Opus 4.5 a atteint 80,9 % sur SWE-bench Verified, devant GPT-5.1-Codex-Max et Gemini 3 Pro, tandis que le prix d'Opus est tombé à 5 $/25 $ par million de tokens.
- Google lance Nano Banana Pro (Gemini 3 Pro Image)Basé sur Gemini 3 Pro, Nano Banana Pro ajoute un rendu de texte multilingue lisible, une sortie en 4K, l'ancrage dans la recherche et la fusion de plusieurs images.
- Google lance Gemini 3 et la plateforme de programmation AntigravityGemini 3 Pro a établi des records sur Humanity's Last Exam et LMArena et a été intégré dès le premier jour à Search et à l'app Gemini, aux côtés du nouvel IDE agentique Google Antigravity.
- xAI lance Grok 4.1Grok 4.1 mise sur l'intelligence émotionnelle et la qualité de la conversation, prenant brièvement la première place de LMArena, avec une variante Grok 4.1 Fast dotée d'un contexte de 2 millions de tokens.
- OpenAI lance GPT-5.1 Instant et ThinkingGPT-5.1 a rendu ChatGPT plus chaleureux et plus attentif aux instructions, avec un raisonnement adaptatif et de nouveaux préréglages de personnalité, déployé auprès de tous les utilisateurs.
- Anthropic lance Claude Haiku 4.5Claude Haiku 4.5 égale Claude Sonnet 4 en programmation et en utilisation d'ordinateur pour un tiers du coût et plus de deux fois plus vite.
- Anthropic lance Claude Sonnet 4.5Claude Sonnet 4.5 a pris la tête sur SWE-bench Verified (77,2 %) et en utilisation d'ordinateur, a tenu des sessions de programmation autonome de 30 heures, et est sorti avec Claude Code 2.0 et le Claude Agent SDK.
- Alibaba lance Qwen3-Max, un modèle à mille milliards de paramètresLors de sa conférence Apsara, Alibaba Cloud a publié Qwen3-Max, son plus grand modèle, avec plus de 1 000 milliards de paramètres entraînés sur 36 000 milliards de tokens, axé sur le raisonnement, la programmation et les agents.
- Microsoft AI dévoile ses premiers modèles maison, MAI-1-preview et MAI-Voice-1Microsoft AI a présenté MAI-Voice-1, un modèle de génération vocale, et lancé les tests publics de MAI-1-preview, son premier modèle de fondation entraîné de bout en bout, signe d'une moindre dépendance à OpenAI.
- Google lance Gemini 2.5 Flash Image, alias « Nano Banana »Google a révélé que le modèle viral « nano-banana », en tête des classements d'édition d'images, était Gemini 2.5 Flash Image, qui offre des personnages cohérents, la fusion de plusieurs images et des retouches en langage naturel.
- DeepSeek publie V3.1, un modèle de réflexion hybrideDeepSeek-V3.1 a réuni les capacités de V3 et R1 dans un seul modèle MoE de 671 milliards de paramètres, avec des modes avec et sans réflexion commutables et des performances bien meilleures en agents et en utilisation d'outils.
- OpenAI lance GPT-5GPT-5 a réuni les modèles rapides et de raisonnement d'OpenAI derrière un routeur en temps réel, est devenu le modèle par défaut pour tous les utilisateurs de ChatGPT, y compris l'offre gratuite, et a établi de nouveaux records en programmation, en mathématiques et en santé.
- OpenAI publie gpt-oss, ses premiers modèles à poids ouverts depuis GPT-2OpenAI a publié gpt-oss-120b et gpt-oss-20b sous licence Apache 2.0 ; le plus grand modèle approche o4-mini sur les benchmarks de raisonnement et tourne sur un seul GPU de 80 Go.Open source
- Anthropic lance Claude Opus 4.1Claude Opus 4.1 améliore Opus 4 sur les tâches agentiques et la programmation en conditions réelles, atteignant 74,5 % sur SWE-bench Verified, à tarif inchangé.
- Alibaba publie Qwen3-Coder en open sourceAlibaba a publié Qwen3-Coder-480B-A35B, un modèle mixture-of-experts sous licence Apache 2.0 dédié à la programmation agentique avec un contexte de 256K, ainsi que l'outil en ligne de commande Qwen Code.Open source
- xAI lance Grok 4 et Grok 4 Heavy, en version multi-agentsxAI a publié Grok 4 et Grok 4 Heavy, une version multi-agents parallèle, revendiquant les meilleurs scores sur Humanity's Last Exam et ARC-AGI-2, ainsi qu'une offre SuperGrok Heavy à 300 $/mois.
- Gemini 2.5 Pro et Flash en disponibilité générale ; Flash-Lite en préversionGoogle a rendu Gemini 2.5 Pro et 2.5 Flash stables et disponibles pour tous, et a présenté en préversion Gemini 2.5 Flash-Lite, à faible coût et faible latence.
- Mistral lance Magistral, ses premiers modèles de raisonnementMistral AI a présenté Magistral, une famille de modèles de raisonnement comprenant Magistral Small, un modèle à poids ouverts de 24 milliards de paramètres (Apache 2.0), et Magistral Medium, destiné aux entreprises.
- OpenAI lance o3-pro et baisse les prix d'o3 de 80 %OpenAI a publié o3-pro, une version à plus forte puissance de calcul de son modèle de raisonnement o3, et baissé de 80 % le prix d'o3 dans l'API, à 2 $/8 $ par million de tokens.
- Anthropic lance Claude 4 Opus et Claude 4 SonnetClaude 4 Opus et Sonnet sortent avec des capacités de programmation et agentiques de rupture, établissant un nouvel état de l'art sur SWE-bench.
- Anthropic lance Claude Sonnet 4 et Claude Haiku 4Aux côtés de Claude Opus 4, Anthropic lance Sonnet 4 et Haiku 4, complétant la famille de modèles Claude 4.
- Google lance Gemini 2.5 FlashGemini 2.5 Flash sort avec des capacités de réflexion intégrées, optimisé pour la vitesse et la maîtrise des coûts.
- OpenAI lance les modèles de raisonnement o3 et o4-miniOpenAI lance o3 (version complète) et o4-mini, capables d'utiliser des outils, dont la navigation web, l'exécution de code et l'analyse de fichiers.
- Meta publie Llama 4 Scout et MaverickLa famille Llama 4 sort avec une architecture MoE : les modèles Scout (17 milliards de paramètres actifs / 109 milliards au total) et Maverick (17 milliards actifs / 400 milliards au total).Open source
- Google lance Gemini 2.5 Pro avec réflexionGemini 2.5 Pro sort en tant que modèle le plus performant de Google, avec des capacités de raisonnement intégrées et un mode réflexion.
- OpenAI lance la génération d'images native de GPT-4oGPT-4o gagne une capacité native de génération d'images intégrée directement au modèle, produisant des images très réalistes au texte fidèle.
- OpenAI publie GPT-4.5 en préversion de rechercheGPT-4.5 est publié comme le plus grand modèle sans raisonnement d'OpenAI, avec une intelligence émotionnelle accrue et moins d'hallucinations.
- Anthropic lance Claude 3.7 SonnetClaude 3.7 Sonnet est lancé comme modèle hybride doté d'une réflexion étendue optionnelle, alliant réponses rapides et raisonnement approfondi.
- xAI lance Grok 3Grok 3 sort en tant que modèle le plus performant de xAI, entraîné sur le supercalculateur Colossus doté de 200 000 GPU H100.
- DeepSeek lance le modèle de raisonnement R1Publication de DeepSeek R1, un modèle de raisonnement à poids ouverts aux performances équivalentes à o1. Il provoque un choc sur le marché mondial de l'IA et relance le débat sur les hypothèses de coût de l'IA.Open source
- OpenAI lance o3-minio3-mini arrive comme modèle de raisonnement économique, avec des niveaux d'effort de raisonnement réglables.
2024
33 modèles- DeepSeek publie le modèle ouvert V3DeepSeek V3 (MoE de 671 milliards de paramètres) est publié à poids ouverts ; son entraînement aurait coûté environ 5,5 millions de dollars, et il rivalise avec les meilleurs modèles propriétaires.Open source
- OpenAI annonce le modèle de raisonnement o3OpenAI présente en avant-première o3 et o3-mini, des modèles de raisonnement de nouvelle génération qui progressent fortement sur ARC-AGI et les benchmarks de mathématiques.
- Google lance les modèles Veo 2 (vidéo) et Imagen 3 (image)Google lance Veo 2 pour la génération de vidéos et une version améliorée d'Imagen 3 pour la création d'images de haute qualité.
- xAI publie un modèle Grok en open sourcexAI publie les poids du modèle de base Grok, l'un des rares modèles de pointe disponibles à poids ouverts.Open source
- Google lance Gemini 2.0 FlashGemini 2.0 Flash est publié avec l'utilisation native d'outils, des sorties multimodales et des performances supérieures à celles de 1.5 Pro.
- OpenAI lance la version complète d'o1La version complète du modèle o1 est déployée pour les utilisateurs de ChatGPT Plus, avec un raisonnement amélioré par rapport à la préversion.
- Alibaba publie Qwen 2.5 Coder et des mises à jour de Qwen 2.5 72B InstructPublication des modèles Qwen 2.5 Coder, à l'état de l'art de la génération de code en open source.Open source
- Anthropic lance un Claude 3.5 Sonnet amélioré et Claude 3.5 HaikuMise à jour de Claude 3.5 Sonnet, avec des progrès majeurs en code, et nouveau Claude 3.5 Haiku. La fonctionnalité Computer use est lancée en bêta publique.
- Meta lance Llama 3.2, avec vision et modèles légersLlama 3.2 comprend des modèles multimodaux de vision de 11B et 90B, ainsi que des modèles de texte légers de 1B et 3B pour les appareils en périphérie.Open source
- Alibaba lance la famille de modèles Qwen 2.5Qwen 2.5 est publié en plusieurs tailles (de 0.5B à 72B), avec de solides capacités en code et en mathématiques.Open source
- Mistral lance Mistral Small v2Une version mise à jour de Mistral Small, optimisée pour les charges à faible latence et qui suit mieux les instructions.
- Mistral lance Pixtral 12B, un modèle multimodalPixtral 12B est le premier modèle multimodal de Mistral, capable de traiter nativement le texte et les images.
- OpenAI lance le modèle de raisonnement o1OpenAI présente o1-preview et o1-mini, des modèles entraînés par apprentissage par renforcement à raisonner par chaîne de pensée avant de répondre.
- xAI lance Grok-2 et Grok-2 MiniGrok-2 arrive avec un raisonnement amélioré et rivalise avec les modèles de pointe sur les benchmarks.
- Mistral lance Mistral Large 2Mistral Large 2 (123 milliards de paramètres) est publié avec de solides capacités en code et en multilingue.
- Meta lance Llama 3.1 avec un modèle de 405BPublication de la famille Llama 3.1, dont le modèle de 405 milliards de paramètres, alors le plus grand modèle à poids ouverts.Open source
- OpenAI lance GPT-4o miniUn petit modèle abordable qui remplace GPT-3.5 Turbo avec des performances nettement supérieures.
- Mistral lance Mistral NeMo 12B avec NVIDIAUn modèle de 12 milliards de paramètres développé avec NVIDIA, sous licence Apache 2.0, avec un contexte de 128 000 tokens.Open source
- Google rend Gemini 1.5 Flash et Pro disponibles pour tousLes modèles Gemini 1.5, avec un contexte de 2 millions de tokens et une latence et un coût optimisés, deviennent disponibles pour tous.
- Google publie les modèles ouverts Gemma 2Les modèles Gemma 2 (9B, 27B) sont publiés avec des performances et une efficacité améliorées.Open source
- Anthropic lance Claude 3.5 SonnetClaude 3.5 Sonnet est publié et surpasse Claude 3 Opus, plus rapidement et à moindre coût.
- DeepSeek publie Coder V2Le modèle ouvert DeepSeek Coder V2 prend en charge 338 langages de programmation et un contexte de 128K, rivalisant avec GPT-4 Turbo en programmation.Open source
- DeepSeek lance V2, un modèle MoEPublication à poids ouverts de DeepSeek V2, un modèle mixture-of-experts.Open source
- Alibaba publie la famille de modèles Qwen 2Qwen 2 sort avec des modèles de 0,5 à 72 milliards de paramètres, un solide support multilingue et des performances compétitives.Open source
- OpenAI lance GPT-4oDévoilement de GPT-4o, un modèle multimodal doté de la voix et de la vision en temps réel.
- Microsoft publie les petits modèles de langage Phi-3Les modèles Phi-3 Mini, Small et Medium sont publiés et affichent de solides performances à petite échelle.
- Meta lance Llama 3 (8B et 70B)La famille de modèles à poids ouverts Llama 3 est annoncée avec de meilleurs résultats sur les benchmarks.Open source
- xAI annonce Grok-1.5Grok-1.5, doté d'un contexte long, est déployé pour le chatbot de xAI.
- Anthropic lance les modèles Claude 3Claude 3 Opus, Sonnet et Haiku sont publiés, avec de solides capacités de raisonnement et de vision.
- Mistral lance Mistral Large et Le ChatLe modèle phare Mistral Large est lancé en même temps que l'assistant conversationnel Le Chat.
- Google publie les modèles ouverts GemmaLes modèles ouverts Gemma 2B et 7B sont publiés avec des conditions favorables à un usage commercial.Open source
- Google annonce Gemini 1.5 avec un contexte d'un million de tokensGemini 1.5 Pro est annoncé avec une fenêtre de contexte inédite d'un million de tokens, grâce à une architecture mixture-of-experts.
- Alibaba lance les modèles Qwen 1.5La famille Qwen 1.5 (de 0.5B à 72B) est publiée avec une prise en charge multilingue et des performances améliorées.Open source
2023
11 modèles- Mistral lance Mixtral 8x7BUn modèle MoE à poids ouverts aux excellents résultats sur les benchmarks, sous licence Apache 2.0.Open source
- Google lance Gemini 1.0Gemini Ultra, Pro et Nano sont annoncés comme modèles multimodaux pour Bard et les Pixel.
- Meta publie en open source SeamlessExpressive et SeamlessStreamingDes modèles de traduction vocale en temps réel publiés avec leur code et leurs poids.Open source
- OpenAI publie Whisper v3 et GPT-4 TurboLors du DevDay, OpenAI lance GPT-4 Turbo avec un contexte de 128k, Whisper v3 et les GPT personnalisés.
- Mistral AI lance Mistral 7BPremier modèle dense Mistral 7B à poids ouverts, très performant pour sa taille.Open source
- OpenAI dévoile DALL-E 3Un nouveau modèle d'image avec rédaction des prompts intégrée à ChatGPT et une meilleure fidélité.
- Meta publie SeamlessM4TUn modèle de traduction multimodal pour la parole et le texte, ouvert à la recherche.Open source
- Meta et Microsoft lancent Llama 2Les modèles ouverts Llama 2 (7B à 70B) sont publiés pour la recherche et un usage commercial.Open source
- Anthropic lance Claude 2Claude 2 fait ses débuts avec un raisonnement amélioré et un contexte de 100 000 tokens.
- Google annonce PaLM 2PaLM 2 est dévoilé à la Google I/O pour alimenter Bard et des fonctionnalités de Workspace.
- OpenAI lance GPT-4Annonce du modèle multimodal GPT-4, disponible via l'API et intégré à ChatGPT Plus.