Les intemporels · 2017 → aujourd'hui
30 papers et événements pour comprendre l'IA d'aujourd'hui.
Si tu pars de zéro et que tu veux comprendre comment on en est arrivé là, voici les jalons à connaître. Trente moments fondamentaux entre 2017 et aujourd'hui : des papers qui ont changé la recherche, des produits qui ont changé l'industrie, et quelques événements qui ont changé le débat public. Fais défiler : la frise avance avec toi, et sa densité raconte l'accélération.
- RechercheJuin 2017Google Brain
« Attention Is All You Need »
Introduit l’architecture Transformer, qui a remplacé les RNN et LSTM dans le traitement du langage. C’est la base de tous les LLM modernes : GPT, Claude, Gemini, Mistral. Un seul papier, une révolution.
Lire la sourcearxiv.org/abs/1706.03762 - RechercheOctobre 2018Google
BERT : les Transformers entrent en production
Premier grand modèle de langage pré-entraîné réellement utile en production. A dominé tous les benchmarks NLP pendant des années et reste la base de Google Search aujourd’hui.
Lire la sourcearxiv.org/abs/1810.04805 - RechercheJanvier 2020OpenAI (Kaplan et al.)
Scaling Laws : plus gros, c’est prévisible
Démontre mathématiquement que les performances des LLM augmentent de façon prévisible avec la taille du modèle, des données et du compute. C’est ce papier qui a justifié les budgets d’entraînement à plusieurs centaines de millions.
Lire la sourcearxiv.org/abs/2001.08361 - RechercheMai 2020OpenAI
GPT-3 : les capacités émergentes
175 milliards de paramètres. Premier modèle à montrer des capacités émergentes : il apprend une nouvelle tâche à partir de quelques exemples dans le prompt, sans entraînement supplémentaire.
Lire la sourcearxiv.org/abs/2005.14165 - RechercheDécembre 2020DeepMind
AlphaFold 2 : le repliement des protéines
Résout, avec une précision quasi-expérimentale, un problème ouvert depuis 50 ans en biologie : prédire la structure 3D d’une protéine à partir de sa séquence. Demis Hassabis et John Jumper ont reçu le prix Nobel de chimie 2024 pour ce travail.
Lire la sourceNature, 2021 - ProduitJanvier 2021OpenAI
DALL-E : l’image générée à partir de texte
Premier modèle text-to-image grand public à montrer des résultats spectaculaires. A ouvert la voie à Stable Diffusion, Midjourney et toute la génération créative qui a suivi.
Lire la sourceopenai.com - ProduitJuin 2021GitHub + OpenAI (Codex)
GitHub Copilot : premier assistant de code grand public
Premier IDE-assistant déployé à grande échelle. Marque le début de la programmation assistée par IA, qui aboutira au « vibe coding » de 2025 avec Cursor et Claude Code.
Lire la sourcegithub.blog - RechercheMars 2022DeepMind
Chinchilla : le bon ratio paramètres / données
Corrige les lois de Kaplan : pour un budget de compute donné, il est plus efficace d’entraîner un modèle plus petit sur plus de données qu’un modèle géant sur peu de données. Tous les LLM post-2022 suivent ce ratio.
Lire la sourcearxiv.org/abs/2203.15556 - ProduitAoût 2022Stability AI / CompVis
Stable Diffusion : le text-to-image open-source
Premier modèle text-to-image puissant publié en open-source. Démocratise massivement la génération d’images : tout le monde peut le faire tourner sur son GPU. Lance l’écosystème de l’image IA libre.
Lire la sourcestability.ai - Produit30 novembre 2022OpenAI
ChatGPT : l’IA entre dans la culture populaire
100 millions d’utilisateurs en deux mois, le produit grand public qui a connu la plus rapide adoption de l’histoire. Le moment où l’IA cesse d’être un sujet technique et devient un sujet de société.
Lire la sourceopenai.com - RechercheDécembre 2022Anthropic
Constitutional AI : le RLHF augmenté par une IA
Méthode d’alignement des modèles qui remplace une partie du feedback humain par des principes écrits (la « constitution »). Base de l’entraînement de Claude. Plus scalable que le RLHF classique.
Lire la sourcearxiv.org/abs/2212.08073 - ProduitFévrier 2023Meta
LLaMA : naissance de l’écosystème ouvert
Premier modèle open-weights compétitif avec GPT-3. Initialement leaké, puis officiellement ouvert avec LLaMA 2. Lance toute la galaxie des LLM ouverts qui font tourner l’IA hors des grands clouds.
Lire la sourceai.meta.com - ProduitMars 2023OpenAI
GPT-4 : le premier LLM mature
Multimodal, score top 10% au barreau américain, raisonnement transparent supérieur. Première fois qu’un LLM atteint un niveau professionnel sur un large éventail de tâches. Le standard auquel se sont mesurés tous les modèles suivants.
Lire la sourceopenai.com - ProduitSeptembre 2023Mistral AI
Mistral 7B : la France entre dans la course
Premier modèle ouvert européen compétitif au niveau mondial. 7 milliards de paramètres, performances dignes de modèles deux fois plus gros. Lance la souveraineté IA européenne.
Lire la sourcemistral.ai - ProduitMars 2024Anthropic
Claude 3 : Anthropic dépasse OpenAI
Première fois qu’un modèle non-OpenAI dépasse GPT-4 sur la plupart des benchmarks. Ouvre une vraie compétition au sommet et installe Claude comme alternative crédible pour les usages professionnels.
Lire la sourceanthropic.com - ÉvénementAoût 2024Union européenne
AI Act : premier cadre réglementaire mondial
Premier règlement contraignant sur l’IA dans le monde. Classifie les systèmes par niveau de risque (inacceptable, élevé, limité, minimal) avec des obligations correspondantes. Effet Bruxelles : devient une référence pour les régulateurs partout dans le monde.
Lire la sourceartificialintelligenceact.eu - ProduitSeptembre 2024OpenAI
OpenAI o1 : le scaling au temps d’inférence
Premier modèle de raisonnement grand public. Au lieu de répondre instantanément, il « réfléchit » plusieurs minutes en générant une chaîne de pensée interne. Ouvre un nouveau paradigme : on peut améliorer les performances en investissant plus de calcul à l’inférence, pas seulement à l’entraînement.
Lire la sourceopenai.com - ÉvénementOctobre 2024Académie royale des sciences de Suède
Les prix Nobel consacrent l’IA
Physique pour John Hopfield et Geoffrey Hinton (réseaux de neurones), chimie pour Demis Hassabis, John Jumper (AlphaFold) et David Baker. En 48 heures, la plus haute institution scientifique reconnaît l’IA comme science fondamentale, et comme instrument de découverte.
Lire la sourcenobelprize.org - ProduitOctobre 2024Anthropic
Computer Use : l’âge des agents commence
Premier modèle grand public capable de contrôler un ordinateur (souris, clavier, screenshots) pour accomplir des tâches en autonomie. Marque le passage du LLM-assistant au LLM-agent qui agit dans le monde numérique.
Lire la sourceanthropic.com - ProduitNovembre 2024Anthropic
MCP : le standard qui connecte les agents au monde
Protocole ouvert qui standardise la connexion entre un modèle et des outils, des données, des applications. Adopté en quelques mois par OpenAI, Google et Microsoft, le « USB-C de l’IA » devient l’infrastructure invisible de l’économie des agents.
Lire la sourceanthropic.com - ProduitDécembre 2024OpenAI
Sora : le text-to-video à qualité cinéma
Premier modèle text-to-video à produire des vidéos longues, cohérentes et photoréalistes. Démontre que les modèles de diffusion peuvent capturer non seulement des images mais aussi la dynamique du monde réel.
Lire la sourceopenai.com - Produit20 janvier 2025DeepSeek
DeepSeek R1 : le choc open-source chinois
Modèle de raisonnement chinois en open-weights, performance comparable à OpenAI o1, à un coût d’entraînement supposé bien plus faible. Provoque la plus forte chute boursière de Nvidia en une journée. Confirme que l’open-source rattrape les leaders propriétaires.
Lire la sourcedeepseek.com - Événement21 janvier 2025OpenAI, SoftBank, Oracle
Stargate : 500 milliards pour le compute
Le lendemain de DeepSeek R1, l’Amérique annonce à la Maison-Blanche 500 milliards de dollars de data centers en quatre ans. L’IA change d’échelle et devient une affaire d’infrastructure nationale, d’énergie et de béton.
Lire la sourceopenai.com - ÉvénementFévrier 2025France + Inde (co-présidence)
Sommet de Paris : la bascule géopolitique
Une soixantaine d’États signent la déclaration finale, mais les États-Unis et le Royaume-Uni refusent. Le discours mondial bascule officiellement de la prudence (Bletchley 2023) à la course : « plug, baby, plug », et 109 milliards d’euros d’investissements annoncés pour la France.
Lire la sourceelysee.fr - ProduitFévrier 2025Anthropic
Claude Code et le « vibe coding »
Début février, Andrej Karpathy invente l’expression « vibe coding » ; trois semaines plus tard, Anthropic publie Claude Code, l’agent qui développe en autonomie depuis le terminal. On décrit, l’agent implémente. Collins en fera le mot de l’année 2025.
Lire la sourceanthropic.com - ProduitMai 2025Google DeepMind
Veo 3 : la vidéo générée, avec le son
Première génération vidéo grand public avec bande-son native : dialogues, bruitages, ambiances synchronisés. Les clips deviennent difficiles à distinguer du réel et envahissent les réseaux. L’ère du contenu synthétique de masse commence.
Lire la sourcedeepmind.google - ÉvénementJuillet 2025OpenAI + Google DeepMind
Médaille d’or aux Olympiades de mathématiques
Des modèles de raisonnement généralistes atteignent le niveau or aux IMO 2025 (35/42), en langage naturel et dans le temps imparti. Un an plus tôt, il fallait encore des systèmes formels spécialisés pour décrocher l’argent. La frontière mathématique tombe plus vite que prévu.
Lire la sourcedeepmind.google - Produit7 août 2025OpenAI
GPT-5 : le raisonnement pour tout le monde
Le lancement le plus attendu de l’histoire de l’IA. Un système unifié route chaque requête entre réponse rapide et réflexion profonde, et amène le raisonnement aux 700 millions d’utilisateurs hebdomadaires de ChatGPT, gratuitement. L’accueil mitigé révèle au passage l’attachement du public à « son » modèle.
Lire la sourceopenai.com - ProduitNovembre 2025Google
Gemini 3 : Google reprend la tête
Après trois ans à courir derrière OpenAI, Google aligne le meilleur modèle sur la plupart des benchmarks et le branche dès le premier jour dans son moteur de recherche. La leçon : à performances comparables, c’est la distribution qui devient l’arme décisive.
Lire la sourceblog.google - Produit9 juin 2026Anthropic
Claude 5 : la classe Mythos, un cran au-dessus d’Opus
Fable 5 et Mythos 5 inaugurent une classe de modèles au-dessus d’Opus : état de l’art sur pratiquement tous les benchmarks. La version intégrale (Mythos) est réservée à des organisations approuvées, la version publique (Fable) embarque des garde-fous renforcés : l’accès différencié devient la norme de sécurité de l’industrie.
Lire la sourceanthropic.com
La suite, chaque jeudi.
La frise s'arrête à aujourd'hui ; l'histoire, non. Hypernews IA documente les nouvelles étapes en temps réel. Pour ne rater aucun jalon, inscris-toi.
S'inscrire gratuitement