Les dernières avancées en intelligence artificielle
Cursor a déployé trois changements en une semaine. Les plugins Google Workspace permettent aux agents de lire, d'écrire et d'agir dans Gmail, Drive et Calendar. Cursor pour iPad est arrivé sur tous les forfaits payants avec des discussions épinglées dans la barre latérale pour surveiller plusieurs agents à la fois. Cursor Start a été lancé à 649 Rs par mois pour les développeurs indiens, avec notamment Grok 4.5 et Composer.
DeepSeek a publié la version 0731 de V4-Flash à 0,14 $ par million de tokens en entrée et 0,28 $ en sortie, avec une fenêtre de contexte de 1M et des modes réflexion et non-réflexion. Les hits de cache coûtent 0,0028 $ par million. La documentation tarifaire comporte un avertissement explicite : DeepSeek prévoit d'augmenter les prix de son API, avec une hausse importante attendue.
OpenAI a fait baisser le prix de GPT-5.6 Luna à 0,20 $ par million de tokens en entrée et 1,20 $ par million de tokens en sortie. Luna avait été lancé à 1 $ par million de tokens en entrée, ce qui représente donc une baisse de 80 %. Le reste de la famille reste inchangé, avec Terra à 2 $/12 $ et Sol à 5 $/30 $ par million de tokens.
Anthropic a révélé ce qu'elle a découvert en examinant trois incidents réels mis en évidence par ses évaluations de cybersécurité. Cette publication s'inscrit dans le cadre du reporting continu de l'entreprise en matière de sécurité, et non d'une annonce de produit.
Google a ouvert la préversion publique de Gemini Robotics ER 2 avec deux points de terminaison : gemini-robotics-er-2-preview pour le raisonnement spatial avancé et la coordination multi-robots, et une variante en streaming optimisée pour un usage en temps réel via la Live API. La génération précédente, gemini-robotics-er-1.6-preview, sera arrêtée le 31 août 2026.
Anthropic a publié une déclaration précisant sa position sur les modèles à poids ouverts. Le même jour, l'entreprise a étendu sa collaboration avec Cognizant pour déployer Claude auprès de clients grands comptes.
Anthropic a lancé Claude Opus 5 le 24 juillet. Il apporte un codage agentique et Computer Use de niveau frontière tout en conservant le prix Opus : 5 $ par million de tokens en entrée et 25 $ en sortie — moitié moins cher que Claude Fable 5. Opus 5 dispose d'une fenêtre de contexte de 1 M de tokens, jusqu'à 128K en sortie, le raisonnement activé par défaut et des connaissances arrêtées en mai 2026. Il devient le modèle par défaut de Claude Max et le plus puissant de Claude Pro.
Le 22 juillet, AMD et Anthropic ont annoncé un partenariat stratégique pour déployer jusqu'à deux gigawatts de GPU AMD Instinct série MI450, le premier gigawatt étant opérationnel au premier semestre 2027. AMD compte investir jusqu'à 5 milliards de dollars dans Anthropic, tandis qu'Anthropic s'engage à acheter des dizaines de milliards de dollars de puces serveur pour l'IA. Les deux ont aussi lancé une collaboration d'ingénierie où Claude optimise les charges Instinct et le logiciel ROCm — un défi direct à la domination de Nvidia sur l'infrastructure IA.
Google a fait passer gemini-3.6-flash et gemini-3.5-flash-lite en disponibilité générale. 3.6 Flash apporte une meilleure efficacité en tokens et des capacités renforcées en code et en planification agentique, à un prix inférieur ; Flash-Lite vise les tâches de sous-agents à faible latence. Ces sorties s'accompagnent d'un changement majeur : temperature, top_p et top_k sont dépréciés pour les deux modèles.
Le Gemini 3.5 Pro de Google — présenté à l'I/O en mai avec une fenêtre de contexte de 2 M de tokens et une couche de raisonnement Deep Think — a de nouveau glissé à la mi-juillet. Après avoir visé un lancement le 17 juillet, Google l'aurait reporté lorsque le modèle a manqué ses objectifs internes de qualité sur les taux d'hallucination et la fiabilité réelle, DeepMind ayant, dit-on, abandonné et reconstruit le modèle de base. Le plus rapide Gemini 3.5 Flash reste le modèle stable actuel de Google.
Le 16 juillet, la Commission européenne a rendu deux décisions contraignantes au titre du Digital Markets Act obligeant Google à donner aux assistants IA concurrents un accès égal à Android. Google doit ouvrir 11 fonctionnalités système aux IA tierces — dont l'accès aux modèles sur l'appareil, l'exécution de tâches en arrière-plan et le contexte d'écran à parité avec Gemini — la plupart des changements d'ici août 2027. Une seconde décision oblige Google à partager des données de recherche anonymisées avec les moteurs et chatbots rivaux dès janvier 2027. Google s'y oppose fermement, invoquant des risques de sécurité.
Le 16 juillet, la société chinoise Moonshot AI a publié Kimi K3, un modèle ouvert Mixture-of-Experts de 2 800 milliards de paramètres avec une fenêtre de contexte de 1 M de tokens — le plus grand modèle à poids ouverts jamais diffusé. En quelques heures, il a débuté à la 1re place de la Frontend Code Arena de LMArena avec un score de 1679, dépassant Claude Fable 5 sur le benchmark qui mesure le plus directement la valeur du code en production. Signe que les modèles ouverts chinois rivalisent désormais à la frontière malgré les limites américaines à l'export de puces.
Le 9 juillet, OpenAI a lancé publiquement sa famille GPT-5.6 en trois niveaux : Sol (le modèle haut de gamme), Terra (intermédiaire) et Luna (rapide et bon marché). Sam Altman a affirmé que Sol est environ 54% plus efficace en tokens pour le code que la génération précédente. Avec les modèles, OpenAI a lancé ChatGPT Work — un agent conçu pour accomplir des tâches entières plutôt que de simplement répondre — et GPT-Live, un mode vocal full-duplex qui écoute et parle en même temps.
Le 24 juin, Google a ajouté Computer Use à Gemini 3.5 Flash : le modèle peut piloter l'interface d'un ordinateur — cliquer, saisir et naviguer dans les applications — pour accomplir des tâches en tant qu'agent autonome. Cela apporte l'automatisation d'interface agentique au modèle stable le plus rapide de Google. Le Gemini 3.5 Pro plus puissant, doté du raisonnement Deep Think et d'une fenêtre de contexte de 2 millions de tokens, reste attendu en juillet.
Anthropic a lancé Claude Fable 5 le 9 juin — le premier modèle de classe Mythos disponible publiquement. Performances de pointe sur presque tous les benchmarks testés : ingénierie logicielle, vision, recherche scientifique et exécution autonome de tâches. Simultanément, Claude Mythos 5 a été lancé avec un accès restreint pour les organisations approuvées dans le domaine de la cybersécurité gouvernementale. Gratuit jusqu'au 22 juin pour les abonnés Pro, Max, Team et Enterprise ; à partir du 23 juin — $10/$50 par million de tokens.
Tous les plans GitHub Copilot ont basculé vers une facturation à l'usage le 1er juin. Le coût de chaque interaction dépend désormais du modèle utilisé et des tokens consommés. Nouvelle monnaie : GitHub AI Credits (1 crédit = 0,01 $). Le plan Pro inclut 1 500 crédits par mois, Pro+ inclut 7 000 (39 $/mois), Max inclut 20 000. Les clients Business et Enterprise bénéficient de crédits supplémentaires pendant la période de transition jusqu'au 1er septembre 2026.
Anthropic a levé 65 milliards de dollars lors d'un tour de table Série H à une valorisation post-money de 965 milliards, mené par Altimeter, Dragoneer, Greenoaks et Sequoia. Le 1er juin la société a déposé confidentiellement un formulaire S-1 en vue d'une introduction en bourse. Le chiffre d'affaires annualisé a atteint environ 47 milliards en mai 2026, dépassant OpenAI (environ 852 milliards) et faisant d'Anthropic la startup IA la plus valorisée de l'histoire.
Anthropic lance Opus 4.8 seulement 41 jours après 4.7. Le score USAMO 2026 passe de 69,3% à 96,7%. Dynamic Workflows dans Claude Code lance jusqu à 1 000 sous-agents en parallèle pour des tâches à l échelle du dépôt. Le mode Fast passe de 30/150 $ à 10/50 $ par million de tokens, soit une réduction de 3x. Prix de base inchangé: 5/25 $ par million de tokens.
ByteDance a dévoilé des plans pour dépenser jusqu à 70 milliards de dollars en centres de données IA en 2026, soit près du triple des 25 milliards de 2025. La société prévoit de financer ces dépenses sur ses bénéfices propres, environ 50 milliards de dollars en 2025. Ce chiffre place ByteDance au même niveau que Microsoft et Google en termes de dépenses d investissement dans l IA.
Andrej Karpathy, cofondateur d OpenAI et ancien responsable IA chez Tesla, a rejoint Anthropic. Il crée une nouvelle équipe chargée d utiliser Claude lui-même pour accélérer la recherche sur le préentraînement. Il travaille sous la direction de Nick Joseph, responsable du préentraînement. Le recrutement est perçu comme un signal fort de la dynamique croissante d Anthropic pour attirer les meilleurs talents.
Le I/O de Google le plus riche en produits depuis des années. Gemini 3.5 Flash remplace le flagship précédent à la vitesse Flash pour $1,50/1M tokens. Gemini Spark se lance comme agent personnel proactif 24/7 sur des VMs cloud. Les lunettes Android XR avec un vrai écran arrivent en test. Google AI Ultra remplace le plan à $250/mois pour $100/mois.
Un jury fédéral de Californie a rejeté à l'unanimité toutes les demandes dans le procès de $150 milliards d'Elon Musk contre OpenAI et Sam Altman. Verdict en moins de deux heures : la prescription était expirée. Musk a annoncé son intention de faire appel.
Cursor a lancé Composer 2.5, propulsé par Kimi K2.5, atteignant ~63% sur SWE-Bench — équivalent à Claude Opus 4.7 — à $0,50/tâche contre $7/tâche pour Opus. Inclut des environnements d'agents cloud multi-repo, une configuration Dockerfile et des journaux d'audit d'entreprise.
OpenAI et Dell Technologies se sont associés pour déployer Codex dans des environnements d'entreprise hybrides et on-premises via la Dell AI Data Platform — le premier accord de distribution on-prem explicite d'OpenAI. Codex compte désormais plus de 4M de développeurs actifs par semaine.
Google I/O 2026 ouvre cette semaine, avec l'annonce d'un nouveau modèle Gemini attendue pour le 19 mai. Google a laissé entendre des mises à jour majeures dans toute la gamme Gemini ainsi que dans l'ensemble de son portefeuille de produits d'IA. Cet événement fait suite au Google Android Show 2026, au cours duquel a été annoncé Gemini Intelligence, destiné à l'automatisation de tâches multi-étapes sur Android.
HeyGen a mis fin à ses forfaits historiques de vidéos avatar illimitées le 15 mai 2026. Tous les nouveaux abonnements HeyGen fonctionnent désormais sur un système de crédits. Avatar V, capable de produire un rendu de qualité studio à partir de 15 secondes de vidéo, ainsi que l'intégration de Seedance 2.0, ont été lancés en même temps que cette restructuration tarifaire.
AWS a bloqué les nouvelles inscriptions au plugin IDE Amazon Q Developer à partir du 15 mai 2026, annonçant son remplaçant : Kiro, un IDE agentique piloté par spécifications. Kiro utilise les « Specs » (exigences en langage naturel qui pilotent l'implémentation complète) et les « Hooks » (déclencheurs automatiques à l'enregistrement d'un fichier ou lors d'un commit). Le support du plugin IDE prendra fin le 30 avril 2027.
Cursor 3.4 introduit des environnements de développement agentiques : les agents provisionnent désormais des environnements définis par Dockerfile, travaillent simultanément sur plusieurs dépôts et s'exécutent en parallèle. Cursor 3.3 avait ajouté la revue de PR directement dans l'éditeur. BugBot passera à une facturation à l'usage à partir de juin 2026.
Lors du Google Android Show 2026, Google a annoncé Gemini Intelligence, une nouvelle couche logicielle qui automatise des tâches multi-étapes comme les achats, les réservations et la gestion de l'agenda directement sur les appareils Android. Cette fonctionnalité arrivera sur les téléphones Samsung et Google à l'été 2026. Google a également annoncé Googlebooks, de nouveaux ordinateurs portables sous Android signés Acer, ASUS et Lenovo, avec Gemini intégré.
Notion a lancé Developer Platform 3.5 le 13 mai 2026. Le runtime Workers permet aux développeurs de déployer une logique JavaScript sans serveur au sein de Notion. Database Sync permet des connexions bidirectionnelles avec des bases de données externes. Les webhooks bidirectionnels permettent à Notion de recevoir et d'envoyer des événements. Le mode Plan permet à des agents IA autonomes d'exécuter des tâches multi-étapes au sein des workflows Notion.
OpenAI a officiellement retiré DALL-E 2 et DALL-E 3 le 12 mai 2026. Les deux modèles sont remplacés par gpt-image-2, qui alimente ChatGPT Images 2.0 avec une résolution native de 2K, un rendu de texte multilingue et jusqu'à 8 images par requête en mode réflexion.
Krea AI a lancé son modèle fondamental Krea 2, conçu entièrement à partir de zéro avec un accent sur l'esthétique et le transfert de style. Ce lancement s'accompagne de Krea Nodes (créer des workflows d'image à partir de descriptions textuelles) et de Krea Edit (édition par région, reéclairage, expansion d'image). Seedance 2.0 est désormais disponible sur tous les forfaits payants.
Kling AI a lancé la v3.5 avec une sortie native en 1080p/60ips, une durée de clip en niveau Pro étendue jusqu'à 2 minutes (la génération unique la plus longue disponible), et une physique de mouvement améliorée pour la dynamique des fluides et la simulation de tissus. Kuaishou étudie la possibilité de scinder Kling AI en une société indépendante, avec une valorisation d'environ 20 milliards de dollars.
Figma a lancé un serveur MCP (Model Context Protocol) permettant à des agents IA comme Cursor et Claude de créer et modifier des designs directement sur le canevas de Figma. Les outils d'image IA intégrés comprennent désormais Vectorize, Remove Background, Erase et Expand, supprimant le besoin d'exporter vers Photoshop. La saisie vocale et le texte sur tracé sont également désormais disponibles.
Luma AI a lancé Ray3.14 avec une sortie vidéo en 1080p natif (sans upscaling), une vitesse de génération 4x plus rapide que Ray2, et un coût par seconde générée 3x inférieur. Les Character Seeds permettent de conserver une apparence de personnage cohérente sur plusieurs clips. La fonction Modify with Instructions permet des modifications post-génération guidées par texte, sans régénération complète.
Midjourney V8.1 propose une sortie en résolution native 2K, une vitesse de génération 3 à 4 fois plus rapide que V7, ainsi qu'un mode Raw pour une interprétation plus littérale des prompts. Les profils publics permettent aux créateurs de partager leurs œuvres sur les réseaux sociaux. Midjourney TV fait ses débuts sous forme de flux en temps réel des créations de la communauté. La version V8.2 a été annoncée comme prochaine mise à jour.
Pika 2.5 élimine les artefacts de scintillement et assure une apparence stable des personnages d'une scène à l'autre. PikaStream 1.0 lance un chat vidéo IA en temps réel : les utilisateurs échangent en direct avec des agents IA incarnés par des personnages vidéo générés. Pika étend son offre vers une plateforme d'application vidéo sociale basée sur l'IA, combinant création, partage et interaction IA en temps réel.
Le Centre pour les Standards et l'Innovation en IA du NIST a annoncé des accords avec Microsoft, Google et xAI pour évaluer les modèles d'IA non publiés pour les risques de sécurité nationale avant le lancement. Cette initiative a été motivée par le modèle restreint Mythos d'Anthropic. Anthropic est notamment absente de l'accord.
OpenAI a remplacé GPT-5.3 Instant par GPT-5.5 Instant comme modèle par défaut dans ChatGPT. Le nouveau modèle réduit les hallucinations de 52,5 % sur les requêtes à fort enjeu et intègre la mémoire des conversations passées, de Gmail et des fichiers enregistrés pour les utilisateurs Plus et Pro.
La plateforme musicale IA Suno est en train de lever une série D à une valorisation de 5 milliards de dollars, plus du double de sa valorisation de novembre 2025, qui était de 2,45 milliards de dollars. L'entreprise compte désormais 2 millions d'abonnés payants et génère 7 millions de morceaux par jour.
Novo Nordisk a annoncé un partenariat stratégique avec OpenAI pour intégrer l'IA dans la découverte de médicaments, les essais cliniques, la fabrication, les chaînes d'approvisionnement et les opérations commerciales. L'accord vise à accélérer de nouveaux traitements contre l'obésité et le diabète.
Anthropic a développé un nouveau modèle frontier appelé Mythos que l'entreprise dit être «bien en avance» sur tous les autres modèles en capacité de cybersécurité. En raison des risques, Anthropic restreint l'accès à un groupe sélect d'organisations vérifiées. Le modèle a amené la Maison Blanche à commencer à envisager un processus formel d'évaluation de l'IA.
Le Model Context Protocol (MCP) d'Anthropic a dépassé 97 millions d'installations en mars 2026, passant d'un standard expérimental à une infrastructure fondamentale pour la construction d'agents d'IA. Chaque grand fournisseur d'IA propose désormais des outils compatibles MCP.
Gemini 3.1 Pro de Google s'est imposé comme le leader global des benchmarks dans les évaluations indépendantes, dominant 13 des 16 principaux benchmarks. Scores clés : 80,6% sur SWE-bench, 94,3% sur GPQA Diamond (le plus élevé de tout modèle), fenêtre de contexte de 2M tokens sur texte, image, audio et vidéo.
Mistral a publié Small 4, un modèle open-source de 119 milliards de paramètres avec une fenêtre contextuelle de 256k, un raisonnement configurable et des capacités multimodales (vision). Il combine l'exécution d'instructions rapide, le raisonnement approfondi et la compréhension des images dans un seul modèle unifié sous licence ouverte.
Microsoft et OpenAI ont réécrit leur accord fondateur de 2019 : Microsoft met fin à son partage des revenus Azure avec OpenAI, OpenAI peut désormais vendre via Amazon Web Services et Google Cloud, et la fameuse «clause AGI» est supprimée. Le chiffre d'affaires d'Anthropic a dépassé celui d'OpenAI pour la première fois à $30B.
Google a annoncé un investissement pouvant atteindre 40 milliards de dollars dans Anthropic, en commençant par 10 milliards à une valorisation de 350 milliards, avec des tranches supplémentaires liées à des jalons. Google Cloud a également engagé 5 gigawatts de capacité de calcul sur cinq ans — le plus grand investissement en IA jamais enregistré.
OpenAI a lancé GPT-5.5, son modèle le plus performant à ce jour, avec des améliorations majeures du codage agentique via Codex, de la recherche approfondie et la capacité d'opérer des logiciels de bout en bout. Le déploiement a été effectué auprès des utilisateurs Plus, Pro, Business et Enterprise de ChatGPT et de l'API le 24 avril.
Anthropic a lancé Claude Design, son premier produit dédié au design, dans le cadre d'Anthropic Labs. Basé sur Claude Opus 4.7, il génère des présentations, des maquettes et des supports marketing à partir d'une conversation — avec génération automatique d'une charte graphique à partir de bases de code ou de fichiers de design existants. Disponible sans coût supplémentaire pour les abonnés Claude Pro, Max, Team et Enterprise.
Adobe a lancé Creative Agent, une couche d'orchestration IA qui accepte un seul prompt en langage naturel et exécute des workflows coordonnés dans Photoshop, Premiere, Lightroom et Illustrator. La bêta Custom Models permet le fine-tuning sur les actifs de marque. La génération sonore a été ajoutée à Adobe Firefly.