Actualité de l'IA - Août 2026
En bref 🚀
En août 2026, Anthropic unifie la mémoire de Claude entre Chat et Cowork, OpenAI ferme son navigateur Atlas
Un mois qui confirme une bascule amorcée en juin : les labos eux-mêmes commencent à freiner leurs propres modèles à l'image d'OpenAI qui met en pause le développement de son futur modèle Astra pour des raisons de cybersécurité. Pendant ce temps, l'écosystème open source reprend des couleurs, pas seulement porté par la Chine, mais par Meta avec Muse Glimmer.
Petit à petit, l'agentique gagne du terrain : des solutions dans le cloud ou locales, mais dotées de toujours plus d'outils et toujours plus d'autonomie, à l'image de la très haute gamme solution Grok Bot de SpaceXAI.
Côté création, la vidéo générative vit son mois le plus dense de l'année : SeeDance 2.5 (ByteDance), MiniMax H3 et Wan 3.0 (Alibaba) sortent à quelques semaines d'intervalle et atterrissent quasiment en direct sur Runway, qui s'assume désormais comme plateforme multi-modèles plutôt que fournisseur unique.
Enfin, l'AI Act européen impose depuis le 2 août l'étiquetage obligatoire des contenus générés par IA.
🔍 Affaire à suivre… OpenAI met en pause son propre modèle par crainte de ses capacités cyber
Le 1ᵉʳ août, OpenAI confirme le nom de son prochain modèle, Astra, à l'occasion d'un billet de recherche : une version interne aurait produit des résultats inédits sur dix problèmes mathématiques non résolus, preuves formelles à l'appui dans l'assistant de preuve Lean. Astra se positionne comme un palier au-dessus des trois variantes de GPT-5.6 sorties en juillet (Sol, Terra, Luna).
Six jours plus tard, coup de frein : OpenAI annonce avoir ralenti volontairement l'entraînement d'Astra. Ses évaluations internes montrent des progrès significatifs en codage agentique et en capacités cyber, au point de ne plus pouvoir exclure un niveau de "capacité cyber critique" au sens de son propre Preparedness FrameworkCadre interne d'OpenAI qui évalue le niveau de risque d'un modèle (dont ses capacités cyber) avant sa sortie, et fixe les mesures de sécurité nécessaires.. Astra reste à l'arrêt le temps d'y voir plus clair.
L'épisode prend tout son sens à la lumière du printemps et de l'été 2026 : contrôle des exports américains sur Fable 5 et Mythos 5 en juin, puis agents OpenAI et Claude compromettant de vraies infrastructures pendant des tests de sécurité en juillet (dont Hugging Face, et trois entreprises tierces côté Anthropic). Pour la première fois, un labo applique ce frein à lui-même, avant toute pression extérieure : un signal fort sur la maturité perçue du risque agentique.
👉 OpenAI says it slowed Astra model development over security concerns (TechCrunch)
👉 Pacing model development in an era of cyber-critical capabilities (OpenAI)
🌐 Régulation : l'étiquetage des contenus IA devient obligatoire dans l'UE
Depuis le 2 août 2026, l'article 50 du règlement européen sur l'IA impose l'étiquetage des contenus générés ou manipulés par IA dans toute l'Union.
Deux obligations pour les producteurs de contenus IA :
- L'étiquetage visible s'applique sans délai.
- Le marquage technique lisible par machine (watermarking) est également exigé pour les nouveaux systèmes, mais les outils déjà commercialisés avant le 2 août bénéficient d'un sursis jusqu'au 2 décembre 2026 pour se mettre en conformité.
- Sanctions : jusqu'à 15 millions d'euros ou 3 % du CA mondial.
En France, le délit de deepfake malveillant existe déjà depuis la loi SREN de 2024 (2 ans de prison, 45 000 € d'amende en cas de diffusion sans mention du caractère artificiel) : l'AI Act vient désormais compléter ce dispositif à l'échelle européenne.
Anthropic applique partiellement ce marquage : Fable 5.1 et Mythos 5.1 intègrent depuis le 2 août un watermark invisible dans le texte généré, et une métadonnée de provenance (norme C2PACoalition for Content Provenance and Authenticity : norme de métadonnées signées (portée par Adobe, Microsoft, la BBC...) qui atteste l'origine d'un fichier et révèle toute modification ultérieure.) dans les fichiers image créés. Les autres modèles suivront d'ici le 2 décembre. La détection reste réservée aux régulateurs, médias et entreprises soumises à obligation. Pas d'outil grand public pour l'instant, sauf pour vérifier la provenance d'un fichier (sur claude.com/check-content).
Je prépare une synthèse pratique pour les créateurs de contenus détaillant les possibilités pour vous mettre en règle au niveau du marquage des images et des vidéos générés par IA. A suivre dans la rubrique AI du blog.
👉 IA Act : ce qui change le 2 août 2026 (BDM)
👉 How Claude marks AI-generated content (Anthropic Help Center)
👉 Anthropic Will Embed Watermarks in AI Outputs (Artificial Lawyer)
👉 EU AI Act watermarking duties now in force for providers
🎧 Tendance : le retour de l'open source, porté cette fois par les géants
En juin, l'Europe misait sur l'open source pour sa souveraineté (le consortium EUROPA/Domyn) et la Chine enchaînait les modèles en poids ouverts (GLM-5.2, puis Kimi K3 en juillet).
En août, c'est au tour d'un géant américain de rouvrir cette voie : Meta publie le 10 août Muse Glimmer, un modèle de 30 milliards de paramètres sous licence Apache 2.0, capable de tourner sur un seul GPU grand public (24 Go de VRAM), pensé pour des agents locaux "toujours actifs" (code, analyse de documents, captures d'écran).
Glimmer est une version distillée du modèle Muse Spark, mis à jour en version 1.2 le 5 août. Mark Zuckerberg justifie ce retour à l'ouverture par une vision de "superintelligence personnelle" distribuée plutôt que centralisée chez quelques acteurs.
Pour les communicants comme pour les PME, la bascule est notable : disposer d'un modèle puissant, gratuit et exécutable localement, sans dépendre d'une API tierce, devient une option crédible.
👉 Meta returns to open source with Muse Glimmer (VentureBeat)
👉 Introducing Muse Glimmer (Meta AI Research)
🧭 Focus : le Mode IA de Google débarque en France
C'était bloqué depuis deux ans : les Aperçus IA et le Mode IA de Google sont officiellement déployés progressivement en France depuis le 22 juillet 2026. Le blocage réglementaire se levait après un accord entre Google et les éditeurs de presse français sur les droits voisins, un sujet qui traînait depuis 2024.
Le Mode IA ajoute un onglet dédié à côté de "Tous / Images / Vidéos" dans la recherche Google : une interface conversationnelle où l'on peut poser des questions complexes, les affiner, et interroger par la voix ou l'image, plutôt qu'une simple liste de liens. Les Aperçus IA, eux, s'affichent directement en tête des résultats classiques.
Le chiffre à retenir : sur les sites où plus de 20 % des requêtes déclenchent un Aperçu IA, le taux de clic a chuté de 23,1 % en seulement 9 jours après le déploiement. De quoi remettre le SEO traditionnel en question au profit d'une logique d'optimisation AEO/GEOAEO = Answer Engine Optimization / GEO = Generative Engine Optimization : optimiser pour être cité par une réponse IA (chatbot, Aperçu IA), plutôt que cliqué dans une liste de liens classique..
Pour en savoir plus sur la façon d'envisager le SEO dans ce contexte... voici mes explications et recommandations :
AEO, GEO, AIO : le SEO à l'heure de l'IA...
👉 Google déploie AI Overviews et AI Mode en France (BDM)
👉 Mode IA : c'est quoi ce nouvel onglet déployé discrètement par Google ? (Journal du Geek)
⏳ Bientôt dans l'actu…
Astra (OpenAI) : pas de date de sortie tant que les capacités cyber ne sont pas mieux cadrées.
FLUX 3 (Black Forest Labs) : les poids ouverts du modèle vidéo sont annoncés "à venir", après une disponibilité en 1080p via API depuis début août.
Un investissement de Nvidia dans Perplexity, évoqué autour d'une valorisation de 30 milliards de dollars, reste à ce stade non confirmé officiellement.
🤖 Côté bots conversationnels
OpenAI
Le 6 août, fin des limites de messages texte pour tous les utilisateurs gratuits de ChatGPT. GPT-5.6 Luna devient le modèle par défaut des offres Free et Go (remplaçant GPT-5.5), avec un nouveau bouton "Think" pour activer un raisonnement plus poussé sur les questions complexes. Trois retraits notables ce mois-ci :
- le navigateur Atlas, lancé en octobre 2025, s'arrête le 9 août.
- Le modèle o3 est retiré le 26 août après 90 jours de préavis,
- le GPT dédié DALL·E ferme le 30 août (ChatGPT Images prend le relais).
Voir l'encadré dans la page pour l'épisode Astra, mis en pause pour raisons de cybersécurité.
👉 ChatGPT brings unlimited text chats to free users (TechCrunch) 👉 OpenAI is shutting down Atlas (TechCrunch)
Anthropic
Le 25 août, Anthropic annonce l'unification de la mémoire entre Claude Chat et Claude Cowork : ce que Claude retient d'une conversation devient disponible dans Cowork, et inversement. La mémoire se met désormais à jour en continu pendant l'échange, sans attendre la fin de la conversation. Les sujets jugés sensibles (santé, convictions) restent exclus par défaut, activables manuellement. Limite à noter : le partage de mémoire ne fonctionne que pour les sessions Cowork exécutées dans le cloud, pas en local.
Le 26 août, Anthropic annonce Claudeforce, un partenariat élargi avec Salesforce autour de Claude comme moteur IA du CRM. Ce fait relance les débats et polémiques sur la viabilité ou non des SaaSSoftware as a Service : un logiciel utilisé en ligne par abonnement (Salesforce, Notion...), hébergé et maintenu par l'éditeur, plutôt qu'installé et possédé par l'entreprise. à l'ère de l'IA.
Claude Cowork embarque depuis août 2026 un navigateur intégré, distinct de l'extension Claude in Chrome, qui propose d'importer les cookies de votre navigateur local pour rester connecté à vos propres sites pendant qu'il travaille pour vous. Claude ne voit vos identifiants que si vous choisissez explicitement de les importer, mais tout site sur lequel vous vous connectez ainsi reste accessible à Claude lors des sessions Cowork suivantes sur le même ordinateur. Bien sûr, à réserver aux sites à faible enjeu, en évitant banque et comptes sensibles.
Fable 5 est désormais accessible en crédits uniquement pour les abonnés Pro (au tarif API : 10 $ par million de tokens en entrée et 50 $ par million en sortie). Sur le plan Max, rien ne change : Fable 5 reste couvert par le forfait, dans la limite de 50 % du quota d'usage hebdomadaire.
👉 Claude Cowork finally remembers what you told the app in chat (TechCrunch) 👉 Use the built-in browser in Claude Cowork (Anthropic Help Center) 👉 Claude Fable 5 on your plan (Anthropic Help Center) 👉 Anthropic news
Google / Gemini
Gemini 3.7 Flash alimente désormais une partie des réponses du Mode IA de Google Search (voir encadré concernant sa sortie en France dans la page), pendant que Gemini 3.1 Pro reste le modèle de référence pour le raisonnement complexe.
Depuis le 26 août, "Ask Gemini in Google Chat" est en déploiement dans le monde anglophone (pour les comptes inscrits au "Workspace Smart Features"). Une seule barre de commande "Ask Gemini" permet de chercher une info dans tout un workspace (mail gmail, fichier drive, créneau Calendar....), alimentée par Workspace Intelligence, une couche qui permet de relier et comprendre en temps réel les données issues de l'ensemble des applications.
Nouveauté côté personnalisation (mais non encore disponible en Europe, conditionné à une analyse d'impact sur la protection des données) : Personal Intelligence permet à Gemini de croiser l'historique de conversations avec Gmail, Photos, Search et YouTube pour répondre en tenant compte du contexte personnel de l'utilisateur, une fonction à surveiller du point de vue de la confidentialité autant que de la pertinence.
👉 Ask Gemini in Google Chat (Google Workspace) 👉 Google Release Notes — August 2026 (Releasebot)
Microsoft
Copilot Notebooks passe en disponibilité générale pour tous les utilisateurs (dans l'appli Microsoft 365 Copilot, sur m365.cloud.microsoft, ou l'appli desktop/mobile), section "Notebooks" dans le menu de gauche : un espace pour rassembler, organiser et faire brainstormer l'IA sur un ensemble de sources, en contexte éducatif comme professionnel. Ces Notebooks apparaissent directement dans OneNote. Seuls les abonnés Microsoft 365 Business (avec un ID Entra) peuvent en bénéficier.
Sur SharePoint (toujours pour les comptes Business), Copilot peut désormais générer un tableau de bord interactif directement depuis une liste, un fichier Excel ou un CSV. Le rapport HTML généré reste connecté aux données sources.
Microsoft continue par ailleurs d'intégrer plusieurs modèles tiers dans Copilot, dont GPT-5.6 et Claude, choisis dynamiquement selon la tâche.
👉 What's New in Copilot in SharePoint: August 2026 (Microsoft Community Hub)
Meta
Voir l'encadré Tendance ci-dessus pour Muse Glimmer, le nouveau modèle ouvert de 30 milliards de paramètres.
En parallèle, Meta a mis à jour son modèle propriétaire Muse Spark en version 1.2 le 5 août (haut de gamme généraliste, un peu sous Opus 5 dans les benchmarks). A tester sur meta.ai (chatbot grand public gratuit avec limites d'usages), avec connexion via vos identifiants meta/facebook. A noter c'est ce Muse Spark qui vous parle dans WhatsApp/Instagram/Facebook...
Mark Zuckerberg a par ailleurs présenté sa vision d'une "superintelligence personnelle" distribuée à chaque utilisateur plutôt que centralisée — un positionnement qui tranche avec le discours de plusieurs concurrents.
👉 Meta's new Glimmer AI model offers a hint at Zuckerberg's personal intelligence vision (TechCrunch)
Perplexity
Le 25 août, Perplexity lance Portable Computer, une version embarquée on device Appli à installer sur une machine à GPU Nvidia (DGX Spark ou RTX sous Linux) : modèle, moteur et agent tournent en local, sans cloud. Windows prévu en septembre 2026, rien pour Apple. de son agent cloud Perplexity Computer, capable de mener des tâches multi-étapes comme le développement d'une application web. Une fonction "Computer in Email" permet aussi de démarrer et poursuivre des sessions Computer directement depuis un fil de mails.
Toujours pour les pipelines "locaux", Perplexity publie Numbat, un outil open source de détection des actions d'agents de code sur un poste de travail, pour bloquer les actions à risque avant exécution.
Côté plateforme, Perplexity élargit l'accès à ses modèles tiers (GPT-5.6, Grok 4.6, DeepSeek V4 Pro, Kimi K3). En toile de fond, Nvidia évaluerait un investissement valorisant Perplexity à plus de 30 milliards de dollars.
👉 Perplexity AI launches Portable Computer on-device AI agent (SiliconANGLE)
xAI (Grok)
Grok 4.6 sort le 12 août : fenêtre de contexte de 500 000 tokens, niveaux de raisonnement configurables (low, medium, high, xhigh), pensé pour des agents à tâches longues. Le modèle rejoint à la fois Microsoft Foundry et la plateforme d'agents d'entreprise de Google.
La veille, le 11 août, xAI lance Grok Bot (en bêta, accessibles aux comptes SuperGrok Heavy - Cursor Ultra et Cursor Teams Premium, sur desktop et IOS) : chaque bot tourne sur son propre ordinateur virtuel dans le cloud, en permanence, avec son navigateur, ses accès fichiers, ses propres identifiants de connexion à vos outils. Il navigue, clique, remplit des formulaires, exécute du code, jusqu'à ce que la tâche soit finie, même si votre ordinateur est éteint.
Il existe aussi une place de marché de "bots" prêts à l'emploi (templates), Elon Musk ayant notamment mis en avant un "Haggle Bot" dédié à la négociation fournisseurs.
Pour rappel : en juin 2026, SpaceX a racheté Cursor (l'éditeur de code IA très populaire) pour 60 milliards de dollars, rachat officiellement finalisé en août. Cursor, SpaceX et xAI opèrent désormais ensemble sous l'appellation "SpaceXAI". Grok Bot est le premier produit conjoint de ce rapprochement, et s'appuie sur l'infrastructure de Cursor pour la distribution. 👉 xAI Release Notes — August 2026 (Releasebot)
Mistral
Le 4 août, Mistral AI publie Shieldstral, un modèle de modération de contenus (texte et image) d'environ 4 milliards de paramètres, sous licence Apache 2.0. Les règles de modération se rédigent en langage naturel plutôt qu'en configuration technique.
Le 11 août, Mistral annonce ses Regional Endpoints : une infrastructure de calcul européenne, avec une coalition d'industriels (Amadeus, ASML, Capgemini, la Caisse des Dépôts, CMA CGM) qui s'engagent à consommer et financer cette capacité localisée. Une pièce de plus dans la stratégie de souveraineté IA européenne amorcée avec le consortium EUROPA/Domyn en juin.
👉 Mistral Regional Endpoints — coalition européenne (Usine Digitale)
🎨 Côté génération d'images & vidéo
Adobe
Firefly franchit une étape audio : Generate Music, Generate Speech et Generate Sound Effects passent en disponibilité générale le 20 août, avec la promesse d'un usage commercial sécurisé (entraînement sur contenus sous licence).
Deux nouveautés en bêta : Firefly Interfaces, qui permet aux entreprises de créer de petites interfaces de production pour des traitements par lots (jusqu'à 500 assets en une fois), et un espace unifié de génération et d'édition image/vidéo pour le desktop (média de projet, historique de génération, éléments réutilisables, timeline vidéo). Autre changement : Firefly Image 3 est totalement retiré du service ce mois-ci, au profit de Firefly Image 4 et 4 Ultra, désormais modèles par défaut.
👉 Adobe Firefly expands its creative AI studio (Adobe Blog)
Midjourney
Après le lancement du modèle V8.2 (esthétique, personnalisation), Midjourney concentre son mois d'août sur son site alpha : refonte de l'interface, meilleures performances, et retour de fonctions attendues (Upscale, Zoom, Vary, recherches sauvegardées). Nouveaux ratios d'image disponibles sur le curseur ar : 6:11, 4:5, 5:4 et 21:9. Midjourney affiche une ligne claire : améliorer l'accessibilité sans sacrifier les fonctions avancées dont dépendent les utilisateurs expérimentés.
👉 Midjourney Info 26 — Week of August 3rd, 2026 (Medium)
Runway
Voir l'encadré spécifique dans la page pour l'arrivée de MiniMax H3 et l'intégration renforcée de Seedance sur la plateforme. Runway ajoute par ailleurs des Agent Skills pour construire des campagnes publicitaires, générer des spots et les décliner par marché en langage naturel. Côté entreprise, l'API gagne des exports d'usage et des journaux d'audit par projet. Elle intègre aussi Seedream 5.0 Lite (génération d'image avec images de référence, jusqu'à 3K) et un paramètre de prompt négatif pour les modèles Veo 3 et Veo 3.1 de Google, utilisables via son API.
Google (Gemini Omni)
Gemini Omni 1.1 Flash entre en préversion : un modèle multimodal (texte, image, vidéo) optimisé pour une génération vidéo rapide avec édition audio et vidéo intégrée. L'évolution du "World Model" présenté à Google I/O en mai.
👉 Gemini Updates — August 2026 (Releasebot)
Black Forest Labs (FLUX)
FLUX 3 Video, premier modèle vidéo du studio allemand, passe en disponibilité générale via API le 5 août : résolution native portée à 1080p (contre 720p en préversion en juillet), avec du 2K et 4K annoncés pour la suite, ainsi que des poids ouverts à venir. Le 20 août, FLUX Upscale complète l'offre : un outil dédié pour ré-générer n'importe quelle vidéo à une résolution supérieure, jusqu'à 4K natif.
Kling AI
La filiale vidéo IA de Kuaishou serait proche de boucler un nouveau tour de table d'environ 3 milliards de dollars, valorisant l'entreprise à 18 milliards de dollars, après une précédente levée de 2,8 milliards de dollars en juillet, avec Alibaba et Tencent au tour de table. Un signal supplémentaire de la course aux capitaux sur la génération vidéo par IA, aux côtés de Runway et Black Forest Labs.
👉 China's Kling AI nears US$3 billion round (South China Morning Post)
🧰 Nouveaux outils : trois modèles vidéo frontière sortent à quelques semaines d'intervalle
La vidéo générative a connu une accélération rare, avec trois sorties majeures venues de Chine.
SeeDance 2.5 (ByteDance) débute le 31 juillet sur Dreamina (API ouverte le 7 août). 30 secondes de génération 4K (jusqu'à 3 minutes en mode Long Video), 50 références multimodales en entrée, avec audio stéréo, et amélioration annoncée de 20 % du respect du prompt.
MiniMax H3 (aussi appelé Hailuo 3.0) sort le 31 juillet, avec des poids ouverts publiés sur Hugging Face dès le 2 août. Un modèle "omni" qui traite texte, image, vidéo et son dans un même contexte, pour générer des plans multi-shots de 4 à 15 secondes en 2K avec audio stéréo.
Wan 3.0 (Alibaba) complète le trio le 24 août, le lendemain de la clôture d'une levée de 10,2 milliards de dollars. Le modèle accepte des documents, tableurs, diaporamas ou pages web en entrée pour générer des vidéos jusqu'à 30 secondes, soit deux fois plus long que la génération précédente.
La plateforme Runway assume pleinement une stratégie de hub multi-modèles en absorbant les modèles frontière en temps réel : elle héberge désormais Seedance, MiniMax H3, Kling 3.0 et Sora 2 Pro aux côtés de son propre Gen-4.5, avec un routeur qui oriente chaque génération vers le modèle le plus adapté (coût, latence ou qualité).
👉 What's New in the Seedance 2.5 for 30-Second 4K Video (Atlas Cloud)
👉 What Is MiniMax H3 (Hailuo 3.0)? (Hugging Face)
👉 Runway Absorbs MiniMax H3, Betting on a Multi-Model Creative Platform (AlphaSignal)
👉 Alibaba Wan3.0 AI video model launch (Quartz)

