Retour à tous les articles
Article

Modèles d’IA à suivre en août 2026 : nouveautés et publics concernés

Auteur:

Les mises à jour marquantes d’août pour le travail, le code, l’image, la vidéo, la transcription et l’usage local, avec dates, accès et raisons de les essayer.

Une boîte à outils compartimentée ouverte contenant un document, une image, une pellicule et un microphone

Si votre assistant IA gère déjà l’essentiel de votre travail, un nouveau modèle doit mériter votre attention. Août a apporté plusieurs raisons : conversation quotidienne mise à jour, choix élargi dans les outils de code, contrôle accru des retouches d’images et de vidéos, et nouvelle possibilité d’exécuter un assistant sur son propre ordinateur.

Notre sélection d’août part de la tâche à améliorer. Pour les utilisateurs de ChatGPT, la mise à jour GPT-5.6 est la plus directe. Les développeurs devraient examiner Gemini 3.7 Flash et DeepSeek-V4-Pro. Les créateurs peuvent tester Imagine Image 2.0 ainsi que les nouveaux contrôles vidéo de FLUX 3 Video et Gemini Omni 1.1 Flash.

Ce premier numéro d’AI Model Monthly couvre les sorties et changements d’accès significatifs du 1er au 31 août 2026, vérifiés auprès de sources publiques le 8 septembre. C’est une sélection éditoriale de nouveautés documentées, pas un tournoi pratique. Les accès annoncés peuvent varier selon compte, région et offre.

Choisir la partie correspondant à votre travail

Votre tâcheCommencer parPourquoi l’examiner
Rédaction courante et organisation d’informationsMise à jour d’août GPT-5.6 Sol / LunaVotre expérience de chat existante peut avoir changé
Code et tâches en plusieurs étapesGemini 3.7 Flash ; DeepSeek-V4-ProNouvelles versions et possibilités d’intégration
Retouche d’images promotionnellesImagine Image 2.0Sélection de zone et retouche par références
Création de vidéos courtesFLUX 3 Video ; Gemini Omni 1.1 FlashImages clés, prolongement et aperçus
Conversion de parole en texteGemini 3.5 TranscribeParcours distincts pour direct et enregistrement
Assistant exécuté localementMuse GlimmerPoids ouverts et indications matérielles concrètes

Les sections suivantes présentent preuves de sortie et limites. Grok 4.6, Muse Spark 1.2, GLM-5.3-Flash et Qwen3.8-Flash-Next ajoutent des options aux équipes qui développent avec des modèles.

Conversation courante : la mise à jour GPT-5.6 vous concerne peut-être déjà

La fiche système du 6 août d’OpenAI décrit de nouvelles versions GPT-5.6 Sol et Luna dans ChatGPT : nouveau modèle par défaut pour Free et Go, Sol mis à jour avec curseur d’effort pour Plus et Pro. À cette date, Codex et ChatGPT Work conservaient les versions de juillet.

Cette distinction importe lorsqu’on entend « GPT-5.6 s’est amélioré ». Le produit et la version accompagnent le nom du modèle. Un résultat dans ChatGPT ne décrit pas automatiquement la version d’un outil de code.

Avant d’acheter un autre abonnement, reprenez une tâche auparavant mal gérée. Pour un petit événement fictif, donnez description, capacité maximale et date confirmée, puis demandez une invitation courte. Vérifiez que date et capacité n’ont pas changé : une formulation plus fluide qui les altère crée du travail supplémentaire.

Code : août a élargi l’ensemble des comparaisons utiles

Les sorties destinées au code ciblent de plus en plus les agents, c’est-à-dire les logiciels qui permettent au modèle d’inspecter des fichiers, d’utiliser des outils et d’enchaîner plusieurs étapes. La question pratique est de savoir si l’ensemble modèle-outil termine votre modification avec moins de corrections.

Gemini 3.7 Flash : une option nouvelle pour les tâches récurrentes

Google a présenté Gemini 3.7 Flash le 13 août, en insistant sur le code et les agents. L’accès développeur passe par l’API Gemini et Google AI Studio, avec d’autres intégrations ; l’accès individuel dans Gemini Spark était réservé aux abonnés Pro et Ultra des pays pris en charge.

Le tarif de lancement était de 0,75 $ par million de jetons d’entrée et 3,75 $ par million de sortie jusqu’à fin 2026. Ce sont des prix API, pas un abonnement de chat ni le coût complet d’une tâche.

Nous le testerions pour des travaux documentaires ou de code répétés où coût et corrections comptent. Sur l’événement, proposez-lui un bug : le formulaire accepte une réservation de trop. Contrôlez la limite et le message d’erreur, puis notez reprises et temps de relecture avec les frais d’usage.

DeepSeek-V4-Pro : une mise à jour derrière un nom connu

Le journal des changements du 13 août de DeepSeek consigne la disponibilité générale de V4-Pro dans l’application, le site et l’API. Les développeurs ont gardé le nom deepseek-v4-pro. La mise à jour documente aussi la compatibilité Responses API et le réglage de l’effort de raisonnement.

Les utilisateurs existants devraient rejouer une tâche enregistrée : un nom d’API identique n’implique pas un comportement inchangé. Joignez date et réglages aux résultats.

Le même journal mentionne V4-Flash-Vision-Exp le 21 août, modèle API expérimental de compréhension visuelle. C’est une option distincte pour lire captures d’écran et autres images, pas un générateur d’images ; son statut expérimental impose une évaluation avant toute dépendance.

Grok 4.6 et Muse Spark 1.2 : regarder aussi l’outil de code

Grok 4.6 est sorti le 12 août, via Grok Build, Cursor et l’API. Dans votre outil actuel, il fournit un candidat pratique pour une modification multifichier. L’accent du fournisseur sur les tâches longues justifie un test, pas une garantie de réussite dans votre dépôt.

La sortie Meta du 5 août associait Muse Spark 1.2, le modèle, à Muse Code beta, un agent de terminal. Distinguez-les : agents persistants en arrière-plan et redémarrage relèvent du système d’exécution, pas automatiquement du modèle appelé ailleurs.

Comparez deux configurations complètes ou gardez le même environnement pour comparer les modèles. Sinon, outils, permissions ou reprises peuvent passer pour une différence d’intelligence.

Image : avec Imagine Image 2.0, la retouche devient la question utile

Imagine Image 2.0 est arrivé le 7 août comme nouveau Quality Mode dans les produits web et mobiles Grok, avec l’API grok-imagine-image-2.0. L’annonce décrit retouche de zones choisies, suppression de fond et édition avec plusieurs références.

Pour une photo de lieu autorisée, essayez de changer la couleur d’une bannière en préservant salle, mobilier et panneaux. Inspectez les zones inchangées aussi attentivement que la zone modifiée : la promesse de précision ne remplace pas ce contrôle.

Si l’image finale contient des informations exactes, vérifiez chaque date, nom et ligne. Vous pouvez aussi générer le visuel puis ajouter le texte approuvé dans un outil de mise en page. Les promesses typographiques du modèle ne dispensent pas de relire.

Vidéo : contrôler le plan avant de juger le spectacle

Deux nouveautés d’août comptent lorsqu’un plan précis est attendu.

FLUX 3 Video : génération ouverte aux utilisateurs API

Black Forest Labs a généralisé FLUX 3 Video le 4 août via son API et certains partenaires. L’offre initiale annonçait jusqu’à 20 secondes, audio natif, images clés, prolongement et mode brouillon. Elle distingue HD native et Full HD obtenue par agrandissement.

Pour un teaser, partez de l’image validée du lieu et demandez un mouvement de caméra sobre. Vérifiez que la salle reste reconnaissable et que le mouvement atteint sa cible. Une porte inventée invalide le plan, même spectaculaire.

Gemini Omni 1.1 Flash : davantage de moyens de réviser une séquence

La sortie développeur Google du 27 août ajoute prolongement de scène, contrôle de première et dernière image, aperçus basse résolution et agrandissement 4K via l’API Gemini dans Google AI Studio.

Le modèle mérite un essai si les images initiale et finale comptent ou si un clip doit être prolongé. Comparez avec FLUX la conservation du sujet au cours de la transition voulue. Précisez son, durée et sortie : agrandir en 4K ne signifie pas générer nativement en 4K, et prolonger diffère d’une génération en un seul passage.

Transcription : Gemini 3.5 Transcribe sépare direct et enregistrement

Google a annoncé Gemini 3.5 Transcribe le 26 août. Le modèle propose un parcours en direct et un autre pour les fichiers, avec attribution des locuteurs et horodatages par mot. La sortie décrit aussi vocabulaire personnalisé et nettoyage des hésitations et autocorrections.

Cela facilite la transformation de notes orales en document lisible, mais impose un choix : voulez-vous les mots prononcés ou le sens corrigé ?

Pour « Réservez mardi — pardon, mercredi », une note de planification propre doit garder la correction ; un verbatim doit conserver l’énoncé original. Décidez avant la comparaison et vérifiez noms, dates et corrections dans l’enregistrement. L’attribution est décrite pour trois locuteurs au maximum, les groupes plus grands restant expérimentaux.

Modèles locaux et ouverts : vérifier ce que votre machine peut exécuter

Muse Glimmer : l’option locale la plus directe de cette sélection

Meta a publié Muse Glimmer le 10 août, modèle de 30 milliards de paramètres sous licence Apache 2.0 destiné aux agents locaux. Les indications matérielles décrivent la quantification — compression de la représentation numérique — et des configurations pour 24 ou 32 Go de mémoire.

Si l’exécution locale est obligatoire, partez des téléchargements et instructions liés dans l’annonce. Vérifiez la mémoire totale, mémoire de travail comprise, plutôt que d’assimiler taille du téléchargement et besoin réel. Un modèle local n’est qu’un composant ; inspectez application et outils connectés avant de supposer que tout reste sur l’appareil.

GLM et Qwen : options développeur à suivre pour des raisons différentes

La note Cloudflare du 26 août confirme GLM-5.3-Flash sur Workers AI avec entrée multimodale, via offre Workers payante ou crédits AI Gateway prépayés. C’est une option de déploiement pour les équipes déjà sur la plateforme ; « Flash » n’indique pas une compatibilité avec un ordinateur portable.

Qwen3.8-Flash-Next est surtout un aperçu d’architecture. Son annonce d’août et son article présentent une version précoce pour évaluer des changements avant Qwen4. Elle intéresse les personnes qui servent ou adaptent des modèles, mais ne constitue ni Qwen4 ni une raison évidente de changer d’outil de chat.

Essayer un nouveau modèle face à une exigence réelle

N’adoptez pas toute la liste. Prenez une tâche répétée, conservez son entrée et comparez votre configuration actuelle à un candidat pertinent. Définissez d’abord ce qui rendrait la sortie inacceptable.

Pour l’événement : date inchangée, capacité infranchissable, salle reconnaissable ou correction orale bien traitée. Notez modèle et produit, date, réglages, erreurs, temps de correction et coût réel. Gardez la solution qui termine le travail avec le moins de réparations.

Références