Sehenswerte KI-Modelle im August 2026: Was sich geändert hat und wer sie ausprobieren sollte
Die wichtigsten KI-Modellupdates im August für Alltag, Code, Bilder, Videos, Transkription und lokale Nutzung – mit Daten, Zugängen und Testgründen.

Wenn Sie bereits über einen KI-Assistenten verfügen, der den Großteil Ihrer Arbeit erledigt, braucht ein neues Modell einen Grund, Ihre Aufmerksamkeit zu erregen. August bot mehrere: einen aktualisierten Alltagschat, mehr Optionen in den Codierungstools, mehr Kontrolle über Bild- und Videobearbeitungen und eine weitere Möglichkeit, einen Assistenten auf Ihrem Computer auszuführen.
Unsere Auswahlliste für August beginnt mit der Aufgabe, die Sie verbessern möchten. Für bestehende ChatGPT-Benutzer ist das GPT-5.6-Update am wichtigsten. Für Entwickler sind Gemini 3.7 Flash und DeepSeek-V4-Pro einen Blick wert. Für Entwickler bieten Imagine Image 2.0 und die neuen Videosteuerungen in FLUX 3 Video und Gemini Omni 1.1 Flash konkrete Dinge zum Testen.
Diese erste Ausgabe von AI Model Monthly behandelt Veröffentlichungen und wichtige Änderungen der Verfügbarkeit vom 1. bis 31. August 2026, die am 8. September anhand öffentlicher Quellen geprüft wurden. Die Auswahl beruht auf dokumentierten Änderungen und ist kein Praxisturnier. Im Folgenden geht es um die angekündigten Zugangswege; Konten, Regionen und Tarife können sich unterscheiden.
Wählen Sie die Änderung, die zu Ihrer Arbeit passt
| Ihre Aufgabe | Beginnen Sie mit | Warum es einen Blick wert ist |
|---|---|---|
| Alltägliches Schreiben und Organisieren von Informationen | GPT-5.6 Sol/Luna August-Update | Ihr bestehendes Chat-Erlebnis hat sich möglicherweise geändert |
| Codierung und Arbeit in mehreren Schritten | Gemini 3.7 Flash; DeepSeek-V4-Pro | Neue Versionen und Integrationsmöglichkeiten |
| Werbebilder bearbeiten | Imagine Image 2.0 | Regionsauswahl und referenzbasierte Bearbeitung |
| Kurze Videos erstellen | FLUX 3-Video; Gemini Omni 1.1 Flash | Keyframes, Fortsetzung und Vorschau-Steuerelemente |
| Sprache in Text verwandeln | Gemini 3.5 Transkribieren | Getrennte Live- und aufgezeichnete Audiorouten |
| Einen Assistenten lokal ausführen | Muse Glimmer | Offene Gewichte mit Beton-Lokal-Hardware-Führung |
In den folgenden Abschnitten werden die Veröffentlichungsnachweise und Einschränkungen hinter diesen Entscheidungen aufgeführt. Grok 4.6, Muse Spark 1.2, GLM-5.3-Flash und Qwen3.8-Flash-Next fügen Optionen für Leser hinzu, die mit Modellen bauen.
Alltagschat: Das GPT-5.6-Update betrifft Sie möglicherweise bereits
OpenAIs Systemkarte vom 6. August beschreibt aktualisierte GPT-5.6-Sol- und -Luna-Versionen für ChatGPT. Sie nennt einen neuen Standard für Free- und Go-Nutzer sowie aktualisierten Sol-Zugriff mit einem Regler für den Denkaufwand bei Plus und Pro. Codex und ChatGPT Work behielten bei dieser Veröffentlichung die Juli-Versionen.
Diese Unterscheidung ist wichtig, wenn Sie hören, dass „GPT-5.6 verbessert wurde.“ Neben dem Modellnamen gehören auch die Produkt- und Release-Version. Ein Ergebnis von ChatGPT beschreibt nicht automatisch die Version, die jemand in einem Codierungstool verwendet hat.
Für normale Benutzer ist dies ein Grund, eine Aufgabe, die Ihr Assistent zuvor schlecht erledigt hat, noch einmal durchzugehen, bevor er ein weiteres Abonnement kauft. Stellen Sie sich ein hypothetisches kleines Ereignis vor: Sie haben eine Beschreibung, eine Kapazitätsgrenze und ein bestätigtes Datum. Bitten Sie um eine kurze Einladung und prüfen Sie dann, ob das Datum und die Kapazität die Neufassung überdauern. Eine flüssigere Einladung, die beide Tatsachen ändert, ist zusätzliche Arbeit, unabhängig vom Namen des Modells.
Codierung: August hat das nützliche Vergleichsset erweitert
Coding-Releases zielen zunehmend auf Agenten ab – Software, die es einem Modell ermöglicht, Dateien zu prüfen, Tools zu verwenden und mehrere Schritte abzuarbeiten. Die praktische Frage ist, ob die Kombination aus Modell und Werkzeug Ihre Änderung mit weniger Korrekturen abschließen kann.
Gemini 3.7 Flash: eine neue Option für wiederkehrende Arbeiten
Google führte Gemini 3.7 Flash am 13. August ein und legte den Schwerpunkt auf Codierung und Agenten-Workflows. In der Ankündigung wird neben anderen Integrationen auch der Entwicklerzugriff über die Gemini API und Google AI Studio aufgeführt. Für Pro- und Ultra-Abonnenten in unterstützten Ländern wurde ein individueller Zugriff über Gemini Spark festgelegt.
Das Startangebot betrug bis Ende 2026 0,75 USD pro Million Input-Tokens und 3,75 USD pro Million Output-Tokens. Token sind die Einheiten, die zur Messung der Textverarbeitung verwendet werden. Hierbei handelt es sich um API-Tarife, nicht um einen Chat-Abonnementpreis oder die Gesamtkosten für die Erledigung eines Auftrags.
Für wiederkehrende Dokument- oder Codierungsaufgaben, bei denen sowohl Kosten als auch Korrekturen eine Rolle spielen, würden wir es in die engere Auswahl nehmen. Geben Sie für das Veranstaltungsbeispiel einen kleinen Fehler im Registrierungsformular ein: Die Kapazitätsprüfung akzeptiert eine zusätzliche Buchung. Überprüfen Sie den genauen Grenzwert und die Fehlermeldung. Erfassen Sie Wiederholungsversuche und Überprüfungszeiten sowie Nutzungsgebühren. Eine niedrige Rate bedeutet wenig, wenn die Änderung wiederholt fehlschlägt.
DeepSeek-V4-Pro: ein Update hinter einem bekannten Namen
Das Änderungsprotokoll vom 13. August von DeepSeek zeichnet die allgemeine Veröffentlichung von V4-Pro in seiner App, Website und API auf. Die Entwickler verwendeten weiterhin denselben Modellnamen, deepseek-v4-pro. Das Update dokumentierte auch die Kompatibilität der Responses API und den anpassbaren Denkaufwand.
Für bestehende DeepSeek-Benutzer ist dies ein guter Grund, eine gespeicherte Aufgabe erneut auszuführen. Ein unveränderter API-Name bedeutet nicht gleichbleibendes Verhalten. Behalten Sie das Testdatum und die Einstellungen bei Ihrem Ergebnis, damit ein späterer Vergleich nachvollziehbar bleibt.
Das gleiche Protokoll zeichnet V4-Flash-Vision-Exp am 21. August auf, ein experimentelles API-Modell für visuelles Verständnis. Behandeln Sie es als separate Option zum Lesen von Screenshots oder anderen visuellen Eingaben. Es handelt sich nicht um einen Bildgenerator, und sein experimenteller Status macht es zu einem Kandidaten für die Evaluierung, bevor man sich darauf verlässt.
Grok 4.6 und Muse Spark 1.2: Schauen Sie sich das Codierungstool an
Grok 4.6 wurde am 12. August gestartet, mit angekündigtem Zugriff über Grok Build, Cursor und die API. Wenn es in dem von Ihnen bereits genutzten Tool verfügbar ist, bietet es einen komfortablen Zusatzvergleich für einen Multi-File-Wechsel. Der Schwerpunkt des Anbieters auf lang andauernden Arbeiten ist ein Grund, dieses Verhalten zu testen, und kein Beleg dafür, dass dadurch die Aufgaben Ihres Repositorys zuverlässiger erledigt werden.
Metas Veröffentlichung vom 5. August kombinierte Muse Spark 1.2, das Modell, mit Muse Code Beta, einem Terminal-Codierungsagenten. Halten Sie die beiden Namen getrennt: Die persistenten Hintergrundagenten und das Neustartverhalten des Tools sind Teil seines Ausführungssystems und keine Funktionen, die Sie automatisch erhalten, wenn Sie das Modell anderswo aufrufen.
Vergleichen Sie einen gesamten Codierungsaufbau mit einem anderen Gesamtaufbau oder halten Sie die Werkzeugumgebung beim Modellvergleich konstant. Andernfalls kann ein Unterschied in den Tools, Berechtigungen oder im Wiederholungsverhalten wie ein Unterschied in der Modellintelligenz aussehen.
Bilder: Imagine Image 2.0 macht die Bearbeitung interessanter
Imagine Image 2.0 erschien am 7. August als neuer Qualitätsmodus in den Web- und Mobilprodukten von Grok, mit API-Zugriff unter grok-imagine-image-2.0. Die Ankündigung beschreibt die Bearbeitung ausgewählter Bereiche, die Entfernung des Hintergrunds und die Bearbeitung mit mehreren Referenzbildern.
Daher lohnt es sich, darüber nachzudenken, welche Werbematerialien Sie überarbeiten müssen. Versuchen Sie anhand eines autorisierten Veranstaltungsortfotos aus dem Veranstaltungsbeispiel, die Farbe eines Banners zu ändern und dabei den Raum, die Möbel und die Schilder zu erhalten. Untersuchen Sie die unveränderten Bereiche ebenso sorgfältig wie die bearbeiteten. Die Zusage des Anbieters zur genauen Bearbeitung ersetzt die Prüfung nicht.
Wenn das fertige Bild genaue Veranstaltungsangaben enthalten muss, prüfen Sie jedes Datum, jeden Namen und jede Textzeile. Sie können das Bild auch ohne Schrift erzeugen und den freigegebenen Wortlaut anschließend in einem Layout-Tool ergänzen. Die typografischen Fähigkeiten des Modells ersetzen kein Korrekturlesen.
Video: Kontrollieren Sie die Aufnahme, bevor Sie die Wirkung beurteilen
Zwei Entwicklungen im August sind besonders relevant, wenn Sie eine bestimmte Aufnahme im Sinn haben und nicht eine offene Anfrage nach einem attraktiven Clip.
FLUX 3 Video: Generation für API-Benutzer geöffnet
Black Forest Labs hat die FLUX 3-Videogeneration am 4. August allgemein verfügbar gemacht über seine API und ausgewählte Partner. Das ursprüngliche Angebot beschrieb Clips mit einer Länge von bis zu 20 Sekunden mit nativem Audio, Keyframes, Videofortsetzung und einem Entwurfsmodus. Die Ankündigung unterscheidet die HD-Ausgabe von der durch Upscaling erzielten Full-HD-Ausgabe.
Der praktische Reiz besteht darin, mehr von der Sequenz spezifizieren zu können. Beginnen Sie für einen Event-Teaser mit dem genehmigten Bild des Veranstaltungsortes und bitten Sie um eine zurückhaltende Kamerabewegung. Beurteilen Sie, ob der Raum erkennbar bleibt und ob die Bewegung den beabsichtigten Endpunkt erreicht. Eine beeindruckende Kamerabewegung, die eine Türöffnung erfindet, scheitert an dieser Aufgabe.
Gemini Omni 1.1 Flash: mehr Möglichkeiten, eine Sequenz zu überarbeiten
Googles Entwicklerversion vom 27. August fügt Szenenerweiterung, Steuerung des ersten und letzten Bildes, Vorschauen mit niedrigerer Auflösung und 4K-Hochskalierung über die Gemini-API in Google AI Studio hinzu.
Wir würden es in Betracht ziehen, wenn das erste und das letzte Bild wichtig sind oder wenn ein brauchbarer Clip fortgesetzt werden muss. Ein nützlicher Vergleich mit FLUX ist, ob jedes System das Motiv über den Übergang hinweg beibehält, den Sie tatsächlich benötigen. Halten Sie die Ton-, Dauer- und Ausgabeeinstellungen explizit. Das Hochskalieren eines Ergebnisses auf 4K führt nicht zu einer nativen 4K-Generierung, und das Erweitern einer Sequenz unterscheidet sich von der Generierung der gesamten Dauer in einem Durchgang.
Transkription: Gemini 3.5 Transcribe trennt Live-Sprache von Aufzeichnungen
Google hat Gemini 3.5 Transcribe am 26. August angekündigt. Es bietet eine Live-Streaming-Route und eine vorab aufgezeichnete Audio-Route, wobei letztere die Sprecherzuordnung und Zeitstempel auf Wortebene unterstützt. Die Veröffentlichung beschreibt auch benutzerdefiniertes Vokabular und die Bereinigung von Zögern und Selbstkorrekturen.
Dies ist nützlich, um gesprochene Notizen in ein lesbares Arbeitsdokument umzuwandeln. Es wirft auch eine Wahl auf: Wollen Sie, was gesagt wurde, oder die bereinigte beabsichtigte Bedeutung?
Stellen Sie sich vor, Sie würden für die Veranstaltung diktieren: „Reservieren Sie es für Dienstag – leider Mittwoch.“ Eine ausgefeilte Planungsnotiz sollte die Korrektur widerspiegeln; eine wörtliche Niederschrift sollte die ursprüngliche Rede bewahren. Entscheiden Sie, bevor Sie die Ergebnisse vergleichen. Vergleichen Sie Namen, Daten und Korrekturen mit der Aufzeichnung, anstatt nur zu beurteilen, wie angenehm das Transkript zu lesen ist.
Die Veröffentlichung beschreibt die Namensnennung für bis zu drei Sprecher, wobei größere Gruppen experimentell sind. Diese Grenze ist für jemanden, der eine Podiumsdiskussion transkribiert, wichtiger als eine allgemeine Aussage über die Qualität der Transkription.
Lokale und offene Modelle: Prüfen Sie, was Sie tatsächlich ausführen können
Muse Glimmer: die klarste lokale Option in dieser Auswahlliste
Meta veröffentlichte Muse Glimmer am 10. August und beschreibt ein Modell mit 30 Milliarden Parametern und Apache-2.0-Gewichten für lokale Agenten-Workflows. Die Hardwarehinweise erklären Quantisierung – die komprimierte numerische Darstellung des Modells – und Konfigurationen für 24 oder 32 GB Arbeitsspeicher.
Dies verdient Aufmerksamkeit, wenn die Ausführung des Modells auf Ihrem eigenen Computer Teil der Anforderung ist. Beginnen Sie mit den in der Ankündigung verlinkten Modell-Downloads und Bereitstellungsanleitungen. Überprüfen Sie den gesamten Speicherbedarf, einschließlich des Arbeitsspeichers, anstatt davon auszugehen, dass die Downloadgröße alles ist, was Sie benötigen.
Ein lokales Modell kann eine Komponente eines lokalen Assistenten sein. Sie müssen dennoch die umgebende Anwendung und die angeschlossenen Tools überprüfen, bevor Sie davon ausgehen können, dass jeder Vorgang auf dem Gerät verbleibt.
GLM und Qwen: nützliche Entwickleroptionen, unterschiedliche Einsatzgründe
Cloudflares Versionshinweis vom 26. August bestätigt die Verfügbarkeit von GLM-5.3-Flash auf Workers AI mit multimodaler Eingabe, was einen bezahlten Workers-Plan oder vorausbezahlte AI Gateway-Gutschriften erfordert. Für Teams, die diese Plattform bereits nutzen, entsteht eine weitere Bereitstellungsoption. Der Name „Flash“ allein sagt noch nichts darüber aus, ob ein Modell zu Ihrem Laptop passt.
Qwen3.8-Flash-Next ist eher ein Thema für die Architekturbeobachtung. Die August-Ankündigung und das Architekturpapier beschreiben eine frühe Veröffentlichung, die es der Community ermöglichen soll, Änderungen vor Qwen4 zu bewerten. Es lohnt sich, es zu befolgen, wenn Sie an der Bereitstellung oder Anpassung von Modellen arbeiten. Es ist kein Qwen4-Start oder ein offensichtlicher Grund für einen gewöhnlichen Chat-Benutzer, zu wechseln.
Probieren Sie ein neues Modell anhand einer echten Anforderung aus
Sie müssen nicht die gesamte Liste übernehmen. Nehmen Sie eine Aufgabe, die Sie bereits wiederholen, bewahren Sie deren Eingabe auf und vergleichen Sie Ihr aktuelles Setup mit einem relevanten Kandidaten. Notieren Sie, was die Ausgabe inakzeptabel machen würde, bevor Sie eines der beiden ausführen.
Bei den Veranstaltungsmaterialien kann das beispielsweise ein unveränderter Termin, ein nicht überschreitbares Buchungslimit, ein erkennbar bleibender Raum oder ein Transkript sein, das eine Korrektur korrekt verarbeitet. Notieren Sie Modell und Produkt, Datum, Einstellungen, Fehler, Korrekturzeit und tatsächliche Kosten. Behalten Sie das Ergebnis, das Ihnen hilft, die Arbeit mit weniger Reparaturen abzuschließen.
Referenzen
- OpenAIs August-Systemkarte: Die August-Versionen von ChatGPT und der Unterschied zu Juli-Bereitstellungen.
- Gemini 3.7 Flash und DeepSeeks Änderungsprotokoll: Veröffentlichungsdaten, Zugriffswege und Entwickleränderungen.
- Grok 4.6 und Muse Spark 1.2 / Muse Code: Codierungsmodellankündigungen und die zugehörigen Tools.
- Imagine Image 2.0: Steuerelemente zur Bildgenerierung und -bearbeitung.
- FLUX 3 Video und Gemini Omni 1.1 Flash: Steuerelemente für Videozugriff und -erstellung.
- Gemini 3.5 Transcribe: Live- und aufgezeichnete Transkription, einschließlich Sprecherbeschränkungen.
- Muse Glimmer: lokale Bereitstellung, Gewichte und Hardware-Anleitung.
- GLM-5.3-Flash on Workers AI: Plattformverfügbarkeit und Zugriffsanforderungen.
- Qwen3.8-Flash-Next-Ankündigung und Architekturpapier: Zweck und Umfang der Architekturvorschau.







