Modelos de IA a seguir en agosto de 2026: novedades y para quién son
Novedades de agosto para trabajo, código, imágenes, vídeo, transcripción y uso local, con fechas, formas de acceso y motivos para probarlas.

Si ya tienes un asistente de IA que resuelve casi todo tu trabajo, un modelo nuevo debe ganarse tu atención. Agosto aportó varios motivos: chat cotidiano actualizado, más opciones en herramientas de programación, más control al editar imágenes y vídeos y otra forma de ejecutar un asistente en tu propio ordenador.
Nuestra selección de agosto empieza por la tarea que quieras mejorar. Para quienes ya usan ChatGPT, la actualización GPT-5.6 es la más directa. Para desarrolladores, Gemini 3.7 Flash y DeepSeek-V4-Pro merecen atención. Para creadores, Imagine Image 2.0 y los controles nuevos de FLUX 3 Video y Gemini Omni 1.1 Flash ofrecen pruebas concretas.
Esta primera entrega de AI Model Monthly cubre lanzamientos y cambios relevantes de disponibilidad del 1 al 31 de agosto de 2026, comprobados con fuentes públicas el 8 de septiembre. Es una selección editorial por cambios documentados, no un torneo práctico. Las vías de acceso son las anunciadas; cuentas, regiones y planes actuales pueden variar.
Elige la parte que coincide con tu trabajo
| Tu tarea | Empieza con | Por qué merece atención |
|---|---|---|
| Escritura cotidiana y organización | Actualización de agosto de GPT-5.6 Sol / Luna | Tu experiencia de chat existente puede haber cambiado |
| Programación y trabajo de varios pasos | Gemini 3.7 Flash; DeepSeek-V4-Pro | Versiones nuevas y opciones de integración |
| Edición de imágenes promocionales | Imagine Image 2.0 | Selección de regiones y edición con referencias |
| Vídeos cortos | FLUX 3 Video; Gemini Omni 1.1 Flash | Fotogramas clave, continuación y vistas previas |
| Convertir voz en texto | Gemini 3.5 Transcribe | Vías separadas para directo y grabaciones |
| Ejecutar un asistente local | Muse Glimmer | Pesos abiertos con orientación concreta de hardware |
Las secciones explican pruebas y límites. Grok 4.6, Muse Spark 1.2, GLM-5.3-Flash y Qwen3.8-Flash-Next añaden opciones para quienes construyen con modelos.
Chat cotidiano: la actualización GPT-5.6 quizá ya te afecte
La ficha del sistema del 6 de agosto de OpenAI describe versiones nuevas de GPT-5.6 Sol y Luna para ChatGPT. Anuncia un predeterminado nuevo para Free y Go y acceso Sol actualizado con selector de esfuerzo para Plus y Pro. En ese lanzamiento, Codex y ChatGPT Work conservaron las versiones de julio.
La distinción importa cuando oyes que «GPT-5.6 ha mejorado». Producto y versión deben acompañar al nombre. Un resultado de ChatGPT no describe automáticamente la versión usada en una herramienta de programación.
Para uso cotidiano, vuelve a una tarea que antes salía mal antes de comprar otra suscripción. Imagina un evento pequeño con descripción, aforo y fecha confirmada. Pide una invitación y comprueba fecha y aforo. Una redacción más fluida que cambia cualquiera añade trabajo, sea cual sea el nombre del modelo.
Programación: agosto amplió los candidatos útiles
Los lanzamientos se orientan cada vez más a agentes, software que permite inspeccionar archivos, usar herramientas y avanzar por pasos. La pregunta práctica es si modelo y herramienta terminan el cambio con menos corrección.
Gemini 3.7 Flash: nueva opción para trabajo recurrente
Google presentó Gemini 3.7 Flash el 13 de agosto, destacando programación y agentes. Anunció acceso mediante Gemini API y Google AI Studio, además de integraciones. El acceso individual en Gemini Spark se indicó para suscriptores Pro y Ultra en países compatibles.
Su oferta inicial era de 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de salida hasta finales de 2026. Son tarifas de API, no el precio de una suscripción ni el coste completo de una tarea.
Lo incluiríamos para documentos o código repetidos donde importen coste y correcciones. En el ejemplo del evento, dale un error pequeño del formulario: el límite acepta una reserva extra. Verifica el límite y mensaje exactos. Registra reintentos y revisión además del uso; una tarifa baja sirve poco si falla repetidamente.
DeepSeek-V4-Pro: actualización tras un nombre conocido
El registro de DeepSeek del 13 de agosto recoge el lanzamiento general de V4-Pro en aplicación, web y API. Los desarrolladores siguieron usando deepseek-v4-pro. También documentó compatibilidad con Responses API y esfuerzo de pensamiento ajustable.
Para usuarios existentes, es motivo para repetir una tarea guardada. Un nombre de API igual no implica comportamiento igual. Conserva fecha y ajustes.
El mismo registro incluye V4-Flash-Vision-Exp el 21 de agosto, modelo experimental para comprensión visual. Es otra opción para leer capturas, no un generador de imágenes; su estado exige evaluar antes de depender.
Grok 4.6 y Muse Spark 1.2: mira dentro de la herramienta
Grok 4.6 se lanzó el 12 de agosto, con acceso por Grok Build, Cursor y API. Si está en tu herramienta, permite comparar cambios de varios archivos. El énfasis del proveedor en trabajo prolongado invita a probar, no demuestra más fiabilidad.
El lanzamiento de Meta del 5 de agosto unió Muse Spark 1.2, el modelo, con Muse Code beta, el agente de terminal. Separa nombres: agentes persistentes y reinicio pertenecen al sistema de ejecución, no al modelo llamado desde otro lugar.
Compara sistemas completos, o mantén fija la herramienta al comparar modelos. De lo contrario, herramientas, permisos o reintentos pueden parecer inteligencia del modelo.
Imágenes: Imagine Image 2.0 convierte la edición en la pregunta útil
Imagine Image 2.0 llegó el 7 de agosto como Quality Mode nuevo en Grok web y móvil, con API grok-imagine-image-2.0. El anuncio describe edición de regiones seleccionadas, eliminación de fondos y varias referencias.
Merece consideración para recursos promocionales que debas revisar. Con una foto autorizada del local, cambia el color de una pancarta conservando sala, muebles y señales. Examina tanto lo inalterado como lo editado. La promesa del proveedor no sustituye la inspección.
Si la imagen necesita datos exactos, revisa fecha, nombre y texto. También puedes generar lo visual y añadir texto aprobado en una herramienta de diseño. Las afirmaciones tipográficas del modelo no eliminan la corrección.
Vídeo: controla la toma antes de juzgar el espectáculo
Dos novedades importan cuando buscas una toma concreta.
FLUX 3 Video: generación abierta a usuarios de API
Black Forest Labs hizo disponible FLUX 3 Video el 4 de agosto mediante API y socios. La oferta inicial describía clips de hasta 20 segundos con audio nativo, fotogramas clave, continuación y modo borrador. Distingue HD de Full HD obtenido por escalado.
El atractivo es especificar más de la secuencia. Para un avance, parte de la imagen aprobada y pide un movimiento moderado. Juzga si la sala sigue reconocible y alcanza el punto final. Un movimiento espectacular que inventa una puerta falla.
Gemini Omni 1.1 Flash: más formas de revisar una secuencia
El lanzamiento de Google del 27 de agosto añade extensión de escenas, control de primer y último fotograma, vistas previas de menor resolución y escalado 4K en Gemini API dentro de Google AI Studio.
Lo consideraríamos cuando importan los extremos o hace falta continuar. Compara con FLUX si conservan el sujeto durante tu transición. Explicita sonido, duración y salida. Escalar a 4K no es generación nativa 4K, y extender no equivale a generar toda la duración de una vez.
Transcripción: Gemini 3.5 separa directo y grabaciones
Google anunció Gemini 3.5 Transcribe el 26 de agosto. Ofrece streaming en directo y audio pregrabado, este último con atribución y marcas por palabra. También describe vocabulario personalizado y limpieza de vacilaciones y autocorrecciones.
Sirve para convertir notas habladas en documento legible. También plantea una elección: ¿quieres lo dicho o el significado corregido?
Imagina dictar «Resérvalo para el martes… perdón, miércoles». Una nota pulida debe reflejar la corrección; un registro literal debe conservar el habla. Decide antes. Comprueba nombres, fechas y correcciones con la grabación.
El lanzamiento describe atribución para hasta tres hablantes, con grupos mayores en fase experimental. Ese límite importa más en un panel que una afirmación general de calidad.
Modelos locales y abiertos: comprueba qué puedes ejecutar
Muse Glimmer: la propuesta local más directa
Meta publicó Muse Glimmer el 10 de agosto, modelo de 30 000 millones de parámetros con pesos Apache 2.0 para agentes locales. Explica cuantización —comprimir la representación numérica— y configuraciones para 24 o 32 GB de memoria.
Merece atención si ejecutar en tu máquina es requisito. Empieza con descargas y guía. Comprueba memoria completa, incluida la de trabajo, no solo el tamaño descargado.
Un modelo local puede formar parte de un asistente local. Aún debes inspeccionar aplicación y herramientas antes de suponer que todo permanece en el dispositivo.
GLM y Qwen: opciones para desarrolladores por motivos distintos
La nota de Cloudflare del 26 de agosto confirma GLM-5.3-Flash en Workers AI con entrada multimodal, requiriendo plan Workers de pago o créditos prepago de AI Gateway. Para equipos en esa plataforma, añade despliegue. «Flash» no dice si cabe en tu portátil.
Qwen3.8-Flash-Next es más un avance arquitectónico. Su anuncio de agosto y artículo describen una versión temprana para evaluar cambios antes de Qwen4. Interesa a quien sirve o adapta modelos; no es Qwen4 ni razón obvia para cambiar el chat cotidiano.
Prueba un modelo nuevo contra un requisito real
No adoptes toda la lista. Toma una tarea repetida, conserva la entrada y compara tu sistema con un candidato pertinente. Define antes qué invalidaría el resultado.
Para los materiales del evento podría ser una fecha intacta, un límite que no se exceda, una sala reconocible o una corrección bien transcrita. Registra modelo y producto, fecha, ajustes, errores, corrección y coste. Conserva lo que termina el trabajo con menos reparación.
Referencias
- Ficha de agosto de OpenAI: versiones de ChatGPT y distinción con julio.
- Gemini 3.7 Flash y registro de DeepSeek: fechas, acceso y cambios.
- Grok 4.6 y Muse Spark 1.2 / Muse Code: modelos y herramientas.
- Imagine Image 2.0: generación y controles de edición.
- FLUX 3 Video y Gemini Omni 1.1 Flash: acceso y controles.
- Gemini 3.5 Transcribe: directo, pregrabado y límites.
- Muse Glimmer: despliegue, pesos y hardware.
- GLM-5.3-Flash en Workers AI: disponibilidad y acceso.
- Anuncio de Qwen3.8-Flash-Next y artículo: finalidad y alcance preliminar.







