Volver a todos los artículos
Artículo

Modelos de IA a seguir en agosto de 2026: novedades y para quién son

Autor:

Novedades de agosto para trabajo, código, imágenes, vídeo, transcripción y uso local, con fechas, formas de acceso y motivos para probarlas.

Una caja de herramientas abierta y compartimentada con un documento, una imagen, una película y un micrófono

Si ya tienes un asistente de IA que resuelve casi todo tu trabajo, un modelo nuevo debe ganarse tu atención. Agosto aportó varios motivos: chat cotidiano actualizado, más opciones en herramientas de programación, más control al editar imágenes y vídeos y otra forma de ejecutar un asistente en tu propio ordenador.

Nuestra selección de agosto empieza por la tarea que quieras mejorar. Para quienes ya usan ChatGPT, la actualización GPT-5.6 es la más directa. Para desarrolladores, Gemini 3.7 Flash y DeepSeek-V4-Pro merecen atención. Para creadores, Imagine Image 2.0 y los controles nuevos de FLUX 3 Video y Gemini Omni 1.1 Flash ofrecen pruebas concretas.

Esta primera entrega de AI Model Monthly cubre lanzamientos y cambios relevantes de disponibilidad del 1 al 31 de agosto de 2026, comprobados con fuentes públicas el 8 de septiembre. Es una selección editorial por cambios documentados, no un torneo práctico. Las vías de acceso son las anunciadas; cuentas, regiones y planes actuales pueden variar.

Elige la parte que coincide con tu trabajo

Tu tareaEmpieza conPor qué merece atención
Escritura cotidiana y organizaciónActualización de agosto de GPT-5.6 Sol / LunaTu experiencia de chat existente puede haber cambiado
Programación y trabajo de varios pasosGemini 3.7 Flash; DeepSeek-V4-ProVersiones nuevas y opciones de integración
Edición de imágenes promocionalesImagine Image 2.0Selección de regiones y edición con referencias
Vídeos cortosFLUX 3 Video; Gemini Omni 1.1 FlashFotogramas clave, continuación y vistas previas
Convertir voz en textoGemini 3.5 TranscribeVías separadas para directo y grabaciones
Ejecutar un asistente localMuse GlimmerPesos abiertos con orientación concreta de hardware

Las secciones explican pruebas y límites. Grok 4.6, Muse Spark 1.2, GLM-5.3-Flash y Qwen3.8-Flash-Next añaden opciones para quienes construyen con modelos.

Chat cotidiano: la actualización GPT-5.6 quizá ya te afecte

La ficha del sistema del 6 de agosto de OpenAI describe versiones nuevas de GPT-5.6 Sol y Luna para ChatGPT. Anuncia un predeterminado nuevo para Free y Go y acceso Sol actualizado con selector de esfuerzo para Plus y Pro. En ese lanzamiento, Codex y ChatGPT Work conservaron las versiones de julio.

La distinción importa cuando oyes que «GPT-5.6 ha mejorado». Producto y versión deben acompañar al nombre. Un resultado de ChatGPT no describe automáticamente la versión usada en una herramienta de programación.

Para uso cotidiano, vuelve a una tarea que antes salía mal antes de comprar otra suscripción. Imagina un evento pequeño con descripción, aforo y fecha confirmada. Pide una invitación y comprueba fecha y aforo. Una redacción más fluida que cambia cualquiera añade trabajo, sea cual sea el nombre del modelo.

Programación: agosto amplió los candidatos útiles

Los lanzamientos se orientan cada vez más a agentes, software que permite inspeccionar archivos, usar herramientas y avanzar por pasos. La pregunta práctica es si modelo y herramienta terminan el cambio con menos corrección.

Gemini 3.7 Flash: nueva opción para trabajo recurrente

Google presentó Gemini 3.7 Flash el 13 de agosto, destacando programación y agentes. Anunció acceso mediante Gemini API y Google AI Studio, además de integraciones. El acceso individual en Gemini Spark se indicó para suscriptores Pro y Ultra en países compatibles.

Su oferta inicial era de 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de salida hasta finales de 2026. Son tarifas de API, no el precio de una suscripción ni el coste completo de una tarea.

Lo incluiríamos para documentos o código repetidos donde importen coste y correcciones. En el ejemplo del evento, dale un error pequeño del formulario: el límite acepta una reserva extra. Verifica el límite y mensaje exactos. Registra reintentos y revisión además del uso; una tarifa baja sirve poco si falla repetidamente.

DeepSeek-V4-Pro: actualización tras un nombre conocido

El registro de DeepSeek del 13 de agosto recoge el lanzamiento general de V4-Pro en aplicación, web y API. Los desarrolladores siguieron usando deepseek-v4-pro. También documentó compatibilidad con Responses API y esfuerzo de pensamiento ajustable.

Para usuarios existentes, es motivo para repetir una tarea guardada. Un nombre de API igual no implica comportamiento igual. Conserva fecha y ajustes.

El mismo registro incluye V4-Flash-Vision-Exp el 21 de agosto, modelo experimental para comprensión visual. Es otra opción para leer capturas, no un generador de imágenes; su estado exige evaluar antes de depender.

Grok 4.6 y Muse Spark 1.2: mira dentro de la herramienta

Grok 4.6 se lanzó el 12 de agosto, con acceso por Grok Build, Cursor y API. Si está en tu herramienta, permite comparar cambios de varios archivos. El énfasis del proveedor en trabajo prolongado invita a probar, no demuestra más fiabilidad.

El lanzamiento de Meta del 5 de agosto unió Muse Spark 1.2, el modelo, con Muse Code beta, el agente de terminal. Separa nombres: agentes persistentes y reinicio pertenecen al sistema de ejecución, no al modelo llamado desde otro lugar.

Compara sistemas completos, o mantén fija la herramienta al comparar modelos. De lo contrario, herramientas, permisos o reintentos pueden parecer inteligencia del modelo.

Imágenes: Imagine Image 2.0 convierte la edición en la pregunta útil

Imagine Image 2.0 llegó el 7 de agosto como Quality Mode nuevo en Grok web y móvil, con API grok-imagine-image-2.0. El anuncio describe edición de regiones seleccionadas, eliminación de fondos y varias referencias.

Merece consideración para recursos promocionales que debas revisar. Con una foto autorizada del local, cambia el color de una pancarta conservando sala, muebles y señales. Examina tanto lo inalterado como lo editado. La promesa del proveedor no sustituye la inspección.

Si la imagen necesita datos exactos, revisa fecha, nombre y texto. También puedes generar lo visual y añadir texto aprobado en una herramienta de diseño. Las afirmaciones tipográficas del modelo no eliminan la corrección.

Vídeo: controla la toma antes de juzgar el espectáculo

Dos novedades importan cuando buscas una toma concreta.

FLUX 3 Video: generación abierta a usuarios de API

Black Forest Labs hizo disponible FLUX 3 Video el 4 de agosto mediante API y socios. La oferta inicial describía clips de hasta 20 segundos con audio nativo, fotogramas clave, continuación y modo borrador. Distingue HD de Full HD obtenido por escalado.

El atractivo es especificar más de la secuencia. Para un avance, parte de la imagen aprobada y pide un movimiento moderado. Juzga si la sala sigue reconocible y alcanza el punto final. Un movimiento espectacular que inventa una puerta falla.

Gemini Omni 1.1 Flash: más formas de revisar una secuencia

El lanzamiento de Google del 27 de agosto añade extensión de escenas, control de primer y último fotograma, vistas previas de menor resolución y escalado 4K en Gemini API dentro de Google AI Studio.

Lo consideraríamos cuando importan los extremos o hace falta continuar. Compara con FLUX si conservan el sujeto durante tu transición. Explicita sonido, duración y salida. Escalar a 4K no es generación nativa 4K, y extender no equivale a generar toda la duración de una vez.

Transcripción: Gemini 3.5 separa directo y grabaciones

Google anunció Gemini 3.5 Transcribe el 26 de agosto. Ofrece streaming en directo y audio pregrabado, este último con atribución y marcas por palabra. También describe vocabulario personalizado y limpieza de vacilaciones y autocorrecciones.

Sirve para convertir notas habladas en documento legible. También plantea una elección: ¿quieres lo dicho o el significado corregido?

Imagina dictar «Resérvalo para el martes… perdón, miércoles». Una nota pulida debe reflejar la corrección; un registro literal debe conservar el habla. Decide antes. Comprueba nombres, fechas y correcciones con la grabación.

El lanzamiento describe atribución para hasta tres hablantes, con grupos mayores en fase experimental. Ese límite importa más en un panel que una afirmación general de calidad.

Modelos locales y abiertos: comprueba qué puedes ejecutar

Muse Glimmer: la propuesta local más directa

Meta publicó Muse Glimmer el 10 de agosto, modelo de 30 000 millones de parámetros con pesos Apache 2.0 para agentes locales. Explica cuantización —comprimir la representación numérica— y configuraciones para 24 o 32 GB de memoria.

Merece atención si ejecutar en tu máquina es requisito. Empieza con descargas y guía. Comprueba memoria completa, incluida la de trabajo, no solo el tamaño descargado.

Un modelo local puede formar parte de un asistente local. Aún debes inspeccionar aplicación y herramientas antes de suponer que todo permanece en el dispositivo.

GLM y Qwen: opciones para desarrolladores por motivos distintos

La nota de Cloudflare del 26 de agosto confirma GLM-5.3-Flash en Workers AI con entrada multimodal, requiriendo plan Workers de pago o créditos prepago de AI Gateway. Para equipos en esa plataforma, añade despliegue. «Flash» no dice si cabe en tu portátil.

Qwen3.8-Flash-Next es más un avance arquitectónico. Su anuncio de agosto y artículo describen una versión temprana para evaluar cambios antes de Qwen4. Interesa a quien sirve o adapta modelos; no es Qwen4 ni razón obvia para cambiar el chat cotidiano.

Prueba un modelo nuevo contra un requisito real

No adoptes toda la lista. Toma una tarea repetida, conserva la entrada y compara tu sistema con un candidato pertinente. Define antes qué invalidaría el resultado.

Para los materiales del evento podría ser una fecha intacta, un límite que no se exceda, una sala reconocible o una corrección bien transcrita. Registra modelo y producto, fecha, ajustes, errores, corrección y coste. Conserva lo que termina el trabajo con menos reparación.

Referencias