1. La carrera de modelos no se ha frenado
Tres lanzamientos de peso en apenas dos semanas, de tres laboratorios distintos — la señal más clara de que el ciclo de lanzamientos se ha acortado de meses a semanas.
DeepSeek V4.1 Flash
Primer modelo multimodal nativo de DeepSeek (integra texto e imagen desde el diseño, no como añadido posterior). Arquitectura MoE de 552.000 millones de parámetros, con velocidades de hasta 420 tokens por segundo en tareas de razonamiento.
Fable 5.1 (Anthropic), disponible desde el 1 de septiembre
Mismo precio que su predecesor (10$/50$ por millón de tokens), con lecturas de caché bajando a 0,25$ y una puntuación propia de 52,6 en Terminal-Bench-Science frente al 24,7 de la versión anterior — más del doble, al mismo coste.
GLM-5.3-Flash (Z.ai)
El primer modelo de la familia GLM-5 nativamente multimodal, con arquitectura MoE de 320.000/18.000 millones de parámetros y ventana de contexto de 1 millón de tokens. Precio agresivo: 0,15$/0,50$ por millón de tokens.
El porqué de tanto lanzamiento a la vez no es casualidad: entrenar un modelo competitivo cuesta cada vez menos en relación a su capacidad, lo que ha metido en la carrera a más laboratorios de los tres o cuatro históricos — y cada uno compite tanto en capacidad como en precio por token.
2. Los agentes empiezan a actuar sin que los mires
Meta Muse
Agente personal capaz de ejecutar tareas por encargo: enviar correos, reservar viajes, rellenar formularios, incluso completar compras. Recibe un objetivo, elabora un plan propio y ejecuta las acciones de forma autónoma — el salto real no es la tecnología en sí, es cuánta supervisión humana deja de requerir paso a paso.
Infraestructura de agentes de OpenAI, ahora pública
La infraestructura de agentes a gran escala que ya usaba internamente ChatGPT Work está disponible como API pública, con tiempos de arranque de un agente bajo un minuto — abre la puerta a que terceros construyan sus propios productos de agentes sobre esa misma base, en vez de montarla desde cero.
Vale la pena la cautela habitual: un anuncio oficial describe lo que el agente puede hacer en condiciones controladas, no necesariamente lo que hará de forma fiable en tu caso concreto la primera semana. Esperar a que usuarios independientes lo prueben fuera del vídeo de presentación sigue siendo el filtro más útil.
«Un modelo nuevo cambia un benchmark. Un agente que de verdad actúa solo cambia una tarea de tu semana. La segunda noticia suele importar más que la primera, aunque la primera se lleve el titular.
— Redacción El Telar
3. El dinero se mueve a otra escala
6.000 ingenieros dedicados en exclusiva a trabajar directamente con clientes empresariales en el diseño y despliegue de sus sistemas de IA — una apuesta por que la adopción real, no la demo, es el cuello de botella.
Cerrada a mediados de agosto, sigue siendo el movimiento más comentado del sector. Para quien ya usa la herramienta: los cambios de producto tras una adquisición de este tamaño tardan meses en notarse, pero merece la pena vigilar precio y hoja de ruta.
4. El tablero de las herramientas de código, cada vez más apretado
La distancia entre Claude Code, Cursor, Codex y Antigravity se ha estrechado hasta converger en un mismo planteamiento de fondo: un modelo potente envuelto en un "arnés" (herramientas, memoria, acceso al repositorio) que hace la mayor parte del trabajo pesado. Claude Code mantiene la ventaja en profundidad y en uso desde terminal, con una ventana de contexto de un millón de tokens que le permite revisar repositorios grandes sin necesitar un índice previo; Codex destaca en ejecución de tareas largas sin supervisión; Cursor sigue siendo la opción más rápida para edición dentro del propio editor.
La recomendación práctica que se repite entre quienes usan varias a diario: terminal programable con Claude Code u OpenCode, velocidad dentro del editor con Cursor o Copilot, y tareas largas sin supervisión con Codex o Devin — no hay una única ganadora para todo.
5. Lo que no cabe en un repaso de novedades
El mismo mes de estos lanzamientos, los propios consejeros delegados de Anthropic y OpenAI han pedido públicamente frenar el ritmo del sector por motivos de seguridad — con un efecto inmediato y medible en bolsa el 14 de septiembre. Lo cubrimos con todo el detalle y las cifras en nuestro repaso de esa sesión de mercado: no es una nota al margen, es la tensión de fondo que atraviesa todos los lanzamientos de este artículo.