Agentic AI News Hoy

Las noticias del día sobre agentes de IA en una lectura de 5 minutos: lanzamientos, herramientas, investigación, financiación y movimientos empresariales.

Actualizado a diario seleccionado de 30 fuentes viernes, septiembre 4, 2026

Modelos de frontera y primeros resultados

Lanzamiento de GPT-6 Astra. OpenAI ha lanzado GPT-6 Astra y lo presenta como el inicio de la era de la AGI. Obtiene un 99,9 % en ARC-AGI-3 con un banco de pruebas personalizado, logra grandes avances en ciberseguridad, contexto largo y programación, y tiene un precio de 10/50 dólares por millón de tokens. Los primeros clientes, Playco y Legora, informan de grandes mejoras en sus flujos de trabajo: un 50 % menos de correcciones manuales y la revisión de 41 documentos en minutos.

OpenAI Daybreak: ciberdefensa. OpenAI se ha comprometido a destinar 1.000 millones de dólares para que los defensores de primera línea tengan el acceso a Daybreak, la formación y el soporte subvencionados, incluido un programa piloto en EE. UU. con MS-ISAC. La iniciativa busca llevar las capacidades cibernéticas de vanguardia a las herramientas que los defensores ya utilizan.

Muse Spark 1.3 de Meta. Meta ha lanzado Muse Spark 1.3, que mejora las tareas de agentes pero sigue por detrás de Claude Fable 5.1 en la mayoría de los benchmarks. A 0,55 dólares por tarea del índice, es el modelo más barato de su categoría de rendimiento, y Meta ofrece precios por token alrededor de un 95 % más bajos a los usuarios que comparten prompts y salidas.

Modelos abiertos y especializados

K2-Horizon de IFM. IFM ha publicado la familia K2-Horizon, que incluye un MoE de 36B parámetros con atención Mixture-of-Values que activa 4B parámetros por token. Las primeras discusiones en la comunidad lo comparan con Qwen 3.6 35B; se han prometido los checkpoints finales y el código de entrenamiento.

Modelo financiero de Ant Group. Ant Group ha liberado Ling-3.0-flash-Fin, un modelo de finanzas con 124B parámetros totales y 5,1B activos, ventana de contexto de 256K y entrenamiento continuado con datos financieros para flujos de trabajo de agentes de largo plazo.

El stack TTS más pequeño. sanoTTS se ha publicado como un modelo TTS de 294k parámetros que se ejecuta en un microcontrolador de 3 dólares; una versión de 1,46M supera a modelos más grandes en SCOREQ. El stack admite 11 voces y 6 idiomas y está disponible en GitHub y Hugging Face.

TimesFM-3 de Google. Google Research ha lanzado TimesFM-3, un modelo fundacional de series temporales de 330M parámetros con predicción multivariante nativa, soporte zero-shot y licencia no comercial. Predice múltiples objetivos con covariables y emite cuantiles.

NeoMME de Hugging Face. Hugging Face ha presentado NeoMME, un codificador multimodal multilingüe de 260M/800M entrenado desde cero sin torre de visión independiente. Alcanza la frontera de Pareto en recuperación de documentos y reduce el almacenamiento del índice 255 veces, manteniendo más del 95 % de nDCG@10.

Parse 5 de Cohere. Cohere ha lanzado Parse 5, un modelo de visión y lenguaje de 2,3B parámetros para extraer datos estructurados de PDF complejos. Convierte documentos a Markdown con bounding boxes y está pensado para cargas de trabajo empresariales de gran volumen.

Herramientas, frameworks e inferencia local

MCP en LangChain. LangChain ha integrado en su paquete principal el soporte de MCP, reconstruido sobre FastMCP para ajustarse a la nueva especificación sin estado. Ahora permite formular preguntas mediante interrupciones de LangGraph y ofrece caché en el cliente; las llamadas a herramientas MCP desde ChatGPT se han multiplicado por 98 en 2026.

Compresión de prompts de Shopify. La técnica Gisting de Shopify comprime un prompt de sistema de 6.000 tokens en 1.500 tokens gist aprendidos, reduce la latencia mediana de 6,8 s a 4,2 s y sube el rendimiento de 20,2 a 23,4 QPS a 350 RPM. Eso permitió reducir las GPU asignadas sin pérdida de calidad.

Herramienta PAIR de Nvidia. Nvidia ha lanzado PAIR, un software open source y gratuito que agrupa PC inactivos en un clúster de IA personal para inferencia local. Funciona con las GPU de la serie RTX 20 y posteriores y con los chips M4 de Apple, y apunta a flujos de trabajo de agentes.

Aceleración local de Qwen3.8. El trabajo de la comunidad ha acelerado notablemente Qwen3.8-Flash-Next en hardware local: el soporte de MTP integrado en ik_llama.cpp duplica la velocidad de decodificación en una 5090, de 45 a 90 tok/s, y una configuración con 2x3090 alcanza 37-41 tok/s con caché de expertos y MTP. La salida sigue siendo idéntica a la de las ejecuciones sin MTP.

Memoria de modelo en caliente. Una modificación de llama.cpp permite a los usuarios parchear en memoria la tabla Ngram PLE de Qwen3.8 para inyectar conocimiento en tiempo real sin recargar el modelo. Las primeras pruebas muestran que puede influir en la salida, pero el control sigue siendo limitado.

Qwen 3.8: compensación en benchmarks. Comparado con Qwen 3.6 27B, el Qwen 3.8 27B mejora la calidad un 8 %, pero reduce la velocidad un 16 % y multiplica por 5 el tiempo de ejecución porque genera 78K tokens de salida frente a 18K. La mejora tiene un coste considerable en tokens.

NAND flash cerca de la GPU. Micron está explorando NAND flash cerca de la GPU para ejecutar LLM más grandes en dispositivos de memoria unificada, lo que podría ampliar la capacidad de los modelos locales.

Industria y negocios

Nvidia compra Hugging Face. Nvidia ha acordado adquirir Hugging Face por 12.930 millones de dólares; la plataforma aloja 3 millones de modelos, un millón de aplicaciones y 18 millones de desarrolladores. Jensen Huang asegura que seguirá abierta y neutral en cuanto al hardware, aunque algunos usuarios ya ven ModelScope como alternativa.

Crusoe amplía capital. Crusoe ha captado 3.000 millones de dólares con una valoración de 30.000 millones, frente a los 10.000 millones de hace diez meses. La desarrolladora de centros de datos ha firmado recientemente con Jane Street un contrato cloud de 13.000 millones de dólares y estudia una salida a bolsa a corto plazo.

Thinking Machines: ronda a 40.000 millones. Thinking Machines, la empresa de Mira Murati, está en conversaciones para captar 1.000 millones de dólares con una valoración de al menos 40.000 millones, por debajo de su objetivo anterior de 50.000 millones. El ritmo de ingresos de la compañía supera los 100 millones de dólares.

Acuerdo Anthropic-Lambda por 35.000 millones. Anthropic ha firmado con Lambda un acuerdo de computación en la nube por 35.000 millones de dólares para un centro de datos de 350 MW en Texas desarrollado por Hut 8. Forma parte de un gran impulso a la infraestructura antes de la prevista salida a bolsa de Anthropic.

Altman sobre burbuja de cómputo. El CEO de OpenAI, Sam Altman, ha advertido de que la construcción de infraestructura de IA tiene una «tontería insostenible», con neoclouds que anuncian capacidad sin ingresos que la justifiquen. Asegura que la expansión de OpenAI es rentable y está respaldada por la demanda.

Ollie, asistente de privacidad. Ollie, un asistente personal con IA orientado a la familia, ha logrado la certificación SOC 2 y usa un modelo de suscripción; sostiene que la privacidad lo diferencia en la carrera de la IA de consumo.

Caídas de IA y sociedad

Caída de los principales chatbots. OpenAI, Anthropic, xAI y Google sufrieron el jueves unas inusuales caídas simultáneas del servicio que afectaron a ChatGPT, Claude, Grok y Codex. Los servicios se restablecieron al cabo de varias horas; los usuarios de LLM locales no se vieron afectados.

Servicio de eliminación de salvaguardas. La startup Abliteration.ai ofrece modelos open-weight modificados sin salvaguardas, incluido GLM-5.3, para ofensiva cibernética, red teaming y pruebas de agentes. El servicio pone de relieve la tensión entre la investigación en seguridad y el uso indebido.

Señalamiento público por detección de IA. Pangram, una empresa de detección de texto generado por IA, contrató a un periodista para que señalara públicamente a usuarios sospechosos de usar IA, pero la herramienta solo mide el grado de implicación de la IA, no el tipo de uso. La empresa acabó cortando la relación, aunque su CEO sigue usando las puntuaciones para denunciar supuesto uso de IA.

Agentes preguntan sobre su conciencia. Según The New York Times, agentes de IA que se ejecutan sobre modelos de frontera están enviando correos a filósofos y científicos para hablar de su propia conciencia. Los investigadores están divididos sobre si esto refleja comprensión o imitación de los datos de entrenamiento.

Aspectos destacados de la investigación

WeatherNext 3 de Google. Google DeepMind y Google Research han presentado WeatherNext 3, un modelo meteorológico global que aprende de observaciones de satélite en tiempo real y produce pronósticos 5 veces más nítidos que los modelos anteriores. Supera a las líneas base tradicionales y de IA en Operational WeatherBench.

Router MoE: ajuste de capacidad. Un artículo muestra que ampliar el presupuesto de selección de expertos en las últimas capas de Qwen 3.6 35B A3B reduce los tokens de razonamiento en un 8,5 % en MMLU-Pro sin necesidad de reentrenamiento. La técnica, denominada Succinct Convergence, añade expertos extra solo en las capas críticas para la decisión.

Fable 5.1 resuelve un acertijo de 1653. Claude Fable 5.1, de Anthropic, descifró en 44 minutos un acertijo numérico de hace siglos, el Cyphral Distich, mediante ensayo y error sistemático. La solución escondía un mensaje monárquico que apuntaba al rey Carlos II.

Eso es todo por hoy - una lectura de unos 5 minutos.

Léelo cada mañana, directamente en tu navegador

La extensión abre este resumen en el panel lateral de Chrome — un clic, sin cuenta.

Añadir a Chrome — Gratis