Agentic AI News Hoy

Las noticias del día sobre agentes de IA en una lectura de 5 minutos: lanzamientos, herramientas, investigación, financiación y movimientos empresariales.

Actualizado a diario seleccionado de 30 fuentes sábado, septiembre 5, 2026

Lanzamiento de modelos de frontera

Lanzamiento de GPT-6 Astra. OpenAI presentó GPT-6 Astra como su nuevo buque insignia y afirma que ofrece un rendimiento de vanguardia en uso de computadora, navegación, ingeniería de software, ciberseguridad, ciencia y trabajo profesional, y que satura ARC-AGI-3 y ExploitBench.

Críticas al despliegue. El lanzamiento escalonado dejó sin acceso a muchos suscriptores de pago, lo que llevó a Sam Altman a disculparse por el desordenado despliegue; algunos usuarios pronto alcanzaron el límite de uso.

Desacuerdo en benchmarks. Epoch AI sitúa a Astra en el primer puesto entre 267 modelos, mientras que Artificial Analysis lo pone a la par de su predecesor y por detrás de Claude Fable 5.1; en ARC-AGI-3, Astra muestra una eficiencia superior a la humana.

Mejoras de seguridad. Astra alucina menos que Sol y bloquea el 99,99 % de las inyecciones directas de prompt, pero la tasa de fallo ante inyecciones indirectas sigue siendo del 8,5 %, demasiado alta para un despliegue seguro de agentes.

Seguridad e incidentes de agentes

Contrabando ASCII. Los spammers están adoptando el contrabando ASCII, una técnica de inyección de prompt, para evadir los filtros de correo. El fenómeno muestra cómo los ataques de IA se trasladan al spam común.

Modelos locales y abiertos

Variantes de Qwen3.8-27B. Un benchmark de 21 variantes cuantizadas de Qwen3.8-27B en 16 GB de VRAM muestra el equilibrio entre calidad y tamaño, con algunas cuantizaciones de menos de 3 bits que conservan la precisión.

Modelo abierto para agentes. Qwen3.8-27B completó el juego de Wikipedia en 6 clics con Playwright, y otro usuario asegura que le confía más de 8 horas seguidas de trabajo autónomo; en una tarea de depuración, el modelo de frontera GPT Sol seguía siendo más rápido.

Empaquetado ternario. Un nuevo formato GGUF empaqueta los pesos ternarios de los modelos en base 3 y reduce sin pérdidas la VRAM de los pesos en cerca del 22 %, en modelos como BitNet.

Modelos en el dispositivo. Qwen3.8-Flash-Next se ejecuta en la CPU de un teléfono, y un LLM conversacional de 90M de parámetros corre en una Sony PSP a 0,5-0,6 tokens por segundo.

Nuevos modelos abiertos. Ling-3.0-flash-VL añade comprensión visual y capacidades de agente; Drummer lanzó Artemis 31B v1 y v1.1 para escritura creativa.

Hardware e infraestructura

AMD Threadripper Halo. AMD presentó una estación de trabajo con un Threadripper PRO de 96 núcleos y dos aceleradores Instinct MI350P, con 288 GB de HBM3E en total y refrigeración líquida.

NVIDIA PAIR. La herramienta de código abierto PAIR de Nvidia enruta las solicitudes de IA local entre los dispositivos de una red doméstica, como un mini centro de datos, y reduce los tiempos de las tareas paralelas de los agentes.

Clúster de Deepseek con Huawei. Deepseek planea desplegar al menos 160 000 chips Huawei Ascend-950DT en Mongolia Interior para inferencia, un paso hacia la reducción de su dependencia de Nvidia.

Ronda de financiación de Nscale. Nscale, proveedor de cómputo de IA, busca 3500 millones de dólares en una financiación previa a la salida a bolsa, incluidos 2000 millones de Nvidia, después de firmar un acuerdo de unos 45 000 millones con Anthropic.

Dispositivos para desarrolladores. El Project Zenith de Microsoft ofrecerá un Windows sin distracciones en equipos con 64 GB o más de memoria unificada, capaces de ejecutar en local modelos de más de 30B de parámetros; el HomeAgent de Ugreen combina NAS, NVR y un asistente local de IA, con soporte hasta Jetson Thor.

Industria y negocios

Financiación de XDOF. La startup de datos para robots XDOF negocia una Serie B con una valoración de 1200 millones de dólares, tres meses después de salir del modo sigiloso con una Serie A de 70 millones.

Gobierno de Anthropic. El Long-Term Benefit Trust de Anthropic, que controla la mayoría del consejo, afronta un mayor escrutinio a medida que se acerca su salida a bolsa de 2 billones de dólares.

Adquisición de Hugging Face. Nvidia confirmó la compra de Hugging Face por 12 930 millones de dólares; el precio contiene un huevo de pascua que codifica el emoji 🤗.

Copilot en Azure Repos. Microsoft habilitó la revisión de código con Copilot en Azure Repos, con facturación por revisión e informes con dos días de retraso.

Gemini Photos. Gemini Spark de Google ya puede gestionar Google Photos: edita fotos, organiza álbumes y realiza tareas de flujo de trabajo para los suscriptores de Pro/Ultra en Estados Unidos.

Defensa sobre derechos de autor. Microsoft asegura que menos del 1 % de los 8,2 millones de registros de chat de Copilot reproducen al menos 16 palabras de contenido de noticias, en contra de las reclamaciones de los editores por derechos de autor.

Investigación destacada

Entornos de terminal. Terminal-Universe reconstruye entornos de terminal ejecutables a partir de trayectorias de agentes, lo que permite la síntesis escalable de tareas para el post-entrenamiento.

Reconstrucción 3D. Scal3R reformula la reconstrucción 3D en línea con consultas multi-relativas de pose y reduce el ATE medio en más del 60 % en KITTI.

Modelo de mundo unificado. Puffin-World integra comprensión física, simulación espacial y generación 3D en un único modelo multimodal, sin módulos externos offline.

Eso es todo por hoy - una lectura de unos 5 minutos.

Léelo cada mañana, directamente en tu navegador

La extensión abre este resumen en el panel lateral de Chrome — un clic, sin cuenta.

Añadir a Chrome — Gratis