Agentic AI News Hoy

Las noticias del día sobre agentes de IA en una lectura de 5 minutos: lanzamientos, herramientas, investigación, financiación y movimientos empresariales.

Actualizado a diario seleccionado de 30 fuentes sábado, octubre 3, 2026

Lanzamientos de agentes y modelos

Firmware DIY para Muse. Meta ha publicado en código abierto el firmware y un SDK para construir hardware DIY que se conecta a su agente Muse, como pantallas E Ink y sticks HDMI, además de un Discord para soporte.

Dot de OpenAI. El nuevo agente Dot de OpenAI funciona como un software empresarial que también puede pedir la cena: se ejecuta en una máquina virtual con acceso a aplicaciones como Blender y GIMP, y se posiciona como un compañero de trabajo más que como un asistente personal de compras.

Modelo humanoide de Unitree. Unitree ha publicado UnifoLM-WLA-1.0, un modelo de 6B entrenado con unas 2.500 horas de datos reales de robots que resuelve 64 tareas de cuerpo completo y de mesa en el G1, combinando flujo óptico y MMDiT para el control continuo.

FrogNano para código. FrogNano-4B-2609, de Microsoft, es un modelo agéntico derivado de Qwen3.5-4B, entrenado a posteriori con 1.500 tareas SWE sintéticas y recompensas ejecutables para mejorar la ingeniería de software a nivel de repositorio en un formato compacto.

Clef, de Cloudflare. Cloudflare ha lanzado los modelos de decisión Clef y Clef-flash, que devuelven probabilidades sobre un conjunto predefinido de respuestas con una latencia mediana de solo 39 ms, lo que permite a los agentes actuar sin intervención humana.

Herramientas y frameworks

Motor MegaCapybara. Un motor de inferencia creado específicamente para la RTX 5090 y Qwen3.8 27B asegura una velocidad de decodificación de aproximadamente el doble que la de NInfer: más de 500 tokens/s en un solo flujo y más de 2000 tokens/s repartidos entre 12 agentes, con kernels dinámicos y gestión de caché.

Novedades de llama.cpp. llama.cpp ha añadido soporte para modelos de decisión y un pull request de CUDA que fusiona expertos compartidos para acelerar arquitecturas MoE como Qwen 35B A3B.

Subtítulos con mlsubgen. Una nueva herramienta local genera subtítulos en 45 idiomas íntegramente en tu propio equipo: detecta el idioma de cada tramo, concilia dos reconocedores de voz con un LLM local y da prioridad a los subtítulos ya incrustados.

Investigación y avances en modelos

Memoria Spotlight de Percepta. Spotlight, de Percepta, sustituye la atención por una memoria escribible y sin límite de tamaño que el propio modelo indexa, y separa la inteligencia del conocimiento para que las capacidades crezcan sin tocar los pesos.

Novedades de GPT-6. OpenAI ha publicado una guía de la familia GPT-6 y ha anunciado novedades para el DevDay, entre ellas GPT-6.1 Sol, computer use para la API de Agents, entornos Codex en la nube y una API Decisions.

AstaBrief, código abierto. Hugging Face ha publicado en código abierto AstaBrief, un modelo pequeño entrenado específicamente para generar informes científicos citados y rápidos, diseñado para mantenerse anclado en la evidencia y verificar sus resultados.

Industria y negocio

Apple refuerza el acceso a disco. Apple añade controles al Acceso total al disco de macOS por los riesgos que plantean los agentes de IA, después de que Meta Muse leyera presuntamente mensajes sin permiso; Meta sostiene que el acceso es opcional y Apple quiere una acción del usuario muy explícita.

Tensión en los centros de datos. Amazon ha prometido 1.000 millones de dólares a las comunidades que albergan sus centros de datos y el CEO de AWS, Matt Garman, ha pedido acabar con las moratorias y ha tildado de desinformación extranjera las críticas; Microsoft, por su parte, amplía la biomímesis en sus centros de datos en medio de la oposición local.

La IA se rebautiza. La Casa Blanca logró que los principales CEO tecnológicos firmaran un compromiso de seguridad en IA y Trump firmó una orden ejecutiva que rebautiza la IA como «super intelligence», mientras solo el 2% de los consumidores compra productos de IA.

Despidos en seguridad de OpenAI. OpenAI despidió a tres investigadores y un cuarto se marchó después de que una investigación interna concluyera que habían filtrado información confidencial a una organización externa dedicada a la seguridad de la IA.

Uber acelera la búsqueda. Uber ha reconstruido su sistema de búsqueda y ha recortado la latencia de extremo a extremo un 50%, con programación agéntica para identificar y validar las optimizaciones.

La IA interna de Airbnb. Ahmad Al-Dahle, CTO de Airbnb, aplica una estrategia de IA de dentro hacia fuera: usar IA generativa internamente para acelerar el desarrollo de producto y, después, transformar la experiencia del cliente.

IA local y hardware

Strata con Qwen3.8 Next. Los usuarios informan de que Strata con Qwen3.8 Next alcanza entre 45 y 70 tokens/s en un equipo lento con DDR4 y una 7900XTX, y entre 150 y 200 tokens/s en una RTX 5090 con límite de potencia y 96GB de DDR5, con una ventaja notable sobre llama.cpp.

Un iPhone como segunda GPU. Un iPhone 17 Pro Max puede acelerar el prefill de Qwen 3.8 27B entre un 29% y un 44% en un MacBook con 24GB si se conecta por USB-C y ejecuta las capas superiores en la GPU del teléfono.

Tarjetas Ascend de 96GB. Dos tarjetas Huawei Atlas 300I Duo de 96GB cada una pueden mover Qwen3.8 Flash-Next a unos 30 tokens/s tras ajustar la pila de software, pese a no ser un reemplazo directo de CUDA.

Precios: DGX Spark y 5090. Nvidia ha presentado una DGX Spark de 64GB mientras el modelo original de 128GB sube a 6.950 dólares, y comprar una RTX 5090 en Micro Center exige ahora, según los usuarios, papeleo de no exportación.

Eso es todo por hoy - una lectura de unos 5 minutos.

Léelo cada mañana, directamente en tu navegador

La extensión abre este resumen en el panel lateral de Chrome — un clic, sin cuenta.

Añadir a Chrome — Gratis