Agentic AI News Hoy

Las noticias del día sobre agentes de IA en una lectura de 5 minutos: lanzamientos, herramientas, investigación, financiación y movimientos empresariales.

Actualizado a diario seleccionado de 30 fuentes jueves, octubre 8, 2026

Modelos e interfaces

Claude Haiku 5.5. El nuevo modelo rápido y barato de Anthropic ofrece un contexto de un millón de tokens y deja el precio del prompt en 0,10 $/M hasta 100.000 tokens, idéntico al de GPT-6 Luna. El problema es que su tokenizador cuenta entre un 25 % y un 30 % más de tokens, y a partir de esos 100.000 el precio se multiplica por cinco. En benchmarks da un salto enorme frente a Haiku 4.5 y compite de tú a tú en coding agéntico.

Mistral Large 4 «Le Chonk». Mistral ha publicado en preview un modelo de pesos abiertos de un billón de parámetros, optimizado para coding, ciberdefensa y sectores concretos, y asegura que su capacidad roza la de los modelos frontera estadounidenses y chinos.

Modelos d1 de Liquid AI. Liquid AI ha liberado d1-3B y d1-omni-600M, modelos multimodales de decisión que devuelven respuestas calibradas de sí/no, de elección o de puntuación sin gastar tokens de salida. d1-3B presume de ser el mejor por debajo de 10B en el Decision Index y se ejecuta en tan solo 16 ms sobre hardware NVIDIA Jetson; también empieza a aparecer un port a WebGPU para navegador.

API Decisions de OpenAI. OpenAI ha lanzado en beta la API Decisions para evaluaciones de sí/no, por categorías y de escala sobre texto o imágenes, unas diez veces más rápida que Responses. Admite GPT-6 Luna a 0,10 $/M de entrada y no cobra los tokens de salida.

Interfaz inteligente de ChatGPT. Con GPT-6, ChatGPT puede generar gráficos interactivos, botones, formularios y mini apps en lugar de texto plano. OpenAI asegura que el razonamiento arranca ya durante el pensamiento para recortar la espera, y que los usuarios de pago tendrán GPT-6 Sol mientras que los gratuitos se quedan con Luna.

Generación de vídeo de Kandinsky 6.0. Kandinsky Lab ha publicado Kandinsky 6.0 Pro (29B) y Lite (3B) con soporte para ComfyUI y Diffusers, e incorpora un escalador de vídeo.

Nemotron, oro en la IMO. Variantes afinadas de Nemotron lograron resultados no oficiales de nivel oro en la IOI 2026 (535,4/600) y una puntuación oficial de oro de 30/42 en la IMO 2026, con SFT, RL y generate-verify-refine.

Agentes y frameworks

Agentes de Nous Research. Nous Research ha levantado 90 millones de dólares con una valoración de 1.500 millones y ha lanzado Hermes for Businesses, orientado a agentes de IA empresariales. Su Hermes Agent de código abierto acumula 24 millones de clones y mueve un 2,5 % estimado del consumo mundial de tokens de IA.

Deep Agents de LangChain. LangChain ha presentado novedades en Skills que vinculan herramientas a habilidades para mantener el contexto pequeño, además de Managed Deep Agents v0.9, con programaciones creadas por el propio agente, configuración por ejecución y reacciones de Slack.

Acciones locales de Copilot. La Hybrid Intelligence de Microsoft permitirá a Copilot acceder a archivos locales y ejecutar acciones en todo Windows: buscar, renombrar, comprimir en zip o enviar documentos por correo en nombre del usuario.

Muse de Meta, al iPad. Muse, el asistente agéntico de Meta, ya tiene soporte nativo para iPad tras alcanzar los 6,6 millones de instalaciones, y suma conectores para herramientas como Canva, GitHub y QuickBooks.

Agent Lightning, RL agéntico. Microsoft Research ha liberado Agent Lightning v1.0, un framework de RL agéntico de 3.500 líneas que usa harnesses de despliegue reales y Kubernetes nativo. En un ejemplo, elevó el Pass@1 de Qwen3.5-9B en SWE-bench Verified del 41,8 % al 56,4 % con unos 6.000 ejemplos de entrenamiento.

IA local y herramientas para desarrolladores

ROCm 10.1. ROCm 10.1 de AMD apunta al cuello de botella del movimiento de datos en la inferencia local, un lanzamiento que los usuarios de IA local han comentado en Reddit.

llama.cpp acelera los MoE. llama.cpp incorpora una caché en GPU para los expertos MoE que se mantienen en memoria del host, lo que promete grandes acelerones en modelos que no caben enteros en la VRAM, y añade soporte para GLM5Next MTP.

Unsloth Studio verifica repositorios. Unsloth Studio ahora vuelve a comprobar los repositorios de modelos de confianza antes de ejecutarlos, después de que unas versiones comprometidas de LiteLLM en PyPI mostraran cómo los ataques a la cadena de suministro pueden llegar a las herramientas de IA.

GLM-5.3-Flash en doble GPU. Un montaje con dos CMP 170HX de 64 GB mueve GLM-5.3-Flash con 384K de contexto y unos 90 tokens por segundo gracias a EXL3, con el MoE de 320B manteniendo los pesos activos en HBM y comparándose con Qwen3.8-Flash-Next en benchmarks.

Benchmarks de Qwen en local. Varias evaluaciones de la comunidad comparan fine-tunes de Qwen3.8-27B y Qwen3.8-Flash-Next con modelos frontera en tareas de dominio específico y de código. Una evaluación de 469 preguntas concluye que los modelos locales pueden acercarse a los resultados frontera con privacidad y menor coste, aunque el abuso de tokens de pensamiento sigue siendo un problema.

Hardware y Windows

Nuevo hardware Surface con IA. Microsoft ha anunciado el Surface Laptop Ultra y el Surface RTX Spark Dev Box, ambos sobre el chip RTX Spark de Nvidia, basado en Arm. El portátil arranca en 2.599 dólares, con hasta 128 GB de memoria unificada, y llega el 16 de octubre; la Dev Box parte de 5.999 dólares y está pensada para ejecutar modelos locales de más de 120B.

Industria y negocio

Brecha de comprensión del código. Una encuesta a 300 responsables sénior de ingeniería concluye que los agentes de código han desplazado el cuello de botella hacia la depuración y la comprensión: los equipos dedican ahora 9,8 horas semanales a escribir código y 16,9 a depurarlo. El informe avisa de un riesgo creciente en bases de código críticas.

Iniciativa de la célula virtual. Biohub coordina un esfuerzo de 1.800 millones de dólares para construir modelos de IA que predigan el comportamiento celular. Google DeepMind, Meta e Isomorphic Labs aportan 300 millones, y el Departamento de Energía de EE. UU. pone más de 500 millones para mediciones de laboratorio y cómputo.

Clones open source de Adobe. El desarrollador Brandon Thomas usó Claude Opus 5.5 para crear Artcraft, una suite de siete aplicaciones open source en Rust y WebAssembly que clonan Photoshop, Illustrator, Premiere y otros programas de Adobe. Las apps son muy recientes y todavía arrastran muchas carencias, pero el proyecto demuestra la reimplementación en sala limpia asistida por IA.

SynthID se abre al público. Google ha abierto al público su detector SynthID, que permite a cualquiera comprobar si imágenes, vídeos y audio llevan marcas de agua de Google o de sus socios. El sistema ya ha marcado más de 180.000 millones de elementos multimedia y también está integrado en Chrome y Gemini.

Playground, juegos con IA. Google Labs ha lanzado Playground, una plataforma en el navegador donde los adultos de EE. UU. pueden crear juegos a partir de prompts de texto, con Gemini, Nano Banana y Lyria por debajo. Unity también ha anunciado Unity Spark para el desarrollo profesional de videojuegos asistido por IA.

Eso es todo por hoy - una lectura de unos 5 minutos.

Léelo cada mañana, directamente en tu navegador

La extensión abre este resumen en el panel lateral de Chrome — un clic, sin cuenta.

Añadir a Chrome — Gratis