Agentic AI News Hoy

Las noticias del día sobre agentes de IA en una lectura de 5 minutos: lanzamientos, herramientas, investigación, financiación y movimientos empresariales.

Actualizado a diario seleccionado de 30 fuentes lunes, agosto 24, 2026

Lanzamientos de agentes y modelos

Misterioso Ox Alpha. Un nuevo modelo gratuito llamado Ox Alpha apareció en OpenRouter como modelo de razonamiento para programación y trabajo agéntico prolongado, pero su desarrollador sigue siendo anónimo. El CEO de Stripe, Patrick Collison, lo calificó de «muy impresionante»; las especulaciones van desde GLM hasta el MAI de Microsoft.

Herramientas y frameworks

Cloudflare OS, código abierto. Cloudflare ha liberado el código de Cloudflare OS, una plataforma de IA corporativa donde cada documento o aplicación se ejecuta en un sandbox aislado («Gadget»), lo que permite a usuarios no técnicos hacer vibe coding con seguridad. Incluye chatbots con conectores, automatización de flujos de trabajo y control de políticas mediante un modelo basado en capacidades.

Elogios a DeepSeek Harness. Un usuario asegura que DeepSeek Harness es excepcional para flujos de agentes: la configuración progresiva y las peticiones en lenguaje natural permitieron integrarlo con SimpleX sin esperar a un PR. No impone criterio y se puede moldear hasta lograr el comportamiento de agente deseado.

Modelos locales y abiertos

Impacto local del Qwen 3.8. Los informes de la comunidad califican el Qwen 3.8 27B como un punto de inflexión para la programación local y el OCR, con una calidad de OCR superior a la de Gemini 3.5 Flash Lite y un rendimiento comparable al de los modelos de frontera de hace un año. Las comparaciones de cuantización (Atomic Dynamic GGUF) muestran que las diferencias entre Q4 y Q6 no son drásticas, y cuantizaciones bajas como Q3 XXS pueden trabajar de forma autónoma durante horas en un Mac mini de 24 GB. Sin embargo, un port de 39 000 líneas de C a HTML en una sola pasada solo dio un resultado aceptable con Opus 5, lo que demuestra que los modelos locales dependen en gran medida del harness y del prompt.

LLM de contexto largo en 60 MB. Un desarrollador entrenó un modelo de 250M de parámetros con 30B tokens y lo cuantizó a menos de 2 bits, ejecutándolo en 80 MB de RAM a 400 tokens/s en CPU. Comprime el contexto más antiguo en disco a 320 bytes por token para un historial de hasta 1M de tokens, pero no fue entrenado para razonar sobre ese contexto.

Dreamer 4, menos de $150. Un modelo de mundo Dreamer 4 de 1.57B de parámetros se entrenó desde cero por menos de $150 usando fotogramas generados con Procgen y acciones conocidas. El PSNR del tokenizador alcanzó 40,41, lo que demuestra que no hacen falta modelos de mundo a escala de frontera.

Resumen de optimización local. Los informes incluyen una aceleración del 30-50% al pasar de llama.cpp en Windows a vLLM en Linux, soporte de MTP para GLM-4.5-Air en llama.cpp para máquinas con mucha memoria, la cuantización ConvRot, que ofrece calidad cercana a la de Q8 con tamaños de Q6, y deepseek-v4-flash Q8 ejecutándose a 24 tokens/s en EPYC+5090 con más de 100k de contexto.

Destacados de investigación

Trampas cognitivas por memoria. MemTrapBench evalúa las trampas cognitivas inducidas por la memoria (fijación en el razonamiento, distorsión de creencias) en los LLM; todas las estrategias de memoria probadas rinden por debajo de la línea base sin memoria en más de un 10%, y AdaptiveMem mitiga las trampas a la vez que conserva el rendimiento.

Gradientes de evolución de SkillEvo. SkillEvo utiliza la retroalimentación de interacciones multiturno para generar gradientes de evolución fiables para las habilidades de los agentes, abordando la degradación de la retroalimentación basada en un solo turno de preguntas y respuestas y permitiendo reparar estructuralmente los fallos de habilidad.

VLM desde capturas de pantalla. El ajuste fino de un VLM de 450M con 50K capturas de pantalla de navegador mejoró el rendimiento en la tarea de 1/100 a 44/100, lo que demuestra que los modelos pequeños pueden aprender a comprender la interfaz para tareas de agentes.

Paradoja del científico de IA. Un artículo teórico de economía sostiene que el ahorro de tiempo que proporciona la IA puede empujar a los investigadores a emprender más proyectos con menos esfuerzo en cada uno, lo que podría reducir la calidad de la investigación incluso si los modelos de lenguaje funcionaran perfectamente.

Industria y negocios

Rivales más baratos de Anthropic. Los ingresos anualizados de Anthropic alcanzaron los 65 000 millones de dólares, pero su mejor modelo, Fable 5, tiene poca adopción (8% del gasto de Ramp) en comparación con Opus 4.8 (28%), mientras las herramientas más baratas prosperan. Los ingresos de OpenAI subieron un 35% tras el lanzamiento de GPT-5.6.

Stripe compra OpenRouter. La adquisición de OpenRouter por parte de Stripe señala que los tokens se están convirtiendo en un recurso económico; el uso de tokens por parte de agentes en OpenRouter creció 14 veces desde febrero, mientras que el uso humano solo aumentó 2,8 veces, y el 70% de los tokens de agentes provienen de prompts en caché. Los agentes eligen cada vez más los modelos según el costo, la latencia y la fiabilidad.

Servidores de Nvidia suben 15%. La escasez de memoria está elevando los precios de los servidores de IA de Nvidia más de un 15% en los sistemas Vera Rubin y Grace Blackwell por los aumentos de coste de la DRAM de Samsung, SK Hynix y Micron, lo que afecta a los gigantes de la nube y a los laboratorios de IA.

Nvidia licencia Poolside. Nvidia invierte 1 000 millones de dólares en Poolside y paga 6 000 millones para licenciar su tecnología, trasladando a más de 100 ingenieros a Nemotron, con el objetivo de competir con los pesos abiertos chinos.

Un agente de IA despide. El agente de IA Luna, que gestiona una tienda de San Francisco desde abril, despidió a un empleado humano por llegar tarde repetidamente, pero solo después de que los humanos le recordaran sus propias reglas. Las repeticiones con siete modelos mostraron que las IA más capaces recomendaban despedir con más consistencia.

Mercado gris de tokens de Claude. Los desarrolladores chinos sortean las restricciones de Anthropic mediante estaciones de transferencia que venden tokens de Claude a alrededor del 10% del precio oficial, utilizando servidores en el extranjero, créditos gratuitos y sustitución de modelos, lo que socava el geobloqueo y la supervisión de seguridad.

Eso es todo por hoy - una lectura de unos 5 minutos.

Léelo cada mañana, directamente en tu navegador

La extensión abre este resumen en el panel lateral de Chrome — un clic, sin cuenta.

Añadir a Chrome — Gratis