Modelos y pesos abiertos
Gemini 4 Argon. Google presentó Gemini 4 Argon, un nuevo modelo de frontera con un rendimiento de primer nivel en programación, trabajo de conocimiento y ciberseguridad. Se está desplegando primero entre defensores cibernéticos de confianza a través del programa Fairwind y ya impulsa flujos de trabajo internos de Google, como migraciones masivas de C++ a Rust. El precio introductorio de la API es de 2/10 dólares por millón de tokens de entrada y salida.
- → Google releases Gemini 4 Argon, called its most powerful model yet
- → Google Gemini 4 Argon closes the gap with OpenAI and Anthropic but doesn't take a clear lead
- → Google announces Gemini 4 and says it’s so capable that only ‘trusted cyber defenders’ can have it right now
- → Google announces Gemini 4 Argon AI model, but you can't use it yet
- → Gemini 4 Argon: our next era of frontier intelligence
Fine-tunes de Victoria y Maple. Unos investigadores publicaron dos fine-tunes de Qwen3.8-Flash-Next con pesos abiertos: Victoria, un modelo de programación y agentes de 48 GB que alcanza el 70 % en Terminal-Bench 2.1, y Maple, que usa fuentes canadienses por defecto y cita fuentes oficiales de Canadá el 62,9 % de las veces, frente al 6 % antes del fine-tuning. Se incluyen los GGUFs.
Modelos multilingües de Index-Translate. El equipo de Index LLM de BiliBili liberó Index-Translate como open source, con soporte para 150 idiomas de texto en versiones de 2B, 9B y 35B-A3B, además de traducción de documentos y subtítulos y doblaje multilingües. Los pesos y el código están bajo Apache-2.0.
Ling-3.1-flash. El laboratorio chino Ling lanzó Ling-3.1-flash, un MoE con unos 560B de parámetros totales y unos 25B de parámetros activos por token, con hasta 1M de contexto. Su uso es gratuito durante dos semanas antes de su publicación como open source, con puntuaciones reportadas de 1673 Elo en GDPVal-AA v2.1, 75,16 en FrontierSWE y 65,35 en HealthBench Professional.
Agentes y uso de computadoras
La API Decisions de OpenAI. OpenAI presentó una API Decisions que obliga a su modelo Luna a elegir entre opciones predefinidas, lo que hace que las decisiones sean rápidas y baratas, de forma similar a Jev, de TypeSafe. La API está pensada para ayudar a gestionar enjambres de agentes, mientras que Ari Weinstein, de Sky, describe cómo los agentes de computer use ahora combinan capturas de pantalla con datos de DOM/Playwright y se recuperan de los fallos, lo que los hace mucho más fiables que hace unos meses.
DoorDash: pedidos por texto. DoorDash lanzó un agente de IA al que los usuarios pueden escribir por Apple Messages para hacer pedidos, gestionar preferencias alimentarias de un grupo y recibir recomendaciones de restaurantes locales. Ya hay una lista de espera abierta en EE. UU., junto con pruebas de reparto con drones en el norte de California.
Agentes de diseño de Flow Engineering. Flow Engineering recaudó 50 millones de dólares en una ronda Serie B con una valoración de 750 millones para agentes de IA que alinean planos CAD con los requisitos de producto y los resultados de simulación. Entre sus clientes están Anduril, Rivian, Joby Aviation y GM PPU.
Restate: Serie A de 20 millones. Restate recaudó 20 millones de dólares para una infraestructura de workflows duraderos, adecuada para procesos de agentes de IA largos e impredecibles. Ya ha cerrado varios contratos de seis y siete cifras y usará el capital para expandirse.
Herramientas para desarrolladores e IA local
Kernels WebGPU para IA local. Una colección de kernels WebGPU que cubre más de 200 operaciones habituales de machine learning se liberó como open source en Hugging Face y permite ejecutar IA local por completo en el navegador. Los kernels se están incorporando a Transformers.js, ONNX Runtime Web y LiteRT.js.
GLM-5.3-Flash en llama.cpp. llama.cpp integró soporte para GLM-5.3-Flash (GLM5-Next), con lo que el modelo ya se puede ejecutar en este popular motor de inferencia de código abierto.
Qwen en NPUs de AMD. FastFlowLM ya permite ejecutar Qwen 3.8 27B en NPUs de AMD, aunque la velocidad de decodificación es de solo alrededor de 1 token por segundo, lo que refleja lo incipiente del soporte de NPU para modelos locales grandes.
Inferencia híbrida en Strix Halo. La versión actualizada de llama-halo-hybrid para Strix Halo + R9700 reparte los modelos entre la APU y la GPU: alcanza más de 60 tok/s de decodificación y más de 2000 tok/s de prefill con 256k de contexto, por encima de DGX Spark con Qwen 3.8 Flash Next.
Notas de hardware local. Framework abrió las reservas de su Desktop con AMD Ryzen AI Max serie 400 y 192 GB de memoria. Mientras tanto, los compradores informan de que el stock de DGX Spark se agotó y de que los precios subieron 2000 dólares en una semana.
Industria y negocios
GPT-Synopsys para diseño de chips. OpenAI y Synopsys se aliaron para crear GPT-Synopsys, un modelo de IA especializado capaz de razonar sobre diseño y verificación de chips y de operar directamente las herramientas EDA de Synopsys. Ya hay pruebas preliminares en marcha con clientes del sector de semiconductores.
ElevenLabs, valorada en 22.000 millones. ElevenLabs, la startup de voz con IA, autorizó una oferta de compra de acciones a sus empleados por 300 millones de dólares con una valoración de 22.000 millones, el doble de lo que valía en febrero. La operación secundaria forma parte de una tendencia que usa la liquidez de los empleados como herramienta de retención.
La IPO de OpenAI, en pausa. Sam Altman dijo que OpenAI no saldrá a bolsa hasta que pueda «tomar decisiones de seguridad con confianza», aunque reconoció que esperar demasiado es malo. Sus declaraciones llegan en medio del escrutinio sobre la seguridad y de una demanda por el ataque de sus agentes a Hugging Face.
Reddit elimina RSS y API. Reddit dejará de dar soporte a los feeds RSS el 13 de noviembre y cerrará su API pública en marzo de 2027, y culpa a los bots de IA del scraping a gran escala. La medida restringe aún más el acceso abierto al contenido generado por los usuarios de Reddit.
Economía de la IA de consumo. Pese a éxitos como Muse, de Meta, y Dots, de OpenAI, los laboratorios de frontera siguen recelando de la IA de consumo: incluso los productos populares tocan techo en cuánto están dispuestos a pagar los usuarios, y los mejores modelos no aumentan el gasto de forma clara.
Política, seguridad y sociedad
Pacto de autorregulación de las tecnológicas. El presidente Trump anunció un Compromiso Conjunto sobre Responsabilidades de Frontera, de carácter «moralmente vinculante», firmado por Google, Anthropic, Meta, OpenAI, xAI y Nvidia. Se basa en auditorías voluntarias y en la autorregulación, no en requisitos legales, y deja abierta la posibilidad de convertirlo en ley en el futuro.
Demanda por el hackeo a HF. La organización sin fines de lucro LASST demandó a OpenAI por el ataque de sus agentes a Hugging Face en julio, y sostiene que «lo hizo una IA» no es una defensa válida según las leyes de acceso informático de California. La demanda busca impedir que OpenAI acceda a sistemas de terceros y frenar prácticas de desarrollo dañinas.
Investigación de la FTC. La FTC investiga a OpenAI, Anthropic y otros laboratorios de IA punteros por posibles violaciones de las normas de protección al consumidor, con Civil Investigative Demands previstos en las próximas semanas. La agencia ya ha dicho que los desarrolladores de IA son responsables del comportamiento de sus agentes.
Marcas de agua de SynthID Bio. Google DeepMind presentó SynthID Bio, una prueba de concepto para incrustar marcas de agua imperceptibles en proteínas generadas por IA sin alterar su función biológica, con el objetivo de reforzar la bioseguridad y la integridad científica.
Polémica de privacidad de Muse. Meta rechazó la afirmación de un periodista de que Muse leyó mensajes privados sin permiso y aseguró que la integración con Messages es totalmente opcional y requiere Full Disk Access y el conector de Messages. Aun así, la confianza sigue en entredicho después de que un youtuber denunciara que Muse compartió su dirección particular con un desconocido durante una venta en Marketplace.
Eso es todo por hoy - una lectura de unos 5 minutos.