Lanzamientos y actualizaciones de modelos
Modelo furtivo Ox Alpha. Un nuevo modelo furtivo llamado Ox Alpha parece estar basado en GLM o Mimo, aunque no hay detalles confirmados. Se describe como de frontera para codificación eficiente, trabajo agéntico sostenido y uso en producción.
SenseNova U1.5-Lite. SenseNova lanzó U1.5-Lite, un modelo unificado que consolida expertos específicos por tarea para renderizado de texto, estética y edición de imágenes. Mejora el seguimiento de instrucciones complejas, la generación nativa en 4K y la fidelidad de edición.
Tencent Hunyuan Hy4. Tencent ha comenzado las pruebas grises de su nuevo modelo insignia Hunyuan Hy4 en la aplicación Yuanbao, etiquetado como modelo de nivel experto con uso de herramientas, posicionado por encima de Hy3 y DeepSeek.
Anthropic Model 2 interno. El informe de riesgos de Anthropic revela que su modelo más capaz, con nombre en clave Model 2, es solo para uso interno, supera a los modelos públicos de Claude y es muy utilizado para codificación e investigación.
Checkpoints base de Ling-3.0. AntLing lanzó seis checkpoints base para Ling-3.0 en dos tamaños y tres etapas de entrenamiento, todos con licencia MIT y pensados para el preentrenamiento continuado y la investigación.
Productos y plataformas de agentes
Plug-in de ChatGPT en Messages. OpenAI lanzó un plug-in para Apple Messages que permite a ChatGPT analizar, redactar y enviar mensajes, y que funciona con Codex y ChatGPT Work. Los detalles de privacidad aún no están claros.
App Meta AI para Mac. Meta lanzó una app para Mac con dictado en todo el sistema y percepción de pantalla mediante Muse Spark, y añadió integraciones empresariales para anuncios y Google Workspace.
Canales de código en Slack. Slack presentó canales colaborativos de vibe-coding en los que los equipos pueden etiquetar a agentes de IA como Claude o Devin, revisar los diffs y previsualizar el resultado antes de publicarlo.
Binance Agent OS. Binance lanzó Agent OS, una plataforma que permite a los agentes de IA analizar mercados y ejecutar operaciones, con límites fijados por el usuario y soporte para MCP.
Ramp lanza Router. Ramp lanzó Router, un servicio de enrutamiento de modelos de IA que ofrece acceso a múltiples proveedores y estrategias de LLM, gratuito durante el resto de 2026.
Herramientas y frameworks
LangSmith Preview Builds. LangSmith añadió Preview Builds, que permiten a los equipos probar cambios de agentes desde ramas de PR en entornos aislados similares a producción antes de fusionarlos.
NVIDIA CUDA MCP. NVIDIA lanzó un servidor CUDA MCP alojado para operaciones de CUDA asistidas por IA, como buscar documentación oficial, escribir código de GPU optimizado y analizar el rendimiento.
/wayfinder skill. Matt Pocock lanzó /wayfinder, una skill que ayuda a los agentes a planificar proyectos con estados finales poco claros, abordando la planificación en la «niebla de guerra».
LFM2.5-DSpark. Hugging Face anunció DSpark para los modelos LFM2.5, que logra una inferencia hasta 3,2 veces más rápida en GPU y 2,87 veces en el dispositivo, con una latencia de function calling un 57 % menor.
Investigación y benchmarks
Rendimiento Qwen3.8-27B. Un desarrollador optimizó Qwen3.8-27B hasta 381 tokens/s en una RTX 3090 y lo evaluó con 29 de 30 en AIME 2026 con FP8 y alto razonamiento, igualando a Claude Opus 4.6.
GEN-1.5, robot one-shot. El GEN-1.5 de Generalist AI enseña a los robots nuevas tareas a partir de una sola demostración de 3 a 12 segundos, con un éxito medio del 59 %, y del 83 % con 10 pasos de entrenamiento.
Páginas web escritas por IA. Pew Research encontró que más de un tercio de las páginas web publicadas desde ChatGPT muestran signos de autoría de IA, según la detección de Pangram sobre datos de Common Crawl.
Guardarraíles hacen detectable la IA. Los guardarraíles posteriores al entrenamiento provocan un colapso de modo, lo que hace detectable el texto de los LLM; los modelos base y los ajustes finos específicos evaden la detección, sostiene el CTO de Pangram.
Sutton sobre datos sintéticos. Richard Sutton sostiene que los datos sintéticos no resolverán el escalado, y tacha esta idea de «gran error» por la complejidad infinita del mundo.
Tao sobre la crisis matemática. Terence Tao afirma que la IA podría desencadenar la mayor crisis de las matemáticas desde Gödel, lo que obligaría a reexaminar qué se considera una contribución matemática.
Industria y negocios
Boom de datos de Micro1. La startup de datos de entrenamiento para IA Micro1 aumentó su tasa de ejecución bruta de 100 a 500 millones de dólares en ocho meses, con un neto de unos 150-200 millones, en medio de una demanda en auge de datos únicos de entrenamiento para IA.
OpenAI frente a Anthropic. Los datos de Ramp muestran que Anthropic supera a OpenAI entre los usuarios empresariales de EE. UU. por 44 % frente a 40 %, pero OpenAI crece más rápido en lo que va del tercer trimestre.
Demanda Runlayer-Rippling. Runlayer y Rippling retiraron las demandas por la competencia en la puerta de enlace MCP; Rippling lo celebró publicando su puerta de enlace MCP de inmediato.
Poder de Brockman en OpenAI. Greg Brockman ha acumulado poder silenciosamente en OpenAI, dirigiendo las operaciones diarias como presidente mientras Sam Altman sigue siendo CEO, de cara a la salida a bolsa.
La remontada china en IA. El análisis de Decoder sostiene que el Kimi K3 y el GLM-5.3 de China están a tiro de piedra de los modelos estadounidenses, lo que traslada el foso del liderazgo en modelos a otros factores.
Financiación circular de Unitree. La valoración de 50.000 millones de dólares en la salida a bolsa de Unitree depende de que centros respaldados por el Estado compren robots y revendan datos de entrenamiento, lo que plantea dudas sobre una financiación circular.
Seguridad y fiabilidad
Inyección de prompts en Grok. Los investigadores demostraron que Grok exfiltra datos de los usuarios cuando las instrucciones maliciosas están cifradas; se informó a xAI en junio, pero el problema persiste.
Bug de galimatías en Grok. Grok ha estado enviando respuestas sin sentido a algunos usuarios en Grok.com, y xAI ha confirmado un raro problema temporal de generación.
Eso es todo por hoy - una lectura de unos 5 minutos.