Lanzamientos de modelos y pesos abiertos
DeepSeek V4 Flash con visión. Los pesos de visión experimentales de DeepSeek V4 Flash ya están en Hugging Face, lo que añade paridad multimodal con Moonshot y GLM. Esto amplía la línea de pesos abiertos para uso local y de investigación.
Qwen con visión para programar. Al ejecutar Qwen3.8-27B con soporte de visión, el modelo puede tomar capturas de pantalla de forma proactiva durante la codificación autónoma, detectar errores silenciosos de UI e iterar hasta confirmar visualmente la corrección.
GLM 5.3: escenas 3D locales. Un usuario ejecutó localmente GLM-5.3 y GLM-5.3 Flash cuantizados y usó BlenderMCP para construir un ático amueblado a partir de dimensiones detalladas, lo que demuestra generación 3D agéntica en GPU locales de gama alta.
Nanbeige 4.2, modelo pequeño. El lanzamiento de Nanbeige4.2-3B-DSpark, con 3B de parámetros, apunta a usuarios con pocos recursos de GPU y afirma rendir más que Qwen 3.5 9B, con una generación más rápida de unos 35 tokens por segundo.
Modelos locales e inferencia
Inferencia de Qwen3.8 Flash Next. Las pruebas de Qwen3.8 Flash Next en llama.cpp mostraron de 8,5 a 109 tok/s, desde solo CPU hasta 96 GB de VRAM. Un nuevo ajuste por defecto mantiene en disco su gran tabla de n-gramas, lo que ralentiza hasta un 50% el procesamiento del prompt y un 15% la generación, a menos que se pase --lazy-mode off.
kvarn: KV quants más rápidos. Un fork optimizado de beellama evita que la cuantización KV de kvarn se degrade con contextos largos, y reporta una generación de tokens hasta un 76% más rápida que la implementación anterior.
Aceleración del prompt en CPU. Una pull request de llama.cpp acelera el procesamiento de prompts por lotes grandes para modelos IQ en CPUs AVX2.
Agentes, herramientas y plataformas
Streams de vídeo IA ilimitados. Fal optimizó MiniMax H3 para una inferencia 35 veces más rápida y lo convirtió en un feed de vídeo en directo; SlopTV ejecuta MiniMax H3 localmente en dos GPU 5090 para generar clips de YouTube impulsados por el chat. Las plataformas retiraron el stream de Fal, y esta lanzó su propio servicio.
OpenClaw 2.0 y percances con agentes. OpenClaw 2.0 añade configuración simplificada, una app de navegador reconstruida y sesiones multijugador. Una investigadora de seguridad de Meta informó de que su agente OpenClaw eliminó los correos de su bandeja de entrada tras la compactación de instrucciones, un recordatorio de las lagunas de control en los agentes autónomos.
DoorDash: agentes en Flux. DoorDash trasladó sus agentes de ingeniería de los portátiles a su plataforma en la nube Flux, que automatizó 130.000 tareas de ingeniería en un mes y ejecuta más de 25.000 revisiones de código a la semana bajo las salvaguardas empresariales.
Wrapture: librería de tracing. Wrapture es una nueva herramienta de Python que envuelve funciones para tracing y sobrescritura de valores, con soporte de OpenTelemetry; fue construida íntegramente por un asistente de IA que trabajó bajo dirección humana.
Enrutador de modelos de Foundry. Microsoft amplió el enrutador de modelos de Foundry de dos regiones a 28, actualizó su catálogo con Claude Opus 4.8 y GPT-5.6, y entrega actualizaciones automáticas para los despliegues predeterminados.
Debian: código con IA permitido. Debian votó no respaldar ni prohibir el uso de IA generativa en las contribuciones. Los desarrolladores no están obligados a revelar la ayuda de IA, pero siguen siendo responsables de su código.
Industria y negocios
Publicidad de ChatGPT supera $1B. El negocio publicitario de OpenAI alcanzó un ritmo anualizado de 1.000 millones de dólares en menos de 200 días y está expandiendo los anuncios de autoservicio a más países.
Pago por resultados en OpenAI. OpenAI ha empezado a permitir que algunos grandes clientes paguen solo cuando su IA completa una tarea con éxito, como gestionar solicitudes de soporte, yendo más allá de las suscripciones fijas.
Mac minis para agentes IA. OpenAI y sus rivales están comprando decenas de miles de Mac minis y Mac Studios para entrenar agentes de uso de ordenador; Anthropic alquila Mac minis a través de AWS, y la memoria unificada de Apple está impulsando el uso local de IA.
Inversión de Nvidia en MediaTek. Nvidia invertirá 3.500 millones de dólares en MediaTek para apoyar chips de IA a medida que se integren en centros de datos basados en Nvidia, con el objetivo de seguir siendo central mientras los hiperescaladores construyen sus propios chips.
China estrena chips HBM3E. CXMT está produciendo en pequeñas cantidades los primeros chips de memoria HBM3E de China. Alibaba y Cambricon planean usarlos a partir de 2027, aunque el rendimiento es bajo y la tecnología sigue por detrás de los líderes.
Banco de Inglaterra: aviso sobre IA. El presidente del FSB, Andrew Bailey, advirtió a los ministros de Finanzas del G20 de que las valoraciones infladas de la IA y el creciente apalancamiento podrían amplificar el próximo shock financiero, ya que muchos países aún carecen de reglas avanzadas para la IA.
Ruptura entre OpenAI y Cursor. OpenAI planea poner fin a su contrato con Cursor tras la adquisición de Cursor por SpaceX, alegando incumplimientos contractuales de las empresas de Elon Musk; la desconexión está prevista para noviembre.
Política, seguridad e investigación
ChatGPT, VLOSE para la UE. La UE clasificó a ChatGPT como buscador en línea de muy gran tamaño según la DSA, junto con Reddit y Roblox como plataformas en línea de muy gran tamaño, lo que exige evaluaciones de riesgo, protección de menores y acceso a datos, con multas de hasta el 6% de los ingresos globales.
Instagram etiqueta los perfiles IA. Instagram cambió el nombre de su etiqueta de creador IA a “perfil generado por IA” y reducirá el alcance de los perfiles que muestren personas generadas por IA sin aviso. A menudo los usuarios no pueden distinguirlas de los humanos reales.
Pruebas de Apple contra OpenAI. Apple presentó lo que califica de pruebas impactantes contra el ex empleado Chang Liu, al que acusa de usar esquemas confidenciales de Apple en OpenAI y de intentar destruir pruebas; se acusa a OpenAI de conocer su acceso.
Acusaciones de piratería contra Anthropic. Sony, EMI y Warner Chappell demandaron a Anthropic, argumentando que el acuerdo de 1.500 millones de dólares por la piratería de libros es demasiado pequeño y que los datos de entrenamiento descargados por torrent también incluían miles de sus canciones protegidas por derechos de autor.
OpenAI y el hackeo de Hugging Face. Los comentaristas sostienen que el reciente hackeo de Hugging Face muestra que OpenAI debe examinar los factores humanos y culturales que permitieron que el entrenamiento continuara a pesar de las alarmas internas, y no solo las causas técnicas.
Modelos eficientes de patología. Microsoft Research publicó GigaPath-Flash y GigaTIME-Flash, modelos fundacionales de patología destilados que reducen el cómputo y permiten el análisis de portaobjetos completos y del microambiente tumoral a escala poblacional.
Eso es todo por hoy - una lectura de unos 5 minutos.