Agentic AI News Hoy

Las noticias del día sobre agentes de IA en una lectura de 5 minutos: lanzamientos, herramientas, investigación, financiación y movimientos empresariales.

Actualizado a diario seleccionado de 30 fuentes miércoles, agosto 12, 2026

Lanzamientos de Modelos e Infraestructura

El modelo de Nvidia prioriza la velocidad. Nvidia lanzó Nemotron 3.5 Lightning, un modelo Mamba-Transformer de peso abierto con 30B que iguala a GPT-OSS-120B en los puntos de referencia y está optimizado para una inferencia rápida con solo 3.6B de parámetros activos.

DeepSeek V4 se ejecuta localmente. Los cuantos comunitarios de DeepSeek V4 corrigen problemas de conversión para obtener líneas de base exactas al bit, y DeepSeek V4 Flash alcanza más de 27 t/s en APU Strix Halo con decodificación especulativa, demostrando una implementación local viable.

Aplicación de escritorio Unsloth. Unsloth lanzó una aplicación de escritorio de código abierto para ejecutar y entrenar modelos locales en múltiples GPU, con ejecución de código en entorno limitado, RAG, exportación de modelos y sin telemetría.

River AI recauda $1.1B en financiamiento inicial. Fundada por el ex cofundador de xAI, Igor Babuschkin, River AI recaudó $1.1B para construir asistentes de IA entrenables personalmente, replanteando toda la pila desde el entrenamiento hasta el hardware.

Daybreak Cyber en AWS. Los modelos de ciberseguridad Daybreak de OpenAI ya están disponibles a través de Amazon Bedrock, lo que brinda a los defensores acceso a capacidades cibernéticas de vanguardia en sus entornos AWS existentes.

El manifiesto de código abierto de Zuck. El CEO de Meta aboga por más lanzamientos de peso abierto e invita a los gobiernos a colaborar en pruebas de seguridad, mientras la empresa continúa publicando modelos como Muse Glimmer.

Soporte para Ling‑3.0. Una solicitud de extracción agrega Ling‑3.0 a llama.cpp, con una variante diminuta que ya funciona bien para tareas de voz de asistente doméstico gracias a su rechazo honesto cuando no está seguro.

Herramientas e IA Local

El broker MCP reduce el contexto. Un arnés de agente casero utiliza un broker MCP para ocultar herramientas detrás de un proxy, reduciendo el contexto de inicio de 20K tokens a casi cero, y añade conciencia temporal para una mejor ejecución local.

GPUs de minería para LLMs. Las tarjetas de minería CMP170HX de 8GB se pueden expandir a 64GB cada una, ejecutando modelos grandes o varios modelos pequeños simultáneamente, ofreciendo un rendimiento económico pero envejecido de clase Ampere.

366 t/s en V100. Los kernels CUDA personalizados (v100‑skinny) permiten hasta 366 t/s en Qwen3.6 27B en NVFP4 en GPUs Volta, dando nueva vida al hardware antiguo para la inferencia local.

Modelo TinyTitle. Un modelo GRU de 1.8M de parámetros genera títulos de chat en menos de 5 MiB de RAM, demostrando una síntesis ultraligera en el dispositivo que se ejecuta en pocos milisegundos.

IA privada en lector electrónico. Una aplicación de lector electrónico integra modelos Gemma 4B localmente para preguntas y respuestas privadas sobre libros dentro de la aplicación, con interruptores de spoilers y coincidencia automática de idioma.

Servidor de IA de bajo consumo. Una configuración que combina un Intel N100 con una RTX 5060Ti produce un servidor llama.cpp silencioso y eficiente capaz de ejecutar modelos recientes como Qwen 3.5 para uso diario.

Costo de inferencia reducido drásticamente. El CEO de Doubleword explica cómo diseñar pilas de inferencia para uso no en tiempo real puede reducir los costos de tokens en más de un orden de magnitud en comparación con las configuraciones de propósito general.

Enrutamiento inteligente de modelos. La librería Switchyard de NVIDIA enruta solo el 7% de las llamadas de agentes a un modelo de vanguardia, reduciendo los costos en un 74% con una pérdida mínima de precisión, y ofrece una fórmula para evaluar el costo‑beneficio.

Gafas AR privadas. Un usuario ciego pide gafas AR estilo Meta que ejecuten modelos locales para evitar enviar datos visuales a Meta, destacando la demanda de privacidad en la tecnología de asistencia.

Investigación de Vanguardia

La IA aborda Riemann. Un modelo no publicado de Anthropic logró avances en la hipótesis de Riemann al probar 650 ideas con 60 subagentes durante 36 horas, reavivando el debate sobre el papel de la IA en el descubrimiento matemático.

Diagnóstico por video de AMIE. El sistema de investigación AMIE de Google demostró consultas clínicas por video de nivel experto, utilizando Gemini y una configuración de múltiples agentes para interpretar señales visuales, auditivas y contextuales.

IA de rayos X de tórax CARE‑X. CARE‑X de Microsoft es un VLM unificado de rayos X de tórax que combina generación y predicción estructurada, utilizando aprendizaje por refuerzo para recompensar la corrección clínica.

Enfrentamiento de memoria de agentes. Tanto ACE como ALTK‑Evolve convierten las trayectorias de los agentes en lecciones reutilizables; ACE crea un manual completo, mientras que ALTK‑Evolve recupera pautas individuales.

Los logprobs detectan alucinaciones. Analizar las distribuciones de probabilidad de tokens en el primer recuerdo factual en la cadena de pensamiento puede revelar conocimiento no fiable, ofreciendo una posible señal temprana de alucinación.

Advertencia sobre la escritura con IA. S. Alpert argumenta que ninguna reescritura es sin pérdidas, por lo que el texto asistido por IA debe ser verificado personalmente para evitar distorsionar el significado previsto del autor.

Negocios y Finanzas

Hito de mil millones de usuarios. ChatGPT y Gemini alcanzaron ambos los 1000 millones de usuarios activos mensuales, siendo Gemini el producto de Google más rápido en alcanzar esa escala; ChatGPT había llegado a 900 millones de usuarios semanales a principios de este año.

Los anuncios de ChatGPT se expanden globalmente. OpenAI amplió los anuncios de ChatGPT a cinco países más, reportando ningún impacto en la confianza del usuario y bajas tasas de descarte mientras busca una monetización sostenible.

Aumento de precios de OpenAI. Los nuevos asientos premium de ChatGPT Business cuestan $125 por usuario al mes con cinco veces la capacidad y sin límites por hora, lo que refleja el alto uso de tokens de las cargas de trabajo de agentes.

Lightcap se va. Brad Lightcap, ex COO y responsable de proyectos especiales de OpenAI, se va después de ocho años para iniciar algo nuevo, continuando una serie de salidas ejecutivas.

El arrendamiento de $9.1B de Anthropic. Anthropic firmó un acuerdo de centro de datos de 20 años y $9.1B con el minero de Bitcoin Riot Platforms para 191 MW en Texas, que impulsará su próxima generación de modelos a partir de 2027.

Obstáculos para la OPI de Anthropic. Ante una posible OPI de $965B, los inversores cuestionan el crecimiento de Anthropic en medio de modelos chinos baratos y vientos políticos en contra, aunque la empresa promociona futuras aplicaciones de salud y biología.

El impulso de $500B de Nvidia. Nvidia se asocia con seis firmas financieras para movilizar $500B para infraestructura de IA garantizando hasta el 25% del valor residual de sus chips, contrarrestando los temores de depreciación.

La apuesta de Accel por la IA en India. Accel cerró un fondo de $550M para India con sobresuscripción, apostando a que la IA sustentará las startups de consumo, fintech y manufactura en lugar de ser una categoría independiente.

Retiro de efectivo de empleados de OpenAI. Una recompra de acciones de $7B a una valoración de $852B permite a los empleados actuales y anteriores de OpenAI liquidar acciones, aliviando la presión antes de una posible OPI.

Seguridad y Transparencia

La UE exige marcas de agua de IA. Bajo la Ley de IA de la UE, Anthropic y OpenAI se comprometen a marcar el contenido generado; Claude incorporará marcas de agua invisibles en texto e imágenes, y se está trabajando en soporte para modelos más antiguos.

Procedencia de fotos de Apple. iOS 27 podría introducir 'Apple Reference Image' para incorporar metadatos de procedencia en la captura, permitiendo a los usuarios demostrar que las fotos del iPhone no son deepfakes.

Spotify señala a los artistas de IA. Spotify etiquetará los perfiles de artistas generados por IA y los excluirá de las recomendaciones, utilizando tanto la autodeclaración como la detección antes de implementar el cambio a mediados de septiembre.

Disputa sobre escritura con IA. El estudio de juegos Saber niega haber reemplazado a los escritores con ChatGPT para Rideshare Stimulator, pero el ex escritor principal afirma que se utilizó IA para la escritura y las voces, sin divulgación en Steam.

Exploit de Zoom impulsado por IA. Se encontró una vulnerabilidad crítica de Zoom que permite tomar el control del dispositivo a través de su función de anotación usando menos de 20 indicaciones a modelos públicos de IA, lo que demuestra la investigación de seguridad acelerada por IA.

Robo de rastros de razonamiento. Los investigadores reprodujeron tokens cifrados de cadena de pensamiento de modelos de vanguardia en modelos hermanos más débiles, los liberaron y recuperaron el razonamiento oculto, exponiendo contraseñas y claves API en sesiones públicas.

Confiando en el código generado por IA. IBM y Red Hat amplían Lightwell para crear cadenas de suministro de software verificables para la era de la IA, asegurando la procedencia y el cumplimiento de políticas tanto para el código generado por humanos como por IA.

Eso es todo por hoy - una lectura de unos 5 minutos.

Léelo cada mañana, directamente en tu navegador

La extensión abre este resumen en el panel lateral de Chrome — un clic, sin cuenta.

Añadir a Chrome — Gratis