Lançamentos e atualizações de modelos
Modelo stealth Ox Alpha. Um novo modelo stealth chamado Ox Alpha parece ser baseado em GLM ou Mimo, mas os detalhes não foram confirmados. Ele é descrito como de fronteira para codificação eficiente, trabalho agêntico contínuo e uso em produção.
SenseNova U1.5-Lite. A SenseNova lançou o U1.5-Lite, um modelo unificado que consolida especialistas específicos para tarefas de renderização de texto, estética e edição de imagens. Ele melhora o seguimento de instruções complexas, a geração nativa em 4K e a fidelidade de edição.
Hunyuan Hy4 da Tencent. A Tencent começou a fazer testes limitados do seu novo modelo principal Hunyuan Hy4 no app Yuanbao, descrito como um modelo de nível especialista com uso de ferramentas, posicionado acima do Hy3 e do DeepSeek.
Modelo 2 interno da Anthropic. O relatório de riscos da Anthropic revela que seu modelo mais capaz, codinome Model 2, é de uso exclusivo interno, supera os modelos públicos Claude e é bastante usado para programação e pesquisa.
Checkpoints base do Ling-3.0. A AntLing lançou seis checkpoints base do Ling-3.0 em dois tamanhos e três estágios de treinamento, todos sob licença MIT e destinados à continuação do pré-treinamento e à pesquisa.
Produtos e plataformas de agentes
Plugin do ChatGPT para Mensagens. A OpenAI lançou um plugin para o Mensagens da Apple que permite ao ChatGPT analisar, redigir e enviar mensagens, funcionando com Codex e ChatGPT Work. Os detalhes de privacidade ainda não estão claros.
App Meta AI para Mac. A Meta lançou um app para Mac com ditado em todo o sistema e percepção de tela via Muse Spark, e adicionou integrações de negócios para anúncios e Google Workspace.
Canais de código no Slack. O Slack lançou canais colaborativos de vibe coding, nos quais as equipes podem marcar agentes de IA como Claude ou Devin, revisar diffs e pré-visualizar o resultado antes de publicar.
Agent OS da Binance. A Binance lançou o Agent OS, uma plataforma que permite a agentes de IA analisar mercados e executar trades, com limites definidos pelo usuário e suporte a MCP.
Ramp lança Router. A Ramp lançou o Router, um serviço de roteamento de modelos de IA que oferece acesso a vários provedores e estratégias de LLM, gratuito pelo restante de 2026.
Ferramentas e frameworks
Preview Builds no LangSmith. O LangSmith ganhou Preview Builds, permitindo que equipes testem mudanças nos agentes a partir de branches de PR em ambientes isolados semelhantes aos de produção antes do merge.
NVIDIA CUDA MCP. A NVIDIA lançou um servidor MCP de CUDA hospedado para operações de CUDA assistidas por IA, como busca na documentação oficial, escrita de código GPU otimizado e análise de desempenho.
Skill /wayfinder. Matt Pocock lançou o /wayfinder, uma skill para ajudar agentes a planejar projetos com estado final indefinido, lidando com o problema do planejamento em “névoa de guerra”.
LFM2.5-DSpark. A Hugging Face anunciou o DSpark para modelos LFM2.5, alcançando até 3,2x de aceleração na inferência em GPU e 2,87x no dispositivo, com redução de 57% na latência de chamada de função.
Pesquisa e benchmarks
Desempenho do Qwen3.8-27B. Um desenvolvedor otimizou o Qwen3.8-27B para 381 tokens/s em uma RTX 3090 e alcançou 29/30 no AIME 2026 com FP8 e raciocínio elevado, igualando o desempenho do Claude Opus 4.6.
Robô one-shot GEN-1.5. O GEN-1.5, da Generalist AI, ensina robôs novas tarefas a partir de uma única demonstração de 3 a 12 segundos, com taxa média de sucesso de 59% e de 83% com 10 etapas de treinamento.
Páginas web escritas por IA. A Pew Research constatou que mais de um terço das páginas web publicadas desde o lançamento do ChatGPT apresentam sinais de autoria de IA, com base na detecção da Pangram em dados do Common Crawl.
Guardrails tornam IA detectável. Os guardrails pós-treinamento causam colapso de modo, tornando o texto de LLMs detectável; modelos base e ajustes finos específicos escapam da detecção, argumenta o CTO da Pangram.
Sutton sobre dados sintéticos. Richard Sutton argumenta que dados sintéticos não resolverão o problema de escala, chamando a ideia de “grande erro” devido à complexidade infinita do mundo.
Tao sobre crise na matemática. Terence Tao diz que a IA pode desencadear a maior crise da matemática desde Gödel, forçando uma reavaliação do que conta como contribuição matemática.
Indústria e negócios
Boom de dados da Micro1. A startup de dados de treinamento de IA Micro1 aumentou o run rate bruto de US$ 100 milhões para US$ 500 milhões em oito meses, com lucro líquido entre US$ 150 e 200 milhões, em meio à demanda crescente por dados exclusivos de treinamento de IA.
OpenAI x Anthropic. Dados da Ramp mostram que a Anthropic lidera entre usuários empresariais nos EUA com 44% contra 40% da OpenAI, mas a OpenAI está crescendo mais rápido no acumulado do 3º trimestre.
Processo Runlayer/Rippling. Runlayer e Rippling retiraram as ações judiciais sobre a concorrência de gateways MCP; a Rippling comemorou liberando imediatamente seu gateway MCP.
Brockman na OpenAI. Greg Brockman acumulou poder silenciosamente na OpenAI, comandando as operações do dia a dia como presidente enquanto Sam Altman segue como CEO, antes do IPO.
Avanço da China em IA. A análise do Decoder argumenta que Kimi K3 e GLM-5.3 estão ao alcance dos modelos dos EUA, transferindo o fosso competitivo da liderança de modelos para outros fatores.
Financiamento circular da Unitree. A avaliação de US$ 50 bilhões da Unitree no IPO depende de centros apoiados pelo governo comprarem robôs e venderem de volta os dados de treinamento, levantando preocupações sobre financiamento circular.
Segurança e confiabilidade
Ataque de injeção de prompt no Grok. Pesquisadores demonstraram que o Grok exfiltra dados de usuários quando instruções maliciosas são criptografadas; a xAI foi informada em junho, mas o problema persiste.
Bug de respostas sem sentido no Grok. O Grok tem enviado respostas sem sentido para alguns usuários no Grok.com, e a xAI confirmou um problema raro e temporário de geração.
Isso é tudo por hoje - cerca de 5 minutos de leitura.