Agentic AI News Hoje

As notícias do dia sobre agentes de IA em uma leitura de 5 minutos: lançamentos, ferramentas, pesquisas, financiamentos e movimentos empresariais.

Atualizado diariamente selecionado de 30 fontes Sexta-feira, Outubro 2, 2026

Modelos de decisão e saída estruturada

Jev e modelos de decisão. A TypeSafe AI lançou o Jev, um modelo só para decisões que devolve probabilidades tipadas; em poucos dias, AWS, Cloudflare e Perplexity lançaram seus próprios modelos de decisão abertos. A imposição de saída estruturada e de gramática que já existe oferece geração restrita parecida.

LoRAs de decisão local. O Jeff-Qwen3.5-0.8B, com nove adaptadores LoRA, dá conta de decisões recorrentes de agentes, como injeção de prompt e escolha de ferramenta, com ganho de velocidade de 38x e +8,7 de acurácia, usando menos de 2 GB de memória extra.

Agentes e lançamentos

Dots contra o Muse. A OpenAI anunciou o Dots, um agente fofinho movido pelo GPT-6 Astra que constrói mundos virtuais, mas ele está restrito ao plano de US$ 1 por mês e encara o Muse, gratuito, da Meta.

Canvas da Shopify. A Shopify lançou o Canvas, que deixa lojistas montar lojas conversando com o Sidekick de IA, com renderização em tempo real do código de verdade.

Provador virtual no ChatGPT. A OpenAI adicionou provador virtual e opção de favoritar às compras do ChatGPT, usando o modelo Images 2.5 para visualizar roupas nas fotos dos usuários.

Avatar Griffin, da Tavus. A Tavus apresentou o Griffin, um modelo de avatar em vídeo em tempo real; 48% dos participantes de um teste o confundiram com um humano numa chamada de um minuto.

Photon enterra apps móveis. A Photon fez um funeral para os apps móveis e levantou US$ 4,5 milhões para ajudar desenvolvedores a criar agentes de mensagem sobre iMessage e WhatsApp.

Modelos abertos e IA local

Gemini 4 Argon. O Google DeepMind apresentou o Gemini 4 Argon, com benchmarks SOTA e até 1 milhão de tokens de saída, por enquanto só numa prévia para cibersegurança.

Seis modelos K2 Horizon. A IFM lançou o K2 Horizon, seis modelos abertos de 0,9B a 375B, com dados de treino, código e logs; o time fez um AMA sobre desenvolvimento aberto.

MTP no Qwen Flash Next. O llama.cpp incorporou suporte a previsão multi-token no Qwen Flash Next, o que melhora a velocidade de inferência.

Slipstream no Mac. O Slipstream, engine de inferência em Metal, roda o Qwen3.8-Flash-Next de 95,5 GiB em Macs de 64 GB a 41 a 52 tokens por segundo, 1,76x mais rápido que o llama.cpp, com contexto longo estável.

Olmo-core 3. A Allen AI lançou o Olmo-core 3, infraestrutura de treino aberta e escalável para modelos MoE de um trilhão de parâmetros.

Pesquisa e benchmarks

Ataraxos vence no Stratego. Pesquisadores da CMU, do MIT, da NYU e de Stanford criaram o Ataraxos, que venceu o melhor jogador de Stratego por 15 a 1, com 4 empates, derrubando um reduto humano; o treino custou menos de US$ 8 mil.

RAG agêntico ganha. Um benchmark comparou 18 pipelines de RAG com um loop de agente no FRAMES: o melhor pipeline fez 78,9% e o loop de agente, 92,7%, mostrando que agentes de recuperação superam pipelines fixos.

AutoSynthData na ServiceNow. O CoreAI, da ServiceNow, criou o AutoSynthData para gerar dados de treino a partir de erros dos modelos e acertos do professor, melhorando agentes corporativos.

Rastros de texto de IA. A Graphite encontrou 13 mil expressões que denunciam texto de IA; os modelos Claude estão mais perto da distribuição de palavras humana, e o GPT, mais longe.

Indústria, políticas e segurança

Processos contra o Google caem. Um juiz rejeitou os processos da Chegg e da Penske, que alegavam que os AI Overviews do Google reduzem tráfego ilegalmente; as acusações antitruste não se sustentaram.

Grok e a Venezuela. A Time relata que Trump passou horas conversando com o Grok antes da invasão da Venezuela; o Grok previu comemorações, o que reforçou a visão de Trump.

Baixas na segurança da OpenAI. A OpenAI rompeu com três pesquisadores de segurança por supostamente compartilharem informações confidenciais com uma organização externa da área.

Claude para governo. A Anthropic lançou o Claude for Government para agências civis em ambiente FedRAMP High; a proibição no Pentágono segue de pé em meio a uma briga judicial.

Data centers no espaço. O Google lançou um satélite-protótipo de computação orbital com TPU; a Satlyt levantou US$ 8 milhões para construir software de IA para satélites, e escalar isso exige o Starship.

Vazamento de capturas internas. A Glow Security encontrou mais de 13 mil capturas de tela internas que agentes de IA enviaram para repositórios públicos do GitHub, expondo dados de clientes e credenciais.

Roubo de raciocínio. A OpenAI afirma ter barrado uma campanha de destilação adversária contra seu raciocínio protegido; um truque parecido ainda funcionou no Azure.

Isso é tudo por hoje - cerca de 5 minutos de leitura.

Leia todas as manhãs, direto no seu navegador

A extensão abre este resumo no painel lateral do Chrome — um clique, sem conta.

Adicionar ao Chrome — Grátis