Agentic AI News Hoje

As notícias do dia sobre agentes de IA em uma leitura de 5 minutos: lançamentos, ferramentas, pesquisas, financiamentos e movimentos empresariais.

Atualizado diariamente selecionado de 30 fontes Sábado, Outubro 3, 2026

Lançamentos de agentes e modelos

Gadgets do Muse. A Meta abriu o firmware e um SDK para montar hardware DIY que se conecta ao seu agente Muse, como telas E Ink e sticks HDMI, com um Discord para suporte.

OpenAI Dot. O novo agente Dot, da OpenAI, age como um software corporativo que também sabe pedir jantar: roda em uma máquina virtual com acesso a aplicativos como Blender e GIMP e é posicionado como um colega de trabalho, não como um assistente pessoal.

Modelo humanoide da Unitree. A Unitree lançou o UnifoLM-WLA-1.0, um modelo de 6B treinado com cerca de 2.500 horas de dados reais de robôs que dá conta de 64 tarefas de corpo inteiro e de bancada no G1. Ele combina fluxo óptico e MMDiT para controle contínuo.

FrogNano para código. O FrogNano-4B-2609, da Microsoft, é um modelo agêntico derivado do Qwen3.5-4B, pós-treinado em 1.500 tarefas sintéticas de SWE com recompensas executáveis para melhorar a engenharia de software em nível de repositório em um formato compacto.

Cloudflare Clef. A Cloudflare lançou os modelos de decisão Clef e Clef-flash, que geram probabilidades sobre respostas predefinidas, com latência mediana de apenas 39 ms, o que permite que agentes ajam sem intervenção humana.

Ferramentas e frameworks

Motor MegaCapybara. Um motor de inferência feito sob medida para a RTX 5090 e o Qwen3.8 27B promete cerca do dobro da velocidade de decodificação do NInfer, chegando a mais de 500 t/s com um agente e mais de 2.000 t/s com 12 agentes, com kernels dinâmicos e gerenciamento de cache.

Atualizações do llama.cpp. O llama.cpp ganhou suporte a modelos de decisão e um pull request de CUDA que funde especialistas compartilhados para acelerar arquiteturas MoE como o Qwen 35B A3B.

Legendas com mlsubgen. Uma nova ferramenta local gera legendas em 45 idiomas totalmente na sua própria máquina, detectando o idioma de cada trecho, conciliando dois reconhecedores de fala com um LLM local e dando preferência a legendas já embutidas.

Pesquisa e avanços em modelos

Arquitetura de memória Spotlight. O Spotlight, da Percepta, substitui a atenção por uma memória gravável sem limite que o próprio modelo indexa, separando inteligência de conhecimento para que as capacidades cresçam sem alterar os pesos.

Novidades do GPT-6. A OpenAI publicou um guia da família GPT-6 e anunciou novidades do DevDay, incluindo o GPT-6.1 Sol, computer use para a Agents API, ambientes Codex na nuvem e uma Decisions API.

AstaBrief em open source. A Hugging Face abriu o código do AstaBrief, um modelo pequeno treinado especificamente para gerar relatórios científicos rápidos e com citações, projetado para se manter ancorado em evidências e verificar as próprias saídas.

Indústria e negócios

Apple restringe acesso a disco. A Apple está adicionando controles ao Acesso Total ao Disco do macOS por causa dos riscos dos agentes de IA, depois que o Meta Muse teria lido mensagens sem permissão. A Meta diz que o acesso é opt-in, e a Apple quer uma ação bem explícita do usuário.

Data centers sob pressão. A Amazon prometeu US$ 1 bilhão para as comunidades que abrigam data centers, e o CEO da AWS, Matt Garman, pediu o fim das moratórias, alegando que se trata de desinformação estrangeira. Já a Microsoft amplia o uso de biomimética em data centers em meio à oposição local.

IA vira “super intelligence”. A Casa Branca conseguiu que os principais CEOs de tecnologia assinassem um compromisso de segurança em IA, e Trump assinou uma ordem executiva que rebatiza a IA como “super intelligence”. Enquanto isso, só 2% dos consumidores compram produtos de IA.

Demissões de segurança na OpenAI. A OpenAI demitiu três pesquisadores e um quarto deixou a empresa depois que uma investigação concluiu que eles vazaram informações confidenciais para uma organização externa de segurança em IA.

Uber Eats acelera busca. O Uber reconstruiu seu pipeline de busca e cortou 50% da latência ponta a ponta, usando codificação agêntica para identificar e validar as otimizações.

IA inside-out do Airbnb. O CTO do Airbnb, Ahmad Al-Dahle, aplica uma estratégia de IA de dentro para fora: usar IA generativa internamente para acelerar o desenvolvimento de produtos e, depois, transformar a experiência do cliente.

IA local e hardware

Strata com Qwen3.8 Next. Usuários relatam que o Strata com Qwen3.8 Next roda a 45 a 70 t/s em uma máquina lenta com DDR4 e uma 7900 XTX, e a 150 a 200 t/s em uma RTX 5090 com potência limitada e 96 GB de DDR5, superando o llama.cpp com folga.

iPhone como segunda GPU. Um iPhone 17 Pro Max pode acelerar o prefill do Qwen 3.8 27B em 29% a 44% em um MacBook de 24 GB quando conectado por USB-C, com as camadas superiores rodando na GPU do celular.

Placas Ascend de 96 GB. Duas placas Huawei Atlas 300I Duo de 96 GB cada rodam o Qwen3.8 Flash-Next a cerca de 30 t/s depois de ajustes na pilha de software, apesar de não serem um substituto direto para o CUDA.

DGX Spark e 5090. A Nvidia apresentou um DGX Spark de 64 GB, enquanto o preço do modelo original de 128 GB subiu para US$ 6.950, e comprar uma RTX 5090 na Micro Center agora exige, segundo relatos, documentação comprovando que a placa não será exportada.

Isso é tudo por hoje - cerca de 5 minutos de leitura.

Leia todas as manhãs, direto no seu navegador

A extensão abre este resumo no painel lateral do Chrome — um clique, sem conta.

Adicionar ao Chrome — Grátis