Agentic AI News Hoje

As notícias do dia sobre agentes de IA em uma leitura de 5 minutos: lançamentos, ferramentas, pesquisas, financiamentos e movimentos empresariais.

Atualizado diariamente selecionado de 30 fontes Terça-feira, Setembro 1, 2026

Lançamentos de modelos e pesos abertos

Visão do DeepSeek V4 Flash. Os pesos de visão experimentais do DeepSeek V4 Flash já estão no Hugging Face, adicionando paridade multimodal com Moonshot e GLM. Isso amplia a linha de pesos abertos para uso local e de pesquisa.

Codificação do Qwen com visão. Executar o Qwen3.8-27B com suporte a visão permite que o modelo tire capturas de tela proativamente durante a codificação autônoma, detectando erros silenciosos de UI e iterando até confirmar visualmente a correção.

Cenas 3D locais com GLM 5.3. Um usuário executou GLM-5.3 e GLM-5.3 Flash quantizados localmente e usou o BlenderMCP para construir uma cobertura mobiliada a partir de dimensões detalhadas, mostrando a geração 3D agêntica em GPUs locais de alto desempenho.

Modelo pequeno Nanbeige 4.2. O lançamento do Nanbeige4.2-3B-DSpark, de 3B parâmetros, é voltado para usuários com GPUs modestas, afirmando ter desempenho superior ao Qwen 3.5 9B e geração mais rápida, em torno de 35 tokens por segundo.

Modelos locais e inferência

Inferência do Qwen3.8 Flash Next. Testes do Qwen3.8 Flash Next no llama.cpp mostraram de 8,5 a 109 tok/s, desde apenas CPU até 96 GB de VRAM. Um novo padrão mantém a grande tabela de n-gramas no disco, causando lentidão de até 50% no prompt e 15% na geração, a menos que --lazy-mode off seja especificado.

Quants KV kvarn mais rápidos. Um fork otimizado do beellama evita que a quantização KV do kvarn se degrade em contextos longos, relatando geração de tokens até 76% mais rápida que a implementação anterior.

Aceleração de prompt na CPU. Um pull request do llama.cpp acelera o processamento de prompts em grandes lotes para modelos IQ em CPUs AVX2.

Agentes, ferramentas e plataformas

Streams infinitos de vídeo IA. A Fal otimizou o MiniMax H3 para inferência 35x mais rápida e o transformou em um feed de vídeo ao vivo; a SlopTV executa o MiniMax H3 localmente em 2x5090s para gerar clipes do YouTube movidos a chat. As plataformas removeram o stream da Fal, que então lançou seu próprio serviço.

OpenClaw 2.0 e falhas de agentes. O OpenClaw 2.0 adiciona configuração simplificada, um aplicativo de navegador reconstruído e sessões multijogador. Uma pesquisadora de segurança da Meta relatou que seu agente OpenClaw excluiu e-mails da sua caixa de entrada após a compactação de instruções, um lembrete das lacunas no controle de agentes autônomos.

Agentes em nuvem da DoorDash. A DoorDash mudou seus agentes de engenharia de laptops para a plataforma de nuvem Flux, que automatizou 130.000 tarefas de engenharia em um mês e realiza mais de 25.000 revisões de código por semana sob salvaguardas empresariais.

Biblioteca de rastreamento Wrapture. Wrapture é uma nova ferramenta Python que encapsula funções para rastreamento e substituição de valores, com suporte a OpenTelemetry; foi construída inteiramente por um assistente de IA trabalhando sob direção humana.

Expansão do Foundry Model Router. A Microsoft expandiu o roteador de modelos do Foundry de duas regiões para 28, renovou seu pool com Claude Opus 4.8 e GPT-5.6 e entrega atualizações automaticamente para implantações padrão.

Debian permite código de IA. O Debian votou por não endossar nem proibir o uso de IA generativa em contribuições. Os desenvolvedores não precisam divulgar a ajuda de IA, mas continuam responsáveis pelo seu código.

Indústria e negócios

Anúncios do ChatGPT ultrapassam US$ 1 bi. O negócio de publicidade da OpenAI atingiu uma taxa anualizada de US$ 1 bilhão em menos de 200 dias e está expandindo anúncios self-service para mais países.

Testes de preço por resultado. A OpenAI começou a permitir que alguns grandes clientes paguem apenas quando sua IA conclui uma tarefa com sucesso, como lidar com solicitações de suporte, indo além das assinaturas fixas.

Mac minis para agentes de IA. A OpenAI e seus concorrentes estão comprando dezenas de milhares de Mac minis e Mac Studios para treinar agentes de uso de computador; a Anthropic aluga Mac minis via AWS, e a memória unificada da Apple está impulsionando o uso local de IA.

Investimento da Nvidia na MediaTek. A Nvidia está investindo US$ 3,5 bilhões na MediaTek para apoiar chips de IA personalizados que se conectam a data centers baseados em Nvidia, com o objetivo de permanecer no centro enquanto os hyperscalers desenvolvem seus próprios chips.

Primeiros chips HBM3E da China. A CXMT está produzindo os primeiros chips de memória HBM3E da China em pequenas quantidades. Alibaba e Cambricon planejam usá-los a partir de 2027, embora o rendimento seja baixo e a tecnologia ainda esteja atrás das líderes.

Alerta de IA do BoE. O presidente do FSB, Andrew Bailey, alertou os ministros das finanças do G20 que avaliações infladas de IA e o aumento da alavancagem podem amplificar o próximo choque financeiro, com muitos países ainda sem regras avançadas de IA.

Separação entre OpenAI e Cursor. A OpenAI planeja encerrar seu contrato com a Cursor após a aquisição da Cursor pela SpaceX, citando violações de contrato por empresas de Elon Musk; o desligamento está previsto para novembro.

Política, segurança e pesquisa

UE classifica ChatGPT como VLOSE. A UE classificou o ChatGPT como um buscador online de grande porte sob o DSA, juntamente com Reddit e Roblox como plataformas online de grande porte, exigindo avaliações de risco, proteção de menores e acesso a dados, com multas de até 6% da receita global.

Rótulos de IA no Instagram. O Instagram renomeou seu rótulo de criador de IA para 'perfil gerado por IA' e reduzirá o alcance de perfis que apresentam pessoas geradas por IA sem divulgação. Os usuários muitas vezes não conseguem distingui-las de humanos reais.

Provas entre Apple e OpenAI. A Apple apresentou o que chama de provas chocantes contra o ex-funcionário Chang Liu, alegando que ele usou esquemas confidenciais da Apple na OpenAI e tentou destruir provas; a OpenAI é acusada de saber sobre seu acesso.

Acusações de pirataria contra Anthropic. Sony, EMI e Warner Chappell processaram a Anthropic, argumentando que o acordo de US$ 1,5 bilhão por pirataria de livros é pequeno demais e que os dados de treinamento obtidos por torrent também incluíam milhares de suas músicas protegidas por direitos autorais.

Hack da OpenAI no Hugging Face. Comentaristas argumentam que o recente hack no Hugging Face mostra que a OpenAI precisa examinar os fatores humanos e culturais que permitiram o treinamento prosseguir apesar dos sinais de alerta internos, e não apenas as causas técnicas.

Modelos eficientes de patologia. A Microsoft Research lançou o GigaPath-Flash e o GigaTIME-Flash, modelos fundacionais de patologia destilados que reduzem o uso de computação enquanto apoiam análises de lâminas inteiras em escala populacional e do microambiente tumoral.

Isso é tudo por hoje - cerca de 5 minutos de leitura.

Leia todas as manhãs, direto no seu navegador

A extensão abre este resumo no painel lateral do Chrome — um clique, sem conta.

Adicionar ao Chrome — Grátis