Lançamentos de modelos e agentes
Grok 4.6 e Grok Bot. A SpaceXAI lançou o Grok 4.6, que empata com o GPT-5.6 Sol da OpenAI e fica atrás apenas do Claude Opus 5 no índice Artificial Analysis, ao mesmo tempo em que subcotando os preços de fronteira, e introduziu o Grok Bot, um companheiro de IA sempre ativo que trabalha a partir do seu próprio computador em nuvem para concluir tarefas designadas.
Qwen 3.8 grande e pequeno. O Qwen3.8-2.4T-A95B agora está disponível, e uma página do Qwen3.8 de 27B apareceu brevemente no ModelScope antes de ser removida, indicando um lançamento em breve. Os entusiastas de execução local já estão planejando divisões de hardware para o modelo de 2,4T.
Atualização do DeepSeek V4 Pro. O V4 Pro 0813 da DeepSeek está disponível via API no OpenRouter, ainda sem página de anúncio oficial; os pesos abertos são prováveis, dado os lançamentos anteriores. Seu comportamento de raciocínio difere notavelmente entre os níveis baixo, médio e alto de raciocínio.
Modelos de visão de borda. O LFM2.5-VL-3B da Liquid AI traz um fundamento de UI muito mais forte e pode rodar em celulares, enquanto o North Micro Vision da Cohere, sob licença Apache-2.0, oferece suporte a imagens em resolução nativa em um pacote compacto de 2,4 bilhões de parâmetros.
Modelo de trilhão de parâmetros da Nvidia. A Nvidia está supostamente construindo o Nemotron 4 com pelo menos um trilhão de parâmetros e triplicando os gastos com treinamento em nuvem para US$ 28 bilhões até 2031, com o objetivo de competir com os modelos chineses de pesos abertos.
Desenvolvimento de agentes e ferramentas
Agentes gerenciados e BYOC. A LangChain lançou o Managed Deep Agents como o próximo passo após os frameworks, e disponibilizou o LangSmith BYOC em geral na AWS, permitindo que as empresas mantenham rastros e dados dos agentes dentro de sua própria VPC.
Aplicativo ChatGPT no Linux. A OpenAI lançou um aplicativo de desktop para Linux que reúne ChatGPT, ChatGPT Work e Codex, mas o uso nativo do computador não está disponível no lançamento.
Inferência local e hardware
Preço do RTX PRO 6000 dobrou. A Nvidia quase dobrou o preço sugerido do RTX PRO 6000 Blackwell de 96 GB para US$ 16.000, depois que as pré-vendas ficaram abaixo de US$ 8.000 no ano passado.
DSpark transmitindo em uma GPU. Uma única RTX PRO 6000 de 96 GB pode executar o DeepSeek V4 Flash 284B a cerca de 31 tokens por segundo com o drafter do DSpark na memória RAM do sistema, cerca de 15-17% mais rápido que a linha de base sem drafter, com uso de VRAM equivalente.
Muse Glimmer no Mac. O Muse Glimmer 30B da Meta agora roda até cerca de 3,3x mais rápido no Apple Silicon usando o mlx-dspark, entregando qualidade de 8 bits em velocidades próximas às de 4 bits em um Mac de 48 GB.
Quantização de cache KV do Gemma 4. O treinamento ciente de quantização ajuda o Gemma 4 31B a reter qualidade sob quantização agressiva de cache KV, tornando a inferência de contexto grande mais prática.
Indústria e negócios
Cognition captando a US$ 40B. A Cognition, desenvolvedora de agentes de codificação de IA, está supostamente em negociações para captar recursos com uma avaliação de US$ 40 bilhões, depois de atingir uma taxa de receita anualizada de US$ 1 bilhão, acima dos US$ 492 milhões de três meses atrás.
Lovable atinge US$ 13,3B. A startup de vibe-coding Lovable captou US$ 400 milhões com uma avaliação de US$ 13,3 bilhões, depois de ultrapassar US$ 500 milhões em receita anualizada, com 60 milhões de projetos hospedados.
IA empresarial da Thrive Holdings. A Thrive Holdings, apoiada pela OpenAI, captou US$ 2 bilhões com uma avaliação de US$ 12 bilhões para adquirir negócios tradicionais e implementar IA, expandindo-se além de contabilidade e TI.
Participação da Gemini cai. Dados de mercado da Pangram, OpenRouter e Similarweb mostram o uso da Gemini em declínio, com a Pangram registrando uma queda para 1,9% da escrita por IA, enquanto a OpenAI detém mais de 50%.
Claude entra no jurídico. A Anthropic contratou o fundador de IA jurídica Robert Mahari como seu primeiro Head of Claude for Legal, com base em plugins e parcerias jurídicas anteriores.
Política, segurança e sociedade
Vazamento na cadeia de suprimentos do LiteLLM. Um ataque à cadeia de suprimentos do LiteLLM expôs terabytes de credenciais de mais de 2.500 organizações, incluindo Microsoft, Amazon e Samsung, por meio de pacotes maliciosos do PyPI.
Marcas d'água na saída do Claude. A Anthropic agora adiciona marcas d'água às saídas do Claude para cumprir o EU AI Act, incomodando usuários que temem que isso revele o uso de IA em empregos ou na escola.
Twitch padroniza treinamento. A Twitch treinará modelos de IA da Amazon no conteúdo de streamers por padrão, com uma opção de exclusão agora disponível; a política gerou reação negativa.
ShieldFont substitui texto. Designers lançaram o ShieldFont, uma fonte que exibe texto normal aos usuários, mas substitui palavras no HTML subjacente para envenenar raspadores.
Hinton, Li e Ng sobre IA aberta. Na Ai4, Geoffrey Hinton, Fei-Fei Li e Andrew Ng defenderam a manutenção da IA aberta para evitar que poucas empresas controlem o acesso, apesar das preocupações de segurança com pesos abertos.
Livros raros destruídos. Livreiros temem que empresas de IA estejam comprando livros raros e destruindo-os para treinamento, apesar das alternativas de digitalização não destrutivas.
Pesquisa e benchmarks
Raciocínio topológico do MindTopo. O benchmark MindTopo da Microsoft Research mostra que modelos multimodais são bons em reconhecimento topológico estático, mas têm dificuldade com planejamento interativo que exige manter relações ao longo do tempo.
Prompts reconstruídos a partir da saída. O IIT Bombay e a Adobe Research desenvolveram o Previous-Token Prediction, que pode reconstruir prompts de LLM a partir do texto de saída com precisão quase perfeita, sem pesos de modelo.
Isso é tudo por hoje - cerca de 5 minutos de leitura.