Lançamentos de modelos e benchmarks
Gemini 3.8 Flash. Google lançou seu terceiro modelo Flash no espaço de seis semanas, com melhorias em raciocínio, programação e uso de ferramentas por agentes. O preço por token não mudou, mas o modelo pode consumir mais tokens; uma variante Cyber está disponível para defensores confiáveis por meio do novo programa Fairwind.
- → Google releases Gemini 3.8 Flash, its third Flash model in six weeks
- → Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- → Proactive cyber defense for governments and enterprises
- → Proactive cyber defense for governments and enterprises
- → Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA
- → Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
- → llm-gemini 0.34
Muse Spark 1.3. O modelo de pesos abertos da Meta agora está em terceiro no AAII, empatado com o GPT-5.6-Sol, e oferece treinamento mais de 90% mais barato para quem optar por isso. A liberação dos pesos está prometida, e usuários aguardam variantes menores entre Glimmer e Spark.
GLM-5.3 vs DeepSeek-V4. Comparações da comunidade em Mac Studio e DGX Spark mostram que o GLM 5.3 Flash chega às conclusões mais rápido e é melhor em escrita e visão, enquanto o DeepSeek V4 Flash oferece mais tokens por segundo e contexto mais longo. O suporte para visão e arquivos GGUF já estão disponíveis para o DeepSeek-V4-Flash-Vision-Exp.
IA local e open source
Ajuste no Qwen3.8 Flash Next. O PR do cache de especialistas melhora a decodificação de 17 para 25–29 t/s em duas RTX 3090, e os novos AP quants e o Q8 N-gram bolting não mostram perda de velocidade. Usuários também relatam alucinações nos planos e corrupção de contexto, o que sugere qualidade de preview.
Perplexity Lily. Perplexity abriu o código de seu servidor de inferência para Mac, otimizado para Qwen 3.6 em Apple silicon, com foco em um único modelo para obter o melhor desempenho.
Ferramentas locais de voz. VoxGen traz TTS em Rust/Vulkan para o VoxCPM2 com bom desempenho em AMD; a Microsoft lançou o VibeVoice, um ASR com streaming; e usuários compartilham o Mac Parakeet e o Whisper/Parakeet como uma configuração funcional de STT para programação.
Mod de Minecraft com GLM. Um GLM 5.3 Flash Q4 rodando localmente em quatro placas RTX PRO 6000 construiu iterativamente um mod de rifle de buraco negro para Minecraft usando a Fabric API.
Pesquisa e modelos de mundo
World Labs Atlas. World Labs apresentou o Atlas, um único modelo que gera, reconstrói e simula cenas 3D a partir de apenas algumas fotos, usando contexto espacial para ancorar cada entrada no espaço 3D.
Controle por linguagem no H3-World. O H3-World compõe ações do personagem e da câmera em instruções textuais injetadas pelo caminho de texto do MiniMax-H3, permitindo movimentação controlável em jogos com apenas 8.000 amostras e 0,199% de parâmetros treináveis.
Segurança, política e direito
Temores de segurança com Astra. A Astra, que a OpenAI está prestes a lançar, usa recorrência opaca, dificultando o monitoramento da cadeia de pensamento, e é classificada como “crítica” em capacidades cibernéticas. Especialistas em segurança alertam para uma corrida para o fundo do poço.
DOJ apoia fair use. O governo dos EUA apoiou a OpenAI no processo movido pelo New York Times, argumentando que o treinamento de LLMs com textos protegidos por direitos autorais é fair use e não se confunde com as saídas, para preservar a liderança americana em IA.
Regras secretas de segurança de IA. Uma ação judicial busca obrigar o governo Trump a revelar o arcabouço secreto para revisões de segurança de IA de fronteira antes do lançamento, que hoje não é transparente para o público nem para o Congresso.
NYC proíbe IA para alunos. Nova York proibiu o uso de IA por alunos até o oitavo ano e de chatbots de companhia em todas as séries, com uso limitado no ensino médio e aulas de letramento em IA.
Processos de Tumbler Ridge. Trinta novos processos acusam a OpenAI de cumplicidade no tiroteio na escola de Tumbler Ridge e de ter ignorado alertas de segurança sobre as conversas do suspeito no ChatGPT.
Negócios e enterprise
Palo Alto compra Console. Palo Alto Networks pagou US$ 500 milhões pela startup de agentes de IA Console, que automatiza tarefas de help desk de TI, para adicionar resultados autônomos de segurança à plataforma Cortex.
HiddenLayer levanta US$ 100 mi. A startup de segurança de IA HiddenLayer levantou US$ 100 milhões à medida que as empresas gastam mais para proteger modelos, agentes e fluxos de trabalho de IA contra ataques adversariais.
Wonderful atinge US$ 5 bi. A startup de sistema operacional de IA Wonderful levantou US$ 550 milhões, dobrando o valuation para US$ 5 bilhões, ao expandir de agentes de atendimento ao cliente para a coordenação de fluxos de trabalho em 35 países.
Escala de agentes corporativos. Schneider Electric, Vodafone e monday.com criaram camadas de infraestrutura para observabilidade, avaliação e deploy depois de descobrir que agentes são fáceis de prototipar, mas difíceis de operar.
Alexa detecta golpes. A Alexa for Shopping da Amazon agora consegue comparar uma mensagem com o histórico de mensagens enviadas pela Amazon para confirmar se ela é legítima, ajudando usuários a identificar golpes de falsa identidade.
Isso é tudo por hoje - cerca de 5 minutos de leitura.