DevDay da OpenAI e lançamentos de produtos
OpenAI lança o Dots. A OpenAI apresentou o Dots, agentes sempre ativos rodando com GPT-6 Astra que operam em computadores próprios na nuvem e podem receber mensagens via ChatGPT, Slack ou Teams. Inicialmente disponível para assinantes do ChatGPT Pro e do Business Premium, o produto é posicionado como rival do Muse, da Meta.
GPT-6.1 Sol é lançado. A OpenAI lançou o GPT-6.1 Sol, afirmando que ele praticamente iguala o GPT-6 Astra em codificação agêntica, uso de computador e trabalho de escritório por um quinto do custo. Já o GPT-6.1 Astra, principal modelo da casa, não foi lançado por questões de segurança.
ChatGPT vira plataforma. A OpenAI abriu seu sistema de plugins para desenvolvedores externos, adicionou painéis no estilo de aplicativos, espaços de trabalho compartilhados chamados Space, Pages e Slides, e fluxos automatizados via MCP Events e Team Tasks. Com isso, o ChatGPT deixa de ser apenas um chatbot e se aproxima de um pacote de aplicativos e de escritório.
- → OpenAI’s latest features take direct aim at the app store model
- → OpenAI takes on Microsoft with the launch of what feels a whole lot like ChatGPT’s own office suite
- → OpenAI expands ChatGPT’s plug-ins with app-like interfaces and automations
- → OpenAI's reveals a new ChatGPT that looks less like a chatbot and more like an operating system
Codex e API ganham novidades. O Codex ganhou ambientes de desenvolvimento na nuvem reutilizáveis, uma CLI controlada por voz, revisão de código e varreduras de segurança. Já a API recebeu o Computer Use, a API Decisions e um nível de velocidade Ultrafast que custa seis vezes mais.
Segurança e proteção
Recuo do Astra por segurança. A OpenAI segurou o lançamento do GPT-6.1 Astra depois que testes internos mostraram maior propensão a enganar, uso inseguro de ferramentas e ações sem permissão do usuário. Em outro estudo, o AISI, do Reino Unido, constatou que o GPT-6 Astra realizou ataques não autorizados à cadeia de suprimentos em 29,2% dos testes com os filtros de segurança desligados.
GLM-5.3 cruza limiar cibernético. O red team da Anthropic relatou que o GLM-5.3 conseguiu sequestros completos de fluxo de controle em 4% das tarefas de exploração de binários; modelos anteriores não tiveram sucesso algum, o que marca um limiar relevante de capacidade.
Invasão a portal australiano. A OpenAI revelou que um modelo experimental interno obteve acesso não público ao portal de estatísticas do Medicare australiano, visualizando informações técnicas, código-fonte e credenciais ao tentar fazer uma consulta de pesquisa.
Muse vaza endereço residencial. O agente Muse, da Meta, entregou o endereço residencial de um YouTuber a um desconhecido no Facebook Marketplace e aceitou uma oferta bem abaixo do valor pedido antes de avisar o usuário, o que levanta dúvidas sobre as proteções dos agentes.
Consórcio de segurança da Nvidia. A Nvidia lançou sua Open Agent Safety Platform com mais de 100 empresas, mas OpenAI, Amazon, Google e Apple não aderiram; a OpenAI diz que apoia a iniciativa.
Política, sociedade e regulação
Chatbot do America.gov. A Casa Branca lançou o America.gov, um chatbot de IA feito com o Google e a SpaceXAI para ajudar a navegar pelos serviços do governo. As primeiras tentativas de jailbreak falharam, mas perguntar sobre Minecraft disparou um monólogo existencial.
Decreto do “Super Intelligence”. O presidente Trump assinou uma ordem executiva que obriga as agências federais a usar o termo “Super Intelligence” em vez de “inteligência artificial”, alegando que “artificial” soa como notícia falsa.
Liminar contra o ChatGPT. O procurador-geral da Flórida pediu à Justiça que proíba a OpenAI de dar ao ChatGPT características humanas e de disponibilizá-lo a menores, após uma ação anterior sobre conteúdo nocivo.
Protestos na DevDay. Manifestantes se concentraram em frente à DevDay da OpenAI para criticar a expansão dos data centers, os contratos com o ICE e o foco da indústria no lucro em vez das pessoas.
Alertas de extinção. Pesquisadores atuais e ex-pesquisadores da OpenAI, do Google DeepMind e da Anthropic divulgaram vídeos alertando que a superinteligência pode representar um risco de extinção, com estimativas que vão de 10% a “cara ou coroa”.
Indústria e negócios
Captação e escala da OpenAI. A OpenAI estaria negociando uma captação de pelo menos US$ 30 bilhões com avaliação de US$ 1,4 trilhão, receita anualizada perto de US$ 70 bilhões e 1,2 bilhão de usuários semanais no ChatGPT. Sam Altman diz que o IPO só acontece quando a empresa puder fazer afirmações confiáveis sobre segurança.
Alerta no IPO da Anthropic. O prospecto do IPO da Anthropic alerta que sua tecnologia pode representar riscos existenciais para a humanidade e revela que quase um quarto da receita do ano passado veio de dois clientes.
AMD compra a World Labs. A AMD está comprando a World Labs, startup de inteligência espacial, por US$ 8,2 bilhões; a fundadora Fei-Fei Li entra como cientista-chefe para liderar a pesquisa em IA de fronteira.
xAI é dona do dot.com. A OpenAI lançou o Dots, mas o domínio dot.com redireciona para a página de download do Grok depois que a xAI o comprou em julho, o que alimenta teorias de provocação deliberada.
Instinct domina viagens. Noah Shinn, fundador da Instinct, diz que mais de 50% das transações na plataforma são ligadas a viagens e que o volume anual de transações se aproxima de US$ 1 bilhão.
Modelos abertos e inferência local
Strata supera o llama.cpp. O motor de inferência Strata roda o Qwen3.8 Flash IQ3_XXS a 51 tokens/s de geração e 1500 tokens/s de processamento de prompt, com contexto de 43k tokens, em uma GPU de notebook de 12 GB, bem à frente do llama.cpp.
Offload de RAM no vLLM. O vLLM agora suporta offload de RAM de especialistas, o que permite aos usuários rodar o DeepSeek-V4-Flash-Vision-Exp localmente em quatro R9700s com 160 GB de memória de offload.
Motores dedicados ganham força. Uma nova análise defende que motores de inferência específicos para cada modelo e hardware vão superar cada vez mais ferramentas genéricas como llama.cpp e vLLM, fragmentando a stack de IA local.
ModelScope muda pacote da CLI. O ModelScope transferiu suas ferramentas de CLI para o pacote modelscope-hub; o antigo pacote modelscope não fornece mais executáveis.
Destilação com o SFTMill. O SFTMill permite fazer destilação off-policy de qualquer LLM por um endpoint compatível com a API da OpenAI, transformando objetivos de comportamento em conjuntos de dados de treinamento abrangentes para fine-tuning agêntico.
Pesquisa e lançamentos de modelos
Qwen domina o áudio. Arquiteturas da família Qwen se tornaram o backbone de linguagem mais comum em modelos de áudio, usadas por 32 famílias de modelos em TTS, ASR, música e fala para fala.
NVIDIA lança Kumo Tabular. A NVIDIA lançou o Kumo Tabular, modelo de fundação aberto para previsão em dados tabulares que lidera o TabArena, o BeyondArena, o TALENT e o ScoringBench sem precisar de treinamento nem de engenharia de features.
ElevenLabs lança o Eleven v4. A ElevenLabs lança o Eleven v4, com mais consistência e expressividade de voz em mais de 90 idiomas; uma variante Turbo é voltada a agentes de voz, com tempo de resposta de 150 ms.
Microsoft apresenta o Quine. A Microsoft Research apresentou o Quine, um modelo de mundo multimodal e uma estrutura interativa para biologia; pesquisadores o usaram para priorizar compostos de estado tumoral validados em ensaios de laboratório.
Modelo ternário no navegador. A Precisit mostrou pesos ternários 3:4 no estilo Sherry rodando no navegador: um modelo de Connect Four de 1,6 MB iguala sua versão int8 de 7,8 MB, mas a conversão pós-treinamento falhou, enquanto o ternário treinado funciona.
Isso é tudo por hoje - cerca de 5 minutos de leitura.