모델 및 에이전트 출시
Grok 4.6 및 Grok Bot. SpaceXAI는 OpenAI의 GPT-5.6 Sol과 동률을 이루고 Artificial Analysis 지수에서 Claude Opus 5에만 뒤지는 Grok 4.6을 출시했으며, 최첨단 가격을 낮추면서 자체 클라우드 컴퓨터에서 작동하여 할당된 작업을 완료하는 상시 대기 AI 동료인 Grok Bot을 소개했습니다.
Qwen 3.8 대형 및 소형. Qwen3.8-2.4T-A95B가 이제 사용 가능하며, 27B Qwen3.8 페이지가 ModelScope에 잠깐 나타났다가 삭제되어 조만간 출시될 것을 암시합니다. 로컬 실행 애호가들은 이미 2.4T 모델을 위한 하드웨어 분할을 계획하고 있습니다.
DeepSeek V4 Pro 업데이트. DeepSeek의 V4 Pro 0813은 OpenRouter에서 API로 사용할 수 있으며 아직 공식 발표 페이지는 없습니다. 이전 출시를 고려할 때 오픈 가중치가 제공될 가능성이 높습니다. 추론 동작은 낮음, 중간, 높음 추론 수준에 따라 눈에 띄게 다릅니다.
엣지 비전 모델. Liquid AI의 LFM2.5-VL-3B는 훨씬 강력한 UI 접지 기능을 제공하며 휴대폰에서 실행할 수 있고, Cohere의 Apache-2.0 North Micro Vision은 컴팩트한 2.4B 파라미터 패키지에서 기본 해상도 이미지 지원을 제공합니다.
Nvidia의 1조 파라미터 모델. Nvidia는 최소 1조 개의 파라미터를 가진 Nemotron 4를 구축하고 있으며, 2031년까지 클라우드 학습 지출을 280억 달러로 3배 늘려 중국의 오픈 가중치 모델과 경쟁하는 것을 목표로 하고 있다고 합니다.
에이전트 개발 및 도구
관리형 에이전트 및 BYOC. LangChain은 프레임워크 이후의 다음 단계로 Managed Deep Agents를 출시했으며, LangSmith BYOC를 AWS에서 일반 공개하여 기업이 에이전트 추적과 데이터를 자체 VPC 내에 유지할 수 있게 했습니다.
Linux용 ChatGPT 앱. OpenAI는 ChatGPT, ChatGPT Work, Codex를 번들로 제공하는 Linux 데스크톱 앱을 출시했지만, 기본 컴퓨터 사용 기능은 출시 시점에는 제공되지 않습니다.
로컬 추론 및 하드웨어
RTX PRO 6000 가격 두 배. Nvidia는 작년 사전 주문이 8,000달러 미만이었던 96GB RTX PRO 6000 Blackwell의 MSRP를 16,000달러로 거의 두 배 인상했습니다.
단일 GPU에서 DSpark 스트리밍. 단일 RTX PRO 6000 96GB는 시스템 RAM에 DSpark의 드래프터를 사용하여 DeepSeek V4 Flash 284B를 초당 약 31토큰으로 실행할 수 있으며, 동일한 VRAM 사용량에서 드래프터가 없는 기준선보다 약 15-17% 빠릅니다.
Mac에서 Muse Glimmer. Meta의 Muse Glimmer 30B는 이제 mlx-dspark를 사용하여 Apple Silicon에서 최대 약 3.3배 빠르게 실행되며, 48GB Mac에서 4비트에 가까운 속도로 8비트 품질을 제공합니다.
Gemma 4 KV 캐시 양자화. 양자화 인식 학습은 Gemma 4 31B가 공격적인 KV 캐시 양자화에서도 품질을 유지하는 데 도움이 되며, 대규모 컨텍스트 추론을 더 실용적으로 만듭니다.
산업 및 비즈니스
Cognition, 400억 달러 평가로 자금 조달. AI 코딩 에이전트 제조사 Cognition은 3개월 전 4억 9,200만 달러에서 연간 매출 실행률 10억 달러에 도달한 후 400억 달러 평가로 자금을 조달하기 위해 협상 중인 것으로 알려졌습니다.
Lovable, 133억 달러 도달. Vibe 코딩 스타트업 Lovable는 연간 매출 5억 달러를 돌파한 후 133억 달러 평가로 4억 달러를 조달했으며, 6,000만 개의 호스팅 프로젝트를 보유하고 있습니다.
Thrive Holdings 엔터프라이즈 AI. OpenAI가 후원하는 Thrive Holdings는 전통적인 비즈니스를 인수하고 AI를 구현하기 위해 120억 달러 평가로 20억 달러를 조달했으며, 회계 및 IT를 넘어 확장하고 있습니다.
Gemini 점유율 하락. Pangram, OpenRouter, Similarweb의 시장 데이터에 따르면 Gemini 사용량이 감소하고 있으며, Pangram은 AI 작성에서 1.9%로 하락한 반면 OpenAI는 50% 이상을 차지하고 있습니다.
Claude, 법률 분야 진출. Anthropic은 이전 법률 플러그인 및 파트너십을 기반으로 법률 AI 창립자 Robert Mahari를 최초의 Head of Claude for Legal로 고용했습니다.
정책, 보안 및 사회
LiteLLM 공급망 유출. LiteLLM에 대한 공급망 공격으로 Microsoft, Amazon, Samsung을 포함한 2,500개 이상의 조직에서 테라바이트 규모의 자격 증명이 악성 PyPI 패키지를 통해 노출되었습니다.
Claude 출력 워터마크. Anthropic은 이제 EU AI Act를 준수하기 위해 Claude 출력에 워터마크를 표시하며, 이로 인해 직장이나 학교에서 AI 사용이 드러날 것을 우려하는 사용자들이 불만을 표시하고 있습니다.
Twitch, 기본 학습 동의. Twitch는 기본적으로 스트리머 콘텐츠로 Amazon AI 모델을 학습시키며, 이제 옵트아웃 토글이 제공됩니다. 이 정책은 반발을 불러일으켰습니다.
ShieldFont, 텍스트 대체. 디자이너들은 사용자에게는 일반 텍스트로 표시되지만 기본 HTML의 단어를 대체하여 스크레이퍼를 오염시키는 폰트인 ShieldFont를 출시했습니다.
힌턴, 리, 응, 오픈 AI에 대해. Ai4에서 Geoffrey Hinton, Fei-Fei Li, Andrew Ng는 오픈 가중치에 대한 안전 우려에도 불구하고 소수의 기업이 접근을 통제하는 것을 피하기 위해 AI를 개방적으로 유지해야 한다고 주장했습니다.
희귀 서적 파괴. 서적상들은 AI 기업들이 비파괴적 스캔 대안이 있음에도 불구하고 희귀 서적을 구매하여 학습을 위해 파괴하고 있다고 우려합니다.
연구 및 벤치마크
MindTopo 토폴로지 추론. Microsoft Research의 MindTopo 벤치마크는 멀티모달 모델이 정적 토폴로지 인식에는 뛰어나지만 시간에 따라 관계를 유지해야 하는 대화형 계획에는 어려움을 겪는다는 것을 보여줍니다.
출력에서 프롬프트 재구성. IIT Bombay와 Adobe Research는 모델 가중치 없이 출력 텍스트에서 LLM 프롬프트를 거의 완벽하게 재구성할 수 있는 Previous-Token Prediction을 개발했습니다.
오늘은 여기까지입니다 - 약 5분 읽기 분량.