에이전트 및 모델 릴리스
Qwen 3.8 27B 점수. Qwen 3.8 27B는 Artificial Analysis Intelligence Index에서 52점을 기록하여 GPT-5.6 Luna Max와 동률을 이루고, 훨씬 더 큰 GLM-5.2 및 DeepSeek V4 Pro에 1점 뒤처집니다. 벤치마크 가시성을 최대화하기 위해 xhigh 추론이 기본 설정으로 제공됩니다.
Qwen 에이전틱 코딩. 16GB VRAM에서 MTP 추측 디코딩을 사용하는 양자화된 Qwen 3.8 27B는 73k 컨텍스트를 30-50 tps로 처리합니다. 로컬 벤치마크에 따르면 중간 추론 모드는 더 적은 토큰으로 DeepSeek V4 Flash와 거의 동일하며, xhigh는 에이전틱 코딩을 명확히 개선하지 않습니다.
- → Optimizing Qwen3.6 / Qwen3.8-27B on 16GB VRAM: Complete Benchmark Results and Setup Guide (~30-50tps at 32k to 72k context)
- → After pushing 1M+ tokens through Qwen 3.8 27B, here is my optimal llama.cpp config for 16GB VRAM (73k Context, Agentic Coding)
- → Local agentic coding Benchmark : Qwen 3.8 27B (in many weights quants / cache quants / engine / reasoning effort) vs others.
35B-A3B 아직 불명확. Qwen 개발자는 35B-A3B를 기다리지 말라고 말하지만, 커뮤니티의 35B-A3B 및 122B에 대한 수요는 공식 출시 신호 없이 여전히 높습니다.
Ling 3.0 Tiny 속도. 1.3B 활성 매개변수를 가진 Ling 3.0 Tiny 8B는 4GB VRAM에서 초당 36토큰으로 실행되며 Qwen 3.5 9B 및 Gemma 12에 근접한 성능을 보입니다.
GLM-5.3 포스트 트레이닝. Z.ai는 GLM-5.3을 출시했으며, 개선은 전적으로 더 많은 포스트 트레이닝에서 비롯되어 더 나은 복잡한 코딩 및 장기 작업 성능을 제공합니다.
Grok Bot 에이전트. SpaceXAI는 전용 클라우드 컴퓨터에서 멀티스텝 워크플로우를 처리하고 선호도를 기억하며 그룹으로 조정하는 지속적인 AI 에이전트인 Grok Bot을 도입했습니다.
도구 및 프레임워크
llama.cpp v0.1.0. llama.cpp는 첫 번째 시맨틱 버전인 v0.1.0을 출시했으며, PR은 MTP 깊이를 동적으로 선택하는 적응형 MTP를 추가하여 코딩 생성 속도를 10-15% 향상시키고 회수 속도를 최대 100% 빠르게 합니다.
에이전트 결제 미들웨어. LangChain 에이전트용 AgentCore Payments 미들웨어는 결정론적 세션 수준 예산과 지갑 지원을 추가하며, LangSmith는 에이전트가 무엇을 구매했는지와 이유를 기록합니다.
에이전틱 피트니스 함수. 새 기사는 에이전틱 피트니스 함수가 판단이 많이 필요한 위험을 처리하여 진화적 아키텍처를 확장할 수 있다고 주장하며, 결정론적 게이트는 측정 가능한 불변 속성을 위해 남아 있습니다.
제약 인식 GPU 스케줄링. Hugging Face는 제약 인식 GPU 할당자를 구축하여 동일한 하드웨어에서 활용도를 최대 33% 포인트, 우선순위 가중 출력을 최대 105% 개선했습니다.
산업 및 비즈니스
Stripe-OpenRouter 거래. Stripe는 AI 모델 라우팅 스타트업 OpenRouter를 70억 달러 이상에 인수할 예정이라고 합니다. 이는 13억 달러 시리즈 B 이후이며, OpenRouter는 800만 사용자와 월 250T 토큰을 보유하고 있습니다.
Anthropic 수익 급증. Anthropic의 연간 매출 실행률은 5월 470억 달러, 2025년 말 90억 달러에서 7월 650억 달러를 넘어섰으며, 올 가을 2조 달러 이상의 가치로 IPO가 예상됩니다.
Relay 종료. AI 워크플로우 자동화 스타트업 Relay가 폐쇄됩니다. 창립자와 일부 직원은 Google의 Chrome 팀에 합류하여 Chrome에서 AI 작업을 수행합니다.
Wispr $280M 조달. Wispr는 AI 받아쓰기에서 메모 작성 및 회의로 확장하기 위해 20억 달러 가치로 2억 8천만 달러 시리즈 B를 조달했으며, Canto 모델을 출시했습니다.
AI 비디오 시장 반등. AI 생성 비디오는 Sora의 실패 이후 할리우드 스튜디오와 수십억 달러를 유치하고 있으며, Promise와 같은 스타트업은 실시간 배경에 Seedance 2.5를 사용합니다.
Grab의 AI 에이전트. Grab은 5단계 에이전트 자율성 모델을 사용하여 기계적인 분석 작업을 44%에서 30%로 줄였으며, 분석가는 최종 결정을 유지합니다.
인프라 및 컴퓨팅
OpenAI 오하이오 데이터 센터. OpenAI는 SB Energy와 함께 오하이오의 PORTS-Pike에서 8GW IT 용량에 대한 20년 임대 계약을 체결했습니다. Nvidia는 최대 1,050억 달러를 지원하며 유일한 칩 공급업체입니다.
Groq 네오클라우드 전환. Groq는 Nvidia와의 라이선스 계약 후 AI 칩에서 Nvidia 기반 네오클라우드 인프라 운영으로 전환하면서 35억 달러 가치로 3억 5천만 달러를 조달했습니다.
RTX Pro 6000 가격 급등. CDW는 RTX Pro 6000의 권장 소비자 가격을 1만 6천 달러에서 1만 9,999달러로 인상했으며, 중고 시장 가격도 급등하여 지역 AI 빌더를 압박하고 있습니다.
훈련 데이터 및 정책
Amazon 희귀 도서 스캔. AirTag가 대량 희귀 도서 주문을 Amazon AI 훈련 시설로 추적했으며, 그곳에서 작업자들은 책을 스캔하기 위해 책을 파기합니다. Amazon은 상업적 채널을 통해 책을 구매한다고 밝혔습니다.
Anthropic Claude 워터마킹. Anthropic은 EU AI Act를 준수하기 위해 Claude 출력에 SynthID-Text 워터마크를 포함할 예정입니다. 비평가들은 단어 선택 품질과 투명성 문제를 우려합니다.
오늘은 여기까지입니다 - 약 5분 읽기 분량.