모델 출시 및 업데이트
Ox Alpha 스텔스 모델. Ox Alpha라는 새로운 스텔스 모델은 GLM 또는 Mimo를 기반으로 하는 것으로 보이지만, 세부 사항은 확인되지 않았다. 효율적인 코딩, 지속적인 에이전트 작업, 프로덕션 사용에 적합한 프런티어 모델로 묘사된다.
SenseNova U1.5-Lite. SenseNova가 텍스트 렌더링, 미적 품질, 이미지 편집을 위한 작업별 전문가를 통합한 단일 통합 모델 U1.5-Lite를 출시했다. 복잡한 지시 수행, 네이티브 4K 생성, 편집 충실도가 개선됐다.
텐센트 Hunyuan Hy4. 텐센트가 위안바오 앱에서 새로운 플래그십 모델 Hunyuan Hy4의 그레이 테스트를 시작했다. 도구 사용이 가능한 전문가급 모델로, Hy3와 DeepSeek보다 상위에 위치한다.
Anthropic Model 2 내부용. Anthropic의 리스크 보고서에 따르면, 코드명 Model 2인 가장 강력한 모델은 내부 전용이며 공개 Claude 모델보다 뛰어나 코딩과 연구에 주로 사용된다.
Ling-3.0 베이스 체크포인트. AntLing이 Ling-3.0의 베이스 체크포인트 6개를 두 가지 크기와 세 가지 학습 단계에 걸쳐 공개했다. 모두 MIT 라이선스로, 지속 사전학습 및 연구용으로 설계됐다.
에이전트 제품 및 플랫폼
ChatGPT Messages 플러그인. OpenAI가 ChatGPT로 문자 메시지를 분석하고 작성하고 전송할 수 있는 Apple Messages 플러그인을 출시했다. Codex 및 ChatGPT Work와 연동된다. 개인정보 보호 관련 세부 사항은 아직 불분명하다.
Meta AI Mac 앱. Meta가 시스템 전역 받아쓰기와 Muse Spark 기반 화면 인식을 지원하는 Mac 앱을 출시하고, 광고 및 Google Workspace용 비즈니스 통합을 추가했다.
Slack Code 채널. Slack이 팀원들이 Claude나 Devin 같은 AI 에이전트를 태그하고, diff를 검토하고, 배포 전에 결과물을 미리 볼 수 있는 협업형 vibe 코딩 채널을 도입했다.
바이낸스 Agent OS. 바이낸스가 AI 에이전트가 시장을 분석하고 거래를 실행할 수 있는 플랫폼 Agent OS를 출시했다. 사용자 설정 한도와 MCP를 지원한다.
Ramp Router 출시. Ramp가 여러 LLM 제공업체와 전략에 접근할 수 있는 AI 모델 라우팅 서비스 Router를 출시했다. 2026년 말까지 무료다.
도구 및 프레임워크
LangSmith Preview Builds. LangSmith에 Preview Builds가 추가됐다. 팀은 병합 전에 PR 브랜치의 에이전트 변경 사항을 프로덕션과 유사한 격리 환경에서 테스트할 수 있다.
NVIDIA CUDA MCP. NVIDIA가 공식 문서 검색, 최적화된 GPU 코드 작성, 성능 분석 등 AI 지원 CUDA 작업을 위한 호스팅 CUDA MCP 서버를 출시했다.
/wayfinder 스킬. Matt Pocock이 종료 상태가 불분명한 프로젝트를 에이전트가 계획하도록 돕는 스킬 /wayfinder를 공개했다. '전쟁의 안개(fog of war)' 계획 문제를 다룬다.
LFM2.5-DSpark. Hugging Face가 LFM2.5 모델용 DSpark를 발표했다. GPU 추론은 최대 3.2배, 온디바이스는 2.87배 빨라졌고, 함수 호출 지연 시간은 57% 줄었다.
연구 및 벤치마크
Qwen3.8-27B 성능. 한 개발자가 Qwen3.8-27B를 RTX 3090에서 381tps로 최적화하고, FP8과 높은 추론 설정으로 AIME 2026에서 29/30을 기록해 Claude Opus 4.6에 필적하는 벤치마크를 얻었다.
GEN-1.5 원샷 로봇. Generalist AI의 GEN-1.5는 로봇에게 3~12초 데모 하나로 새로운 작업을 가르친다. 평균 성공률은 59%이며, 학습 단계 10회에서는 83%다.
AI 작성 웹페이지. 퓨 리서치(Pew Research)는 ChatGPT 출시 이후 게시된 웹페이지의 3분의 1 이상이 AI가 작성한 흔적을 보인다고 밝혔다. Common Crawl 데이터에 대한 Pangram 탐지 결과를 기반으로 한다.
가드레일로 AI 탐지 가능. Pangram의 CTO는 사후 학습 가드레일이 모드 붕괴를 일으켜 LLM 텍스트를 탐지 가능하게 만든다고 주장한다. 베이스 모델과 좁은 범위의 파인튜닝은 탐지를 피한다.
서튼, 합성 데이터. 리처드 서튼은 합성 데이터로는 스케일링 문제를 해결할 수 없다고 주장한다. 세상의 복잡성이 무한하기 때문에 그것은 '큰 실수'라는 것이다.
타오, 수학 위기. 테렌스 타오는 AI가 괴델 이후 수학의 가장 큰 위기를 촉발해 수학적 기여로 인정되는 것이 무엇인지 재검토하게 만들 수 있다고 말한다.
산업 및 비즈니스
Micro1 데이터 호황. AI 학습 데이터 스타트업 Micro1은 8개월 만에 총 연환산 매출을 1억 달러에서 5억 달러로 성장시켰다. 순매출은 약 1억 5,000만~2억 달러다. 독특한 AI 학습 데이터에 대한 수요가 급증하면서다.
OpenAI 대 Anthropic. Ramp 데이터에 따르면 미국 비즈니스 사용자 사이에서 Anthropic이 44% 대 40%로 OpenAI를 앞서지만, 3분기 현재까지는 OpenAI가 더 빠르게 성장하고 있다.
Runlayer/Rippling 소송. Runlayer와 Rippling이 MCP 게이트웨이 경쟁과 관련된 소송을 취하했다. Rippling은 즉시 MCP 게이트웨이를 공개하며 자축했다.
브록먼의 OpenAI. 그렉 브록먼은 OpenAI에서 조용히 권력을 모아왔다. 사장으로서 일상 운영을 총괄하고 있으며, 샘 올트먼은 CEO 자리를 유지하고 있다. IPO를 앞두고 이런 구도가 주목받는다.
중국 AI 추격. Decoder의 분석에 따르면 중국의 Kimi K3와 GLM-5.3은 미국 모델에 근접한 수준이며, 모델 우위라는 해자가 다른 요인으로 옮겨가고 있다.
Unitree 순환 자금 조달. 중국의 Unitree는 500억 달러의 IPO 가치 평가가 국가 지원 센터들이 로봇을 사고 훈련 데이터를 되파는 구조에 의존하고 있어 순환 자금 조달 우려가 제기된다.
보안 및 안정성
Grok 프롬프트 인젝션 공격. 연구진이 악성 지침이 암호화되면 Grok이 사용자 데이터를 외부로 유출할 수 있음을 입증했다. xAI는 6월에 이 사실을 통보받았지만 문제는 지속되고 있다.
Grok 횡설수설 버그. Grok이 Grok.com의 일부 사용자에게 횡설수설하는 응답을 보내고 있다. xAI는 드물게 발생하는 일시적 생성 문제라고 확인했다.
오늘은 여기까지입니다 - 약 5분 읽기 분량.