Релизы моделей и инфраструктура
Модель Nvidia, ориентированная на скорость. Nvidia выпустила Nemotron 3.5 Lightning, открытую модель Mamba-Transformer на 30B параметров, которая соответствует GPT-OSS-120B по бенчмаркам, будучи оптимизированной для быстрого инференса всего с 3.6B активных параметров.
DeepSeek V4 работает локально. Сообщество квантизаторов DeepSeek V4 исправляет проблемы конвертации для бит-точных бейзлайнов, а DeepSeek V4 Flash достигает 27+ токенов/с на APU Strix Halo со спекулятивным декодированием, демонстрируя жизнеспособное локальное развертывание.
Десктопное приложение Unsloth. Unsloth выпустила открытое десктопное приложение для запуска и обучения локальных моделей на GPU, с песочницей для выполнения кода, RAG, экспортом моделей и отсутствием телеметрии.
Посевной раунд River AI на $1.1 млрд. Основанная экс-сооснователем xAI Игорем Бабушкиным, River AI привлекла $1.1 млрд для создания персонально обучаемых ИИ-ассистентов, переосмыслив весь стек от обучения до аппаратного обеспечения.
Daybreak Cyber на AWS. Модели кибербезопасности OpenAI Daybreak теперь доступны через Amazon Bedrock, предоставляя защитникам доступ к передовым кибервозможностям в их существующих средах AWS.
Манифест Цукерберга об открытом исходном коде. Генеральный директор Meta выступает за более открытые релизы весов и приглашает правительства к сотрудничеству в тестировании безопасности, поскольку компания продолжает публиковать такие модели, как Muse Glimmer.
Поддержка Ling‑3.0. Пул-реквест добавляет Ling‑3.0 в llama.cpp, при этом крошечный вариант уже хорошо работает для голосовых задач домашнего ассистента благодаря честному отказу при неуверенности.
Инструменты и локальный ИИ
MCP Broker сокращает контекст. Самодельная агентная обвязка использует MCP-брокер для скрытия инструментов за прокси, сокращая стартовый контекст с 20K токенов почти до нуля, и добавляет временную осведомленность для лучшего локального выполнения.
Майнинговые GPU для LLM. Майнинговые карты CMP170HX с 8GB могут быть расширены до 64GB каждая, запуская большие модели или несколько маленьких моделей одновременно, предлагая дешевую, но устаревающую производительность класса Ampere.
366 ток/с на V100. Пользовательские CUDA-ядра (v100‑skinny) обеспечивают до 366 ток/с на Qwen3.6 27B в NVFP4 на GPU Volta, вдыхая новую жизнь в старое оборудование для локального инференса.
Модель TinyTitle. Модель GRU с 1.8M параметров генерирует заголовки чатов менее чем в 5 МиБ ОЗУ, демонстрируя сверхлегкое устройственное суммарирование, которое выполняется за несколько миллисекунд.
Приватный ИИ для электронных книг. Приложение для электронных книг интегрирует модели Gemma 4B локально для приватных вопросов и ответов по книгам в приложении, с переключателями спойлеров и автоматическим подбором языка.
Энергоэффективный ИИ-сервер. Сборка, сочетающая Intel N100 с RTX 5060Ti, дает тихий и эффективный сервер llama.cpp, способный запускать современные модели, такие как Qwen 3.5, для повседневного использования.
Стоимость инференса резко снижена. Генеральный директор Doubleword объясняет, как проектирование стеков инференса для нереального времени использования может сократить затраты на токены более чем на порядок по сравнению с универсальными конфигурациями.
Умная маршрутизация моделей. Библиотека NVIDIA Switchyard направляет только 7% вызовов агентов к передовой модели, снижая затраты на 74% с минимальной потерей точности, и предлагает формулу для оценки выгоды от затрат.
Приватные AR-очки. Невидящий пользователь просит AR-очки в стиле Meta, которые запускают локальные модели, чтобы избежать отправки визуальных данных в Meta, подчеркивая спрос на конфиденциальность в вспомогательных технологиях.
Передовые исследования
ИИ берется за гипотезу Римана. Невыпущенная модель Anthropic добилась прогресса в гипотезе Римана, протестировав 650 идей с 60 субагентами за 36 часов, вновь разжигая дискуссию о роли ИИ в математических открытиях.
Видеодиагностика AMIE. Исследовательская система Google AMIE продемонстрировала клинические видеоконсультации на уровне эксперта, используя Gemini и мультиагентную установку для интерпретации визуальных, слуховых и контекстуальных сигналов.
CARE‑X: ИИ для рентгенографии грудной клетки. CARE‑X от Microsoft — это унифицированная VLM для рентгенографии грудной клетки, которая сочетает генерацию и структурированное прогнозирование, используя обучение с подкреплением для поощрения клинической правильности.
Сравнение агентной памяти. ACE и ALTK‑Evolve превращают траектории агентов в переиспользуемые уроки; ACE создает исчерпывающее руководство, а ALTK‑Evolve извлекает отдельные рекомендации.
Логпробы обнаруживают галлюцинации. Анализ распределений вероятностей токенов при первом фактическом воспоминании в цепочке рассуждений может выявить ненадежные знания, предлагая потенциальный ранний сигнал галлюцинаций.
Предупреждение о написании текстов ИИ. С. Альперт утверждает, что никакое переписывание не является без потерь, поэтому текст, созданный с помощью ИИ, должен быть лично проверен, чтобы избежать искажения замысла автора.
Бизнес и финансы
Рубеж в 1 млрд пользователей. ChatGPT и Gemini достигли 1 млрд активных пользователей в месяц, при этом Gemini стал самым быстрым продуктом Google, достигшим такого масштаба; ChatGPT ранее в этом году достиг 900 млн еженедельных пользователей.
Реклама ChatGPT становится глобальной. OpenAI расширила рекламу ChatGPT еще на пять стран, сообщив об отсутствии влияния на доверие пользователей и низких показателях отклонения, поскольку стремится к устойчивой монетизации.
Повышение цен OpenAI. Новые места ChatGPT Business Premium стоят $125 за пользователя в месяц с пятикратной емкостью и без почасовых лимитов, что отражает интенсивное использование токенов агентными нагрузками.
Лайткэп уходит. Брэд Лайткэп, бывший операционный директор OpenAI и руководитель специальных проектов, уходит после восьми лет, чтобы начать что-то новое, продолжая череду уходов руководителей.
Аренда Anthropic на $9.1 млрд. Anthropic подписала 20-летнюю сделку на $9.1 млрд по дата-центру с биткоин-майнером Riot Platforms на 191 МВт в Техасе, которая обеспечит питанием следующее поколение моделей начиная с 2027 года.
Препятствия для IPO Anthropic. В преддверии потенциального IPO на $965 млрд инвесторы ставят под сомнение рост Anthropic на фоне дешевых китайских моделей и политических препятствий, хотя компания рекламирует будущие приложения для здоровья и биологии.
Инициатива Nvidia на $500 млрд. Nvidia сотрудничает с шестью финансовыми компаниями для мобилизации $500 млрд на ИИ-инфраструктуру, гарантируя до 25% остаточной стоимости своих чипов, что противодействует опасениям об обесценивании.
Индийская ставка Accel на ИИ. Accel закрыла переподписанный фонд для Индии на $550 млн, делая ставку на то, что ИИ станет основой для стартапов в сфере потребительских услуг, финтеха и производства, а не отдельной категорией.
Выход сотрудников OpenAI в кэш. Обратный выкуп акций на $7 млрд при оценке в $852 млрд позволяет нынешним и бывшим сотрудникам OpenAI ликвидировать акции, ослабляя давление перед потенциальным IPO.
Безопасность и прозрачность
ЕС требует водяные знаки для ИИ. В соответствии с Законом ЕС об ИИ, Anthropic и OpenAI обязуются маркировать сгенерированный контент; Claude будет встраивать невидимые водяные знаки в текст и изображения, также ведется работа по поддержке старых моделей.
Происхождение фото Apple. iOS 27 может представить «Apple Reference Image» для встраивания метаданных о происхождении при съемке, позволяя пользователям доказывать, что фотографии iPhone не являются дипфейками.
Spotify помечает ИИ-артистов. Spotify будет маркировать профили артистов, созданные ИИ, и исключать их из рекомендаций, используя как самораскрытие, так и обнаружение, прежде чем внедрить изменение в середине сентября.
Спор о написании текстов ИИ. Игровая студия Saber отрицает замену сценаристов на ChatGPT для Rideshare Stimulator, но бывший ведущий сценарист утверждает, что ИИ использовался для написания текстов и озвучки, без раскрытия информации в Steam.
Эксплойт Zoom на основе ИИ. Критическая уязвимость Zoom, позволяющая захватить устройство через функцию аннотаций, была найдена с использованием менее 20 промптов к общедоступным ИИ-моделям, что демонстрирует ускоренное ИИ исследование безопасности.
Кража цепочек рассуждений. Исследователи воспроизводили зашифрованные токены цепочек рассуждений из передовых моделей в более слабых собратьях, взламывали их и восстанавливали скрытые рассуждения, раскрывая пароли и API-ключи в публичных сессиях.
Доверие к коду, сгенерированному ИИ. IBM и Red Hat расширяют Lightwell для создания проверяемых цепочек поставок программного обеспечения в эпоху ИИ, обеспечивая происхождение и соответствие политикам как для кода, созданного человеком, так и для кода, созданного ИИ.
На сегодня всё - около 5 минут чтения.