#дайджест
Дайджест AI/ML за неделю 7–13 сентября 2026
OpenAI: уравнения Навье-Стокса
Драма недели. Внутренняя модель сильно сильнее Astra в виде роя из ~10к агентов за 88 часов доказала, что 3D Навье-Стокс с гладкой внешней силой взрывается за конечное время. Вариант без внешней силы, за который дают миллион, все еще открыт, так что на приз OpenAI не претендует.
Теперь к скандалу. Тристан Бакмастер (NYU) и Левент Альпеге (Anthropic) год копали ровно этот подход с Claude и Codex и за две недели до запуска роя получили важный промежуточный результат. OpenAI признает, что не может исключить попадание переписок математиков в обучение.
Deep Blue против Каспарова, только если бы Каспаров делал свои ходы с подсказками Deep Blue, а Deep Blue подсматривала стратегию Каспарова из своих подсказок.
Блогпост,
заявление Бакмастера
DeepSeek: V4.1-Flash
552B MoE, активных 8B на prefill и 16B на decode, новая Causal Encoder-Decoder архитектура, нативное зрение, контекст 1М. На DeepSWE 74.2 против 74.0 у Opus 5 и 73.0 у Sol, зато на Terminal-Bench 4.0 всего 31.2 против 51.8 у Opus. KV-кэш ужали в 4 раза.
Цена $0.30/$1.20, в непиковые часы вдвое дешевле, кэш в непик $0.003 за миллион. С 14 сентября все запросы к V4-Pro роутятся во Flash по цене Flash, пока не выйдет V4.1-Pro.
Блогпост,
HF
OpenAI: ChatGPT Images 2.5
До 50% быстрее 2.0, более тонкое редактирование, например может в стоп-моушен анимацию без дерганой картинки, чего не могла ни одна text to image модель. Еще можно накалякать скетч прямо в чате и использовать как референс, плюс шаблоны и комментарии на самой картинке для точечных правок. В API две модели: gpt-image-2.5-flare (быстрая, дефолт) и gpt-image-2.5-sunburst (побольше). Цена за токен как у gpt-image-2. Раскатано всем, включая Free.
Блогпост
Suno: v6, v6-wild и v6-mini
Вышла новая серия в виде трех моделей: v6 точная и предсказуемая, v6-wild та же, но при температуре 39' для экспериментов, v6-mini быстрая и для бесплатных. Все умеют править отдельные секции трека текстом, мэшапы, семплы и генерацию по картинке, видео или аудио. Старые модели уберут. Бенчмарков нет, но их услужливо посчитали конкуренты, см. ниже.
Блогпост
m-a-p: YuE2
Открытая 3.6B модель для генерации песен. Из лирики и стиля сначала пишет партитуру в ABC-нотации, которую можно править руками или агентом, потом рендерит стерео 48 кГц. Умеет zero-shot каверы. На их WildSongBench набирает 6.96 против 6.87 у Suno v5 и 6.56 у свежей Suno v6. То есть по чужому бенчмарку v6 хуже v5, но это чужой бенчмарк.
Код Apache 2.0, веса CC BY-NC(!), нужно 24 GB VRAM.
GitHub,
HF,
демо
Tencent: AuK
Nano Banana для аудио, как они сами говорят. Открытая 1.5B модель: zero-shot TTS, замена слов в готовой речи, смена эмоции и тембра, шепот, удаление акцента, денойз и разделение речи/музыки, все текстовыми инструкциями плюс референс. 1.95М часов супервизии. AuK-Flash дистиллирована до 4 шагов и в 4.5 раза быстрее. MIT, есть ComfyUI-ноды и демо. Теперь легендарные RYTP с прямой линии можно превратить в недерганную речь.
GitHub,
HF,
Статья
BFL: FLUX Video Edit
Редактирование готового видео промптом: добавить или убрать объекты, поменять текст в кадре, перекрасить, перевести реплики с липсинком. Длительность, пропорции и звук исходника сохраняются, вход даунскейлится до 720p, до 15 секунд, цена $0.03 за секунду.
Документация
Blackmagic: DaVinci Resolve 21.1
В Resolve Studio встроили MCP-сервер: CC и Codex могут работать с проектами. Заодно Python-скриптинг вынесли из бесплатной версии, так что автоматизация теперь стоит $295
Обзор
Google+NASA: MAPL-EMIT
Модель которая из данных со спектрометра на МКС (EMIT) резмечает области выделения метана, чтобы потом глобально не теплеть
База данных,
визуализация,
Kaggle,
GitHub
Lightx2v: MiniMax H3 Turbo Ref2VA - дистилляция reference-to-video ветки открытого MiniMax H3 до 8 шагов и 768p
Новость
Krea: Agents - агент, который по брифу сам выбирает из 60+ моделей, генерирует и правит картинки, видео и звук. Доступен в бесплатном тарифе.
Agent