Марат пишет про науку (в основном)
Open in Telegram
Кидаю сюда ссылки на свои тексты, рассуждаю про физику, искусственный интеллект и их связь с видеоиграми и масскультурой @zumrus
Show more883
Subscribers
+224 hours
+27 days
+1030 days
Data loading in progress...
Similar Channels
Tags Cloud
Incoming and Outgoing Mentions
---
---
---
---
---
---
Attracting Subscribers
September '26
September '26
+12
in 0 channels
August '26
+14
in 0 channels
Get PRO
July '26
+7
in 0 channels
Get PRO
June '26
+9
in 0 channels
Get PRO
May '26
+7
in 1 channels
Get PRO
April '26
+18
in 0 channels
Get PRO
March '26
+20
in 1 channels
Get PRO
February '26
+17
in 0 channels
Get PRO
January '26
+20
in 0 channels
Get PRO
December '25
+29
in 5 channels
Get PRO
November '25
+9
in 1 channels
Get PRO
October '25
+35
in 3 channels
Get PRO
September '25
+42
in 3 channels
Get PRO
August '25
+14
in 2 channels
Get PRO
July '25
+22
in 0 channels
Get PRO
June '25
+15
in 0 channels
Get PRO
May '25
+30
in 0 channels
Get PRO
April '25
+139
in 1 channels
Get PRO
March '25
+9
in 0 channels
Get PRO
February '25
+19
in 1 channels
Get PRO
January '25
+31
in 1 channels
Get PRO
December '24
+21
in 0 channels
Get PRO
November '24
+19
in 1 channels
Get PRO
October '24
+23
in 1 channels
Get PRO
September '24
+16
in 3 channels
Get PRO
August '24
+14
in 1 channels
Get PRO
July '24
+12
in 0 channels
Get PRO
June '24
+15
in 1 channels
Get PRO
May '24
+143
in 2 channels
Get PRO
April '24
+16
in 0 channels
Get PRO
March '24
+7
in 0 channels
Get PRO
February '24
+9
in 0 channels
Get PRO
January '24
+18
in 0 channels
Get PRO
December '23
+22
in 0 channels
Get PRO
November '23
+40
in 3 channels
Get PRO
October '23
+311
in 0 channels
| Date | Subscriber Growth | Mentions | Channels | |
| 10 September | 0 | |||
| 09 September | +2 | |||
| 08 September | 0 | |||
| 07 September | 0 | |||
| 06 September | 0 | |||
| 05 September | 0 | |||
| 04 September | +1 | |||
| 03 September | 0 | |||
| 02 September | 0 | |||
| 01 September | +9 |
Channel Posts
Последние сутки в моей инфосфере только и разговоров о том, что новая модель от OpenAI решила одну из математических Задач тысячелетия…
Вообще-то, большими и малыми победами искусственного интеллекта в математике за последние полгода уже никого не удивишь. Но Задачи тысячелетия — это совсем другой уровень, ибо их решение неизбежно продвинет целые области. Неспроста на каждую Институтом Клэя выставлен приз — 1 миллион долларов.
На этот раз машина — а, точнее, рой из 10000 ИИ-агентов — кажется, смогли найти условия, при которых нарушается гладкость решений уравнений Навье — Стокса. Я пишу «кажется», потому что впереди долгая процедура верификации доказательства экспертным сообществом, но публика настроена весьма оптимистично. К сожалению, в этой истории не обошлось и без споров об авторстве.
Обо всём этом можно прочитать в разборе по горячим следам, который буквально только что вышел на N + 1. Подготовили его мои коллеги из AIRI, ну а я им немного помог.
| 2 | Сегодня наконец-то дошла до сайта вторая часть разбора про Deus Ex для N + 1, прошу любить и жаловать.
Текст вышел лёгкий, в нём я перечисляю различные технологии, ищу научные источники, из которых команда разработчиков черпала свои идеи, и кратко их сопоставляю. Если первая часть целиком строилась вокруг роли нейроинтерфейсов в лоре приквелов Deus Ex, а потому по тематике не покидала нейронауки, то здесь мы затронем область новых материалов, нанотехнологии и даже геоинженерию.
Конечно, ко дню рождения обеих игр успеть не получилось, пусть тогда этот пост ознаменует грядущий Всемирный день видеоигр, который празднуют 29 августа. | 365 |
| 3 | Сегодняшняя дата — 23 августа — знаковая для поклонников франшизы Deus Ex. 10 лет назад вышла последняя полноценная игра серии, Mankind Divided, а 15 лет назад — её предшественница Human Revolution. Deus Ex отличает трансмедийность: зародившаяся в ААА-видеоиграх, эта киберпанковая история со временем обросла книгами, комиксами и мобильными релизами. Не самая популярная траектория в современном попкультурном мире, с ходу на ум приходит только Mass Effect, к которой я также отношусь трепетно.
Помимо прочего, Deus Ex и Mass Effect роднит и бережное отношение к научным аспектам показываемых миров. В случае с Mass Effect в этом можно убедиться, если прочитать мои разборы тамошней физики и искусственного интеллекта. Но и другие отрасли науки и техники вроде ксенобиологии или ракетостроения в Mass Effect тоже показаны довольно хорошо.
Deus Ex я только начал разбирать. Весной вышел текст про нейроинтерфейсы, а его вторая часть уже написана и находится в редактуре (увы, к юбилею не успели), там погорим про другие технологии.
Но праздник немного грустный: история, через которую проходит герой последних игр, была оборвана на полуслове со множеством намёков, а разработка игры, которая должна была бы дать нам все ответы, была свёрнута по корпоративным причинам. Отсутствие определённости породили среди фанатов множество теорий о происходящем. Обзору одной из них посвящён текст, который я написал к десятилетию Mankind Divided. | 466 |
| 4 | Недавно в Усть-Лабинске прошла летняя школа по искусственному интеллекту AIRI, я анонсировал её некоторое время назад. Отбор там был суровый, и, возможно, прошли не все, кто хотел, в том числе и среди тех, кто читает мой канал.
Но если вам было интересно, как прошла школа, приглашаю вас прочитать свежий хабр, написанный двумя её участниками, кстати говоря, физиком и биофизиком. Из текста можно узнать, как применять методы ИИ в смежных областях, а также зарядиться мотивацией к подаче заявки в следующем году. | 445 |
| 5 | Трансформеры, лежащие в основе LLM, создают текст токен за токеном (авторегрессионно). Но это не единственный путь.
Последние год-два (совсем недавно по меркам изобретения трансформеров) начал активно изучаться подход, где генерация токенов происходит параллельно — с помощью диффузии, той самой, которая рисует нам картинки и видео. Теоретически это даёт кратное ускорение, а также позволяет заполнять пропуски в тексте.
Сейчас уже прошло достаточно времени, чтобы порассуждать о работоспособности нового метода. Это сделали исследователи из AIRI вместе с коллегами из Sber AI, написав большой разбор на основе собственного опыта взаимодействия с dLLM. Этот текст на днях вышел в нашем блоге на Хабре. | 601 |
| 6 | В ИИ-мире сейчас только и говорят, что про агентов…
Когда LLM только появились, все поняли, что с их помощью можно решать массу вопросов в режиме «вопрос — ответ». Например, можно попросить написать какой-то код, попробовать выполнить его и, если возникнут ошибки, попросить исправить. Такой подход, напомню, называется вайбкодинг, я про него подробно рассказывал в большом материале.
Но довольно быстро люди поняли, что труд обращения к LLM тоже можно автоматизировать с помощью LLM. Так мир пришёл к идее автономных агентов, которые сами ставят себе подзадачи, пока не достигнут поставленной человеком цели.
Сегодня разработчики оптимизируют не только самих агентов, а но и обвязку их разными опциями, оркестрацию, циклы работы и всё такие прочее. А можно ли автоматизировать и саму эту оптимизацию?
Мой коллега по AIRI Антон Разжигаев ответил на этот вопрос утвердительно. Знакомьтесь, Уроборос — агент, который постоянно переписывает себя в автономном цикле эволюции. В отличие от прочих подобных проектов, которые в основном обрастают инструментами, он меняет собственное ядро.
Антон запустил Уробороса в феврале и рассказывал о его успехах у себя в канале. Сейчас же он доэволюционировал то состояния, в котором он бьёт Codex и Claude Code на нескольких важных бенчмарках. Вчера мы выпустили текст в нашем блоге на Хабре, где Антон подробно рассказывает историю создания и устройство своего агента. Хорошая новость, что агент открытый, и его может использовать любой желающий (при наличии ресурсов, конечно). | 628 |
| 7 | Сейчас будет небольшой LLM-ликбез.
При рассказе про очередную ИИ-модель я периодически упоминают такое понятие как длина контекстного окна или, проще, контекст. В общем и целом, под ним понимают общий бюджет промпта, который мы подаём на вход модели. В зависимости от модели это может быть не только текст, но и изображения, документы и иные типы данных.
Перед входом контекст токенизуется — разбивается на последовательность дискретных сущностей из словаря модели. Поэтому контекст принято измерять в токенах. Но это всё же некоторое, хоть и приемлемое в большинстве случаев упрощение.
Корректнее говорить, что контекст состоит из элементов последовательности, которые состоят из столбцов специальной матрицы, кодирующей представление токенов — эмбеддингов. В большинстве текстовых языковых моделей один эмбеддинг соответствует одному токену.
Мои коллеги по AIRI в прошлом году показали, что этот принцип можно нарушить — и закодировали в один эмбеддинг-вектор аж целых 1568 токенов. Результат впечатляющий, поскольку, в теории, позволяет оптимизировать контекст, хотя главным в той работе было всё же исследовать архитектурные пределы сжатия в LLM.
А совсем недавно коллеги из другой команды AIRI доказали, что при такой плотной упаковке теряется семантическая осмысленность, и объяснили этот механизм. Обо всём этом мы с ними на днях выпустили статью для нашего блога. | 507 |
| 8 | Сегодня пост на стыке физики, дифуров и ИИ (но не про контрпример к гипотезе якобиана, нет).
Те, кто читает меня достаточно долго, знают, что мне нравятся штуки под названием физически-информированные нейросети (Physics‑Informed Neural Networks или просто PINN). Если очень упрощать, это такие нейронки, которые при обучении тяготеют не только к тренировочным данным, но и к руками заданному физическому дифференциальному уравнению. С одной стороны, это позволяет обходиться меньшими датасетами и добиваться большей точности решения уравнения, чем голый data-driven подход. С другой — PINN считает сильно быстрее, чем FEM или FDTD, что для типовых рутинных расчётов очень хорошо.
PINN — это ярчайший пример подхода, известного как Science-Informed Machine Learning (сами переведёте), когда априорные знания о вашей науки формируют саму архитектуру модели. Но буквально кодировать уравнения — не единственный подход.
Те, кто имел удовольствие учить у себя на физмат-факультетах курсы вроде «Методы математической физики», знают, что, к примеру, уравнения колебания струны не обязательно решать в лоб дискретизацией. Ответ можно искать в виде разложения в ряд Фурье, сводя задачу к алгебраической проблеме.
Описанный выше приём — простейший пример спектрального подхода к решению дифференциальных уравнений в частных производных. В его рамках мы ищем решение в виде суммы некоторых базисных функций, вообще говоря, не обязательно гармонических. В 2024 вышла статья, где этот могучий метод адаптировали под научное информирование моделей. Так увидели свет SINN — спектрально информированные нейросети.
А вчера мы с Тянчи Ю, первым автором той статьи, а также младшим научным сотрудником в AIRI, выпустили для нашего блога на Хабре текст о том, как они с соавторами усовершенствовали SINN. | 477 |
| 9 | Две недели назад у меня вышел текст про нейродвижки, то есть модели, которые отрисовывают геймплей игры без обращения к её ресурсам, а лишь на базе обучения на многих часах видео. На момент написания материала существовала уже целая куча примеров таких моделей, что всех и не перечислить. А вот нейроигр с мультиплеером я тогда насчитал всего две.
Теперь же их число пополнила нейроверсия Rocket League, аркадной гоночной игра в жанре футбола, довольно популярная в своём сегменте. Работает на диффузионном трансформере, принимает на вход только управление и несколько кадров, правда, контекст модели всего 4 секунды — больше деталей в блоге исследователей. Примечательно, что к команде разработчиков присоединились сотрудники компании Epic Games, которая издаёт игру. Это говорит о том, что крупные игроки геймдева всё же держат руку на пульсе в истории с нейродвижками.
Ну и конечно, есть демка — играем с рандомами. Если есть желание попробовать, советую не тянуть. По опыту, приобретённому в ходе написания материала, могу сказать, что публично доступные демки долго "не живут". | 452 |
| 10 | Сегодня посчастливилось принять участие в научном семинаре «Нанооптика, фотоника и когерентная спектроскопия – 2026», который прошёл в Казанском физтехе. Семинар, фактически, является конференцией, с тезисами и индексируемым сборником. Доклад был устный, и на нём я изложил последние наработки нашей маленькой команды (теоретические) по поводу поиска следов электромагнитной массы электрона в фотонных кристаллах.
Подробнее о самой работе расскажу как-нибудь позднее, когда выйдет статья. Для меня сегодняшнее мероприятие важно тем, что это, оказывается, мой первый конференционный орал за довольно долгое время.
Я, вообще, со студенческих лет предпочитал устные доклады постерным, и делал их много и часто на самых разных конфах. Но с определённого момента я начал доверять доклады магистрантам и аспирантам нашей группы, а затем жизнь сделала поворот, и наука вовсе отошла на второй план. Так что нынешнее выступление можно назвать в некотором роде камбэком 💪 | 505 |
| 11 | С момента, когда в 2024 году исследователи показали нейросеть, отрисовывающую DOOM без единого обращения к файлам с ресурсами игры, мне стало интересно, как будет развиваться эта технология. С тех пор я периодически рассказывал в канале о новостях из этой области, но долго не решался садиться за полноценный разбор, потому что тема действительно непростая.
И всё же это случилось, и текст вышел сегодня на N + 1. Из него вы узнаете, как устроены такие модели, какие игры успели воспроизвести на нейросетях и даже найдёте ссылки, чтобы поиграть самим (в том числе мультиплеер для игры с друзьями). | 533 |
| 12 | Недавно мы вместе с ведущим научным сотрудником AIRI Константином Ушениным выпустили на Хабре статью про победу его команды на хакатоне по созданию ИИ‑ассистента для планирования синтеза в лаборатории органической химии. В тексте много технических деталей, касающихся разработки, управления проектами и создания ИИ-систем, но цепляет он не этим.
Хакатон, если кто не знает, — это соревнование, в ходе которого командам нужно создать продукт (ну, или хотя бы прототип) в условиях жесточайшего дедлайна. При таких обстоятельствах недостаточно одних хард-скиллов, нужны ещё пресловутые «софты» и умение правильно взаимодействовать с сокомандниками.
История Константина очень похожа на фильмы про ограбления: сбор команды, трезвая оценка возможностей, планирование «на берегу». И, как это обычно бывает в таких сюжетах, по началу план работает хорошо, но ближе к кульминации начинаются проблемы — конфликты коммитов, перегрузки сервера и даже хакерская атака на проект за 15 минут до его защиты. Но в конечном итоге наши герои вышли победителями.
В общем, текст вышел очень остросюжетным и поучительным. Рекомендую к прочтению даже людям, далёким от разработки. | 518 |
| 13 | Бояться восстания машин от роботов в том виде, в котором они сегодня существуют, не стоит. Проблема не в том, что роботы не умеют стрелять или самостоятельно подзаряжать свои батареи. Проблема в их забывчивости.
Раскрою мысль. Сегодня на роль «мозгов» для разных робототехнических устройств стало модным брать так называемые VLA-модели (Vision‑Language‑Action), которые представляют собой архитектуру трансформер — да, ту самую, что в LLM. Это здорово работает, когда вся нужная информация для робота доступна прямо сейчас: объект виден, инструкция дана, и тот должен немедленно совершить действие.
Но в тот момент, когда нужная информация роботу больше не доступна (нужный предмет лежит в ящике, который сейчас закрыт, или цель объявили ранее), приходится полагаться память робота, которая в трансформерах живёт в контекстном окне: всё, что робот видел, слышал и чувствовал, должно быть упаковано туда. Трудность в том, что механизм внимания имеет квадратичную сложность по длине последовательности, а значит долгосрочная память для робота будет обходиться слишком дорого, если пытаться наивно увеличивать размер контекста.
Решить эту проблему могли бы новые архитектурные решения. Одно из них придумали и опубликовали мои коллеги из команды «Воплощенные агенты» AIRI. Подробнее о нём рассказывает свежая статья в институтском блоге на Хабре. | 388 |
| 14 | В фантастике нам часто показывают искусственный интеллект, сравнимый с человеческим, который расположен внутри робота или синтетического тела. Сам вопрос о создании такого типа интеллекта, похоже, разрешится в ближайшие годы. Но даже если он и будет возможен, то на текущем технологическом этапе размер датацентров для его обслуживания будет сопоставим с целым городом — в робота такое точно не засунуть.
Причина в том, что нужный эффект достигается главным образом за счёт масштабирования размеров моделей и количества данных. Но ведь веса — это, по сути, упакованная информация, если угодно, эрудированность и энциклопедичность. Интеллект же чаще проявляется в способности рассуждать и анализировать. А что, если попытаться сохранить умственные навыки модели без балласта в виде ненужных знаний? В конце концов, необходимую информацию можно подавать ситуативно в контекст.
Рассуждая таким образом, мои коллеги из AIRI создали семейство компактных языковых моделей под названием Optimal Cognitive Core (OCC) — SLM в противовес LLM. Пока они решали только задачу контекстных ответов на вопросы. При размере 0.6 и 1.7 млрд параметров, соответственно, OCC-модели отвечают на равных или лучше моделей общего назначения, которые в 2–6 раз больше, а по верности контексту показывают лучший результат среди моделей до 32 млрд. Сегодня про эту разработку вышла статья у нас на Хабре.
Конечно, это пока не общий интеллект, скорее proof-of-concept того, что компактная модель может работать так же, а то и лучше своих эрудированных собратьев. В перспективе этот подход сможет существенно снизить требования по железу к сильному ИИ, включая пресловутую проблему с энергией. | 427 |
| 15 | Любите роботов? Тогда вам должны понравиться робопарады, которые ежегодно проходят в рамках конференций серии International Conference on Robotics and Automation (ICRA). Последний такой парад прошёл совсем недавно в Вене в рамках ICRA 2026, и его снял для нас директор лаборатории когнитивных систем искусственного интеллекта AIRI Александр Панов.
Андроиды и робособаки всех форм и расцветок, роверы и шагающие аниматроники — не знаю, как вам, а мне это напоминает сцены из какого-нибудь эпизода Звёздных войн! 🤖
Кстати говоря, на Хабре сегодня вышел репортаж Александра о его поездке на ICRA 2026. Если вас интересует роботехника и автоматизация с профессиональной точки зрения, то там вы можете узнать выжимку из главных статей и докладов, а также увидеть больше фото с конференции. | 404 |
| 16 | В студенческие годы я много и с упоением играл в первый StarCraft, также пытался осваивать пресловутый «скилл». Это классическая стратегия в реальном времени с добычей ресурсов, строительством и микроконтролем каждого военного юнита. С точки зрения теории управления — это абсолютно неправильно, ибо неэффективно. Но именно этот аспект вывел StarCraft и его вторую часть в пантеон киберспорта, поскольку идея повесить всё на игрока открывает широченный простор для развития мастерства.
В моменты неудач мне очень хотелось, чтобы все хитрые тактические манёвры вроде мутастека, ривердропа и прочие хит-н-раны, твои юниты выполняли сами. Однако при всём желании разработчики не смогли бы научить компьютерных болванчиков чему-либо сложнее движения с атакой или патрулирования, потому что написать алгоритм для хитрого тактического манёвра, который учтёт контекст ситуации и при этом влезет в оперативную память компьютеров начала 00-х, было технически невозможно.
Сегодня машинное обучение полностью меняет правила игры. Активно развиваются алгоритмы многоагентного планирования пути и действий — и их отрабатывают, представьте себе, в StarCraft! Ну, точнее, в специальной среде SMACv2 на базе второй части игры, где исследователи сами задают сценарии битвы (на видео к посту TvT-скирмиш в этой среде), но тем не менее. Разумеется, не старкрафтом единым, есть ещё куча сред, например, футбольный симулятор GRF.
К сожалению, многоагентная модель, обученная на одной среде, будет слаба, а то и вовсе бесполезна в другой. Мои коллеги из AIRI сделали большой шаг в создании универсальных моделей, используя архитектуру трансформер. Получившаяся модель под названием MARL‑GPT обучалась с подкреплением на датасетах из трёх разных сред: SMACv2, GRF и среде с лабиринтами POGEMA, и показала достойные результаты.
Подробности работы рассказала сегодня у нас в блоге на Хабре один из членов команды Мария Нестерова. | 494 |
| 17 | Наверняка многие из тех, кто меня читает, хотя бы раз, да использовали распознавание речи в текст. Сегодня такие системы работают довольно хорошо для обычной речи: они научились правильно расставлять знаки препинания и даже могут учитывать контекст.
Но даже технооптимист с сомнением воспримет идею о том, что машина способна справиться с потоком математической речи (озвученных формул и математических выражений), надёжно перепаковав её в LaTeX-код — так называемая Speech-to-LaTeX задача. А ведь такая штука могла бы пригодиться, когда нужно расшифровывать аудиозапись семинара, готовить конспекты и презентации, да и просто лень ручками набирать формулу для статьи.
Лучшее, что можно ожидать от существующих разпознавалок, это строки типа «сумма по i от единицы до n», иногда они узнают отдельные математические символы типа π или знака умножения. Ситуация усложняется ещё и тем, что структура формул может обладать вложенностями (скобки, дроби и т.д.). Наконец, математическая речь неоднозначна — мы не всегда проговариваем скобки, и машина из контекста должна понять, когда их нужно ставить, а когда нет.
Как оказалось, мои коллеги из AIRI работают над проблемой Speech-to-LaTeX. Недавно они собрали большой открытый двуязычный датасет и сравнили несколько подходов к её решению. О том, как они его собирали, и насколько далеко ещё до надёжных математических распознавателей, рассказал на днях один из членов команды Дмитрий Корж в нашем блоге на Хабре. | 465 |
| 18 | Наука об ИИ существенно более конференционная, чем другие науки — об этом я регулярно пишу. Весь год ML-ресёрчера размечен датами подачи сабмитов, ответов рецензентам и, собственно, проведения. Всем хочется участвовать в самых топовых мероприятиях, и конкуренция там обычно велика.
Конференции серии ICLR традиционно относят к топ-3 по машинному обучению. Помимо того, что туда идёт серьёзный отбор, в этом году само мероприятие проходило довольно далеко от нас — в Рио-де-Жанейро.
Тем из исследователей, кто хотел бы поучаствовать в ICLR 2026, но по каким-то причинам не смог, может быть полезным репортаж из Рио, который мы выпустили на днях в нашем блоге на Хабре. Конференция охватывает самый широкий спектр тем, поэтому мы попросили коллег из разных команд AIRI подсветить ключевые тренды в их направлениях, которые были представлены на ICLR 2026.
Из интересного: на видео бегает забавный робот-футболист, который привезла на конференцию Booster Robotics. «Мозг» такого робота сначала подвергается обучению с подкреплением в виртуальной среде, после чего его выпускают в реальный мир — сегодня это стандартная практика в робототехнике.
Больше подробностей — в нашем репортаже! | 438 |
| 19 | Геологи есть? Про вас новость🌎
Сколько сравнительно известных фильмов, в которых появляются геологи, вы можете назвать? Видимо потому что я физик, я сходу не назвал ни один. Те, кто занимается геологией, наверняка в первую же минуту назовут с дюжину.
Исследователи с факультета прикладной геофизики Гётеборгского университета насчитали 141 американскую и британскую картину, которые когда-либо выходили на большом экране. Зачем? Чтобы выяснить, как геологов изображают в кино!
На основе выборки из 202 персонажей-геологов авторы собрали много забавной статистики и опубликовали её в журнале Geology Today. Оказалось, что 85% учёных, исследующих Землю, положительные персонажи, носящие клетчатые рубашки. Занятно, что это отличается от того, как в фильмах показаны другие естественники: физики и химики чаще оказываются безумными маньяками, стремящимися к власти или богатству.
Впрочем, у доброты есть и обратная сторона — каждый третий геолог в кино умирает. Наиболее распространенной причиной смерти является убийство (например, в фильмах про Джеймса Бонда), за ним следуют смерти, вызванные геологическими явлениями или инопланетянами (например, в «Прометее»).
Больше статистики есть в самой статье. Если же вам интересно, в каких же фильмах есть геологи, авторы собрали всю информацию в одну табличку, где указаны даже их алайнмент и причины смерти.
P.S. На гифке, если не узнали, изображён химик и геолог Уолтер Рокхаунд, сыгранный Стивом Бушеми в фильме «Армагеддон». | 487 |
| 20 | Физика и машинное обучение сплетаются всё теснее с каждым годом. Нейросети ускоряют сложные симуляции и удешевляют моделирование, как в форме архитектур вроде PINN, так и в составе гибридных моделей.
В другую сторону процесс также идёт — машиннообучаемые модели, вдохновлённые какими-либо физическими законами известны ещё с 80-х годов. Наиболее известным примером можно назвать диффузию, которая прочно заняла место во множестве архитектур современного генеративного ИИ.
В них решается задача перевести одно вероятностное распределение в другое — например, шум или стартовую картинку в целевое изображение. Диффузионные модели «подсматривают» этот путь у законов термодинамики. Важно, что при этом сохраняется интерпретируемость — довольно редкое и ценное качество для машинного обучения.
Мои коллеги из AIRI недавно предложили ещё одну такую «физичную» модель. Авторы также решали задачу генерации или модификации, но теперь дорогу данным «показывают» силовые линии некоторого распределения зарядов в обкладках конденсатора (многомерного, впрочем). После выучивания электрического поля в такой схеме для генерации достаточно стартовать с правильной точки на обкладке конденсатора, силовые линии сделают своё дело.
О том, как устроена новая архитектура, коллеги рассказывают в свежей статье на Хабре, которую мы сегодня выпустили. | 431 |
