en
Feedback
Ivan Oseledets’ Channel

Ivan Oseledets’ Channel

Open in Telegram

Личный канал доктора физико-математических наук, профессора РАН, CEO Института AIRI, профессора Сколтеха Ивана Оселедца. Для связи: brand@airi.net

Show more
992
Subscribers
+224 hours
+117 days
+6230 days
Posts Archive
На прошлой неделе я писал про два научных семинара Математического института им. В.А. Стеклова Российской академии наук, а се
+3
На прошлой неделе я писал про два научных семинара Математического института им. В.А. Стеклова Российской академии наук, а сегодня хочу поделиться впечатлениями от прослушенных докладов:

Сегодня рассказываю про крутую инициативу Математического института им. В.А. Стеклова Российской академии наук. Вместе с коллегами (в новом отделе математических основ ИИ собраны ведущие ученые страны) мы запустили «Общеинститутский семинар по математике и её приложениям», тема мне очень близка. В ближайшее время уже запланировано 2 заседания – можно подключиться онлайн или прийти очно. Первое заседание состоится сегодня в 17:00 в конференц-зале МИАН, также планируется трансляция на YouTube и в Zoom (идентификатор конференции: 975 9984 9413, код доступа: 585526). Александр Гасников (Университет Иннополис, МФТИ, ИСП РАН, МИАН) представит доклад на тему: «Федеративное обучение. Фундаментальные аспекты. Открытые задачи». Аннотация, подробности и регистрация на семинар по ссылке: https://www.mathnet.ru/conf2402 Второй семинар пройдет 15 февраля в 16:00. Доктор физ.-матем. наук В. Н. Темляков представит доклад «Некоторые математические задачи, связанные с разработкой искусственного интеллекта». Этот доклад мне особенно интересен, так как Владимир Темляков — всемирно известный ученый и победитель мегагранта. Известен работами по так называемым «жадным» алгоритмам. Все подробности про семинар: https://www.mathnet.ru/php/seminars.phtml?option_lang=rus&presentid=41627

#забавно В известную коллекцию ложных корреляций https://tylervigen.com/spurious-correlations не так давно добавили объяснени
#забавно В известную коллекцию ложных корреляций https://tylervigen.com/spurious-correlations не так давно добавили объяснение этих корреляций с помощью ИИ, а также "научные" статьи, сгенерированные ИИ, которые их объясняют.

Сегодня в рамках флешмоба #AIRI_вдохновляет хочу рассказать про свою первую научную публикацию: Свою первую статью я сделал в 2003 году на 3 курсе МФТИ, когда пришел на базовую кафедру ИВМ РАН под руководство Е.Е. Тыртышникова. Он посмотрел на меня и выдал задачу про построение вейвлетов (всплесков). Евгений Евгеньевич использовал довольно распространенный метод работы со студентами: посмотреть на человека, вспомнить какую-нибудь актуальную и интересную проблему, выдать краткое описание и отправить разбираться дальше самостоятельно. Первая задача играет очень важную роль — она призвана заинтересовать и проверить, насколько человек способен к научной деятельности. Эта способность слабо связана с "техническими скиллами" и техническими собеседованиями, так популярными в ИТ-компаниях — это как спринт и марафон. При этом стоит принять во внимание один лайфхак: не давайте студентам важные задачи — давайте интересные. Такие, которыми некогда заниматься самому, но на которые у студента достаточно времени, чтобы он/она мог подумать и в нее погрузиться. Ну так вот — моя задача была про построение вейвлет-преобразований на неравномерных сетках. Детали уже забылись: у меня была отдельная тетрадка, в которой я писал формулы. Где-то через месяц формулы были получены, причем вместо численных расчётов удалось получить довольно хитрые аналитические решения. Потом это все пришлось запрограммировать (тогда ещё на Fortrane) и получить цифры сжатия, которые были достаточно существенные. Статью написал, подали в журнал "Математические Заметки", но там она сгинула на 2 года. Вышла только в 2005 году (ее куда-то потеряли, и пришлось лично ходить в редакцию, чтобы ее там нашли!). Поэтому фактически первая статья стала только второй. А формально первой статьей стало её продолжение, сделанное совместно с учеными из Манчестера. В ней новые вейвлет-преобразования были применены уже к малоранговому сжатию больших матриц, и получилось прямо хорошо. Да, иногда бывает так, что применение метода выходит позже, чем сам метод. Обе статьи были опубликованы в хороших, но отечественных журналах (хоть и переводных). Я очень много читал статей, и мне очень сильно хотелось публиковаться на английском, в международных журналах. Такая "первая статья" появилась через год (работать над ней начали в 2004 году), вместе с Вадимом Ольшевским. Он получил грант на исследования теплицевых матриц, и мы вместе с Т.Е.Е. придумали новый алгоритм и теорию. Получилось довольно круто, сжатие и ускорение (мои две любимые темы) получились серьезные. Заметьте, никаких суперкомпьютеров, только ноутбук 2005 года. После выхода статьи произошло интересное событие: из Америки пришел чек на 1000$, выписанный на мое имя с американского гранта. Пришлось побегать по Москве, чтобы его обналичить, но это было супер-приятное ощущение: при стипендии 1500 рублей (повышенной) — это были для меня огромные деньги!

Кстати, это я в в 2006 году на конференции рассказываю про свои научные работы)
Кстати, это я в в 2006 году на конференции рассказываю про свои научные работы)

Коллеги, поздравляю всех причастных с Днем российской науки! Наука — это умение не только задавать вопросы, но и находить ответы на них. Это постоянный поиск и стремление к новым горизонтам. Желаю всем исследователям продолжать идти за своими идеями и развивать науку в России и мире!

Добавлю немного научного вдохновения вам на выходные) Делюсь отчетом нашего Института AIRI за 2023 год. За прошедший год в на
Добавлю немного научного вдохновения вам на выходные) Делюсь отчетом нашего Института AIRI за 2023 год. За прошедший год в нашем портфолио сформировался целый ряд крупных научных результатов по фундаментальным и прикладным аспектам AI. От себя еще хочу добавить, что в этом году мы продолжаем активно развивать партнерства и стремиться к лидерству по числу публикаций на конференциях A/A*.

Сегодня делюсь хорошей лекцией профессора Чарбель Фархат, которую послушал вживую в Саудовской Аравии на конференции DD28, которую проводит KAUST. С точки зрения public talks выступление — просто огонь, можно сразу понять сложность области. Тематика domain decomposition очень техническая, но профессор Фархат подробно рассказывает про то, как переходить от методов к продуктивизации. → https://www.youtube.com/live/nmH35q_K_gw?si=Amqo0BfuxBgbh48W

Делюсь нашей совместной работой с кандидатом физико-математических наук, старшим преподавателем Сколтеха Александром Михалевы
Делюсь нашей совместной работой с кандидатом физико-математических наук, старшим преподавателем Сколтеха Александром Михалевым. NNTile — фреймворк для обучения больших нейросетевых моделей, который позволяет на одном и том же оборудовании обучать модели в 4 раза больше, чем PyTorch. Наша глобальная цель в данном исследовании — это понижение простоя вычислительных устройств и, как следствие, повышение производительности обучения больших нейронных сетей на кластерах и суперкомпьютерах за счет перехода от массивно-синхронной парадигмы параллельного программирования к задаче-ориентированной. В текущем виде наш фреймворк позволяет обучать модели типа DeepReLU, MLP Mixer и GPT. В ближайшее время планируем оптимизировать код и ускорять как базовые операции. GitHub

Сегодня хочу поделиться грустной новостью. Ушел из жизни один из ведущих математиков в области линейной алгебры — Ник Хайам. Мы с ним были знакомы лично, он вручал мне премию SIAM Outstanding paper prize в 2018 году за статью "Time Integration of Tensor Trains". Ник Хайам был не только великолепным ученым, писателем, но и преподавателем, вдохновлявшим своих студентов на поиск знаний и понимание глубин математики. Его научные достижения и интеллектуальное наследие будут жить в работах исследователей по всему миру. В последнее время Ник Хайам активно интересовался машинным обучением и алгоритмами в пониженной точности — там целая новая линейная алгебра возникает. Рекомендую всем математикам прочитать книгу его авторства "Functions of Matrices".

Кстати, в блоге на сайте AIRI опубликовали статьи про наши работы, принятые на NeurIPS 2023. Постарались простыми словами рассказать про наши исследования. Делюсь ссылками на научные статьи, а также публикации в блоге: — Neural Harmonics: Bridging Spectral Embedding and Matrix Completion in Self-Supervised Learning Решая эту проблему теоретической обоснованности методов самообучения, мы поняли, что их работу можно свести к хорошо известной в математике задаче о восполнении низкоранговой матрицы. Статья в блоге по ссылке. — PROTES: Probabilistic Optimization with Tensor Sampling Эта статья посвящена поиску оптимума некоторой функции без использования градиентного спуска. Мы воспользовались тем фактом, что задачу можно свести к поиску минимального или максимального элемента в неявно заданном тензоре, где полезным оказывается разложение в тензорный поезд. Прочитать о работе нового алгоритма можно тут. Если будут вопросы, можете писать в комментарии, постараюсь ответить)

Всех с наступившим! В этом году планирую продолжать делиться интересными новостями о науке и жизни в канале) Сегодня хочу рассказать про недавнее интервью, которое вышло на Коммерсантъ. В нем я рассказал о том, зачем и как изучать искусственный интеллект, а также поделился мнением про потенциал ИИ в естественных и точных науках. Читайте по ссылке.

Сегодня подписали соглашение со СберМедИИ — компанией, которая в экосистеме Сбера отвечает за разработку медицинских решений
Сегодня подписали соглашение со СберМедИИ — компанией, которая в экосистеме Сбера отвечает за разработку медицинских решений с использованием искусственного интеллекта. Мы хотим привнести мультимодальность в медицинские AI-продукты, то есть сделать так, чтобы с ними можно было взаимодействовать сразу несколькими способами: текстом, голосом, изображениями. В реализации этой амбициозной цели нам помогут результаты проекта FusionBrain, который развивает технологии Kandinsky и OmniFusion совместно с другими командами исследователей из компаний-партнеров. На фото мы с генеральным директором СберМедИИ Владимиром Кохом подписываем соглашение.

На этой неделе вручили премию Сбера моему научному руководителю Евгению Евгеньевичу Тыртышникову, которого я все равно всегда
На этой неделе вручили премию Сбера моему научному руководителю Евгению Евгеньевичу Тыртышникову, которого я все равно всегда называю «Шеф». Хочу поздравить Шефа с заслуженной наградой и рассказать немного интересного про общий путь в науке. Как все начиналось? В Институт вычислительной математики им Г.И. Марчука Российской академии наук я пришел больше 20 лет назад студентом 3 курса МФТИ. Чем именно заниматься было особо непонятно, поэтому я выбирал наугад — и угадал. Главное в научном руководителе — дать задачу и позволить студенту ее решить. Евгений Евгеньевич угадал с задачей, и уже через год появилась первая статья, а я стал полноправным членом научной группы. Обсуждения тех лет сложно забыть, как-нибудь я обязательно про это расскажу. Матрицами Евгений Евгеньевич занимался до меня и получил выдающиеся результаты, известные во всем мире. Тензоры — это наше совместное творчество. Сами тензорные поезда появились в 2009 году, тоже в результате совместной работы. Как появилось название «Тензорный поезд»? Хочу поделиться забавной историей самого названия Tensor Train. Исходно аббревиатура TT означала Tree Tucker, но когда я принёс формулы, Евгений Евгеньевич сказал: «Я придумал супер название: tensor train, тензорный поезд». Так и закрепилось на долгое время) Поздравляю Евгения Евгеньевича и желаю еще больше научных достижений!

Прошлую неделю я провёл в Гонконге на международном воркшопе International Workshop on Multiscale Model Reduction and Scienti
+4
Прошлую неделю я провёл в Гонконге на международном воркшопе International Workshop on Multiscale Model Reduction and Scientific Machine Learning в качестве приглашённого докладчика. Мероприятие организовал Китайский университет Гонконга — 47-й ВУЗ в мире и 10-й в Азии, если верить Рейтингу университетов QS. Окрестности, в которых расположены университет и близлежащие гостиницы, очень живописны — надеюсь, фотографии это передают. Погода также порадовала, позволив искупнуться в море. Мой доклад был посвящен аппроксимации функций многих переменных. Он вызвал живой интерес участников конференции, в том числе и тех, кто приехал из Германии, США, Китая, что должно положить начало новым коллаборациям. Это особенно ценно.

На этой неделе выступил с докладом для работников Счетной палаты. Рассказывал про искусственный интеллект для финансового ауд
На этой неделе выступил с докладом для работников Счетной палаты. Рассказывал про искусственный интеллект для финансового аудита. В аудите надо работать с большим количеством неструктурированных данных, и тут современные модели точно могут помочь, но могут быть сложности в их применении. Надо отметить, что наша Счетная палата — одна из первых в мире, которая успешно применила NLP для задач аудита. Подробнее, к сожалению, не смогу рассказать) Надеюсь, что однажды коллеги поделятся этим кейсом. В этот раз получил много положительных отзывов про свой доклад) Кстати, на следующей неделе я буду в Гонконге, так что буду рассказывать про поездку тут)

Хочу еще раз поздравить победителей премии, которых награждали вчера на AI Journey: – Валентин Хрульков, кстати, был моим асп
Хочу еще раз поздравить победителей премии, которых награждали вчера на AI Journey: – Валентин Хрульков, кстати, был моим аспирантом и защитился в 2020 году. – Александр Коротин, руководитель исследовательской группы в Сколтехе и научный сотрудник в AIRI. – Третий лауреат премии – Александр Безносиков. Успехов ребятам!

Кстати, а вот и фотка с одним из победителей 🔥
Кстати, а вот и фотка с одним из победителей 🔥

Уже два дня нахожусь на AI Journey 2023, слушал доклады коллег, а также поздравил молодых ученых с наградами)) Вчера на конференции был научный день, на котором я представил доклад «Повышение эффективности и качества обучения больших нейросетевых моделей»: – рассказал про новую мультимодальную мультизадачную модель OmniFusion. Сейчас архитектура стабильно работает на английском языке и обучается грамотному владению русским, чтобы стать доступной пользователям, а наша команда готовит научную публикацию о процессе создания OmniFusion. Планируем продолжать активно развивать модель с исследователям из SberAI и SberDevices и добавлять в неё новые модальности, результатами обязательно поделюсь; – также поделился разработкой нового фреймворка NNTile для параллельного обучения и инференса больших нейросетевых моделей. Запись доклада уже выложена на сайте конференции, а презентацию можно посмотреть по ссылке.

В этом году 19 спикеров AIRI выступят на международной конференции AI Journey! 👀 Делимся темами докладов первого дня конфере
В этом году 19 спикеров AIRI выступят на международной конференции AI Journey! 👀 Делимся темами докладов первого дня конференции AIJ Science: 🔻Главный зал 13:45 – 16:00 → Иван Оселедец «Повышение эффективности и качества обучения больших нейросетевых моделей» → Евгений Бурнаев «От стохастических дифференциальных уравнений до задачи Монжа-Канторовича и обратно: путь к искусственному интеллекту?» → Ольга Кардымон «ИИ для дизайна и генерации белковых молекул» 17:15 – 18:30 → Андрей Кузнецов "OmniFusion" 🔻Научный зал 1 11:15 – 13:30 → Елизавета Гончарова «Языковые модели. Что можно выучить генерируя текст?» 13:45 – 15:15 → Денис Димитров «MERA: Инструктивный бенчмарк для русского языка для больших языковых моделей» → Михаил Сальников «Вопросно-ответные системы с использованием графов знаний и больших языковых моделей» 15:15 – 16:00 → Денис Димитров «Kandinsky: эффективный подход, основанный на диффузии, для высокоточного синтеза изображений и видео» 16:15 – 18:30 → Евгений Фролов «Следующий шаг: рекомендации по использованию гиперболической геометрии» 🔻Научный зал 2 13:45 – 16:00 → Артем Важенцев «Гибридная оценка неопределенности для задачи выборочной классификации неоднозначных текстов» → Олег Сериков «Обработка естественного языка» 🔻Научный зал 3 13:45 – 16:00 → Айбек Аланов «Редактирование изображений с помощью диффузионных моделей» → Виталий Поздняков «Генерация стрессовых данных для проверки устойчивости моделей» Подробное расписание и онлайн-трансляция на сайте AI Journey 📍