en
Feedback
DLStories

DLStories

Open in Telegram

Что-то про AI Research и AI образование от Танечки Сотрудничество/предложения: @atmyre

Show more

📈 Analytical overview of Telegram channel DLStories

Channel DLStories (@dl_stories) in the Russian language segment is an active participant. Currently, the community unites 15 521 subscribers, ranking 8 109 in the Technologies & Applications category and 42 272 in the Russia region.

📊 Audience metrics and dynamics

Since its creation on невідомо, the project has demonstrated rapid growth, gathering an audience of 15 521 subscribers.

According to the latest data from 08 September, 2026, the channel demonstrates stable activity. Although there has been a change in the number of participants by 34 over the last 30 days and by -1 over the last 24 hours, overall reach remains high.

  • Verification status: Not verified
  • Engagement rate (ER): The average audience engagement rate is 48.44%. Within the first 24 hours after publication, content typically collects 13.47% reactions from the total number of subscribers.
  • Post reach: On average, each post receives 0 views. Within the first day, a publication typically gains 2 091 views.
  • Reactions and interaction: The audience actively supports content: the average number of reactions per post is 0.
  • Thematic interests: Content is focused on key topics such as llm, ioai, phd, dls, ревью.

📝 Description and content policy

The author describes the resource as a platform for expressing subjective opinions:
Что-то про AI Research и AI образование от Танечки Сотрудничество/предложения: @atmyre

Thanks to the high frequency of updates (latest data received on 09 September, 2026), the channel maintains relevance and a high level of publication reach. Analytics show that the audience actively interacts with content, making it an important point of influence in the Technologies & Applications category.

15 521
Subscribers
-124 hours
+47 days
+3430 days
Attracting Subscribers
September '26
September '26
+28
in 0 channels
August '26
+155
in 3 channels
Get PRO
July '26
+91
in 1 channels
Get PRO
June '26
+153
in 4 channels
Get PRO
May '26
+160
in 1 channels
Get PRO
April '26
+206
in 2 channels
Get PRO
March '26
+103
in 0 channels
Get PRO
February '26
+110
in 0 channels
Get PRO
January '26
+94
in 0 channels
Get PRO
December '25
+161
in 4 channels
Get PRO
November '25
+119
in 2 channels
Get PRO
October '25
+158
in 1 channels
Get PRO
September '25
+375
in 11 channels
Get PRO
August '25
+166
in 6 channels
Get PRO
July '25
+180
in 4 channels
Get PRO
June '25
+279
in 5 channels
Get PRO
May '25
+211
in 2 channels
Get PRO
April '25
+217
in 3 channels
Get PRO
March '25
+117
in 2 channels
Get PRO
February '25
+111
in 0 channels
Get PRO
January '25
+93
in 4 channels
Get PRO
December '24
+94
in 0 channels
Get PRO
November '24
+68
in 0 channels
Get PRO
October '24
+187
in 5 channels
Get PRO
September '24
+279
in 11 channels
Get PRO
August '24
+216
in 8 channels
Get PRO
July '24
+558
in 1 channels
Get PRO
June '24
+67
in 1 channels
Get PRO
May '24
+125
in 1 channels
Get PRO
April '24
+179
in 1 channels
Get PRO
March '24
+227
in 2 channels
Get PRO
February '24
+270
in 4 channels
Get PRO
January '24
+150
in 0 channels
Get PRO
December '23
+170
in 0 channels
Get PRO
November '23
+203
in 1 channels
Get PRO
October '23
+264
in 1 channels
Get PRO
September '23
+480
in 0 channels
Get PRO
August '23
+339
in 0 channels
Get PRO
July '23
+454
in 0 channels
Get PRO
June '23
+383
in 0 channels
Get PRO
May '23
+3 051
in 0 channels
Get PRO
April '23
+436
in 0 channels
Get PRO
March '23
+412
in 0 channels
Get PRO
February '23
+941
in 0 channels
Get PRO
January '23
+460
in 0 channels
Get PRO
December '22
+248
in 0 channels
Get PRO
November '22
+222
in 0 channels
Get PRO
October '22
+186
in 0 channels
Get PRO
September '22
+786
in 0 channels
Get PRO
August '22
+323
in 0 channels
Get PRO
July '22
+249
in 0 channels
Get PRO
June '22
+228
in 0 channels
Get PRO
May '22
+306
in 0 channels
Get PRO
April '22
+92
in 0 channels
Get PRO
March '22
+145
in 0 channels
Get PRO
February '22
+696
in 0 channels
Get PRO
January '22
+203
in 0 channels
Get PRO
December '21
+699
in 0 channels
Get PRO
November '21
+302
in 0 channels
Get PRO
October '21
+216
in 0 channels
Get PRO
September '21
+1 040
in 0 channels
Get PRO
August '21
+852
in 0 channels
Get PRO
July '21
+371
in 0 channels
Get PRO
June '21
+17
in 0 channels
Get PRO
May '21
+25
in 0 channels
Get PRO
April '21
+29
in 0 channels
Get PRO
March '21
+127
in 0 channels
Get PRO
February '21
+1 463
in 0 channels
Date
Subscriber Growth
Mentions
Channels
09 September+4
08 September+2
07 September+2
06 September+1
05 September+2
04 September+5
03 September+6
02 September+4
01 September+2
Channel Posts
В мае я писала, что меня позвали в программный комитет Practical ML Conf. С тех пор мы просмотрели очень много заявок на доклады и выбрали из них те, которые попадут на конференцию. А сейчас уже вместе с авторами готовим их к конференции) На сайте уже есть программа. Мы старались выбирать самые содержательные и технически нетривиальные доклады. В итоге из самого, на мой взгляд, интересного:World models для роботов. Спикер — из Nvidia, где руководит созданием нейросетей для стека автономных беспилотных автомобилей • Обучение Alice AI LLM — как хорошо сделать так, чтобы LLM одновременно обладала фактическими знаниями, работала с длинным контекстом, разбиралась в отдельных предметных областях, решала задачи, следовала инструкциям и сохраняла нужный стиль общения. Как завести для этого всего reward модели, и как возникает reward hacking • Agentic Vision: как улучшить пространственное восприятие VLM, научив модель строить планы, корректировать решения и получать дополнительную визуальную информацию И самое веселое — доклад от Антона Разжигаева про Уробороса (онлайн). Уроборос — автономный самоулучшающийся агент Антона, который бьет Codex/Claude Code/Cursor на многих открытых бенчмарках, и уже собрал кучу звезд и форков на GitHub. Вся история создания и улучшения Уробороса — у Антона в канале. Я следила за ней с самого начала, это правда довольно весело, так что я с удовольствием послушала бы общий доклад Антона на конфе) Ну и еще будет много всего другого: генеративные рекомендации, инференс и RL для больших моделей, автономный транспорт, как заводить модели в прод для разных хадач. Ещё будут дискуссии про агентов и про то, как исследования превращаются в продукты. Конференция пройдёт 19 сентября в Москве и онлайн. Участие бесплатное, но нужно зарегистрироваться. P.S. А еще там объявят победителей Yandex ML Prize. Когда-то мне с DLS этот приз не дали 😠 Посмотрим, у кого тут "лучший ML-курс" в этом году 😐

2
А сегодня ещё, наконец, вышел пост на Lesswrong по этой статье, который написал мой соавтор. Его можно прочитать и даже лайкнуть, если было интересно)
4 052
3
В июне, перед тем как уехать на ICML, а потом на подготовку к IOAI, я была учеником на школе ARENA (Alignment Research Engine
В июне, перед тем как уехать на ICML, а потом на подготовку к IOAI, я была учеником на школе ARENA (Alignment Research Engineer Accelerator). Это что-то вроде технической программы по AI Safety. Как я писала выше, я занимаюсь AI interpretability, что довольно сильно связано с AI Safety. Поэтому я пошла на ARENA, чтобы получше понять, что там происходит внутри AI Safety коммьюнити, познакомиться с людьми, которые делают рисерч по теме interpretability, и, возможно, найти себе fellowship или работу. В итоге у меня сложилось довольно неоднозначное впечатление про коммьюнити AI Safety, но об этом как-нибудь потом. Пока что хотела написать вот о чем: ARENA длилась 5 недель, и в последнюю неделю мы в парах делали небольшие рисерч проекты. В итоге у меня и моего коллеги проект получился достаточно хорошим, с явными результатами, и поэтому мы решили немного его доделать и написать статью на воркшоп. Ниже кратко опишу, о чем статья, а еще дам ссылку на HF daily papers, куда я ее сегодня выложила и теперь хочу лайки 🙂 Итак, статья: When Activation Oracles Learn Not to Read: Concept-Specific Blind Spots in Fine-Tuned Oracles Activation Oracles (AO) — это языковые модели, обученные отвечать на вопросы о внутренних активациях другой модели на естественном языке. То есть, это один из подходов анализа активаций моделей, который выдает инфу в виде текста на естественном языке. У модели AO по сути спрашивают "о чём это скрытое состояние?", и AO генерирует ответ. Теперь: пусть у вас есть LLM, в которой есть какая-то скрытая информация — например, backdoor, скрытая цель или знание. Тогда естественно было бы предположить, что если обучить AO на активациях именно этой модели, то он хорошо научится считывать ее внутренние состояния и сможет легко найти эту скрытую информацию. Так вот, в нашей статье мы показываем, что в реальности может получиться ровно наоборот. Мы взяли пять разных концептов и дообучили LLM скрывать эти концепты. Потом обучили AO на активациях этих моделей. Оказалось, что AO, обученный на активациях модели X, начинает хуже "видеть" именно тот концепт, который скрывала модель X. При этом если этому же AO скормить активации другой модели Y, то он хорошо распознает концепт, который скрывает Y. Короче, вывод: в некоторых случаях обучение инструмента интерпретации (например, AO) на данных той самой модели, которую он должен интерпретировать, может сделать его систематически слепым именно к той информации, которая содержится в этой модели. Ссылки: Статья HF daily papers (вот тут можно поставить лайк!)
12 413
4
7 золота, 1 бронза и абсолютное 1 место у Артема Горохова 🎉 Новость: https://cu.ru/tpost/4ib9ed5o01-shkolnaya-sbornaya-rossi+6
7 золота, 1 бронза и абсолютное 1 место у Артема Горохова 🎉 Новость: https://cu.ru/tpost/4ib9ed5o01-shkolnaya-sbornaya-rossii-tretii-god-pod
9 962
5
В последнее время количество хороших новых статей растет огромными темпами, и уследить за всем интересным даже в пределах одной области становится супер сложно. Я уже перестала пытаться, честно. Даже на ICLR/ICML, где я недавно была, количество потенциально интересных мне статей было слишком большим, чтобы нормально все просмотреть и со всеми пообщаться (и еще успеть у своих постеров постоять). Из-за этого еще более полезными становятся мероприятия, где умные люди выделяют из нового ресерча главное, структурируют и подают в доступной форме. 13 августа Яндекс проводит ML Global Recap H1 2026 — мероприятие, где эксперты разберут несколько важных тем из мирового ML за первую половину года. Акцент будет на идеи, которые уже начинают менять индустрию. В программе — нетворкинг, дискуссии и доклады руководителей разных команд Яндекса: • Tabular DL — про это расскажет Артём Бабенко, руководитель Yandex Research; • Тренды и вызовы в ризонинге — разберёт Дмитрий Мокеев, руководитель группы качества претрейна Alice AI в Яндекс Поиске; • Новые подходы и стандарты в оценке качества моделей — представит Иван Дёгтев, руководитель аналитики Alice AI LLM в Яндекс R&D; • Оптимизация LLM-инференса — расскажет Андрей Бежин, руководитель службы ML-инфраструктуры в Яндекс R&D. Встреча пройдет 13 августа — можно присоединиться очно в Москве или онлайн. 🔗Регистрация — по ссылке. Регистрация закроется завтра, 7 августа в 18:00 #промо
4 949
6
Паблик ЛБ. Ждём приват! https://ioai.artix.tech/ioai_2026_estimations.html
4 246
7
Опа (Мы уже сказали детям, что с них налог)
6 765
8
AGI+1
AGI
6 480
9
Последние три недели я провела в Москве на сборах перед межнаром IOAI, а сегодня мы прилетели в Астану на сам межнар. Основны
Последние три недели я провела в Москве на сборах перед межнаром IOAI, а сегодня мы прилетели в Астану на сам межнар. Основные индивидуальные туры будут 4 и 6 августа, а пока что, как видите, фоткаемся и бегаем от комаров (они тут очень жёсткие)
8 126
10
В итоге рекорд из 10 попыток — 9.6 секунд на сборку. Среднее значение — что-то вроде 78-80 поворотов/10 секунд на сборку. Для+2
В итоге рекорд из 10 попыток — 9.6 секунд на сборку. Среднее значение — что-то вроде 78-80 поворотов/10 секунд на сборку. Для каждой попытки из зала вызывался человек, который либо кнопками вручную, либо с помощью случайного генератора (либо и так, и так) запутывал мегаминкс, затем полученный стейт подавался на вход алгоритму, который искал решение, и затем это решение реализовывалось роботом. На видео: 1) Как человек собирает мегаминкс (тут сборка за минуту 40 секунд) 2) Как работает пайплайн 3) Одна из 10 попыток сборки: запутывает мегаминкс тут Леша Колегов — один из членов сборной этого года на IOAI (собственно, мы приехали смотреть на мегаминксы с ребятами из команды, с которыми у нас сейчас сборы перед IOAI в Москве)
8 776
11
Приехала на Физтех, где сегодня собираются ставить рекорд по сборке мегаминкса роботом. Правда, выяснилось, что рекорд будет
Приехала на Физтех, где сегодня собираются ставить рекорд по сборке мегаминкса роботом. Правда, выяснилось, что рекорд будет только в 19:00 (а всех звали к 17:30), поэтому пока что сижу работаю. Что ж, посмотрим, поставят ли)
6 569
12
- я и постер (забыла попросить кого-то сфоткать) - я, постер и мой бывший коллега из российского Huawei - афтепати с коллегам+2
- я и постер (забыла попросить кого-то сфоткать) - я, постер и мой бывший коллега из российского Huawei - афтепати с коллегами после
7 515
13
Я на ICML в Сеуле, и тут на main conference аж две мои статьи, чем я очень горжусь! Но и это еще не все, еще две статьи — на MechInterp воркшопе, который будет 10 числа. И сегодня уже через пару часов буду стоять у постера одной из статей (если мне его таки распечатали))), поэтому приходите в HALL A #2606 в первую постерную сессию посмотреть на меня и помочь толпой сделать вид что статья популярна, хах Статья: MidSteer: Optimal Affine Framework for Steering Generative Models (arxiv link) Это — вторая моя статья по теме representation engineering, и первая попытка уйти от чисто эмпирического рукомахательного рисерча и сделать что-то более математически/теоретически обоснованное. История такая: как я писала раньше, первой моей статьей по этой теме была CASteer — steering-метод для удаления концептов из активаций диффузионной модели. В CASteer стиринг для удаления применяется довольно наивно, без нормального теоретического обоснования, только что-то вроде "ну вот у нас есть linear representation hypothesis, поэтому логично двигать активацию в сторону анти-стиринг-вектора, и давайте подвинем именно на такой коэффициент потому что такая трансформация сохраняет норму". После того, как я доделала CASteer, мне захотелось понять, как делать стиринг для удаления более фундаментально, т.е. можно ли вывести в некотором смысле лучшее преобразование для удаления концепта из активации. Оказалось, что для задачи удаления такое уже существует. Это статья LEACE: Perfect linear concept erasure in closed form. В ней выводится в некотором смысле лучшее линейное преобразование для удаления концепта из векторов-активаций моделей. Но применяется это в статье только для активаций, которые были получены из модели типа BERT и потом применяются для решения какой-нибудь downstream задачи классификации. То есть, метод не применяли на активациях LLM/диффузий, чтобы влиять на их генерацию. Я стала разбираться с LEACE. Оказалось, во-первых, что обычный activation steering для удаления концептов из активаций, который делается оргононализацией активации к стиринг вектору — это просто частный случай LEACE. То есть, обычный стиринг == LEACE в предположении о том, что матрица ковариаций активаций слоя единична, и среднее активаций равно нулю. Тут у меня возник вопрос, а почему тогда в статьях по стирингу не используется LEACE. Тут два предположения: 1) для LEACE надо считать матрицу ковариации слоя, что долго и дорого 2) как писала выше, статья LEACE не тестирует метод на генеративных моделях, и, возможно, поэтому о LEACE просто мало знают те, кто стирят LLMки Хорошо, стиринг для удаления — частный случай LEACE. Давайте теперь попробуем сделать что-то новое. Например, попробуем решить чуть другую задачу — не удаления концепта из активации, а перевода одного концепта c_1 в другой c_2 (concept switching). Например, c_1=котик, c_2=песик, и тогда цель — чтобы LLM/диффузия генерили текст/картинки с песиками вместо котиков, если в промпте при этом просят котиков. И, как и в LEACE, скажем, что преобразование должно быть линейным и в некотором смысле "оптимальным". Оптимальность в данном случае задается как "минимальное изменение вектора активации при условии изменения концепта c_1 -> c_2". Оказывается, такое "оптимальное" линейное преобразование для concept switching можно вывести. Более того, есть даже два варианта. Первое очень просто получается из LEACE изменением коэффициента, но у него есть недостаток — при применении оно меняет c_1 <-> c_2 в обе стороны, т.е. вместо котиков вы получите песиков, и наоборот. А второе — новое, которое меняет c_1 -> c_2, но не наоборот. Вот это новое преобразование для concept switch (теорема и результаты экспериментов) и есть главное novelty моей статьи. В итоге главные моменты статьи: • Cтиринг для удаления концептов — частный случай LEACE • Оптимальное линейное преобразование для concept switch (случай c_1 <-> c_2) — следствие LEACE • Новая теорема и эксперименты: оптимальное линейное преобразование для concept switch (случай c_1 -> c_2) — MidSteer Ссылки: Статья на arxiv Alpharxiv (тут можно поставить лайк 🥺)
6 485
14
☄️ Дата-сайентисты, новость для вас! Авито открывает набор на Data Science Bootcamp — годовую программу для тех, кто хочет вы+1
☄️ Дата-сайентисты, новость для вас! Авито открывает набор на Data Science Bootcamp — годовую программу для тех, кто хочет вырасти в ML и получить опыт работы в одной из самых сильных DS-команд на рынке! ➡️ Почему тебе стоит присоединиться? Читай в карточках. Регистрируйся до 9 июля — прием заявок ограничен: https://u.to/BqOfIg #промо
3 866
15
В феврале, прямо перед поездкой в Словению на межнар, приходила к Виктору Кантору на подкаст. И вот пару дней назад он наконец вышел — ссылки на посмотреть тут Поговорили немного про рисерч, про DLS, олимпиады, и мотивацию этим всем заниматься. Возможно, говорили про что-то еще, но я этого уже не помню)
6 659
16
У нас с Егором вышла новая статья про стиринг, бегом лайкать на HF daily papers) Вообще за последнее время у меня приняли несколько статей, и вышли ещё несколько новых статей, но никак не могу про это все написать 🫠 (отчасти потому, что работаю над этими статьями, хех)
8 258
17
Чаще всего стиринг активаций LLM реализуют как параллельный перенос активаций вдоль предпосчитанного вектора концепта (стиринг вектора). Такой дизайн исходит из гипотезы о локальной линейности множества активаций LLM. Но недавно вышли работы, которые критикуют такой подход, заявляя, что при линейном стиринге сильно меняется норма активации, а это выводит активацию в out-of-distribution, что ломает модель. Предлагаемая альтернатива — сферический стиринг, который сохраняет нормы активации, только поворачивая их в сторону вектора концепта на некоторый угол Но сами гипотезы, на которых строится этот подход (что активации лежат на сфере, а норма для концепта не важна), эмпирически не проверялись. Мы с Таней решили закрыть этот пробел: построили фреймворк, объединяющий сферический и линейный стиринг в один общий класс методов, и выделили норму и угол вектора как два интерпретируемых параметра (вместо одного, неинтерпретируемого, в линейном стиринге) Оказалось, что активации не лежат строго на сфере, а норма всё-таки важна для стабильности генерации, и опираясь на это мы предложили новый метод, совмещающий сильные стороны обоих подходов Полный обзор написал в [телеграфе] Если вам понравилась статья, поддержите её классом на huggingface daily papers, чтобы больше людей её увидело :) [arxiv]
6 701
18
В этом году позвали в программный комитет Practical ML Conf. Мы вместе с авторами @lovedeathtransformers, @boris_again, @tech_priestess и другими людьми будем отбирать доклады и делать так, чтобы программа конфы получилась интересной и качественной. Говорят, в этом году подали больше докладов, чем в прошлом, и доклады в среднем тоже круче. Конференция будет 19 сентября 2026. А пока еще можно подать на нее доклад — дедлайн подачи уже 1 июня (включительно). Тематика такая: Мы ждём глубокие технические доклады об ML-технологиях, которые уже сейчас приносят пользу для бизнеса. Мы отбираем доклады, исходя из четырёх основных критериев: польза и новизна для сообщества, применимость на практике и хардовый уровень сложности. Более подробно про подачу докладов — тут. Подавайте доклады, рассказывайте о своем рисерче/работе! (а мы ее рассмотрим 😃) Подать доклад тут
12 837
19
Нина подаётся на Yandex ML Prize как руководитель DLS. Там для заявки нужны несколько отзывов студентов, которые проходили курс. Если вы проходили DLS, вам понравилось, и вы хотите поддержать DLS, Нину и всех нас, напишите мне, пожалуйста
6 706
20
Так вышло, что теперь у нас не три, а четыре дня NeoAI, и сегодня тоже есть тур Он начнется вот-вот, вот ссылка на трансляцию. А ещё у нас есть живой лидерборд! Туры сегодня и завтра уже не международные, поэтому на лидерборде по новым задачам будут только кандидаты в сборную Приходите смотреть трансляцию, там будет про задачи в том числе)
7 325