causality links
Open in Telegram
people say (hope) we're invariant personal channel of @vkurenkov
Show more338
Subscribers
No data24 hours
No data7 days
No data30 days
Posts Archive
😘 Первая публикация дорогого брата Ильи Зисмана (@suessmann) на ICML'e первым автором, проделал кучу работы и прошел через несколько кругов ада с Watermaze'ом.
Клевая и простая идея, с которой дальше будет гораздо легче скейлить in-context rl.
https://t.me/dunnolab/20
Repost from ду́но
+1
Мы ищем стажеров!
👩🌾
shorties — это персональная программа, в которой мы выращиваем таланты до полноценных Research Engineer’ов или Research Scientist’ов в зависимости от ваших интересов.
🔭 Intern Research Scientist Вы будете заниматься написанием статей на top-tier ИИ конференции (NeurIPS, ICLR, ICML) и участием в научном дискурсе: проведение экспериментов, проверка и генерация исследовательских идей, которые направлены на развитие научного знания.
🧪 Intern Research Engineer Вы будете заниматься созданием новых frontier-технологий и применением Reinforcement Learning в реальных задачах.Тестовые задания и подробные описания позиций можно найти по ссылкам выше, дедлайн подачи заявки — 15 августа. - - — @dunnolab
https://h-frac.org/
Есть ощущение, что индекс хирша всегда был с нами, но на самом деле он был предложен только в 2005 году. Обосновывался не последним образом как число которое коррелирует ((кендалл в районе 0.3 - 0.4)) с научными наградами вроде нобелевки.
Спустя 15 лет внезапно выяснилось, что ученые заоптимизировали его в край и теперь корреляция в районе нуля (справедливо как минимум для физиков).
Решение оказалось простым — аллоцировать хирш фракционно среди соавторов. Этой прекрасной статье уже три (!!!) года, но системного перехода на эту метрику замечено не было 🤭
Repost from ду́но
+1
Привет! Это ду́но.
Мы группа исследователей на базе AIRI. Нас можно знать как экс-команду из Tinkoff Research, которая делала заметный движ с Reinforcement Learning: 7 статей на NeurIPS / ICML за последние три года.
Этот канал — точка сборки, где мы будем рассказывать про наши новые статьи, технологии, проекты, эвенты и возможности поработать с нами. Мы строим свою работу на нескольких принципах:
— Technology-first. Построение frontier-технологий и движение научного дискурса рука об руку. Мы не занимаемся публикациями ради публикаций, наша работа направлена на поиск и разработку новых технологий.
— No new science, no new technology. Мы понимаем, что построение новых технологий невозможно без поиска и влёта с ноги в новые (иногда неочевидные и рисковые) научные области. Мы постоянно ищем их и размышляем, за какими из них будущее.
— Deep connections. Мы взращиваем студентов, стараясь образовывать стабильные и долгосрочные связи с ними за счет активного менторства. Мы не даём 50 идей для рисерча🥴и не бросаем студентов на волю судьбы, мы занимаемся наукой и технологиями вместе.
Построить ASI не обещаем, но интересные вещи сделаем и поделимся ими здесь с вами.
Stay tuned.
- - —
Влад К., Саша Н., Никита Л., Илья З., Андрей П.
Зарелизили первый публичный и огромный (100 миллиардов таплов!) датасет для In-Context Reinforcement Learning'a. Ждем ваших апвоутов ❤️
https://huggingface.co/papers/2406.08973
Alumni!
В Университете Иннополис есть клевое коммьюнити выпускников. Каждый год ребята собираются отметить выдающихся алюмней и просто поговорить, что происходит в университете сегодня и как дела у самих выпускников.
💖 Спустя 5 лет (жесть!) после выпуска наконец-то смог добраться до этой встречи: было оч круто оказаться в кругу знакомых лиц, с которыми связано много приятных воспоминаний и узнать как мы все дошли до жизни такой 🌚
💕 В добавок ко всему, выпускники отметили меня как outstanding alumni (залутал худи) и отдельно подсветили наши потуги с @lua_b над стипендией.
В очередной раз для себя сделал пометку насколько повезло с университетом и людьми, которые собрались вокруг него. Community building круто, всем желаю такого 🏡
Transformers Learn Temporal Difference Methods for In-Context Reinforcement Learning
https://arxiv.org/pdf/2405.13861
Repost from [11/100] Витя Тарнавский
Смотрите какая потрясающая красивая статья вышла про наш ML Research ❤️
https://tinkoff-research.tass.ru/
Энтузиаст 🤙 дал небольшое интервью Forbes после победы в Yandex ML Prize.
Если интересно послушать про то как пришел в науку, в какую сторону копаем и каких принципов придерживаемся -- включайте 👨💻
Learning in POMDPs is Sample-Efficient with Hindsight Observability
https://arxiv.org/abs/2301.13857
Repost from Жёлтый AI
+2
Мы в Минске, а значит начался наш мировой тур Research 4 Kids – завтра полетим в СПб, а вы все еще можете зарегистрироваться, чтобы не пропустить ивенты 🐊
Repost from Жёлтый AI
Долго ждать записей RL-ивента не пришлось! Если вы не смогли прийти, то теперь можно посмотреть рассказ про:
– Новый метод сбора данных для In-Context RL
– Простой способ делать In-Context RL с генерализацией на новые действия
– Как сделать 1 триллион действий за 2 дня с XLand-MiniGrid
В записях таятся секретные знания о RL будущего, так что они обязательны к просмотру!
> готовишься у ребутталу, ставишь кучу экспериментов допом
> да с кайфом ребята, так уж и быть оставлю weak accept
😜😜😜
https://l.tinkoff.ru/tlab_research4kids2024
будем там вместе с @suessmann, так что если вы из [минск, спб, казань, мск, екатеринбург, новосибирск, астана] -- приходите пообщаться 🙂
