ИИ Песочница Sber AI Lab
前往频道在 Telegram
AI & ML related papers review, news, opensource updates GitHub: https://github.com/sb-ai-lab Contact us for posts and promo: @oxana_y
显示更多2 293
订阅者
-324 小时
-37 天
+7930 天
数据加载中...
吸引订阅者
八月 '26
八月 '26
+112
在5个频道中
七月 '26
+69
在2个频道中
Get PRO
六月 '26
+63
在1个频道中
Get PRO
五月 '26
+158
在3个频道中
Get PRO
四月 '26
+156
在3个频道中
Get PRO
三月 '26
+34
在0个频道中
Get PRO
二月 '26
+24
在0个频道中
Get PRO
一月 '26
+29
在1个频道中
Get PRO
十二月 '25
+35
在1个频道中
Get PRO
十一月 '25
+145
在2个频道中
Get PRO
十月 '25
+72
在2个频道中
Get PRO
九月 '25
+31
在3个频道中
Get PRO
八月 '25
+34
在0个频道中
Get PRO
七月 '25
+90
在2个频道中
Get PRO
六月 '25
+52
在3个频道中
Get PRO
五月 '25
+11
在0个频道中
Get PRO
四月 '25
+29
在1个频道中
Get PRO
三月 '25
+41
在1个频道中
Get PRO
二月 '25
+53 398
在46个频道中
Get PRO
一月 '25
+948
在1个频道中
| 日期 | 订阅者增长 | 提及 | 频道 | |
| 30 八月 | 0 | |||
| 29 八月 | 0 | |||
| 28 八月 | +3 | |||
| 27 八月 | +3 | |||
| 26 八月 | +1 | |||
| 25 八月 | +1 | |||
| 24 八月 | +2 | |||
| 23 八月 | +1 | |||
| 22 八月 | +2 | |||
| 21 八月 | 0 | |||
| 20 八月 | +1 | |||
| 19 八月 | 0 | |||
| 18 八月 | +3 | |||
| 17 八月 | +2 | |||
| 16 八月 | +5 | |||
| 15 八月 | +6 | |||
| 14 八月 | +4 | |||
| 13 八月 | +7 | |||
| 12 八月 | +2 | |||
| 11 八月 | +11 | |||
| 10 八月 | +4 | |||
| 09 八月 | +2 | |||
| 08 八月 | +3 | |||
| 07 八月 | +18 | |||
| 06 八月 | +11 | |||
| 05 八月 | +3 | |||
| 04 八月 | +2 | |||
| 03 八月 | +8 | |||
| 02 八月 | +7 | |||
| 01 八月 | 0 |
频道帖子
ИИ-РАЗРАБОТЧИКИ, ВАШ ВЫХОД 🤩
Открываем регистрацию на международное онлайн-соревнование AI Journey Contest 2026. Участников ждут пять задач от Sber AI и Cloud.ru, а общий призовой фонд составит более 10 млн рублей.
Задачи 🤩
🟣 Guardian of Truth: научить модель находить контекстные галлюцинации в ответах ИИ-агентов
🟣 Green Challenge: создать модель физического ИИ для управления антропоморфным роботом Грином
🟣 3D DIT Distillation: ускорить генерацию 3D-объектов на базе Kandinsky 3D
🟣 Vision-Action Data Factory: собрать фабрику датасетов для обучения робототехнических моделей
🟣 Coordination Referee: построить модель арбитра для распознавания и определения типов сбоев во взаимодействии ИИ-агентовУчаствовать можно индивидуально или командой до четырёх человек. Допуск — с 18 лет. Подать решение можно до 20 октября включительно, победителей наградим на сцене AI Journey 2026 в Москве. 🤩 Изучить правила и зарегистрироваться 🤩 ✔️ Подписывайтесь на Sber AI в МАКС
| 2 | 🔍 ЛУЧШЕ ИИ ИЩЕТ ТОЛЬКО ЛУЧШИЙ ИИ
Мы привыкли искать информацию в чатах с ИИ, но качество нейропоиска всё ещё оставляет желать лучшего. Поэтому учёные и разрабатывают эмбеддинги — способы преобразования для семантического поиска и RAG-систем. А вот и один из них 🤩
GigaEmbeddings — новое поколение ИИ-моделей, которые превращают текст в числовые векторы и помогают ИИ находить информацию не по совпадению слов, а по смыслу
Чем лучше модель понимает смысл текста, тем точнее находит нужную информацию, тем ниже риск галлюцинаций у ассистентов и чат-ботов. Это особенно критично там, где цена ошибки высока: в поддержке клиентов, работе с юридическими и финансовыми документами и внутренними базами знаний.
🤖 В обновлённой линейке — три модели:
🤩 10B-A1.8B — лидер рейтинга ruMTEB
🤩 3B — лучший прирост качества и способности обработки кода на 14,5 пункта
🤩 480M — лидер среди моделей на русском языке до 500M параметров
Полные результаты тестирования доступны в открытом рейтинге ↖️
🤖 Что изменили внутри?
🤩 Объём данных для обучения вырос в несколько раз. Основной прирост качества дали открытые датасеты, в том числе Nemotron, F2LLM и KALM
🤩 Архитектуру упростили и добавили поддержку стандартных открытых инструментов вроде vLLM и SGLang — за счёт этого выросла и скорость инференса: 3B стала быстрее в 1,6 раза, а 10B-A1.8B — в 2 раза
🤩 Баланс языков сохранили за счёт мержинга экспертов на всех этапах обучения: удалось не потерять качество на русском при усилении английского и кода.
Модели бесплатно доступны разработчикам и бизнесу под открытой MIT-лицензией:
HF: 480M 3B 10B-A1.8B
Gitverse: 480M 3B 10B-A1.8B
Подробности читайте в посте команды ↖️
✔️ Подписывайтесь на Sber AI в МАКС | 362 |
| 3 | 没有文字... | 623 |
| 4 | 🔥 КАКИМ ИИ БУДЕТ ЗАВТРА?
обсудим на конференции AI R&D DAY
📆 17 сентября
📍 Москва
🎚️ 22 доклада от исследователей и инженеров Сбера.
Отличная возможность обменяться опытом, задать вопросы и обсудить идеи.
Что ещё будет на конференции:
🔘Новые архитектуры и подходы к обучению моделей
🔘ИИ-агенты и инструменты для разработки
🔘Омнимодальная долгосрочная память
🔘Модальности и коммуникации
🔘Оценка качества и производительности ИИ-
решений
Sber AI Lab будет в программе:
🎙Максим Макаренко выступит с докладом
«LLM для работы с событийными данными» — о том, как адаптировать большие языковые модели для анализа последовательностей событий (транзакции, логи, поведенческие данные) и какие вызовы возникают на этом пути.
🔘 Демо библиотеки SIRIN (Semantic Inconsistency Recognition and Inspection Nexus) на стенде — покажем, как работает детекция галлюцинаций в LLM в реальном времени.
🔘Постерная сессия — наши исследования и результаты.
Участие бесплатное, количество мест ограничено.
📎 Полная программа и регистрация по ссылке. Присоединяйтесь очно или онлайн! | 1 015 |
| 5 | ВИДИМ ДАННЫЕ НАСКВОЗЬ 🤩
Даже хорошая рекомендательная модель может показать отличный результат на тесте, но провалиться в реальности. И проблема часто скрывается в данных.
Исследователи Центра практического ИИ Сбера и AIRI создали SplitLight — открытый инструмент, который помогает находить такие проблемы ещё до обучения и сравнения моделей.
Что он умеет
🟣 Ищет аномалии в данных и даёт рекомендации по их устранению. Например, сбои логирования, дублирующиеся события и сдвинутые временные метки
🟣 Проверяет реалистичность эксперимента. Не попали ли в обучение данные из будущего, учтены ли новые пользователи и объекты, насколько отличаются тренировочная и валидационная выборки
🟣 Помогает сравнивать исследования. Фиксирует ключевые статистики разбиения и подготовки данных, чтобы эксперименты можно было воспроизводить и корректно сопоставлять
🟣 Показывает общую картину. Выводит на дашборде подробную статистику по проблемам в данных
Команда проекта во главе с исполнительным директором по исследованию данных Центра практического ИИ Сбербанка Алексея Васильева протестировала SplitLight на шести популярных открытых датасетах и наглядно показала: даже незначительные изменения в разбиении способны заметно повлиять на метрики и трактовку качества модели.
А научную работу о SplitLight представили на ACM SIGIR 2026 — одной из ведущих международных конференций в области информационного поиска и рекомендательных систем.
Забрать инструмент можно на GitVerse, а также на GitHub
✔️ Подписывайтесь на Sber AI в МАКС | 1 149 |
| 6 | ⚡️Рассказываем о нашей крутой разработке в области Recsys ⬇️ | 594 |
| 7 | Как ИИ помогает врачам ставить диагноз по фотографии?
В августе к нам на смену приезжал Константин Егоров — руководитель направления по исследованию данных Sber AI Lab, Центра практического искусственного интеллекта Сбера. На лекции он рассказал, как развивалось компьютерное зрение: от первых экспериментов на зрительной коре кошек до современных моделей глубокого обучения, которые уже сегодня помогают решать реальные медицинские задачи
После лекции мы попросили Константина ответить на несколько вопросов. Как инженер-строитель оказался в Data Science? Чем сегодня занимается Sber AI Lab? И какой совет он дал бы школьникам, которые мечтают связать свою жизнь с искусственным интеллектом?
Ответы — в карточках
#мнениеэксперта | 693 |
| 8 | Медицинская команда Sber AI Lab была на новой смене олимпиадной школы МФТИ, делилась опытом и знаниями.
Рассказываем, как это было 👇 | 567 |
| 9 | 没有文字... | 1 153 |
| 10 | 没有文字... | 1 650 |
| 11 | 没有文字... | 2 399 |
| 12 | 没有文字... | 922 |
| 13 | ICML 2026: главные тренды
продолжаем делиться обзором и аналитикой с конференции
В Сеуле с 6 по 11 июля прошла 43-я ICML - одна из трёх самых престижных конференций по машинному обучению (A*, h5‑index 272).
Цифры:
24 661 поданных работ - самая крупная конференция за всё время (2× по сравнению с ICML 2025)
6 552 приняты (26.6%)
168 устных докладов, 5 874 постера, 44 воркшопа
🔝Топ-5 тематик принятых работ:
🔘Large language models
🔘Applications: computer vision
🔘Deep learning: generative models and autoencoders
🔘Applications: chemistry, physics, earth sciences
🔘Applications: health, medicine
🎤Ключевые доклады
🔘Pascale Fung (HKUST) - агентам в реальном мире нужны модели мира: JEPA, VLWM, VL‑JEPA вместо пиксельных предсказаний.
🔘Verena Rieser (DeepMind) - сдвиг от запретов («не навреди») к позитивному выравниванию агентов. В реальных агентских сценариях, полных ценностно-нагруженных и неоднозначных решений, слепое следование правилам вредит. Предложена Habermas Machine - ИИ как нейтральный медиатор для группового консенсуса. В adversarial multi-turn framework перестановка фактов меняет решение модели в 13–22% случаев и сдвигает итоговую позицию к мнению пользователя на 6,5%.
🔘Arvind Narayanan (Princeton) -коллаборативные агенты успешнее автономных. RSI (Recursive Self-Improvement) не приведёт к AGI автоматически. Ключевой фокус: на создание бенчмарков и человеческую валидацию.
7️⃣главных трендов
1️⃣Генерация архитектур мультиагентных систем
Вместо ручного дизайна - переиспользуемые блоки (review, voting, planning) и диффузионная генерация графа коммуникации агентов.
2️⃣ Память и контекст для долгосрочных агентов
Context Folding -экономия контекста в 10×. BEACON — вехи для точной оценки в RL. MemoryArena - бенчмарк памяти в многосессионных задачах.
3️⃣ Эволюционный поиск вместо ручного дизайна
Эволюционные стратегии впервые дообучают LLM целиком, превосходя RLHF. AutoNumerics-Zero (DeepMind) - эволюционный поиск математических функций.
4️⃣Стабильность агентского RL
ARLArena - систематический разбор причин коллапса обучения. One Tool Is Enough - агент с одним инструментом обходит модели с 32B параметров.
5️⃣ Быстрый инференс LLM
ThunderAgent- ускорение в 1.5–3.9×.
Star Elastic (Nvidia) - одна модель с несколькими размерами. AgentOmit - пропуск лишних мыслей.
6️⃣Факты и безопасность
Большинство фактологических ошибок - не отсутствие знаний, а неспособность их извлечь (DeepMind). Бинарная награда за факты снижает галлюцинации на 39%. Co-RedTeam - мультиагентный поиск уязвимостей кода.
7️⃣ Надёжность в продакшене
Исследования реальных внедрений: надёжность агентов в ПРОМе обеспечивается ограничением автономности, короткими цепочками действий и ранним вмешательством человека.
💡Выводы
✔️Агенты становятся отдельным направлением, а не продолжением LLM-практики. На конференции заметен переход от «LLM + tools» к агентам с памятью, координацией, моделями мира и длинным горизонтом планирования.
✔️Надёжность и проверяемость выходят на первый план. Вопрос уже не в том, как поднять метрику, а в том, почему система ошибается: из-за знаний, извлечения, выравнивания, reward hacking или слабой постановки задачи.
✔️Эффективность снова стала центральной темой. Много сильных работ посвящено более дешёвому инференсу, семплированию, дообучению и разрежению. Для production это часто важнее, чем ещё один процент качества без понимания цены.
✔️Diffusion-модели закрепились как отдельный фронтир для языка и теории -это видно по награждённым работам и общему вниманию к diffusion language models и методам точного семплирования.
✔️Безопасность и выравнивание обсуждаются как прикладная инженерная задача. Вопрос уже не только в том, как ограничить модель, но и в том, какие инструменты для этого создаются и как они будут использоваться на практике.
❤ @sb_ai_lab
#icml | 1 225 |
| 14 | 没有文字... | 1 011 |
| 15 | Как попасть в Sber AI Lab и заниматься тем, что используют миллионы людей?
Помните недавнюю лекцию Дарьи Денисовой, ведущего специалиста по исследованию данных Sber AI Lab — Центра практического Искусственного интеллекта Сбера? Она рассказала, как работают рекомендательные системы, почему алгоритмы так хорошо угадывают наши интересы и какую роль в этом играют математика, анализ данных и машинное обучение.
После лекции многие ещё долго обсуждали услышанное, а мы решили пойти дальше и поговорили с Дарьей лично. Как олимпиады помогли ей попасть в Big Tech? Чем на самом деле занимается исследователь данных? И какой совет она дала бы тем, кто уже сейчас мечтает строить технологии будущего?
Ответы — в карточках
#мнениеэксперта | 906 |
| 16 | 💚 Sber AI Lab активно работает с молодыми талантами:
🟢лекции в вузах
🟢темы для курсовых и дипломных работ
🟢летние школы со студентами
🟢поддержка школьников.
На олимпиадной школе МФТИ Дарья Денисова рассказала про рекомендательные системы и как олимпиады помогают попасть в Big Tech. Интервью со спикером, подготовленное организаторами школы ниже ⬇️ | 728 |
| 17 | Как попасть в Sber AI Lab и заниматься тем, что используют миллионы людей?
Помните недавнюю лекцию Дарьи Денисовой, ведущего специалиста по исследованию данных Sber AI Lab — Центра практического Искусственного интеллекта Сбера? Она рассказала, как работают рекомендательные системы, почему алгоритмы так хорошо угадывают наши интересы и какую роль в этом играют математика, анализ данных и машинное обучение.
После лекции многие ещё долго обсуждали услышанное, а мы решили пойти дальше и поговорили с Дарьей лично. Как олимпиады помогли ей попасть в Big Tech? Чем на самом деле занимается исследователь данных? И какой совет она дала бы тем, кто уже сейчас мечтает строить технологии будущего?
Ответы — в карточках
#мнениеэксперта | 1 |
| 18 | 没有文字... | 1 |
| 19 | 💚Sber AI Lab активно работает с молодыми талантами:
🟢лекции в вузах
🟢темы для курсовых и дипломных работ
🟢летние школы со студентами
🟢поддержка школьников.
На олимпиадной школе МФТИ Дарья Денисова из команды Recsys рассказала про рекомендательные системы и как олимпиады помогают попасть в Big Tech. Интервью со спикером, подготовленное организаторами школы ниже ⬇️ | 1 |
| 20 | 没有文字... | 1 270 |
