fa
Feedback
epsilon correct

epsilon correct

رفتن به کانال در Telegram

Машинное обучение, графы, языковые модели. Чуток про карьеру исследователя в FAANG, путь PhD и щепотка полезной математики. Связаться с автором: @deltaincorrect. Рекламы в канале нет.

نمایش بیشتر
8 125
مشترکین
-324 ساعت
+187 روز
+3530 روز

در حال بارگیری داده...

جذب مشترکین
اوت '26
اوت '26
+94
در 0 کانال‌ها
ژوئیه '26
+98
در 1 کانال‌ها
Get PRO
ژوئن '26
+157
در 0 کانال‌ها
Get PRO
مه '26
+148
در 0 کانال‌ها
Get PRO
آوریل '26
+218
در 5 کانال‌ها
Get PRO
مارس '26
+111
در 0 کانال‌ها
Get PRO
فوریه '26
+256
در 2 کانال‌ها
Get PRO
ژانویه '26
+171
در 3 کانال‌ها
Get PRO
دسامبر '25
+109
در 5 کانال‌ها
Get PRO
نوامبر '25
+152
در 2 کانال‌ها
Get PRO
اکتبر '25
+106
در 3 کانال‌ها
Get PRO
سپتامبر '25
+148
در 3 کانال‌ها
Get PRO
اوت '25
+156
در 6 کانال‌ها
Get PRO
ژوئیه '25
+147
در 2 کانال‌ها
Get PRO
ژوئن '25
+214
در 5 کانال‌ها
Get PRO
مه '25
+159
در 5 کانال‌ها
Get PRO
آوریل '25
+213
در 3 کانال‌ها
Get PRO
مارس '25
+521
در 10 کانال‌ها
Get PRO
فوریه '25
+541
در 10 کانال‌ها
Get PRO
ژانویه '25
+150
در 6 کانال‌ها
Get PRO
دسامبر '24
+381
در 9 کانال‌ها
Get PRO
نوامبر '24
+152
در 3 کانال‌ها
Get PRO
اکتبر '24
+388
در 10 کانال‌ها
Get PRO
سپتامبر '24
+2 489
در 19 کانال‌ها
Get PRO
اوت '24
+198
در 10 کانال‌ها
Get PRO
ژوئیه '24
+232
در 4 کانال‌ها
Get PRO
ژوئن '24
+76
در 0 کانال‌ها
Get PRO
مه '24
+85
در 4 کانال‌ها
Get PRO
آوریل '24
+138
در 1 کانال‌ها
Get PRO
مارس '24
+185
در 8 کانال‌ها
Get PRO
فوریه '24
+105
در 3 کانال‌ها
Get PRO
ژانویه '24
+119
در 1 کانال‌ها
Get PRO
دسامبر '23
+408
در 3 کانال‌ها
Get PRO
نوامبر '23
+52
در 0 کانال‌ها
Get PRO
اکتبر '23
+165
در 3 کانال‌ها
Get PRO
سپتامبر '23
+106
در 0 کانال‌ها
Get PRO
اوت '23
+140
در 0 کانال‌ها
Get PRO
ژوئیه '23
+1 495
در 0 کانال‌ها
تاریخ
رشد مشترکین
اشارات
کانال‌ها
27 اوت0
26 اوت+2
25 اوت+13
24 اوت+2
23 اوت+7
22 اوت+4
21 اوت+6
20 اوت+3
19 اوت+4
18 اوت+3
17 اوت+5
16 اوت+1
15 اوت+5
14 اوت+5
13 اوت+1
12 اوت0
11 اوت+4
10 اوت+1
09 اوت+3
08 اوت+3
07 اوت+1
06 اوت+4
05 اوت+5
04 اوت+6
03 اوت+2
02 اوت+1
01 اوت+3
پست‌های کانال
Что-то я сюда не писал уже почти месяц, будем исправляться. Произошло много чего, анонсы через неделю уже никому не интересны, поэтому чуток расскажу про то, что запомнилось. Gemini 3.7 Flash – первая модель от гугла, которой можно пользоваться для агентского кодинга, хоть и сама по себе очень специфичная. Она поглупее других, но из-за супер быстрого сёрвинга на >300 TPS превращается во что-то полезное. Или напрототипировать что-то для других агентов. RSI Simulator – симулятор неолабы, которая пытается достичь recursive self improvement (RSI), когда модельки начнут бесконечно улучшать себя 📈. Начинается как простой кликер, потом тратим деньги, балансируя количество рисёрчеров, количество компьюта и баланс того, на что тратим деньги. Если у кого-то получится раньше, чем в 2029 году – пишите в комменты, как получилось!

2
Куртку продали за $960.000 Если купили дорогие подпищеки, дайте поносить?
3 046
3
у нашей с вами геммы пофиксили темплейт чата, стало лучше на бенчах 👀 бежим качать обновление с хф
у нашей с вами геммы пофиксили темплейт чата, стало лучше на бенчах 👀 бежим качать обновление с хф
4 106
4
Техрепорт Gemma 4 наконец-то докатился до архива ☺️, особо ничего нового, немного больше эвалов в long-context и для аудио
5 826
5
Мечта всех, кто хотел кожаночку как у Дженсена Хуанга – на следующем Sotheby's можно будет купить подписанную им куртку Tom F
Мечта всех, кто хотел кожаночку как у Дженсена Хуанга – на следующем Sotheby's можно будет купить подписанную им куртку Tom Ford. Средства пойдут на благотворительность, ориентировочная цена – 40-60k$, хотя зачастую у аукционных домов не всё хорошо с оценкой спроса, и куртка может уйти за сильно больше какому-нибудь сотруднику фронтирной лабы.
7 212
6
Пока я откисаю в Корее от очередного сезона исхода дорогих коллег [1, 2, 3, и др.] перед ICML, наша с читателями любимая Лили
Пока я откисаю в Корее от очередного сезона исхода дорогих коллег [1, 2, 3, и др.] перед ICML, наша с читателями любимая Лилиан Вэн – авторка топ-1 блога по диплёрнингу – написала первый за почти два года пост про историю и развитие науки об оценке правил масштабирования (scaling laws) языковых моделей. Почему "правил", а не "законов" – чтобы не создавать ощущения универсальности самих законов: всех необходимых факторов для по-настоящему точных предсказательных правил для конкретных архитектур, моделей, данных, оптимизаторов и других факторов, на них влияющих. Особого почтения заслуживает упоминание статьи Lovelace et al., где в первый раз в академическом мире разбираются, как влияют повторения данных на scaling laws. Так что у кого знания остановились на шиншилле – бежим освежать знания, чтобы фронтир толкался предсказуемо и безопасно.
6 780
7
Проверяемся, запомнили ли вас ллмки на intheweights.com Гпт 5.5 меня задизреспектила 😭
Проверяемся, запомнили ли вас ллмки на intheweights.com Гпт 5.5 меня задизреспектила 😭
6 207
8
MTP спекулятивный декодинг в Gemma 4: ускоряемся в два раза без потери качества 🥳 В нашу дорогую гемму наконец завезли спеку
MTP спекулятивный декодинг в Gemma 4: ускоряемся в два раза без потери качества 🥳 В нашу дорогую гемму наконец завезли спекулятивный декодинг, когда более маленькая модель предсказывает токены, которые могут верифицироваться большой моделью параллельно, существенно ускоряя инференс для локальных юзкейзов. Попробовать можно через HuggingFace transformers, остальные движки тоже скоро будут поддерживать. блогпост, технический блог
0
9
Продолжаем геммапропаганду. В прошлом году у NVIDIA вышла неплохая статья о том, как ловить людей, которые доливают тест в тр
Продолжаем геммапропаганду. В прошлом году у NVIDIA вышла неплохая статья о том, как ловить людей, которые доливают тест в трейн. CoDeC – нормализованный показатель перплексии, где для тестсета бенчмарка считают изменения в перплексии с дополнительными примерами из того же бенчмарка. Для неконтаминированных моделек мы ожидаем, что дополнительные примеры не будут сбивать модель с толку, а в лучшем случае помогут. С другой стороны, если модель запомнила текст из теста, дополнительные примеры собьют её с толку и уверенность модели в ответе упадёт. Шкала нормализована от 0 до 100, где ~80% значит, что примеры из теста модель видела буквально, ~40% – в перефразированном виде. Товарищ с твиттера посчитал CoDeC для Gemma 4 и сравнил с Qwen 3.5 – почему-то у наших китайских коллег модель почти запоминает примеры из теста.
0
10
WeirdML – один из самых необычных бенчмарков для ЛЛМок. В него входят необычные open-ended задачки по МЛю, например, распозна
WeirdML – один из самых необычных бенчмарков для ЛЛМок. В него входят необычные open-ended задачки по МЛю, например, распознавание цифр со всего 28 размеченными примерами и ~50к неразмеченными, распознавание формы фигур, или восстановление перемешанных фрагментов изображений. Gemma 4 31B оказалась самой сильной открытой моделью на этом бенчмарке, опередив GLM 5 (MoE на 700B) и GPT-OSS с хорошим отрывом, показав результат на уровне с О3 или Gemini 2.5 Pro.
0
11
Мои любимые artificial analysis выложили своё независимое тестирование Gemma 4 (твит, страница с результатами), по результата
Мои любимые artificial analysis выложили своё независимое тестирование Gemma 4 (твит, страница с результатами), по результатам вышло хуже квенов из-за просадки на 𝜏²-bench, ну и ладно с ним. В этой версии мне довелось поработать над околонаучными бенчмарками и работой с длинным контекстом, а там мы наступаем на пятки китайским моделям на порядок больше вроде GLM 5 или DS 3.2.
0
12
Gemma 4 blogpost | huggingface 4 размера: E2B, E4b (бывшие Gemma 3n/Gemini Nano); 26A4B, 31B Dense
Gemma 4 blogpost | huggingface 4 размера: E2B, E4b (бывшие Gemma 3n/Gemini Nano); 26A4B, 31B Dense
0
13
Gemini embedding 002 блог | API docs Первые по-настоящему мультимодальный эмбеддинги от нас. Теперь можно за в один эмбеддинг
Gemini embedding 002 блог | API docs Первые по-настоящему мультимодальный эмбеддинги от нас. Теперь можно за в один эмбеддинг загнать до 8к токенов текста, 6 картинок, 120 секунд видео, 80 секунд аудио или 6 страниц PDF. В этой версии сильно улучшили качество эмбеддингов по коду, теперь распознаёт больше языков. Улучшили matryoshka embeddings – теперь можно обрезать на размерность ~768 почти без потери качества. Я был первым бета-юзером в гугле, так что уверен, что настоящим сварщикам модель зайдёт. 👍
0
14
Artificial analysis про то, что изменилось: 1. Подрос общий индекс способностей модельки: SotA результаты на их бенчмарках пр
Artificial analysis про то, что изменилось: 1. Подрос общий индекс способностей модельки: SotA результаты на их бенчмарках при меньшем количестве токенов, чем Opus 4.6 или GPT 5.2-xhigh. 2. Почти вдвое уменьшили количество галлюцинаций (88%->50%), но при этом количество общих знаний у модели несопоставимо больше, чем у конкурентов 3. Наконец-то доросли до фронтира по агентному кодингу
0
15
Gemini 3.1 Pro Обновили нашу флагманскую модель, основной фокус в этом релизе на агентских способностях и кодинге, но и в общ
Gemini 3.1 Pro Обновили нашу флагманскую модель, основной фокус в этом релизе на агентских способностях и кодинге, но и в общих способностях моделька подкачалась. Поиграться, как обычно, можно на ai.dev
0
16
Пара полезных чисел Берём два несвязанных эмбеддинга из новой модной модели, а их косинусное расстояние – не ноль, почему? Есть два полезных числа, которые стоит запомнить: 2/π ≈ 0.6366 и 1/π ≈ 0.3184. Первое в ожидании получится, когда наши эмбеддинги распределены как модуль от координат гауссианы, второе – когда мы берём max(0, ·) – в простонародье ReLU от координат. Для других функций вычислить тоже довольно просто: косинусное расстояние для Z~N(0;1) концентрируется вокруг E[f(Z)^2] / (E[f(Z)])^2.
0
17
В декабре я писал про систему помощи авторам на конференции STOC; сегодня наша команда выпустила экспериментальную версию, где можно получить фидбек про свою статью на https://icml.cc/
0
18
The origins of efficiency Brian Potter, 2025 stripe press, amazon подкаст про книгу с автором Эффективность производства – од
The origins of efficiency Brian Potter, 2025 stripe press, amazon подкаст про книгу с автором Эффективность производства – один из фундаментальных механизмов, которые толкают цивилизацию вперёд, превращая дефицит в изобилие за счёт снижения затрат на производство товаров. В "истоках эффективности" Поттер максимально подробно разбирает конкретные рычаги оптимизации: технологические S-образные кривые (смена парадигм производства), экономию на масштабе, контролю вариативности и приведение процесса к идеалу непрерывного процесса, где минимизированы буферы, простои и запасы. Разбирая кейсы от производства лампочек и гвоздей до фотовольтаики, Поттер показывает, как улучшение процессов создаёт положительные циклы обратной связи, когда рост объёмов производства оправдывает инвестиции в улучшение процессов и R&D. Тем не менее, так происходит не везде: например, в строительстве и медицине в связи с высокой вариативностью, низкой повторяемостью, регуляторных усложнений процессов и болезни издержек Баумоля не получается обеспечить роста эффективности сравнимого с другими областями. Поттер считает, что в будущем такие барьеры будут преодолеваться через гибкую автоматизацию при помощи более адаптивных роботов. Книга – моя любимая из прочитанных за год, очень рекомендую любителям читать про изменения техпроцесса производства лампочек 10 страниц подряд. Заставляет смотреть на окружающие процессы с точки зрения улучшения их эффективности, параллели можно найти и с нашими с вами ЛЛМками – они усилиями многих коллег проходят ускоренный S-образный процесс улучшения их "производства". Настоящим сварщикам и выпекателям настоятельнейше рекомендую.
0
19
Два новогодних подгончика, чтобы слушать/читать, пока готовишь оливье. Неделю назадо вышло довольно подробное интервью с Себом, который (тех)лидит пре-трейн Gemini. Мало где можно послушать о том, как фронтирные лабы думают о претрейне. Джефф с Санджаем (вот тут очень мило про них от Нью Йоркера) выпустили коллекцию мыслей про оптимизацию ПО. У Джеффа невероятная интуиция на ускорение кода, в гугле ходят шутки в стиле шуток про Чака Норриса.
0
20
⚡⚡⚡ Gemini 3 Flash Флагманский апдейт дешёвой рабочей лошадки, которя перформит существенно лучше альтернатив за свои деньги.
⚡⚡⚡ Gemini 3 Flash Флагманский апдейт дешёвой рабочей лошадки, которя перформит существенно лучше альтернатив за свои деньги. Особенно всё прокачалось в мультимодальных запросах. Блогпост
0