epsilon correct

Открыть в Telegram

Машинное обучение, графы, языковые модели. Чуток про карьеру исследователя в FAANG, путь PhD и щепотка полезной математики. Связаться с автором: @deltaincorrect. Рекламы в канале нет.

Больше

Россия77 943 Технологии и приложения14 078

8 073

Подписчики

-124 часа

+127 дней

+4130 день

4 974

Просмотры поста

Нет данных24 часа

Нет данных48 часов

61.62%

Коэффициент вовлеченности

Нет данных

Постов в день

Ads index

beta

Загрузка данных...

Похожие каналы

Сегодня родился Бенедикт Киберксюш

Больше каналов

Входящие и исходящие упоминания

---

Привлечение подписчиков

июль '26

+16

в 0 каналах

июнь '26

+157

в 0 каналах

Get PRO

май '26

+148

в 0 каналах

Get PRO

апрель '26

+218

в 5 каналах

Get PRO

март '26

+111

в 0 каналах

Get PRO

февраль '26

+256

в 2 каналах

Get PRO

январь '26

+171

в 3 каналах

Get PRO

декабрь '25

+109

в 5 каналах

Get PRO

ноябрь '25

+152

в 2 каналах

Get PRO

октябрь '25

+106

в 3 каналах

Get PRO

сентябрь '25

+148

в 3 каналах

Get PRO

август '25

+156

в 6 каналах

Get PRO

июль '25

+147

в 2 каналах

Get PRO

июнь '25

+214

в 5 каналах

Get PRO

май '25

+159

в 5 каналах

Get PRO

апрель '25

+213

в 3 каналах

Get PRO

март '25

+521

в 10 каналах

Get PRO

февраль '25

+541

в 10 каналах

Get PRO

январь '25

+150

в 6 каналах

Get PRO

декабрь '24

+381

в 9 каналах

Get PRO

ноябрь '24

+152

в 3 каналах

Get PRO

октябрь '24

+388

в 10 каналах

Get PRO

сентябрь '24

+2 489

в 19 каналах

Get PRO

август '24

+198

в 10 каналах

Get PRO

июль '24

+232

в 4 каналах

Get PRO

июнь '24

+76

в 0 каналах

Get PRO

май '24

+85

в 4 каналах

Get PRO

апрель '24

+138

в 1 каналах

Get PRO

март '24

+185

в 8 каналах

Get PRO

февраль '24

+105

в 3 каналах

Get PRO

январь '24

+119

в 1 каналах

Get PRO

декабрь '23

+408

в 3 каналах

Get PRO

ноябрь '23

+52

в 0 каналах

Get PRO

октябрь '23

+165

в 3 каналах

Get PRO

сентябрь '23

+106

в 0 каналах

Get PRO

август '23

+140

в 0 каналах

Get PRO

июль '23

+1 495

в 0 каналах

Дата	Привлечение подписчиков	Упоминания	Каналы
04 июля	+3
03 июля	+2
02 июля	+6
01 июля	+5

Посты канала

Мечта всех, кто хотел кожаночку как у Дженсена Хуанга – на следующем Sotheby's можно будет купить подписанную им куртку Tom Ford. Средства пойдут на благотворительность, ориентировочная цена – 40-60k$, хотя зачастую у аукционных домов не всё хорошо с оценкой спроса, и куртка может уйти за сильно больше какому-нибудь сотруднику фронтирной лабы.

2	Пока я откисаю в Корее от очередного сезона исхода дорогих коллег [1, 2, 3, и др.] перед ICML, наша с читателями любимая Лилиан Вэн – авторка топ-1 блога по диплёрнингу – написала первый за почти два года пост про историю и развитие науки об оценке правил масштабирования (scaling laws) языковых моделей. Почему "правил", а не "законов" – чтобы не создавать ощущения универсальности самих законов: всех необходимых факторов для по-настоящему точных предсказательных правил для конкретных архитектур, моделей, данных, оптимизаторов и других факторов, на них влияющих. Особого почтения заслуживает упоминание статьи Lovelace et al., где в первый раз в академическом мире разбираются, как влияют повторения данных на scaling laws. Так что у кого знания остановились на шиншилле – бежим освежать знания, чтобы фронтир толкался предсказуемо и безопасно.	3 190
3	Проверяемся, запомнили ли вас ллмки на intheweights.com Гпт 5.5 меня задизреспектила 😭	5 004
4	MTP спекулятивный декодинг в Gemma 4: ускоряемся в два раза без потери качества 🥳 В нашу дорогую гемму наконец завезли спекулятивный декодинг, когда более маленькая модель предсказывает токены, которые могут верифицироваться большой моделью параллельно, существенно ускоряя инференс для локальных юзкейзов. Попробовать можно через HuggingFace transformers, остальные движки тоже скоро будут поддерживать. блогпост, технический блог	0
5	Продолжаем геммапропаганду. В прошлом году у NVIDIA вышла неплохая статья о том, как ловить людей, которые доливают тест в трейн. CoDeC – нормализованный показатель перплексии, где для тестсета бенчмарка считают изменения в перплексии с дополнительными примерами из того же бенчмарка. Для неконтаминированных моделек мы ожидаем, что дополнительные примеры не будут сбивать модель с толку, а в лучшем случае помогут. С другой стороны, если модель запомнила текст из теста, дополнительные примеры собьют её с толку и уверенность модели в ответе упадёт. Шкала нормализована от 0 до 100, где ~80% значит, что примеры из теста модель видела буквально, ~40% – в перефразированном виде. Товарищ с твиттера посчитал CoDeC для Gemma 4 и сравнил с Qwen 3.5 – почему-то у наших китайских коллег модель почти запоминает примеры из теста.	0
6	WeirdML – один из самых необычных бенчмарков для ЛЛМок. В него входят необычные open-ended задачки по МЛю, например, распознавание цифр со всего 28 размеченными примерами и ~50к неразмеченными, распознавание формы фигур, или восстановление перемешанных фрагментов изображений. Gemma 4 31B оказалась самой сильной открытой моделью на этом бенчмарке, опередив GLM 5 (MoE на 700B) и GPT-OSS с хорошим отрывом, показав результат на уровне с О3 или Gemini 2.5 Pro.	0

Посмотреть все записи