Градиент обреченный
前往频道在 Telegram
8 808
订阅者
+224 小时
-67 天
+5530 天
帖子存档
8 808
Ресурсы для ML интервью
Восстанавливаю потихоньку сакральные знания, которые часто спрашивают на собеседованиях по общему ML. Метрики, классические алгоритмы и трюки, ансамбли и т.д. Всё это достаточно быстро забывается, если время от времени не повторять и не использовать, но на собеседовании точно спросят.
Я для себя понял, что чего-то лучше общения с чатгпт для освежения знаний нет, но нравится ещё пара вещей для самопроверки.
Карьерник от Тагира — штука в стиле дуолинго c вопросами и ответами по ML. Разбиение по темам хорошее, изредка встречаются странные формулировки, но в целом прикольно. Есть немного теоретического материала на повторить.
Список общих вопросов для собеседований — документ, который собирали сообществом ещё в 2020-м году, я туда тоже что-то добавлял тогда. По нему надо пройтись, оценить как бы ответили вы.
8 808
Тут сразу N замечательных девушек из канала @n_it_girls, попросили ответить на вопросы про секс, з/п и рок-н-ролл типичного IT'шника.
Девчонки клёвые, познакомился с ними на сентябрьских митапах. Подписываемся на них.
https://t.me/n_it_girls/1464
8 808
Сундар Пичаи проанонсировал Gemini 4 Argon. Пишут, что внутри им довольны, используют в исследованиях (есть результаты оптимизации квантовых алгоритмов), в оптимизации ресурсов (освободили 300TB оперативки в датацентрах, тоже в ходе оптимизации) и т.д.
Скоро гугл выпустит этот газ, можно будет подышать.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
8 808
Погонял новый Sonnet, сделал сценку Сити с машинками и NPC. Занимает всё около мегабайта, отрисовывается на three.js. Сделано на базе вот этой репы.
8 808
AMD покупает World Labs
Стартап от Фей Фей Ли из области моделей мира (это когда ИИ оперирует пространственными понятиями, строит 3D миры, понимает как и что внутри этого мира взаимодействует и т.д.), покупается за $8.2 миллиарда 😱.
Стартапу всего 2 года, у них есть есть продукт Marble, он публичный с конца 2025-го, в него мы уже обывательски потыкали.
Практическими кейсами у него, является обучение роботов (симуляция помещений, улиц, дорог, складов и т.д., генерация миллионов сцен, где робот будет планировать свои действия и дообучаться) и куча более очевидных применений типа игр, дизайна и т.д.
Для embodient agents (или «воплощенный ИИ» как его ещё переводят) тоже должно быть круто — робоагент строит внутри себя мир по камерам, размышляет, что произойдет при разных взаимодействиях со средой, и затем что-то выполняет в реальности.
Покупают всю RnD лабу Фей Фей Ли, а она сама становится исполнительным вице-президентом и Chief Scientist AMD. Очень круто.
https://ir.amd.com/news-events/press-releases/detail/1299/amd-to-acquire-world-labs-to-advance-the-future-of-ai-compute
8 808
Опять 5.5
Вышел Sonnet 5.5. В пресс-релизе сумели нарисовать график, где он выше всех. Обожаю такое.
Вообще же пишут, что предыдущая 5-я версия набирала на агентном бенчмарке Terminal Bench 4.0 только 10%, а новая модель аж 70%.
Смотрим её. Либо правда хороша, либо пора собирать Terminal Bench 5.0.
8 808
Чувак говорит, что при общении с новым чат-ботом от Meta тот скинул ему архив своей файловой системы. Для удобства даже закачал всё на Google Drive.
Вот это я понимаю сервис, не то что ваши вредные клоды.
https://mouse.dev/blog/muse-runtime-export/
8 808
🔺 Сделал 23-х язычную Алису в стране чудес
Эта книга была переведена на гораздо большее количество языков (и не один раз), так что в будущем ещё подрасширим. Так же скоро добавлю несколько её переводов на русский, в том числе перевод Владимира Набокова, можно будет их сравнивать между собой.
В Алисе очень много словесных игр, абсурдных шуток и стихов, каждый переводчик по сути перепридумывал их под свой язык, так что очень интересно разбираться у кого как получилось.
Добавил в нашу читалку вместе с новыми языками. Теперь есть нидерландский, турецкий, шведский, венгерский и другие. Появились даже эсперанто и ложбан 😱.
P.S. Это было не просто, так что если найдете косяки, то пишите.
👉 https://lingtrain.ru/library/ru/alice-s-adventures-in-wonderland-carroll--f6b939
8 808
Вышел grok 4.7. Появился в курсоре и в родном консольном клиенте. В консоли можно пока пользоваться бесплатно.
Консоль ставится так:
irm https://x.ai/cli/install.ps1 | iex
Потыкал им в один проект со сложным UI. Где-то через 10 минут посыпались 500-е ошибки. Через полчаса ожило, потом опять падало. Явно у них сейчас послерелизная нагрузка. В целом же плюс-минус как Opus работает, только медленней (в этот конкретный запуск).
Если по цене за API говорить, то тут сильно лучше опуса — $2/$6 за in/out 1M токенов (у опуса $5/$25).
Grok харнесс у них, кстати, открытый, можно посмотреть исходники. Особенно любопытно смотреть, что они там исправляют каждый раз, когда подливают изменения из рабочего репозитория.8 808
Мы боялись, что у нас отберет работу ИИ, но совершенно упустили из виду мух-дрозофил 🤩
8 808
Сегодня тусим на Practical ML от Яндекса. Пришло примерно миллиард человек. Все красавцы.
8 808
Ещё вчера был классный доклад про рекурсивные архитектуры
Есть ряд статей про такие архитектуры — HRM, TRM и URM (гуглим). Суть в том, что небольшая сеть, переиспользуя свои собственные веса, может многократно уточнять решение какой-то задачи, прежде чем выдать ответ.
Оказалось, что это хорошо ложится на логические задачи типа задач с ограничениями (судоку и другие варианты латинских квадратов, какуро и т.п.), лабиринтов, автоматов типа игры в жизнь и в целом задач с абстрактным рассуждением (ARC-AGI бенчмарк).
Из минусов то, что не получается загнать все такие таски в одну сеть, надо обучать под конкретную задачу. Из плюсов то, что одна модель может на своей задаче давать качество лучше любой LLM, быть сильно дешевле, быстрее и т.д.
Ребята собрали свою архитектуру на этой базе — STARM (Single Task Algorithmic Reasoning Models), оптимизировали её, получили SOTA качество. Выложили код.
👉 Хабр | GitHub
8 808
Люблю господина Сергея Николенко. Что в ЧКГ он мне всегда нравился, что книжки классные по ML у него есть, рекомендую для вкатывания.
- Говорит, что математика, кажется, всё, но математики это переживут.
- Обсудили коммунистический подход агентов, ломавших HF.
- Поразмышляли над архитектурами моделей лет через пять.
- Возможно, что следующие топовые архитектуры будут придуманы уже не нами.
8 808
+1
Тусим сегодня на AI RnD Day от Сбера, доклады пока отличные, множество знакомых лиц, все красавцы.
8 808
Слушайте, а давно клод-код стал сам возобновлять таски, которые умерли по лимиту?
- limit resets 9:40pm
- сontinuing automatically at 9:40pm
8 808
Тем временем нашу нишевую читалку для изучения языков установили 500 раз за две недели.
👉 качаем тут: ios | android
