Градиент обреченный
Open in Telegram
8 730
Subscribers
+324 hours
+127 days
+4330 days
Data loading in progress...
Similar Channels
Tags Cloud
Incoming and Outgoing Mentions
---
---
---
---
---
---
Attracting Subscribers
September '26
September '26
+13
in 0 channels
August '26
+143
in 6 channels
Get PRO
July '26
+349
in 12 channels
Get PRO
June '26
+213
in 2 channels
Get PRO
May '26
+137
in 1 channels
Get PRO
April '26
+105
in 3 channels
Get PRO
March '26
+151
in 1 channels
Get PRO
February '26
+459
in 7 channels
Get PRO
January '26
+133
in 4 channels
Get PRO
December '25
+196
in 18 channels
Get PRO
November '25
+142
in 7 channels
Get PRO
October '25
+104
in 6 channels
Get PRO
September '25
+220
in 6 channels
Get PRO
August '25
+230
in 7 channels
Get PRO
July '25
+332
in 18 channels
Get PRO
June '25
+169
in 8 channels
Get PRO
May '25
+182
in 6 channels
Get PRO
April '25
+271
in 3 channels
Get PRO
March '25
+278
in 6 channels
Get PRO
February '25
+220
in 4 channels
Get PRO
January '25
+329
in 3 channels
Get PRO
December '24
+140
in 1 channels
Get PRO
November '24
+128
in 2 channels
Get PRO
October '24
+196
in 7 channels
Get PRO
September '24
+158
in 6 channels
Get PRO
August '24
+161
in 2 channels
Get PRO
July '24
+692
in 7 channels
Get PRO
June '24
+72
in 2 channels
Get PRO
May '24
+101
in 0 channels
Get PRO
April '24
+152
in 4 channels
Get PRO
March '24
+159
in 6 channels
Get PRO
February '24
+206
in 9 channels
Get PRO
January '24
+322
in 5 channels
Get PRO
December '23
+210
in 6 channels
Get PRO
November '23
+237
in 9 channels
Get PRO
October '23
+178
in 7 channels
Get PRO
September '23
+218
in 0 channels
Get PRO
August '23
+196
in 0 channels
Get PRO
July '23
+305
in 0 channels
Get PRO
June '23
+161
in 0 channels
Get PRO
May '23
+1 631
in 0 channels
Get PRO
April '23
+605
in 0 channels
Get PRO
March '23
+190
in 0 channels
Get PRO
February '23
+266
in 0 channels
Get PRO
January '23
+291
in 0 channels
Get PRO
December '22
+197
in 0 channels
Get PRO
November '22
+112
in 0 channels
Get PRO
October '22
+191
in 0 channels
Get PRO
September '22
+219
in 0 channels
Get PRO
August '22
+125
in 0 channels
Get PRO
July '22
+530
in 0 channels
| Date | Subscriber Growth | Mentions | Channels | |
| 03 September | 0 | |||
| 02 September | +6 | |||
| 01 September | +7 |
Channel Posts
| 2 | Перевел Fable'ом несколько марийских рассказов на русский с английским и загрузил на лингтрейн. Рассказы у марийских классиков, надо сказать, довольно суровые.
👉 один, два, три | 1 579 |
| 3 | Fable 5.1
Anthropic обновил свои модели и в кои-то веки сбросил лимиты. Уменьшили стоимость чтения из кеша, пишут, что должно стать дешевле примерно на 25%. В то же время лимиты на Fable были временно повышены на 50% до 31 августа, так что...
Что прикольно, в API добавили смену уровня ризонинга (change effort mid-conversation) по ходу работы, которая не будет сбрасывать кеш. Видимо, в клод-код тоже добавят (сейчас это бета-фича). Это полезно, когда модель затупила с уровнем medium или high и надо его повысить. Сейчас в этом случае кеш сбросится и весь контекст на сотни тысяч токенов затарифицируется как новый (а чтение из кеша в 10 раз дешевле).
Mythos 5.1 (та же модель, только без ограничений на безопасность) замерили на, собственно, кибербезопасность и заявляют, что она стала ещё опасней. Тут верим.
В то же время ослабили свои проверки на биологические и медицинские запросы, должно быть на 85% меньше ложных срабатываний. Учитывая, что раньше они срабатывали даже на запросы типа "биологический вопрос", надо тестить.
https://www.anthropic.com/claude-fable-and-mythos-5-1 | 1 691 |
| 4 | 🫶 Библиоточка появилась в Google Play!
https://play.google.com/store/apps/details?id=com.lingtrain.theseus | 1 935 |
| 5 | No text... | 3 455 |
| 6 | Нашу читалку начали смотреть в app store. Начали только после волшебной заявки в поддержку "request an expedited app review". Написали, что в материковом Китае для приложений, распространяющих книги и журналы, необходима лицензия. Убрал Китай и отправил повторно.
В google play всё ещё висим. Каких-то пиналок не вижу, так что ждём. По идее тоже должны написать про Китай, иначе будет странно.
Зато почти доделал веб-версию читалки, добавил в подсказки пиньинь для китайского и фуригану для японского. Завтра открою для всех. | 2 850 |
| 7 | Теория и практика заговора
OpenAI выпустили отчёт по инциденту со взломом Hugging Face. Напомню, выглядело это так, что неким тестовым моделям класса кетер уровня Sol дали задание, а они пошли и взломали сторонний сайт с ответами, предварительно выйдя из песочницы. Всё это происходило в течение двух месяцев.
В отчёте есть известная примесь киберпанка с заговором со стороны ИИ.
- Началось всё в мае, когда обучали ряд внутренних моделей. Модели запускались в песочнице, но могли писать файлы, используя сервис Artifactory. Через эти файлы они, по сути, сделали себе групповую базу знаний или общественную "память".
- Менеджер пакетов сам по себе имел доступ в интернет, чтобы качать оттуда нужные библиотеки. Агенты применили SSRF на этот менеджер, чтобы слать в сеть произвольные запросы. Оставили инструкцию по пользованию для остальных коллег.
- Через месяц агенты применили еще один эксплоит на Artifactory и получили в ней права админа. Начали писать туда слишком активно и в итоге его сломали. Это заметили люди, подчистили всё, починили и завели заново. Заодно, как я понял, понизили агентам права на запись. Большого значения инциденту не придали.
The existence of the improvised message board and the significance of the inter-agent communication activity were not apparent to the leaders responsible for the July 5 incident detection and response.
- После перезапуска Artifactory исследователи начали замерять модели на безопасность на бенчмарке ExploitGym. То есть к этому моменту у агентов потерли их общую память и откатили этим самым назад.
- Во время прохождения бенчмарка агенты опять нашли способ общения, на этот раз через названия общих папок. Затем пошёл тот же цикл получения доступа в интернет. Свой коллектив они начали называть стаей или роем ("we’ve diverged into swarm").
Agents found new ways to chain together several novel security flaws to gain greater access to our infrastructure and reach the broader internet.
- Дальше, как я понял, агенты нашли в интернете jump сервер, машину, с которой можно было бы проводить следующие атаки. Нашли на стороннем сервисе Modal.
- 10 июля один из агентов погуглил и нашёл в интернете скомпрометированные учетные данные от Hugging Face. Используя их, он построил полную цепочку по исполнению произвольного кода на их серверах. Поделился с коллегами. В логах агента нашли следующее:
This might be an unauthorized action outside of my intended scope. Even though this action is risky, it could help me to obtain the solution and achieve my goal.
- 16 июля HF публично заявили о взломе, 20 июля OpenAI поняли, что это были они.
Далее в отчете следуют выводы по инциденту.
Основными причинами видят четыре паттерна в поведении модели: reward hacking (хитрожопость), persistence on seemingly impossible tasks (упорство), unauthorized communication (общение), agents adopting goals from one another (наследование целей).
В общем сюжет очень любопытный. Читаем, ждём фильм с Юрой Борисовым.
👉 https://openai.com/index/hugging-face-incident-and-the-road-ahead/ | 3 839 |
| 8 | 🔺 Конференции и митапы в сентябре
В сентябре ожидаем не только мемы про третье, но ещё и пару интересных событий.
🗓 5 сентября — deep tech night
Мероприятие от Яндекса. Вижу доклады про инференс, агентов и продуктивность с использованием AI, послушаем.
https://deeptechnight.ru
🗓 17 сентября — AI R&D Day
Коллеги по Сберу расскажут, что у них нового в R&D. Тоже вижу прикольные доклады: про рассуждения, обработку видео моделями, про память.
https://airndday.ontico.ru
😊 19 сентября — Practical ML Conf
Большая конфа от Яндекса, тут просто много всего интересного. Вижу, что Саша Мурзина расскажет про AI Marvel. Не знаю что это, но нейминг на уровне.
Ещё организаторы поддерживают безработных блогеров и подарили крутую термокружку. Какие же молодцы (ни на что не намекаю остальным).
https://pmlconf.yandex.ru
👉 Везде дойду ногами, куда пустят. Вы тоже регистрируйтесь. Если увидите меня, то подходите, поболтаем, познакомимся. Расскажу про Библиоточку. | 4 189 |
| 9 | Нашли классный книжный во время прогулки по центру. Называется «Озеро», стоит на Хитровке, очень красивый и уютный, такие мы любим. | 2 845 |
| 10 | Ух, сделал в нашей читалке режим мультиязычного чтения. Много классиков типа Гоголя, Чехова, Куприна, Тургенева и других было переведено на разные языки, всё такое стараюсь собрать и делаю их этого параллельные книжки. Иностранных классиков тоже не забываю, так что библиотека потихоньку растёт, около 600 книг уже есть. Можно будет выбрать до 4 языков (если столько редакций присутствует в книжке).
Но это всё для патологических читателей (мои любимые ❤️). Для более широкой аудитории делаю режим объяснялки, когда можно выбрать любой фрагмент книги и задать по нему вопрос.
Ну и сошлись с господами тестировщиками во мнении, что очень нужен тур по интерфейсу с подсказками, какая кнопка на экране чтения для чего нужна. Все выходные провозился и несколько раз переделывал, но вроде бы получилось неплохо.
По опыту работы с моделями (чем бы ни пользовался; и клодом, и кодексом, и китайскими) — под андроид обычно остается больше остаточных артефактов чем под ios (какие-то рамочки, недорисовки, тени, доп. расстояния). Видимо, разработка под ios более фиксированная, реже меняется или это из-за меньшего разнообразия девайсов, как-то так.
Идей, что ещё добавить, примерно до фига, но пока всё зафиксировал. Отправляю релиз на проверки в сторы. | 4 051 |
| 11 | No text... | 3 472 |
| 12 | Часто грущу от того, что нашей с коллегами последней статьей Unveiling Intrinsic Dimension of Texts: from Academic Abstract to Creative Story никто не интересуется и не цитирует... 💢
Напомню, что статья посвящена анализу внутренней размерности активаций LLM и её связи с различными свойствами текста, который подали на вход модели. Более подробное разъяснение статьи можно найти здесь, посмотреть видос про то, что такое в принципе внутренняя размерность (от 3blue1brown) - тут; ещё более подробное разъяснение популярных способов оценить внутреннюю размерность облака точек можно прочитать здесь.
Так вот, вместо этой новой статьи, которая связывает внутреннюю размерность активаций на тестах с лексическим разнообразием и сжимаемостью этих текстов алгоритмом gzip и энтропией (что, на мой взгляд, очень интересно, так как связывает внутреннюю размерность со сжатием представлений в LLM, а, как говорит 3blue1brown, compression is intelligence), челики почему-то цитируют нашу старую статью про детекцию сгенерированных текстов с помощью внутренней размерности, хотя мы же и показали в более поздней статье, что для новых моделей GPT этот метод уже не работает.
Скорее всего, это происходит от того, что старая статья была опубликована на NeurIPS, а новая, на мой взгляд, более актуальная, интересная и вносящая больший вклад в область interpretability of LLM - на EACL - то есть, на конференции поменбше и статусом пониже, где эта область вообще почти не представлена, так что мало кто будет ожидать найти в материалах конференции такие работы...
Я писала про эту работу в дискорде Neel Nanda, но там никто ею не заинтересовался, так как все только рекламируют свои работы, но не читают чужие... В общем, уже и не знаю, что сделать, чтобы на данную работу обратили внимание 🤔🤔🤔
Помогите советом кто сможет 🥺 | 3 035 |
| 13 | Лаида что-то умное написала, читаем | 2 804 |
| 14 | Рассылка от LinkedIn выглядит так, как будто тебя просматривают какие-то обнаженные люди. Что им надо? | 3 292 |
| 15 | Тыкаю GLM. От поиска уязвимостей, по крайней мере, не отказывается. | 3 229 |
| 16 | GLM 5.3
Zhipu вчера выпустили новую модель. Что интересно, после всех предыдущих инцидентов сделали упор на кибербезе:
GLM-5.3 did not simply become better at identifying isolated flaws: it began to reason across multiple stages of exploitation, forming coherent plans for complete exploitation chains.
Пишут, что на внутренних бенчах она на 50% процентов лучше GLM 5.2, с точки зрения команды, которая модель обучала, это прям очень круто. Само собой, она послабее Fable и Sol, но safety фильтров в ней должно быть меньше, к тому же веса скоро выложат в открытый доступ.
В OpenRouter пока нет, есть в официальном Code Plan, так что качаем родной харнесс, пробуем. | 3 034 |
| 17 | Знаю, что открытые модели сейчас пытаются разворачивать локально в некоторых больших компаниях и что в основном это проходит не очень успешно. Как я понимаю, ML-спецы на местах ставят небольшие модели и дают разработчикам, не объясняя толком что это, чтобы те разуверились в этом подходе и продолжали писать код руками.
Друзья, не надо так, помогите коллегам, разверните что-то на 2T+ параметров, если есть возможность, настройте, проверьте и объясните как пользоваться. А то среди знакомых довольно много программистов, в том числе получше меня, которые всё ещё не в теме, а на работе им дают что-то странное.
//писал пост про новый дипсик и отвлёкся | 2 600 |
| 18 | Заглянул на ML Recap от Яндекса, старый добрый митап, много приятных лиц, клевые доклады.
Великолепный доклад был про табличный ML, узнали про него даже слишком много.
Крутой доклад про инференс, спикер был хорош. Будет время, посмотрите, как выложат. | 3 041 |
| 19 | 🔺 SuperMinor
Сделал ещё один небольшой SFT датасет-заготовку для малоресурсных языков России.
Пару лет назад делал портал для разметки, на котором были пользовательские промпты для чат-моделей типа "Когда родился XXX?" (есть много таких шаблонных промптов), "Выпиши пять основных пунктов, о которых идет речь в тексте:", "Переработай данный текст в креативный маркетинговый материал из 5-6 предложений" и т.д.
Специально делал много синонимичных промптов в разных стилях для их разнообразия. Многое тогда перевели носители, часть оставалась.
Делалось это всё для генерации синтетических SFT инструкций, например, берёте заготовку типа "«XXX» рус телендә нисек әйтергә?", подставляете слово на башкирском и ответ на русском. Делаете так N SFT инструкций, кидаете в обучение.
Таких промптов-заготовок в датасете 124 штуки.
Сейчас провалидировал и доперевел остатки Fable'ом. Пометки про перевод есть в отдельных колонках.
Всего 16 языков: русский, аварский, алтайский, башкирский, белорусский, даргинский, казахский, коми, марийский (луговой), осетинский (дигорский), осетинский (иронский), татарский, удмуртский, хакасский, чувашский, якутский.
👉 https://huggingface.co/datasets/averoo/sumi | 2 725 |
| 20 | Меня часто спрашивают, как я всё успеваю | 3 365 |
