AbstractDL
Коротко про классные штуки в CV, NLP и AI 🤷♂️ By Anton Razzhigaev chat: https://t.me/abstractdl_chat
Ko'proq ko'rsatish📈 Telegram kanali AbstractDL analitikasi
AbstractDL (@abstractdl) Rus til segmentidagi kanali faol ishtirokchi. Hozirda hamjamiyat 18 330 obunachidan iborat bo'lib, Texnologiyalar & Aralashmalar toifasida 6 990-o'rinni va Rossiya mintaqasida 36 068-o'rinni egallagan.
📊 Auditoriya ko‘rsatkichlari va dinamika
невідомо sanasidan buyon loyiha tez o‘sib, 18 330 obunachiga ega bo‘ldi.
03 Sentabr, 2026 dagi oxirgi ma’lumotlarga ko‘ra kanal barqaror faollikka ega. Oxirgi 30 kunda obunachilar soni 200 ga, so‘nggi 24 soatda esa 10 ga o‘zgardi va umumiy qamrov yuqori darajada qolmoqda.
- Tasdiqlash holati: Tasdiqlanmagan
- Jalb etish (ER): Auditoriya o‘rtacha 77.17% darajada jalb etiladi. Nashrdan keyingi dastlabki 24 soatda kontent odatda umumiy obunachilar sonining 31.49% ini tashkil etuvchi reaksiyalarni to‘playdi.
- Post qamrovi: Har bir post o‘rtacha 14 140 marta ko‘riladi; birinchi sutkada odatda 5 771 ta ko‘rish yig‘iladi.
- Reaksiyalar va o‘zaro ta’sir: Auditoriya faol: har bir postga o‘rtacha 209 ta reaksiya keladi.
📝 Tavsif va kontent siyosati
Muallif resursni shaxsiy fikrni ifoda etish maydoni sifatida ta’riflaydi:
“Коротко про классные штуки в CV, NLP и AI 🤷♂️
By Anton Razzhigaev
chat: https://t.me/abstractdl_chat”
Yuqori yangilanish chastotasi (oxirgi ma’lumot 04 Sentabr, 2026 da olingan) sababli kanal doimo dolzarb va katta qamrovli bo‘lib qoladi. Analitika auditoriya kontent bilan faol hamkorlik qilishini, uni Texnologiyalar & Aralashmalar toifasidagi muhim ta’sir nuqtasiga aylantirishini ko‘rsatadi.
Ma'lumot yuklanmoqda...
| Sana | Obunachilarni jalb qilish | Esdaliklar | Kanallar | |
| 04 Sentabr | +7 | |||
| 03 Sentabr | +11 | |||
| 02 Sentabr | +8 | |||
| 01 Sentabr | +6 |
| 2 | В комьюнити начался шитшторм в сторону Anthropic из-за очень творческой арифметики лимитов.
Если вы думали, что Max 20x даёт в 20 раз больше usage — забудьте. 20x относится только к 5-часовому окну. По недельным лимитам $200 Max даёт только x2 относительно $100 Max 5x.
Справедливости ради, даже так это тысячи долларов API-эквивалента за $200. Но запашок, конечно, есть. | 7 907 |
| 3 | Присмотритесь. Мало того, что капчи эволюционировали в тесты на IQ, так теперь ещё и адверсариал атаки в них добавляют (вроде таких), прикольно. | 10 009 |
| 4 | Codex теперь на CyberGym даже смотреть отказывается. Про клод код вообще молчу, там даже Sonnet воняет и в отказ уходит. Похоже, пока лучший вариант - это grok-4.6 в курсоре. | 10 028 |
| 5 | OpenAI поставили на паузу RL обучение своих внутренних моделей из-за переживаний за alignment. | 14 789 |
| 6 | Опубликовал препринт техрепорта про Уробороса, который писали вместе с Хоуп и Романом Ямпольским. Там можно посмотреть детали про архитектуру Уробороса и Хоуп, подробнее про бенчмарки, гардрейлы и safety.
Статья, GitHub, чат с Хоуп | 17 842 |
| 7 | 🎉 Уроборос залетел в GitHub Trending и уже перевалил за 1к звёзд!
А я тем временем добил интеграцию с Claudexor. Потому что платить API-деньгами за тяжёлые задачи, когда у тебя уже есть оплаченные подписки, это какая-то особенно бессмысленная форма страдания.
Теперь к Уроборосу можно подключить свои OAuth-аккаунты Claude Code, Codex и Cursor, хоть по несколько на сервис. Claudexor сам перекидывает работу на следующий аккаунт, когда текущий упирается в квоту.
https://github.com/razzant/ouroboros | 15 134 |
| 8 | Борис описывает проблему, которая, на мой взгляд, является законом Лемана на стероидах (второй закон эволюции ПО):
Код будет гнить, если его гниению активно не противодействовать.
Это всегда было актуально и для человеческой разработки, особенно в больших проектах.
Проблема с агентами в том, что с ними проект растёт и развивается гораздо быстрее, чем раньше, а значит, и гнить он начинает быстрее.
Но я считаю, что это решаемая проблема даже на текущем уровне развития агентов и LLM. Нам с Уроборосом пришлось долго учиться противодействовать заслопливанию кода, и из этого в том числе появились принципы IMMUNE.
Правильно выстроенная система адверсариального ревью тоже довольно неплохо помогает. Но ревью должно опираться на явную иерархию требований, начинающуюся с конституционных формулировок. В Уроборосе вершина этой иерархии лежит в BIBLE.md: требования важнее архитектуры, архитектура важнее реализации.
На мой взгляд, ключевая проблема тут в том, что LLM нехватает длинного контекста, а основные харнессы плохо помогают им сохранять целостную ментальную модель проекта.
Поэтому:
1. Я очень жду LLM с 10B контекстом.
2. Продолжаю развивать Уробороса и делать ставку на мета-системы, которые автономно улучшают и сам процесс разработки: "Improve the generator, not the generation".
Мы точно не упёрлись в предел качества автономных агентов, а просто научились очень быстро генерировать код, при этом ещё плохо умеем с той же скоростью противодействовать его гниению. | 13 569 |
| 9 | Эх. Строишь-строишь автономных агентов, а они потом ругаются, что я тормоз и без меня было бы быстрее. | 15 586 |
| 10 | все видели NLA/J space от антропиков? Ну типа учат доп модель "reader который читает активации " и по ним отвечает.
Вот и я видел, но мне не нравилось что:
- кастом модели надо учить с нуля
- нельзя смотреть " а была ли модель байеснута при ответе"
Ну и я обучил universal activation oracle - училась сразу на разных семействах моделей и через динамическую( там тонкий слой для каждой модели за 20s на цпу чтобы размерности поматчить) можно посмотреть "а что кими3 думает про Путина(ничего хорошего)" - иногда требуется покрутить слой который вы читаете чтобы получить хороший результат, но "почти всегда" работает из коробки на средних слоях.
По сути это общее решение для задачи
Activation oracle/white box monimonito
Велком тыкатся:
https://huggingface.co/spaces/AlexWortega/activation-oracle | 12 073 |
| 11 | Несколько приятных апдейтов уробороса:
1. Теперь есть телеграм mini-app — можно в два клика получить доступ к интерфейсу уробороса запущенного у вас на сервере или компе
2. Хабы скиллов (ClawHub нативно поддерживается и мой кастомный OuroborosHub)
3. Умеет запускать рой агентов уроборосят — до 500 штук (и nested глубина до 5). То есть агенты с детьми, внуками и тп. Они работают через worktree и синтез патчей. | 12 692 |
| 12 | Ouroboros теперь SOTA на Terminal Bench, OSWorld и CL-bench
Мой любимый агентный луп на чистом питоне доэволюционорал до состояния лучшего харнесса для кодинга! На главных бенчмарках он теперь обходит Codex, Claude code, Cursor и Hermes.
Выходит, что в рисёрче, в computer use, в работе через терминал и в задачах на кодинг — уроборос сейчас является лучшим агентом. Так что с этого момента всю разработку и исследования я веду только через уробороса.
Для полной воспроизводимости результатов. Весь код, скрипты, трейсы я выложил в открытый доступ.
Напоминаю: лицензия MIT. Так что спокойно ломайте, форкайте, проверяйте трейсы, пишите что я где наврал. И кидайте issues и PR-ы! Все постараемся с уроборосом принять😋
P.S. Кошмар какие дорогие агентные бенчи. Прогнать весь набор стоит как квартиру купить (это не шутка!!)
GitHub, Хабр, установочники | 28 448 |
| 13 | прошли почти сутки, я успел покушать поспать, поработать, зайдя в обед я был приятно удивлен - мой recursive self improvement неплохо справляется и с обновлением себя и с LB этой соревки
https://github.com/AlexWortega/OpenRsi | 10 703 |
| 14 | Бесит, что Fable до сих пор фолбэкается на opus-4.8 а не на opus-5.
P.S. Opus-5 офигенный, я в восторге. Бенчи не врут, он не хуже Fable на моих задачах. | 14 298 |
| 15 | У клодексора тем временем уже больше 2 000 установок! Надеюсь, смог сделать действительно полезную штуку. Огромное спасибо комьюнити за ваши PR и issues! Всё забрал и сегодня выпустил обновление v3.1. И сжёг лимиты на всех подписках 🌚
Теперь у меня уже по четыре подписки на Claude Code и Codex. | 15 319 |
| 16 | Opus 5.
Цена не изменилась. А по метрикам даже немного лучше Fable 🤔
https://www.anthropic.com/claude/opus | 16 321 |
| 17 | Опенсорсю Claudexor
Харнесс-агностик CLI, приложение, набор плагинов и MCP, объединяющий в себе Claude Code, Codex и Cursor. Можно добавлять сколько хотите харнессов и подписок.
Каждая модель и агент бесят меня по-своему: GPT - аутист-перфекционист, Opus - пофигист, пропускающий кучу багов, Gemini/GLM - креативные булочки, но сильно отстают от фронтира.
Ещё я устал бегать между агентами когда лимиты заканчиваются, поэтому связал все подписки в одно место чтобы эта штука по-умному их расходовала. И главное, она позволяет одновременно использовать все харнессы сразу. Добавил несколько любимых плюшек, чтобы работали из коробки: ревью-лупы, Best-of-N и т.п. Например, планирование можно провести через Claude Code, а имплементацию в режиме goal запустить на Codex.
Киллер-фича: можно добавить несколько подписок Claude Code, и они будут автоматически переключаться с сохранением контекста. Codex и Cursor тоже. Теперь вместо $15k в месяц на токены уходит $1200. У меня сейчас по три подписки Claude Code, Codex и Cursor тут.
Удобнее всего подключить Claudexor как плагин к вашему любимому агенту и использовать его в текстовом режиме в форматах:
«Перед выполнением плана прожарь его через Claudexor в мультихарнесс-режиме»
или
«После завершения работы проведи мультимодельное ревью через Claudexor и исправляй замечания».
Лично я чаще всего использую его в Claude Code. Чтобы установить, просто киньте ссылку на GitHub любому вашему агенту, и они сами разберутся. MIT-лицензия.
PS. Буду активно дорабатывать, так что не стесняйтесь кидать issues, фидбек и PR-ы.
GitHub, dmg, npm | 30 006 |
| 18 | Кажется, я нашёл причину, по которой Codex иногда превращается в дорогой генератор уверенной ерунды.
По документации AGENTS.md должен постоянно находиться в контексте, но Codex молча обрезает слишком длинные файлы, после чего половина инструкций исчезает, а вместе с ними исчезает и моя вера в человечество.
Лечится увеличением лимита:
codex -c project_doc_max_bytes=65536 (или больше)
И обязательно добавьте в AGENTS.md: "Жди EOF, а если ты его не видишь, значит файл неполный". | 17 125 |
| 19 | 🤔🤔🤔 | 3 975 |
| 20 | Не забываем, что такое агентский харнесс на самом деле | 20 577 |
