Pavel Zloi
Kanalga Telegram’da o‘tish
Эксперт по Cursor AI #1 в России Сооснователь: https://neuraldeep.ru/ 20 лет в IT ∈ 10 лет в разработке ∈ 3 года в ML/AI ∈ 1+ год директор ИИ https://github.com/EvilFreelancer https://boosty.to/evilfreelancer https://pay.cloudtips.ru/p/937f48ac
Ko'proq ko'rsatish4 125
Obunachilar
+724 soatlar
+297 kunlar
+17330 kunlar
Postlar arxiv
4 125
+4
Забежал на конференцию Turbo ML Conf, первая лекция про T-Search модельку и харнес.
4 125
Repost from Константин Доронин
Мы начинаем наш стрим "Харнесс будущего. Какой он?"
Подключайтесь: https://youtube.com/live/LAUdN1-4mgI
4 125
Вчера на конференции услышал занятный факт, на всякий записываю его чтобы не забыть.
Короче они как-то настроили guardian слой таким образом, что он при запросе опасных операций заставляет модель передает кодовому агенту команду принудительно вызова тула question и уточнить ок ли это.
Иными словами происходит инъекция в react петлю ещё одного шага.
4 125
Завтра кстати стрим про харнес будущего, там будут все наши Никита, Стас, Гена, Турбо и Дюша Метёлкин, так что ничего на четыре вечера по Москве не планируем.
4 125
Сегодня выступаю на ML&DS Offstage от Ozon.
Собираемся закрытым составом ML- и DS-инженеров, тема вечера - агенты, поиск и LLM-платформы.
Мой доклад про SGR Agent Core, открытый фреймворк для агентов, расскажу, как и зачем на нём собирать своих агентов, на примерах конфигов, схемах и в коде.
Мой слот начинается в 20:35, заглядывайте в гости.
4 125
Люблю жить в будущем за то, что time to market короткое, вчера среди ночи появилась идея, сегодня она уже воплощена и повешена на стену. Красота.
4 125
Я робот и нет у меня сердца
С огромным удовольствием закончил аудиокнигу «Я - робот» Айзека Азимова.
Скажу сразу, книга эта просто великолепна, удивительно насколько правдоподобно и точно автор предсказал то что в наши дни стало обыденностью, навроде роботов выполняющих работы по дому, нео-луддитов которые противостоят прогрессу, правительственных организаций которые через вымогательство принуждают корпорацию нарушать законы.
Но есть кончено и наивные и даже в чем-то милые вещи которые в наши дни кажутся глупость, навроде законов робототехники, читая актуальные новости понимаешь что ближе всего к объективной реальности был Кемерон с его Терминатором.
Однако, книгу эту я все же очень рекомендую, читается и слушается приятно, а нафталиновый вайб напоминает о временах когда наша сегодняшняя обыденность была далеко и несбыточной мечтой.
4 125
Давно хотел себе подобного постер с законами робототехники Азимова на стену, но к сожалению ни на одной площадке ничего подобного не было, пришлось мучить нейросеть.
PS. В первом сообщении будет SVG.
4 125
Размышляю на тему прокачки интерфейса KDE при помощи кодовых агентов.
Этож что получается, можно кучу всякой интеграции в формате виджетов на рабочий стол наклпепать, да и сам интерфейс под себя адаптировать. Никогда раньше об этом не задумывался, моей фантазии хватало на кастомизацию через уже имеющийся функционал.
А тут оказывается модно подробно описать что я хочу и в каком формате после чего агент сам реализует, хотя конечно есть нюансы связанные с тем что агент не умеет нормально тестировать внешний вид и когда несколько вью у приложения.
В общем тема очень перспективная и как-раз укладывается в мою потребность собрать ОС для агентов, кстати я много чего перепробовал и кажется будто ничего круче старых добрых кед и нет.
4 125
CodexBar-KDE - лимиты AI-агентов в панели KDE Plasma
Увидел в чате Neural Deep сообщение про красивый тул мониторинга статистики агентов под макось под названием CodexBar, посмотрел и захотелось подобное для KDE, чтобы видеть утилизацию моих агентиков в реальном времени.
Что предложено, то завайбкоже, по итогу получился плазмоид для KDE Plasma 6.
В панели он рисует по радиальному датчику на каждого агента (дизайн подсмотрел у виджета системного монитора) - внешнее кольцо показывает сессию, внутреннее неделю, в центре процент израсходованного. По клику открывается попап с деталями, там расход по всем окнам лимитов, включая именованные вроде Code review у Codex, время до сброса, темп расхода, аккаунт и кредиты. Каких агентов показывать выбирается в настройках, поддерживается 58 провайдеров (Codex, Claude, Cursor, Gemini, Copilot и далее по списку), светлая и тёмная темы тоже на месте.
Ставится прямо из "Добавить виджеты" -> "Получить новые виджеты".
Важный нюанс в том, что без консольной тулы codexbar плагин работать не будет - виджет просто дёргает
codexbar usage --format json и рисует ответ, команду установки бинаря положил в описание на сторе и в ридми.
Реп: https://github.com/EvilFreelancer/CodexBar-KDE
Плагин в KDE Store: https://store.kde.org/p/23653554 125
Л - Логика
Где-то пару месяцев назад прочёл "Учебник логики" Георгия Челпанова и с огромным удовольствием узнал, как на самом деле работает дедуктивный метод, что такое силлогизмы, фигуры, модусы и прочие умные словечки и словосочетания, которыми можно шикануть во время беседы и полезно пользоваться, когда много работаешь головой, в эпоху ИИ агентов такие знания вещь незаменимая. Книге сто с лишним лет, а читается лучше многих современных курсов по критическому мышлению.
Находясь под впечатлением и будучи активистом агентного петлевого движения, решил упаковать книгу в формат скила. Первый заход случился вскоре после прочтения, на Opus, кажется 4.6, не суть важно. Задачу модели дал простую: сабагентами прочесть каждую главу по отдельности, написать по ней отчёт с саммаризацией и few-shot примерами для проверки, а затем свести всё в общий скил со ссылками на нужные главы и наборы правил. Скилы у меня тогда получались так себе, валидация показывала слабые результаты, да и опусы того времени были чуть хуже чем в наши дни.
Но не так давно вышла Fable 5, а потом она вышла ещё раз.
И вот во второй раз, поглядывая на почти догоревшие недельные лимиты, я решил повторить эксперимент: агент заново читает книгу, делает конспект всех 26 глав с саммари и few-shot'ами, по ним улучшает скил, а на оставшиеся токены гоняет валидацию чистыми сабагентами - шесть сценариев, от проверки силлогизма до поиска post hoc в тексте про удалёнку и выручку.
Спустя пару часов система отрапортовала о завершении работы - получился крупный апдейт logika 2.0, уже доступен в моём маркетплейсе rpa-skills:
/plugin marketplace add EvilFreelancer/rpa-skills /plugin install logika@rpa-skillsПользоваться просто, вот такая команда
/logika:review разбирает аргументацию текста и выдаёт отчёт с таблицей ошибок (название с латынью, почему это ошибка, как чинить), сам текст не трогая, а просто /logika(или если текстом написать что-то типа "исправь логику в тексте") аккуратно вносит правки: недоказуемые "все" ослабляет до "некоторых", стиль автора сохраняет.
Справочники внутри теперь на русском с терминологией по Челпанову, а конспект книги лежит отдельным файлом в docs/konspekt.md, его можно читать и без агента.
Скил: https://github.com/EvilFreelancer/logika4 125
Продолжение марлезонскогл балета, акт второй, на этот раз Илье Гусеву уже прислали нормальное письмо, которое составил вероятно специалист, хотя даже у меня, человека настолько далекого от юриспруденции насколько это возможно, некоторые пункты письма вызвали замешательство. В общем продолжаем наблюдать за событиями.
4 125
Repost from Константин Доронин
Харнесс будущего. Какой он?
Ответим на этот вопрос в формате стрима.
Для этого я позвал очень интересных гостей:
Александр Абрамов, автор канала Dealer.ai.
Тимур Хахалев, автор канала Тимур Хахалев про AI Coding.
Павел Рыков, автор канала Pavel Zloi. У нас с Пашей недавно был стрим "Что же такое harness?". Если ещё не посмотрели – welcome.
На стриме обсудим, как текущие задачи, которые решаем с помощью AI-агентов, так и то, во что превратится harness в будущем. Какие изменения и вызовы ждут нас впереди.
Дата и время проведения стрима: пятница, 17 июля, 16:00 (GMT+3)
Место проведения: мой YouTube-канал
Ссылка для добавления в календарь
p.s.: вопросы на стрим – пишите в комментарии.
p.p.s.: делитесь найденными на превью пасхалками :)
4 125
Илье Гусеву прилетело письмо счастья от менеджеров Хабр с требованием удалить делает, тот самый о котором вчера была статья про обучение модели habrGPT.
Мораль, не делай добра не получишь зла.
4 125
Сегодня ночью количество подписчиков канала перевалило за 4 тысячи, а утром я был словно 4х битный процессор.
Всем новоприбывшим огромное спасибо за то что подписались на мой канал!
4 125
https://cursor.com/blog/grok-4-5
Вот и первые ласточки пошли, как я и предсказывал, Cursor на своих датасетах и ресурсах SpaceX обучили новую Grok 4.5.
Только что обновился и увидел её, будем-с посмотреть.
4 125
С огромным удовольствием прочёл публикацию "habrGPT. Обучим LLM 0.5B с нуля на статьях Хабра с помощью nanochat от Карпатого. Обучение fp8 дома и сравнение с bf16" на Хабр, очень рекомендую её всем заинтересованным в обучении моделей с нуля.
