uz
Feedback
Pavel Zloi

Pavel Zloi

Kanalga Telegram’da o‘tish

Эксперт по Cursor AI #1 в России Сооснователь: https://neuraldeep.ru/ 20 лет в IT ∈ 10 лет в разработке ∈ 3 года в ML/AI ∈ 1+ год директор ИИ https://github.com/EvilFreelancer https://boosty.to/evilfreelancer https://pay.cloudtips.ru/p/937f48ac

Ko'proq ko'rsatish
4 125
Obunachilar
+724 soatlar
+297 kunlar
+17330 kunlar
Postlar arxiv
Про генерацию голоса доклад теперь
Про генерацию голоса доклад теперь

Забежал на конференцию Turbo ML Conf, первая лекция про T-Search модельку и харнес.
+4
Забежал на конференцию Turbo ML Conf, первая лекция про T-Search модельку и харнес.

Мы начинаем наш стрим "Харнесс будущего. Какой он?" Подключайтесь: https://youtube.com/live/LAUdN1-4mgI

Вчера на конференции услышал занятный факт, на всякий записываю его чтобы не забыть. Короче они как-то настроили guardian слой таким образом, что он при запросе опасных операций заставляет модель передает кодовому агенту команду принудительно вызова тула question и уточнить ок ли это. Иными словами происходит инъекция в react петлю ещё одного шага.

Завтра кстати стрим про харнес будущего, там будут все наши Никита, Стас, Гена, Турбо и Дюша Метёлкин, так что ничего на четыре вечера по Москве не планируем.

Фух, отстрелялся, было весело, закончил доклад даже чуть быстрее чем планировал.

Сегодня выступаю на ML&DS Offstage от Ozon. Собираемся закрытым составом ML- и DS-инженеров, тема вечера - агенты, поиск и LL
Сегодня выступаю на ML&DS Offstage от Ozon. Собираемся закрытым составом ML- и DS-инженеров, тема вечера - агенты, поиск и LLM-платформы. Мой доклад про SGR Agent Core, открытый фреймворк для агентов, расскажу, как и зачем на нём собирать своих агентов, на примерах конфигов, схемах и в коде. Мой слот начинается в 20:35, заглядывайте в гости.

Люблю жить в будущем за то, что time to market короткое, вчера среди ночи появилась идея, сегодня она уже воплощена и повешен
Люблю жить в будущем за то, что time to market короткое, вчера среди ночи появилась идея, сегодня она уже воплощена и повешена на стену. Красота.

Я робот и нет у меня сердца С огромным удовольствием закончил аудиокнигу «Я - робот» Айзека Азимова. Скажу сразу, книга эта просто великолепна, удивительно насколько правдоподобно и точно автор предсказал то что в наши дни стало обыденностью, навроде роботов выполняющих работы по дому, нео-луддитов которые противостоят прогрессу, правительственных организаций которые через вымогательство принуждают корпорацию нарушать законы. Но есть кончено и наивные и даже в чем-то милые вещи которые в наши дни кажутся глупость, навроде законов робототехники, читая актуальные новости понимаешь что ближе всего к объективной реальности был Кемерон с его Терминатором. Однако, книгу эту я все же очень рекомендую, читается и слушается приятно, а нафталиновый вайб напоминает о временах когда наша сегодняшняя обыденность была далеко и несбыточной мечтой.

Давно хотел себе подобного постер с законами робототехники Азимова на стену, но к сожалению ни на одной площадке ничего подоб
Давно хотел себе подобного постер с законами робототехники Азимова на стену, но к сожалению ни на одной площадке ничего подобного не было, пришлось мучить нейросеть. PS. В первом сообщении будет SVG.

Размышляю на тему прокачки интерфейса KDE при помощи кодовых агентов. Этож что получается, можно кучу всякой интеграции в формате виджетов на рабочий стол наклпепать, да и сам интерфейс под себя адаптировать. Никогда раньше об этом не задумывался, моей фантазии хватало на кастомизацию через уже имеющийся функционал. А тут оказывается модно подробно описать что я хочу и в каком формате после чего агент сам реализует, хотя конечно есть нюансы связанные с тем что агент не умеет нормально тестировать внешний вид и когда несколько вью у приложения. В общем тема очень перспективная и как-раз укладывается в мою потребность собрать ОС для агентов, кстати я много чего перепробовал и кажется будто ничего круче старых добрых кед и нет.

CodexBar-KDE - лимиты AI-агентов в панели KDE Plasma Увидел в чате Neural Deep сообщение про красивый тул мониторинга статистики агентов под макось под названием CodexBar, посмотрел и захотелось подобное для KDE, чтобы видеть утилизацию моих агентиков в реальном времени. Что предложено, то завайбкоже, по итогу получился плазмоид для KDE Plasma 6. В панели он рисует по радиальному датчику на каждого агента (дизайн подсмотрел у виджета системного монитора) - внешнее кольцо показывает сессию, внутреннее неделю, в центре процент израсходованного. По клику открывается попап с деталями, там расход по всем окнам лимитов, включая именованные вроде Code review у Codex, время до сброса, темп расхода, аккаунт и кредиты. Каких агентов показывать выбирается в настройках, поддерживается 58 провайдеров (Codex, Claude, Cursor, Gemini, Copilot и далее по списку), светлая и тёмная темы тоже на месте. Ставится прямо из "Добавить виджеты" -> "Получить новые виджеты". Важный нюанс в том, что без консольной тулы codexbar плагин работать не будет - виджет просто дёргает codexbar usage --format json и рисует ответ, команду установки бинаря положил в описание на сторе и в ридми. Реп: https://github.com/EvilFreelancer/CodexBar-KDE Плагин в KDE Store: https://store.kde.org/p/2365355

Л - Логика Где-то пару месяцев назад прочёл "Учебник логики" Георгия Челпанова и с огромным удовольствием узнал, как на самом деле работает дедуктивный метод, что такое силлогизмы, фигуры, модусы и прочие умные словечки и словосочетания, которыми можно шикануть во время беседы и полезно пользоваться, когда много работаешь головой, в эпоху ИИ агентов такие знания вещь незаменимая. Книге сто с лишним лет, а читается лучше многих современных курсов по критическому мышлению. Находясь под впечатлением и будучи активистом агентного петлевого движения, решил упаковать книгу в формат скила. Первый заход случился вскоре после прочтения, на Opus, кажется 4.6, не суть важно. Задачу модели дал простую: сабагентами прочесть каждую главу по отдельности, написать по ней отчёт с саммаризацией и few-shot примерами для проверки, а затем свести всё в общий скил со ссылками на нужные главы и наборы правил. Скилы у меня тогда получались так себе, валидация показывала слабые результаты, да и опусы того времени были чуть хуже чем в наши дни. Но не так давно вышла Fable 5, а потом она вышла ещё раз. И вот во второй раз, поглядывая на почти догоревшие недельные лимиты, я решил повторить эксперимент: агент заново читает книгу, делает конспект всех 26 глав с саммари и few-shot'ами, по ним улучшает скил, а на оставшиеся токены гоняет валидацию чистыми сабагентами - шесть сценариев, от проверки силлогизма до поиска post hoc в тексте про удалёнку и выручку. Спустя пару часов система отрапортовала о завершении работы - получился крупный апдейт logika 2.0, уже доступен в моём маркетплейсе rpa-skills:
/plugin marketplace add EvilFreelancer/rpa-skills
/plugin install logika@rpa-skills
Пользоваться просто, вот такая команда /logika:review разбирает аргументацию текста и выдаёт отчёт с таблицей ошибок (название с латынью, почему это ошибка, как чинить), сам текст не трогая, а просто /logika(или если текстом написать что-то типа "исправь логику в тексте") аккуратно вносит правки: недоказуемые "все" ослабляет до "некоторых", стиль автора сохраняет. Справочники внутри теперь на русском с терминологией по Челпанову, а конспект книги лежит отдельным файлом в docs/konspekt.md, его можно читать и без агента. Скил: https://github.com/EvilFreelancer/logika

Продолжение марлезонскогл балета, акт второй, на этот раз Илье Гусеву уже прислали нормальное письмо, которое составил вероятно специалист, хотя даже у меня, человека настолько далекого от юриспруденции насколько это возможно, некоторые пункты письма вызвали замешательство. В общем продолжаем наблюдать за событиями.

Харнесс будущего. Какой он? Ответим на этот вопрос в формате стрима. Для этого я позвал очень интересных гостей: Александр Аб
Харнесс будущего. Какой он? Ответим на этот вопрос в формате стрима. Для этого я позвал очень интересных гостей: Александр Абрамов, автор канала Dealer.ai. Тимур Хахалев, автор канала Тимур Хахалев про AI Coding. Павел Рыков, автор канала Pavel Zloi. У нас с Пашей недавно был стрим "Что же такое harness?". Если ещё не посмотрели – welcome. На стриме обсудим, как текущие задачи, которые решаем с помощью AI-агентов, так и то, во что превратится harness в будущем. Какие изменения и вызовы ждут нас впереди. Дата и время проведения стрима: пятница, 17 июля, 16:00 (GMT+3) Место проведения: мой YouTube-канал Ссылка для добавления в календарь p.s.: вопросы на стрим – пишите в комментарии. p.p.s.: делитесь найденными на превью пасхалками :)

Илье Гусеву прилетело письмо счастья от менеджеров Хабр с требованием удалить делает, тот самый о котором вчера была статья про обучение модели habrGPT. Мораль, не делай добра не получишь зла.

Сегодня ночью количество подписчиков канала перевалило за 4 тысячи, а утром я был словно 4х битный процессор. Всем новоприбыв
Сегодня ночью количество подписчиков канала перевалило за 4 тысячи, а утром я был словно 4х битный процессор. Всем новоприбывшим огромное спасибо за то что подписались на мой канал!

https://cursor.com/blog/grok-4-5 Вот и первые ласточки пошли, как я и предсказывал, Cursor на своих датасетах и ресурсах Spac
https://cursor.com/blog/grok-4-5 Вот и первые ласточки пошли, как я и предсказывал, Cursor на своих датасетах и ресурсах SpaceX обучили новую Grok 4.5. Только что обновился и увидел её, будем-с посмотреть.

С огромным удовольствием прочёл публикацию "habrGPT. Обучим LLM 0.5B с нуля на статьях Хабра с помощью nanochat от Карпатого. Обучение fp8 дома и сравнение с bf16" на Хабр, очень рекомендую её всем заинтересованным в обучении моделей с нуля.

Добавил Coddy Agent на NeuralDeep на странице про отечественные агенты.
Добавил Coddy Agent на NeuralDeep на странице про отечественные агенты.