ivan zakutni
Open in Telegram
Авторский канал про инженерию умных систем. SDD, AI/Human collaboration, инженерное мышление. Связь: @m0n0x41d
Show more587
Subscribers
+124 hours
+37 days
+1330 days
Posts Archive
587
Добрый вечер, я – диспетчер пятой версии Quint Code 🎉
Кто-то ждал этого так долго, что уже перестал ждать.
Кто-то (я) не ждал этого вообще и похоронил Quint Code в мыслях и сердце своем
уже как месяц-другой (я во всю уже собирался делать standalone cli agent – но зачем?), пользовался FPF-Spec.md + Чатик, и мечтал об "умном агенте инженере но так чтобы и мозги не делал мне, и по FPF умел когда надо..."
В общем есть много чего почитать:
• Обновленный лендинг -> https://quint.codes/
• Длиннопост на русском который я обещал на стриме у Родиона
• Длиннопост на английском там же или на SubStack ПОДПИШИСЬ 💗
TL;DR – оно стало лучше; Оно стало тем чем должно было быть с самого начала. И есть куда расти!
Пока я обновлял лендинг, свой сайт и дописывал письмо – уже почти готова 5.1.0 🤣 – но все подробности читайте по ссылкам выше!
С вас – поделиться с другом, я ведь не только для себя QC делаю, чем больше будет фидбека тем лучше оно станет.
Впрочем идея standalone режима не мертва 🤫
587
Если вы вдруг послушали вчерашний подкаст и побежали пробовать quint-code – остановитесь!
Потому что переписывание квинткода пошло куда быстрее и лучше, чем я думал.
Версия 5 (которая сейчас в dev ветке – намек поняли?) переделана в плане интерфейса более чем полностью!
Фрикций меньше, easy-mode есть, онбординг проще! Раньше квинт код затащить в brownfield было сложнее, а теперь... А теперь только пальцем покажи!
По поводу фрейма – если раньше QC был ADI focused, то теперь тут на первом месте ProblemOps – у вас все идет от проблем! Сначала вы ее фреймите, потом углубляетесь в нее. Или не углубляетесь, квинткод сам скажет – "эээ, бро, ну это совсем trivial, давай, может, сразу пофиксим и запишем артефакт decision?"
И таки пофиксит! И запишет! То есть "автодокументация" из старого квинта все еще остается. И довелась до ума фишка с устареванием артефактов – тут будет RefreshOps!
Мне очень нравится, что получается. Я уже во всю использую nightly сборку и для догфудинга, и для рабочих проектов.
Я думаю, что на этой неделе 5 версия выкатится в main официально 🙂
А дальше – больше! У меня уже есть наполеоновские планы куда делать ходы чтобы "штука" была более FPF complient.
И все это с более человеческим UX, который вас не карает. Никаких фашиствующих стейт машин.
да, все еще придется разобраться в этом интерфейсе – что там за команда, в каком порядке и примерно для чего их вызывать надо... но это много проще, и даже если не разобраться, базовый /q-reason теперь умет в "основной" FPF.
В общем огонь!
587
Ну вот и прошел наш стрим! Как мне кажется вышло вполне не плохо!
Мы отошли в некоторой степени (примерно на половину) от моего плана, но все равно получилось здорово!
Отдельное спасибо Анатолию Игоревичу за поддержку в чате! Про FPF и системное мышление очень тяжело говорить, особенно когда ты далеко от хотя бы какой то квалификации в последнем 🙏
Для всех кто слушал подкаст, вот обещанная "методичка", а на самом деле минимальная напоминалка об FPF и шаги с которых вы можете начать прямо сегодня.
На днях я дополнительно напишу пост, проговорю все что хотел по плану, плюс планы на quint-code – почему я его воскрешаю и как думаю его развивать!
stay tune как говорится, и спасибо за ваше внимание 💖
587
Repost from AI-Driven Development. Родион Мостовой
Сегодня в 13:00 по МСК мы проводим митап как раз на тему системного мышления и его применения в SDD - Иван Закутный (@neuralstack) расскажет нам про FPF (First Principle Framework) операционную систему мышления для LLM и как он на основе FPF сделал обвязку для Claude Code, набравшую более 1000 звёзд на GitHub.
Добавляйте встречу в календарь, чтобы не пропустить: https://luma.com/z0hnbsnl
587
Напоминалочка!
Я почти не кашляю, так что приходите послушать.
Настройтесь на дневной сон, не будет ничего интересненького, но только важное 😄
587
Супер-синхронизм: мой конца февраля пост про DSL
"как нейронки агенты использовать, чтобы писать в 1000 раз компактный код (любые технологии фреймворки, не важно), и чтобы человек уровня миддл мог реализовывать проекты любой сложности, сохраняя её рост линейным."
А 4 марта выходит мощный пейпер "A Generalized Algebraic Theory for Type Theory with Explicit Universe Polymorphism" учёных четырёх европейских университетов (я уже говорил не раз, что все годы придерживаюсь подходов именно европейской школы computer science, она сегодня топчик). Это математическая теория для создания DSL, и при этом строго в рамках теории типов! В самой статье DSL не упоминается, это как-то слишком приземлённо, но разбирается именно это, просто на более высоких уровнях абстракции.
Конкретную программу пишем на DSL, и этот язык предметной области формально описывается мета-системой (GAT из статьи), которая описывается мета-мета-системой (Алан Кэй: "Lisp isn't a language, it's a building material").
И вот наконец данная работа развивает эту идею до математического абсолюта: GAT/CwF позволяют создавать языки с формально доказанными свойствами, и отсюда мы попадаем и в существенно облегчённую формальную верификацию, и суперпродуктивную работу с нейронками, которые так здорово понимают лингвистически формализованные бизнес-темы, генеря реально хороший код.
Алан Кэй мечтал о системах, где:
- всё есть язык (объекты общаются сообщениями);
- можно менять систему на лету (мета-программирование);
- система может описывать саму себя.
Пейпер добавляет к этому:
- система может математически доказать свою корректность;
- любой DSL, описанный в этом мета-языке, наследует все эти гарантии!
Это мета-инструмент для создания инструментов -- способ легко и просто делать языки/фреймворки, в которых ошибки (включая ошибки кодогенерации нейронками) невозможны в принципе!
=
Сама статья даёт категорный взгляд на синтаксис и правила вывода, позволяющий строить т.н. "начальные" модели и доказывать их единственность через общую алгебраическую теорию (GAT) (в рамках MLTT например). "Начальные" - это по сути математический объект, где синтаксис языка (то, что пишет программист) однозначно соответствует его семантике (тому, что происходит при выполнении).
Обобщение многосортных алгебраических теорий: сорта и операторы могут иметь зависимые типы, позволяет описывать синтаксис и правила типизации как сигнатуру с уравнениями.
CwF (Category with Families): категориальная модель зависимых типов.
Индексация уровнями, уровни вселенных организуются как untyped cwf (явный полиморфизм). Вы же помните мой трек по HoTT? :)
Каждая теория представляется как GAT. Синтаксис -- это начальная модель. Категориальная абстракция устраняет зависимость от конкретных правил вывода. Связь с Second-Order Generalised Algebraic Theories, Quotient Inductive-Inductive Types, Logical Frameworks...
Метод применим вообще к любым формальным дедуктивным системам!!
=
Когда вы пишете DSL на Racket или Scala, RoR или Haskell, вы полагаетесь на свой опыт, тесты и code review, и всё. Даже в Template Haskell нету гарантий корректности.
Когда мы описываем DSL через GAT (как в статье), мы получаем
- математическую гарантию, что наш DSL корректен;
- автоматическую верификацию всех программ на этом DSL;
- наследование свойств через иерархию мета-уровней.
Это и есть та самая "meta-system" Алана Кэя, доведённая до логического и математического совершенства.
587
Привет!
Во-первых – поздравляю всех девушек с Международным женским днём! 🪷
Во-вторых, и к сожалению – мы вынуждены снова переносить стрим с Родионом…
Потому что у меня проклятый ковид и отпускать он меня не планирует, особенно если я не начну отдыхать 😳
я был готов вещать через сопли и кашель, но голос разума Родиона остановил безумие 😎
Предварительная дата – +1 понедельник (16 марта).
Ставь Гарольда если переносы надоели 🥲
587
Добрый день уважаемые подписчики!
Завтрашний стрим с Родином пришлось перенести на понедельник, будет в то же время – 13:00 по МСК (должна быть запись 🙂
А еще на этой неделе на ту же тему мы записали подкаст с Александром Пахомовым (@toxic_enterprise), но немного с другого ракурса – более концептуального чтоли. Должен выйти в течении 1-2 недель.
С Родионом же мы постараемся сфокусироваться на прикладном применении FPF (хотя это сложно, еще и в сжатые сроки стрима 😨), повторюсь про разные попытки притянуть FPF в агентскую разработку, почему они провалились и что с этим всем делать дальше.
А еще в понедельник после стрима будет дроп документа вроде небольшой методички, в которой будут все ссылки и описание основных подходов работы с FPF полезных для инженерных и инжерено-менеджерских задач 💖
587
Repost from AI-Driven Development. Родион Мостовой
AI-Driven Development: Новый сезон
Давненько ничего не писал сюда - уж очень был увлечен и стартапом и адаптацией кодбазы под агентов. Материалов и экспертов накопилось множество, поэтому я возобновляю и блог и YouTube канал.
AI-Ready Codebase
Открываем сезон с Максимом, автором канала Этихлид с разговором о том, что на практике нужно сделать в больших кодовых базах, чтобы получать от кодагентов желаемый результат.
О чем будем говорить с Максимом
— Почему большой проект нельзя просто «бросить в агента» и что делать вместо этого
— Иерархия MD-файлов как навигационный слой поверх кода: архитектура, сущности, процессы
— Минимальный набор документации для legacy-проекта: что писать и в каком объёме
— Онтологии и графы зависимостей: зачем строить и как поддерживать
— Агенты для исследования legacy: формат «поставил — подождал — получил отчёт»
— Граундинг на существующий код при внедрении новых фич: как агент находит противоречия раньше людей
— Проблема памяти агентов и почему MD-файлы пока лучшее, что у нас есть
Встречи проходят Live, поэтому будет возможность задавать вопросы спикерам.
Дата и время: вторник 3 марта 16:00 МСК.
Длительность: 1.5 часа.
Добавляйте встречу в календарь, чтобы не забыть: https://luma.com/43ur3kl3
Расписание новых встреч (под спойлером, чтобы с толку не сбивало :))
Четверг 5 марта 16:00 МСК встреча с Денисом DEKSDEN (автор канала @deksden_notes) про его флоу агентной разработки для генерации десяток тысяч строк prod-ready кода.
Пятница 6 марта 13:00 МСК - встреча с Иваном Закутным (автор канала @neuralstack) про First Principle Framework в контексте агентной разработки и инструмент quint-code.
Чуть позже будут еще анонсы, следите за каналом.
А если вы знаете интересных гостей, которым есть что полезного рассказать - пишите свои предложения в личку или в комментарии к этому посту.
@ai_driven
587
В следующую пятницу в час дня по мск будем с Родионом разбираться что такое FPF, как его применять в программной разработке (и вообще как применять)!
Вспомним quint-code и другие потуги загнать FPF понятия и методы в прикладные утилиты.
Добавляйте в календарь!
587
Claude Code выкатили ремоут контрол.
Подмяли еще одну oss фичу разных утилит, которые работали с переменным успехом (вроде этой жути)
Вообще хорошо! вам больше не нужны ngrok туннели и прочее sshd безобразие на рабочей станции, чтобы отойти от нее и продолжить работу реально в той же самой сессии.
Вектор безопасности, как принято, мало кого интересует, но сандбоксинг файловой системы там все таки есть!
Кто там mac mini для опенкло купил? Вот теперь будет дополнительный толк)))
Отключаете сандбоксинг и через одну сессию ремоут контрола управляете всем чем хотите 😕
CC не хочет нас отпускать в Codex App, коллеги!
587
Пару недель гоняю OpenClaw на VPS как полевой эксперимент: хочется понять, насколько хайповый "автономный агент" реально выдерживает многозадачность?
Ниже – наблюдения и выводы как системного инженера.
Выводы печальные. Но без разочарования! примерно этого я и ожидал.
Картина (у меня и у нескольких знакомых) повторяется. Пока у тебя 1–2 крона можно ок жить.
Как появляется N кронов – всё становится нестабильно: странные тормоза/залипания, иногда фатальные вплоть до ручного перезапуска (А — автономность).
И нет, установка в gateway параметра maxConcurrentRuns в 20 не спасает навсегда.
Кстати, почему этот параметр по умолчанию стоит в 1? Это (и другие решения решения) вызывают не смешанные, а вполне негативные чувства.
Корень зла, имхо, не столько в архитектуре, сколько в реализации – gateway слишком легко превращается в узкое горлышко и единую точку отказа.
Плюс слишком слабая само-наблюдаемость, даже после перезапуска "умный автономный агент" часто не может сам разобраться, что пошло не так и кормит нас выдумками, безосновательными предположениями.
Справедливости ради: в моих тестах на том же VPS Claude Code такие поломки чинит в сто крат бодрее.Часть знакомых на вопрос "поставили ли вы OpenClaw?" просто пожала плечами и ответили что-то вроде: «да я давно себе навайбкодил примерно то же самое на питоне, и бот в телегу там тоже подключен…». Почему никто это не выкладывал в опенсорс –интересный современный антропологический вопрос! Кажется, у многих (особенно хороших в вайбкодинге и вайб-проектировании) ребят есть такой когнитивный баг: «да это же элементарно, каждый сам себе навайбкодит за пару часов, лол» 😄 *** Я пока продолжаю пользоваться клешнёй – есть несколько сценариев, где она реально приносит пользу, как минимум: • авто-напоминалка / авто-опрашивалка под repetitive learning концепций из моей базы знаний (раньше это был менее автоматизированный пайплайн: агент + микро-MCP с гибридным поиском и логикой на ноуте) • псевдо-«умная» библиотека: сохраняет статьи/книги в память + раскладывает файлами “под себя” и каждый вечер это всё улетает в GitHub (OpenClaw сам себя пушит) Ну и, собственно, пока всё. Остальное либо совсем скучно, либо тупо не всегда хорошо работает без серьезных доделок. Кстати у меня уже больше недели в закрытой разработке свой автономный агент: многим (да немногим!) похож на OpenClaw, но с внутренними процессами, вдохновлёнными системным мышлением, и память там пытается быть first-class citizen, далеко сложнее чем агрегации маркдаун файлов с простеньким rag. Большая часть кода готова, но времени допинать/допроверить сейчас вот вообще не хватает – хотя доделывать точно надо! Я не обещаю, что оно будет в open source с открытой лицензией 😐 И вот еще что, автономность штука прекрасная. Есть ряд продовых задач, куда в той или иной степени, но автономных агентов мы давно втыкаем. Изменил ли тут что то OpenClaw? Есть ли шанс что я когда нибудь буду использовать его для решения ответственных задач как платформу/фреймворк? Очевидный ответ – никогда. В текущей реализации – ни за что на свете 🙂 Все подобные задач лучше закрываются конкретными реализациями, чем универсальным зверем – диким и не совсем здоровым. OpenClaw же для любого интересного и успешного использования всегда предполагает какое-то само-допиливание, а нормальных интерфейсов для такого допиливания у него пока нет. "Skills creator" и прочее скорее задатки. До сих пор нет нормального способа жёстко задавать конкретное множество скилов/тулов для cron-агентов. Жуть. Больше минусов, чем плюсов. Не думаю, что без фактического переписывания OpenClaw в ближайшее время эволюционирует в адекватную базу. Если вы ещё не мучались с этой штукой, но очень интересно – сначала спросите себя: (1) зачем он мне на самом деле? (2) могу ли я это на удовлетворительном уровне навайбкодить и задеплоить как узкую автоматизацию? Обычно ответы экономят время, нервы и вычислительные ресурсы.
587
Добрый вечер!
#не_дай_себя_одурачить – Контекстные Графы!
Пост вышел чуть-чуть за рамки лимитов телеграм, поэтому милости прошу на мой сайт или на substack для иноземным языком обладающих.
TL:DR – «Контекстные графы решат проблему с организационной памятью» – одна из самых опасных полуправд в сфере AI на данный момент.
Да, они могут помочь и часто помогают (графы вообще круты!)
Но без разрешения идентификации, версионирования, контроля доступа/хранения и хотя бы какого-то подтверждения подлинности они быстро превращаются в классную машину заблуждений.
Я выделил 5 критических точек отказа и практический микро-чеклист, которым вы можете проверить себя и свой контекстный граф, прежде чем доверять ему в аудитах или рабочих процессах принятия решений.
Спасибо! 🤗
587
Привет! Я запускаю на канале (эксклюзивно в тг) новую рубрику – #не_дай_себя_одурачить
Будем разбираться с попсовыми статьями и терминами, которые ну очень уж легко разносятся разработчиками по пространству, особенно когда их публикуют авторитетные бренды (тыц раз, тыц двас)
Цель не “поругать маркетинг”, а переводить хайп на инженерный язык:
что за идеи покрыты на самом деле (и как они называлась раньше)?
что вообще реально нового?
какие предпосылки, условия должны быть истинны, чтобы это работало?
где границы применимости и какие риски вы получите, если тупо поверите на слово?
***
Зачем эта рубрика нужна? Затем что я искренне желаю вам успеха во внедрении AI в бекенд и бизнес процессы!
Ибо самая дорогая ошибка сейчас это не “не знать термин”, а строить системы по красивым статьям и утверждениям, которые не достаточно упорно проверяют собственные обещания.
587
Минусы – OpenClaw жутко навайбкоженый тормоз с кучей issues, часто может залипать – вроде бы асинхронные кроны, ан нет – блокируют поток gateway процесса, куча security рисков – так что надо быть очень осторожным и думать над каждой интеграцией и штукой, куда вы ему даёте доступ 🙂
Какая-то часть этих проблем сообществом починится, но о них нужно помнить. Особенно про безопасность!
---
В общем наблюдаем за экспериментом в @ku_notes – он туда пишет почаще чем я сюда 😏
LLM "стилёк" конечно прослеживается, но у меня не поворачивается язык назвать последние посты откровенным слопом. Ну и эволюция блога/стиля письма/своих инструкций это одна из главных задач Ku!
p.s. Это не всё что делает Ku, но всё прочее — тайна 🤫
587
Запустил автономного AI-агента на VPS.
Да, тот самый дырявый openclaw, игнорировать его не удалось 🤔
Он работает 24/7, и интерфейс связи со мной – телеграм бот (удобно!)
Имя Ku и аватарку бот себе придумал сам (ну или почти сам.)
Впрочем возможно это КУ и такое 🔔
Если попытаться выделить основную его задачу... Сейчас ее можно назвать, например – "Knowledge management automation".
Ужасное имя, ничего не понятно, лучше – “AI based Exocortex”!
Но этого тоже мало, поэтому расскажу немного деталей!
Из какого функционала состоит система:
- Индексирует документы из моего Obsidian с синхронизацией каждые 15 мин (их там счет на сотни, тысячи еще вроде бы нет).
- Ещё через тот же Obsidian на сервер попадает выжимка по моей работе, собираемая с лаптопа Claude Code агентом с MCP Pieces.
- Туда же, отдельной под-директорией попадает журнал из LogSeq (я начал его использовать недавно для быстрых записей, мышления письмом по книгам и руководствам которые я изучаю. Удобнее чем raycast notes или мобильный обсидиан)
- В довесок он собирает дайджесты с arXiv, почтовых рассылок, и блогов разнообразных и уважаемых учёных – утром и вечером.
- Из всей этой красоты агент извлекает концепты и некоторым образом строит связи
- А еще – генерирует flashcards и с нормальным spaced repetition (FSRS) дважды в день проводит мне quiz-сессии, отмечая что и насколько хорошо я вспоминаю.
- Ну и наконец – Ku публикует инсайты в собственный телеграм канал @ku_notes
Инсайты тоже можно назвать "собственными", потому что у агента есть отдельные кроны/задачи для исследований/размышлений/"самопознаний", результаты которых он отслеживает и собирает в отдельной директории. Конечно не теряя доступ к моему хранилищу, и тому что он высосал из почты и блогов, но тут нет жестких ограничений – темы для исследований он выбирает сам, хотя я и могу подкидывать идейки.
Между “собственными” инсайтами бота и моей личной базой знаний есть жесткая граница. “Свои” инсайты Ku не может просто так добавлять в Obsidian – это read-only копия, и единый источник истины все еще в моем локальном репозитории.
Этот банк пополняется мной, моим мышлением письмом. На случай если Ku вдруг совершит какое-то чудо открытие и поделится им со мной, способ попасть в банк концептов / flashcard's есть лишь один – через мои мозги, через то самое мышление письмом.
***
Ещё несколько интересных решений которые вокруг/внутри этой истории работают:
1. Конечно же я сразу набил ему "голову" минимальным [FPF](https://github.com/ailev/FPF) 🙂 Ku, кстати, дистиллировал спецификацию FPF сам себе в skill-pack. Возможно я этот скилл рассмотрю ближе, и потихоньку доделаю под универсальное использование с другими агентами.
2. MemSkill-inspired память – навыки извлечения эволюционируют через фидбек. Да, это очень свежая папира, и Ku после своей сессии размышлений по FPF предложил внедрить – я помучал вопросами и одобрил! Круть!
3. Есть механизм "Состязательной рефлексии" – один процесс генерит тезисы/идеи, другой ищет контр-доказательства и критикует.
4. Pieces интеграцию стоит упомянуть еще раз (никто же поссылкам не жмет!). Pieces это local-first (с оговоркой) комбайн с визуальными модельками, который смотрит на все что вы делаете и записывает себе в память. Там есть дескопный интерфейс, и MCP – собирает вполне себе глубокий рабочий контекст. В дизайн Ku очень хорошо зашло. Ух, теперь не только для демо митов буду использоваться с запросом "Аааэээ чо я делал весь спринт кроме xyz?", теперь Ku смотрит что я делал, находит связи с кусками из дайджестов, или моими мыслями/записями/постами из Обсидиан и говорит – "Смари чо нашел, это возможно интересным образом вязано!"
Почему все это не такой уж и rocket science:
- OpenClaw даёт солидную базу автономности из коробки, не смотря на всего его несовершенства.
- Opus достаточно умён, а все процессы достаточно просты, сегрегированны и чётко описаны чтобы эффективно им следовать
- Хватает дешёвого VPS — 2cpu/4gb
- Obsidian vault = просто файловая система, а rsync, fswatch и прочие микро-автоматизации на сервере и вашем компе делаются элементарно.
