es
Feedback
DEKSDEN notes

DEKSDEN notes

Ir al canal en Telegram

Мои заметки на разные темы, уровень - "для продолжающих") Vibe Coding -> AI SWE, AI Coding Tools, Agents: Claude Code, Codex, news, links Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi (с) 2025-2026, @deksden

Mostrar más
2 972
Suscriptores
+124 horas
+157 días
+12030 días
Archivo de publicaciones
⚪️ Grok 4.6 Ну вот! стоит отвлечься на эфир, тут моделей уже насыпят.. У Маска наступило 7 августа, и вышел новый грок. Что м
⚪️ Grok 4.6 Ну вот! стоит отвлечься на эфир, тут моделей уже насыпят.. У Маска наступило 7 августа, и вышел новый грок. Что можно сказать по материалам, представленным на релизе? Бенчи оч неплохие, на уровне фронтира. Видимо, похуже агентность (deepswe/tb3 немного пониже). Модель быстрая, и не дорогая - $2/$6. Акция: в Grok Build лимиты на неделю х2 поставили! Время тестить Новая модель доступна в курсоре, grok build, grok bot и api. Ну - будем сравнивать с ещё одним сегодняшним дебютантом, DS4Pro @deksden_notes

Repost from Junior AI PM
#иное Комьюнити-эфир 12 августа. Живая дискуссия про AI coding Без докладов и презентаций -> просто собираемся и обсуждаем, к
#иное Комьюнити-эфир 12 августа. Живая дискуссия про AI coding Без докладов и презентаций -> просто собираемся и обсуждаем, как сейчас реально работаем с AI-разработкой 🎙 Максим Ключников -> техлид и автор канала Этихлид, много экспериментирует с AI в разработке и инженерных процессах https://t.me/etechlead 🎙 Денис Киселёв -> AI SOLO founder, автор канала про AI-разработку, агентов и инженерные инструменты https://t.me/deksden_notes 🎙 Артем Летюшев -> Tech PM в Twinby и гильдмастер AI Engineers Guild https://t.me/junior_pm Поговорим про свежие модели и tokens per task, спеки, архитектуру, ADR и AI SDLC. Дальше как пойдёт Ссылка на событие https://luma.com/lwm1coqr 📍 Google Meet: https://meet.google.com/bzz-aeoo-vio 🗓 12 августа, среда 🕖 19:00–20:00 мск

⚪️ Codex Reset завтра? Вот как такое понимать? Если завтра, то включаем fast. Если нет - попадаем на 4 скучных дня)) Вот и га
⚪️ Codex Reset завтра? Вот как такое понимать? Если завтра, то включаем fast. Если нет - попадаем на 4 скучных дня)) Вот и гадаем. Я склоняюсь что нас ждёт ресет. Но уже немного утомляет неопределённость. Начните их продавать, наконец! @deksden_notes

⚪️ Grok 4.6 и Bot на SuperGrok Тут Илон пояснил за сабж 1) Grok 4.6 "позже на этой неделе" 2) Grok Bot будет расширен на друг
⚪️ Grok 4.6 и Bot на SuperGrok Тут Илон пояснил за сабж 1) Grok 4.6 "позже на этой неделе" 2) Grok Bot будет расширен на другие тиры как пофиксят начальные проблемки - но сроков нету @deksden_notes

⚪️ Codex app теперь под Linux (preview) Не прошло и несколько лет, как построенный на мультиплатформенном электроне Кодекс ап
⚪️ Codex app теперь под Linux (preview) Не прошло и несколько лет, как построенный на мультиплатформенном электроне Кодекс апп наконец то смогли запустить на линухах! Ура Конечно, можно и ранее было юзать неофициальные репаки - но сейчас можно юзать официальные. Поддерживаются: • Ubuntu 24.04 LTS and 26.04 LTS • Debian 13 • Fedora 43 and 44 @deksden_notes

⚪️ Grok Bot Маск выпускает Grok Bot. Продукт совместный с Курсором - на ios разработчиком числится Anysphere, подписки работа
⚪️ Grok Bot Маск выпускает Grok Bot. Продукт совместный с Курсором - на ios разработчиком числится Anysphere, подписки работают Курсоровские в том числе. Это такой cowork, но подключённый к облачной vm, которая выделяется пользователю (не боту, на всех ботов пользователя - одна эта машина, и они работу могут передавать друг другу). Управялем им с приложений macos/win/ios, android будет позже. Так как агент в облаке на vm, работает даже когда твой комп выключен. ‼️ В общем, интересно, конечно, НО есть одно большое НО - работает только на максимальных подписках - Курсор ультра и Грок СУПЕР Хеви. Получилось как ChatGPT Work который совмещён между облачным режимом (где и у chatgpt есть под капотом немаленькая vm, кто не знает - спросите у него сами про доступный комп) и локальным агентом в приложении. Мне по описанию показалось что у Маска сделано логичнее чем у chatgpt. @deksden_notes

⚪️ Взлом ризонинга фронтира Тут люди взломали ризонинг у антропиков, клозедов, гугла. Те самые шифрованные мысли моделей! omf
⚪️ Взлом ризонинга фронтира Тут люди взломали ризонинг у антропиков, клозедов, гугла. Те самые шифрованные мысли моделей! omfg Почитайте сами чего и как: 🔗 Почитайте тред: https://x.com/kotekjedi_ml/status/2087147042888114428 Из проблем: даже если в трейсах агентов у вас нету данных, то в мыслях моделей они вполне могут встретиться Ну и праздник у китайских вендоров: то, что тщательно шифровали буржуи, легко ломается. Шило - как водится, не удержали. @deksden_notes

Agent Lifecycle Kit: управляемая работа с ИИ-инструментами для разработки Кодовый агент — это инструмент с моделью ИИ, которы
Agent Lifecycle Kit: управляемая работа с ИИ-инструментами для разработки Кодовый агент — это инструмент с моделью ИИ, который по текстовой задаче может изучить проект, изменить файлы и запустить проверки. К таким инструментам относятся Codex, Claude Code, Cursor, OpenCode, Qwen Code и другие. На простой задаче достаточно получить готовое изменение. Но при работе над архитектурой, безопасностью или большой функцией важно также понимать:   - какая цель была поставлена;   - что именно разрешено менять;   - какие этапы нужно пройти;   - какие проверки обязательны;   - почему результат можно считать принятым. Agent Lifecycle Kit (ALK) организует этот процесс от постановки задачи до подтверждённого завершения. ALK помогает:   - принять задачу из текста, Markdown-файла или внешнего документа;   - провести исследование и подготовить план;   - зафиксировать требования, критерии приёмки и границы изменений;   - разделить работу на последовательные этапы;   - сохранить состояние задачи и продолжить её позже;   - проверить результат относительно утверждённого плана;   - собрать подтверждения проверок;   - принять результат или зафиксировать причину блокировки. Главное отличие ALK от кодовых агентов в разделении ответственности:   - кодовый агент анализирует проект, пишет код и выполняет проверки;   - ALK управляет процессом, границами, состоянием, подтверждениями и приёмкой результата. ALK не привязан к одной модели или одному инструменту. Подключения к Codex, Claude Code, Cursor, OpenCode, Qwen Code, Goose, Gemini CLI и другим инструментам выполняются через адаптеры. При этом правила жизненного цикла остаются едиными. Для задач разного уровня используется соразмерный контроль. Небольшая механическая задача проходит короткий путь. Архитектурная, связанная с безопасностью или несколькими исполнителями, получает более строгие проверки. Дополнительная проверка несколькими моделями включается по необходимости. Можно использовать любые доступные сочетания инструментов и моделей: например, один инструмент готовит план, а другие проверяют исследование, архитектуру или  реализацию. Если доступна только одна модель, дополнительная проверка не требуется. ALK работает с большими, малыми и локальными моделями. Компактные задания, ограничения ресурсов и повторяемые проверки помогают экономить контекст, сохраняя требования к качеству. Подробнее: Быстрый старт (https://github.com/avksp/agent-lifecycle-kit/blob/main/docs/ru/quickstart.md) Архитектура системы (https://github.com/avksp/agent-lifecycle-kit/blob/main/docs/ru/architecture/system-architecture.md) Как ALK работает с разными задачами (https://github.com/avksp/agent-lifecycle-kit/blob/main/docs/ru/guides/how-alk-works.md) Сравнение с похожими инструментами (https://github.com/avksp/agent-lifecycle-kit/blob/main/docs/ru/reference/project-comparison.md) Репозиторий проекта (https://github.com/avksp/agent-lifecycle-kit) #opensource #опенсорс

⚪️ Codex Reset Тибо сказал - тибо сделал @deksden_notes
⚪️ Codex Reset Тибо сказал - тибо сделал @deksden_notes

⚪️ Muse Glimmer бенчмарки Интересно, что выше Gemma 4! Неплохо Марк вернулся к опенсорсу (в своём классе, конечно). Почти уро
⚪️ Muse Glimmer бенчмарки Интересно, что выше Gemma 4! Неплохо Марк вернулся к опенсорсу (в своём классе, конечно). Почти уровень кими 2.5, но размер то сильно меньше. Qwen3.6 27B всё равно получется поумнее - что лишний раз говорит о крутости квена в сегменте услоно мелких моделек. 🔗 Анонс бенча: https://x.com/ArtificialAnlys/status/2086916150278111551 @deksden_notes

⚪️ Claude Sonnet 5 остается дешевкой По мнению антропиков - они решили сохранить на постоянку акцию со снижением цен на Sonne
⚪️ Claude Sonnet 5 остается дешевкой По мнению антропиков - они решили сохранить на постоянку акцию со снижением цен на Sonnet, которую объявили при запуске модели. Вместо "стандартной" цены в $3/$15 у нас остаётся $2/$10 Это, конечно, хорошо Но воркер на луне стоит $0.2/$1.2 - это почти х10 дешевле. Дорогая терра стоит на уровне $2/$12. Видимо дороже её не хочет остаться антропик. Но у антропика "выше" по иерархии ещё 2 модели.. В общем, посмотрим на ценовые манёвры фронтира @deksden_notes

Rejudge — независимая проверка для ИИ-агентов. https://rejudge.syabro.com/ru/ https://github.com/syabro/rejudge Выкатываю еще один свой инструмент в паблик Код, который написал агент, можно проверить четырьмя способами, где каждый следующий способ ловит больше предыдущего: I. Та же сессия, та же модель. Агент перечитывает свой код. Он уже решил, что код правильный, и повторное чтение это решение не меняет. II. Новая сессия, та же модель. Контекст чистый, модель прежняя. У неё то же обучение и те же привычки, поэтому она пропускает ошибки, которые написала бы сама. III. Другая модель. Другая модель действительно находит настоящие ошибки. Но теперь у вас два мнения, и когда они расходятся, решать, кто прав, приходится вам. Я сделал дальше: IV. Rejudge: три модели и судья. Все три модели получают один и тот же вопрос одновременно. Каждая работает в изолированном контексте и сама вызывает инструменты, поэтому ни одна не видит, что делают другие. Судья читает все три отчёта, задаёт уточняющие вопросы там, где они расходятся, и пишет один ответ. Плюс агент может отправить дозапрос по session-id в Rejudge если есть что-то что не понравилось. Внутри pi-sdk с поддержкой все провайдеров которые поддерживает Pi. У меня rejudge работает на OpenCode Go (линк реферальный, $5 вам, $5 мне) за $10. Но честно перестало хватать, ибо стал юзать на любой чих, докупил еще один акк. Если есть альтернатива интереснее подскажите в комментах.

{
  "reviewers": [
    "opencode-go/deepseek-v4-pro@xhigh",
    "opencode-go/minimax-m3@xhigh",
    "opencode-go/mimo-v2.5-pro@xhigh"
  ],
  "judge": "opencode-go/glm-5.2@medium"
}
В комплектеrejudge CLI тулза для всех агентов • /rejudge и /rejudge-diff скиллы для работы с Rejudge в целом и проверки диффов, например перед коммитом или на PR • Pi-extension с rejudge tool для красивого UI и более кошерной коммуникации агенту. В комментах отвечу на вопросы. В планах • Прогнать на DeepSWE, посмотреть что получится • Допинать /rejudge-dx-review skill • Интегрировать мой websearch Установка тут: https://rejudge.syabro.com/ru/#install Как обычно с вас лайк, шер, репост, подписка, поглатить ближайшего котика, вот это все. Ваш, @syabro_notes #opensource #mit

🤖 ChatGPT, Claude, Cursor, Gemini - всё в одном месте, не ищи по разным сайтам! 🏃‍♂️ Просто пиши - выдам быстро | @dobrovskiys ⚠️ САМОЕ ВАЖНОЕ! ЦЕНЫ! - Chat GPT Plus/Pro - Gemini Pro - от 1$ | Есть опт - Claude Pro/Max | Claude API 🔝Может ты искал Higgsfield, Kiro, Manus, HeyGen, GROK, Kling, OpenWonder, ElevenLabs, Notion, Loveable, Adobe, Canva, Gamma, n8n, Figma, Factory и многие другие подписки? Они у нас есть! 💵Dobrovski’s Market - Твой проводник в мир подписок! ✈️ Купить ChatGPT | Gemini

⚪️ Промптинг - отрицательные инструкции Нынче развлекаюсь тестами более тупых моделей чем фронтир на обычных агентных флоу. Я давно работал с агентными флоу только на фронтире (конечно, простые модели были в апи в софте, но там другая специфика). А тут в связи с практически "бесплатностью" луны для лимитов, возникла необходимость посмотреть какие стадии флоу нормально делаются моделями попроще. ▶️ Столкнулся с таким эффектом: отрицательные иснтрукции работают крайне плохо. Столкнулся с этим на теме роутинга задачи на выполнение с той или иной детальностью. Агенты на слабых моделях упорно игнорируют инструкции по теме "не запускай субагентов в случае простых задач". Как бороться? Делаем реверс логики. Вместо "не запускай" переписываем этот блок так: по-умолчанию никаких субагентов. Запускать субагентов разрешается в таких случаях: чек-лист. То есть мы перевели отрицательную инструкцию "не запускай, если ..." в положительное правило - "запускай, если ...". Такое работает хорошо даже на простых моделях. Реверс логики не всегда естественный для человека - люди все таки воспринимают отрицательные инструкции получше. Нет, такой подход не решает проблему следования инструкциям - он просто снижает вероятность НЕ следования инструкциям, сформирвоанным "негативно". Пряник и тут эффективнее - особенно если им бить)) ❓ Кто то замечал подобный эффект? как боролись? @deksden_notes

⚪️ Codex Reset Небольшой нежданчик! Тибо обсуждал с Борисом Клод-Кодовичем проблемки парня с баном акканута антропиков, и рас
⚪️ Codex Reset Небольшой нежданчик! Тибо обсуждал с Борисом Клод-Кодовичем проблемки парня с баном акканута антропиков, и расщедрился на ресет. Это было неожиданно! Ну, ок. Спасибо) @deksden_notes

Repost from Этихлид
The Jeff Dean Facts Из Google после 27 лет работы ушёл Джефф Дин - вместе с несколькими коллегами идёт строить Discovery Loop - стартап про ускорение научных исследований с помощью ИИ. Для меня Джефф - это инженер-легенда и один из тех редких профи, на которых всегда хотелось быть похожим. И не из-за должностей и регалий, а потому, что за ним стоят такие проекты, как Google Search, MapReduce, Bigtable, Protocol Buffers, LevelDB, Spanner, Google Brain, TensorFlow, TPU, Gemini. Причём он там не только руководил - он участвовал и в их проектировании, и в создании. Писал код. Своими руками! Если вы в индустрии недавно, его имя может вам ни о чём не говорить, но его наследием вы пользуетесь каждый день. Чел настолько крут, что внутри Google давно родился целый жанр - Jeff Dean Facts, аналог фактов про Чака Норриса. Пользуясь случаем - отобрал самые интересные: (факты с ✓ - правда 🤯)
PIN-код Джеффа Дина - последние 4 цифры числа пи ✓ Когда Джефф Дин проводит семинар в Стэнфорде, слушателей набивается столько, что Дональду Кнуту приходится сидеть на полу Однажды в начале 2002-го, когда упали индекс-серверы, Джефф Дин два часа отвечал на поисковые запросы вручную. Эвалы показали рост качества на 5 пунктов ✓ Джеффа Дина повысили до 11-го уровня в системе грейдов, где максимальный - 10-й Джефф Дин компилирует и запускает код перед коммитом - но только чтобы проверить компилятор и процессор на баги Недовольный константным временем, Джефф Дин создал первый в мире алгоритм O(1/n) ✓ Когда Джефф Дин уходит в отпуск, продакшн-сервисы по всему Google начинают загадочно падать через пару дней Джефф Дин однажды сдвинул бит так сильно, что тот оказался на другом компьютере На собеседовании в Google Джеффа спросили, что следовало бы из равенства P=NP. Он ответил: "P = 0 или N = 1". Затем, пока собеседующий ещё не перестал смеяться, Джефф присмотрелся к публичному сертификату Google и выписал приватный ключ на доску Вы используете свой мозг на 10%. Остальные 90% заняты одной из мап-редьюс джоб Джеффа Дина В резюме Джеффа Дина перечислено то, чего он не делал - так короче Для Джеффа Дина "NP" означает "No Problemo" Джефф Дин однажды написал алгоритм O(n^2). Это нужно было для решения задачи коммивояжёра Джеффу Дину пришлось изобрести асинхронные API однажды, когда после его оптимизации функция вернула значение прежде, чем её вызвали Скорость программирования Джеффа Дина выросла в 40 раз в конце 2000 года, когда он проапгрейдил клавиатуру на USB 2.0 Когда Джефф Дин разрабатывает программу, то сначала создаёт бинарник, а потом пишет исходный код как документацию Компиляторы не выдают варнинги Джеффу Дину. Джефф Дин выдаёт варнинги компиляторам IDE Джеффа Дина не делает анализ его кода - она делает ему комплименты Джефф Дин не пользуется ECC-памятью: он предвидит попадания космических лучей и использует их для оптимизации Джефф Дин однажды не прошёл тест Тьюринга, потому что правильно вычислил 203-е число Фибоначчи менее чем за секунду Джефф Дин однажды поднял веб-сервер одним вызовом printf(). Другие инженеры добавили тысячи строк комментариев с пояснениями, но так и не поняли, как он работает. Сегодня эта программа известна как Google Web Server Это Джефф Дин откусил кусок от логотипа Apple Чак Норрис может вас убить. Джефф Дин может сделать вам kill -9 Джефф Дин умеет парсить HTML регулярками... правильно Когда Джефф не может заснуть, он мап-редьюсит овечек Когда в вашем коде undefined behavior - вы получаете сегфолт и битые данные. Когда undefined behavior в коде Джеффа Дина - прискакивает единорог на радуге и раздаёт всем бесплатное мороженое Джефф Дин умеет инстанцировать абстрактные классы gcc -O4 отправляет ваш код Джеффу Дину на полную переработку Джефф Дин всё ещё ждёт, когда математики найдут шутку, которую он спрятал в разрядах числа пи Джефф Дин родился 31 декабря 1969 года в 23:48. Ему потребовалось 12 минут, чтобы запустить свой первый счётчик времени Когда Джефф Дин говорит "Hello, World", мир отвечает: "Hello, Jeff" Джефф Дин умеет получать единицы из /dev/zero Google однажды пришлось съехать из дата-центра: Джефф Дин случайно сжал поисковый индекс так плотно, что образовалась чёрная дыра Скорость света в вакууме была 55 км/ч. Затем Джефф Дин потратил уикенд на оптимизацию физики Джефф Дин изобрёл MapReduce, чтобы сортировать письма фанатов Процесс, убитый сигналом SIGJEFF, больше никогда не запускается На клавиатуре Джеффа Дина две клавиши: 1 и 0 Часы Джеффа Дина показывают секунды с 1 января 1970 года. Он никогда не опаздывает Код Джеффа Дина такой быстрый, что ассемблеру нужно три опкода HALT, чтобы его остановить Джеффу Дину приходится деоптимизировать свой код, чтобы ревьюеры поверили, что его писал человек Веб-поиск - это просто большой юнит-тест, который Джефф написал для своего настоящего приложения Джеффу Дину не нужны колонки и наушники. Он делает cat *.mp3, бросает взгляд на экран - и мозг декодирует музыку в фоне, пока он работает ✓ Джефф Дин официально сертифицирован как человек, умеющий читать Perl Джефф Дин сортирует бельё квиксортом Кнут прислал в Google экземпляр "Искусства программирования". Джефф Дин подписал его и отправил обратно Когда Ричард Столлман узнал, что автобиография Дина выйдет эксклюзивно на платформе Amazon, он купил Kindle Джефф Дин умеет сжимать случайные данные без потерь Когда Джеффа Дина спросили, правдивы ли факты о нём, он ответил: "111111". Пока интервьюер соображал, что он имеет в виду, Джефф пояснил: "каждый бит в них - чистая правда"
Штош, удачи, Джефф! 🫡 #respect

⚪️ Новости AI SWE - дайджест, часть 2 Думали, - все? Как бы не так)) ▶️ Palywright обновился: много доработок. Поддержка тестрования passkey, AbortSignal почти везде, симуляция DnD через locator.drop(), прямой доступ на чтение/запись к page.localStorage / page.sessionStorag, 🔗 Полный лог: https://playwright.dev/docs/release-notes Анонс - https://x.com/playwrightweb/status/2085055175438516590 А ещё доработали тестирование компонентов - анонс https://x.com/playwrightweb/status/2085055254689992712 и описание https://github.com/microsoft/playwright/issues/42139 Теперь создаём story и есть страничка gallery с ними. —— ▶️ Open Kimi PPT Skill: помните Kimi Slides такой есть? чел разобрал как оно работает и сделал по мотивам скилл. Можно посмотреть подходы к тому, как делать агентами презентации. 🔗 ритхаб: https://github.com/Binaryify/open-kimi-ppt-skill/blob/main/README_EN.md —— ▶️ takumi-pdf: чел пилит движок, который напрямую пишет pdf из jsx + tailwind. Не нужен хром, можно запускать на разных edge окружениях. Rust. PDF/A, все такое. Активно развивается. 🔗 Акк в твиттере с анонсами: https://x.com/kanewang_ 🔗 Гитхаб: https://github.com/kane50613/takumi 🔗 Офсайт: https://takumi.kane.tw/ —— ▶️ Vercel представил приватные паки для навыков: теперь можно не отдельные скиллы публиковать, а паки скиллов, что будет поудобнее для команд. Паки для каждого аккаунта закрыты, ими делятся в рамках Vercel аккаунта с коллегами. Публично паки нельзя зашарить. В пак добавляем репо гитхаба, локальные папки, иди опубликованные на skills.sh скиллы. 🔗 Анонс: https://vercel.com/changelog/skill-packs-are-now-available 🔗 Раздел на сайте: https://www.skills.sh/packs —— ▶️ OpenDesign новости. Добавили к себе модель DS4flash, на некоторое время бесплатно. Анонс: https://x.com/OpenDesignHQ/status/2084586169107386834 Чел написал книжку про openDesign: анонс - https://x.com/imehr/status/2084936431118729431 и репо книжки https://github.com/imehr/open-design . Не знаю, будут ли читать её люди, но может агенту пригодится. И OpenDesign в плагины кодекса добавили - анонс https://x.com/OpenDesignHQ/status/2084984244762210484 —— ▶️ Overeasy: файловая система поверх S3 от Modal. Ориентирована на работу с агентами, легко бранчится, есть CLI. 🔗 Анонс: https://x.com/erikdunteman/status/2085899578436657661 🔗 Гитхаб: https://github.com/modal-labs/overeasy —— ▶️ OpenTag: открытая альтернатива Claude Tag (бот для Slack / MS Teams). Работает поверх Channels SDK. 🔗 Анонс: https://x.com/svpino/status/2085715688698806651 🔗 Репка: https://github.com/CopilotKit/OpenTag —— ▶️ OriHarness: опенрутер выпустил утилиту для конфигурирования упряжек для работы с ним. Поддержаны Claue code, codex, openCode, hermes. Обещают правильную и оптимальную конфигурацию для работы. Удобно! Надо будет расковырять что именно они там придумали настраивать. 🔗 Блог: https://openrouter.ai/blog/announcements/ori-harness/ 🔗 Анонс: https://x.com/OpenRouter/status/2084708457631060359 @deksden_notes

⚪️ Новости AI SWE - краткий формат Для разгребания бэклога новостей используем формат дайджеста, чтобы не спамить пучками нов
⚪️ Новости AI SWE - краткий формат Для разгребания бэклога новостей используем формат дайджеста, чтобы не спамить пучками новостей в канал. ▶️ Новости Клода: наконец то разрешили обмениваться сообщениями между сессиями. ранее можно было между агентами чатится. В кодексе тоже можно. 🔗 Анонс: https://x.com/ClaudeDevs/status/2085817074816070014 🔗 Дока: https://code.claude.com/docs/en/cross-session-messaging С 14 августа в Клод Коде будет дефолтом авто-режим разрешений на действия агента. Они протестировали и решили что он ок. Аналог кодексового Approve-for-me. Он лимиты, кстати, весьма бодро кушал - расход токенов приличный. 🔗 Анонс: https://x.com/ClaudeDevs/status/2085794862608318627 ▶️ Грок выпустил - думаете обещанный 4.6? Нет. Новую картиночную модель Imagine Image 2.0 - улучшено следование промпту, редактирование. Доступно в вебе, в апи позже. 🔗 Анонс: https://x.com/grok/status/2085931542262526102 🔗 Новость: https://x.ai/news/grok-imagine-image-2 Уже рекламируют что цензура R-rated совсем слабая, а также что копирасты в печали )) https://x.com/TomLoweCinema/status/2085976911055065350 Не проверял, но звучит завлекательно —— ▶️ Куча вполне годного чтения от Cloudflare. Не читаете сами - скормите агенту/в гемини ноутбук, получите выжимку. Оно полезное. 🔗 How Cloudflare enforces engineering standards using AI : https://blog.cloudflare.com/engineering-standards-enforcement/ и анонс https://x.com/CloudflareDev/status/2084708447053042102 🔗 Give any website a WebMCP interface : https://blog.cloudflare.com/webmcp/ и https://x.com/rseroter/status/2085789821554008098 В целом, WebMCP заслуживает внимания - это превращение любого сайта в набор инструментов для ИИ агента. Годная тема. Я попытаюсь ими публикацию на сторонних ресурсах автоматизировать. 🔗 Сторонний блог про Cloudflare-OS, про её смысл: Cloudflare OS is an architecture of distrust - https://lord.technology/2026/08/05/cloudflare-os-is-an-architecture-of-distrust.html 🔗 Про новый стандарт MCP (мы анонсировали его в канале, тут про него ещё раз пишет уже CF): The next generation of MCP - https://blog.cloudflare.com/mcp-v2/ и https://x.com/mattzcarey/status/2085352166017937765 —— ▶️ У Минимаксов свой кодинговый агент на базе Pi: MinimaxCode 2.0: 🔗 Анонс: https://x.com/MiniMaxAgent/status/2085679716976243045 Это ремейк софта, загружать тут - https://agent.minimax.io/download Дока: https://agent.minimax.io/docs/code/welcome Да, сильно похоже на кодекс апп. Исходников (пока?) нету. —— ▶️ Маленькая блогозапись от exe.dev - архитектура их агентой системы, какие автономные циклы они прикрутили. Небезинтересно 🔗 A Non-Exhaustive Inventory of exe's Software Factory : https://blog.exe.dev/inventory @deksden_notes

⚪️ Текущие впечатления от поколения 5.6 и флоу Много обсуждали в чате, и, пользуясь служебным положением, резюмирую впечатлен
⚪️ Текущие впечатления от поколения 5.6 и флоу Много обсуждали в чате, и, пользуясь служебным положением, резюмирую впечатления от поколения gpt моделей 5.6 Использую, как и все, наверное, Sol и Luna. Terra остаётся не у дел: не ясно зачем она нужна - расход немаленький, а качество пониже Sol. ▶️ Планирую Sol. Попытки планирования Луной не сказать чтобы провальные, но она заметно больше упускает, не так глубоко прорабатывает, и делает все сильно дольше. Что у Sol хорошо: он действительно может глубоко проработать. High / Xhigh ризонинга мне хватало. Max / Ultra практически не включал, смысла не вижу. Что у Sol плохо: мощная тяга все усложнять. Без промптинга на жёсткое упрощение навыком Ponytail/аналогами все время получаем космолёт. И в предыдущих поколениях такое было - но сейчас это правило усложнить на ровном месте . Снижение ризонинга помогает слабо и заметно слабее проработка деталей - поэтому приходится спасаться промпингом. Что ещё плохо: лимиты Sol просто кушает. Кодинг на Sol по качетсву ок, времени мало занимает, пишет сразу все хорошо, но даже на Medium/Low лимиты тают ▶️ Что у Луны хорошо: лимиты практически не кончаются. Я уже и количество подписко в пуле снизил (пока на четверть), потому что у меня остались лимиты при текущей загрузке! Думаю, с таким расходом можно повышать использование, больше проектов одновременно и больше сессий. Надо добивать облачный оркестратор. Что у Луны ещё хорошо: она, в принципе, недурственно справляется со всеми конкретно поставленными задачами. Что у Луны плохо: она не так внимательна, как Sol. Может что-то упускать. Спасает ревью. Что ещё у Луны плохо: скорость. Модель не особо летает, и думает она медленно, токенов на max тратит немало. Что ещё у Луны плохо: если встретилась проблема в протоколе (что то не учли заранее или прописали так, что остаётся люфт) - может под goal очень и очень долго ходить кругами и предлагать ерунду вместо решения проблемы. За долгими сессиями надо следить - благо сейчас /side во время сессии позволяет получить справку чего там происходит, что сделано, что не сделано, какие проблемы. ▶️ Насчёт флоу: не могу нащупать баланс - рельсовые флоу получаются очень долго все прорабатывают, могут крутится часами. Качество, конечно, хорошее - но оптимизации затруднены. Попытки делать роутинг простых задач в более простой флоу автоматически приводят к тому, что модели часто видят ситуацию сложнее, чем оно того стоит, в итоге выбирая более тяжёлые флоу чем я бы выбрал "руками" и чем оно того стоит. Не уверен в том, как это чинить - вроде бы упрощать флоу не хочется, для сложных вопросов оно такое надо, но проблему траты кучи времёни надо решать. Пока склоняюсь к созданию облачного оркестратора и работе просто с большим количеством параллельных сессий. Интерактивные сессии с простыми вручную вызываемыми скиллами - тоже вариант, но чтобы получилось качественно, надо много руками дёргать скиллов/субагентов. Без проработки скиллами/субагентами на проектах крупнее 30-50к loc уже получается слоп. ▶️ В целом, я скорее за рельсовые флоу по мотивам SDD / TDD/ BDD, но надо придумывать как бороть их недостаток: очень "тяжелые". Уже разные оптимизации придумываю, всякий роутинг автоматический, всякий вариант не фокусными агентами делать, а группировать в субагентов аспекты пачками. Есть ещё одна задумка: дорабатывать фичи более лёгким флоу, с последующей глубокой проработкой рефакторингом в фоновом режиме (ночью, в облаке, например) - но это все упирается в слабую способность моделей пилить качественную и простую архитектуру. Надежда на астру в этом плане - нужна не оверинжиниринг в моделях, а сеньёрность, умение сделать максимально просто но с полным функционалом. Ponytail это пробует зафорсить, становится лучше, но здравого смысла к сожалению, добавить не всегда может. Возможно, секрет в нескольких агентах и их коллаборации по таким вопросам. Вопрос требует исследований и экспериментов - делитесь если кто то туда же думает. 👉 Примерно так. Можно спрашивать если что то развернуть или невнятно описал. @deksden_notes

⚪️ Неделя без ресетов Заканчивается первая за последнее время неделя без ресетов кодекса Прошла тяжело, народ уже ломало к за
⚪️ Неделя без ресетов Заканчивается первая за последнее время неделя без ресетов кодекса Прошла тяжело, народ уже ломало к завершению Попытка подсадить на продукт - увенчалась! Уверен, что если слухи о продажах ресетов за деньги будут правдой - то "прогрев гоев" считаю успешным, народ готов. Я перебивался лунамаксингом, но границы этой модели начинают нащупываться. ❓ Что думаете? Как у вас прошло? @deksden_notes