fa
Feedback
DEKSDEN notes

DEKSDEN notes

رفتن به کانال در Telegram

Мои заметки на разные темы, уровень - "для продолжающих") Vibe Coding -> AI SWE, AI Coding Tools, Agents: Claude Code, Codex, news, links Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi (с) 2025-2026, @deksden

نمایش بیشتر
2 972
مشترکین
+524 ساعت
+187 روز
+12230 روز
آرشیو پست ها
👉 Подписки для работы с ИИ, удобный market: apel0sin_market_bot Из того, что сейчас особенно интересно: • ChatGPT Plus Edu и Chatgpt plus, подходит для Codex • Super grok + X premium+ по самой низкой цене • Gemini Pro + 5TB на 18 месяцев • разные ИИ-сервисы и подписки под работу, учебу и код Оплата есть через СБП, крипту и CryptoBot. Большая часть выдачи автоматическая, поэтому не нужно долго ждать ручной обработки. Гарантии указываются в конкретных товарах. • ОтзывыИх канал, там промокоды на деньги

⚪️ Grok 4.5 Маск подумал что лучшего момента смазать презентацию 5.6 у клозедов ждать не стоит, и оперативно зарелизил свой G
⚪️ Grok 4.5 Маск подумал что лучшего момента смазать презентацию 5.6 у клозедов ждать не стоит, и оперативно зарелизил свой Grok 4.5 🔗 Почитать : https://x.ai/news/grok-4-5 🔗 Дока : https://docs.x.ai/developers/grok-4-5 Вкратце: • бенчи - заявлено хуже Фубли, лучше Опуса 4.8 (посмотрим) • сильно быстрее многих - 80 tps (неплохо, но это скромнее многих Fast режимов); • дешевле - $2/$6 (оч гуманно) • контекст 500k • особенно отмечено что знает Excel, PPT, Word • уже в Grok Build и Cursor • в EU после середины Июля Ну - раз подписка есть, попробую @deksden_notes

⚪️ Релиз от OpenAI !.. ... но не тот, который мы все ждем. 🔗 Бложик: https://openai.com/index/introducing-gpt-live/ gpt-live
⚪️ Релиз от OpenAI !.. ... но не тот, который мы все ждем. 🔗 Бложик: https://openai.com/index/introducing-gpt-live/ gpt-live-1 Более лучшая голосовая модель реального времени, уже в ChatGPT Voice. Неужели в Codex на диктовку поставят командовать Солнышком? Посомтрим

⚪️ TinBase: локальный Supabase Наткнулся на интересный проект Это локальный Supabase в одном бинарнике, даже без докера (хотя
⚪️ TinBase: локальный Supabase Наткнулся на интересный проект Это локальный Supabase в одном бинарнике, даже без докера (хотя он бы и не помешал) - полностью совместим с supabase-js SDK, но меньше и менее прожорливый. Похож на PocketBase, но вместо простенького SQLite полноценный PostgreSQL Выглядит полезным! 🔗 Оффсайт: https://www.tinbase.dev 🔗 Гитхаб : https://github.com/sanketsahu/tinbase @deksden_notes

⚪️ TypeScript 7 уже здесь Релиз! Выпустили TS 7 Я понимаю - это уже скорее для агентов, но... 🔗 почитать : https://devblogs.
⚪️ TypeScript 7 уже здесь Релиз! Выпустили TS 7 Я понимаю - это уже скорее для агентов, но... 🔗 почитать : https://devblogs.microsoft.com/typescript/announcing-typescript-7-0/ Из главного, что я отметил - сильно быстроее компилятор стал. Местами х10! Хорошо (ц) новости для агентов @deksden_notes

⚪️ Рыбный день Интрига сбита. Релиз линейки 5.6 точно завтра! Ждем-с @deksden_notes
⚪️ Рыбный день Интрига сбита. Релиз линейки 5.6 точно завтра! Ждем-с @deksden_notes

⚪️ Orchids.app Bun.app всё! Скушан Figma Кто помнит - такой UI ориентированный веб билдер был, неплохой UI делал, react прило
⚪️ Orchids.app Bun.app всё! Скушан Figma Кто помнит - такой UI ориентированный веб билдер был, неплохой UI делал, react приложение.. Потом они зачем то ребрендинг делали, какой то вроде пивота - и вот - отмучались. Писал про них давно: https://t.me/deksden_notes/467 Больше нету - с 18 июля закроется, команда перешла в Figma. Жалко? Не особо. UI дела уходят в штатных агентов и навороченные тулы типа ClaudeDesign / OpenDesign. Хотя - это было быстро)) (ц) это жизнь! @deksden_notes

⚪️ Еще раз про Advisory Я ранее мисал уже про этот инструмент в СС: https://t.me/deksden_notes/824 Интересно, что сами Антроп
⚪️ Еще раз про Advisory Я ранее мисал уже про этот инструмент в СС: https://t.me/deksden_notes/824 Интересно, что сами Антропики ровно так и советуют пользовать Фублю, я угадал (это было несложно). Видимо, готовят народ к апи ценам, чтобы всем не было слишком больно. Схема и вправду мне представляется отличной. Присмотритесь, не ровен час будет нужна! Бенчи приличные, их в комменты кину Почитайте описание в предыдущем посте. Ну и дока на всякий пожарный: 🔗 дока: https://platform.claude.com/docs/en/agents-and-tools/tool-use/advisor-tool Бенч в комментах ⬇️ @deksden_notes

⚪️ Quotio v0.22 У тулзы которую я пользую поверх CPA для менеджмента своего пула аккаунтов кодекса новая версия с мелкой, но
⚪️ Quotio v0.22 У тулзы которую я пользую поверх CPA для менеджмента своего пула аккаунтов кодекса новая версия с мелкой, но нужной функцией - теперь показывает ресеты в деталях аккаунта кодекса в меню баре. наводите и смотрите, пример в КДПВ! (ц) Мелочь, а приятно! @deksden_notes

⚪️ Vercel скушал BetterAuth Есть неплохой проект в мире TS для авторизации во всем что только можно - Better Auth. Теперь это
⚪️ Vercel скушал BetterAuth Есть неплохой проект в мире TS для авторизации во всем что только можно - Better Auth. Теперь это у Vercel. Они упорно собирают все инфраструктурные проекты! Ну - хоть ClaudFlare туда же собралась - будет какая то конкуренция. @deksden_notes

⚪️ Loop Engineering Какое то время назад на хайпе проскакивала тема Loop. Русскоязычные названия почему то в голову лезут не
⚪️ Loop Engineering Какое то время назад на хайпе проскакивала тема Loop. Русскоязычные названия почему то в голову лезут не совсем приличные! Но тему раскачивали и Борис из Клод Кода, и куча других известных персонажей. Суть Loop: агенты работают в цикле, пока не выполнят задачу. Такой режим работы поддерживается штатными функциями упряжек типа /goal команд. ▶️ Поделюсь своим опытом. Да, у меня давно существвует и в какой то мере отработан стандартный SDLC флоу : цепочка этапов prime -> discuss -> specify -> plan -> code -> merge. Но это не тот цикл, о котором хотел поговорить. Для некоторых проектов у меня есть задача отработки какой то функциональности. В частности, в боте, работающем с базой знаний - это пайплайн импорта (когда бот "читает" и перерабатывает знания из источников разного рода в граф), и пайплайн "ответов" по этой базе. Что я сделал. Я создал систему агентных тестов (назвал их экспериментами, хотя это скорее эвалы - ну, исторически такой вот термин, хоть и не точный). Агент, используя специальный раннер, запускает код пайплайна на заранее подготовленных данных определенного формата. По итогам запуска, делается агентное ревью результатов, мульти-аспектное исследование субагентами качества переработки знаний по разным критериям. Да, вы правы - это весьма похоже на интеграционный тест: только логика оценки результатов не детерминированная, а агентная. ▶️ Так вот. Я сделал простой цикл: прогнав "эксперимент" агент оценивает результаты. Если выявлены существенные отклонения по качеству, агент начинает короткий SDLC цикл: • смотрит выявленные существенные отклоненния • устанавливает причину в коде • анализирует "истинную причину" - смотрит "сверху вниз", чтобы чинить не следствия, а причины • создает новый протокол на устранение недоработок • прогоняет протокол по стандартному флоу plan -> code, там на plan много проработок протокола "вглубину" еще делается; • с исправлениями запускает эксперимент снова - цикл повторяется Все это работает под командой /goal в кодексе. ▶️ Наблюдения: в принципе, схема рабочая. Циклы крутятся по суткам и больше, и достигают результатов. Один пайплайн на ответы был доработан, циклов было сделано 8, времени - 3 часа примерно. Результат хороший. С циклом на импорт знаний ситуация похуже - он сильно сложнее, и крутится уже вторые сутки. Протоколов сделано более 20, процесс идет. 👉 Проблемы: есть небольшой дрифт логики работы - инструкции заставляют перечитывать промпты, но не все моменты цикла зафиксированы в промптах, что то, видимо, не учтено. то есть требуется более тщательное прописывание логики работы цикла - промпт /goal тут не совсем подходит. Схема защиты от хождения по кругу (с исправлением примерно одного и того же) требует доработки. Видимо, нужно придумать схему "гипотез". Я бы предпочел реализовать этот цикл на детерминированном dynamic workflow - чтобы четко прописать логику работы, но такого пока в стандартном кодексе нету - хоть изучай сторонние решения! Промптами такое прописывается не совсем надежно, дрифт после многих часов работы видимо возможен. Отладка таких процессов немного затруднена их длительностью. Пока не придумал удачной observability для такого флоу: данных же очень много, надо выделять что то существенное. 👉 Плюсы: оно условно само дорабатывает софт в заданном направлении. Просто требуется наработать опыти правильно это все организовать. Направление интересное - можно придумать разные циклы подобного рода. ❓ Вы забавляетесь чем то подобным? Интересная обратная связь и опыт @deksden_notes

⚪️ Апи-геддон на Клоде откладывается до 12 июля! Антропики не решились дернуть рубильник в ранее намеченную дату 7 июля, и Фу
⚪️ Апи-геддон на Клоде откладывается до 12 июля! Антропики не решились дернуть рубильник в ранее намеченную дату 7 июля, и Фубля будет с нами на подписке до 12 июля. Видимо, приняли решение стрелять в ногу дуплетом - если 12 отключат Фублю, то 13 кончается акция на х2 лимиты.. .. или они пойдут по пути Санлайта и прощальных концертов Пугачевой - и Фубля будет прощаться, но не уйдет? @deksden_notes

⚪️ Нативный GLM субагент в codex Тут побаловался немного с прикручиванием GLM в Codex cli. Зачем? Идея - брать "второе мнение
⚪️ Нативный GLM субагент в codex Тут побаловался немного с прикручиванием GLM в Codex cli. Зачем? Идея - брать "второе мнение" на некоторых флоу при планировании, при ревью. Мульти-модель всегда давала какой то буст в перфомансе, раскажу потом о конкретике - что удалось добиться, это отдельно. Сейчас расскажу о деталях "прикручивания". ▶️ В чем нюансы? z.ai дает openai-compatible ручки формата completions. А codex хочет более новый формат Responses API. Следовательно, нужен слой трансляции API - благо сейчас это не проблема. У меня базовый сетап был построен так: стандартный CODEX_HOME был для Codex.app чтобы спокойно без прокси логинится в какой то аккаунт (при работе через CPA часть функций либо не доступна, либо глючит - поэтому лучше напрямую). Основную работу я делаю через Codex cli (Cmux) и для него сделан отдельный профиль/home, запускаемый скриптом "cx". Он подключает codex к прокси с пулом аккаунтов, управляемых приложением Quotio. Под капотом там тот же CliProxyApi, дефолтный порт 8317. Его я и взял для трансляции API для GLM. Настроил систему под GLM: • сделал отдельный инстанс CPA на другом порту 8327 с glm-провайдером; там и ключ подтягивает от z.ai coding plan; • добавил в конфиг кодекса нового провайдера - локальный glm прокси на 8327; • сделал кастомного субагента "glm" с указанием модели glm-5.2 и ризонинга high, ну и провайдера из конфига; • добавил в конфиг codex cli нового провайдера - локальный glm-прокси; • сделал скрипты для glm-прокси, которые стартуют/останавливают/обновляют ядро CPA/статус текущий показывают. ▶️ получилось несколько конфигов, ссумирую еще раз: • Дефолтный codex.app без CPA • Конфиг для Codex CLI который настроен на пул аккаунтов Quotio/CPA, дополнительно там прописан провайдер GLM-прокси, и кастомный субагент "glm" который подключен к этому провайдеру. ▶️ В codex есть multi-agents v1 и новый v2. TLDR: c v2 работать не будет, там пока баги. Выключайте экспериментальный v2, он еще даже не beta версии. Надеюсь его доработают. Пока - рабоатем с v1. Важно: сессии, которые начаты с v2, прийдется стартовать заново, переключить "движок" субанентов в сессии во время работы нельзя, только при старте новой сессии. Запоминает в jsonl файле. ▶️ В целом все рабоатет, можно играцца дальше 👉 Агент все это может вам сделать на вашем сетапе, но нужно "прогреть" его гугленьем конкретных штук - проект CPA, Z.ai доки, доку/исходники codex cli. @deksden_notes

⚪️ Hy3 - бесплатно Пока мы тут ожидаем три-релиз фронтирной гпт, можно размяться очередным приплывшим с поднебесной китом - в
⚪️ Hy3 - бесплатно Пока мы тут ожидаем три-релиз фронтирной гпт, можно размяться очередным приплывшим с поднебесной китом - вышла Tencent Hunyuan 3. Из интересного - бенчи сразу пропускаем, скажу только что в бенчах средний для китов результат, на КДПВ видно что где-то получше, где то похуже китовых грандов. Интересно другое: free api на openrouter до 21 июля! Не оч быстро, 65 tps, провайдер - Novita. Самое время попробовать, подключить как "третье мнение" в ревью, заморочится и сделать таки интеграцию в свой флоу.. В общем - есть бесплатный период на эксперименты Посмотрел буржуйские китовые подписки - там нету. В Droid Core отсутствует (зато там завезли таки GLM 5.2 Fast и Minimax M3 появились), в OpenCode Go / Cline Pass нету, они с Tencent вроде и не работали. Ну и ладно - опенрутер уже отлично. (ц) Хорошо же! @deksden_notes

⚪️ Готовимся к три-релизу 5.6? Все мы знаем что релиз линейки моделей gpt 5.6 готовится. Есть данные и про завтра, и про четверг и про четверг следующей недели - это уже область гаданий и ставок на полимаркетах. ❓Вопрос другой: готовите свои флоу к релизу линейки моделей? Что думаете? ▶️ Я вот уже все распланировал как меняю в оркестраторе модели. Sol думает/планирует/ревьюит, Terra кодит и верифицирует, Moon будет исследовать. Это первый такой релиз гпт, чтобы в поколении вышло семейство моделей одного поколения. Даже антропик сейчас линейку двигает урывками, хотя концепция линейки моделей - его (как и много других концепций в AI SWE / ИИ в целом). @deksden_notes

⚪️ Хвиттерские сравнения моделей Вот почитывая хвиттер, решулярно натыкаюсь на такой вот жанр обзоров: 🔗 Пациент : https://x.com/naymur_dev/status/2073059979834331206 Чел сделал ваншотом флаппибёрд на GLM-5.2 / DeepSeek v4 Pro / Fable 5 и сравнивает их результаты. Но я не про это - почитайте источник кому интересно, что Фубля вышла самой дорогой (неожиданно!). ▶️ У меня смешанная реакция на такой контент. С одной стороны - это практический тест, наглядный результат, оценка цены. Вроде, делается попытка вывести соотношение цены/качества с каким то выводом. Что меня тут настроаживает я думал и придумал: ваншот я НЕ использую от слова совсем. Мне вообще мало где можно применить ваншоты - нету таких проектов и применений, совсем нету! Мои проекты работают по флоу из моего меморибанка, праймятся контекстом проекта, отрабатывают пайплайны промптов в циклах SDLC, крутят лупы с эвалами/экспериментами. Мне важны другие качества модели - как она планирует, как оркестирует. Ну - для кодеров - как пишет код по спеке. Как валидирует, как генерирует идеи экспериментов. И вот такие ваншоты мне не говорят НИЧЕГО. Более того - они разъезжаются с моей практикой! Потому что дорогой запуск умной модели на планировании бережет мне кучу времени, токенов на переделке кода/тестов/сценариев/экспериментов/эвалов - и в итоге делает разработку быстрее и дешевле. Такой вот пердимонокль ❓ Что думаете? Есть такая буква? @edksden_notes

⚪️ Shadcn/ui теперь по дефолту на Base UI Новости параллельной вселенной. Shadcn/ui переходит в дефолте на BaseUI с более дре
⚪️ Shadcn/ui теперь по дефолту на Base UI Новости параллельной вселенной. Shadcn/ui переходит в дефолте на BaseUI с более древнего RadixUI. В целом - ок. BaseUI как новая инкарнация подходов Radix выглядит понаряднее, и уже довольно стабильная. Агенты знают эту штуку более-менее. Норм, кмк ❓ Вы на base или еще на radix? @deksden_notes

⚪️ Anthropic API rate limits увеличены Соннет/хайку на высоких тирах - аж в 5 раз! И при этом логика апгрейда тиров отвязалас
⚪️ Anthropic API rate limits увеличены Соннет/хайку на высоких тирах - аж в 5 раз! И при этом логика апгрейда тиров отвязалась от суммы трат, можно просить перевести на более высокий тир самостоятельно, из консоли. Дарио не может отказать вам в желании лить ему деньги скорее и больше! (ц) это хорошие новости? Я запустался @deksden_notes

https://mdtask.dev https://github.com/syabro/mdtask 😮 Выкатываю в паблик mdtask - markdown-based тасктрекер для evergreen SDD. Который пилю и использую уже пару месяцев. Тлдр: задачи лежат в файлах со спеками и спека обновляется с кодом в одном коммите с закрытием задачи. Плюс cli и три скилла как заводить, выполнять и хранить К любым таск трекерам у меня всегда была особая любовь. Думаю это началось где-то с traq. Кастдевмлил народ под свой, потому что джира была тумач и тормозила. В итоге положил на полку ибо ресурсов на второй линеар точно не хватило бы. А вот когда начал работать с агентами достал и стряхнул пыль. Сильно не хватало какой-то простой и понятной системы для того, чтобы можно было сохранить, засунуть луп и сказать агенту «делай это». И чтобы спеки были first-time citizen. - Openspec слишком перегружен. - Linear/JIRA для мелких продуктов это перегруз + спеки 100% идут по одному месту если не следить. - Просто список задач? Не хватает, но с этого начал. Сделал mdtask. 😲 Нахуя и главное зачем 1. Задачи хранятся локально. В markdown. Это легко читать-писать-изменять-whatever как кожаному так и агенту. Никаких саасов. Легко начать, не понравится - данные все еще ваши. 2. Задачи хранятся в файле спеки. Отсюда один файл = что уже есть + что будет. И легко трекать если спека не обновилась а задача какого-то хера закрылась 3. В одном коммите лежит код, обновление спеки и закрытая задача. В логах это будет полезно 4. CLI тулза на ноде. Умеет автоматически проставлять ID и показывать список задач по проекту с фильтром - по дефолту показывает незаблокированные и незавершенные задачи. @blocked_by из коробки 5. Набор скиллов /mdtask (описание, формат задач, sdd), /mdtask-add (создание задачи) /mdtask-do флоу для выполнения. То что наполировалось за время использования Ю Из идей html view для проекта. И eagle eye view для кучи. Короче вот они данные только руку протяни. Делай что хочешь поверх Короче топ, рекомендую :) С вас шер, звездочка и рассказать что неудобно 🙃

⚪️ Claude Code Artefacts на Pro, Max тарифах Сделали дост упными Артефакты из Claude Code на тарифах Pro / Max. Артефакты - э
⚪️ Claude Code Artefacts на Pro, Max тарифах Сделали дост упными Артефакты из Claude Code на тарифах Pro / Max. Артефакты - это аналог canvas, но теперь антропики не просто в чате их показывают в сайдбаре, а хостят на своем сервере, смотреть их списком можно claude.ai/code/artefacts. Это живая интерактивная страничка, у которой есть URL для ее просмотра. Claude Code может обновлять этот артефакт в ходе работы в сессии. Артефакты здорово подходят для отчетов о задаче, дашбордов, визуализаций различных. Это не может быть веб приложением, бэкэнд не предусмотрен. 🔗 Дока : https://code.claude.com/docs/en/artifacts @deksden_notes