DEKSDEN notes
Open in Telegram
Мои заметки на разные темы, уровень - "для продолжающих") Vibe Coding -> AI SWE, AI Coding Tools, Agents: Claude Code, Codex, news, links Чат (!!!): https://t.me/+B1fB3sZbaVthMDhi (с) 2025-2026, @deksden
Show more2 999
Subscribers
-424 hours
+297 days
+12630 days
Posts Archive
3 002
Кодекс устаёт и выгорает
Аж 3 минуты работал!
редко, но ловит какую то хрень в контексте что отказывается нормально работать.
Хорошо можно контекст выкинуть и в другом начать
3 002
Grok Code?
Полку cli агентов прибыло скоро может прибыть.
Ну - посмотрим, конечно.
3 002
Мультисмплинг в Jules
Как там говаривали гуглеры? Ship! ship! ship! Раш не одними китайцами - что гуд.
👉 Жульес разродился мультисемплингом и некоторыми приятными допиливаниями.
Можно сделать 2 варианта на указанный промпт. Вопрос, конечно, кто там их потом сравнивает и как - но это за скобками и в других инструментах (да, облачный Кодекс?) 😀
Мелкие фиксы и допиливания прилагаются, в ченжлоге поподробнее.
🔗 https://jules.google/docs/changelog/
Такое мы приветствуем!
#post
@deksden_notes
3 002
Qoder Pro subscription $2
Налетай! подешевело )))
Раш --зергами-- китайцами продолжается: скидки у кводера - первый месяц за $2, потом $10.
https://docs.qoder.com/events/discount
https://qoder.com/pricing
Конкуренция - великая штука. Курсору и антропику бы задуматься, причём антропику надо думать больше.
#post
@deksden_notes
3 002
Специализация моделей
Мы все читае мбенчмарки, и мы все понимаем что часто бенчмарки особенного отношения к жизни (нашей, во всяком случае) не имеют. Это,кстати, вполне закономерно - если лезть в детали бенчмарков, там можно найти много всякого весёлого, когда становится очевидно что бенчмарк измеряет, мягко говоря, странное, или странно измеряет, или при таких вводных, что без понимания особенностей бенчмарка он малополезен.
В общем, мы пользуем модели для разных целей и имеем разный опыт.
Идея: давайте поделимся, кто и для чего имел хороший опыт с разными моделями. Типа, какая модель для каких задач лучше всего подходит
Я попробую свои наблюдения сформирвоать:
▶️ Claude Sonnet: классика кодинга, - код делает хорошо, на твёрдую 4 даже сейчас. Неочевидное применение - devops, хорошо знает многие системы, хорошо применяет cli утилиты, высокая агентность, не так часто чудит с опасными командами (хотя случается). Нормально рисует веб интерфейсы, но некоторые говорят что они кондовые.
▶️ Gpt-5-thinking : одна из топовых моделей сейчас. Умная, много знает. Слабо может в текст, излагает корявенько и как интроверт какой то - как минимум, нужен специальный промптинг для хорошего перфоманса для текста. В коде много знает, очень умная, но за оверинжинирингом рекомендуется следить - чтобы на заачу записать текст в файл вам не делали менеджер файловой системы. Как кодовый агент - пугливая, двигается очень короткими интервалами, часто переспрашивает чего и как продолжаем - это не очень высокая агентность. В вебе говорят неплохо делает веб интерфейсы.
▶️ Gpt-5-codex. Топовая модель для написания кода сейчас - высокая агентность, тянет долгие задачи, разумно останавливается. Хорошее внимание, до разумных пределов. Неважно запускает консольные тулы (хуже соннета). Интерфейс тоже похуже Gpt-5. Вроде не настолько знающая чем Gpt-5. Говорит как аутист, раскрутить на нормальный стиль общения едва ли выйдет - особенно внутри cli-агента (там промпты ещё накладываются).
▶️ Gemini 2.5 pro: Очень умная модель, хорошо работает с текстами и переводами, отличный OCR, огромное контекстное окно. Из недостатков - только низкая агентность, и низкое умение пользвоать тулами в агенте - поэтому не пускайте её писать код. Зато анализировать и обсуждать код с ней - топ. Ещё она довольно подхалимская, это минус - будет поддерживать вас в любой дичи, для работы такое вредно.
3 002
+1
Ещё раз об экономике токенов
Я все время топлю за подписки, и не пользую инструменты если у них нет возможности использования по подписке.
Щас поажу почему
▶️ Вы же пользуйтесь семейством продуктов ccusage? Оно считает токены внутри СС и Кодекса. Отличныйц софт, рекомендую!
🔗 https://github.com/ryoppippi/ccusage
👉 Итак, не самый интенсивный месяц на Кодексе: $1431 по апи-ценам.
▶️ Вы скажете - конечно! Это же проклятые капиталисты. Китайские модели гораздо гуманнее по ценам.
👉 Это так и есть, но гуманизм спасает ситуацию не сильно - $362 на китайских моделях, простенькие задачи - раннер и эксперименты. Причём, траф 1.1T всего, это не много.
▶️ Подписка за $200 уже не кажется такой дорогой, да?)
А китайские планы за $10-40 так вообще капец какими выгодными!
#post
@deksden_notes
3 002
OpenRouter и новые китайские ризонинги
https://x.com/scaling01/status/1987938809628291168?s=20
Не всякий роутор освоит думать по-китайски! перфоманс модели через Опен Роутер хуже чем напрямую у провайдера
Раз сандал немного пошёл - есть шансы что починят
Просто лучше юзать официальное апи, кому надо
3 002
Раш китайцами
На опенроутере нынче котокодер
Где же время то найти - чтобы это все затестить!
И я вспоминаю времена как нам рассказывал Дарио о безумных затратах на производство модели!
А щас пучок китайцев выкатывает их регулярно
Как похорошел пекин при собянине!
3 002
Codex Credits и прочая экономика лимитов
Я для себя получил предварительную оценку системы кредитов клозедов
День не самой интенсивной работы - средней, в 1-2 потока агента мне вышел чуть более 350 кредитов.
500 кредитов - это $20. Выходит, что примерно $15 в день на кредитах!
При этом аккаунт Team Стоит $30 в месяц. Успел увидит следующую цифру - если "сжечь" полностью 5часовой лимит, то выходит что тратится ровно 30% недельного лимита.
Теперь осталось прикинуть за сколько я полностью жгу лимит в 5 часов на Team плане при таком использовании, и экономика сложится.
Но уже ясно что кредиты - не самая лучшая альтернатива подписке.
Также довольно очевидно, насколько выгодна подписка за 200 - там я только один раз приблизился к недельному лимиту. и то работало все в 3-4 потока. То есть это стараться надо!
Продолжаем наблюдение
3 002
Kimi K2 Thinking в CC
Не утерпел! Любопытно потыкать
Впечатлениями, конечно, поделюсь!
3 002
Используем СС со сторонними моделями
Напомню, что в Claude Code легко подключить почти любую модель, и пользоваться всем её возможностями - планмоды, баш/джоб менеджер, кастомные субагенты, и прочее
Принципиально - две возможности: если у провайдера anthropic-совместимый эндпоинт есть (как у z.ai, deepseek, minimax, kimi), можно прописать его напрямую в переменных окружения, вместе с названиями моделей.
пример: https://docs.z.ai/devpack/tool/claude
Либо используем проект claude-code router, прокси, конвертирующий любой open-ai совместимый эндпоинт в anthropic совместимый.
https://github.com/musistudio/claude-code-router
А тулинг в СС - топовый!
Конечно, рекомендуется использовать по подписке, чтобы не платить по ценам api, что накладно даже с китайскими ценами. Благо кодинговые планы сейчас есть у z.ai, kimi, minimax, возможно и других вендоров.
Такое мы пользуем, конечно )
#post
@deksden_notes
3 002
+1
Кодекс и запуск тулов
Кодекс - сильная модель, но недостатки тулинга в codex cli - очевидны.
вот такую картину (git commit) наблюдаю регулярно!
В промпте написано - не запускать интерактивные команды, но оно запускает. Надо дорабатывать промптинг.
Вот в СС такого не бывает - там bash tool имеет встроенный таймаут по-умолчанию в 2 минуты. А кодекс в таком состоянии будет висеть часами.
В общем, направление для инструментов пока очевидно - добейтесь feature parity с лидером.
А пока пользуем чего дают
#post
@deksden_notes
3 002
Утилита :: свитчер моделей в СС/Codex
Раз уж у нас пошёл поток моделей от китайский вендоров, некоторые из которых прям интересные и/или очень бюджетные, такой проект просто обязан был появиться. Собственно, сабж:
🔗 https://github.com/farion1231/cc-switch
Такое мы пользуем
#post
@deksden_notes
3 002
Нотификации к Кодексу
Кто привык к развитому тулингу СС немного страдает на кодексе. У СС давно были хуки через которые можно было сделать нотификацию со звуком, когда СС ждёт реакции от пользователя.
Теперь похожую штуку можно сделать для Кодекса вместе с некоторым другим тюнингом!
🔗 https://github.com/regenrek/codex-1up
Такое мы смотрим
⭐️250 звёзд )) Не ураган популярности.
#post
@deksden_notes
3 002
Подписочки от Minimax
Мне нравится тенденция на рынке - подписочки вместо Api usage, которое для агентов весьма накладно, даже если это китайские цены.
MiniMax разродился подписками: золотой стандарт отрасли - сравнить с ценами Антропиков)) Тут в разы больше использования, в разы дешевле.
https://x.com/MiniMax__AI/status/1986815058249408541
Дополнительно вводят цены на API ($0.3, $0.03 / $1.2)
Интересно, что дополнительно и отдельно введён план для Агента - $0 / $19 / $69.
В общем, знакомимься.
#post
@deksden_notes
3 002
Gemini Cli :: субагенты
Тихонько и незаметно в Gemini CLI появились субагенты. PR замержен и уже в 0.12 релизе.
Конечно, первым делом там появился Codebase investigator subagent
Замечу - что это компания с моделями с самым большим контекстом на рынке! А ведь я давно говорил - что дело не в контексте)) Фокусная задача, выбор модели для субагента, параллельный запуск - это все важные дополнительные факторы!
Документация как обычно: в PR github
https://github.com/google-gemini/gemini-cli/pull/9988
https://github.com/google-gemini/gemini-cli/pull/10282
Большое дело! Осталось в этом все таки признаться. Так, глядишь, и до планмода дело дойдёт
#post
@deksden_notes
3 002
О терминах
Пару раз за последнее время заходила речь об используемых терминах / жаргонных наименованиях. Вопрос не самый первостепенный, но словарик постепенно сформируем. Это не исчерпывающий словарик AI терминов, но это про те термины, в которых были какие-то разнотолки. Изложу своё понимание, не претендуя на истину.
Начнём-с!
▶️ Вендор - это "производитель" модели, та организация которая натренировала модель. Например, OpenAI, Google, Anthropic, Moonshot и так далее. Синонимы: "лаба".
▶️ Провайдер - это тот, кто "предоставляет" услугу инференса модели, обеспечивая обработку запросов пользователя в ответы модели. Вендоры, как правило, являются провайдерами своих моделей - но они могут быть не единственными. Open Source модели ведущих китайских лаб инферят много других компаний.
▶️ Агент - многогранный термин, значит очнь разное, а именно:
- компьютерная программа, предоставляющая "инструменты" (tools, через function calling, может быть упаковано в MCP server), поддерживающим такую функцию моделям; в итоге система обретает возможность условно автономных действий "по своему разумению" для достижения поставленных целей;
я такую программу чтобы не путаться называю Agentic Engine (движок), она сейчас часто бывает в виде CLI приложения (самая известная - Claude Code/CC, есть ещё куча, типа Gemini CLI, Qoder CLI, Codex CLI, ...). Но агенты бывают встроены в приложения - самый известный такой софт это Cursor, ну и системы типа Manus;
синонимы: консольный агент, CLI-агент;
- специальный промпт для агентного движка, который даёт специфические инструкции модели, и работает в своём контексе; также известен как Sub-Agents у Антропиков в Claude Code, но при этом управляется командой "/agents", живёт в папке "agents/"; будем считать Sub-Agent синонимом для этого значения "agents";
- Computer-Use Agents / Browser Agents / AI Browsers - это категория агентных приложений, в которых к модели подключён браузер/комптютер, и модель научена понимать скриншоты; кроме тогда дали инструменты, которыми можно рулить браузером (или в общем случае - компьюером целиком);
- Generic Agent: это агент общего профиля, без специфической ориентации как Browser Agent - пример Manus.
- Фоновый / Удалённый / Облачный агент - агентная система, работающая с кодом, расположенная "в облаке" удалённо (в противовес локально работающим CLI-агентам); примеры - Codex Cloud, Google Jules, Claude Code Web;
- Ну и тьма других агентных решений/систем - Gpt-5 Pro, DeepSearch, Grok Heavy, Google Deep Think, куча PPT агентов (создавать презентации) ...
▶️ Агентный воркфлоу - некий алгоритм, который выполняет агентная система
▶️ Жаргонные, местами шуточные термины:
- СС - Claude Code
- Клозеды - компания OpenAI (от closedAI, троллинг за отход от открытости в разработке AGI/ASI);
- Жульес: Google Jules;
- Муравьи (Ants) - сотрудники Anthropic;
- Зайка - Z.ai, вендор модели GLM; или сама модель GLM;
- Клод - продукт Антропика - Claude, общее название их семейства моделей;
...
3 002
Codex : фоллбэки на -mini
новинка в 0.56 видимо!
Немного напоминает гугл с флешем, хотя возможностей mini внимательно не тестил. Надеюсь, она получше код пишет, по плану к написанному коду у меня вопросов вроде бы не было, но я мало пока пользовал.
3 002
Minimax M2 Coding Plan …
… будет скоро!
Анонс в твиттере имеем:
🔗 https://x.com/skylermiao7/status/1986625358041620954?s=46
😂 Золотым стандартом отрасли становится считать во сколько раз это дешевле антропиков!) намекнули на бюджеты меньше $20
Пока не выпустили -> бесплатный триал M2 продолжается.
Крутой ход.
Такое мы ценим!
#post
@deksden_notes
3 002
Модель Gpt-5-codex обновилась
🆕 Клозеды анансировали небольшое обновление своей кодинговой модели:
- стала более коллоборативная (что бы это ни значило);
- тратит чуть меньше токенов
- чуть лучше работает на некоторых бенчмарках (но на каких именно - не сказали)
Amazing! Enjoy
🔗 https://x.com/thsottiaux/status/1986602121572327650?s=46
Такое мы, конечно, пользуем! Ну а куда деваться)
#post
@deksden_notes
