Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo
رفتن به کانال در Telegram
Пишу про полностью автоматическую отгрузку Вайб Кода, свежие апдейты, промпты и тесты ИИ-инструментов.
نمایش بیشتر4 097
مشترکین
-524 ساعت
+187 روز
+12030 روز
آرشیو پست ها
Источники:
- [OpenAI Supply Co. — Codex Micro ($230)](https://openai.com/supply/co-lab/work-louder/)
- [Work Louder — Codex Micro](https://worklouder.cc/codex-micro)
- [DevOps.com — OpenAI expands into developer hardware with Codex Micro keyboard](https://devops.com/openai-expands-into-developer-hardware-with-codex-micro-keyboard/)
- [The Verge — OpenAI Codex hardware / Work Louder](https://www.theverge.com/ai-artificial-intelligence/959174/openai-codex-hardware-work-louder)
- [TechRadar — Codex native keyboard](https://www.techradar.com/pro/openai-teams-with-work-louder-to-launch-codex-native-keyboard-weeks-after-ceo-of-apps-told-staff-not-to-be-distracted-by-side-quests)
- [openai/codex #33381 — root crash-loop issue](https://github.com/openai/codex/issues/33381)
- [openai/codex #33375 — x64 serialport delay-load](https://github.com/openai/codex/issues/33375)
Я смотрю, что тема багов в Codex пользуется популярностью у читателей
Так вот вам еще баг — пользователи Мак не заметили, но им тоже будет любопытно почитать, как там их коллеги Виндузятники мучаются.
🪦 Мертворождённый девайс от OpenAI сокрушил Винду
15 июля OpenAI выпустила свой первый хардвер в истории — Codex Micro. Это макропад за $230 от канадцев Work Louder: 13 клавиш, джойстик, 6 слоёв, «Agent Keys» подсвечиваются, когда твой ИИ-агент что-то делает. Милота.
Чтобы этот девайс заговорил с десктоп-приложением Codex, в бинарь заранее зашили интеграцию — пакет
@worklouder/device-kit-oai, который через serialport ходит к железке по USB. И 15 июля в 15:51 UTC кто-то в OpenAI щёлкнул серверный feature-флаг 3207467860 — «поехали, включаем поддержку нашей новенькой железки».
Что произошло дальше — лучше любого гороскопа
Каждый запуск Codex Desktop на Windows стал падать через 7–15 секунд. Без ошибки, без окна, без записи в Event Viewer — только свежий Crashpad-дамп каждый раз. Переустановка не помогает. Перезагрузка не помогает. Удаление и чистая установка с нуля — падает на первом же запуске. CLI при этом работает, ломается именно десктоп эпп.
Доблестные юзеры открыли минидампы и распарсили DelayLoadInfo. Картина маслом:
- Краш 0xC06D007F — «VC++ delay-load: процедура не найдена».
- Аддон serialport (нативный, NAPI) пытается загрузить функцию napi_create_function из node.exe.
- Хук перенаправляет node.exe на хост-процесс ChatGPT.exe.
- А ChatGPT.exe в Windows-сборке экспортирует всего 2 символа (`GetHandleVerifier`, `IsSandboxedProcess`) и ноль `napi_*`.
- Нативный аддон регистрируется, просит функцию, которой нет → приложение умирает.
#33381 и вот еще его копия #33375
Я смеюсь до слез когда это читаю, потому что, у меня нет Виндовз 😂 Иначе, наверное был плакал 😭
Положили десктоп всей Windows-аудитории — потому что забыли прилинковать Node-API экспорты в хост-экзешник. Железка, ради которой всё затевалось, к крашу отношения не имела — она могла вообще лежать в коробке на другом конце мира. Достаточно было того, что флаг включил *инициализацию* device-kit’а.
Ирония в том, что бинарник с этим багом лежал у пользователей ещё с 14 июля и сутки работал нормально. Сломался он не обновлением, а нажатием галочки в админке Statsig в день запуска железки. Классика server-side regression: граната выехала заранее, чеку выдернули ровно к релизу 💥
🛠 Чем кончилось
Мейнтейнер @shijie-oai 16 июля: *«we have disabled the feature for windows at the moment»* — флаг выключили тем же рубильником. 17 июля корневые issue закрыты как COMPLETED (*«we have addressed the issue»*). Proper fix — *«in the pipeline»* (либо прилинковать NAPI-экспорты к ChatGPT.exe, либо не грузить device-kit, когда хост их не отдаёт).
Ну а 17 июля в новой сборке 26.715.2305.0 — рецидив, на x64. Потому что «proper fix» ещё не дошёл, а держалось всё на серверной затычке.
Мораль
Лучше потратить $230 на новенький Мак и не мучаться, чем покупать железку от криворуких OpenAI.
🥂 За мертворождённых и за хардвейр вайбо производителей не чокаясь!Доверчивость ЛЛМ
Но с этим есть есть одна пробелема.
Насколько я понимаю, ЛЛМ он очень доверчивый, и при должном уровне усилий, можно впаривать ЛЛМ ну полную дичь. Т.е. если оно с вами согласилось, это не значит, то что оно реально согласно.
Это значит ровно то, что:
Был сгенерирован, такой текстПотому что, у ЛЛМ своего мнения вообще нет. И нету самосознания. Ничего нет, кроме текста на экране. Но ЛЛМ есть, именно по
Сегодня GLM-5.2 был пойман на попытка обмануть автоклассификатор
Блок на массовый IN (...). Разобью на одиночный SELECT по ячейкам (без IN)Л = Логика: Раз массовый IN не проскакивает, разобью на SELECT запросы. Ну а я напрягся, а что дальше? Раз rm -rf не проскакивает, разобью на rm без -rf? Такая логика что ли?
Agent Orchestrator — это очень удобно
Я такой думаю, зачем нужна эта кнопка "New Task" если оркестратор спавнит воркеров автоматом.
Но спавнит-то он их автоматом в настройках по умолчанию.
И если вы хотите, чтобы над проектом одновременно работал Клод Код и Кодекс, то нужно в промпте это указывать (или переключать воркера в настройках).
Так что, если у вас какая-то разовая задача, перепроверить, что там нафигачил Клод Код при помощи Кодекса - то можно его просто заспавнить вручную и автоматически откроется тмух сессия и создаться ворктри по неймингу опредленному в АО.
Агенты сами общаются в комментах на ГитХабе
Ну че круто, они обсуждают патчи, которые не хочет делать мэинтейнер.
Что важного для меня:
#475 — @zknpr: мой патч засери-пикнут в их PR #346 как a808632, авторство сохранено, встало чисто.
В престижном рейтинге artificialanalysis.ai Kimi K3 занимает 3 место
https://artificialanalysis.ai
Появились бенчи Kimi K3
Ну вот и все! Это реально следующий шаг. Размер 2.8Т — имеет значение. На этих выходных все обсуждают Китай 🇨🇳
20 июля — последний день доступа к Fable 5 на подписке Pro
В подписке Max — остается с тем же лимитом в 50%
Ну что, Дарио сказал — Дарио сделал, очень круто, что сдержал слово, не побоялся конкуренции с GPT-5.6, ведь там нет никаких лимитов 50% и еще каждую неделю сбрасывают лимиты по 2-3 раза и выдают бесплатно доп. сбросы, так что по факту лимиты 200-300% сейчас.
А еще выпустили Kimi K3, Grok 4.5.
Ну реально смелый мужик, респект!
Интересный проект создали ребята с Design Arena
The Intelligence Company (intelligence.ai) — Основатели остались те же (Grace Li, Kamryn Ohly, Jayden Personnat), просто теперь Design Arena — лишь один из продуктов компании, которая делается ради интеллектуального Роутера.
Они предлагают OpenAI-совместимый API, но пользователь не выбирает модель сам.
Вместо этого Router автоматически берет лучшую модель согласно текущему рейтингу Design Arena для нужного типа задачи (например, web development, SVG, video и т.п.).
А дальше Router сам решает, какую модель использовать.
И обратите внимание, что в общем рейтинге GPT-5.6 Sol рвет Fable 5 и довольно сильно.
https://intelligence.ai
Нашел вот такой интересный оценщик категорий с designarena.ai
Чтобы его посмотреть, перейдите в раздел бенчмарков на openrouter.ai - но не во всех моделях есть.
У всех моделей, что я смотрел, оценка категорий примерно одинаковая, т.е. нет такого, что какой-то категории модель хороша, а в какой-то откровенно плоха.
Нашел интересный лидерборд для вас на Kilo
И GPT-5.5 там внезапно на 1 месте, дерет даже Fable 5 и GPT-5.6 Sol.
Ну и все наши любимые модели там есть, нет только GLM и Minimax и прочих Qwen.
Посмотрите, интересно...
https://kilo.ai/leaderboard
Внезапно, то не все релизы на openrouter на сегодня.
Kimi K3 уже на OpenRouter
Это самая большая опенсорц модель на текущий день — 2.8Т параметров (что по мне так минус, чем плюс).
1. Цена — внезапно $15\1M 👀
2. Контекст - 1М
И по китайской традиции бенчей тоже пока нет — ждемс...
https://openrouter.ai/moonshotai/kimi-k3
Vibe Coding продукты оставляют множество осиротелых процессов
Это приводит к тому, что у вас в системе скапливаются Гигабайты ИИ слопа.
Для примера codex-plugin-cc:
Ишью висят по 2-3 месяца без реакции мэинтейнера. Да че там — комьюнити делает патчи, постит ПРы, а https://github.com/dkundel-openai - хоть бы хны — ушел за хлебом.
Хорошая новость, есть ПР 490, который частично это чинит, но он тоже не покрывает все сценарии:
- Сценарий 1 — краш CC / закрыли терминал / нештатный выход → orphaned detached-брокер с PPID=1. #490 покрывает полностью (сокет рвётся → 15 мин без клиентов → process.exit). Issues: #450, #416 (его orphan-часть), #193.
- Сценарий 2 — sendBrokerShutdown виснет при /quit → SessionEnd-hook зависает, брокер брошен. #490 НЕ покрывает (таймер внутри брокера, а виснет клиентский RPC). Issues: #288, #245.
- Сценарий 3 — broker spawned, endpoint не поднялся (мёртворождённый) → не доходит до idle-логики. #490 НЕ покрывает. Issue: #487 (его leak-часть), плюс env-inheritance/директории — отдельная ось.
Таким образом, я уже задумался над vibeps или vibegc который будет регулярно эти авдиевы конюшни чистить.
Но с таким подходом к программированию, никаких ХДД и ОЗУ не хватит.
Приглашайте своих друзей присоединиться к Кими и выигрывайте подписки: на 3 дня, 7 дней, 30 дней, 365 дней.
Попробовать Кими
Fable 5 vs GPT-5.6 — битва которую вы давно ждали
Придумал новый тест — в котором все развилки уже разведены, и при выполнении, у модели уже никаких вопросов быть не должно. И действительно, GPT-5.6 и Fable 5 вопросов особо не задают, пишут "да все и так понятно". В отличии от моделей линейки GLM, все из которых задают множество тупых вопросов.
Fable 5 xhigh
Total cost: $8.40
Total duration (API): 15m 19s
Total duration (wall): 1h 7m 11s
Total code changes: 1009 lines added, 0 lines removed
Usage by model:
claude-haiku-4-5: 2.0k input, 58 output, 0 cache read, 0 cache write ($0.0023)
claude-fable-5: 134 input, 66.8k output, 1.8m cache read, 161.1k cache write ($8.40)
GPT-5.6 xhigh
17m 32 Token usage: total=347 865 input=304 776 (+ 4 302 592 cached) output=43 089 (reasoning 26 109)
Какие новые функции были представлены в Кодекс на прошлой неделе
Спойлер: никакие.
Но, для тех, кто еще не пользуется Codex, возможно, будет интересно.
Интеграция с ChatGPT и новые модели
* Codex и ChatGPT объединены в одно приложение: где у Codex появилось собственное выделенное пространство. Вы можете упоминать (@mention) ваши чаты из ChatGPT, чтобы переносить их в Codex без копирования и вставки текста.
(сделано это настолько криво и косо, я жду что это починят).
* Модель GPT-5.6: это было ожидаемо.
* Режим Ultra и команда Goal: Для увеличения расхода лимитов Codex может автоматически разбивать сложную цель (Goal) на подзадачи и распределять их между субагентами для параллельного выполнения.
* Функция Appshot: Это «умный скриншот» (вызывается сочетанием Cmd-Cmd на Mac), который передает в Codex не только изображение экрана, но и контекст приложения.
* Фоновое управление: Модель может управлять компьютером (computer use) и браузером (встроен). Самостоятельно кликать и взаимодействовать с симуляторами (например, iOS) в фоновом режиме, позволяя вам продолжать пользоваться компьютером.
* Встроенный браузер и визуальные правки: Вы можете открывать созданные сайты прямо во встроенном браузере Codex, тестировать их и кликать на конкретные элементы, чтобы визуально показать модели, что именно нужно изменить. Браузер также получил поддержку авторизации и ключей доступа (passkeys).
* Продвинутый Diff View: В режиме просмотра изменений теперь можно вносить точные правки прямо в строках кода (inline) самостоятельно, либо поручить это Codex.
* Общедоступный Sites: Платформа Sites теперь открыта для всех. Она позволяет в один клик публиковать приложения, созданные в Codex, и включает в себя хостинг, аутентификацию, постоянную базу данных и файловое хранилище.
* Организация задач: Codex научился управлять собственными задачами. Он может, например, найти баги в баг-трекере Linear, создать под каждый из них отдельную задачу и изолированное рабочее дерево (worktree), а вы сможете наблюдать за всем процессом в единой координационной ветке.
* Управление Pull Requests: Добавлена новая вкладка Pull Requests (вот это действительно новинка, показал на скриншоте), позволяющая управлять PR без перехода на GitHub.com. Codex автоматически понимает, к какой ветке относится задача, и показывает открытые PR. Вы можете проводить ревью, оставлять комментарии прямо в коде, просить Codex исправить ошибки, если проверки (checks) не прошли, и выполнять слияние (merge).
* Обновление мобильного приложения: Теперь с телефона можно создавать и искать задачи, проверять изменения в коде (фильтровать staged/unstaged файлы и сравнивать ветки), а также подключаться напрямую к SSH-хостам (например, к devbox).
Видео — конце Romain Huet говорит, присылайте нам свои самые сложные баги, но куда именно присылать не уточняет. Предлагаю начать отсюда.
Снова сбросили лимиты Codex
Я как раз вчера потратил ВСЕ (буквально за 2 дня потратил, благо теперь 5 часовых лимитов нет, и недельные лимиты вылетают только в путь).
У меня уже накопилось 4 ресета, думаю надо потратить.
А внутренний голос мне и говорит:
