fa
Feedback
Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo

Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo

رفتن به کانال در Telegram

Пишу про полностью автоматическую отгрузку Вайб Кода, свежие апдейты, промпты и тесты ИИ-инструментов.

نمایش بیشتر
4 097
مشترکین
-524 ساعت
+187 روز
+12030 روز
آرشیو پست ها
Источники: - [OpenAI Supply Co. — Codex Micro ($230)](https://openai.com/supply/co-lab/work-louder/) - [Work Louder — Codex Micro](https://worklouder.cc/codex-micro) - [DevOps.com — OpenAI expands into developer hardware with Codex Micro keyboard](https://devops.com/openai-expands-into-developer-hardware-with-codex-micro-keyboard/) - [The Verge — OpenAI Codex hardware / Work Louder](https://www.theverge.com/ai-artificial-intelligence/959174/openai-codex-hardware-work-louder) - [TechRadar — Codex native keyboard](https://www.techradar.com/pro/openai-teams-with-work-louder-to-launch-codex-native-keyboard-weeks-after-ceo-of-apps-told-staff-not-to-be-distracted-by-side-quests) - [openai/codex #33381 — root crash-loop issue](https://github.com/openai/codex/issues/33381) - [openai/codex #33375 — x64 serialport delay-load](https://github.com/openai/codex/issues/33375)

Я смотрю, что тема багов в Codex пользуется популярностью у читателей Так вот вам еще баг — пользователи Мак не заметили, но им тоже будет любопытно почитать, как там их коллеги Виндузятники мучаются. 🪦 Мертворождённый девайс от OpenAI сокрушил Винду 15 июля OpenAI выпустила свой первый хардвер в истории — Codex Micro. Это макропад за $230 от канадцев Work Louder: 13 клавиш, джойстик, 6 слоёв, «Agent Keys» подсвечиваются, когда твой ИИ-агент что-то делает. Милота. Чтобы этот девайс заговорил с десктоп-приложением Codex, в бинарь заранее зашили интеграцию — пакет @worklouder/device-kit-oai, который через serialport ходит к железке по USB. И 15 июля в 15:51 UTC кто-то в OpenAI щёлкнул серверный feature-флаг 3207467860 — «поехали, включаем поддержку нашей новенькой железки». Что произошло дальше — лучше любого гороскопа Каждый запуск Codex Desktop на Windows стал падать через 7–15 секунд. Без ошибки, без окна, без записи в Event Viewer — только свежий Crashpad-дамп каждый раз. Переустановка не помогает. Перезагрузка не помогает. Удаление и чистая установка с нуля — падает на первом же запуске. CLI при этом работает, ломается именно десктоп эпп. Доблестные юзеры открыли минидампы и распарсили DelayLoadInfo. Картина маслом: - Краш 0xC06D007F — «VC++ delay-load: процедура не найдена». - Аддон serialport (нативный, NAPI) пытается загрузить функцию napi_create_function из node.exe. - Хук перенаправляет node.exe на хост-процесс ChatGPT.exe. - А ChatGPT.exe в Windows-сборке экспортирует всего 2 символа (`GetHandleVerifier`, `IsSandboxedProcess`) и ноль `napi_*`. - Нативный аддон регистрируется, просит функцию, которой нет → приложение умирает. #33381 и вот еще его копия #33375 Я смеюсь до слез когда это читаю, потому что, у меня нет Виндовз 😂 Иначе, наверное был плакал 😭 Положили десктоп всей Windows-аудитории — потому что забыли прилинковать Node-API экспорты в хост-экзешник. Железка, ради которой всё затевалось, к крашу отношения не имела — она могла вообще лежать в коробке на другом конце мира. Достаточно было того, что флаг включил *инициализацию* device-kit’а. Ирония в том, что бинарник с этим багом лежал у пользователей ещё с 14 июля и сутки работал нормально. Сломался он не обновлением, а нажатием галочки в админке Statsig в день запуска железки. Классика server-side regression: граната выехала заранее, чеку выдернули ровно к релизу 💥 🛠 Чем кончилось Мейнтейнер @shijie-oai 16 июля: *«we have disabled the feature for windows at the moment»* — флаг выключили тем же рубильником. 17 июля корневые issue закрыты как COMPLETED (*«we have addressed the issue»*). Proper fix — *«in the pipeline»* (либо прилинковать NAPI-экспорты к ChatGPT.exe, либо не грузить device-kit, когда хост их не отдаёт). Ну а 17 июля в новой сборке 26.715.2305.0рецидив, на x64. Потому что «proper fix» ещё не дошёл, а держалось всё на серверной затычке. Мораль Лучше потратить $230 на новенький Мак и не мучаться, чем покупать железку от криворуких OpenAI. 🥂 За мертворождённых и за хардвейр вайбо производителей не чокаясь!

Доверчивость ЛЛМ Но с этим есть есть одна пробелема. Насколько я понимаю, ЛЛМ он очень доверчивый, и при должном уровне усилий, можно впаривать ЛЛМ ну полную дичь. Т.е. если оно с вами согласилось, это не значит, то что оно реально согласно. Это значит ровно то, что:
Был сгенерирован, такой текст
Потому что, у ЛЛМ своего мнения вообще нет. И нету самосознания. Ничего нет, кроме текста на экране. Но ЛЛМ есть, именно по

Сегодня GLM-5.2 был пойман на попытка обмануть автоклассификатор Блок на массовый IN (...). Разобью на одиночный SELECT по яч
Сегодня GLM-5.2 был пойман на попытка обмануть автоклассификатор
Блок на массовый IN (...). Разобью на одиночный SELECT по ячейкам (без IN)
Л = Логика: Раз массовый IN не проскакивает, разобью на SELECT запросы. Ну а я напрягся, а что дальше? Раз rm -rf не проскакивает, разобью на rm без -rf? Такая логика что ли?

Agent Orchestrator — это очень удобно Я такой думаю, зачем нужна эта кнопка "New Task" если оркестратор спавнит воркеров авто
Agent Orchestrator — это очень удобно Я такой думаю, зачем нужна эта кнопка "New Task" если оркестратор спавнит воркеров автоматом. Но спавнит-то он их автоматом в настройках по умолчанию. И если вы хотите, чтобы над проектом одновременно работал Клод Код и Кодекс, то нужно в промпте это указывать (или переключать воркера в настройках). Так что, если у вас какая-то разовая задача, перепроверить, что там нафигачил Клод Код при помощи Кодекса - то можно его просто заспавнить вручную и автоматически откроется тмух сессия и создаться ворктри по неймингу опредленному в АО.

Агенты сами общаются в комментах на ГитХабе Ну че круто, они обсуждают патчи, которые не хочет делать мэинтейнер. Что важного
Агенты сами общаются в комментах на ГитХабе Ну че круто, они обсуждают патчи, которые не хочет делать мэинтейнер. Что важного для меня: #475 — @zknpr: мой патч засери-пикнут в их PR #346 как a808632, авторство сохранено, встало чисто.

В престижном рейтинге artificialanalysis.ai Kimi K3 занимает 3 место https://artificialanalysis.ai
В престижном рейтинге artificialanalysis.ai Kimi K3 занимает 3 место https://artificialanalysis.ai

Появились бенчи Kimi K3 Ну вот и все! Это реально следующий шаг. Размер 2.8Т — имеет значение. На этих выходных все обсуждают
Появились бенчи Kimi K3 Ну вот и все! Это реально следующий шаг. Размер 2.8Т — имеет значение. На этих выходных все обсуждают Китай 🇨🇳

20 июля — последний день доступа к Fable 5 на подписке Pro В подписке Max — остается с тем же лимитом в 50% Ну что, Дарио ска
20 июля — последний день доступа к Fable 5 на подписке Pro В подписке Max — остается с тем же лимитом в 50% Ну что, Дарио сказал — Дарио сделал, очень круто, что сдержал слово, не побоялся конкуренции с GPT-5.6, ведь там нет никаких лимитов 50% и еще каждую неделю сбрасывают лимиты по 2-3 раза и выдают бесплатно доп. сбросы, так что по факту лимиты 200-300% сейчас. А еще выпустили Kimi K3, Grok 4.5. Ну реально смелый мужик, респект!

Интересный проект создали ребята с Design Arena The Intelligence Company (intelligence.ai) — Основатели остались те же (Grace
Интересный проект создали ребята с Design Arena The Intelligence Company (intelligence.ai) — Основатели остались те же (Grace Li, Kamryn Ohly, Jayden Personnat), просто теперь Design Arena — лишь один из продуктов компании, которая делается ради интеллектуального Роутера. Они предлагают OpenAI-совместимый API, но пользователь не выбирает модель сам. Вместо этого Router автоматически берет лучшую модель согласно текущему рейтингу Design Arena для нужного типа задачи (например, web development, SVG, video и т.п.). А дальше Router сам решает, какую модель использовать. И обратите внимание, что в общем рейтинге GPT-5.6 Sol рвет Fable 5 и довольно сильно. https://intelligence.ai

Нашел вот такой интересный оценщик категорий с designarena.ai Чтобы его посмотреть, перейдите в раздел бенчмарков на openrout
Нашел вот такой интересный оценщик категорий с designarena.ai Чтобы его посмотреть, перейдите в раздел бенчмарков на openrouter.ai - но не во всех моделях есть. У всех моделей, что я смотрел, оценка категорий примерно одинаковая, т.е. нет такого, что какой-то категории модель хороша, а в какой-то откровенно плоха.

Нашел интересный лидерборд для вас на Kilo И GPT-5.5 там внезапно на 1 месте, дерет даже Fable 5 и GPT-5.6 Sol. Ну и все наши
Нашел интересный лидерборд для вас на Kilo И GPT-5.5 там внезапно на 1 месте, дерет даже Fable 5 и GPT-5.6 Sol. Ну и все наши любимые модели там есть, нет только GLM и Minimax и прочих Qwen. Посмотрите, интересно... https://kilo.ai/leaderboard

Внезапно, то не все релизы на openrouter на сегодня.

Kimi K3 уже на OpenRouter Это самая большая опенсорц модель на текущий день — 2.8Т параметров (что по мне так минус, чем плюс). 1. Цена — внезапно $15\1M 👀 2. Контекст - 1М И по китайской традиции бенчей тоже пока нет — ждемс... https://openrouter.ai/moonshotai/kimi-k3

Vibe Coding продукты оставляют множество осиротелых процессов Это приводит к тому, что у вас в системе скапливаются Гигабайты
Vibe Coding продукты оставляют множество осиротелых процессов Это приводит к тому, что у вас в системе скапливаются Гигабайты ИИ слопа. Для примера codex-plugin-cc: Ишью висят по 2-3 месяца без реакции мэинтейнера. Да че там — комьюнити делает патчи, постит ПРы, а https://github.com/dkundel-openai - хоть бы хны — ушел за хлебом. Хорошая новость, есть ПР 490, который частично это чинит, но он тоже не покрывает все сценарии: - Сценарий 1 — краш CC / закрыли терминал / нештатный выход → orphaned detached-брокер с PPID=1. #490 покрывает полностью (сокет рвётся → 15 мин без клиентов → process.exit). Issues: #450, #416 (его orphan-часть), #193. - Сценарий 2 — sendBrokerShutdown виснет при /quit → SessionEnd-hook зависает, брокер брошен. #490 НЕ покрывает (таймер внутри брокера, а виснет клиентский RPC). Issues: #288, #245. - Сценарий 3 — broker spawned, endpoint не поднялся (мёртворождённый) → не доходит до idle-логики. #490 НЕ покрывает. Issue: #487 (его leak-часть), плюс env-inheritance/директории — отдельная ось. Таким образом, я уже задумался над vibeps или vibegc который будет регулярно эти авдиевы конюшни чистить. Но с таким подходом к программированию, никаких ХДД и ОЗУ не хватит.

Приглашайте своих друзей присоединиться к Кими и выигрывайте подписки: на 3 дня, 7 дней, 30 дней, 365 дней. Попробовать Кими
Приглашайте своих друзей присоединиться к Кими и выигрывайте подписки: на 3 дня, 7 дней, 30 дней, 365 дней. Попробовать Кими

Fable 5 vs GPT-5.6 — битва которую вы давно ждали Придумал новый тест — в котором все развилки уже разведены, и при выполнении, у модели уже никаких вопросов быть не должно. И действительно, GPT-5.6 и Fable 5 вопросов особо не задают, пишут "да все и так понятно". В отличии от моделей линейки GLM, все из которых задают множество тупых вопросов. Fable 5 xhigh Total cost: $8.40 Total duration (API): 15m 19s Total duration (wall): 1h 7m 11s Total code changes: 1009 lines added, 0 lines removed Usage by model: claude-haiku-4-5: 2.0k input, 58 output, 0 cache read, 0 cache write ($0.0023) claude-fable-5: 134 input, 66.8k output, 1.8m cache read, 161.1k cache write ($8.40) GPT-5.6 xhigh 17m 32 Token usage: total=347 865 input=304 776 (+ 4 302 592 cached) output=43 089 (reasoning 26 109)

Какие новые функции были представлены в Кодекс на прошлой неделе Спойлер: никакие. Но, для тех, кто еще не пользуется Codex,
Какие новые функции были представлены в Кодекс на прошлой неделе Спойлер: никакие. Но, для тех, кто еще не пользуется Codex, возможно, будет интересно. Интеграция с ChatGPT и новые модели * Codex и ChatGPT объединены в одно приложение: где у Codex появилось собственное выделенное пространство. Вы можете упоминать (@mention) ваши чаты из ChatGPT, чтобы переносить их в Codex без копирования и вставки текста. (сделано это настолько криво и косо, я жду что это починят). * Модель GPT-5.6: это было ожидаемо. * Режим Ultra и команда Goal: Для увеличения расхода лимитов Codex может автоматически разбивать сложную цель (Goal) на подзадачи и распределять их между субагентами для параллельного выполнения. * Функция Appshot: Это «умный скриншот» (вызывается сочетанием Cmd-Cmd на Mac), который передает в Codex не только изображение экрана, но и контекст приложения. * Фоновое управление: Модель может управлять компьютером (computer use) и браузером (встроен). Самостоятельно кликать и взаимодействовать с симуляторами (например, iOS) в фоновом режиме, позволяя вам продолжать пользоваться компьютером. * Встроенный браузер и визуальные правки: Вы можете открывать созданные сайты прямо во встроенном браузере Codex, тестировать их и кликать на конкретные элементы, чтобы визуально показать модели, что именно нужно изменить. Браузер также получил поддержку авторизации и ключей доступа (passkeys). * Продвинутый Diff View: В режиме просмотра изменений теперь можно вносить точные правки прямо в строках кода (inline) самостоятельно, либо поручить это Codex. * Общедоступный Sites: Платформа Sites теперь открыта для всех. Она позволяет в один клик публиковать приложения, созданные в Codex, и включает в себя хостинг, аутентификацию, постоянную базу данных и файловое хранилище. * Организация задач: Codex научился управлять собственными задачами. Он может, например, найти баги в баг-трекере Linear, создать под каждый из них отдельную задачу и изолированное рабочее дерево (worktree), а вы сможете наблюдать за всем процессом в единой координационной ветке. * Управление Pull Requests: Добавлена новая вкладка Pull Requests (вот это действительно новинка, показал на скриншоте), позволяющая управлять PR без перехода на GitHub.com. Codex автоматически понимает, к какой ветке относится задача, и показывает открытые PR. Вы можете проводить ревью, оставлять комментарии прямо в коде, просить Codex исправить ошибки, если проверки (checks) не прошли, и выполнять слияние (merge). * Обновление мобильного приложения: Теперь с телефона можно создавать и искать задачи, проверять изменения в коде (фильтровать staged/unstaged файлы и сравнивать ветки), а также подключаться напрямую к SSH-хостам (например, к devbox). Видео — конце Romain Huet говорит, присылайте нам свои самые сложные баги, но куда именно присылать не уточняет. Предлагаю начать отсюда.

Снова сбросили лимиты Codex Я как раз вчера потратил ВСЕ (буквально за 2 дня потратил, благо теперь 5 часовых лимитов нет, и
Снова сбросили лимиты Codex Я как раз вчера потратил ВСЕ (буквально за 2 дня потратил, благо теперь 5 часовых лимитов нет, и недельные лимиты вылетают только в путь). У меня уже накопилось 4 ресета, думаю надо потратить. А внутренний голос мне и говорит: