ru
Feedback

Не попадитесь на канал ботавода! Telemetrio находит и помечает такие каналы 👉 Хотите видеть метку — оформите подписку 👈

КайфКодинг

КайфКодинг

Открыть в Telegram

ВайбКодинг с Артемом Кругловым, выпускник МФТИ, AI-гуру и основатель AnyQuery. Быстрые лайфхаки: короткие видео с приёмами и трюками

Больше
1 043
Подписчики
Нет данных24 часа
+197 дней
+8530 дней
Архив постов
Ох, что делают антропики. Сильно наступают на Гугл и МикроСофт

Коди Хо и его напарник Никлас месяц писали один и тот же GPU-драйвер одним и тем же агентом, но разными методами. Быстрее шёл
+2
Коди Хо и его напарник Никлас месяц писали один и тот же GPU-драйвер одним и тем же агентом, но разными методами. Быстрее шёл тот, чей агент был обязан собирать код, а не понимать железо. Хо — инженер, который до этого написал гипервизор, чтобы реверсить macOS. Вдвоём они собрали полностью совместимый с OpenGL ES 3.0 драйвер для M4 Mac Mini и MacBook Neo. По его оценке — примерно за месяц вместо обычных лет. Minecraft на этом драйвере идёт в 200 fps. Методы разошлись с самого начала: — Хо шёл от железа. Сначала реверс-инжиниринг, потом спецификация, потом агент реализует её до полной совместимости. — Никлас шёл от Mesa. Собирал драйвер и реверсил ровно столько, сколько нужно на следующую функцию. — Тесты не писал никто. CTS от Khronos — готовый корпус, который драйвер обязан пройти. Самое тяжёлое в работе с LLM за них уже сделано, и это слова Хо. Гонку проиграл тот, у кого была спецификация. Дословно у Хо:
Мой агент тратил уйму времени на мелкие несущественные задачи ради полноты. Его агент был заземлён необходимостью реально собирать Mesa — и распоряжался временем и ресурсами куда эффективнее.
Хо называет это свойство педантичностью: агент исчерпывающе тщателен всегда, и иногда это преимущество, а иногда он застревает на случайной ветке в ущерб цели. Спецификация от этого не спасает: в документе нет строки, на которой агент провалится. В сборке она есть. Что сделать сегодня. Откройте последнюю задачу, которую отдали агенту, и найдите в ней артефакт, который либо собирается, либо падает. Не нашли — вы дали ему тему, а не задачу, и полноту он выдаст вместо результата. Честности ради, Хо перечисляет и провалы. Код пока не готов для конечных пользователей. Чистый захват compute-нагрузки вышел на 336 МБ и не воспроизводился, а объекты агент больше недели пытался построить сам — и не смог. Переход от питоновского прототипа к Linux-драйверу занял три дня, и один из них ушёл впустую: агент взялся за самое трудное вместо самого простого. https://codyho.dev/blog/gpu-driver/ Что в вашей последней задаче агент был обязан собрать или запустить, чтобы узнать, что ошибся?

МИЛЛИОН и больше 110 новых покупок только с этого поста с новых покупок органически сегодня пришло $1300 у меня все, я открыв
МИЛЛИОН и больше 110 новых покупок только с этого поста с новых покупок органически сегодня пришло $1300 у меня все, я открываю шампанское И ЭТО МЫ ПОКА НЕ ЗАПУСКАЛИСЬ В ТИК ТОКЕ И ИНСТЕ

Ребята гении

Будущее пришло в Москву. Таксист: - "Вы голосовое Кодексу или Клоду наговариваете? Я таксист и на фрилансе Клодом решают фронтовые заказы, когда они попадаются"

🐹 Хомка — семейный ИИ-помощник в Telegram. Выложили в open source и ищем 3–4 семьи-соавторов Хотелось бота, который живёт в семейном чате и снимает бытовую суету: помнит, напоминает, ищет, считает — и при этом не путает личное с семейным. Как это выглядит в жизни ☀️ «Хомка, что у нас сегодня?» — садик до 17:00, забирает папа, в 19:30 собрание, и ты хотела записать кота к ветеринару. 🎁 Попросила мужа купить подарок маме до пятницы — Хомка ведёт это как «жду ответа»: муж жмёт «принимаю», а если молчит — в четверг напомнит спросить. 🗑 «Кто вынесет мусор?» — «беру». Исполнитель один, даже если ответили двое сразу. 🎒 «Напоминай каждый четверг в 8 брать сменку». Ночью не разбудит — тихие часы. 🛒 «Добавь молоко, творог и батарейки» — общий список видят все, а корзину во ВкусВилле Хомка соберёт по нему сама. Заказ и оплата — у вас. 🥜 «Запомни: у Маши аллергия на орехи». Через месяц на «что взять Маше на день рождения?» ответит: зефир или мармелад, только без орехов. «Откуда знаешь?» — покажет источник. 🧾 Фото чека: «на сколько сходили и что самое дорогое?» — 2 340 ₽, дороже всего сыр. 📚 Фото домашки — разберёт задачу и объяснит ребёнку по шагам. 🎙 Голосовое за рулём: «напомни вечером позвонить бабушке» — сработает как текст. 🔎 «До скольки в субботу Музей космонавтики и пустят ли с самокатом?» — найдёт на сайте, даст ссылку и честно скажет, чего там нет. 🗳 «Куда сходим в воскресенье?» — предложит варианты, каждый голосует за себя, решение принято, когда согласны оба. 🎨 «Нарисуй открытку бабушке: кот в валенках дарит ромашки». А потом: «оживи, пусть машет лапой» — 4 секунды видео. 🧠 «Сделай навык: по пятницам считай, что купили за неделю» — Хомка напишет его себе сама и включит после вашей кнопки. 👥 В чате друзей или дачного посёлка — отдельная память и только то, что вы разрешили. Ни личного, ни семейного. Главное — границы. Кто пишет и что ему можно, решает база и проверенный апдейт Telegram, а не промпт. Личка остаётся личной. Откуда взялась. Началось с Osinara от @nyxandro — семейного агента на eve с честной архитектурой. @ilkruglov развил его в своём форке и запустил своего бота; мы много переносили друг у друга. Хомка — третья ветка: DeepSeek с поиском, долговременная память и семейные сценарии. Спасибо, парни 🙏 Стек: TypeScript, eve, PostgreSQL + pgvector, DeepSeek V4 Flash, Docker. Стоимость: $3–10 в месяц на модель плюс сервер от 1000 ₽. 👉 https://github.com/artkruglov/homka (Apache-2.0) — там же пошаговая инструкция: около часа от пустого сервера до работающего бота. Давайте объединимся 🤝 Ищу 3–4 человек, которые поднимут Хомку у себя в семье и будут развивать её вместе со мной. Каждый приносит задачи своей семьи, лучшее забираем в общий проект. Впереди: календарь, дети и их расписание, дела по очереди, голосовой режим, удобные кнопки в Telegram, оценка качества ответов. Нужны не только разработчики — важнее живые семьи и честная обратная связь. С запуском помогу. Пишите в комментариях ✍️

Ваш allow-лист в settings.json — не граница, а догадка о том, что сделает строка в шелле. За двадцать шесть дней эту догадку
+2
Ваш allow-лист в settings.json — не граница, а догадка о том, что сделает строка в шелле. За двадцать шесть дней эту догадку чинили пятнадцать раз. Речь про чекер прав для Bash в Claude Code. В CHANGELOG.md после метки stable лежат строки, которые чинят ровно одно — решение «спрашивать разрешение или нет». Восемь релизов из двадцати восьми, вышедших после stable. Что проезжало мимо чекера: — Глоб в значении опции: grep -v dir/* file. Файлы, в которые раскрывается звёздочка, чекер пропускал (2.1.271). — Два cd, сабшелл или цепочка cd+git в одной строке — команда шла без вопроса при включённом permissions.blockReadsOutsideWorkingDirectories, в bypass и auto (2.1.271). — env -C или eval на той же строке — deny-правило на Read или Edit просто не применялось (2.1.268). — deny и ask на /etc, /tmp, /var не срабатывали, если путь дали реальным местоположением, а не через симлинк (2.1.268). Самая неприятная строка — про правила, которые не работали молча. В формулировке чейнджлога 2.1.260:
Правила прав, в пути которых есть круглые скобки, отбрасывались как некорректные, и «read-only» папки оставались доступными на запись.
Теперь про направление. Из пятнадцати правок ровно одна — про лишний вопрос: в 2.1.270 чинили read-only git-команды, которые начали спрашивать разрешение посреди сессии. Ещё одна направления не называет. Остальные тринадцать — про вопрос, которого не было. Переносим к себе. Правила вы пишете в терминах файлов и путей, а проверяет их парсер строки шелла, и каждая из этих правок — место, где парсер проиграл шеллу. Причём формы, на которых он спотыкался, пишете не вы: grep -v dir/* file и цепочку из двух cd сочиняет агент. Что сделать сегодня. Выполнить npm view @anthropic-ai/claude-code dist-tags и сравнить с тем, что отвечает ваш claude --version. На 15 сентября latest — 2.1.272, а stable — 2.1.236 от 19 августа. Все они вышли после неё. Честности ради: это строки самой Anthropic, то есть речь только о том, что она нашла и назвала сама. Почти всё здесь — про чтение файлов, а не про запись. И чинится это тяжело: в 2.1.233 правку про < file и Cygwin-симлинки откатили целиком, пообещав вернуть «более узкую версию». https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md Какое правило из вашего permissions.deny вы не рискнули бы проверить командой, которую агент написал сам?

Repost from Эксплойт
От Скайнета нас спасут ОНЛИФАНЩИЦЫ — организатор секс-вечеринок пообещала любому сотруднику OpenAI, который со скандалом ливн
+1
От Скайнета нас спасут ОНЛИФАНЩИЦЫ — организатор секс-вечеринок пообещала любому сотруднику OpenAI, который со скандалом ливнёт из компании, устроить тусовку с кучей девушек. Через пару дней бывший сотрудник OpenAI и Anthropic Джейкоб Коксон громко заявил об уходе. Он просто выбрал быть счастливым. @exploitex

+3
Видеокейсы использования агента Инстинкт.

photo content

В Кремниевой долине вирусится новый AI-ассистент — Instinct. Ему уже поручают разбираться со счетами, покупками и организацией поездок. Один из ранних пользователей, инвестор Sheel Mohnot, написал ему 677 сообщений за пять дней. Он рассказывает, как агент искал поставщиков для свадьбы, собирал время прилёта гостей в таблицу и отменял подписки. https://x.com/pitdesi/status/2090579987778937159 Что это за продукт? Instinct — персональный помощник, с которым общаешься в iMessage. Передаёшь задачу, он использует доступные инструменты, ведёт переписку и возвращается за уточнениями или с результатом. Недавно ему выдали собственный email. Например, можно переслать письмо о покупке и поручить возврат. В демо агент сам общается с поддержкой и получает этикетку для отправки товара. https://x.com/noahrshinn/status/2097443135177798060 Ещё команда показала, как Instinct разных людей могут договариваться между собой о совместных планах. https://x.com/noahrshinn/status/2097794967574028448 Основатель — Noah Shinn, ранее работавший в Sierra и занимавшийся исследованиями AI-агентов. В августе проект привлекал раунд при оценке $2,5 млрд. Почему вирусится — кажется, понятно: люди делятся историями о конкретных делах, которые получилось передать помощнику. Каждую легко примерить на себя. Сам пока не тестировал. Но продукт интересный: хочется понять, насколько быстро такой помощник становится ежедневной привычкой.

Repost from Neural Shit
photo content

Инструкция агенту «используй TDD» — не нейтральный совет: без неё код выходит правильнее. Дэн Лу, известный разборами про отказы систем, дал Codex с GPT-5.6 Sol одну задачу — Zstd на Rust. 26 добавок к промпту и четыре тест-скилла, по 80 прогонов на каждом из двух уровней reasoning effort. Выше среднего оказался вариант без единой инструкции про тесты, а «TDD» просел: агенты писали вдвое больше тестов и чаще обходили ими сложные случаи. Скилл ECC на 250 тысяч звёзд, тоже требующий red-green, почти догнал дефолт по сырому счёту — за счёт семи агентов из 160, которые его не открыли, и девяти, открывших под конец. Там, где скилл читали, результат ниже среднего: чем раньше агент его открывал, тем хуже корректность. Одна задача и один харнесс, ранжировать условия Лу сам не советует. Но строка про тесты в вашем CLAUDE.md написана как учебник для человека, а агенту нужен не учебник, а запрет на конкретную привычку — например, плодить мелкие тесты. https://danluu.com/agentic-testing/

Инструкция агенту «используй TDD» — не нейтральный совет: без неё код выходит правильнее. Дэн Лу, известный разборами про отк
+2
Инструкция агенту «используй TDD» — не нейтральный совет: без неё код выходит правильнее. Дэн Лу, известный разборами про отказы систем, дал Codex с GPT-5.6 Sol одну задачу — Zstd на Rust. 26 добавок к промпту и четыре тест-скилла, по 80 прогонов на каждом из двух уровней reasoning effort. Выше среднего оказался вариант без единой инструкции про тесты, а «TDD» просел: агенты писали вдвое больше тестов и чаще обходили ими сложные случаи. Скилл ECC на 250 тысяч звёзд, тоже требующий red-green, почти догнал дефолт по сырому счёту — за счёт семи агентов из 160, которые его не открыли, и девяти, открывших под конец. Там, где скилл читали, результат ниже среднего: чем раньше агент его открывал, тем хуже корректность. Одна задача и один харнесс, ранжировать условия Лу сам не советует. Но строка про тесты в вашем CLAUDE.md написана как учебник для человека, а агенту нужен не учебник, а запрет на конкретную привычку — например, плодить мелкие тесты. https://danluu.com/agentic-testing/

Памятка для тех, кто использует опенроутер

photo content

Гугл поменял подход к найму разработчиков

Выпускаю Lanka — open-source продукт для работы над презентациями вместе со своими AI-агентами. В компаниях постоянно делают презентации. Но полезные материалы, обсуждения и история правок часто остаются в отдельных файлах и переписках. Хочется, чтобы следующая команда могла воспользоваться уже сделанной работой. Для этого я делаю Lanka. В ней можно редактировать слайды в браузере, сохранять документы в общей библиотеке, открывать доступ коллегам, комментировать и просматривать предложения агента перед принятием. Когда нужен файл — выгружать PDF или редактируемый PowerPoint. Главная идея — работать с агентной инфраструктурой самой компании. Lanka предоставляет инструменты через MCP, а поддержанное подключение позволяет общаться с агентом прямо рядом с презентацией. Систему можно развернуть на своих серверах, настроить корпоративный вход и права доступа. Закрытый контур зависит также от выбранных моделей и подключённых инструментов. Это первый публичный preview. Хочу проверить его на реальных задачах: предложения клиентам, регулярные обзоры, внутренние презентации. Бесплатно для самостоятельного использования, включая компании. Лицензия Apache 2.0. Исходники и инструкция на русском: https://github.com/artkruglov/lanka Если хотите попробовать у себя, подключить корпоративного агента или настроить фирменные шаблоны — напишите мне.