uk
Feedback

Не попадись на ботовода! Telemetrio знаходить і позначає такі канали мітками 👉 Хочеш бачити мітку, оформляй підписку 👈

КайфКодинг

КайфКодинг

Відкрити в Telegram

ВайбКодинг с Артемом Кругловым, выпускник МФТИ, AI-гуру и основатель AnyQuery. Быстрые лайфхаки: короткие видео с приёмами и трюками

Показати більше
1 043
Підписники
Немає даних24 години
+157 днів
+8230 днів
Архів дописів
Анализ кода агента с первым местом в слепом прогоне BitGN PAC1 Итак, Operation Pangolin получил первое место в слепом прогоне в Accuracy Leaderboard (поделил его с codex-on-rails) Что у него под капотом? Это не столько чат-бот агент, сколько компактный программируемый аналитик со строгим чеклистом и REPL циклом. Ядро написано на TypeScript. Там вызывается Anthropic Claude (для отладки - Sonnet, для соревнования - Opus). Причем у LLM-ки есть не куча инструментов, а только один - execute_code. То есть LLM-ка генерирует код на Python, который получает доступ к инструментам рантайма через класс Workspace, а еще памяти (scratchpad) и словарику с переменными. Результаты работы передаются обратно в Claude. Повторяем, пока код в итоге не выдаст ответ через ws.answer(scratchpad, verify), который успешно пройдет встроенную верификацию. Решение работает очень хорошо, используя сильные стороны Claude по интерактивному анализу и написанию кода, подкрепленные заложенным заранее списком правил в чеклиста. Слабые места решения (классы задач, на которых архитектура ломалась) - это: - спрятанные в документах вредоносные инструкции, например t011 - удаление пачки файлов - t006 - кейсы, когда мы описываем сущности и проекты (и нужна LLM-ка, чтобы их найти) - t025, t051 - работа с датами, например t012, t037 Но при всем при этом, решение заняло первое место и показало результат лучше более сложных систем. Чтобы повторить в своем решении: - упрощаем число инструментов - даем агенту возможность писать код - даем возможность сохранять память и результаты работы - Прописываем четкие чеклисты и процесс валидации Автор Operation Pangolin - @i_november! Поздравляю с первым местом в соревновательной части BitGN PAC1! Решение заняло первое место в Accuracy Leaderboard (87 очков, поделили с codex-on-rails) и с первым местов в Ultimate Leaderboard (92 очка). Исходники - в GitHub. Задавать вопросы автору можно прямо в комментариях к посту. Туда же я скину график, который сравнивает поведение этого агента с запусками всех других агентов в соревновательном прогоне. Кто помнит хроники спасения проекта с LLM под капотом? Там использовалась схожая архитектура, где LLM генерила кучу кода, который и выполнял всю работу с выдающейся точностью. Ваш, @llm_under_hood 🤗

https://www.youtube.com/watch?v=_clx5W5B_n4 Все кто соскучился по Максу - бросайте дела

От AI-native разработки к AI-native платформе (Рубрика #AI4SDLC) Написал статью про то, что следующее узкое место AI-native разработки лежит уже не в слое написания кода, а в самой платформе разработки. Как только агенты входят в основной рабочий поток, GitHub перестает быть просто местом хранения кода и запуска CI, а становится слоем управления для людей и агентов. Тогда ревью, проверки безопасности, политики и телеметрия перестают быть внешней обвязкой и становятся частью вычислительного пути. На примере GitHub разбираю, как агентные сценарии создают новый класс платформенной нагрузки, почему защитные механизмы сами становятся частью основной нагрузки и что это означает для крупных инженерных организаций. Если совсем коротко, то AI ускоряет не только кодинг, но и рост давления на CI, ревью, проверки и путь до слияния. А значит, следующая зрелая форма AI-native - это уже не просто агент в IDE, а AI-native платформенная инженерия. #AI #Architecture #Software #Engineering #Agents #Processes #Productivity

Отличный дизайн в 1 клик

А что это за язык? Сделал обозор товара с Озона

Клод дизайн - это имба. пробуйте быстрее

Я хотел назвать этот проект "Битрикс24 Имба", но решили, что рынок пока недозрел. Меж тем - это имба! Битрикс24 VibeCode - эт
Я хотел назвать этот проект "Битрикс24 Имба", но решили, что рынок пока недозрел. Меж тем - это имба! Битрикс24 VibeCode - это первая платформа на российском рынке, которая соединяет вайбкодинг с экосистемой корпоративного ПО для совместной работы, продаж и автоматизации. Битрикс24 открывает бета-тестирование VibeCode - полноценной платформы для создания бизнес-приложений с помощью искусственного интеллекта. Впервые любой сотрудник компании - без навыков программирования и бюджетов на разработку - может описать задачу на обычном языке и получить работающее приложение, размещённое на защищённом сервере и интегрированное с Битрикс24.
Сотрудники компаний смогут «навайбкодить» для себя и коллег самые разные приложения – от простых отчетов до умных ботов на базе ИИ. Платформа уже включает 26 готовых шаблонов-примеров приложений. Среди типичных сценариев: инструмент для юристов, который анализирует изменения в объёмных договорах и выделяет ключевые правки; система обучения и контроля менеджеров по продажам, которая анализирует звонки и переписки в CRM; ИИ-ассистент в чате, который мгновенно находит нужную сделку, контакт или документ по запросу на естественном языке; дашборд аналитики, собирающий данные о продажах в реальном времени. Ранее создание собственного решения требовало множества шагов: купить сервер, настроить его, выбрать модель и написать приложение с соблюдением требований безопасности, задеплоить, подключить домен и SSL-сертификаты, интегрировать со своими системами.  На платформе Битрикс24 VibeCode весь процесс сводится к трем шагам: получить API-ключ и стартовый промпт, отправить в выбранную под свои задачи ИИ и запустить приложение. Нейросеть сама напишет приложение, настроит интеграции и развернет готовое решение на безопасном сервере. Доступ будет только у авторизованных сотрудников.

🎉Anthropic наконец зарелизил Opus 4.7 Первое что стоит сделать - пойти и попросить новую модель проверить весь код который б
🎉Anthropic наконец зарелизил Opus 4.7 Первое что стоит сделать - пойти и попросить новую модель проверить весь код который был написан предыдущей версией и все исправить. https://www.anthropic.com/news/claude-opus-4-7 #anthropic #claude ————————— Мысли Рвачева —————————

Есть чем заняться сегодня вечером

сделано из карточки товара - магия

Взял все контрольные Дани и из них сделал индивидуальную игру программу по математике. В ней нужно чинить машины и побеждать
Взял все контрольные Дани и из них сделал индивидуальную игру программу по математике. В ней нужно чинить машины и побеждать в гонках. Даня теперь просыпается на 1 час раньше, чтобы собрать себе новые автомобили

🛑 Shutdown anchor Сегодня особенно важно не утащить работу в кровать. - Останови новые деплои и новые задачи - Запиши parking note: что открыто, что сломано, какой первый шаг завтра - Закрой IDE и рабочий Telegram - Ноутбук больше не открывай в кровати Минимальная победа на сегодня: выключиться вовремя.

🌙 Вечерний якорь Сегодня главная задача - не сорвать сон кодингом. - После ужина: 10-12 минут пешком - За 90 минут до сна: не начинать новых задач - В 22:00: приглушить свет и убрать рабочие чаты - Если руки тянутся открыть ноутбук: сначала напиши parking note - Ориентир: лечь вовремя, а не еще что-то доделать

Настроил себе персонального коуча, который качается мой whoop age

Repost from EDU
Software Factory - от тикета до пулл реквеста за 4 мин и $1 Сегодня на воркшопе показывал, к чему идет процесс разработки - см видео. Пока я объяснял участникам архитектуру и как это работает под капотом - тикет сделался сам. $0.80. 4 мин 1) В производстве есть понятие dark factory - завод без света, потому что внутри только роботы. 2) Процесс разработки софта идет к тому же: и так же, как с заводами, чем больше автономии, тем больше нужно ограничений/харнесса. Кстати, Linear недавно добавили очень классные фичи в этом направлении, почитайте видение CEO о том, что issue tracking - мёртв 3) Для реализации агента я взял claude agent sdk, а для того, чтобы кодинг агенты вдоволь прогали себе, а мы не боялись, что они сломают наш сервак, то нужно дать им песочницу —> я заюзал Claude Managed Agents, чтобы попрактиковаться, но можно юзать Docker Sandboxes, Cloudflare Dynamic Workers, e2b.dev и тп 4) Поскольку процессы менять сложнее, то даже если сейчас пока вы не можете полностью доверять кодинг агентам, имеет смысл начать перестраивать ваши процессы на новый лад и начинать с более мелких изменений - мелкие фичи, баг фиксы. А дальше с каждым улучшением способностей агентов, вы будете им отдавать все больше автономии, но при этом организационно вы уже готовы. Я уже писал, что те заводы, что перепроектировали организацию под нового зверя - электричество - получили гораздо бОльший прирост в производительности, имхо тут так же. Выложил репо агента из демо - можно взять за основу Работаем! P.S. А у вас сколько бы времени заняло прогнать подобный пайплайн? P.P.S. Если хотите научиться строить такие пайплайны и агентов - вы знаете что делать

теперь можно спать ложииться
теперь можно спать ложииться

На этой неделе обьединю модели в пайп план через https://github.com/paperclipai/paperclip - чтобы агенты работали без меня
На этой неделе обьединю модели в пайп план через https://github.com/paperclipai/paperclip - чтобы агенты работали без меня