AI Makes Me Hate
Відкрити в Telegram
AI systems engineer и скептический практик, который проверяет AI на реальных задачах разработки
Показати більшеКраїна не вказанаКатегорія не вказана
480
Підписники
+124 години
+37 днів
+7230 день
Архів дописів
Repost from iOS Makes Me Hate
+1
Уважаемые любители харнесса бесконечности. Собираемся на подлодке 14 сентября.
Буду рассказывать реальную практику. Где мы будем настраивать рой Джарвисов
Agentic Design Patterns
Наверное самая практическая книга про системы агентов. В ней разбирается:
• цепочки промптов, маршрутизация и параллельное выполнение;
• reflection — самопроверка и улучшение ответа;
• использование API, поиска, баз данных и других инструментов;
• планирование сложных задач;
• память и адаптация;
• взаимодействие нескольких агентов;
• RAG, MCP и протокол A2A;
• human-in-the-loop;
• обработка ошибок и восстановление;
• guardrails, безопасность, оценка качества и мониторинг.
Из критики это слишком много вширь, но мало некоторой глубины. Но если дополнять это аишкой, то супер.
держу вкурсе, лучше всех мне сэкономил токенов Progressive disclosure и изоляция стадий.
У меня есть оркестратор из 14 скиллов, который ел ~1.2M токенов за один прогон.
Я решил по оптимизировать Не загружать все 14 скиллов одновременно, а только при переходе к след стейту. Корневой orchestrator выбирает одну stage-инструкцию, а stage-runner читает только ее. Такая тема на полном пайплайне из девяти стадий устраняет около 8 820 повторно загружаемых слов.
В итоге стало 784 400 токенов, экономия около 415 600, или ~35%.
Repost from CodeCamp
Ого, Anthropic официально запустили бесплатную Claude Academy!
Внутри уже больше 20 полноценных курсов и сотни обучающих материалов. Есть отдельные треки по Claude Code, API, MCP, агентным системам, RAG, промпт-инжинирингу и многому другому. Курсы состоят из видео, интерактивных уроков, практических заданий и квизов + внутри есть 6 уровней подготовки — от полного новичка до продвинутых разработчиков.
При этом после завершения некоторых курсов выдают сертификат о прохождении, так что можно будет положить в резюме или похвастаться в LinkedIn.
Сохраняем клад 👍
короче рофл. Я тут заюзал caveman и там есть convert. Эта шутка превращает ваш скилл в .... PNG?
и короче это экономит почти где-то 5-10%
короче гипотез не подтвердилась. gpt-5.6-sol high сказал что языки это вообще не про token
efficiency
хочу протестить давний миф, что написание скиллов и инструкций на английском экономит дохералион токенов. По разным источникам скиллы на англ экономней скиллов на русском х1.5. Есть ли у вас замеры или интересные доклады/статьи с пруфами?
в компании есть много разных дашбордов, которые помогают оценить твою эффективность по использованию ии
вот среди десятки тысяч у меня топ 6%
делитесь какие инструменты для векторизации есть у вас
У я есть рейтинг владением аи в рабочих задачах. И вот я в нем топ 6% среди разрабов
Конечно, есть много нюансов и вопросов. Но вот вам маленькая ачивка
Чем умнее модель, тем вычурней галлюцинации
Каждый релиз новой модели соннет или fable, неважно, встречают как очередную революцию. Но чем больше мы в команде строим обвязки и агентов, тем очевиднее, что сама модель не главный множитель качества.
Свежий кейс. Разбирался с багом в BDUI. Была задержка при открытии ботом шита. Я знал, что баг тривиальный. Фейбл полдня водил меня кругами. то рассказывал про проблемы с диспетчеризацией, предлагал уходить в нативные SDK и создавать пропосал там (хотя доступ к ним у него был), валил все на iOS 26.
В итоге банальный дебаунс в моем же BDUI-коде.
Причем нашел я его, когда перестал скармливать модели описание симптомов и дал минимальный репро с логами. С правильным контекстом модель сошлась на ответе за пару итераций.
Мне понравилось как в аи комьюнити модель это лишь один из шести этапов качества результата. И не решающий.
Качество делится на такие слои:
• Модель это догадки и рассуждения
• Цикл. Дает фреймворк для работы
• Инструменты.
• Контекст
• Память
• Валидация
Когда агент тупит, тупит не он целиком, а конкретный слой. И по симптому почти всегда видно, какой. В моем случае это была модель. Но чинился он на слое контекста.
Ну и главный вывод — умная модель не перестает галлюцинировать. Она просто галлюцинирует убедительнее.
Читаю всякие стать, книги и тп. И понимаю, что лучший метод обучения — это практика. Она легко фильтрует булщит.
Думаю сделать хакатоны в стиле:
• построй свой харнесс
• настрой команду агентов
• оркестраторы
Как думаете? Будем разделяться на миникоманды. Делать защиты, прогонять на тестах?
Ставь 👍 если интересно
Порог входа не упал, он сместился
За мысль "без опыта разработки ни хуя не выйдет" я прям дико плюсую. У меня жопа горит последние недели когда те, кто давно не кодит, пишут скиллы что сжирают дневную квоту клода 100$ за час
