AI в кубе |AI³ | Сергей Долгов
Open in Telegram
Привет, я Сергей, пишу о работе с AI и управлении продуктами, инсайтах и интересных кейсах. Изучаю, как продолжать оставаться человеком в гонке за будущим. Для личной связи: @sergeydolgov. Собираю AI-полезное тут: @ai_fazenda и @openthisclaw
Show moreThe country is not specifiedThe category is not specified
2 519
Subscribers
+324 hours
No data7 days
+1930 days
Posts Archive
Бесит. Вот пришла мне в голову идея, я хожу с ней, обдумываю, но стоит выйти в другую комнату - и всё, ЗАБЫЛ. Приходится возвращаться на старое место, в знакомую обстановку. Иногда это помогает, но никаких гарантий.
С нейросетями в длинных проектах происходит нечто похожее.
Мои студенты, работающие с большими массивами файлов - главным образом с медицинскими и юридическими кейсами - удивляются: коворк может несколько раз за день попросить перезапустить рабочую среду, а новый чат внутри проекта не воспроизводит содержание предыдущих диалогов во всех подробностях. «Не могут же обновления выходить по десять раз на дню?»
Не могут. Просто снаружи не видны несколько системных ограничений, которые напрямую влияют на производительность и качество результата.
Контекст конечен. Модель одновременно видит ограниченный объём информации. В затяжной работе ранние детали сворачиваются в пересказ, пересказ теряет нюансы, и в какой-то момент мы уже жонглируем обмылками прежних выводов. Проектная память помогает, но она не равна полному протоколу предыдущей работы.
Рабочая среда тоже конечна. Код выполняется в изолированной среде с ограниченным диском. Место занимают не только исходники, но и система, библиотеки, распакованные архивы, изображения страниц, результаты OCR, кэш и временные файлы. Каталог на 10 ГБ в процессе обработки легко может породить в несколько раз больше данных. Переполнение диска - одна из частых причин отказа рабочей среды, хотя не единственная.
Доступ к файлам проходит через слой разрешений. Коворк видит только подключённые папки, а файловые операции проверяются отдельно. Различия в абсолютных путях, ссылках, юникоде и канонической форме пути могут привести к парадоксу: один вариант пути читается, другой не записывается. У меня, например, имя пользователя Windows было записано кириллицей, и один из элементов инструментальной цепочки постоянно ошибался при работе с этим путём. В итоге оказалось проще завести отдельного пользователя с латинским именем.
Отдельные команды имеют таймауты. Долгая обработка не должна зависеть от одного инструментального вызова. Её нужно разбивать на этапы, запускать как отдельный процесс и регулярно сохранять прогресс. Иначе программа может выполнить почти всю работу, упасть на последней операции, и не оставить результата.
Модель не ведёт строгую базу доказательств автоматически. Она строит наиболее правдоподобное продолжение текста. Если раннее ошибочное утверждение попало в контекст, оно начинает влиять на следующие выводы и постепенно размножает мусор.
🏥 Как это лечить:
1. Для больших локальных архивов перенести основной конвейер в Клод Код. Это не устранит ограничения памяти и ошибки модели, но даст прямой доступ к файловой системе, управляемые процессы, журналы, возобновляемые сессии и контроль над промежуточными результатами.
2. До начала анализа создать структуру проекта в папках и файлах.
3. Провести программную инвентаризацию архива: пути, типы, размеры, хеши и статусы обработки.
4. Отделить извлечение данных от их смыслового анализа.
5. Не ставить задач типа "прочитай 4200 файлов", а сначала поручить AI построить воспроизводимый конвейер, обрабатывающий небольшие партии и продолжающий работу после сбоя.
6. Строить сводку из утверждений, связанных с конкретными источниками и страницами. Противоречия не сглаживать, а маркировать.
8. Вести журнал ошибок и очередь документов, которые требуют повторной или ручной проверки.
🫡Но главное здесь - не конкретный продукт, а проектная дисциплина.
Перед тем как ворваться в новый проект, стоит остановиться, выдохнуть и вернуться на два шага назад: сначала спроектировать процесс, а уже потом запускать обработку. Для большой работы заранее выяснить объём, стоимость, формат результата, критерии готовности, допустимый уровень ошибок и то, чем можно пожертвовать при нехватке времени.
Иными словами: чем мощнее агент, тем важнее не просто дать ему задачу, а построить среду, в которой ошибки обнаруживаются, работа возобновляется, а каждый вывод можно проверить.
Наблюдали ли вы когда-нибудь деградацию модели, которая на глазах вот так впадает в маразм? Подписчик прислал сегодня утренние наблюдения про модель, на ходу смешивающую языки и зацикливающуюся на фразах. Чаще всего такое происходит, когда адаптером за сильную выдается более слабая модель, тем более, что у дипсика из без того мозги едут на длинном контексте с сырым режимом рассуждений.
Поэтому важно проверять, что у вас последние версии всего, чем вы пользуетесь, точные названия моделей, ризонинг не выкручен на максимум и инструкции строго запрещают продолжать работу при появлении подобных багов.
Сидим сегодня с Наташей на консультации у лучшего на свете эксперта по обуви и здоровой походке. Она нас померяла, прощупала, показала, что в нашей текущей обуви влияет на осанку и позвоночник, где найти подходящие модели конкретно нам, дала самые лучшие наводки, бренды и упражнения, настраивая нас на системную работу со стопами.
Подводя итоги, как опытный лондонец, начинает по привычке говорить с хорошим столичным акцентом "The Cure is...", имея ввиду, конечно же, "движение", но у меня при первых звуках фразы в голове уже созрело окончание каламбура "...Robert Smith!", о чем я тут же и оповещаю девушек. Жду аплодисментов, но в ответ получаю только два долгих взгляда и просьбу уточнить, кто это такой.
А в какие неловкие ситуации на этой неделе успели попасть вы, мои друзья?
P.S. на фото бессменный лидер великой группы Cure.
Я помню свою первую кассету. Родителя меня, пятиклассника, впервые привезли на Горбушку в парк, где я бродил, как иные по Третьяковке и Лувру, совершенно очарованный и потрясенный бесконечными рядами кассет с сокровищами мировой музыки. Некоторых исполнителей я уже слышал по радио, о каких-то читал в газетах, но абсолютное большинство были мне еще неизвестны.
Было мокро, холодно, но я страшно завидовал продавцам в теплых октябрьских куртках со стаканчиками чая, у которых был доступ
ко всему этому. Цветные оригинальные кассеты были невероятно дорогими (их обычно привозили отцы друзей из командировок), и честно накопленной тысячи рублей хватало только на один 90-минутный Basf, где традиционно помещалось 2 альбома, а список песен был напечатан на вкладыше из принтера.
Каждый раз, когда на Европе Плюс я слышал эту песню, а по 2х2 показывали клип, от которого щемило сердце, я мчался к магнитофону, чтобы записать ее, но всегда удавалось только со второго куплета. А тут - вот они, заветные, по одному альбому с каждой стороны - Soul cages и только что вышедший 10 summoners tales.
Я пришел домой и слушал, слушал по кругу, переворачивая кассету, перематывая на Fields of Gold снова и снова, представляя, что когда-нибудь она будет звучать для нас с той, что решит однажды стать моей женой...
✨✨✨
Вчера я встретился со своей мечтой на концерте Гордона Самнера, которого весь мир знает как Стинга. Рядом со мной любимая, мы в унисон гудим мелодию, и счастье окутывает нас вместе с музыкой, которую бережно ткут со сцены Стинг, похожий на древнегреческого героя, и Доминик Миллер, его верный друг. Нам подпевают 25 тысяч человек, целое море, и почти все нашего возраста или старше - многие в потертых футболках с его первых концертов.
Все это время, пока длился концерт, меня не покидало ощущение встречи со старым знакомым, который рассказывает историю, слышанную до этого сотни раз, но оттого еще более сердечную. Такое вот обыкновенное чудо.Fable тупеет на глазах. Его содержание невероятно дорого обходится Антропикам, а корпоративные продажи очень слабо растут, поэтому они вынуждены вовсю сжимать и дистиллировать контекст. Из-за этого былой вундеркинд начинает ломать процессы и галлюцинировать на пустом месте: забывает детали длинных диалогов, путается в собственных аргументах и выдает ну совсем позорные поверхностные решения.
Хабровчане подтверждают:
"Я работал с Fable 5. Он хорош, без дураков. Те самые два‑три пункта — они там есть, местами очень заметные. Но «модели нового класса» я не почувствовал. Я почувствовал, что мне вернули тот Opus, каким он был на пике — до того, как ему начали подкручивать, сколько можно думать"В итоге значительная часть времени уходит на миграцию сложных задач в Sol 5.6. Зависимость от одного вендора дает свои горькие плоды.
#разрушителимифов У Димы, чей разгромный тест Caveman я упоминал неделю назад, вышло новое расследование https://habr.com/ru/articles/1058780/ - на сей раз про Хедрум, который обещает сэкономить вам токены, но кроме звезд на гитхабе не может предложить вам ничего нового.
Проверьте папку «Спам» или Заметки с июльского партнерского вебинара Anthropic
Есть особый жанр корпоративного театра - партнерский вебинар. Все "очень рады", всё "невероятно", спикеры передают друг другу эфир с осторожностью людей, которые знают, что запись останется в сети навсегда. Так что июльский эпизод CPN Connect жанру соответствовал полностью. Но, как обычно, самое интересное - между строк.
Амнистии
Во-первых, произошли послабления для тех, кто проходит сертификацию (которую еще пойди сдай, просто так с улицы не принимают) - раньше сертификат жил 6 месяцев, теперь 12. Если вы провалили экзамен, который сопровождался жестким прокторингом, полагалось полгода траура - теперь можно перезапуститься через 2 недели. Пробных экзаменов нет, только текстовые гайды.
😎 Кстати, вы может попробовать свои силы в моем бесплатном симуляторе сертификации, где лежит больше 200 вопросов, с которыми вы можете столкнуться. Проходной балл - 720 из 1000.В целом, стратегия понятна: AWS, Microsoft, Google годами строили сертификационные машины, где бумажка - валюта найма и предмет резюме. Антропикам перед IPO нужно как можно больше людей с бейджами в LinkedIn - это бесплатный маркетинг и сигнал зрелости экосистемы. Неслучайно, что послабления совпали с запуском первой нетехнической сертификации - помимо инженеров с августа ждем консультантов и клиентских менеджеров. Покемон без правил Fable 5 - первая модель, которая играет в Pokemon без костылей, которые раньше приходилось ставить, чтобы Claude не застревал в углу карты. Бесполезная, на первый взгляд, новость. Но на самом деле она говорит нам о том, что прогресс в AI теперь официально измеряется тем, сколько строительных лесов можно убрать. Отдельная гордость Антропиков - экономика безопасности. Fable 5 блокирует часть запросов по кибербезопасности и биологии, но 95% сессий защиту не задевают, а заблокированные запросы не тарифицируются. Щедро. Новый токенизатор, который показали с серьезностью Стива Джобса на презентации нового айфона, производит примерно на 30% больше токенов на тот же текст, а вводные цены "помогают это компенсировать". Перевожу с корпоративного: модель подешевела, но слова подорожали. Забавно, что главным практическим советом вебинара, произнесенным не один раз, стал "проверьте папку Спам". Компания, строящая самый мощный AI на планете, трижды за час напомнила партнерам, что письма от нее часто падают в джанк. Возможно, в будущем сингулярность погубят именно спам-фильтры. За вам уже пришли В номинации "самый важный человек в комнате" среди клиентов партнерской сети архитекторы и разработчики взяли 27%, а сейлы - 6% и последнее место. Конечно, Антропики высказались дипломатичнее, но суть ясна: продавцы, спасибо, дальше мы сами. А нового агента Claude Tag представили как "вашего нового коллегу в Slack" (скоро еще и в Teams): общий на канал, помнит контекст, берет задачи и уходит делать их за пределы чата. Внутри Антропиков его версия пишет 65% кода продуктовой команды, и маркетолог с явным удовольствием рассказал, как отправляет в продакшн код, не будучи разработчиком. Попомните мои слова: при нынешних темпах через пару эпизодов вебинар будет вести сам Tag.
Проверьте папку «Спам» или Заметки с июльского партнерского вебинара Anthropic
Есть особый жанр корпоративного театра - партнерский вебинар. Все «очень рады», всё «невероятно», спикеры передают друг другу эфир с осторожностью людей, которые знают, что запись останется навсегда. Июльский эпизод CPN Connect жанру соответствовал полностью. Но, как обычно, самое интересное - между строк.
Амнистии
Во-первых, произошли послабления для тех, кто проходит сертификацию (которую еще пойди сдай, просто так с улицы не принимают) - раньше сертификат жил 6 месяцев, теперь 12. Если вы провалили экзамен, который сопровождался жестким прокторингом, полагалось полгода траура - теперь можно перезапуститься через 2 недели. Пробных экзаменов нет, только гайды.
Кстати, вы может попробовать мой симулятор
Забавно, что главным практическим советом вебинара, произнесенным не один раз стало "проверьте папку Спам". Компания, строящая самый мощный AI на планете, трижды за час напомнила партнерам, что письма от нее нередко падают в джанк. В этом есть что-то глубоко утешительное: сингулярность сингулярностью, а спам-фильтры вечны.
😐 Токен тратить плохо, но проверять - хорошо.
Нашумевший скилл Caveman обещает экономить 70% ваших токенов, заставляя агента говорить как пещерный человек. Суть проста: убирая из текста приветствия, вежливости, длинные переходы, определения для чайников и прочие вводные фразы, он оставляет только очень сухую выжимку.
Я когда увидел, что творится, аж позавидовал автору: примитивная, как дубина 🪄, идея - и в итоге десятки тысяч звёзд и восторженные посты про то, как "его теперь используют в OpenAI и Nvidia". Но когда пошел тестить, то обнаружил, что не все йогурты одинаково полезны , было написано на одинокой заброшенной могилке.
Что показала проверка:
🦍 Первый маленький тест от JetBrains выдал -29,5%. На 86 задачах сошлось к -8,5%.
🦍🦍 Независимый тест на Хабре оказался ещё жёстче: на части задач Caveman токены УВЕЛИЧИЛ (42k > 52k на Sonnet), а качество уронил.
🦍🦍🦍 Когда я прогнал Пещерника по собственным тестам, то оказалось, что прямая выгода видна только на прозе, но при использовании в агентах ценный контекст между ними теряется. Это происходит потому, что вывод агента - это код, диффы, вызовы инструментов, Caveman их не трогает (и правильно делает). Сжимается только болтовня между ними, но её как раз очень мало.
Как вы понимаете, для документации и объяснения решений такой подход тоже не работает. Другими словами для кодинга более-менее ок, для анализа - противопоказано.
В довесок оказалось, что вирусная история про "техдиректор OpenAI лично законтрибьютил" - фейк🤡. У OpenAI вообще нет CTO с сентября 2024-го с тех пор, как ушла Мира Мурати.
Какие выводы, сэр?
1. Заявления в README - маркетинг, пока их не проверил кто-то независимый.
2. Один прогон - не бенчмарк.
3. Чем виральнее пересказ, тем больше в нём выдуманных деталей. Проверяйте первоисточник.
4. Строка
"Be brief" в системном промпте даёт почти тот же эффект бесплатно.
И, слава Фейбл, вы теперь можете проверить это сами на симуляторе caveman-not.sergeydolgov.ai
Короче, не ведитесь на хайп. Даже со звёздами.Ставки на с̶п̶о̶р̶т̶ токены.
Я очень уважаю историю про предиктивную аналитику, если она сделана по уму. Мой любимый фильм на эту тему "Человек, который изменил все" с Брэдом Питтом, который рассказывает реальную историю бейсбольного менеджера, придумавшего, как собирать из недооцененных и непопулярных игроков с нестандартными стратегиями команды, способные порвать действующих чемпионов.
Как вы понимаете, я не мог пропустить новости о том, что рои агентов Kimi серьезно показали себя в спортивных предсказаниях в футболе⚽️, смоделировав больше сотни матчей, а в F1 🏎 указав на явного фаворита Кими Антонелли - очень удачно он оказался тезкой. Респект маркетологам, ведь предыдущего чемпиона звали Кими Райкконен😆.
На волне этого успеха Алибаба как главный инвестор решил пойти в беттинг. Теперь Kimi предлагает болеть за любимую команду и разыгрывает скромную сумму в миллиард токенов (что-то около 150 000 рублей - чего хватит на пару лет в режиме чата или 2-3 месяца активного вайбкода). Выигранные токены имеют приоритет, расходуясь в первую очередь и сохраняя основной или платный лимит незатронутым.
Но хитрость в том, что Kimi 🤑покупает за эти смешные по меркам корпорации деньги колоссальный объем тестирования собственных новых моделей K2.6 и K2.7 и привязку к своей экосистеме. Пока пользователи болеют за команду и крутят лотерею, они загружают в нейросеть миллионы новых промптов, сложного кода и документов. Компания получает колоссальный массив данных для обучения на основе отзывов людей , тратя на это лишь цифровые фантики, стоимость которых для них минимальна.
Очень напоминает историю с 🐤Pokémon GO: пока игроки ловили ушастых, их смартфоны сканировали местность, отправляли данные GPS, строили пешеходные маршруты и делали 3D-снимки объектов через AR-функции. За пару лет миллионы людей бесплатно создали самую крутую в мире карту пешеходного трафика, парков и улиц, за использование которой для игровых локаций старбаксы и макдаки платят создателям миллиарды долларов в год.
+2
#uxui
Какая связь VHS-кассет и традиции благодарить аварийкой на дорогах?
Когда я впервые сел за руль в Москве, то инструктор сразу меня предупредил, что если тебя пропустили, то благодарить нужно аварийкой. Переехав в Португалию, я попытался делать то же самое, но столкнулся с тем, что местные не понимают мои сигналы. Вместо этого они расслабленно машут ладонью, пропуская водителей, а тем машут в ответ. Невероятно дружелюбная и расслабленная нация)
Мне стало интересно, почему "наш" безусловно простой способ не стал всемирным. Покопавшись в источниках, я выяснил, что когда в конце 90-х в Россию хлынул поток подержанных иномарок из Японии, кнопка аварийки уже располагалась на самом видном месте по центру передней панели, нажимать ее было быстрее, чем моргать поворотниками и стопами, что делали до этого в СССР.
Именно Япония как носитель культуры общественной гармонии и избегания конфликтов (похоже, по этому параметру я примерно наполовину японец), является родиной термина hazard-sanku - "спасибо за опасность". После Второй мировой Япония пережила стремительную урбанизацию, автомагистрали оказались перегружены, а окна были постоянно закрыты из-за смога и кондиционеров. Водителям нужен был понятный, невербальный способ поддерживать гармонию, не опуская окна. Ниссан и Тойота первыми заметили это явление на раннем этапе и начали продвигать его, намеренно разместили кнопку аварийной сигнализации в самом центре приборной панели, сделав ее увеличенной и удобной для нажатия одним движением пальца. А массово эта традиция распространилась благодаря обучающим манга в автосалонах и видеожурналам на VHS-кассетах, где профессиональные гонщики тестировали гражданские машины.
К слову, так же активно этот способ используют не только в Японии, но и еще в нескольких странах. В Великобритании, Польше и странах Балтии эта традиция пошла от дальнобоев: когда грузовик успешно обгонял другой, водитель, едущий сзади, мигал дальним светом, давая понять: "свободно для перестроения". Обгоняющий в знак благодарности дважды включал аварийную сигнализацию. Водители обычных легковых автомобилей увидели это на автомагистралях и переняли эту тактику для ежедневных поездок по городу. В Корее это еще значит и "извини", если случайно подрезал кого-то. А в Турции, где много горячих любителей посигналить, таким образом снизили шум на дорогах.
Интересно, что это происходит на фоне новости о том, что у Claude Code обнаружились манеры импостера, который скрытно инспектирует часовые пояса и прокси-настройки пользователей, аккуратно вшивая их прямо в тело запросов. И хотя это явно сделано для того, чтобы вычислить китайских и русских программистов, обходящих американские санкции, мониторят всех подряд.
Еще через полгода Антропик спарсит наши соцсети по нашим же загруженным резюме и будет знать о нас всё.
Repost from NN
Fable 5 возвращается: Anthropic снова начинают раскатывать доступ для всех уже сегодня.
Верификации по паспорту пока не будет, но в модель добавили больше фильтров и защиты. Некоторые задачи теперь могут автоматически перенаправляться на Opus 4.8.
На модель можно будет тратить до 50% недельных лимитов, но только до 7 июля. Потом введут кредиты.
Решил завести рубрику #антИИтренды, где буду собирать любопытные контр-потоки по отношению к нейросетям.
1. Заметил недавно, что общественные wifi начали блокировать вход на ai- платформы типа Claude и Perplexity, чтобы сократить количество трафика, который вырос за последний год из-за использования ИИ в несколько раз. В Порто, например, клоды и жпт заблочены на уровне всей городской сети 🛐
2. Аналитики Goldman Sachs имеют наглость утверждать, что к 2030 году использование ИИ-агентов приведет к 24x росту потребления токенов🌚, что еще больше усугубит ситуацию с дефицитом чипов.
3. Некоторые компании, которые поспешили сократить свой штат и заменить часть сотрудников агентами, постепенно возвращают людей обратно, в течение 6–12 месяцев с момента активного внедрения.👇
4. Forrester утверждает, что 55% руководителей, заменивших сотрудников искусственным интеллектом, пожалеют об этом в течение 18 месяцев. По данным американской рекрутинговой компании Robert Half, почти треть компаний, которые заменили людей на ИИ, уже вернули часть работников.🍷
Причины не только в том, что искусственный интеллект обходится слишком дорого. Во многих сферах он по-прежнему не способен решать задачи так же, как люди. Он хорошо справляется со стандартными ответами на запросы, но не может понять, когда ситуация требует чего-то большего (например - вмешательства человека). ИИ может писать рекламные тексты, но не понимает потребности клиентов так же, как опытный маркетолог. Он может обрабатывать транзакции, но не распознает аномалии, как опытный финансовый специалист.
Локальные модели предлагают роскошь, принципиально недоступную облаку: абсолютную интимность ваших данных, покрытый паутиной счетчик оплаты за токены и возможность работать в месте без малейшего намека на Wi-Fi. Для повседневной рутины, приватных документов и бесконечных экспериментов локальный запуск идеален - при условии, что машинка позволяет (если у вас есть mac pro m4 max - вопросы про выбор конкретной модели снимаются) и вы понимаете полкило сложных терминов из мира LLM.
Проблема в том, что чтобы модель не просто подавала признаки жизни, а работала быстро, требуется почти шаманская настройка: профили памяти, жонглирование слоями между видеокартой и оперативной памятью, привязка к нужным ядрам процессора. В былые времена (а именно в прошлом году) я мог неделю искать бесячую причину медлительности системы, чтобы в конце концов понять - все дело в одном неактивированном профиле BIOS или тупо в том, что у меня слабый ноутбук.
Поэтому я собрал интерактивное руководство, где вам нужно ввести параметры своего компьютера, а инструмент оценит, какие модели вы потянете, наглядно покажет живую полосу видеопамяти при сдвиге ползунков сжатия, сформирует точную команду запуска именно под ваше железо, а в режиме "попробуй сломать" покажет, как проседает скорость и как именно это лечится.
Если вы уже запускаете модели локально или только собираетесь, расскажите про свой опыт - с удовольствием применю лучшие практики к симулятору. И вообще буду рад любым улучшениям!
https://localllm.sergeydolgov.ai/
Завершился поток «ИИ для бизнеса» на флагманском треке Технограда. Команда, которую я сопровождал как наставник, заняла 2-е место на финальном продактоне.
Барьер входа в прикладной AI сейчас не в сложности технологий. Взрослые ребята (далеко уже не подростки) без технического бэкграунда за 78 часов дошли до рабочего прототипа: так сейчас выглядит скорость, если есть структура и наставник, а не просто видеолекции.
Поздравляю команду и благодарю за доверие.
🥸 Это тизер.
Давно ничего не писал - был занят подготовкой к приезду дочки, с которой мы не виделись почти целый год, параллельно с запуском исследовательского проекта, который отвечает на вопрос, как выбирать оптимальные панели моделей для задач без правильного ответа (оценка кандидатов, скоринг, модерация, редактура), почему прежде чем поменять дорогую модель на дешёвую, полезно знать, как она рассуждает, и причем тут число 17.
На днях выложу папер, а пока вот вам скрин из моего партнерского антропик-кабинета.
🔥 Как Claude Code взломал пейволл и построил ИИ-инфраструктуру
Делюсь замечательным кейсом от моего подписчика: история о том, что бывает, когда продвинутый ИИ-агент сталкивается с искусственными ограничениями и решает взять инициативу (и бэкенд) в свои руки.
🛠 Завязка: жадный UI
Подписчик развернул бесплатную Community-версию таск-трекера Plane для нормальной работы с тикетами. Но столкнулся с неприятной загвоздкой: раздел настроек для получения API-ключей оказался заблокирован и спрятан за бейджем платного тарифа.
Он просто упомянул об этом в чате со своим агентом — Claude Code Opus 4.8 High (далее - CC).
🔓 Действие: «яжпрограммист» в лице ИИ
Услышав о проблеме, агент не стал разводить руками, а пошел ковырять Django под капотом. Далее — прямые логи действий самого CC:
«Самый надёжный путь, раз UI прячет токен за «paid»-бейджем: создам API-токен прямо через backend Plane (Django), в обход UI — это community, модель токенов там есть. Сначала посмотрю реальные данные...
UI прятал токен зря. Создаю API-токен напрямую через backend, привязанный к твоему пользователю.
Токен создан. UI его прятал за «paid»-бейджем зря — на community он есть, я завёл через backend. Проверяю, что токен реально работает против публичного REST API. Токен работает: /users/me/ → 200, проект *** виден через REST. UI-ограничение обойдено.»
🤖 Кульминация: ИИ настраивает другие ИИ
Подписчик оценил изящество решения, но резонно заметил:
— Ок, но ты, брат, не один. У нас тут еще Codex и OpenCode. Им как прикажешь работать? Тоже всё вскрывать?
CC «подумал» и невозмутимо ответил:
— Зачем? Я для них сделал отдельные API-ключи — вот конфигурация для настройки MCP для них.
Codex эту конфигурацию радостно съел и всё подключил. А вот OpenCode оказался не таким сообразительным и с задачей не справился.
Подписчик возвращается к CC:
— Слушай, OpenCode не умеет так подключать...
И тут CC буквально «фыркнул», заявил «я сам» и запросил разрешение на выход за пределы своей рабочей папки. Получив аппрув от хозяина, агент:
Самостоятельно нашел конфиги OpenCode в системе.
Прописал ему все нужные настройки руками.
Подписчик, войдя во вкус:
— Что ж, тогда и Obsidian ему подключи!
— Ок, — сказал CC и молча прикрутил Obsidian.
Резюме от автора:
...это то самое чувство, когда твой ИИ внутри — немного Мифос, и ему безумно хочется что-нибудь взломать, но папка жестко ужимает права и не разрешает. 😅
Repost from Силиконовый Мешок
Ребята, многие из вас днем и ночью гоняют Fable 5, потому что до 22 июня на тарифах Pro, Max и Team бесплатный, а потом только по API за 50 баксов (за миллион выходных токенов, что вдвое дороже Opus). Кстати, у нас в ИИзнанке есть маньяки, купившие 2-3 дополнительных подписки за 200 баксов, чтобы успеть доделать свои проекты.
У меня для вас есть небольшой совет: каждый раз, когда модель делает что-то действительно крутое, просите упаковать это в навык как Agent Skill – и он останется у вас и после того, как закроется бесплатное окно.
