Да придет ИИ: ChatGPT, Claude, Gemini, Grok
Kanalga Telegram’da o‘tish
Ko'proq ko'rsatish
3 436
Obunachilar
-124 soatlar
+67 kun
-6030 kun
Postlar arxiv
Главная моя критика Dots
То что будет доступно бесплатно, но подписчикам Pro, но и то не всем.
Как сэкономить токены в Claude Code ультимейт гайд
Основанный на моем более чем 1.5 годовом опыте работы с КК.
Поймите, основная статья расходов - это не генерация новых токенов - это чтение из кэша. Уже писал об этом тут.
Как это вообще происходит? В агентом цикле КК снова и снова перечитывает всякий мусор:
• Он шарахается по интернету и от туда все пылесосит в контекст
• Он шарахается по жесткому диску и все собирает.
• Его просто циклит на ровном месте.
Писал об этом тут.
Чтобы бороться с циклами я даже сделал отдельный проект, но он пока не готов.
КК имеет 2 типа кеша:
• стандартный 1 часовой - просто не отходите от КК больше чем на час, а если ушли на долго запускайте компактацию.
• 5 минутный для агентов. Просто не запускайте агентов самостоятельно. КК делает это сам автоматически когда нужно.
Подробнее про кэш.
Как сэкономить еще больше:
1. Начните с команды /context она показывает, чем вообще засрано. Так я обнаружил, что мой самописный MCP содержит в себе 134 туда с очень жирными описаниями, и вот это просто пассивно отжирало лимиты. все эти скиллы и мсп вы просто платите пассивный налог на каждый. писал об этом тут.
2. Команда /insights там КК выдает вам тонну советов, в том числе и по сокращению потреблению лимитов.
3. /skill-doctor - проверяет не жрут ли скиллы, скорее всего не жрут, но проверить стоит.
4. Не устанавливайте всякие сомнительные инструменты для "экономии токенов" из интернета. Как я обжогся с Headroom больше экспериментов не хочу (хотя в блог писать надо). А например в скилле superpowers (не знаю как сейчас, но раньше так было) дефолтная разработка была субагентами, а там кэш 5 минут, и лимиты это выжирало мгновенно. Не знаете как это работает — лучше не запускайте, вот что я для себя усек.
Для что я могу посоветовать для экономии токенов:
скил понитейл — как это работает? он сокращает написание кода. А значит меньше кода будет записано в контекст, и меньше контекста попадет в циклы. сам автор называет скромные цифры 20-30% экономии, но меня вдохновило сообщение в чате, там человек писал что перепробовал и стоунмэн, и сирена и кодеграф, реально экономит только понитейл.
команда /simplify - она проверяет код на задублирование, меньше кода - меньше мусора в кэше.
И заметьте ни слова про CLAUDE.md (писал тут) и /memory (еще не писал) т.к. это уже должно быть очевидно.
Если после прочтения этой статьи вам не удалось сэкономить токены — требуйте от меня возврата денег за чтение!
Пройдите интервью с ИИ!
Был бы я обычным пользователем я бы нафиг послал за такие просьбы, но как фанат ИИ я должен поучаствовать в развтии ИИ.
https://claude.ai/anthropic-interviewer/your-thoughts-on-ai?from=spotlight
Ребята, дошли тут до меня интересные новости о том, что:
Франция созвала Совет Безопасности ООН, чтобы Дарио Амодеи зачитал по веб-трансляции своё сообщение
Франция, которая председательствует в Совбезе в сентябре, заранее созвала заседание «Artificial intelligence and international security» на 23 сентября. Еще 18 сентября Reuters писал, что Altman будет там выступать и что Anthropic тоже может принять участие.
Т.е. Антропики даже заранее свое участие не подтвердили.
А Anthropic объявила ART 23 сентября, то есть в день заседания. Амодеи просто очень удачно получил свежий пример для своего выступления.
Факт: Claude уже продемонстрировал довольно автономный поиск новой биологии.
Не доказано: что Claude сейчас способен самостоятельно создать новый опасный патоген, эффективное биологическое оружие или тем более средство «вымирания человечества».
Еще интереснее факт, что:
Всю лабораторную работу делают люди. Лаборатория Антропик работает только с уровнями биобезопасности BSL-1 и BSL-2 и не имеет дела с патогенами, опасными для человека.Ребята, «Новый вариант CRISPR». Это пока гипотеза. И CRISPR ли это вообще? Функция системы ART неизвестна. Не ведитесь на хайпожориков всяких. Читайте правильные ТГ-каналы.
На гитхабе стремительно вирусяться Jev репо
Вот например этот предлагает использовать Jev для стремительной компакции: https://github.com/tamaratran/fast-jev-compaction — уже 5К звезд.
Напишите в комментах, не страшно ли тестить такое?
Какая модель лучше пишет тексты на русском языке?
Для этого есть текстовый лидерборд arena.ai
Модели от ОпенАЙ тексты традиционно пишут ну очень плохо.
Вы можете сами зайти в Battle Mode и посравнивать как пишут тексты разные модели и сравнить между собой.
https://arena.ai/leaderboard/text/russian
Claude тестирует новую версию Projects
Пока только в Claude Code.
Раньше проект был базой знаний с историей чата. В новой версии проект — это один непрерывный диалог. Формулируете задачу, Claude разбивает её на параллельные потоки и выполняет в облаке. Закрыли ноутбук — потоки продолжают работать.
Каждый поток стартует с доступом к файлам проекта, репозиториям, инструкциям и памяти. Библиотека проекта собирает всё, что вы загрузили, и всё, что создал Claude.
Доступ: часть пользователей Pro и Max с Claude Code. Остальные — по мере раскатки, затем очередь дойдёт до Cowork, Team и Enterprise. Без доступа — лист ожидания на claude.com/form/projects.
Старые проекты в чате и Cowork работают как раньше, апгрейд получат позже.
Лимиты расходуются как при любом использовании Claude. Несколько параллельных потоков тратят их быстрее.
Google выпустил Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking для голосовых агентов
И он нагибает все, кроме Gemini 3.1 Live и это все не модели кодирования. А голосовые агенты.
Extended Thinking занял первое место в рейтинге Artificial Analysis по качеству речь-в-речь — 82,6 балла, 97,7% на Big Bench Audio.
Не знаете в чем отличие между обычным чатом и Cowork в Claude.ai?
Вот и Антропик тоже не знают, поэтому объединили их в одно окно. Но функция будет выкатываться в течении 2х недель, так что время разобраться в чем там разница еще есть.
https://claude.com/blog/cowork-is-now-claude
Хочу посоветовать вам мой новый канал про Vibe Coding
Потому что весь движ сейчас там
@prog_ai
+1
Протестировал GPT-2.0 vs GPT 2.5
Промпт:
Создай изображение, на котором умести как можно больше разных акул в натуральную величину, и к каждой акуле сделай подпись, что это за акула.
Как видим, изображение менее "плывет" на большом количестве деталей.
Все элементы не смешиваются и подписи выполнены четко.Вышел GPT-image-2.5
Наконец-то обновился самый лучший генератор изображений!
Нвидеа покупает Обнимашки за $12,930,300,000
Это говорит о том, что Зеленый Гигант делает ставку на домашнее оборудование для конечных пользователей.
Т.е. раз уж корп. клиенты проектируют свои собственные чипы для отказа от Нвидеа, то Нвидеа сделает опенсорс модели дешевыми и разнообразными, чтобы мы покупали их железяки для запуска их моделей локально.
А я еще думал, за чей счет банкет.
Подарите друзьям кредиты в ChatGPT
Это кстати еще один способ обходит санкции, но... получится уж больно дорого
Stability AI привлекла $76 млн от Electronic Arts, Sony Music, Universal Music, Warner Music и других
Компания объявила, что привлекла раунд B. Оценку не раскрыла.
Всего стартап привлёк $232 млн под руководством гендиректора Према Аккараджу. Он занял должность в 2024 году вместо сооснователя Эмада Мостака, который покинул пост на фоне ухода «ключевых» сотрудников и предполагаемых финансовых проблем.
Среди новых инвесторов — Electronic Arts, Sony Music Group, Universal Music Group, Warner Music Group, а также инвестфирмы AMD Ventures и Pacific Alliance Ventures. У компании уже есть партнёрства с Electronic Arts, Universal Music и Warner Music.
Предполагается, что будут разрабатывать модели для генерации музыки.
