Telegram Man's blog (Mirror)
رفتن به کانال در Telegram
3 696
مشترکین
-824 ساعت
-337 روز
-15030 روز
در حال بارگیری داده...
کانالهای مشابه
ابر برچسبها
هیچ دادهای
مشکلی وجود دارد؟ لطفاً صفحه را تازه کنید یا با مدیر پشتیبانی ما تماس بگیرید.
اشارات ورودی و خروجی
---
---
---
---
---
---
جذب مشترکین
سپتامبر '26
سپتامبر '260
در 0 کانالها
اوت '26
+2
در 0 کانالها
Get PRO
ژوئیه '260
در 0 کانالها
Get PRO
ژوئن '260
در 0 کانالها
Get PRO
مه '26
+2
در 0 کانالها
Get PRO
آوریل '26
+1
در 0 کانالها
Get PRO
مارس '26
+3
در 0 کانالها
Get PRO
فوریه '26
+3
در 0 کانالها
Get PRO
ژانویه '260
در 0 کانالها
Get PRO
دسامبر '250
در 0 کانالها
Get PRO
نوامبر '25
+3
در 0 کانالها
Get PRO
اکتبر '25
+2
در 0 کانالها
Get PRO
سپتامبر '25
+51
در 0 کانالها
Get PRO
اوت '25
+66
در 0 کانالها
Get PRO
ژوئیه '25
+17
در 0 کانالها
Get PRO
ژوئن '25
+38
در 0 کانالها
Get PRO
مه '25
+8
در 0 کانالها
Get PRO
آوریل '25
+4
در 0 کانالها
Get PRO
مارس '25
+4
در 0 کانالها
Get PRO
فوریه '25
+29
در 0 کانالها
Get PRO
ژانویه '25
+28
در 2 کانالها
Get PRO
دسامبر '24
+541
در 3 کانالها
Get PRO
نوامبر '24
+109
در 4 کانالها
Get PRO
اکتبر '24
+106
در 8 کانالها
Get PRO
سپتامبر '24
+855
در 11 کانالها
Get PRO
اوت '24
+1 131
در 9 کانالها
Get PRO
ژوئیه '24
+9 147
در 32 کانالها
Get PRO
ژوئن '24
+111
در 13 کانالها
| تاریخ | رشد مشترکین | اشارات | کانالها | |
| 02 سپتامبر | 0 | |||
| 01 سپتامبر | 0 |
پستهای کانال
Repost from Telegram Man's blog
LiUM убрал бонус $5 — похоже, не выдержал наплыва 📉
В видео про запуск Qwen3.8-27B-Uncensored я давал свою ссылку на LiUM — сервис аренды GPU на базе Bittensor. Новым аккаунтам там начисляли $5, этого хватало на первые часы аренды RTX 5090: можно было попробовать вообще бесплатно.
После публикации по ссылке зарегистрировалось прилично народу. Сейчас пишут, что бонуса больше нет: новым пользователям сразу предлагают пополнить баланс. Видимо, в LiUM решили, что пошёл абуз, и просто прикрыли лавочку.
Если не успели поймать бонус — не страшно. Что бы я делал на вашем месте:
1. Сравнивайте цены с Vast.ai
Там часто дешевле, чем на LiUM. Но цены динамические: на одну и ту же видеокарту сегодня выгоднее одна площадка, а завтра — другая. Перед каждым запуском сравнивайте обе, это буквально пара минут. А лучше просите делать это агента.
→ LiUM — регистрация — оплата криптой или иностранной картой
→ Vast.ai — регистрация — то же самое: крипта + иностранная карта
2. Если нужно именно за рубли
Есть российский аналог — qudata.ai. Но скажу честно: для работы лучше заморочиться с иностранным способом оплаты или криптой. Что аренда GPU, что аренда серверов у российских площадок всегда заметно дороже.
✈️ Подписаться на канал
| 2 | Запускаем модель без цензуры бесплатно 📹
В новом видео показываю, как за пять минут запустить Qwen3.8-27B-Uncensored на арендованной RTX 5090 — даже если у вас обычный ноутбук без подходящей видеокарты. Первые часы можно ничего не платить: LiUM начисляет новым аккаунтам $5, а всю установку делает агент по одной ссылке.
По ряду тестов Qwen3.8-27B находится примерно на уровне Claude Opus 4.6. Только в этой сборке вырезали направления, отвечающие за отказы. Обычная модель отказала в 98 вредоносных запросах из 100, эта — только в 12.
Её выложили 14 августа. За неполный месяц одну только GGUF-сборку скачали уже больше 2 миллионов раз.
Поэтому я и решил показать, насколько доступными стали такие модели. Не для того, чтобы кто-то повторял опасные запросы, а чтобы вы понимали, что уже сейчас есть у других людей — в том числе у злоумышленников. Лучше знать об этом, чем однажды сильно удивиться.
При этом модель полезна и для вполне легальных задач, на которых ChatGPT, Claude или DeepSeek иногда отказывают просто из-за перестраховки. Если эту работу всё равно нужно выполнить, открытая модель без фильтров может помочь.
Буду рад, если поддержите канал во время просмотра: поставите лайк, подпишетесь на YouTube и оставите любой комментарий. Активность важна для алгоритмов YouTube. И для меня тоже: чем её больше, тем больше мотивации делать новый контент.
📹 Смотреть видео
💻 Регистрация в LiUM — получить $5 на аренду видеокарт
🤖 Skill для развёртывания модели агентом
Приятного просмотра!
✈️ Подписаться на канал | 53 |
| 3 | OpenAI ChatGPT — нарушение политики использования и предупреждение об отключении
В процессе подготовки нового видео получил письмо счастья от OpenAI. Надеюсь, оно вам понравится 😅
✈️ Подписаться на канал | 116 |
| 4 | Судя по всему завтра очередной ресет лимитов Codex 🤖
✈️ Подписаться на канал | 110 |
| 5 | Аренда GPU в Bittensor 💻
В прошлом посте про децентрализованный ИИ я писал, что в Bittensor уже появились полезные продукты. Один из них — Lium, децентрализованный сервис аренды GPU на базе 51-й подсети Bittensor.
GPU — это видеокарты, на которых можно обучать и запускать собственные AI-модели. Вместо покупки железа вы арендуете нужную машину на несколько часов и платите только за фактическое время работы.
По ценам Lium вполне конкурирует с Vast.ai. Нельзя сказать, что через Bittensor всегда дешевле: на обеих площадках цены динамические. Но на отдельные видеокарты в Lium периодически появляются предложения выгоднее.
При регистрации дают $5 приветственного баланса. При текущих ценах этого хватает примерно на 7–8 часов аренды RTX 5090. Цена меняется, поэтому перед запуском лучше проверить актуальное предложение.
Для чего я использую такие сервисы?
В основном — чтобы разворачивать и тестировать open-source модели. У меня Mac M4, но если запустить на нём даже не крупную модель, нормально продолжать работать на ноутбуке уже не получается. Покупать отдельный сервер ради экспериментов тоже нет смысла — проще арендовать GPU на несколько часов.
Сейчас я готовлю видео, в котором через Lium разворачиваю модель со снятыми ограничениями. Она отвечает практически на любые вопросы и берётся почти за любую работу. Делаю это, конечно, в исследовательских целях — и первые результаты немного пугают.
Одной из самых мощных открытых моделей такого типа сейчас является Kimi K3 Abliterated. Но это гигант на 2,8 трлн параметров: для его запуска нужно серьёзное железо, и приветственных $5 здесь точно не хватит.
Поэтому для эксперимента я выбрал Qwen3.8-27B Uncensored. Это сильная модель на 27 млрд параметров, которую можно запустить на одной RTX 5090.
По официальным бенчмаркам базовой Qwen3.8-27B в программировании она находится примерно в классе Claude Opus 4.6 Max. На SWE-bench Pro у неё 61,7 против 53,4 у Opus, на LiveCodeBench — 90,3 против 88,8. При этом на сложном научном reasoning и части агентных задач Opus всё ещё сильнее.
Это результаты оригинальной модели. Версия Uncensored отдельно по этим тестам не проверялась, а снятие ограничений и квантизация могут немного снизить качество.
Но сам факт всё равно впечатляет: модель такого уровня можно самостоятельно развернуть на одной потребительской видеокарте. А благодаря бонусу Lium первый эксперимент можно провести вообще бесплатно.
И если у вас вдруг закралась мысль наплодить аккаунтов ради бонусных $5 - не советую. Но если будете делать - делайте с умом: используйте разные устройства и IP адреса.
Скоро покажу, как всё это работает на практике.
✈️ Подписаться на канал | 101 |
| 6 | Как заработать, обучая роботов 🤖
Компания Figure вчера публично запустила INDEX — платформу, на которой людям платят за запись обычных бытовых действий.
Я рекомендую прямо сейчас скачать приложение и подать заявку.
Спрос уже огромный, поэтому после заявки вас ставят в очередь. Но публичный запуск состоялся только вчера, 25 августа. Поэтому шанс попасть в число Creator сейчас точно выше, чем будет через пару месяцев.
Я уже подал заявку из Индонезии. С Россией пока неизвестно: Figure говорит о 108 странах, но не публикует их список. Я не нашёл подтверждения, что компания уже отправляет устройства в РФ и может платить российским участникам. Подать заявку попробовать стоит, но до одобрения я бы ни на что не рассчитывал.
За последние четыре месяца, пока INDEX работал в закрытом режиме:
— приложение скачали 264 000 раз;
— 44 000 человек пользуются им еженедельно;
— участники загрузили 16 млн видео;
— Figure уже выплатила им $15 млн.
Суть простая. Если вашу заявку одобрят, Figure пришлёт устройство для записи. В приложении вы смотрите, за какие действия сейчас платят: заправить кровать, сложить одежду, убрать комнату, приготовить еду, загрузить стиральную машину и так далее.
Включаете камеру, выполняете задачу, загружаете видео и получаете деньги за каждую принятую минуту.
Ключевое слово — принятую. Figure проверяет техническое качество, содержание, дубликаты и подозрительную активность. Поэтому несколько часов записи не означают несколько оплаченных часов.
Я бы ещё сразу следил за приватностью. Не допускал в кадр детей и посторонних людей, банковские карты, документы, личные фотографии и открытые ноутбуки. Figure публично не раскрыла все причины отклонения видео — это уже моя рекомендация. Такие записи создают слишком много юридических проблем, и их проще не принимать.
В посте про домашних роботов в конце прошлого года я писал, что главная проблема универсального робота — данные.
Текстов и картинок в интернете много. А миллионов часов видео от первого лица, где люди моют посуду, накрывают на стол и убирают разные дома, почти нет. Без этого модель не научится работать с тысячами планировок, предметов и способов выполнить одну и ту же задачу.
INDEX — попытка Figure решить эту проблему деньгами и масштабом.
Сколько можно заработать, пока непонятно: точные ставки компания не раскрывает, а оплата, вероятно, будет зависеть от страны, заданий и количества принятого видео. Я бы ориентировался на несколько сотен долларов в месяц при регулярной записи. $1–2 тысячи тоже могут быть возможны, если ставка в вашей стране окажется высокой и получится загружать несколько принятых часов в день. Но это пока расчёт, не обещание.
Figure заявила, что в следующие 12 месяцев потратит более $1 млрд на данные и вычисления. Не весь этот миллиард уйдёт участникам, но масштаб понятен.
И эта возможность не навсегда. Когда компании соберут достаточно данных, заданий станет меньше, а ставки, вероятно, упадут. Зато на этих данных обучат модели, которые будут управлять домашними роботами.
Я видел видео, где рабочие с камерами на лбу выполняют свою обычную работу. А в комментариях под такими роликами пишут: «Вот идиоты — сами собирают данные для моделей, которые будут управлять роботами, а те потом их же и заменят».
Я с этим не согласен. Роботы всё равно заберут значительную часть такой работы. Вопрос только в том, заработаете ли вы хоть что-то на этом переходе.
Поэтому минимальный смарт-мув сейчас — скачать INDEX, подать заявку и забыть. Если одобрят, уже тогда посмотрите на реальные ставки и решите, стоит ли участвовать.
✈️ Подписаться на канал | 97 |
| 7 | Децентрализованный ИИ начинает работать 🕸
Последний год-два децентрализованные сети дружно хоронили: скам, вечные тестнеты, продуктов нет. Я и сам был скептиком — когда Дуров анонсировал Cocoon, честно писал, что это для галочки.
Сейчас вижу, что штука начинает работать. Наблюдаю за тремя сетями: Cocoon, Bittensor и Gonka. Плюс Akash Network — туда планирую погрузиться поглубже в ближайшее время.
Cocoon: конфиденциальный инференс 🤖
Главная идея — никто не знает, о чём вы общались с моделью. Даже хосты, на чьих видеокартах крутится ваш запрос: он исполняется в изолированной среде, провайдер видит нагрузку, но не видит содержимое.
Первый потребитель здесь очевиден — Telegram. Переводить и саммаризировать личные сообщения так, чтобы они действительно оставались личными. Я писал, когда сеть заработала.
Но внешний потребитель интереснее:
• история болезни пациента
• юридические документы
• данные карт, приватные ключи кошельков
Всё то, что нельзя отправлять в чужой API, но очень хочется, чтобы за вас подумал ИИ.
Gonka: общественный дата-центр ⚫️
Распределённая сеть, где инференс сейчас в сотни раз дешевле официальных цен API.
Долгосрочно это может стать тем же, чем крипта стала для фиатных денег. В банке всё по паспорту: отслеживается, блокируется, зависит от чужих решений. А иногда хочется, чтобы деньги просто принадлежали тебе.
С ИИ будет та же история. Локальные модели будут умнеть и мельчать — модели уровня Opus 5 мы, скорее всего, погоняем на телефоне года через три. Но флагманские модели будут становиться ещё больше и ещё умнее, и дома такую уже не запустишь.
А вот если объединить вычислительные мощности — например, в Gonka — можно закинуть туда реально крупную open source модель и пользоваться ею вместе. Без паспорта, без региональных ограничений, никого не спрашивая.
Биткоин — общественное хранилище денег. Gonka может стать общественным дата-центром для ИИ.
Bittensor: уже не только фантики 🛒
Я писал о нём в начале 24-го на старом канале — тот удалили, сослаться не получится. Тогда моя картина была такой: экономической целесообразности нет, одни люди пользуются бесплатным инференсом, а другие за это платят, покупая $TAO.
С тех пор в сети появились полезные продукты:
• AI дешевле официального API
• аренда видеокарт
• поиск по Twitter и вебу дешевле централизованных аналогов
• даже аренда квантового компьютера
Сеть сильно выросла. Показательно, что после роста с ~$50 до $700+ токен скорректировался всего в 3 раза — посмотрите на другие монеты, там падения в 10–20 раз считаются нормой.
При этом бесполезной работы всё ещё очень много — на мой взгляд, местами это похоже на пирамиду, за которую люди просто получают токен. Проблема до конца не решена. Но за два с половиной года в сети реально появились работающие продукты — это факт.
Не спешите покупать эти токены: в экономике есть нюансы. Это тема отдельного поста — обязательно напишу.
Дальше хочу глубже погрузиться в децентрализованный ИИ и больше об этом писать.
Интересна ли вам тема? Поставьте реакцию или напишите в комментариях — мне важно понимать, что я пишу это для кого-то, а не в стол.
✈️ Подписаться на канал | 91 |
| 8 | AI спроектировал мини-белки против раковых клеток, которые после оптимизации смогли селективно уничтожать опухолевые клетки в лаборатории.
У Anthropic уже есть внутренняя модель сильнее публичной Mythos 5, которую компания не планирует выпускать пользователям и, по слухам, применяет для создания следующего поколения моделей.
OpenAI приостановила обучение своих мощнейших моделей из-за риска достижения ими критического уровня возможностей в кибербезопасности.
Китайские робокопы уже выдали больше 170 000 предупреждений водителям и пешеходам.
А под AI теперь собираются строить дата-центр мощностью до 8 ГВт — при полной загрузке за год он потребит примерно столько же электричества, сколько целая Австрия.
Это просто новости этой недели. И проходят они уже практически рутинно.
Мы всё глубже погружаемся в сингулярность и киберпанк. Просто это происходит не одним большим событием, а по пять таких новостей в неделю.
И чем больше могут модели, тем больше интеллекта нам нужно.
Раньше мой основной расход токенов приходился на написание кода. Сейчас к нему добавился монтаж видео, ресерчи, поиск информации и вдохновения, проверка гипотез, работа с документами и куча других вещей.
Постепенно обнаруживается, что агентов можно применить почти везде. А когда привыкаешь отдавать им работу, обратно делать всё руками уже особо не хочется.
При этом даже подписки за $200 не хватает, чтобы использовать самую умную модель для всего. В Claude Code нельзя постоянно работать только на Fable — лимиты заканчиваются слишком быстро.
Топовые модели требуют всё больше вычислений. Но ещё быстрее растёт количество работы, которую мы хотим им передать. Агенты становятся умнее, работают дольше и могут выполнять больше разных задач — поэтому мы неизбежно начинаем потреблять больше токенов.
Когда-нибудь нынешние субсидии закончатся, и всё постепенно придёт к обычному pay-as-you-go: сколько интеллекта использовал — столько и заплатил.
И использовать топовую модель для каждой мелочи будет просто странно. За те же деньги можно сделать в десять раз больше полезной работы на модели слабее, если она нормально справляется с задачей.
Поэтому важным навыком становится не умение пользоваться конкретным ChatGPT или Claude. Важнее выстроить работу с агентами так, чтобы провайдер интеллекта вообще не имел большого значения.
Сложные задачи отправлять самым умным моделям. Простые — дешёвым. А когда где-то появляются особенно выгодные лимиты, бесплатные токены или сильная открытая модель — просто подключать их к своей системе и использовать.
Сегодня одна компания субсидирует подписки. Завтра другая увеличивает лимиты, чтобы не проиграть гонку. Послезавтра выходит новая открытая модель, её разворачивают в той же Gonka — и мы получаем доступ к тому же интеллекту намного дешевле.
Я уверен, такие возможности будут постоянно появляться то тут, то там. Поэтому важно строить работу с агентами так, чтобы можно было быстро переключаться между моделями и использовать лучший доступный интеллект.
Потому что интеллекта много не бывает.
Если дать людям его в десять раз больше, они довольно быстро найдут, на что его потратить. Всегда есть новые идеи, исследования, улучшения и задачи, до которых раньше просто не доходили руки.
Ограничено не количество полезных задач.
Ограничено количество интеллекта, которое мы можем себе позволить.
✈️ Подписаться на канал | 106 |
| 9 | /goal | 114 |
| 10 | Сегодня выжимайте Codex на максимум 🤖
Тибо написал, что команда нашла несколько багов, из-за которых у части пользователей лимиты расходовались быстрее. Завтра выпустят исправления и полностью сбросят лимиты всем платным подпискам.
Поэтому сегодня самое время дать Codex большой проект, который вы давно хотели сделать:
Обсудите с ним задачу, дайте ссылку на Superpowers или попросите работать через субагентов, зафиксируйте результат через /goal — и идите заниматься своими делами.
Обычно я ставлю GPT-5.6 Sol оркестратором, а реализацию отдаю субагентам на GPT-5.6 Luna с reasoning Max, чтобы экономить лимиты.
Но сегодня можно не экономить: включайте Fast Mode и запускайте всё на GPT-5.6 Sol. Завтра всё равно обнулят)
✈️ Подписаться на канал | 119 |
| 11 | 🔧 Как реально что-то создавать с помощью AI-агентов
Этот пост для тех, кто уже попробовал работать с агентами — Claude Code, Codex, или любым другим — но сталкивался с такой ситуацией: говоришь агенту «напиши мне приложение» — он что-то делает, рапортует об успехе, а в итоге ничего толком не работает и половину приходится переделывать.
Проблема не в модели и не в агенте. Проблема в подходе.
Пайплайны убирают большинство этих проблем
Любая сложная задача — это цепочка шагов, а не один запрос. Например, AI-видео:
→ придумать идею → написать сценарий → сгенерировать изображения → оживить их → смонтировать
Или разработка продукта:
→ декомпозиция → планирование фаз → ревью плана → атомарные задачи → выполнение → проверка
Когда ты просишь агента «сделай всё сразу» — у него ограничено окно контекста, и когда нужно держать в голове слишком много, внимание рассеивается. Вот откуда половина проблем.
Когда даёшь ему пайплайн — он проходит каждую фазу отдельно. Сначала уточняет спецификацию, строит план, показывает его тебе. Потом разбивает на задачи и запускает субагентов — основной агент занимается только координацией, а субагенты с незасорённым контекстом работают узко над своей задачей.
Два инструмента, которые это реализуют
Superpowers и GSD.
Оба превращают агента в настоящий многофазный процесс разработки. Работа может занимать час, два, три и больше — но большая часть того, что ты описал, выходит готовой. Доработок в разы меньше.
Я использую GSD — просто потому что начал с него первым. Пробовал Superpowers — обе утилиты хорошо справляются со своей задачей. Superpowers работает не только с Claude Code, но и с Codex и другими агентами.
Чтобы выбрать — вот интерактивное сравнение:
→ GSD vs Superpowers
Попроси своего агента установить один из них и попробуй сделать через него реальный проект.
Также вышел GSD 2
Переработанная версия — работает не только с Claude Code, но и с другими моделями, более стабильная, надёжная и тратит меньше токенов. Я сам только начинаю тестировать. Чем отличается от первой версии — вот сравнение.
Пока рекомендую начать с одного из двух проверенных: GSD или Superpowers. Это реально меняет качество того, что выдаёт агент.
Но важный момент — пробуйте это только если вы уже хоть что-то делали с агентом. Если опыта ноль, сначала поработайте без утилит, просто чтобы понять, как это вообще работает. | 106 |
| 12 | Пост не потерял актуальности ⬇️
И он хорошо подходит, чтобы закрывать большие задачи — даже с укороченным контекстом, как у DeepSeek Flash из гонки.
GSD давно не пользуюсь, сейчас использую только Superpowers.
Всё просто: даёте агенту ссылку на репозиторий и просите сделать реализацию того, что нужно, через Superpowers. Дальше он сам разрулит.
✈️ Подписаться на канал | 91 |
| 13 | Gonka + DeepSeek Harness
Gonka немного ожила, поэтому выкладываю видео о том, как подключить DeepSeek V4 Flash через эту сеть и запустить его в DeepSeek Harness.
👉 Смотреть видео
API-ключ можно получить в моём мини-приложении Knyazev AI. Там же пополняется баланс: от $0.10 криптовалютой или от $1 через Telegram Stars.
Как установить
Понадобятся Git, Node.js 22.19+ или 24+ и pnpm 11.7.
Моя сборка с фиксом компактинга под контекст Gonka и плагином Knyazev AI:
git clone https://github.com/knyazev741/deepseek-harness.git
cd deepseek-harness
pnpm install
pnpm run build
pnpm dsh plugin --profile web add @knyazevai/dsh
pnpm dsh web
После запуска откройте http://127.0.0.1:3080 → Settings → Models → Knyazev AI и вставьте ключ.
Официальный DeepSeek Harness без моей сборки:
```
npx @deepseek-ai/dsh plugin --profile web add @knyazevai/dsh
npx @deepseek-ai/dsh webОфициальный репозиторий DeepSeek Harness.
```
Про доступность DeepSeek в Gonka
Мест под DeepSeek пока не очень много, поэтому временами можно получить ошибку 429 — особенно если после видео придёт много новых пользователей.
Но это решаемая проблема. Вычислительные мощности в сети есть, просто сейчас большая их часть выделена под другие модели. Нужно поменять стимулы так, чтобы хостам было выгоднее поднимать больше DeepSeek.
Сейчас разбираюсь, как это правильно оформить. План такой: сначала вынести proposal на обсуждение, собрать обратную связь, а затем перейти к ончейн-голосованию.
Возможно, хосты добавят мощности ещё раньше. В любом случае мест под DeepSeek станет больше — спрос уже есть, осталось правильно направить в него ресурсы сети.
✈️ Подписаться на канал | 105 |
| 14 | Gonka перегружена 🤖
У меня ещё со вчерашнего дня готово видео о том, как подключить себе агента на DeepSeek через Gonka. Я даже сделал свой прокси, чтобы можно было пополнять баланс — пополнение можно сделать на 10 центов.
Но видео пока не выкладываю. Gonka больше суток перегружена из-за огромного спроса на DeepSeek: почти все запросы падали с ошибкой. Вчера вечером DeepSeek еле-еле работал, сейчас начали работать несколько сессий.
Чтобы удовлетворить текущий спрос, мощностей в сети достаточно. Проблема в другом: эти мощности в основном стоят на MiniMax 2.7, а не на DeepSeek.
За MiniMax 2.7 участникам дают больше веса, поэтому они получают большую долю эмиссии. Из-за этого майнерам выгоднее запускать MiniMax, хотя самый большой спрос сейчас именно на DeepSeek.
Менять это нужно через голосование майнеров. Нужно изменить настройки сети так, чтобы больше участников запускали DeepSeek.
В чатах сейчас обсуждают, что цены на DeepSeek нужно поднимать. Но в сотню раз их не поднять. В Gonka нет кэша, а при работе с агентами основной расход — именно кэш. Поэтому по цене с учетом кеша у официального API Gonka выигрывает только в 5 раз: там всё считается как обычные input-токены.
Когда работа DeepSeek стабилизируется, выложу видео.
✈️ Подписаться на канал | 123 |
| 15 | DeepSeek Harness — великолепен 🤖
Ребята из DeepSeek сделали очень интересную вещь — DeepSeek Harness.
Это ровно про боль многих, включая меня. Подписки размазаны по вендорам: Claude — тут, Codex — где-то ещё. Модели разные, задачи разные, свои конкретные workflow — тоже. А связать всё это в одном месте раньше не получалось — собирался зоопарк из скриптов и костылей.
DeepSeek Harness это закрывает: подключаешь разные модели и подписки, собираешь свои workflow — всё в одном месте. А главное — это open source, то есть позволяет делать всё, что нужно. Не «ждём, пока вендор запилит фичу», а просто берёшь и делаешь.
Я уже вовсю его обкатываю — большие задачи гоняю прямо через DeepSeek V4 Flash, подключённого через сеть Gonka. А если задача слишком сложная — сначала план составляет большая модель (GLM 5.3, DeepSeek V4 Pro и т.д.), и уже потом по этому плану пишет Flash. Прекрасно работает.
Вот эти штуки, например, DeepSeek Flash через Gonka сделал сам, без всякого планировщика сверху:
— пометить сообщение непрочитанным
— скопировать ID сессии
— вкладки для background-агентов
Видео харнеса прикрепляю к посту — там всё это видно в работе.
Про background — отдельная магия для тех, кто держит агентов на кроне. Раньше фоновый агент работал в чёрном ящике: запустил — и молись. Теперь можно удобно зайти в его сессию и посмотреть, как он конкретно работал: что думал, что запускал, где ошибся.
Вчера на очень большой задаче вылез недостаток: компактинг в харнесе был рассчитан на контекст 1M, а у модели через Gonka окно 400K — и он отработал криво. Сделал фикс — патч, который нормально адаптирует компактинг под фактический размер контекстного окна.
И знаете, что я почувствовал, пока делал этот патч? Начало нулевых, когда мы качали патчи для игр и программ по локальной сети. Ощущение один в один: вот софт, и его можно пропатчить под себя — и он становится лучше.
Вся соль DeepSeek Harness в подходе «всё — плагин»: всё изменяемое, всё можно сделать как угодно — максимально универсальная штука. Уверен, люди начнут выпускать свои плагины и свои патчи, и каждый сможет собирать своего агента — и при этом ещё получать обновления, которые выходят от DeepSeek.
Цифры подтверждают интерес: у репозитория уже 153k звёзд и 15k форков. Количество звёзд растёт быстрее, чем у OpenClaw. И честно — считаю, что эта штука гораздо, гораздо полезнее OpenClaw.
Про DeepSeek Harness я ещё очень много буду писать. Планы такие:
— выкладывать свои плагины, патчи и наработки, которые я делаю последние полгода — с января, с момента, когда Claude Code попал мне в руки — и переносить всё это в DeepSeek Harness
— один из агентов сейчас занимается тем, чтобы подключить в харнес интерактивные сессии Claude Code и Codex — работать с ними по подписке, чтобы вся система была максимально универсальной
— параллельно отдельно занялся безопасностью кредов для всех агентов: токены и приватные данные агенты могут использовать в работе, но не могут их видеть — а значит, они не попадают в логи сессий и никуда никому не уходят
Это не инструмент на неделю. Это фундамент, на котором можно строить своего агента годами.
✈️ Подписаться на канал | 144 |
| 16 | Где я беру DeepSeek V4 Flash в 500 раз дешевле официального прайса 🤖
Исползую DeepSeek V4 Flash не через официальный API, а через децентрализованную сеть Gonka (токен $GNK). На днях там как раз развернули эту модель — помимо неё в сети уже работают Kimi K2.6 и Minimax M2.7. Единственное отличие по лимитам от официального API — контекст 400K токенов вместо 1M.
Математика простая: 1 млн токенов в этой сети стоит 0.01 $GNK. При цене $GNK в $0.1298 миллион исходящих токенов DeepSeek V4 Flash обходится в $0.001298 вместо $0.66 по официальному тарифу. Итого примерно в 508 раз дешевле.
Я пользуюсь сетью чуть больше месяца, но до недавнего времени использовал её только как backend, а не для агентов: модели, которые там были, не устраивали по качеству для агентов. Без минусов не обошлось — в некоторые дни сеть час-два отдаёт ошибки 429 и не работает. Но динамика заметная: стабильность растёт, и за последние сутки процент ошибок составил около 4%. За месяц я получил оттуда более 12 млрд токенов — это рабочая инфраструктура, а не игрушка.
Про доступ. Есть несколько брокеров, например gonka gate — там дают $10 баланса бесплатно, и потратить их непросто. Но у DeepSeek через этот брокер не заработал reasoning — модель не думает, а агент, который не думает, бесполезен. Поэтому я работаю через OpenBroker. Там оплата в $GNK, и потребуется немного возни: купить обёрнутый $GNK в Ethereum, перевести его по мосту и внести минимальное пополнение — 100 $GNK (порядка $13). На таких ценах этих $13 хватает надолго — примерно на 10 млрд токенов.
Почему так дёшево и кто за это платит. В итоге за дешёвый инференс по большей части платят держатели $GNK — это хорошо видно на графике: если год назад ты купил gonka на $1000, а сейчас твои токены стоят $100, разницу в $900 ты по факту отдал на то, чтобы другие могли пользоваться дешёвыми вычислениями. Думаю, текущая цена продержится минимум несколько месяцев, но когда-нибудь она пойдёт вверх: во-первых, если вырастет стоимость самого $GNK; во-вторых, в сети предусмотрен динамический прайсинг в зависимости от спроса — сейчас он просто отключён.
Про reasoning. Я тестировал и работаю с этой связкой на DeepSeek Harness (через Codex тоже работает). Чтобы reasoning корректно включился, нужно прописать в ~/.dsh/settings.yaml провайдера:
llm-ai:
providers:
openbroker:
apiKeyEnv: OPENBROKER_API_KEY
api: openai-completions
baseURL: https://api.openbroker.gonka.gg/v1
compat:
thinkingFormat: qwen
supportsReasoningEffort: false
reasoning: high
models:
- id: deepseek-ai/DeepSeek-V4-Flash-0731
name: DeepSeek-V4-Flash
contextWindow: 400000
maxTokens: 40000
reasoningEfforts:
off: null
minimal: minimal
low: low
medium: medium
high: high
xhigh: xhigh
Если не хочешь возиться с обёрнутым $GNK, мостами и газом — могу закинуть тебе на баланс 100 $GNK для активации API. Сделаю это не за $13, а за $20, чтобы возместить время на переписку, перевод через мост и расходы на газ в Ethereum. Если интересно, напиши в личку.
✈️ Подписаться на канал | 151 |
| 17 | DeepSeek выпустил свой харнес 🤖
Обещал в прошлом посте разобрать — вот он. Open source, пока developer preview: конфиги и API ещё будут меняться.
По роли это то же, что Claude Code и Codex: модель думает, а харнес даёт ей файлы, shell, sandbox, субагентов и планирование. Я уже писал, что харнес решает больше, чем кажется — одна и та же модель в разных средах работает по-разному.
У DeepSeek главное не это. Главное — everything is a plugin.
Модель, тулзы, sandbox, UI и сам agent loop можно заменить плагином. Хочешь свою логику вызова инструментов — ставишь плагин. Хочешь поменять, как агент думает и ходит по шагам — тоже. Ядро трогать не нужно.
Для своих агентов это как раз самое полезное. Sandbox, права, сессии — уже сделаны. Свою логику подключаешь сверху, а не пишешь обвязку с нуля.
Провайдеров можно накидать сколько угодно. Официальный API DeepSeek, локальная модель, OpenRouter — в одном интерфейсе. Один прогон на DeepSeek, второй на локалке, третий через OpenRouter.
Ставится так:
npx @deepseek-ai/dsh web
Тестирую в нем V4 Flash через неофициальный API — примерно в 500 раз дешевле.
20 🔥 — расскажу, где беру такую цену на Flash.
✈️ Подписаться на канал | 147 |
| 18 | DeepSeek против GPT-5.6 — новое видео 📹
Вышло видео, о котором я писал в прошлом посте: DeepSeek V4-Flash против GPT-5.6 Luna — один и тот же агентный тест в Claude Code и Codex.
👉 Смотреть видео
Монтировал я его очень долго — так долго, что за это время DeepSeek успел обновить цены на API и выпустить собственный харнес. Харнес протестирую, расскажу отдельным постом. Но само видео актуальности не потеряло.
Почему так долго? Потому что руками я не делал ничего. Вообще ничего — только запустил Adobe Premiere и включил MCP, чтобы агенты могли им управлять. Монтировать я сам не умею, а хотел получить результат лучше, чем умею.
Это не идеальный монтаж, и я это знаю. Но в этом и смысл: зайдите и посмотрите, что сейчас способны смонтировать агенты в руках человека, который без понятия, как делать такие эффекты.
Работали все подряд: Codex, Grok, Kimi, Qwen. И наблюдение вышло неожиданным:
— Grok 4.6 в Grok Build понравился больше всех — нужного эффекта добивался заметно меньшим числом итераций.
— Codex с GPT-5.6 Sol оказался самым тупым из всех, кого я пробовал на монтаже.
Про сам подход я уже писал отдельно: монтаж через агентов сегодня — это как программирование в 2023 году.
✈️ Подписаться на канал | 144 |
| 19 | DeepSeek в Codex 🤖
Продолжаю тему DeepSeek V4-Flash — модели, которая по API стоит копейки, а в агентной работе выходит дешевле подписок.
Недавно я давал скрипт для подключения DeepSeek к Claude Code. Теперь сделал то же самое для Codex — скрипт установки оставлю следующим сообщением.
А сегодня на YouTube выйдет видео, где я сравнил одну и ту же модель в двух харнесах: Codex против Claude Code. Одна DeepSeek V4-Flash, одни и те же задачи — но результат отличается. Харнес решает больше, чем кажется.
Если хотите попробовать — лучше не откладывать: DeepSeek уже объявила о повышении цен на API, и текущие тарифы могут скоро закончиться.
KEY="ВСТАВЬ КЛЮЧ СЮДА"
RC="$HOME/.zshrc"
[ -n "$BASH_VERSION" ] && RC="$HOME/.bashrc"
if ! command -v codex >/dev/null 2>&1; then
echo "Ошибка: сначала установи Codex"
elif [ -z "$KEY" ] || [[ "$KEY" == *"ВСТАВЬ"* ]]; then
echo "Ошибка: вставь свой DeepSeek API-ключ в строку KEY"
elif grep -q 'codex-dsk()' "$RC" 2>/dev/null; then
source "$RC"
echo "codex-dsk уже настроен — можно запускать: codex-dsk"
else
cat >> "$RC" <<EOF
# DeepSeek V4 Flash для Codex
export DPSK_KEY="$KEY"
codex-dsk() {
codex \
--model deepseek-v4-flash \
--config 'model_provider="deepseek"' \
--config 'model_providers.deepseek.name="DeepSeek"' \
--config 'model_providers.deepseek.base_url="https://api.deepseek.com/v1"' \
--config 'model_providers.deepseek.env_key="DPSK_KEY"' \
--config 'model_providers.deepseek.wire_api="responses"' \
--config 'model_providers.deepseek.stream_idle_timeout_ms=600000' \
--config 'model_context_window=1048576' \
--config 'model_auto_compact_token_limit=900000' \
--config 'model_reasoning_effort="xhigh"' \
--config 'model_supports_reasoning_summaries=false' \
"\$@"
}
EOF
source "$RC"
echo "Готово! Запускай DeepSeek внутри Codex: codex-dsk"
fi
✈️ Подписаться на канал | 150 |
| 20 | Монтаж через агентов — это программирование в 2023 году 🎬
Последние четыре дня я завис в монтаже следующего видео для YouTube. Причём делаю его исключительно через AI-агентов.
Честно: сейчас это работает, но медленно. Я трачу много токенов, постоянно что-то переделываю, а агент регулярно ошибается или понимает задачу не так.
Если человек хорошо умеет монтировать в Premiere Pro или DaVinci Resolve, сегодня ему нет смысла переходить на такой способ. Руками он сделает быстрее и, скорее всего, лучше.
Но для меня выбор выглядит иначе: либо управлять агентами, либо самому изучать монтаж, искать уроки под конкретную программу, разбираться в эффектах и вручную расставлять кейфреймы.
И я уже видел ровно такую же картину.
В 2023 году я начал писать код с помощью ИИ, хотя не знал языков программирования. Тогда AI-кодинг тоже был медленным, дорогим и требовал бесконечных исправлений. Профессиональный разработчик почти всегда написал бы быстрее руками.
Но для меня это всё равно было быстрее, чем сначала несколько лет учиться программировать. И, как показало время, ставка оказалась правильной: сегодня моя работа с кодом почти полностью сводится к постановке задач агентам и проверке результата.
Проверять, безусловно, нужно. Но объёмы кода уже такие, что читать вручную каждую сгенерированную строчку практически нереально. Поэтому задача постепенно меняется: нужно не самому проверять всё построчно, а выстроить систему из тестов и агентов-проверяющих, которая умеет находить ошибки.
Я уже называл это временем непрофессионалов: человек без узкого технического навыка получает результат, который раньше был для него недоступен.
На прикреплённом видео — простой анимированный счётчик. Не шедевр монтажа. Но раньше, чтобы сделать даже его, мне пришлось бы найти нужный туториал, разобраться в конкретном приложении, подобрать эффект и расставить кейфреймы. Сейчас я просто надиктовал агенту задачу голосом.
Думаю, уже к январю 2027 года таких задач станет гораздо больше. Монтаж через агентов станет быстрее и дешевле — примерно так же, как написание кода сегодня.
А дальше этот принцип выйдет в физический мир.
Сейчас владельцы 3D-принтеров часто скачивают готовые STL- или 3MF-модели с Thingiverse, Printables и других библиотек. Но скоро можно будет просто описать нужную бутылку, крепление или деталь, посмотреть на сгенерированную модель, голосом попросить внести изменения и сразу отправить её на печать.
Расстояние от мысли до физического предмета станет намного короче, а необходимых навыков — намного меньше.
В конечном итоге то же самое произойдёт и с более сложными задачами: построить дом, выкопать бассейн, произвести нужную вещь. Человек будет управлять агентами, а агенты — роботами.
Главным навыком станет не умение нажимать кнопки в конкретной программе, а способность чётко описать результат, разбить путь к нему на задачи и правильно проверить исполнение.
✈️ Подписаться на канал | 139 |
