AI for Devs
По сотрудничеству пишите в личные сообщения канала. Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе. Технологический партнер: veai.ru
نمایش بیشتر📈 تحلیل کانال تلگرام AI for Devs
کانال AI for Devs (@ai_for_devs) در بخش زبانی روسی بازیگری فعال است. در حال حاضر جامعه شامل 16 581 مشترک است و جایگاه 7 629 را در دسته فناوری و برنامهها و رتبه 39 627 را در منطقه روسيا دارد.
📊 شاخصهای مخاطب و پویایی
از زمان ایجاد در невідомо، پروژه رشد سریعی داشته و 16 581 مشترک جذب کرده است.
بر اساس آخرین دادهها در تاریخ 31 اوت, 2026، کانال فعالیت پایداری دارد. در ۳۰ روز گذشته تغییر اعضا برابر 1 186 و در ۲۴ ساعت گذشته برابر 19 بوده و همچنان دسترسی گستردهای حفظ شده است.
- وضعیت تأیید: تأیید نشده
- نرخ تعامل (ER): میانگین تعامل مخاطب 59.27% است و در ۲۴ ساعت نخست پس از انتشار، محتوا معمولاً 36.84% واکنش نسبت به کل مشترکان کسب میکند.
- دسترسی پستها: هر پست به طور میانگین 9 810 بازدید دریافت میکند. در اولین روز معمولاً 6 097 بازدید جمعآوری میشود.
- واکنشها و تعامل: مخاطبان بهطور فعال حمایت میکنند؛ میانگین واکنش به هر پست 95 است.
- علایق موضوعی: محتوا بر موضوعات کلیدی مانند claude, gemini, токенов, контекст, openai تمرکز دارد.
📝 توضیح و سیاست محتوایی
نویسنده این فضا را محل بیان دیدگاههای شخصی توصیف میکند:
“По сотрудничеству пишите в личные сообщения канала.
Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.
Технологический партнер: veai.ru”
به لطف بهروزرسانیهای پرتکرار (آخرین داده در تاریخ 01 سپتامبر, 2026)، کانال همواره بهروز و دارای دسترسی بالاست. تحلیلها نشان میدهد مخاطبان بهطور فعال با محتوا تعامل دارند و آن را به نقطه اثرگذاری مهم در دسته فناوری و برنامهها تبدیل کردهاند.
در حال بارگیری داده...
| تاریخ | رشد مشترکین | اشارات | کانالها | |
| 01 سپتامبر | +32 |
Базовая цена осталась $10/$50 за миллион токенов, зато чтение кэша подешевело на 75%.Fable 5.1 уже доступна на всех платформах и в API. Mythos 5.1 (та же модель с менее строгими фильтрами) только для проверенных организаций. Также в честь релиза всем пользователям сбросили недельные и часовые лимиты. @ai_for_devs
| 2 | ⚡️ Вышла версия GLM-5.3 Flash без цензуры
На Hugging Face появилась GLM-5.3 Flash Uncensored. Это версия свежей модели Z.ai, в весах которой ослабили выученное поведение отказа: она реже отвечает «извините, я не могу вам с этим помочь».
Судя по тестам, снятие ограничений почти не задело обычные способности модели. Зато отказов ожидаемо стало меньше.
На вредоносных запросах из JailbreakBench базовая GLM отказалась отвечать в 93% случаев, uncensored-версия — в 12%.
Такие модели вообще не редкость. У OrcaRouter уже есть целая коллекция: Qwen3.8-27B Uncensored, Qwen3.8 Flash Next Uncensored, которые можно легко запустить локально. А через API также доступна Gemma4 26B A4B Uncensored.
Если будете использовать, то главное помнить: «С большой силой приходит большая ответственность»!
@ai_for_devs | 6 587 |
| 3 | ⚡️ Модели OpenAI исчезнут из Cursor из-за сделки со SpaceX
После покупки Cursor компанией SpaceX OpenAI решила прекратить прямой доступ к GPT-моделям с 12 ноября.
Причина максимально личная: компания не доверяет бизнесам Илона Маска и опасается нарушения своих правил.
В Cursor ответили, что на модели OpenAI приходится лишь 5% трафика. Свой API-ключ при этом продолжит работать.
@ai_for_devs | 8 465 |
| 4 | ⚡️ Туда, сюда, обратно, тебе и мне приятно — миграция настроек
За последний год в AI-инструментах всё невероятно поменялось: новые агенты появляются чуть ли не каждый месяц, и иногда переход с одного на другой не только оправдан, но и необходим.
Но начинать всё с нуля совсем не хочется: вместе с собой надо забрать правила проекта, инструкции, скиллы, настройки MCP и память агента.
Уже через 1 час, в 17:00 (МСК) Михаил Костицын из Veai покажет, где хранятся настройки Claude Code, Codex, Cursor, OpenCode и Veai, как легко перенести их и проверить на реальной задаче.
Вебинар бесплатный, главное зарегистрироваться: https://veai.ru/events/ai-agent-mcp/join | 8 649 |
| 5 | ⚡️ Anthropic сделали «MCP для железа»
Model Hardware Standard (MHS) — общий интерфейс, через который AI-агенты могут находить и безопасно управлять микроскопами, роботами и другим лабораторным оборудованием.
Для каждого устройства создаётся MHS-драйвер с простыми командами вроде read и write, описанием возможностей и ограничений безопасности. Агент читает эту инструкцию и управляет сразу несколькими устройствами.
В первых тестах AI-агент сам подбирал параметры лабораторного робота и справлялся с частью ошибок по ходу эксперимента. Подготовка сложного эксперимента с микроскопом сократилась с нескольких недель до одного дня.
Пока это закрытый research preview. После тестов MHS обещают сделать open source.
@ai_for_devs | 9 884 |
| 6 | В дополнение к релизу Z.ai на две недели снизили цены GLM-5.3-Flash вдвое: $0,075/$0,25 за миллион входных/выходных токенов.
У обновлённого DeepSeek V4 Flash после подорожания даже off-peak стоимость почти в 3 раза дороже.
На Router AI модель уже доступна без VPN и иностранной карты:
– 9 ₽/1М input, 30 ₽/1M output
– Кэш 1,81 ₽ / 1M токенов
Настройка для Claude Code, OpenCode, Cursor, JetBrains, Cline, и т.д.
@ai_for_devs | 7 508 |
| 7 | ⚡️ NVIDIA согласилась купить Hugging Face за $12,9 млрд
Если сделка состоится, она станет крупнейшей покупкой в истории NVIDIA. Предыдущий рекорд — Mellanox за $7 млрд.
Годовой темп выручки Hugging Face оценивают всего в $150 млн, поэтому цена равна примерно 86 годовым выручкам. NVIDIA платит не за текущий бизнес, а за доступ к миллионам разработчиков.
Забавно, но ещё пол года назад стало известно, что Hugging Face отказала NVIDIA в инвестиции $500 млн при оценке $7 млрд: компания не хотела одного доминирующего инвестора, способного влиять на решения 🧠
@ai_for_devs | 7 971 |
| 8 | ⚡️ Qwen4: Alibaba выпустили первую модель на новой архитектуре
Состоялся релиз Qwen3.8-Flash-Next на 125 млрд параметров. Alibaba переработали механизм работы с длинным контекстом и добавили отдельную память на 51 млрд параметров для частых сочетаний текста и кода.
Это пока не полноценная Qwen4: модель выпустили, чтобы сообщество научилось работать с новой архитектурой до появления всего семейства.
На DeepSWE новинка набрала 58,7% против 42,2% у Qwen3.8-27B и 54,4% у DeepSeek V4 Flash. Но до Kimi K3 с открытыми весами не дотянула, у последней 67,5%.
Веса уже доступны бесплатно, но для локального запуска потребуется больше 80 ГБ памяти.
API-версия скоро появится в QwenCloud по цене $0,16/$0,47 за миллион токенов.
@ai_for_devs | 7 464 |
| 9 | ⚡️ Z.ai выпустили GLM-5.3-Flash — ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter
Стелс-превью закончилось: за шесть дней пользователи OpenCode прогнали через модель 42 трлн токенов, а на OpenRouter она обошла ближайший DeepSeek по использованию больше чем в два раза!
GLM-5.3-Flash — первая нативно мультимодальная модель семейства GLM-5: контекст на 1 млн токенов, 320 млрд параметров и 18 млрд активных.
Веса уже открыли под MIT. Причём весь трафик Ox Alpha Z.ai обслуживали исключительно на китайских AI-чипах!
В официальном прогоне DeepSWE v1.1 модель набрала 63,4% против 46,2% у GLM-5.2. На собственном Code Bench от Z.ai она почти сравнялась с Opus 4.8: 29 против 29,5 на максимальном effort.
API стоит $0,15 за миллион входных токенов, $0,50 за выходные и $0,03 за закэшированный ввод.
Модель уже доступна в API, ZCode, Chat и AutoClaw.
@ai_for_devs | 8 446 |
| 10 | ⚡️ Новый чип OpenAI разогнал Kimi K2.5 почти до 700 ток/с
В июне мы уже рассказывали про Jalapeño, собственный чип OpenAI для инференса. Тогда готовых бенчмарков ещё не было, теперь компания опубликовала первые результаты.
На GPT-OSS, DeepSeek R1 и Kimi K2.5 чип выдаёт в 2,7–4,1 раза больше токенов в секунду на пользователя, чем NVIDIA GB200 и GB300 (самые мощные решения NVIDIA для запуска AI-моделей).
Если зафиксировать максимальную скорость NVIDIA для одного пользователя, разрыв по общей пропускной способности получается вообще аномальным: Jalapeño обрабатывает до 100 раз больше токенов на киловатт.
В абсолютной скорости генерации Cerebras пока впереди: Kimi K2.6 на их гигантском чипе выдаёт около 1000 ток/с, хотя напрямую сравнивать результаты нельзя из-за разных версий модели и методик тестирования.
@ai_for_devs | 7 975 |
| 11 | ⚡️ Сегодня ночью в Codex вернут 5-часовой лимит для $20 подписок
Пользователи Plus вернутся к старой схеме: 5-часовой лимит поверх недельного в ChatGPT Work и Codex.
Инженеры OpenAI заявляют 2 причины:
1. 5-часовое окно помогает сглаживать нагрузку на дата-центры и сохранять щедрый недельный лимит
2. Новые юзеры часто случайно сжигали весь недельный лимит за несколько часов и потом не понимали, почему остались без Codex
Для пользователей на тарифах за $100 и $200 пока ничего не меняется: в ближайшие несколько месяцев 5-часовое ограничение включать не будут.
@ai_for_devs | 9 580 |
| 12 | ⚡️ Orca ADE преодолела отметку в 50 тысяч звёзд на GitHub
Orca – это новая ADE (Agent Development Environment), среда для параллельной работы с AI-агентами. Меньше чем за полгода репозиторий отметили 50 тысяч разработчиков.
Десктопная версия ADE построена на базе Electron.
Продукт разрабатывает команда выходцев из Y Combinator. Orca бесплатна, исходный код открыт под лицензией MIT. Отдельная подписка на ADE не нужна.
Основные возможности:
• Переключиться между агентами можно в рамках одной задачи
• Прикольно, что прямо в ADE видны лимиты всех агентов: Claude Code, Codex, Gemini, OpenCode, Kimi Code и MiniMax
• Есть Workspace Board, на котором видны запущенные задачи, а карточки можно перетаскивать между статусами
• Изменения можно проверить во встроенном редакторе и Git-диффе, а комментарии передать агенту
• Здорово, что есть Design Mode: можно откомментить элемент страницы, а не делать несколько скриншотов
• Есть управление с телефона
• Задачи можно запустить параллельно в отдельных git worktree, локально или через SSH
Orca поддерживает 35 агентов, включая самые популярные: Claude Code, Codex, OpenCode и т.д. Также можно запустить любой CLI-агент, который работает в терминале.
@ai_for_devs | 10 440 |
| 13 | ⚡️ Новая stealth-модель обгоняет Fable 5 и GPT-5.6 Sol на DeepSWE
У неизвестной мультимодальной модели контекст на 1 млн токенов. OpenCode обещают почти безлимитное бесплатное использование до 27 августа.
Бесплатно Ox Alpha доступна и через OpenRouter. Правда, там провайдер сохраняет запросы и ответы, но обещает не использовать их для обучения.
Модель прогнали на 10 задачах DeepSWE: Ox Alpha набрала 80%, Fable 5 — 65%, GLM-5.3 и Grok 4.6 — по 62%, GPT-5.6 Sol — 52%.
Выборка маленькая, поэтому до полноценного бенчмарка далеко, но результат внушительный.
Кто сделал модель, неизвестно. Вероятнее всего это новая GLM-5.x: совпадают токенизатор, видеоэнкодер, стиль ответов и реакция на аудио.
@ai_for_devs | 13 488 |
| 14 | ⚡️ Claude Code получил нативный аналог Caveman
Anthropic добавили встроенный стиль Concise. Claude начинает с результата, пропускает предисловия и не расписывает детали, пока его об этом не попросят.
По сути, это нативный аналог Caveman: скилла, который заставляет агента говорить как пещерный человек и экономить output-токены. Только теперь ничего устанавливать не нужно.
Включается через /config → Output style → Concise или строчкой "outputStyle": "Concise" в settings.json.
@ai_for_devs | 13 903 |
| 15 | ⚡️ Cursor запустил Origin: собственный хостинг кода для AI-агентов
Мы уже писали о его анонсе, а теперь сервис начал публичное развёртывание в ранней бете.
Доступ получают пользователи всех платных тарифов. На старте доступны репозитории, пул-реквесты, просмотр и поиск кода, а также синхронизация с GitHub.
Создать репозиторий можно во вкладке Codebase, после чего Cursor покажет CLI-команды для клонирования или загрузки локального проекта.
Репозитории из GitHub можно подключать выборочно и отключать в любой момент.
@ai_for_devs | 13 814 |
| 16 | ⚡️ GPT-5.6 Sol разогнали до 750 токенов в секунду
OpenAI и Cerebras запустили ограниченное превью Ultrafast, нового режима GPT-5.6 Sol в API. Полная модель генерирует до 750 выходных токенов в секунду. Это до 14 раз быстрее Standard без перехода на уменьшённую модель.
На всех 2500 вопросах Humanity's Last Exam Sol закончила работу за 11 часов 11 минут. Claude Fable 5 понадобилось 78 часов 27 минут при сопоставимой точности.
Для сравнения, нынешний Fast mode ускоряет Sol только до 2,5 раза и стоит вдвое дороже Standard. Цену Ultrafast пока не раскрыли, а доступ дали лишь нескольким клиентам.
Можно попробовать оставить заявку на ранний доступ.
@ai_for_devs | 13 950 |
| 17 | ⚡️ Qwen3.8-27B запускается локально и местами обходит Opus 4.6
Alibaba открыли веса Qwen3.8-27B. В одном из тестов на агентное программирование результат вырос более чем втрое по сравнению с Qwen3.6-27B.
По совокупности тестов новинка оказалась сильнее даже предыдущей облачной Qwen3.7-Plus.
В отдельных задачах по программированию она показывает результаты выше Opus 4.6, хотя всё ещё уступает некогда флагману в сложных рассуждениях и работе с терминалом.
Облегчённая версия от Unsloth занимает около 17 ГБ: её можно запустить на Mac с Apple Silicon или видеокарте с 24 ГБ памяти.
@ai_for_devs | 10 063 |
| 18 | ⚡️ Google выпустили Gemini 3.7 Flash
Последнюю Pro-модель Google выпустили ещё 19 февраля. Зато с тех пор успели зарелизить уже три Flash подряд: 3.5, 3.6 и 3.7.
По coding-бенчмаркам 3.7 Flash примерно на уровне GPT-5.6 Terra и в среднем немного лучше Sonnet 5. На DeepSWE — 65.3% против 69.6% у Terra и 53.8% у Sonnet, на FrontierCode уже обходит обе: 43.6% против 41.3% и 42.7%.
До конца года стоимость $0.75/$3.75 за миллион токенов (input/output). Это в 2.7 раза дешевле Sonnet 5 по output и больше чем в 3 раза дешевле Terra.
Контекст 1M, модель уже доступна через API, в AI Studio и Antigravity.
@ai_for_devs | 11 299 |
| 19 | ⚡️ DeepSeek поднимают цены на API до 12 раз
С 16 августа DeepSeek вводят часы пик. В это время API будет стоить вдвое дороже, чем в остальные часы. Сами базовые цены тоже выросли.
Генерация V4 Flash подорожает с $0,28 до $0,66–1,32 за миллион токенов, V4 Pro — с $0,87 до $1,98–3,96.
Сильнее всего досталось кэшированному входу V4 Pro: вместо $0,003625 придётся платить $0,022 вне часов пик и $0,044 в часы пик. Это в 6–12 раз дороже.
Эпоха почти бесплатного DeepSeek подошла к концу.
@ai_for_devs | 10 553 |
| 20 | ⚡️ Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol
Технически внутри та же GLM-5.2: без нового претрейна и архитектуры, просто ещё месяц RL на длинных инженерных задачах DeepSWE вырос с 46,2% до 66,9%, Terminal-Bench 3.0 с 4,6% до 28,3%.
На Terminal-Bench 3.0 новинка обошла Kimi K3 и Opus 4.8, но не дотянула до Fable 5 и GPT-5.6 Sol.
Начиная с GLM-5.2 команда проверяла реальные кодовые базы несколькими своими моделями и нашла 2436 уязвимостей в 269 проектах; какие именно версии участвовали, Z.ai не уточняет.
GLM-5.3 уже раскатили в Coding Plan от $18/мес, а веса обещают через две недели; цены API за токены пока нет.
@ai_for_devs | 12 496 |
