AI for Devs
По сотрудничеству пишите в личные сообщения канала. Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе. Технологический партнер: veai.ru
Ko'proq ko'rsatish📈 Telegram kanali AI for Devs analitikasi
AI for Devs (@ai_for_devs) Rus til segmentidagi kanali faol ishtirokchi. Hozirda hamjamiyat 16 581 obunachidan iborat bo'lib, Texnologiyalar & Aralashmalar toifasida 7 629-o'rinni va Rossiya mintaqasida 39 627-o'rinni egallagan.
📊 Auditoriya ko‘rsatkichlari va dinamika
невідомо sanasidan buyon loyiha tez o‘sib, 16 581 obunachiga ega bo‘ldi.
31 Avgust, 2026 dagi oxirgi ma’lumotlarga ko‘ra kanal barqaror faollikka ega. Oxirgi 30 kunda obunachilar soni 1 186 ga, so‘nggi 24 soatda esa 19 ga o‘zgardi va umumiy qamrov yuqori darajada qolmoqda.
- Tasdiqlash holati: Tasdiqlanmagan
- Jalb etish (ER): Auditoriya o‘rtacha 59.27% darajada jalb etiladi. Nashrdan keyingi dastlabki 24 soatda kontent odatda umumiy obunachilar sonining 36.84% ini tashkil etuvchi reaksiyalarni to‘playdi.
- Post qamrovi: Har bir post o‘rtacha 9 810 marta ko‘riladi; birinchi sutkada odatda 6 097 ta ko‘rish yig‘iladi.
- Reaksiyalar va o‘zaro ta’sir: Auditoriya faol: har bir postga o‘rtacha 95 ta reaksiya keladi.
- Tematik yo‘nalishlar: Kontent claude, gemini, токенов, контекст, openai kabi asosiy mavzularga jamlangan.
📝 Tavsif va kontent siyosati
Muallif resursni shaxsiy fikrni ifoda etish maydoni sifatida ta’riflaydi:
“По сотрудничеству пишите в личные сообщения канала.
Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.
Технологический партнер: veai.ru”
Yuqori yangilanish chastotasi (oxirgi ma’lumot 01 Sentabr, 2026 da olingan) sababli kanal doimo dolzarb va katta qamrovli bo‘lib qoladi. Analitika auditoriya kontent bilan faol hamkorlik qilishini, uni Texnologiyalar & Aralashmalar toifasidagi muhim ta’sir nuqtasiga aylantirishini ko‘rsatadi.
Ma'lumot yuklanmoqda...
| Sana | Obunachilarni jalb qilish | Esdaliklar | Kanallar | |
| 01 Sentabr | +32 |
Базовая цена осталась $10/$50 за миллион токенов, зато чтение кэша подешевело на 75%.Fable 5.1 уже доступна на всех платформах и в API. Mythos 5.1 (та же модель с менее строгими фильтрами) только для проверенных организаций. Также в честь релиза всем пользователям сбросили недельные и часовые лимиты. @ai_for_devs
| 2 | ⚡️ Вышла версия GLM-5.3 Flash без цензуры
На Hugging Face появилась GLM-5.3 Flash Uncensored. Это версия свежей модели Z.ai, в весах которой ослабили выученное поведение отказа: она реже отвечает «извините, я не могу вам с этим помочь».
Судя по тестам, снятие ограничений почти не задело обычные способности модели. Зато отказов ожидаемо стало меньше.
На вредоносных запросах из JailbreakBench базовая GLM отказалась отвечать в 93% случаев, uncensored-версия — в 12%.
Такие модели вообще не редкость. У OrcaRouter уже есть целая коллекция: Qwen3.8-27B Uncensored, Qwen3.8 Flash Next Uncensored, которые можно легко запустить локально. А через API также доступна Gemma4 26B A4B Uncensored.
Если будете использовать, то главное помнить: «С большой силой приходит большая ответственность»!
@ai_for_devs | 6 587 |
| 3 | ⚡️ Модели OpenAI исчезнут из Cursor из-за сделки со SpaceX
После покупки Cursor компанией SpaceX OpenAI решила прекратить прямой доступ к GPT-моделям с 12 ноября.
Причина максимально личная: компания не доверяет бизнесам Илона Маска и опасается нарушения своих правил.
В Cursor ответили, что на модели OpenAI приходится лишь 5% трафика. Свой API-ключ при этом продолжит работать.
@ai_for_devs | 8 465 |
| 4 | ⚡️ Туда, сюда, обратно, тебе и мне приятно — миграция настроек
За последний год в AI-инструментах всё невероятно поменялось: новые агенты появляются чуть ли не каждый месяц, и иногда переход с одного на другой не только оправдан, но и необходим.
Но начинать всё с нуля совсем не хочется: вместе с собой надо забрать правила проекта, инструкции, скиллы, настройки MCP и память агента.
Уже через 1 час, в 17:00 (МСК) Михаил Костицын из Veai покажет, где хранятся настройки Claude Code, Codex, Cursor, OpenCode и Veai, как легко перенести их и проверить на реальной задаче.
Вебинар бесплатный, главное зарегистрироваться: https://veai.ru/events/ai-agent-mcp/join | 8 649 |
| 5 | ⚡️ Anthropic сделали «MCP для железа»
Model Hardware Standard (MHS) — общий интерфейс, через который AI-агенты могут находить и безопасно управлять микроскопами, роботами и другим лабораторным оборудованием.
Для каждого устройства создаётся MHS-драйвер с простыми командами вроде read и write, описанием возможностей и ограничений безопасности. Агент читает эту инструкцию и управляет сразу несколькими устройствами.
В первых тестах AI-агент сам подбирал параметры лабораторного робота и справлялся с частью ошибок по ходу эксперимента. Подготовка сложного эксперимента с микроскопом сократилась с нескольких недель до одного дня.
Пока это закрытый research preview. После тестов MHS обещают сделать open source.
@ai_for_devs | 9 884 |
| 6 | В дополнение к релизу Z.ai на две недели снизили цены GLM-5.3-Flash вдвое: $0,075/$0,25 за миллион входных/выходных токенов.
У обновлённого DeepSeek V4 Flash после подорожания даже off-peak стоимость почти в 3 раза дороже.
На Router AI модель уже доступна без VPN и иностранной карты:
– 9 ₽/1М input, 30 ₽/1M output
– Кэш 1,81 ₽ / 1M токенов
Настройка для Claude Code, OpenCode, Cursor, JetBrains, Cline, и т.д.
@ai_for_devs | 7 508 |
| 7 | ⚡️ NVIDIA согласилась купить Hugging Face за $12,9 млрд
Если сделка состоится, она станет крупнейшей покупкой в истории NVIDIA. Предыдущий рекорд — Mellanox за $7 млрд.
Годовой темп выручки Hugging Face оценивают всего в $150 млн, поэтому цена равна примерно 86 годовым выручкам. NVIDIA платит не за текущий бизнес, а за доступ к миллионам разработчиков.
Забавно, но ещё пол года назад стало известно, что Hugging Face отказала NVIDIA в инвестиции $500 млн при оценке $7 млрд: компания не хотела одного доминирующего инвестора, способного влиять на решения 🧠
@ai_for_devs | 7 971 |
| 8 | ⚡️ Qwen4: Alibaba выпустили первую модель на новой архитектуре
Состоялся релиз Qwen3.8-Flash-Next на 125 млрд параметров. Alibaba переработали механизм работы с длинным контекстом и добавили отдельную память на 51 млрд параметров для частых сочетаний текста и кода.
Это пока не полноценная Qwen4: модель выпустили, чтобы сообщество научилось работать с новой архитектурой до появления всего семейства.
На DeepSWE новинка набрала 58,7% против 42,2% у Qwen3.8-27B и 54,4% у DeepSeek V4 Flash. Но до Kimi K3 с открытыми весами не дотянула, у последней 67,5%.
Веса уже доступны бесплатно, но для локального запуска потребуется больше 80 ГБ памяти.
API-версия скоро появится в QwenCloud по цене $0,16/$0,47 за миллион токенов.
@ai_for_devs | 7 464 |
| 9 | ⚡️ Z.ai выпустили GLM-5.3-Flash — ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter
Стелс-превью закончилось: за шесть дней пользователи OpenCode прогнали через модель 42 трлн токенов, а на OpenRouter она обошла ближайший DeepSeek по использованию больше чем в два раза!
GLM-5.3-Flash — первая нативно мультимодальная модель семейства GLM-5: контекст на 1 млн токенов, 320 млрд параметров и 18 млрд активных.
Веса уже открыли под MIT. Причём весь трафик Ox Alpha Z.ai обслуживали исключительно на китайских AI-чипах!
В официальном прогоне DeepSWE v1.1 модель набрала 63,4% против 46,2% у GLM-5.2. На собственном Code Bench от Z.ai она почти сравнялась с Opus 4.8: 29 против 29,5 на максимальном effort.
API стоит $0,15 за миллион входных токенов, $0,50 за выходные и $0,03 за закэшированный ввод.
Модель уже доступна в API, ZCode, Chat и AutoClaw.
@ai_for_devs | 8 446 |
| 10 | ⚡️ Новый чип OpenAI разогнал Kimi K2.5 почти до 700 ток/с
В июне мы уже рассказывали про Jalapeño, собственный чип OpenAI для инференса. Тогда готовых бенчмарков ещё не было, теперь компания опубликовала первые результаты.
На GPT-OSS, DeepSeek R1 и Kimi K2.5 чип выдаёт в 2,7–4,1 раза больше токенов в секунду на пользователя, чем NVIDIA GB200 и GB300 (самые мощные решения NVIDIA для запуска AI-моделей).
Если зафиксировать максимальную скорость NVIDIA для одного пользователя, разрыв по общей пропускной способности получается вообще аномальным: Jalapeño обрабатывает до 100 раз больше токенов на киловатт.
В абсолютной скорости генерации Cerebras пока впереди: Kimi K2.6 на их гигантском чипе выдаёт около 1000 ток/с, хотя напрямую сравнивать результаты нельзя из-за разных версий модели и методик тестирования.
@ai_for_devs | 7 975 |
| 11 | ⚡️ Сегодня ночью в Codex вернут 5-часовой лимит для $20 подписок
Пользователи Plus вернутся к старой схеме: 5-часовой лимит поверх недельного в ChatGPT Work и Codex.
Инженеры OpenAI заявляют 2 причины:
1. 5-часовое окно помогает сглаживать нагрузку на дата-центры и сохранять щедрый недельный лимит
2. Новые юзеры часто случайно сжигали весь недельный лимит за несколько часов и потом не понимали, почему остались без Codex
Для пользователей на тарифах за $100 и $200 пока ничего не меняется: в ближайшие несколько месяцев 5-часовое ограничение включать не будут.
@ai_for_devs | 9 580 |
| 12 | ⚡️ Orca ADE преодолела отметку в 50 тысяч звёзд на GitHub
Orca – это новая ADE (Agent Development Environment), среда для параллельной работы с AI-агентами. Меньше чем за полгода репозиторий отметили 50 тысяч разработчиков.
Десктопная версия ADE построена на базе Electron.
Продукт разрабатывает команда выходцев из Y Combinator. Orca бесплатна, исходный код открыт под лицензией MIT. Отдельная подписка на ADE не нужна.
Основные возможности:
• Переключиться между агентами можно в рамках одной задачи
• Прикольно, что прямо в ADE видны лимиты всех агентов: Claude Code, Codex, Gemini, OpenCode, Kimi Code и MiniMax
• Есть Workspace Board, на котором видны запущенные задачи, а карточки можно перетаскивать между статусами
• Изменения можно проверить во встроенном редакторе и Git-диффе, а комментарии передать агенту
• Здорово, что есть Design Mode: можно откомментить элемент страницы, а не делать несколько скриншотов
• Есть управление с телефона
• Задачи можно запустить параллельно в отдельных git worktree, локально или через SSH
Orca поддерживает 35 агентов, включая самые популярные: Claude Code, Codex, OpenCode и т.д. Также можно запустить любой CLI-агент, который работает в терминале.
@ai_for_devs | 10 440 |
| 13 | ⚡️ Новая stealth-модель обгоняет Fable 5 и GPT-5.6 Sol на DeepSWE
У неизвестной мультимодальной модели контекст на 1 млн токенов. OpenCode обещают почти безлимитное бесплатное использование до 27 августа.
Бесплатно Ox Alpha доступна и через OpenRouter. Правда, там провайдер сохраняет запросы и ответы, но обещает не использовать их для обучения.
Модель прогнали на 10 задачах DeepSWE: Ox Alpha набрала 80%, Fable 5 — 65%, GLM-5.3 и Grok 4.6 — по 62%, GPT-5.6 Sol — 52%.
Выборка маленькая, поэтому до полноценного бенчмарка далеко, но результат внушительный.
Кто сделал модель, неизвестно. Вероятнее всего это новая GLM-5.x: совпадают токенизатор, видеоэнкодер, стиль ответов и реакция на аудио.
@ai_for_devs | 13 488 |
| 14 | ⚡️ Claude Code получил нативный аналог Caveman
Anthropic добавили встроенный стиль Concise. Claude начинает с результата, пропускает предисловия и не расписывает детали, пока его об этом не попросят.
По сути, это нативный аналог Caveman: скилла, который заставляет агента говорить как пещерный человек и экономить output-токены. Только теперь ничего устанавливать не нужно.
Включается через /config → Output style → Concise или строчкой "outputStyle": "Concise" в settings.json.
@ai_for_devs | 13 903 |
| 15 | ⚡️ Cursor запустил Origin: собственный хостинг кода для AI-агентов
Мы уже писали о его анонсе, а теперь сервис начал публичное развёртывание в ранней бете.
Доступ получают пользователи всех платных тарифов. На старте доступны репозитории, пул-реквесты, просмотр и поиск кода, а также синхронизация с GitHub.
Создать репозиторий можно во вкладке Codebase, после чего Cursor покажет CLI-команды для клонирования или загрузки локального проекта.
Репозитории из GitHub можно подключать выборочно и отключать в любой момент.
@ai_for_devs | 13 814 |
| 16 | ⚡️ GPT-5.6 Sol разогнали до 750 токенов в секунду
OpenAI и Cerebras запустили ограниченное превью Ultrafast, нового режима GPT-5.6 Sol в API. Полная модель генерирует до 750 выходных токенов в секунду. Это до 14 раз быстрее Standard без перехода на уменьшённую модель.
На всех 2500 вопросах Humanity's Last Exam Sol закончила работу за 11 часов 11 минут. Claude Fable 5 понадобилось 78 часов 27 минут при сопоставимой точности.
Для сравнения, нынешний Fast mode ускоряет Sol только до 2,5 раза и стоит вдвое дороже Standard. Цену Ultrafast пока не раскрыли, а доступ дали лишь нескольким клиентам.
Можно попробовать оставить заявку на ранний доступ.
@ai_for_devs | 13 950 |
| 17 | ⚡️ Qwen3.8-27B запускается локально и местами обходит Opus 4.6
Alibaba открыли веса Qwen3.8-27B. В одном из тестов на агентное программирование результат вырос более чем втрое по сравнению с Qwen3.6-27B.
По совокупности тестов новинка оказалась сильнее даже предыдущей облачной Qwen3.7-Plus.
В отдельных задачах по программированию она показывает результаты выше Opus 4.6, хотя всё ещё уступает некогда флагману в сложных рассуждениях и работе с терминалом.
Облегчённая версия от Unsloth занимает около 17 ГБ: её можно запустить на Mac с Apple Silicon или видеокарте с 24 ГБ памяти.
@ai_for_devs | 10 063 |
| 18 | ⚡️ Google выпустили Gemini 3.7 Flash
Последнюю Pro-модель Google выпустили ещё 19 февраля. Зато с тех пор успели зарелизить уже три Flash подряд: 3.5, 3.6 и 3.7.
По coding-бенчмаркам 3.7 Flash примерно на уровне GPT-5.6 Terra и в среднем немного лучше Sonnet 5. На DeepSWE — 65.3% против 69.6% у Terra и 53.8% у Sonnet, на FrontierCode уже обходит обе: 43.6% против 41.3% и 42.7%.
До конца года стоимость $0.75/$3.75 за миллион токенов (input/output). Это в 2.7 раза дешевле Sonnet 5 по output и больше чем в 3 раза дешевле Terra.
Контекст 1M, модель уже доступна через API, в AI Studio и Antigravity.
@ai_for_devs | 11 299 |
| 19 | ⚡️ DeepSeek поднимают цены на API до 12 раз
С 16 августа DeepSeek вводят часы пик. В это время API будет стоить вдвое дороже, чем в остальные часы. Сами базовые цены тоже выросли.
Генерация V4 Flash подорожает с $0,28 до $0,66–1,32 за миллион токенов, V4 Pro — с $0,87 до $1,98–3,96.
Сильнее всего досталось кэшированному входу V4 Pro: вместо $0,003625 придётся платить $0,022 вне часов пик и $0,044 в часы пик. Это в 6–12 раз дороже.
Эпоха почти бесплатного DeepSeek подошла к концу.
@ai_for_devs | 10 553 |
| 20 | ⚡️ Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol
Технически внутри та же GLM-5.2: без нового претрейна и архитектуры, просто ещё месяц RL на длинных инженерных задачах DeepSWE вырос с 46,2% до 66,9%, Terminal-Bench 3.0 с 4,6% до 28,3%.
На Terminal-Bench 3.0 новинка обошла Kimi K3 и Opus 4.8, но не дотянула до Fable 5 и GPT-5.6 Sol.
Начиная с GLM-5.2 команда проверяла реальные кодовые базы несколькими своими моделями и нашла 2436 уязвимостей в 269 проектах; какие именно версии участвовали, Z.ai не уточняет.
GLM-5.3 уже раскатили в Coding Plan от $18/мес, а веса обещают через две недели; цены API за токены пока нет.
@ai_for_devs | 12 496 |
