Machinelearning
Погружаемся в машинное обучение и Data Science Показываем как запускать любые LLm на пальцах. По всем вопросам - @haarrp @itchannels_telegram -🔥best channels Реестр РКН: clck.ru/3Fmqri
Ko'proq ko'rsatish📈 Telegram kanali Machinelearning analitikasi
Machinelearning (@ai_machinelearning_big_data) Rus til segmentidagi kanali faol ishtirokchi. Hozirda hamjamiyat 278 376 obunachidan iborat bo'lib, Texnologiyalar & Aralashmalar toifasida 331-o'rinni va Rossiya mintaqasida 1 358-o'rinni egallagan.
📊 Auditoriya ko‘rsatkichlari va dinamika
невідомо sanasidan buyon loyiha tez o‘sib, 278 376 obunachiga ega bo‘ldi.
10 Oktabr, 2026 dagi oxirgi ma’lumotlarga ko‘ra kanal barqaror faollikka ega. Oxirgi 30 kunda obunachilar soni -3 126 ga, so‘nggi 24 soatda esa 0 ga o‘zgardi va umumiy qamrov yuqori darajada qolmoqda.
- Tasdiqlash holati: Tasdiqlanmagan
- Jalb etish (ER): Auditoriya o‘rtacha 7.75% darajada jalb etiladi. Nashrdan keyingi dastlabki 24 soatda kontent odatda umumiy obunachilar sonining 6.10% ini tashkil etuvchi reaksiyalarni to‘playdi.
- Post qamrovi: Har bir post o‘rtacha 21 572 marta ko‘riladi; birinchi sutkada odatda 16 988 ta ko‘rish yig‘iladi.
- Reaksiyalar va o‘zaro ta’sir: Auditoriya faol: har bir postga o‘rtacha 155 ta reaksiya keladi.
- Tematik yo‘nalishlar: Kontent openai, claude, api, gemini, контекст kabi asosiy mavzularga jamlangan.
📝 Tavsif va kontent siyosati
Muallif resursni shaxsiy fikrni ifoda etish maydoni sifatida ta’riflaydi:
“Погружаемся в машинное обучение и Data Science
Показываем как запускать любые LLm на пальцах.
По всем вопросам - @haarrp
@itchannels_telegram -🔥best channels
Реестр РКН: clck.ru/3Fmqri”
Yuqori yangilanish chastotasi (oxirgi ma’lumot 11 Oktabr, 2026 da olingan) sababli kanal doimo dolzarb va katta qamrovli bo‘lib qoladi. Analitika auditoriya kontent bilan faol hamkorlik qilishini, uni Texnologiyalar & Aralashmalar toifasidagi muhim ta’sir nuqtasiga aylantirishini ko‘rsatadi.
Лёгкий беспорядок вызывает тихое хныканье, настоящая катастрофа - полноценный вопль.Эндрю подаёт идею с серьёзным лицом:
По мере того как команды внедряют кодинг-агентов, следующий вызов - понимать не только то, что агенты производят, но и то, каково ощущается работа внутри кодовой базы, — написал Вос на Hacker News, представившись там как CTO Endless Toil.По его словам, плагин даёт разработчикам сигнал в реальном времени о сложности, поддерживаемости и архитектурном напряжении, переводя качество кода в аудиообратную связь. У плагина 3 уровня: "стон", "вопль" и "бездна". Последний, надо полагать, зарезервирован для тотального спагетти-кода, написанного в два часа ночи джуном, открывшим для себя Codex. Вокруг подобных идей уже сложился целый поджанр. Утилита nubmoan, заставляющая красный TrackPoint на ThinkPad стонать при нажатии, набрала на GitHub 292 звезды. Приложение SlapMac использует акселерометр Mac, чтобы кричать в ответ на шлепки по корпусу и реагировать на каждое подключение по USB.
SlapMac, кстати, успешно монетизировался - за 3 дня получил около 7000 установок и заработал более 5000 долларов.Все это выглядит как небольшая, неловкая, очень человеческая категория софта, которой несколько лет назад не существовало. Что-то изменилось в том, как мы относимся к инструментам. Они перестают быть нейтральными. Мы хотим, чтобы они реагировали. На нас, на наш код, на наши ошибки. @ai_machinelearning_big_data #news #ai #ml
Теперь ИИ-помощник в облаке может создавать несколько виртуальных машин, а после управлять ими по команде. Например, добавлять или удалять диски, менять конфигурации и выполнять другие повседневные операции.2️⃣ Три новых сценария
▶️
DevOps-агент
— может разворачивать и обслуживать PostgreSQL, Kafka, WordPress, GitLab и другие популярные сервисы по текстовому промпту.
▶️
SRE-агент
— настраивает мониторинг, алертинг и помогает разбирать инциденты.
▶️
FinOps-агент
— находит забытые или неиспользуемые ВМ и предлагает их удалить, чтобы исключить бессмысленные траты. А еще может показать топ дорогих ресурсов, позволяя сравнивать траты за разные периоды.👉 Попробовать
Теперь разработчики могут переносить уже готовых агентов на GigaChat с минимальными правками.Инструменты раздают по открытым MIT-лицензиям, и такой подход дает вполне измеримые плоды. Базовая библиотека Сбера вошла в топ 1,5% по скачиваниям на PyPI, а энтузиасты сами добавляют поддержку GigaChat в другие популярные фреймворки вроде LlamaIndex. 🟢Свежее интервью на Хабре с управляющим директором и техлидом GigaChain Константина Крестникова наглядно показывает: делиться кодом — лучшая стратегия для глобального роста. @ai_machinelearning_big_data #news #ai #ml
Во-первых, это классические memory-bound ядра: они постоянно гоняют тензоры K, V и промежуточные стейты туда-сюда между HBM и чипом.
Во-вторых, из-за рекуррентной природы стейта вы просто не можете нормально утилизировать GPU при маленьких батчах или использования тензорного параллелизма. Сплошной простой вычислительных блоков.В Qwen не стали лепить очередное монолитное ядро (которое на маленьких батчах и под TP все равно простаивает), а пошли на компромисс, написав библиотеку FlashQLA на базе TileLang: 🟢 Разбили прямой проход на два слитных ядра, а между ними вставили препроцессинг для автоматического контекстного параллелизма внутри одной карты. 🟠Главная фича Использовали свойство экспоненциального затухания гейта в GDN.
На 60-80% голов внимания влияние старых токенов быстро падает. Это значит, что нам не нужно считать рекуррентный стейт с самого начала последовательности.FlashQLA делает легкий прогрев на 6-8 чанках и получает практически точный стейт для текущего блока. 🟢В рамках одного потокового мультипроцессора одни варпы занимаются только перекладыванием данных, пока другие в режиме пинг-понга молотят матричные умножения на Tensor Cores и CUDA Cores, скрывая задержки. 🟡Цифры На чипах Hopper FlashQLA ускоряет forward в 2–3 раза, backward - в 2 раза относительно FLA Triton. На фоне FlashInfer отрыв ещё больше. Особенно сочный буст виден на претрейне и при инференсе агентов, где обычно гоняется один длинный промпт. 🟡Ложка дёгтя
Старое железо - мимо: ядра требуют архитектуру SM90. Если у вас парк старых Ampere - ограничиваемся чтением статьи и копим бюджеты на H200. Во-вторых, код сильно заточен под конкретную алгебру GDN, так что использовать это как замену для любого линейного внимания не получится.Но Qwen достойны любви за эту красивую инженерную работу, где оптимизации логично вытекают из математических свойств самой архитектуры. Посмотрим, как быстро этот подход растащат в другие фреймворки. 📌Лицензирование: MIT License 🟡Статья 🖥GitHub @ai_machinelearning_big_data #AI #ML #LLM #FlashQLA #Kernels #Qwen
В демонстрации возможностей V2.5-Pro самостоятельно написала рабочий компилятор из SysY в RISC-V: на процесс ушло 4,3 часа и почти 700 вызовов внешних инструментов.🟠MiMo-V2.5 (1M) и MiMo-V2.5 Base (256K) Мультимодальная модель на 310 млрд общих и 15 млрд активных параметров c выделенным визуальным (729 млн) и аудиоэнкодером (261 млн), которая понимает текст, изображения, видео и звук. Обе ветки семейства используют гибридную систему внимания (скользящее окно плюс глобальное) и трехуровневый модуль MTP, который предсказывает сразу несколько токенов. 🟡Вместе с релизом Xiaomi запустила грантовую программу Orbit. с 27 апреля по 27 мая компания бесплатно распределит между разработчиками и стартапами пул в 100 триллионов токенов. После аппрува заявки полученные лимиты можно будет подключить к Cursor и Claude Code. 📌Лицензирование: MIT License 🟡Статья 🟡Набор моделей 🟡Demo @ai_machinelearning_big_data #AI #ML #LLM #MMLM #MiMO #Xiaomi
Тестирование проводилось на модели ChatGPT 5.2 Thinking. Задания передавались в виде изображений, а сочинения и развёрнутые ответы оценивали преподаватели школы Kawai Juku.На самом популярном направлении Токийского университета - медицинском, ИИ опередил лучшего из поступивших на 50 баллов и получил максимальный результат по математике. По гуманитарному блоку чат-бот набрал 452 балла из 550 (лучший показатель среди абитуриентов был 434), а по естественным наукам - 503 из 550 (против 453 у кожаных). Недобрал GPT 5.2 только внезапно по английскому языку (90%) и всемирной истории (25%). На экзаменах Киотского университета чат-бот набрал 771 балл на юридическом факультете (наивысший балл у людей - 734) и 1 176 баллов на медицинском (против 1 098 у лучшего поступившего абитуриента). LifePrompt проводит подобное тестирование 3-й год подряд. 🟠В 2024-м модель ChatGPT 4 не смогла преодолеть минимальный проходной балл Токийского университета. 🟠В 2025-м версия o1 впервые прошла этот порог. 🟢В этом году заявленные результаты впервые превысили показатели людей. Глава Японского общества искусственного интеллекта, профессор Университета Кэйо Сатоси Курихара прокомментировал результаты скептически.
"Подобно тому как калькулятор считает быстрее и точнее человека, для ИИ закономерно набирать высокие баллы", — сказал учёный, добавив, что нынешние вступительные экзамены требуют пересмотра.@ai_machinelearning_big_data #news #ai #ml
Conductor и TRINITY приняты на ICLR 2026.🟡Статья 🟡Arxiv @ai_machinelearning_big_data #AI #ML #LLM #Orchestration #FUGU #SakanaAi
"В будущем возможны периоды, когда нам придётся пожертвовать частью расширения возможностей ради большей устойчивости".Публикация вышла на фоне продолжающейся в индустрии дискуссии о том, насколько безопасно ускорять разработку ИИ и кто должен принимать решения о пределах допустимого. Часть бывших сотрудников OpenAI ранее публично выражала сомнения в соответствии действий компании её декларациям; отдельные критики указывали на коммерциализацию структуры, изначально созданной как некоммерческая. Сама OpenAI пишет, что заслуживает пристального внимания и критики и обещает делать выводы и корректировать курс. @ai_machinelearning_big_data #news #ai #ml
Слова «ALWAYS» и «NEVER» советуют беречь для настоящих инвариантов: правил безопасности и обязательных полей вывода. Для остального - правила и явные ограничители, чтобы модель не зацикливалась в бесконечных лупах.Рекомендованная структура промпта открывается ролью и контекстом, дальше идут Personality, Goal, Success criteria, Constraints, Output и Stop rules. Внутри блока Personality гайд просит разделять 2 измерения: как ассистент звучит (тон, формальность, юмор) и как он работает - когда уточнять, когда делать допущения и как обходиться с неопределённостью. Поведение при поиске и цитировании OpenAI вводит понятие retrieval budgets: один широкий поиск по коротким ключевым словам, повторный - только если не хватает фактов, нужен конкретный документ или пользователь просил исчерпывающий обзор. Для презентаций и маркетинговых текстов руководство рекомендует чётко делить утверждения: где нужны источники, а где можно писать свободно. Для стриминговых интерфейсов гайд предлагает preambles — короткие пользовательские апдейты в одно-два предложения перед первым вызовом инструментов. Они не ускоряют модель, но заметно сокращают воспринимаемую задержку. Переписывать всё вручную не обязательно. OpenAI опубликовала собственный Skill для Codex и других кодинг-агентов - он применяет правила нового гайда одной командой. @ai_machinelearning_big_data #news #ai #ml
