en
Feedback
Анализ данных (Data analysis)

Анализ данных (Data analysis)

Open in Telegram

Data science, наука о данных. @haarrp - админ РКН: clck.ru/3FmyAp

Show more

📈 Analytical overview of Telegram channel Анализ данных (Data analysis)

Channel Анализ данных (Data analysis) (@data_analysis_ml) in the Russian language segment is an active participant. Currently, the community unites 50 602 subscribers, ranking 2 570 in the Technologies & Applications category and 12 199 in the Russia region.

📊 Audience metrics and dynamics

Since its creation on невідомо, the project has demonstrated rapid growth, gathering an audience of 50 602 subscribers.

According to the latest data from 02 September, 2026, the channel demonstrates stable activity. Although there has been a change in the number of participants by 186 over the last 30 days and by 3 over the last 24 hours, overall reach remains high.

  • Verification status: Not verified
  • Engagement rate (ER): The average audience engagement rate is 12.86%. Within the first 24 hours after publication, content typically collects 8.16% reactions from the total number of subscribers.
  • Post reach: On average, each post receives 6 507 views. Within the first day, a publication typically gains 4 130 views.
  • Reactions and interaction: The audience actively supports content: the average number of reactions per post is 30.
  • Thematic interests: Content is focused on key topics such as llm, контекст, openai, архитектура, deepseek.

📝 Description and content policy

The author describes the resource as a platform for expressing subjective opinions:
Data science, наука о данных. @haarrp - админ РКН: clck.ru/3FmyAp

Thanks to the high frequency of updates (latest data received on 03 September, 2026), the channel maintains relevance and a high level of publication reach. Analytics show that the audience actively interacts with content, making it an important point of influence in the Technologies & Applications category.

50 602
Subscribers
+324 hours
+607 days
+18630 days
Posts Archive
🚀 Техотчёт Meituan — LongCat-Flash Модель на 560B параметров (из них ~27B активные) с архитектурой MoE, где число активных э
🚀 Техотчёт Meituan — LongCat-Flash Модель на 560B параметров (из них ~27B активные) с архитектурой MoE, где число активных экспертов динамически подстраивается под контекст. 🔧 Архитектура - Каждый слой содержит 2 блока внимания + FFN и MoE → коммуникации накладываются и ускоряют обучение. - Введён «нулевой эксперт» — токен может выбрать «ничего не делать». Это экономит вычисления для простых случаев. - Балансировка нагрузки через специальный loss с постепенным уменьшением смещения. 📈 Масштабирование - Инициализация с выравниванием дисперсий для MoE/MLA → модель обучается стабильнее. - Growth init: сначала тренируется уменьшенная версия (в 2 раза меньше), потом на её основе строят полную модель, просто добавляя слои. - Передача гиперпараметров через метод SP (вместо muP). ⚖️ Стабильность - Следят за отношением нормы градиента и схожестью экспертов, чтобы не «завалить» балансировку. - Для сдерживания активаций используется лёгкий z-loss (альтернатива qk-clip). - Параметр Adam epsilon снижен до 1e-16, чтобы быть меньше диапазона градиентов. ### 📚 Обучение - Всего обучено на ~20 трлн токенов + отдельные фазы: - STEM/код (70% смеси) - расширение контекста: 80B токенов для 32k и 20B для 128k - Данные: извлечение контекста → фильтрация → дедупликация. 🧪 Бенчмарки и результаты - Новые тесты: Meeseeks (многошаговые инструкции) и VitaBench (реальные бизнес-сценарии). - Отдельно показали: - какие top_k лучше для разных задач - как токены распределяются по слоям - В инфре: оптимизация под inference, speculative decoding, квантизация, параллельные коммуникации. 📌 Репозиторий: github.com/meituan-longcat

ИИ-ассистенты уже стали нормой для разработчиков Свежий отчёт от Yandex B2B Tech и ИТМО: 75 % dev’ов используют AI-помощников для кода, документации и поиска багов 🔥 Несколько цифр: — лишь 6 % верят, что ИИ сможет полностью автоматизировать задачи; — 61 % ждут разгрузки рутины, а не полной замены; — 79 % считают, что влияние сильнее всего на джуниоров. Появляется новый must-have навык: работа с ассистентами. Компании планируют вкладывать до 10 % IT-бюджета в инструменты с AI, а интерес к отечественным решениям (например, SourceCraft) растёт — безопасность и независимость стали важнее. 79 % студентов и половина преподавателей уже пользуются AI в обучении.

Grok 5 может стать AGI, считает Илон Маск — и это нельзя недооценивать. 🔹 Модель обучается на огромных массивах данных. 🔹 x
Grok 5 может стать AGI, считает Илон Маск — и это нельзя недооценивать. 🔹 Модель обучается на огромных массивах данных. 🔹 xAI снабжает её свежей и тщательно отобранной информацией. 🔹 Tesla генерирует данные с камер автопилота FSD. 🔹 В ближайшем будущем робот Optimus начнёт собирать колоссальные объёмы реальных данных из физического мира. При этом остаётся главный вопрос: что именно считать AGI? Универсальное и согласованное определение всё ещё необходимо. https://x.com/elonmusk/status/1968202372276163029

📊 Fiverr сокращает 250 сотрудников (около 30% штата), чтобы перезапустить платформу как первый AI маркетплейс. Руководство о
📊 Fiverr сокращает 250 сотрудников (около 30% штата), чтобы перезапустить платформу как первый AI маркетплейс. Руководство объясняет: внутренние ИИ-системы уже автоматизируют значительные объёмы задач, позволяя работать быстрее с меньшими затратами. Примеры: - поддержка через ботов, которые резюмируют политику и историю тикетов, сокращая время SLA, - модели для выявления мошенничества на раннем этапе, - автоматизация процессов, которые раньше были слишком затратны вручную. Компания уходит в сторону «более лёгкой структуры» — меньше уровней, компактные команды, выше личная продуктивность при поддержке общей AI-инфраструктуры. Фокус найма смещается к AI-native специалистам. Существующие команды переучивают на задачи: построение дата-пайплайнов, оценка моделей, поддержка стабильных inference-сервисов. Уже запущенные AI-функции: Neo, Fiverr Go и Dynamic Matching — ускоряют поиск, упрощают старт проектов и улучшают маршрутизацию заказчиков и исполнителей. Финансово компания стабильна: прогноз выручки 2025 — $425M–$438M, цель по операционной марже — 25% к 2026. Экономия частично пойдёт в реинвестирование, остальное — в рост прибыльности. Подробнее: finalroundai.com/blog/fiverr-layoffs-2025

🇺🇸🇨🇳 Anthropic призывает США ускорить внедрение ИИ в госструктурах Компания предупреждает: Китай быстрее продвигает AI в
🇺🇸🇨🇳 Anthropic призывает США ускорить внедрение ИИ в госструктурах Компания предупреждает: Китай быстрее продвигает AI в госуслугах, промышленности и интерфейсах для граждан, и США не должны отставать. 📌 Главное: Уже сотни тысяч федеральных сотрудников используют Claude, но темпы внедрения нужно ускорить. Anthropic предлагает Claude for Enterprise и Claude for Government всего за $1 на год по программе OneGov. Аналогичные скидки дают и другие AI-компании, чтобы агентства могли протестировать разные стеки без больших затрат. Claude уже используют в национальной безопасности, в Lawrence Livermore National Lab и в пилотах с Пентагоном. Система сертифицирована по FedRAMP High, что позволяет работать с конфиденциальными данными. Anthropic также предлагает ввести экспортные ограничения и базовые требования к прозрачности — публикацию результатов тестов и оценок моделей. 🛡️ Вся стратегия компании сводится к ускорению рабочих процессов, защищённым путям данных, проверенным контролям безопасности и интеграции ИИ в уже существующие системы. fedscoop.com/anthropic-makes-its-pitch-to-dc-warning-china-is-moving-even-faster-on-ai/

🚀 Release: TimesFM 2.5 Google Research представила обновлённую версию TimesFM 2.5 на Hugging Face (скоро также в BigQuery и
🚀 Release: TimesFM 2.5 Google Research представила обновлённую версию TimesFM 2.5 на Hugging Face (скоро также в BigQuery и **Model Garden**). TimesFM (Time Series Foundation Model) - модель от Google для прогнозирования временных рядов. Что нового: - Существенное повышение точности по сравнению с TimesFM 2.0 - Увеличенная максимальная длина контекста - Лидерство на GiFT-Eval — TimesFM 2.5 занимает первое место по всем accuracy-метрикам среди zero-shot foundation-моделей 🟠Репозиторий: https://github.com/google-research/timesfm) 🟠HF: http://huggingface.co/google/timesfm-2.5-200m-pytorch @data_analysis_ml #AI #ML #TimesFM #forecasting #GoogleResearch

🔥 agency-swarm — проект, связанный с моделированием многагентных систем с использованием методов искусственного интеллекта!
🔥 agency-swarm — проект, связанный с моделированием многагентных систем с использованием методов искусственного интеллекта! 🌟 Проект ориентирован на создание среды, где множество агентов могут взаимодействовать друг с другом, сотрудничать или конкурировать для достижения определенных целей. 🌟 Основная цель agency-swarm — это исследование и реализация агентных систем, где каждый агент может быть автономным и выполнять задачи в рамках заданной среды. Такие системы часто используются для симуляции поведения групп людей, животных или даже для оптимизации процессов, например, в логистике, робототехнике или при моделировании социальных взаимодействий. 🔐 Лицензия: MIT 🖥 Github @data_analysis_ml

🔥 Курс по AI-агентам уже стартовал! Сегодня, 15 сентября, мы начали первую сессии. Но вы всё ещё можете присоединиться и усп
🔥 Курс по AI-агентам уже стартовал! Сегодня, 15 сентября, мы начали первую сессии. Но вы всё ещё можете присоединиться и успеть в поток — это ПОСЛЕДНИЙ шанс забронировать место по старой цене. На курсе:разложим LLM по косточкам: токенизация, SFT, PEFT, инференс; — соберём RAG и научимся оценивать его адекватно; — построим настоящую мультиагентную систему — архитектуру, которая умеет расти; — разберём CoPilot, сломаем через prompt injection (спасибо Максу); — и наконец, посмотрим, как это работает в MCP и реальных кейсах. 📍 Это 5 живых вебинаров + раздатка + домашки + чат с преподавателями. И главное — возможность реально разобраться, как проектировать системы на LLM, а не просто «поиграться с API». Промокод на 5.000₽: DATAANALYSISML 👉 Курс здесь Реклама. ИП Дрёмов Артём Сергеевич, ИНН 771391651571. Erid 2VtzqxQEXpY

📊 McKinsey: ИИ взорвёт рынок дата-центров По данным свежего отчёта McKinsey, только искусственный интеллект потребует к 2030
📊 McKinsey: ИИ взорвёт рынок дата-центров По данным свежего отчёта McKinsey, только искусственный интеллект потребует к 2030 году $5,2 трлн инвестиций в дата-центры. 💡 Ключевые цифры: - к 2030-му для покрытия спроса на ИИ понадобится 156 ГВт мощностей дата-центров; - с 2025 по 2030 годы нужно будет добавить 125 ГВт новых мощностей; - $5,2 трлн — это расчёт на основе сценариев масштабирования вычислений для ИИ. Этот прогноз подчёркивает: рост ИИ меняет индустрию дата-центров беспрецедентно быстро, а финансовая нагрузка, связанная с обеспечением вычислительных мощностей, станет колоссальной. 🔗 McKinsey Report: https://www.mckinsey.com/industries/technology-media-and-telecommunications/our-insights/the-cost-of-compute-a-7-trillion-dollar-race-to-scale-data-centers @data_analysis_ml

Интегрируй ML-модель в продакшн без боли и ошибок! Практикум для разработчиков и ML-инженеров, которые устали от «эксперимент
Интегрируй ML-модель в продакшн без боли и ошибок! Практикум для разработчиков и ML-инженеров, которые устали от «экспериментов в Jupyter» и хотят переходить к реальным решениям! 16 сентября в 19:00 приглашаем на встречу по интеграции моделей с внешним миром и написанию API вместе с экспертом Игорем Стурейко — разработчиком модели прогнозирования технического состояния газотранспортной системы ПАО Газпром. На практикуме вы: 👨‍💻перенесёте модель из Jupyter notebook в полноценный Python-класс 👨‍💻создадите API и подготовите эндпоинты 👨‍💻напишете валидатор для входящих параметров 👨‍💻протестируете работу модели как отдельного сервиса. Все участники получают 7% скидку на любой курс OTUS + бонус: карьерные треки для ML-специалистов Записывайся на практикум: https://tglink.io/7f7e67d341e5 Реклама. ООО "ОТУС ОНЛАЙН-ОБРАЗОВАНИЕ". ИНН 9705100963. erid: 2W5zFJF6HRA

🔒 Nano Banana и цифровые водяные знаки Все изображения, сгенерированные через Nano Banana, автоматически содержат водяной зн
🔒 Nano Banana и цифровые водяные знаки Все изображения, сгенерированные через Nano Banana, автоматически содержат водяной знак synthID. Это специальная технология, которая встраивает в картинку невидимую метку — её можно обнаружить и подтвердить происхождение изображения. Подробнее о том, как работает synthID watermarking, можно прочитать здесь: 👉 https://huggingface.co/blog/synthid-text

Топ навыков ML-инженера на примере реальной бизнес-задачи Предсказать отток клиентов — одна из самых распространенных и актуа
Топ навыков ML-инженера на примере реальной бизнес-задачи Предсказать отток клиентов — одна из самых распространенных и актуальных задач для любого бизнеса. На примере этой задачи можно рассмотреть все этапы работы ML-инженера: данные, признаки, модель, метрики и выводы для бизнеса. Чтобы увидеть полный цикл решения реальной задачи и понять, какие навыки нужны ML-инженеру в работе, приходите 16 сентября на практико-ориентированный вебинар от Кристины Желтовой — директора по разработке моделей в Газпромбанке. В ходе вебинара мы на примере задачи предсказания оттока клиентов разберём:
🟠Актуальность предсказания оттока клиентов для бизнеса 🟠Как работать с «сырыми» данными и подготовить их для обучения модели 🟠Как выбрать, построить и обучить базовую модель в Google Colab 🟠Как проверить, качество работы модели: разбор метрик и ошибок 🟠Какие ключевые навыки складываются в профессию
ML-инженера.🕗 Встречаемся 16 сентября в 19:00 МСК Обязательно ждем вас в лайве — вы сможете напрямую задать свои вопросы Кристине Желтовой и забрать с собой пример файла в Google Colab, с которым сможете продолжить погружаться в задачу после вебинара! 😶Зарегистрироваться на бесплатный вебинар

✂️ НОВОСТЬ: Вышел Grok 4 Fast (ранний доступ, бета) И название себя оправдывает — молниеносно быстрый. Бету можно включить пр
+1
✂️ НОВОСТЬ: Вышел Grok 4 Fast (ранний доступ, бета) И название себя оправдывает — молниеносно быстрый. Бету можно включить прямо сейчас: Настройки → Подписка → Включить ранний доступ к моделям ⚡️ Главный апдейт — скорость, которая делает Grok 4 отличеным выбором для задач с большим количеством вычислений. @data_analysis_ml

Эра 1-битных LLM наступила 🫥 🔹 DeepSeek-V3.1, квантованный всего до 1-бита или 3-бит, обошёл Claude Opus 4 и GPT-4.5. 🔹 Un
+5
Эра 1-битных LLM наступила 🫥 🔹 DeepSeek-V3.1, квантованный всего до 1-бита или 3-бит, обошёл Claude Opus 4 и GPT-4.5. 🔹 Unsloth GGUF смог сжать DeepSeek-V3.1 на 75%, при этом модель превзошла топовых конкурентов в бенчмарке Aider Polyglot. 🟠Подробности: https://docs.unsloth.ai/new/unsloth-dynamic-ggufs-on-aider-polyglot @data_analysis_ml

🚀 MobileLLM-R1 на Hugging Face Это новая компактная модель для reasoning-задач (рассуждений), которая весит меньше 1B параме
🚀 MobileLLM-R1 на Hugging Face Это новая компактная модель для reasoning-задач (рассуждений), которая весит меньше 1B параметров и оптимизирована для запуска на edge-устройствах. Почему это важно: - Производительность: • Решает задачи MATH почти в 5 раз точнее, чем Olmo-1.24B • В 2 раза точнее, чем SmolLM2-1.7B - Эффективность обучения: • Модель обучалась всего на 4.2 триллионах токенов (это примерно 1/10 от Qwen3) • Несмотря на это, показывает такие же или лучшие результаты, чем Qwen3, на ряде тестов по рассуждениям MobileLLM-R1 показывает, что даже очень маленькая модель может быть умной и эффективной, если её правильно обучить. https://huggingface.co/facebook/MobileLLM-R1-950M

Если Ctrl+Z не помогает… Значит, пора искать команду, где гипотезы проверяются на реальных данных, а результаты влияют на миллионы пользователей. В Сбере именно так — и это видно даже в поздравительном видео, которое подготовили будущие коллеги. Вакансии ждут вас здесь. А кодовый бонус прилагается: team.congratulate("С Днём программиста! 💚")

🔥 Новинка от S-Lab, Nanyang Technological University и SenseTime Research: Next Visual Granularity Generation (NVG)! 🖼️ Новый фреймворк поэтапно улучшает изображение — от общего макета до мельчайших деталей, позволяя получить тонкий контроль над процессом генерации. 📊 Результаты впечатляют: NVG превзошёл серию VAR по метрикам FID! huggingface.co/papers/2508.12811

Поздравляем, вы на 1 шаг ближе к работе мечты 🥳 Осталось только прочитать этот пост, подписаться на канал и откликнуться на
Поздравляем, вы на 1 шаг ближе к работе мечты 🥳 Осталось только прочитать этот пост, подписаться на канал и откликнуться на вакансию 😉 Avito Career — место, где Авито делится актуальными вакансиями и стажировками для Go-разработчиков. Подписывайтесь, чтобы найти ту самую работу ✨

🚀 Новый релиз: Smart Turn v3 🎙️ Это модель, которая понимает, когда человек закончил говорить и ждёт ответа от голосового а
🚀 Новый релиз: Smart Turn v3 🎙️ Это модель, которая понимает, когда человек закончил говорить и ждёт ответа от голосового ассистента. ⚡ Особенности: - Работает супербыстро: <60мс на обычном CPU, <10мс на GPU - Поддержка 23 языков (можно добавлять новые через сообщество) - Полностью открытая: данные, код, обучение - Бесплатно использовать даже на CPU 🛠️ Уже доступна в @pipecat_ai 0.0.85 и на Pipecat Cloud. 🔥 Голосовой AI становится всё умнее — теперь ассистенты будут отвечать ещё естественнее! 🟢Blog: https://daily.co/blog/announcing-smart-turn-v3-with-cpu-inference-in-just-12ms/ 🟢GitHub: https://github.com/pipecat-ai/smart-turn/

🚀 Оптимизация обновления весов моделей в LLM Checkpoint Engine — это легковесное промежуточное ПО для обновления весов в LLM
🚀 Оптимизация обновления весов моделей в LLM Checkpoint Engine — это легковесное промежуточное ПО для обновления весов в LLM во время инференса, критически важное для обучения с подкреплением. Оно обеспечивает быстрые и эффективные методы обновления весов, позволяя обрабатывать модели с триллионом параметров за считанные секунды. 🚀 Основные моменты: - Поддержка двух методов обновления: Broadcast и P2P. - Эффективная передача данных с использованием CUDA IPC. - Оптимизированный процесс передачи с учетом шардирования. - Подходит для работы с большими моделями на множестве GPU. 📌 GitHub: https://github.com/MoonshotAI/checkpoint-engine