en
Feedback
Data Science | Machinelearning [ru]

Data Science | Machinelearning [ru]

Open in Telegram

Все о Data Science, машинном обучении и искусственном интеллекте: от базовой теории до cutting-edge исследований и LLM. Личный блог автора - @just_genych По вопросам рекламы или разработки - @g_abashkin РКН: https://vk.cc/cJPGXD

Show more

📈 Analytical overview of Telegram channel Data Science | Machinelearning [ru]

Channel Data Science | Machinelearning [ru] (@devsp) in the Russian language segment is an active participant. Currently, the community unites 19 808 subscribers, ranking 6 531 in the Technologies & Applications category and 33 428 in the Russia region.

📊 Audience metrics and dynamics

Since its creation on невідомо, the project has demonstrated rapid growth, gathering an audience of 19 808 subscribers.

According to the latest data from 02 September, 2026, the channel demonstrates stable activity. Although there has been a change in the number of participants by -98 over the last 30 days and by 6 over the last 24 hours, overall reach remains high.

  • Verification status: Not verified
  • Engagement rate (ER): The average audience engagement rate is 7.83%. Within the first 24 hours after publication, content typically collects 4.91% reactions from the total number of subscribers.
  • Post reach: On average, each post receives 1 550 views. Within the first day, a publication typically gains 972 views.
  • Reactions and interaction: The audience actively supports content: the average number of reactions per post is 5.
  • Thematic interests: Content is focused on key topics such as llm, nvidia, контекст, openai, архитектура.

📝 Description and content policy

The author describes the resource as a platform for expressing subjective opinions:
Все о Data Science, машинном обучении и искусственном интеллекте: от базовой теории до cutting-edge исследований и LLM. Личный блог автора - @just_genych По вопросам рекламы или разработки - @g_abashkin РКН: https://vk.cc/cJPGXD

Thanks to the high frequency of updates (latest data received on 03 September, 2026), the channel maintains relevance and a high level of publication reach. Analytics show that the audience actively interacts with content, making it an important point of influence in the Technologies & Applications category.

19 808
Subscribers
+624 hours
+177 days
-9830 days
Posts Archive
👩‍💻 Задачка по Python Напишите функцию, которая принимает DataFrame и заменяет отсутствующие значения (NaN) в каждом числовом столбце на среднее значение этого столбца. Если столбец содержит только NaN, оставьте его без изменений. ➡️ Пример:
   feature1  feature2  feature3
0       1.0      10.0       NaN
1       2.0       NaN       NaN
2       NaN      30.0       NaN
3       4.0      40.0       NaN

   feature1  feature2  feature3
0      1.00      10.0       NaN
1      2.00      26.7       NaN
2      2.33      30.0       NaN
3      4.00      40.0       NaN
Решение задачи ⬇️
import pandas as pd def fill_missing_with_mean(df): numeric_columns = df.select_dtypes(include=['float', 'int']) for column in numeric_columns: if df[column].notna().any(): # Проверяем, есть ли значения не NaN df[column] = df[column].fillna(df[column].mean()) return df # Пример использования: data = pd.DataFrame({ 'feature1': [1.0, 2.0, None, 4.0], 'feature2': [10.0, None, 30.0, 40.0], 'feature3': [None, None, None, None] }) result = fill_missing_with_mean(data) print(result)

🖥 Как работает Трансформер: очень простое описание Вот очень простое объяснение для тех, кто не хочет вдаваться в сложную математику, но и не готов принимать эту ключевую технологию как магию, которая просто работает. Конечно, никакого волшебства тут и нет — идея на самом деле довольно проста.. Читать...

👩‍💻 Задачка по Python Напишите Python-скрипт, который принимает путь к большому CSV-файлу и подсчитывает количество строк (записей) в файле без загрузки его целиком в память. Скрипт должен быть оптимизирован для работы с большими файлами. ➡️ Пример:
python count_rows.py large_file.csv
Количество строк: 3
Решение задачи ⬇️
import csv import sys def count_rows(file_path): with open(file_path, 'r', encoding='utf-8') as file: reader = csv.reader(file) # Используем enumerate для подсчёта строк, исключая заголовок row_count = sum(1 for _ in reader) - 1 # Минус 1 для исключения заголовка return row_count if __name__ == "__main__": if len(sys.argv) < 2: print("Использование: python count_rows.py <file_path>") sys.exit(1) file_path = sys.argv[1] try: result = count_rows(file_path) print(f"Количество строк: {result}") except Exception as e: print(f"Ошибка: {e}")

🖥 Руководство по созданию приложения для поиска данных на основе агента GraphRAG Статья описывает приложение, объединяющее GraphRAG и AutoGen-агентов с локальными LLM от Ollama для автономного встраивания и вывода. Рассмотрены ключевые аспекты: интеграция знаний, настройка LLM, вызов функций и интерактивный интерфейс. Читать...

➡️ Путь разметки данных для NER: от Open Source до Prodigy Статья посвящена созданию обучающей выборки для NER. Описан опыт разметки данных с использованием Open Source инструментов и Prodigy, профессионального решения для ускорения процесса создания наборов данных. Читать...

🧬 Почини одну переменную — и система станет проще Ты борешься с непонятной логикой, огромными условиями, крошечными багообразными эффектами. Всё сложно. 👉 Совет: не паникуй. Найди одну переменную, одно имя, один формат, который вносит больше всего путаницы — и перепиши его. Часто даже одно улучшение приводит к лавине упрощений. Разбор сложности начинается с одной точки.

🤔 Практика: мой опыт интеграции более 50 нейронных сетей в один проект Статья основана на полутора годах работы по внедрению нейронных сетей в веб-приложение с открытым исходным кодом. В ней собраны практические лайфхаки для решения реальных задач и преодоления сложностей, с которыми сталкиваются разработчики. Читать...

👩‍💻 Разрабатываем первое AI приложение Статья анализирует роль языка и цифровизации в накоплении и передаче знаний. Обсуждаются вызовы структурирования данных, которые, несмотря на успехи машинного обучения и реляционных баз, всё ещё затрудняют полное понимание накопленной информации. Читать...

⚙️Магистратура по ML раньше: либо сухая теоретическая нагрузка, либо практикум без базы. Центральный университет запустил гиб
⚙️Магистратура по ML раньше: либо сухая теоретическая нагрузка, либо практикум без базы. Центральный университет запустил гибридную магистратуру, где занятия онлайн, но есть и живые буткемпы в Москве, причем ребятам из регионов проживание оплачивает вуз. Студенты будут работать над реальными задачами компаний под руководством экспертов индустрии: ведущих дата сайентистов, профессоров, аналитиков и главных тренеров школьной сборной России, победившей в мировой олимпиаде по ИИ в Болгарии. 📌В программе обучения: актуальные ML-инструменты, командная работа, вечерние занятия в мини-группах. Есть гранты до 75%, очный диплом и отсрочка от армии. Начало в сентябре, заявки принимаются до 20 августа.

⚙️ Что такое StandardScaler в Data Science и зачем он используется? StandardScaler из библиотеки scikit-learn — это инструмент для нормализации данных. Он приводит признаки (столбцы данных) к одному масштабу со средним значением 0 и стандартным отклонением 1. Это важно для алгоритмов машинного обучения, чувствительных к масштабу данных — например, линейной регрессии, SVM или KMeans. ➡️ Пример:
from sklearn.preprocessing import StandardScaler
import numpy as np

X = np.array([[10, 200],
              [20, 300],
              [30, 400]])

scaler = StandardScaler()
X_scaled = scaler.fit_transform(X)

print(X_scaled)
🗣️ В этом примере значения всех признаков преобразуются так, что каждый столбец имеет среднее значение 0 и одинаковый масштаб. Это ускоряет обучение и повышает качество модели.
🖥 Подробнее тут

⚙️ Конфиденциальность мертва: Яндекс и ВК обучают ИИ на ваших личных данных? В статье проверяют, как Yandex GPT в голосовом ассистенте ведёт себя с персональными данными. Узнают, что он сливает номер телефона и личную инфу, а потом делает вид, что ничего не знает. Читать...

ТОПОВЫЕ ЭКСПЕРТЫ РАСКРЫВАЮТ СВОИ СЕКРЕТЫ 🤫 Поспеши узнать первым!❗ Мы с ведущими экспертами решили поделиться нашими секрета
ТОПОВЫЕ ЭКСПЕРТЫ РАСКРЫВАЮТ СВОИ СЕКРЕТЫ 🤫 Поспеши узнать первым! Мы с ведущими экспертами решили поделиться нашими секретами, наработками, инструментами в сфере бизнеса, маркетинга, ИИ:👇 ▪️Кейсы, лайфхаки, стратегии для бизнеса в непростые времена ▪️Как выйти на доход 300к+ и управлять проектами любой сложности. ▪️Всё об  Искусственном Интеллекте и как зарабатывать с его помощью.  ▪️Как делать запуски на 100 млн+ 🔥 Все это в нашем канале СЕКРЕТЫ TELEGRAM Возможность забрать  секреты продлится 5 дней! Если вы давно хотели найти новые идеи или инструменты, которые помогут вам ещё больше зарабатывать💰,то СЕКРЕТЫ TELEGRAM специально для вас! 🔑Канал с Секретами среди каналов экспертов ▪️В папке есть Чат-нетворкинг: "ЗАЯВИ О СЕБЕ", где вы можете разместить информацию о своих услугах и оставить контакты. Это отличная возможность прорекламировать себя совершенно бесплатно и получить новых клиентов!🔥 Жми на ссылку и присоединяйся: 👇 https://t.me/addlist/VEJiOiE3Pps4ZmQ0 ЗАПИСАТЬ СВОЙ КАНАЛ В ПАПКУ

ТОПОВЫЕ ЭКСПЕРТЫ РАСКРЫВАЮТ СВОИ СЕКРЕТЫ 🤫 Поспеши узнать первым!❗ Мы с ведущими экспертами решили поделиться нашими секрета
ТОПОВЫЕ ЭКСПЕРТЫ РАСКРЫВАЮТ СВОИ СЕКРЕТЫ 🤫 Поспеши узнать первым! Мы с ведущими экспертами решили поделиться нашими секретами, наработками, инструментами в сфере бизнеса, маркетинга, ИИ:👇 ▪️Кейсы, лайфхаки, стратегии для бизнеса в непростые времена ▪️Как выйти на доход 300к+ и управлять проектами любой сложности. ▪️Всё об  Искусственном Интеллекте и как зарабатывать с его помощью.  ▪️Как делать запуски на 100 млн+ 🔥 Все это в нашем канале СЕКРЕТЫ TELEGRAM Возможность забрать  секреты продлится 5 дней! Если вы давно хотели найти новые идеи или инструменты, которые помогут вам ещё больше зарабатывать💰,то СЕКРЕТЫ TELEGRAM специально для вас! 🔑Канал с Секретами среди каналов экспертов ▪️В папке есть Чат-нетворкинг: "ЗАЯВИ О СЕБЕ", где вы можете разместить информацию о своих услугах и оставить контакты. Это отличная возможность прорекламировать себя совершенно бесплатно и получить новых клиентов!🔥 Жми на ссылку и присоединяйся: 👇 https://t.me/addlist/VEJiOiE3Pps4ZmQ0 ЗАПИСАТЬ СВОЙ КАНАЛ В ПАПКУ

⚙️ RAG: борьба с низким качеством ответов в условия экономии памяти на GPU В статье показали, как делали ИИ-помощника на RAG для юристов внутри компании: с какими проблемами столкнулись, как прокачивали точность ответов и экономили память на видеокартах. Читать...

🧑🏻‍💻16 июля в 18:00 МСК OTUS проводит открытый вебинар: «Random Forest — мощный метод ансамблирования в ML». Вы узнаете, к
🧑🏻‍💻16 июля в 18:00 МСК OTUS проводит открытый вебинар: «Random Forest — мощный метод ансамблирования в ML». Вы узнаете, как работает один из самых надёжных и понятных алгоритмов машинного обучения — Random Forest. Поговорим о принципах его работы, вариантах применения, особенностях настройки и, конечно, попрактикуемся на Python прямо на занятии. Это отличный шанс для тех, кто: — делает первые шаги в Data Science; — хочет разобраться в ключевых алгоритмах ML; — рассматривает переход в IT; — выбирает курс и направление для старта карьеры. 📢 Спикер Мария Тихонова – PhD Computer Science, Senior Data Scientist. ➡️ Вебинар проходит в преддверии старта курса «Специализация Machine Learning». Все участники получат скидку на обучение. Регистрация открыта: https://vk.cc/cNAVi9 Реклама. ООО «Отус онлайн-образование», ОГРН 1177746618576

➡️ Что забирает до 90% времени на созвонах и как перестать проводить их впустую Когда митапов больше, чем решений, пора что-то менять. Мы выработали способ делать онлайн-созвоны короче, полезнее и без «а что мы вообще решили?». Делюсь, как именно. Читать...

Мы собрали 📂 рабочую папку с экспертами, которые крутятся вокруг AI, IT, маркетинга на ежедневной основе. Внутри — те, кто:
Мы собрали 📂 рабочую папку с экспертами, которые крутятся вокруг AI, IT, маркетинга на ежедневной основе. Внутри — те, кто: — помогает бизнесу не просто “поиграться с GPT”, а реально встроить его в продажи, контент и аналитику — знает, как нейросети экономят бюджет на копирайт, визуал и прогрев — умеют выстраивать воронки, где AI — часть, а не шоу — не сливает в тесты по 100к, потому что уже прошёл это сам 📌 В подарок каждому: Гайд «50 нейросетей для презентаций! — сэкономьте часы и делайте эффектные слайды за минуты, а не вручную!» ЗАБРАТЬ ПАПКУ