Data Scientist | ML & AI
الذهاب إلى القناة على Telegram
Один из ведущих каналов по Data Science, Machine Learning и Big Data Сотрудничество: @bape_ads Прайс: @bape_media
إظهار المزيد3 024
المشتركون
+524 ساعات
+197 أيام
+6030 أيام
أرشيف المشاركات
🔖 Как обучают LLM в огромных масштабах
Нашли бесплатную онлайн-книг, где разбирают:
🫡 Память GPU и профилирование; 🫡 Разбиение вычислений на блоки; 🫡 Fusion ядер; 🫡 FlashAttention; 🫡 Data parallelism; 🫡 Tensor parallelism; 🫡 Pipeline parallelism; 🫡 Context parallelism.⛓ Ссылка на книгу tags: #полезное ➡ Data Scientist | Чат
🎬Бесплатный вебинар «Один SQL над Iceberg, PostgreSQL и ClickHouse: как Trino выполняет федеративные запросы, и где они начинают тормозить»
Практический вебинар о том, как Trino физически выполняет один SQL-запрос над Iceberg/S3, PostgreSQL/Pangolin и ClickHouse, и почему производительность в такой архитектуре определяется не текстом SQL, а тем, где реально считаются фильтры, агрегации и соединения.
На живом примере через EXPLAIN ANALYZE разберём путь запроса от координатора до источников, найдём узкое место и сравним варианты решения — от ранней фильтрации и материализации в Iceberg до вычислений прямо в источнике.
В финале — критерии выбора между федерацией, материализацией и выполнением по частям, сравнение Trino с PostgreSQL/Greenplum, ClickHouse и Spark SQL.
📅Дата: 15.09.2026, 1700 (МСК)
👨🎓Спикер: Брейман Александр, Эксперт в области разработки и архитектуры ПО
👉Записаться👈
#реклама
О рекламодателе
📰 Как бы опытный разработчик заходил в Data Science и ML с нуля
В статье автор разбирает, как бы выстроил обучение сегодня, если бы начинал заново.
Фокус не только на том, что учить, но и в каком порядке: какие темы реально важны, где чаще всего теряют время и какие ошибки лучше не повторять.
⛓️ Читать статью
tags: #статья
➡ Data Scientist | Чат
📰 Как бы опытный разработчик заходил в Data Science и ML с нуля
В статье автор разбирает, как бы выстроил обучение сегодня, если бы начинал заново.
Фокус не только на том, что учить, но и в каком порядке: какие темы реально важны, где чаще всего теряют время и какие ошибки лучше не повторять.
⛓️ Читать статью
tags: #статья
➡ Data Scientist | Чат
Псс, хочешь перестать мониторить Telegram в поисках работы? 👀
Ты листаешь каналы, видишь вакансию, сохраняешь и откладываешь отклик «на потом».
Потому что на каждую нужно потратить минут 20. В итоге из десятков сохранённых вакансий до отклика доходят единицы.
Софи забирает эту рутину на себя.
Она сама находит подходящие вакансии в 350+ Telegram-каналах, изучает их, пишет персональное сопроводительное и отправляет отклик.
А еще она умеет откликаться на:
▫️ hh ru
▫️ карьерных сайтах компаний - Авито, Сбер, Т-Банк
▫️ Geekjob
▫️ youngjunior.ru
Тебе больше не нужно выбирать, где сегодня искать работу.
Софи будет искать везде.
Доступ откроется 22 сентября.
Первые 3 дня - бесплатно.
Мест немного. Подпишись, чтобы не пропустить старт.
🔖 Бесплатная книга по теории графов
«Введение в теорию графов» Дарижа Гринберга — продвинутый материал с теоремами, алгебраическим подходом и большим количеством упражнений.
Читать можно бесплатно с ИИ-преподавателем.
⛓ Ссылка на книгу
tags: #полезное
➡ Data Scientist | Чат
🔖 Большая база по GPU и оптимизации AI-инференса
В подборке собраны материалы по CUDA, Roofline, FlashAttention, KV-cache, batching, quantization, MoE и оптимизации LLM-инференса.
Есть и свежие темы по Blackwell, CDNA 4, Trainium3 и будущим Rubin/CDNA 5.
⛓ Ссылка на GitHub
tags: #полезное
➡ Data Scientist | Чат
🔖 RL на чистом C: курс с полной реализацией
Вместо PyTorch и готовых фреймворков здесь берут чистый C и с нуля собирают систему для обучения с подкреплением.
В программе:
🫡 Автоматическое дифференцирование; 🫡 Матричные операции; 🫡 Policy Gradient; 🫡 Полный RL training pipeline; 🫡 Собственный фреймворк без высокоуровневых библиотек; 🫡 Симуляция игры «Змейка».⛓ Ссылка на курс tags: #полезное ➡ Data Scientist | Чат
🔖 Learning Mathematics — как перестать бояться математики
Автор объясняет, что математическое мышление — не врождённый талант, а навык, который развивается постепенно через практику, время и системную работу.
Полезное чтение для тех, кто прокачивает матбазу под Data Science и ML.
⛓ Ссылка на книгу
tags: #полезное
➡ Data Scientist | Чат
🔖 Как проверить AI-проект и не поверить красивому README
Archify построил схему реального репозитория и прошёл все девять встроенных проверок. Затем в схему добавили несуществующую PostgreSQL, ложную связь и ссылку на посторонний код — результат снова PASS, без ошибок и предупреждений.
Из этого эксперимента получился бесплатный чек-лист из 12 проверок: установка, повторный запуск, собственные данные и отрицательный сценарий. Он помогает понять, что действительно работает, а что пока подтверждено только описанием или демо.
⛓ Скачать PDF и посмотреть разбор → https://t.me/+Az1HBasH2FhjYmEy?erid=2W5zFJt9eyF
#полезное
🔖 Chrome DevTools прокачали под AI-агентов
Теперь агенты могут сами устанавливать расширения Chrome, запускать их и тестировать интерфейс через
chrome-devtools-mcp.
Внутри уже есть 5 инструментов для работы с расширениями: агент может делать скриншоты, кликать по интерфейсу и полностью автоматизировать UI-тесты.
⛓ Ссылка на GitHub
tags: #полезное
➡ Data Scientist | ЧатRepost from SberHealth ИТ
С днём ML-митапа!
Приглашаем на первый офлайн ML Meetup SberHealth в Москве. Будет онлайн-трансляция, так что можно присоединиться из любой точки.
16 сентября соберём в одном месте ML-инженеров, экспертов и всех заинтересованных!
В программе
🟣 Леонид Чесников — про то, как превратить n8n в основу AI-платформы и подключить к ней AI-агентов и MCP
🟣 Влад Гонта — про то, как собрать корпус русского медицинского текста, когда качественной разметки катастрофически не хватает
Приглашённые эксперты
🟣 Александр Кузнецов, MWS — про ModelOps и ежедневный скоринг 110+ моделей
🟣 спикер Альфа-Банка — про LLM-as-labeler и LLM-as-classifier: что делать с LLM, когда одного промпта уже недостаточно
И это ещё не всё!
На митапе будут также и наши эксперты, CDO и CIO СберЗдоровья⭐️
Подходи знакомиться, задавай вопросы и рассказывай свои кейсы, а наши чиллаут-активности создадут приятную атмосферу для непринужденного общения.
После основной программы – напитки, нетворкинг и DJ-сет от нашего юриста 🎧
Да, всё согласовано, легально и бесплатно🔥
📌 Москва (офлайн + онлайн)
📌16 сентября
✉️ 18:30
Приходите. Будем знакомиться, обсуждать ML и хорошо проводить вечер.
🔜 Регистрация и подробная информация по ссылке
📰 ИИ научили слушать «радио Судного дня»
Автор статьи собрал систему для автоматического мониторинга УВБ-76: RTL-SDR ловит эфир, Whisper превращает речь в текст, а Qwen анализирует сообщения и определяет ключевые слова.
Всё работает на Raspberry Pi 5 + домашнем K8s-кластере.
⛓️ Читать статью
tags: #статья
➡ Data Scientist | Чат
Мы живём в эру вайбкодинга 🤖
Каждый умник с интернетом теперь делает «сайты под ключ» и «бота для вашего бизнеса» за пару промптов в Claude.
Вот только цена за такие решения — безопасность. Если не хочешь ставить под удар свой бизнес, сайт или приложение — добро пожаловать в «Пакет безопасности». Это сильнейшее медиа в сфере кибербеза в Telegram.
Тут ты найдёшь внутрянку работы хакеров, способы применения ИИ в атаках и защите IT-инфраструктуры, а также множество полезных утилит и советов от безопасников.
ИИ-революция только началась. Дальше — больше. Подпишись и будь внимателен: @PackageSec
🔖 Парсим чеки в структурированные данные
Нашли инструмент, который извлекает данные из фотографий чеков с помощью LLM или Tesseract OCR.
На выходе получаем не просто распознанный текст, а структуру, которую уже удобно передавать в приложение, хранить в БД или использовать для аналитики.
⛓ Ссылка на GitHub
tags: #полезное
➡ Data Scientist | Чат
📰 Как заставить Whisper нормально летать на обычном CPU
Автору статьи надоела облачная диктовка — и он собрал WhisperType, который работает полностью локально на Windows.
Самое интересное — оптимизация под капотом: Whisper не гоняет пустые 30 секунд, начинает распознавать длинную речь ещё во время записи и подбирает потоки под CPU.
⛓️ Читать статью
tags: #статья
➡ Data Scientist | Чат
🔖База Computer Science от MIT
Нашли учебник Mathematics for Computer Science — про ту самую математику, на которой держатся алгоритмы и CS.
Логика, графы, комбинаторика, вероятность, индукция, рекуррентные соотношения и дискретные структуры — всё в одном месте.
⛓ Ссылка на учебник
tags: #полезное
➡ Data Scientist | Чат
📰 Как устроен AI-агент для КОМПАС-3D
Автор статьи собрал систему, которая умеет:
🫡 Принимать текст и изображения чертежей; 🫡 Писать Python-код для построения детали; 🫡 Создавать редактируемую параметрическую модель; 🫡 Смотреть на результат через VLM; 🫡 Находить визуальные ошибки и исправлять их; 🫡 Работать через собственную обёртку над COM API.По экспериментам автора, текстовое моделирование уже работает уверенно, а восстановление сложной геометрии по нескольким видам чертежа остаётся слабым местом. ⛓️ Читать статью tags: #статья ➡ Data Scientist | Чат
Участвуй в КосмоХакатоне 4–6 сентября, решай реальные космические кейсы, поборись за 1,2 млн ₽ и шанс попасть в финал в Москве!
С 4 по 6 сентября в Ростове-на-Дону пройдёт КосмоХакатон Южного и Северо-Кавказского федеральных округов — масштабное соревнование для тех, кто готов превратить данные о нашей планете в реальные технологические решения.
Один хакатон — два формата: участвовать можно очно в Ростове-на-Дону или онлайн из любой точки России. Все команды работают над едиными кейсами, оцениваются по одинаковым критериям и участвуют в общем рейтинге.
В рамках хакатона также пройдёт открытая лекция «Применение космических технологий для решения экологических задач» от Игоря Кожелина, CEO SR Data.
Призовой фонд — 1 200 000₽
Даты проведения: 4–6 сентября
Формат: онлайн и офлайн
Очная площадка: Центр развития предпринимательства «Новый Ростов», ул. Максима Горького, 151, 4 этаж.
🔗 Зарегистрироваться: https://космохакатон.рф
