Data Science Notes
Ir al canal en Telegram
Материалы по Data Science. Наши каналы: + Книги по Frontend – @frontend_textbooks + Книги по Python – @python_textbooks Куратор: @masha_goroshko
Mostrar más3 985
Suscriptores
Sin datos24 horas
-87 días
-3430 días
Archivo de publicaciones
3 985
Яндекс Игры пришли к нам с запросом:
SELECT *
FROM subscribers
WHERE channel_name = 'ds_notes'
AND technical_skills IN ('SQL', 'Airflow', 'MapReduce', 'DataLens')
AND data_driven_approach = true
AND analytical_mindset = true
AND years_of_experience >= 2
AND fit = true;
Ребята ищут аналитика в свою команду. Яндекс Игры посещают более 40 млн пользователей в месяц, поэтому можно проверять кучу гипотез на крупных выборках и экспериментировать.
ВАЖНО. Проверенные гипотезы не пойдут «в стол», а будут помогать команде принимать взвешенные решения и влиять на развитие продукта.
Если у тебя есть опыт работы с продуктами, аналитический склад ума и необходимые навыки, — это отличный шанс быстро вырасти и прокачаться на интересных задачах.
Описание вакансии здесь, но лучше сразу пишите рекрутеру и договаривайтесь о собеседовании: @danny_md13 985
Авито ищет опытных специалистов в Data Science
Если вы готовы решать реальные задачи с помощью ML-моделей полного цикла,, то это точно ваш шанс. В команде Авито вы сможете строить точные прогнозы, оптимизировать процессы и создавать инструменты, которые влияют на миллионы пользователей.
Присоединяйтесь к сильному комьюнити дата-сайентистов всего в три шага:
1. Подайте заявку до 1 октября
2. Решите тест
3. Пройдите интервью 5-6 октября
Откликайтесь и забирайте оффер!
3 985
Lamoda Tech Data Science meetup уже сегодня!
Подключайся к онлайн-трансляции встречи, на которой обсудим новые подходы к персонализации в поиске, каталоге и других продуктах, расскажем о применении машинного обучения в ценообразовании, а также поговорим о том, как оптимизировать ML-пайплайны и упростить работу дата сайентистов.
• Старт в 19:00 (по Москве)
• Ссылки на трансляцию VK и YouTube.
Присоединяйся, знакомься в чате с DS-коммьюнити и задавай вопросы спикерам 🔥
Реклама. ООО «Ламода Тех». ИНН 7734461512. Erid: 2VfnxvfmGKr
3 985
Появляется новый тип баз данных — делаем обзор! Дата-инженер из финтех-компании Точка Николай Мозганов расскажет, как пользоваться векторными базами данных для ML-задач. Если коротко: теперь в вектор можно превратить слова, предложения и даже звуки.
Читайте статью и задавайте вопросы в комментариях!
3 985
Вакансия Middle/Senior Data Scientist в команде Lamoda Tech
Создаем продукты, которые делают шопинг удобным и вдохновляющим. Результат — 17 млн. довольных пользователей ежемесячно и звание крупнейшей fashion & lifestyle платформы в России по версии Data Insight.
Ищем специалистов с опытом промышленной разработки моделей.
Стек технологий: Big data (Hadoop, PySpark, Hive), Python, Catboost, Airflow, Docker, SQL, PyTorch.
Как работаем: квартальное планирование по OKR, двухнедельные спринты, регулярные проектные встречи; развитое DS-сообщество; полный жизненный цикл разработки data-driven продуктов с применением ML. В части разработки онлайн-сервисов и деплоя моделей помогает команда инженеров.
Что еще интересного: гибрид; офис в Москве и коворкинг в СПб; организуем внутренние и внешние митапы; помогаем развивать личный бренд шопинг на Lamoda со скидками до 40%
Подробнее о вакансии
Реклама. ООО «Ламода Тех». ИНН 7734461512. erid:LjN8KBjcj
3 985
Бесконечное добро: стартует восьмая акция «IT-донор»
С 3 по 7 июня пройдёт восьмая неделя IT-донора. Это значит, что айтишники со всей России соберутся, чтобы сдать кровь и спасти тысячи жизней.
За годы существования акции «IT-донор»:
❤️ в проекте зарегистрировалось 4900 человек;
❤️собрали 720 литров крови и спасли более 3000 жизней;
❤️объединили 200 городов.
Чтобы присоединиться к акции, нужно зарегистрироваться через бот https://t.me/IT_donor_bot и с 3 по 7 июня сдать кровь или компоненты на станции в своём городе.
3 985
🫖 Как стать топовым Data-инженером?
Хотите развиваться в Data-инжиниринге, но не знаете, что для этого нужно?
Подключайтесь к вебинару от Слёрм «ИИ и инструменты Data-специалиста» и получите инсайдерские знания о том, как улучшить свои навыки и стать лидером в области обработки данных.
Когда? 27 мая в 19:00
➡ Зарегистрироваться
В программе:
- Вкатились в Data-инжиниринг. Что дальше?
- Управление знаниями: персональная Data-инженерная вики.
- Где и как рисовать диаграммы и схемы?
- Чат-боты и ChatOps: персональный помощник Data-инженера.
- Какие софт скиллы нужны Data-инженеру?
- Нужны ли Data-инженеру пет-проекты и участие в хакатонах?
- Как влиться в DE-комьюнити?
Спикеры:
Николай Марков, Data Platform Lead в компании Altenar, спикер курса Слёрма «Data-инженер», 11 лет опыта в разработке и проектировании.
Игорь Мосягин, Data-*разработчик в shrimpsizemoose AB, PhD по теоретической физике.
❓ А еще на вебинаре вас ждёт анонс нового и пока секретного проекта. Приходите, чтобы узнать подробности!
До встречи 27 мая!
➡ Регистрируйтесь в боте
Реклама ООО «Слёрм» ИНН 3652901451, erid: 2VtzquuNgKM
3 985
✅ Друзья, этой осенью в Москве состоится интересное событие: AiConf 2024 – первая прикладная тематическая конференция по Data Science.
Программа конференции будет строиться вокруг областей применения машинного обучения, а к выступлению приглашены не только спикеры из отраслей отраслей IT, Интернет и ECommerce, но и из отраслей реального сектора.
Основные темы конференции:
- работа со звуком
- компьютерное зрение и генерация изображений
- обработка естественного языка
- рекомендательные системы и поиск
- умные механизмы
- разработка агентов
- академические исследования
- оптимизация использования железа и др.
До 15 июня принимаются заявки на доклады. Есть чем поделиться - подавайте заявку на сайте https://cfp.aiconf.ru
А 23 мая в 18:00 мск приглашаем на встречу докладчиков с программным комитетом, где обсудим какие темы будут актуальны на AIConf. Встреча пройдет в онлайн формате, необходима регистрация (https://cfp.aiconf.ru)
Подробности о конфeренции AiConf 👉 https://aiconf.ru/2024
3 985
Data Science Digest: Latest Trends and Techniques | Exploring Cutting-Edge Developments in AI and Machine Learning (en) 2023
Статья посвящена последним тенденциям и техникам в области искусственного интеллекта и машинного обучения.
Появление GPT-4 знаменует собой значительный прорыв в области обработки естественного языка и понимания. Модель демонстрирует более тонкое понимание контекста и способность генерировать человекоподобные ответы с беспрецедентной точностью.
Большие данные и инженерия данных играют все более важную роль, обеспечивая возможность обработки больших объемов данных в режиме реального времени и получения ценных аналитических данных для ИИ-приложений.
Этические аспекты ИИ становятся все более важными, включая обеспечение справедливости, прозрачности и подотчетности ИИ-систем. Организации внедряют этические принципы на всех этапах разработки и внедрения ИИ.📌 Читать статью полностью #article #beginner
3 985
Is Fashion ML Profession?
Правильный ответ Lamoda Tech назовет на Data Science митапе 28 марта. Приходи обсудить ML-эксперименты и готовые решения «под капотом» крупнейшей модной платформы в России!
Раскроем все details: как адаптируем каталог под индивидуальный стиль пользователей, отвечаем на сложные запросы в поиске, подбираем образы на уровне стилистов и рекомендуем подходящие размеры.
Программа:
19:05 Data Science в Lamoda: особенности применения ML в Fashion E-commerce
Александр Желубенков, Head of Data Science
19:35 Рекомендация размера с помощью машинного обучения
Никита Чуркин, Teamlead of Personalisation
20:20 В поисках стиля: Deep Learning в fashion-индустрии
Илья Черников, Senior Data Scientist
Между выступлениями и после будем общаться за вкусными закусками и напитками, а еще поиграем в настольный теннис и кикер.
Ждем вас в нашем офисе или онлайн! Регистрация обязательна по ссылке
Реклама. ООО "Купишуз". ИНН 7705935687 . erid: LjN8KAU6d
3 985
A Whirlwind Tour of Python – Jake VanderPlas (en) 2016
Введение в основные возможности Python для исследователей и разработчиков, знакомых с программированием на других языках. Предназначен для использования в области науки о данных и научного программирования.
Материал распространяется по лицензии CC0 без ограничений для повторного использования, модификации и улучшения.
Читать
#book #middle
3 985
VK объявляет Hiring days для ML и Backend-разработчиков
Станьте частью Департамента AI или Дзена всего за два дня. Развивайте технологии искусственного интеллекта для ключевых продуктов VK, стройте единую платформу для рекомендаций и поиска контента и получайте опыт в команде профессионалов.
Отправить отклик можно до 15 февраля включительно.
3 985
Нашли хорошее и человеческое объяснение от дата-сайентиста из Точки о том, как работают алгоритмы CatBoost и LightGBM
Артур Сосновиков рассказал в статье на Хабре, что находится под капотом этих библиотек и в чём их особенности. Подробно, с примерами и формулами.
Будет интересно начинающим и тем, кто уже знает классический градиентный бустинг, а мидлам будет полезно для расширения кругозора. Ну и конечно тем, кто готовится к собесам и хочет произвести хорошее впечатление)
Читать статью на Хабре
3 985
Introduction to Data Science (en)
Эта open source книга представляет собой вводный курс в науку о данных. После прочтения вы сможете выполнять основные задачи DS специалиста. Предварительные знания R не требуются, хотя некоторый опыт программирования может быть полезным.
Читать
#book #beginner
3 985
Data Science Meetup (ru) 2023
Митап для Data Scientist'ов с докладами о хардовых и нетривиальных подходах от экспертов в инудстрии.
В программе:
🟡Contrastive Representation Learning: что это за технология и как её можно использовать бизнесу. Расскажет Тимур Кадыров, Senior Data Scientist СберМаркета.
🟡ANNA — первый AutoDL сервис в банках. Опытом поделится Демид Гаибов, Middle Data Scientist в Альфа-Банке.
🟡NBA — баскетбол с офферами. Как в него играть? Объяснит Тимур Джумакаев, DS Team Lead из МегаФона.
🗓Когда? 23 ноября в 19:30 по Москве
📍Где?
Зарегистрироваться на оффлан митап в офисе SberMarket Tech
Зарегистрироваться на онлайн митап
#meetup
3 985
Международная научная премия Yandex ML Prize (2023)
Yandex ML Prize — научная премия, которую компания присуждает за значимый вклад в развитие машинного обучения. На награду могут претендовать ML-исследователи и их наставники: преподаватели и научные руководители.
💡 Научные области. Премию можно получить за успехи в сфере информационного поиска, распознавания и синтеза речи, обработки естественного языка и машинного перевода, компьютерного зрения, работу с генеративными моделями.
💡 Страны. Заявки смогут подать исследователи и наставники из России, Беларуси, Казахстана, Азербайджана, Армении, Кыргызстана, Молдовы, Сербии, Таджикистана, Туркменистана, Узбекистана.
💡 Номинации. В Yandex ML Prize появились новые номинации. Теперь их пять: за первую публикацию, исследователям в обозначенных областях, молодым и опытным научным руководителям, а также преподавателям ML.
Лауреатов выбирает совет премии. В него входят исследователи из Яндекса и представители научного сообщества. Помимо денежного приза, Яндекс предоставляет лауреатам доступ к сервисам Яндекс 360 и выдаёт грант на использование платформы Yandex Cloud — с её помощью можно выполнять объёмные вычисления и обрабатывать данные экспериментов. В этом году размер гранта на облачные вычисления увеличен до 500 тысяч рублей.
Заявки от соискателей принимаются на сайте премии до 16 октября.
Читать подробнее
#award #ml #middle
3 985
А вы хотите успешно пройти собеседование на аналитика? 🚀
📣 Всем привет! Хотим пригласить вас на бесплатный 5-дневный марафон-подготовку к собеседованиям на позицию аналитика данных!
🗓 Марафон начнется 14 сентября!
Для кого наш марафон?
👉 Для всех, кто хочет повысить свои шансы на успешное прохождение собеседований на аналитика данных.
👉 Для тех, кто уже сталкивался с провальными собеседованиями и тестированиями и хочет избежать таких ошибок в будущем.
Почему стоит присоединиться к нашему марафону? 💡
◾️ Получите ценную информацию об оценке своих навыков.
◾️ Разберетесь с техническими вопросами, которые могут вас ожидать на собеседованиях.
◾️ Узнаете секреты успешного прохождения собеседований в ТОП-компании.
◾️ Овладеете навыками создания идеального резюме.
◾️ Прорешаете реальные тестовые задания.
Присоединяйтесь к нашему марафону и покажите всем, что вы готовы стать настоящим профессионалом в аналитике данных! 💪💼
🔗 Записаться на марафон здесь
Реклама. ООО АЙТИ РЕЗЮМЕ. Erid: LjN8KEWAr
3 985
☄️Открытый урок по языковым моделям от OTUS
4 сентября в 18:00 мск встречаемся на открытом уроке «Языковые модели: от статистических до ChatGPT» в рамках курса «Natural Language Processing (NLP)» от OTUS.
📣 Кому подходит этот урок:
- Практикующим Data Scientist и IT-специалистам, которые хотят глубже погрузиться в область NLP
- Тем, кто хочет узнать, что делает ChatGPT таким умным
- Людям, освоившим основы машинного обучения, но желающими развиваться в области DS
💪 Результаты урока:
Вы узнаете, что такое языковые модели и как их использовать для решения NLP-задач, а также изучите подходы к обучению больших языковых моделей, таких как ChatGPT.
Это отличная возможность совершенно бесплатно протестировать формат обучения и задать преподавателю любые вопросы в режиме реального времени 😎!
Пройдите тестирование курса, чтобы зарегистрироваться на урок - https://otus.pw/ROAD/
Нативная интеграция. Информация о продукте www.otus.ru
3 985
👉 Запустите собственную LLM, представленную на HuggingFace!
Уже сегодня в 20:00 мск на открытом уроке в OTUS мы обсудим что такое большая языковая модель, какие есть предобученные модели.
🔹 Поработаем с API ChatGPT, запустим предобученную RuGPT3.
🔹 Посмотрим примеры работы с подходами Zero-shot, Few-shot.
🔹Обсудим, как можно дообучать LLM на небольших видеокартах с помощью LORA модификаторов.
Вебинар приурочен к старту онлайн-курса «Machine Learning. Professional» в OTUS
📌 Результаты урока:
Вы узнаете как работать с API ChatGPT, запускать собственную LLM, представленную на HuggingFace, работать с LORA модификаторами моделей
👉 РЕГИСТРАЦИЯ
https://otus.pw/OwuT/
Нативная интеграция. Информация о продукте www.otus.ru
3 985
💣 Научитесь создавать рекомендательные системы для контента
📌 Приходите 24 августа в 20:00 (мск) на открытый урок «Векторизация текстов для практических задач» в рамках курса «Natural Language Processing» от OTUS!
✅ Что будем делать:
— Обсудим, как можно получать векторы текстов и использовать их в практических целях;
— Узнаем, как быстро сделать рекомендательную систему для текстов;
— Рассмотрим похожие статьи на основе тематического моделирования, экстрактивной суммаризации и векторизации FastText;
— Поищем похожие товары на основе векторизации TF-IDF;
— Обсудим векторизацию текстов архитектурой BERT.
👉 В результат вы узнаете, как эффективно подбирать похожие по смыслу и тематике тексты.
💻 Успейте зарегистрироваться по ссылке https://otus.pw/E9oF/ , количество свободных слотов на регистрацию ограничено.
Нативная интеграция информация о продукте www.otus.ru
