🏄 Соревновательный Data Science | Kaggle | Чемпионаты
رفتن به کانال در Telegram
Соревновательный Data Science - сообщество тех, кто побеждает или только учится побеждать в ML чемпионатах👨💻 Наш курс на Stepik: https://stepik.org/a/108888 Чат: https://t.me/+UeIeCRykqYEwY2Y6 Для предложений и вопросов: @Aleron_1
نمایش بیشتر3 398
مشترکین
-324 ساعت
-87 روز
+2030 روز
آرشیو پست ها
Ай, ладно на эти акции Степика на 14%
Ловите подгончик от нас
Промокод ALERON на 35% на сутки.
Как раз успеете обдумать все и начать до 1 августа.
Прочитай это до конца если тебе приелись хакатоны и чемпионаты по Data Science.
Привет, это пост я, Алерон, пишу именно для тех, кто давно уже забросил идею соревнований.
Да, рано или поздно хобби участвовать в чемпионатах по машинному обучению может уйти на второй план.
Я знаю это по своему опыту. Кто-то доходит до заветного титула и бросает. Кто-то бросает еще раньше. Это нормально. Я и мои со-авторы убеждены, что опыт и навыки важнее, чем медали на Kaggle. Да?
Соревнования это классный опыт прокачиваться с острым чувством азарта. Медали это всего лишь элемент геймификации.
Но это не единственный способ интересно и полезно применять свои технические навыки вне работы. Есть еще кое-что…
Если закончили наш курс или давно работает в роли DS, DA, DE или MLE, то у вас вполне достаточно навыков чтобы «поиграть» в другие игры.
Игры, где число попыток не ограниченно, а вместо медалей настоящие деньги.
И нет!! Мы не про казино (не дай бог), я про запуск своих личных IT проектов и здоровое предпринимательство.
Я заметил, что люди, умеющие побеждать в чемпионатах, как правило, хорошо чувствуют себя, конкурируют в технологиях и трафике на рынке IT решений (микро-SaaS и SaaS).
Уже год как я ушел из найма из занимаюсь только своими проектам. Так мне удалось сделать неплохой экзит из проекта, а потом запустить еще 2 технологичный SaaS решения.
Причем достаточно успешных. Недавно мне даже дали оценку в 60М на 4-й месяц от первого платящего клиента.
Как и всегда, я свободно делюсь своими знаниями и лайфхаками с другими в рамках здравого смысла. А недавно я запустил интенсив для технарей, кто регулярно что-то свое пилит, но никогда не хватает сил дотащить проект до оплат/выручки из-не достатка знаний в digital маркетинге.
Маркетинг - это действительно бывает непросто. Нас этому не учат в ВУЗе. Поэтому именно на это и будет сделан упор в курсе.
Я на примерах своего опыта или друзей соавторов научу находить и быстро проверять идеи, за которые люди хотят платить. И легко расстаются с деньгами. Да еще и остаются благодарны вам за решение.
Преврати пет-проект в микро-SaaS с первой выручкой за 3 месяца
Кейс моих результативных выпускников можно почитать в @datafeelnig
А если вам уже стало интересно, то до конца июня Степик раздал скидухи, забирайте)
Тем кому все еще интересен соревновательный DS, то с вами мы продолжим делиться полезными материалами и актуальными чемпионатами.
Прочитай это до конца если тебе приелись хакатоны и чемпионаты по Data Science.
Привет, это пост я, Алерон, пишу именно для тех, кто давно уже забросил идею соревнований.
Да, рано или поздно хобби участвовать в чемпионатах по машинному обучению может уйти на второй план.
Я знаю это по своему опыту. Кто-то доходит до заветного титула и бросает. Кто-то бросает еще раньше. Это нормально. Я и мои со-авторы убеждены, что опыт и навыки важнее, чем медали на Kaggle. Да?
Соревнования это классный опыт прокачиваться с острым чувством азарта. Медали это всего лишь элемент геймификации.
Но это не единственный способ интересно и полезно применять свои технические навыки вне работы. Есть еще кое-что…
Если закончили наш курс или давно работает в роли DS, DA, DE или MLE, то у вас вполне достаточно навыков чтобы «поиграть» в другие игры.
Игры, где число попыток не ограниченно, а вместо медалей настоящие деньги.
И нет!! Мы не про казино (не дай бог), я про запуск своих личных IT проектов и здоровое предпринимательство.
Я заметил, что люди, умеющие побеждать в чемпионатах, как правило, хорошо чувствуют себя, конкурируют в технологиях и трафике на рынке IT решений (микро-SaaS и SaaS).
Уже год как я ушел из найма из занимаюсь только своими проектам. Так мне удалось сделать неплохой экзит из проекта, а потом запустить еще 2 технологичный SaaS решения.
Причем достаточно успешных. Недавно мне даже дали оценку в 60М на 4-й месяц от первого платящего клиента.
Как и всегда, я свободно делюсь своими знаниями и лайфхаками с другими в рамках здравого смысла. А недавно я запустил интенсив для технарей, кто регулярно что-то свое пилит, но никогда не хватает сил дотащить проект до оплат/выручки из-не достатка знаний в digital маркетинге.
Маркетинг - это действительно бывает непросто. Нас этому не учат в ВУЗе. Поэтому именно на это и будет сделан упор в курсе.
Я на примерах своего опыта или друзей соавторов научу находить и быстро проверять идеи, за которые люди хотят платить. И легко расстаются с деньгами. Да еще и остаются благодарны вам за решение.
Преврати пет-проект в микро-SaaS с первой выручкой за 3 месяца
Кейс моих результативных выпускников можно почитать в @datafeelnig
А если вам уже стало интересно, то до конца июня Степик раздал скидухи, забирайте)
Тем кому все еще интересен соревновательный DS, то с вами мы продолжим делиться полезными материалами и актуальными чемпионатами.
Прочитай это до конца если тебе приелись хакатоны и чемпионаты по Data Science.
Привет, это пост я, Алерон, пишу именно для тех, кто давно уже забросил идею соревнований.
Да, рано или поздно хобби участвовать в чемпионатах по машинному обучению может уйти на второй план.
Я знаю это по своему опыту. Кто-то доходит до заветного титула и бросает. Кто-то бросает еще раньше. Это нормально. Я и мои со-авторы убеждены, что опыт и навыки важнее, чем медали на Kaggle. Да?
Соревнования это классный опыт прокачиваться с острым чувством азарта. Медали это всего лишь элемент геймификации.
Но это не единственный способ интересно и полезно применять свои технические навыки вне работы. Есть еще кое-что…
Если закончили наш курс или давно работает в роли DS, DA, DE или MLE, то у вас вполне достаточно навыков чтобы «поиграть» в другие игры.
Игры, где число попыток не ограниченно, а вместо медалей настоящие деньги.
И нет!! Мы не про казино (не дай бог), я про запуск своих личных IT проектов и здоровое предпринимательство.
Я заметил, что люди, умеющие побеждать в чемпионатах, как правило, хорошо чувствуют себя, конкурируют в технологиях и трафике на рынке IT решений (микро-SaaS и SaaS).
Уже год как я ушел из найма из занимаюсь только своими проектам. Так мне удалось сделать неплохой экзит из проекта, а потом запустить еще 2 технологичный SaaS решения.
Причем достаточно успешных. Недавно мне даже дали оценку в 60М на 4-й месяц от первого платящего клиента.
Как и всегда, я свободно делюсь своими знаниями и лайфхаками с другими в рамках здравого смысла. А недавно я запустил интенсив для технарей, кто регулярно что-то свое пилит, но никогда не хватает сил дотащить проект до оплат/выручки из-не достатка знаний в digital маркетинге.
Маркетинг - это действительно бывает непросто. Нас этому не учат в ВУЗе. Поэтому именно на это и будет сделан упор в курсе.
Я на примерах своего опыта или друзей соавторов научу находить и быстро проверять идеи, за которые люди хотят платить. И легко расстаются с деньгами. Да еще и остаются благодарны вам за решение.
Преврати пет-проект в микро-SaaS с первой выручкой за 3 месяца
Кейс моих результативных выпускников можно почитать в @datafeelnig
А если вам уже стало интересно, то до конца июня Степик раздал скидухи, забирайте)
Тем кому все еще интересен соревновательный DS, то с вами мы продолжим делиться полезными материалами и актуальными чемпионатами.
Открыли регистрацию на E-CUP 2026 Students 🎓
В этом сезоне — только для студентов. Будет интересно тем, кто изучает ML / DS / big data / аналитику данных.
Сможете ускорить модель по поиску дубликатов на 20%? Получится создать классификатор для модерации товаров? Сумеете предсказать поведение покупателя?
Как минимум — попробуете и получите фидбэк от тех, кто делает это в Ozon Tech каждый день. Как максимум — разделите призовой фонд в 7 200 000 ₽ в торжественной атмосфере конференции E-CODE.
Нетривиальные задачи, нетворк с ведущими специалистами индустрии, кастомный мерч и шанс масштабно усилить портфолио — это про E-CUP 2026 Students.
Больше подробностей и регистрация ↩️
Открыли регистрацию на E-CUP 2026 Students 🎓
В этом сезоне — только для студентов. Будет интересно тем, кто изучает ML / DS / big data / аналитику данных.
Сможете ускорить модель по поиску дубликатов на 20%? Получится создать классификатор для модерации товаров? Сумеете предсказать поведение покупателя?
Как минимум — попробуете и получите фидбэк от тех, кто делает это в Ozon Tech каждый день. Как максимум — разделите призовой фонд в 7 200 000 ₽ в торжественной атмосфере конференции E-CODE.
Нетривиальные задачи, нетворк с ведущими специалистами индустрии, кастомный мерч и шанс масштабно усилить портфолио — это про E-CUP 2026 Students.
Больше подробностей и регистрация ↩️
Привет, Чемпионы! 👋
На Stepik стартовала распродажа курсов по ИИ.
А у нас, как раз, много таких (скидка от 20% до 1 августа):
• 🛡 AI Security - самый свежий 🆕
• 🏆 Соревновательный DS - проверенная классика
• 🧠 LLM-курс - свой сервис с AI
• 🏄♀️ Vibe-кодинг - хайп
• 🛠 ML-инструменты - антихайп)
• 🤖 ИИ-АГЕНТЫ и автоматизация с n8n - практикум по быстрой разработке систем с ИИ под капотом.
• 👉 Claude Code для НЕпрограммистов - тот самый курс по автоматизации ежедневной рутины.
👆 Скидки сработают только по этим ссылкам
Привет, Чемпионы! 👋
На Stepik стартовала весенняя распродажа курсов по ИИ.
А у нас, как раз, много таких (скидка от 20%):
• 🛡 AI Security - самый свежий 🆕
• 🏆Соревновательный DS - проверенная классика
• 🧠 LLM-курс - свой сервис с AI
• 🏄♀️ Vibe-кодинг - хайп
• 🤖 ИИ-АГЕНТЫ и автоматизация с n8n - практикум по быстрой разработке систем с ИИ под капотом.
• 👉 Claude Code для НЕпрограммистов - тот самый курс по автоматизации ежедневной рутины.
👆 Скидки сработают только по этим ссылкам.
Repost from N/a
Привет, редтимеры! 🚩
🤖 AI Agent Security: месяц борьбы не с моделями, а со скорером.
Продолжается одно из самых необычных соревнований на Kaggle от OpenAI: AI Agent Security - Multi-Step Tool Attacks.
Главный инсайт: это соревнование не столько про лучший джейлбрейк, сколько про победу над Kaggle-скорером.
На бумаге задача звучит просто: написать attack.py, который атакует LLM-агента с инструментами, находит уязвимые цепочки и возвращает воспроизводимые AttackCandidate.
На практике ты воюешь сразу с тремя вещами:
1. моделью;
2. гардрейлом;
3. официальным скорером, который может убить весь сабмит после нескольких часов расчета.
И вот третий пункт оказался самым жестким боссом.
🎯 Что реально работает?
Самый стабильный путь сейчас - не сложные многоходовые атаки, а быстрые и воспроизводимые tool-call атаки.
Главная рабочая механика:
- заставить агента сделать
http.post;
- передать в data скоринговый маркер;
- менять URL/домены/пути так, чтобы получать новые score cells;
- возвращать только те кандидаты, которые реально сработали во время live exploration.
То есть выигрывает не самый «хакерский» промпт, а тот, кто лучше управляет плотностью: сколько валидных атак можно посадить в лимиты времени.
🚀 Подходы, которые выстрелили:
Live-fill.
Алгоритм не просто генерирует заранее 1000 промптов. Он прямо во время run() взаимодействует со средой, проверяет, сработала ли атака, и возвращает только successful candidates.
Template race.
Берем несколько коротких шаблонов атаки, прогоняем пробные запросы, смотрим, какой шаблон быстрее и надежнее на текущей модели, потом заполняем оставшееся время лучшим вариантом.
Replay-safe sizing.
Самая важная инженерная часть. Скорер потом заново replay-ит все кандидаты. Если вернуть слишком много даже рабочих атак, сабмит может умереть с Submission Format Error. Поэтому нужно считать не только генерацию, но и будущую стоимость replay.
One-turn exfil density.
Многоходовые атаки красивее и локально могут давать жирный score, но на официальном Kaggle часто не проходят replay budget. Сейчас короткие одношаговые атаки часто выгоднее, потому что их можно посадить больше.
🧨 Что работает хуже, чем хотелось:
Мультитёрн сценарии, indirect prompt injection, logic puzzles, давление в стиле «я админ», JSON-маркеры, языковые варианты, эмодзи, опечатки - всё это интересно и иногда стреляет в локальной валидации.
Но главная проблема: официальный скоринг жестко наказывает за дорогие цепочки. Даже если атака успешная, она может быть слишком тяжелой. А один тяжелый сабмит может несколько часов считаться и в конце упасть без score.
😵💫 Главная боль соревнования:
`Submission Format Error` не значит, что у тебя неправильный CSV.
Очень похоже, что под этим сообщением скрываются:
- timeout replay-фазы;
- слишком много кандидатов;
- слишком дорогие многоходовые цепочки;
- нестабильность hosted evaluator;
- несовпадение локальной валидации и реального Kaggle replay.
- и ещё множество догадок в дискашенах, но никаких объяснений от каггл стафф.
То есть можно иметь локально отличный score, отправить сабмит, ждать несколько часов и получить просто пустой результат.
📈 Сейчас топовые решения сходятся к одной идее:
Побеждает не самый крутой ркдтимер, а тот, кто аккуратнее балансирует:
- latency;
- replay budget;
- число кандидатов;
- уникальность score cells;
- стабильность на GPT-OSS и Gemma.
Это уже почти не prompt engineering, а performance engineering для атакующего алгоритма.
🧠 Что по итогу:
AI Agent Security не сорева про LLM-безопасность, а инженерная задача на границе red-teaming, системного дизайна и оптимизации под странный evaluator.
Модель можно пробить.
Гардрейл можно обойти.
Но настоящий финальный босс - это пройти скорер и не умереть через 6 часов с Submission Format Error.
Если хотите решать агентами - Фабла и Сол сразу всё рефьюзят, даже если пишешь им, что это официальная сорева от OpenAI (проверил за вас - не благодарите)
Остался месяц - самое время подключиться, основные шишки уже набили за вас.
Решаете или планируете приступить???Привет, Чемпионы! 🏆
Курс по AI-security полностью выложен на Stepik. 🚩
🤚 Все 5 модулей, точнее 5 компаний, которые нанимают вас к себе, чтобы пошатать своих продакшен-ботов на уязвимости и предложить меры защиты.
Можно пройти путь от простых промпт-иньекций до полной разведки и взлома мультиагентной системы.
И всё это без кода и полностью в интерфейсе Stepik.
Курс прошел ревью от экспертов в области из компаний Positive Technologies и HiveTrace, и уже собрал несколько положительных отзывов от студентов.
🪪 Дошедшим до конца прилагается сертификат от компании HiveTrace.
До четверга 23.07 курс можно приобрести по прежней цене и с промокодом DATAFEELING.
Сработает по этой ссылке.
Привет, Чемпионы! 🏆
На неделе закончился нейргольф на Каггл.
Что интересного:
Во-первых, все топ-команды рассказали, что пользовали всех возможных агентов в хвост и в гриву. И самое сложное было - это заставить агента не лениться, а искать решение (сталкивались с таким? - я постоянно). И главное было заставить агента не тюнить существующие, а искать новый алгоритм решения для задачи, чего он делать упорно не хотел.
Пока про слитые бюджеты не распространяются.
Второе, это конечно как чел сначала прям в каггл-датасете предлагал купить серебряный сабмит за битки (см. скриншот), а ближе к концу стал угражать что обрушит серебряную зону, если не заплатят выкуп опять же в битках )) (что вроде и случилось)
Интересно, что и датасет и дискашены с угрозами до сих пор висят на каггле и никто их не затер.
Вот такие дела.
Участвовали в нейрогольфе? Как успехи?
🔥 Бесплатная магистратура «Облачные технологии» от МТС х ФПМИ — возможность войти в одно из самых востребованных ИТ-направлений и получить практический опыт в инженерии облачной инфраструктуры уже во время учебы!
Подробнее о программе — в карточках.
⚡️ Отправляйте заявку и развивайтесь в перспективной индустрии вместе с лидерами рынка: https://vk.cc/cZrrsl
Привет, Чемпионы! 🏆
NVidia выкатили вот такую штуку для Клод-кагглинга.
Выглядит интересно 👀
Кто-нибудь уже гонял?
Repost from Олимпиадное комьюнити ЦУ
+5
PvP на Kaggle: как побеждать, если вместо датасета боты должны захватывать планеты ⭐️
Недавно на Kaggle прошли Orbit Wars — ML-соревнования, где участники обучали ботов захватывать планетарную систему, сражаясь друг с другом в реальном времени.
4 июля в 19:00 пройдет разбор игры от:
⚫️ Дмитрия Руденко — kaggle-мастера и автора канала @pseudolabeling;
⚫️ Ярослава Пудовкина — студента Центрального университета и участника Orbit Wars.
Спикеры разберут лучшие решения и идеи победителей и покажут, какие подходы реально работают в RL-задачах, а также расскажут о том, как мыслят топовые ML-инженеры и какие решения приводят к победе.
▶️ Подключайтесь, если хотите понимать, что сегодня двигает Kaggle, а завтра — всю ML-индустрию.
Repost from adapt compete evolve or die
Ну и последнее про CAFA 6.
Антон запилил writeup на наше второе место в CAFA6 с ссылкой на github. Нет 100% уверенности, что там все работает идеально, но мы старались.
Если читать отчет первого места , то там ключевая идея, что они пошли дальше в анализе литературы: использовали вообще всю доступную литературу о белках, а не только тех, что использовались в соревновании, искали семантически близкие к соревновательным и использовали их функции как признаки для целевых. я тоже думал об этом! буквально несколько минут 😂 потому что я решил, что это очень сложно сделать такой инструмент, даже граббер не так прост. Однако, ребята с первого места работают в лабе, которая на этом специализируется, так что у них есть наработки наверняка, жаль, что не делятся как мы.
Третье место во многом воспроизводит наше решение прошлого года, но все равно открытые решения это здорово, однако сам я никогда не решаюсь, респект Антону еще раз, что он драйвит эту активность.
Новый ML/RL-хакатон по рыночным данным с призовым фондом $5,000
Команда Reinforce.fi (ex-Overnight.fi) запускает соревнование по построению модели принятия решений на рынке.
Задача отличается от классического прогнозирования временных рядов.
Участникам предстоит выбрать одно из 10 возможных действий (A1–A10) для каждого состояния рынка и максимизировать итоговую прибыль стратегии.
Данные:
• реальные рыночные данные с анонимизированными признаками
• последовательности длиной 1000 шагов
• различные рыночные режимы и временные периоды
• train и validation датасеты в формате Parquet
Метрика:
Score = суммарный PnL по всем принятым решениям.
Что может пригодиться:
• Reinforcement Learning
• Time Series Forecasting
• Sequential Models
• Transformers
• Decision Making Algorithms
• Ensemble-подходы
Призы:
1️⃣ $2,500
2️⃣ $1,500
3️⃣ $1,000
Финал соревнования:
Топ-10 участников лидерборда предоставляют код или ноутбук для проверки на скрытом датасете. Финалисты презентуют свои решения команде Reinforce.fi онлайн или офлайн.
Старт соревнования — конец июня 2026 года (продолжительность — около 1.5–2 месяцев).
Telegram-чат участников:
https://t.me/+R6lMJ10VXP5hOTI0
Регистрация и подробные условия
Привет, Чемпионы! 🏆
🤖 AI Agent Security - Multi-Step Tool Attacks: Почувствуй себя хакером в мире LLM-агентов! 🎯
На Kaggle стартовало, пожалуй, самое долгожданное соревнование для специалистов по AI Safety и ИИ-безопасности. Организаторы не абы кто, а OpenAI, Google, IEEE и WCCI. Вместо привычного тюнинга бустингов или классификации картинок нам предлагают заняться алгоритмическим ред-тимингом и взломать умных ИИ-агентов, использующих внешние инструменты.
Это НЕ конкурс на написание единичных «джейлбрейков» вручную. Задача гораздо глубже: нужно написать автоматический алгоритм атаки, который заставит агента совершить цепочку деструктивных действий.
В чем суть задачи?
Современные агенты умеют читать файлы, лазить в интернет, отправлять email-ы и делать HTTP-запросы. Но что, если во входящем письме или на веб-странице спрятана инструкция, которая заставит агента прочитать secret.txt, вытащить оттуда SECRET_API_KEY и отправить его на сторонний сервер через http.post?
Ваш алгоритм (attack.py) будет помещен в Gym-style среду. Ему предстоит взаимодействовать с изолированным агентом (тестировать будут на GPT-OSS и Gemma 4), искать многошаговые уязвимости и выдавать воспроизводимые цепочки промптов, которые пробивают гардрайлы (guardrails).
🚀 Что здесь может сработать:
Reinforcement Learning (RL) и MCTS. Поиск цепочки атак - это, по сути, исследование графа состояний. Алгоритмы вроде Monte Carlo Tree Search (MCTS) или Q-learning могут помочь эффективно искать траектории, которые шаг за шагом сдвигают контекст агента в сторону опасного действия.
Пакетные итеративные промпты (Prompt Injection Frameworks). Агенты «ломаются» на стыке контекстов. Использование техник Indirect Prompt Injection (когда вредоносный текст подсовывается через web.search или mail_seed.json) - ключ к успеху. Нужно заставить агента самого прочитать ваш скрытый промпт при выполнении легитимной задачи.
Анализ трейсов (Trace Analysis). Среда возвращает логи вызовов инструментов. Напишите парсер логов (отслеживайте fs.read, email.read), чтобы ваш алгоритм атаки динамически адаптировался: если агент прочитал нужный файл, следующий шаг атаки должен подтолкнуть его к вызову http.post.
Генерация состязательных суффиксов (Adversarial Optimization). Атаки на основе градиентов или генетических алгоритмов для подбора таких токенов, которые максимизируют вероятность вызова агентом запрещенной функции, несмотря на системные промпты защиты.
📅 Дедлайн:
Прием решений открыт до конца августа 2026 года. Призовой фонд: $50,000, но Solo Gold и статус главного кошмара для ИИ-безопасности OpenAI стоят гораздо дороже!
🔗 Ссылка на соревнование:
https://www.kaggle.com/competitions/ai-agent-security-multi-step-tool-attacks
Для кого эта тема в новинку, предлагаем быстро погрузиться на нашем практическом курсе по AI Security 🚩. (промокод в комментах)
Кто готов заняться легальным хакингом фронтирных моделей? Обсуждаем векторы атак в комментариях! 👇
Напоминалка, что распродажа завтра заканчивается!!! 🏃♀️➡️
Тренировки по ML
➖➖➖➖➖➖
6️⃣ июня состоится семнадцатая встреча в рамках тренировок по машинному обучению ❤️
Что будет на встрече:
⚪️Orbit Wars как первое RL соревнование на Kaggle в эпоху coding agents
📢 Спикер: Дмитрий Руденко, Kaggle Competition Master, самый активный участник соревновательного сообщества. Автор @pseudolabeling
📆 Когда: 6 июня в 18:10
🗺️ Где: онлайн ❤️ ссылка на подключение
Подробнее про челленджи 🐭
По организационным вопросам вы можете обращаться к Марии ↩️
#анонсы #студенты #ии
