fa
Feedback
Data Science | Тесты

Data Science | Тесты

رفتن به کانال در Telegram

Сайт: https://easyoffer.ru/ Все каналы: t.me/+xGeAw6ckJ4liYzQy Контакт для рекламы: @easyoffer_adv

نمایش بیشتر
2 654
مشترکین
-124 ساعت
+27 روز
-630 روز
آرشیو پست ها
🤔 Какой метод машинного обучения используется для кластеризации данных на основе иерархической структуры?
Anonymous voting

🤔 Как решить задачу, где присутствует одновременно два target – один categorical, другой continuous? Используются модели multi-output, которые обучаются на несколько целевых переменных, например, через отдельные выходные слои в нейросети. Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой метод используется для балансировки несбалансированных данных?
Anonymous voting

🤔 Чем отличается итератор от генератора? Итератор — это объект с методами iter и next, позволяющий поочерёдно перебирать элементы. Генератор — это удобная форма итератора, создаваемая функцией с использованием yield, которая сохраняет своё состояние между вызовами. Итераторы требуют ручной реализации, а генераторы упрощают создание итераций. Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой метод уменьшает переобучение, ранняя остановка обучения при ухудшении ошибок?
Anonymous voting

🤔 Какой метод уменьшает переобучение, исключая случайные нейроны?
Anonymous voting

Пожизненный PRO доступ на easyoffer — по цене одного года! До 2 сентября вы можете купить PRO навсегда. Покупаешь один раз — пользуешься всю жизнь. – База вопросов и задач из собеседований – Примеры видео-ответов на вопросы – Записи реальных собеседований – Тренажеры "Проработка вопросов" и "Реальное собеседование" – Аналитика требований из вакансий – Автоотклики на вакансии – Агрегатор вакансий (скоро) 👉 Купить PRO со скидкой 70%: https://easyoffer.ru/pro

🤔 Что такое мультиколлинеарность? Это ситуация, когда признаки сильно коррелируют друг с другом. - Это вызывает нестабильность линейных моделей, так как коэффициенты могут становиться большими и неинтерпретируемыми. - Решения: удаление зависимых признаков, PCA, L1-регуляризация (Lasso). Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой метод уменьшает смещение в ансамблевом обучении?
Anonymous voting

🤔 Какие магические методы в python знаешь? Магические методы в Python — это специальные методы, которые начинаются и заканчиваются двойным подчеркиванием. Примеры включают `__init__` (конструктор класса), `__str__` (представление объекта в виде строки), `__len__` (возвращает длину объекта) и `__getitem__` (обращение к элементам по индексу). Также есть методы, такие как `__add__` для перегрузки операторов и `__call__`, позволяющий объекту вести себя как функция. Эти методы позволяют кастомизировать поведение объектов Python. Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой алгоритм используется для уменьшения дисперсии ансамбля моделей?
Anonymous voting

🤔 Какой метод кластеризации наиболее устойчив к выбросам?
Anonymous voting

🤔 Почему считается, что случайный лес не переобучается? Считается, что случайный лес не склонен к переобучению, потому что он усредняет предсказания большого количества деревьев решений, каждое из которых обучается на случайной подвыборке данных и случайных признаках. Этот процесс помогает уменьшить влияние отдельных переобученных деревьев на финальное предсказание. В результате модель становится более устойчивой к ошибкам и шуму в данных. Кроме того, случайный лес не сильно зависит от малозначимых признаков, так как случайные выборки уменьшают их влияние. Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой метод используется для уменьшения размерности данных, сохраняя максимальную вариативность?
Anonymous voting

🤔 В чем разница между L1 и L2 регуляризацией? L1-регуляризация (Lasso) добавляет сумму модулей весов к функции потери, склоняя веса к нулю, что способствует разреженности. L2-регуляризация (Ridge) добавляет сумму квадратов весов, уменьшая их величину, но не зануляя. L1 эффективна для отбора признаков, а L2 — для стабилизации модели и борьбы с переобучением. Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой метод оптимизации используется для поиска глобального минимума функции потерь, комбинируя преимущества градиентного спуска и моментума?
Anonymous voting

🤔 Как оценивать эффективность работы рекомендательных моделей? Используются метрики: 1. Precision@K и Recall@K для точности и полноты рекомендаций. 2. NDCG для оценки релевантности на основе позиций элементов. 3. Coverage — доля уникальных рекомендованных элементов. 4. Оценка на основе A/B-тестов или пользовательских метрик, таких как удержание. Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какой метод машинного обучения используется для задач классификации, когда данные содержат как числовые, так и категориальные признаки?
Anonymous voting

🤔 Что известно о ML дизайне? ML-дизайн включает выбор модели, структуры данных, метрик и процесса обучения для конкретной задачи. Важные аспекты: • Постановка задачи (классификация, регрессия, кластеризация). • Подготовка данных (очистка, масштабирование, выделение признаков). • Выбор и настройка модели, а также оптимизация гиперпараметров. • Оценка результатов (использование метрик качества и валидации). Ставь 👍 если знал ответ, 🔥 если нет Забирай 📚Базу Знаний

🤔 Какие алгоритмы наиболее подходят для обработки текста?
Anonymous voting