DATApedia | Data science
Open in Telegram
Тут вы найдете всё, что связано с Data Science, AI и Machine Learning, как для начинающих, так и для бывалых специалистов. Также, для вас, мы переводим зарубежные статьи. Сотрудничество: @Seyfme
Show more3 309
Subscribers
No data24 hours
-57 days
-3230 days
Posts Archive
Чем занимаются дата-сайентисты в Авито? Узнайте изнутри!
Статья от команды Data Science в Авито рассказывает о реальных кейсы, проектах и командах, которые развивают бизнес и обеспечивают безопасность платформы:
➡️ Как алгоритмы автомодерации проверяют миллионы объявлений.
➡️ Какие подходы используются для борьбы с мошенничеством.
➡️ Как работают персонализированные рекомендации и поиск.
➡️ Какие проекты ведет AI Lab в Авито.
Все о мире DS в Авито и многое другое ➡️ по ссылке.
Реклама. ООО «Авито Тех».
Разбираем тестовое задание на позицию Junior Аналитика в Яндекс.
Чтобы найти работу, мало пройти курс и сделать классное резюме. На практике, чтобы выделиться на собеседовании, нужно понимать, что лежит под капотом каждого инструмента, а не следовать конкретному заученному алгоритму.
Чтобы попрактиковаться в этом, приходите на бесплатный вебинар, где будем разбирать реальное тестовое задание, которое дают аналитикам в подразделении Яндекс Картинки.
Что будет на вебинаре:
• С помощью Python решим рутинные задачи - разархивировать файлы, прочитать большой json и т.д.
• С помощью Pandas проанализируем поисковые запросы Яндекс.Картинок
• С помощью Plotly построим интерактивные графики и сделаем выводы
• Найдем статистически значимую разницу в поведении пользователей на разных устройствах
Вебинар проведет Андрон Алексанян, CEO Simulative
🎁Обязательно приходите смотреть вебинар в прямом эфире - в лайве будут дарить подарки, которые сильно бустанут старт карьеры в аналитике!
Зарегистрироваться на бесплатный вебинар
Причины возникновения галлюцинаций LLM
В данной статье будет представлен укороченный и упрощенный перевод статьи “A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions”. А именно перевод части, относящейся к причинам возникновения галлюцинаций.
Читать | DATApedia | #DS_AI
Законы масштабирования нейронных языковых моделей
Эта статья от 23 января 2020 года не так известна, как "Всё, что вам нужно - это внимание". Но, думаю, впоследствии она войдет в новейшую техноисторию как аналог трёх законов Ньютона для LLM (сами авторы статьи сравнивают открытые ими принципы с уравнениями для идеального газа)
Читать | DATApedia | #DS_AI
Repost from BApedia | Бизнес-анализ
Как не нужно визуализировать данные: антипаттерны в примерах
Как делать графики понятными и наглядными? Да ещё и избежать неверных трактовок? Когда использовать круговую диаграмму, а когда нужны линейные графики или столбчатая шкала? Для этого достаточно учесть антипаттерны, которые вредят и запутывают. Разберём на «хороших» и «плохих» примерах.
Читать | BApedia
Разбор и стандартизация имен, адресов и других типов пользовательских данных в миллионных базах
Ошибки в данных появляются повсюду: пользователи путают буквы, операторы торопятся, а программы для распознавания документов добавляют свои погрешности. И если вы думаете, что корректность данных легко определить, просто взглянув на них, вспомните кавээновский номер с Гадей Петрович.
Читать | DATApedia
Google представила ИИ-генератор видео Veo 2.0: лучше ли, чем Sora и как получить доступ
Если вы впервые слышите о Veo, то это ИИ-видеомодель Google, способная генерировать видео по текстовым описаниям. Первая версия Veo была представлена в мае 2024 года, но так и не стала общедоступной. Теперь Google представила Veo 2.0 со значительными улучшениями и расширенной функциональностью.
Читать | DATApedia | #DS_AI
