en
Feedback
DATApedia | Data science

DATApedia | Data science

Open in Telegram

Тут вы найдете всё, что связано с Data Science, AI и Machine Learning, как для начинающих, так и для бывалых специалистов. Также, для вас, мы переводим зарубежные статьи. Сотрудничество: @Seyfme

Show more
3 309
Subscribers
No data24 hours
-57 days
-3230 days
Posts Archive
Чем занимаются дата-сайентисты в Авито? Узнайте изнутри! Статья от команды Data Science в Авито рассказывает о реальных кейсы, проектах и командах, которые развивают бизнес и обеспечивают безопасность платформы: ➡️ Как алгоритмы автомодерации проверяют миллионы объявлений. ➡️ Какие подходы используются для борьбы с мошенничеством. ➡️ Как работают персонализированные рекомендации и поиск. ➡️ Какие проекты ведет AI Lab в Авито. Все о мире DS в Авито и многое другое ➡️ по ссылке. Реклама. ООО «Авито Тех».

​​Данные для обучения моделей иссякли. Что будет дальше? Сегодня мы разберемся, что будем делать, когда у моделей закончится «еда». Читать | DATApedia | #DS_AI

Разбираем тестовое задание на позицию Junior Аналитика в Яндекс. Чтобы найти работу, мало пройти курс и сделать классное резю
Разбираем тестовое задание на позицию Junior Аналитика в Яндекс. Чтобы найти работу, мало пройти курс и сделать классное резюме. На практике, чтобы выделиться на собеседовании, нужно понимать, что лежит под капотом каждого инструмента, а не следовать конкретному заученному алгоритму. Чтобы попрактиковаться в этом, приходите на бесплатный вебинар, где будем разбирать реальное тестовое задание, которое дают аналитикам в подразделении Яндекс Картинки. Что будет на вебинаре: • С помощью Python решим рутинные задачи - разархивировать файлы, прочитать большой json и т.д. • С помощью Pandas проанализируем поисковые запросы Яндекс.Картинок • С помощью Plotly построим интерактивные графики и сделаем выводы • Найдем статистически значимую разницу в поведении пользователей на разных устройствах Вебинар проведет Андрон Алексанян, CEO Simulative 🎁Обязательно приходите смотреть вебинар в прямом эфире - в лайве будут дарить подарки, которые сильно бустанут старт карьеры в аналитике! Зарегистрироваться на бесплатный вебинар

​​Причины возникновения галлюцинаций LLM В данной статье будет представлен укороченный и упрощенный перевод статьи “A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions”. А именно перевод части, относящейся к причинам возникновения галлюцинаций. Читать | DATApedia | #DS_AI

​​Законы масштабирования нейронных языковых моделей Эта статья от 23 января 2020 года не так известна, как "Всё, что вам нужно - это внимание". Но, думаю, впоследствии она войдет в новейшую техноисторию как аналог трёх законов Ньютона для LLM (сами авторы статьи сравнивают открытые ими принципы с уравнениями для идеального газа) Читать | DATApedia | #DS_AI

photo content

​​Метрики оценки LLM: полное руководство по оценке LLM В этой статье вы научитесь всему, что нужно знать о метриках оценки LLM, включая примеры кода. Читать | DATApedia | #DS_AI

​​Как просто добавить ИИ в приложения на Rust: универсальный опенсорсный инструмент В этой статье хочу рассказать о новом инструменте на Rust, который облегчает запуск моделей машинного обучения и их внедрение в приложения. Читать | DATApedia | #DS_AI

​​Миграция данных: Понятие, виды и примеры на Python В данной статье мы рассмотрим основные виды миграции данных и приведем примеры реализации некоторых из них на Python. Читать | DATApedia

​​Математические бланки // Часть 1: введение в проблему Данная статья описывает проблему математических бланков и демонстрирует, на что способно её решение. Читать | DATApedia | #DS_AI

​​Оптимизация SQL запросов В данной статье мы рассмотрим как переписать запрос, чтобы выполнялся быстрее. В статье пойдет речь о PostgreSQL, хотя применять данные советы к любой базе данных SQL Ниже будут представлены термины и операторы, о которых пойдет в данной статье. Читать | DATApedia

Коллеги, мы? 😢

​​Как не нужно визуализировать данные: антипаттерны в примерах Как делать графики понятными и наглядными? Да ещё и избежать неверных трактовок? Когда использовать круговую диаграмму, а когда нужны линейные графики или столбчатая шкала? Для этого достаточно учесть антипаттерны, которые вредят и запутывают. Разберём на «хороших» и «плохих» примерах. Читать | BApedia

​​Разбор и стандартизация имен, адресов и других типов пользовательских данных в миллионных базах Ошибки в данных появляются повсюду: пользователи путают буквы, операторы торопятся, а программы для распознавания документов добавляют свои погрешности. И если вы думаете, что корректность данных легко определить, просто взглянув на них, вспомните кавээновский номер с Гадей Петрович. Читать | DATApedia

​​«Брендометр» Airbnb: автоматизация оценки восприятия бренда в социальных сетях с помощью ИИ Эта статья посвящена тому, как в Airbnb, пользуясь технологиями глубокого обучения, вычисляют показатели восприятия бренда на основе данных, полученных из социальных сетей. Читать | DATApedia | #DS_AI

photo content

​​Google представила ИИ-генератор видео Veo 2.0: лучше ли, чем Sora и как получить доступ Если вы впервые слышите о Veo, то это ИИ-видеомодель Google, способная генерировать видео по текстовым описаниям. Первая версия Veo была представлена в мае 2024 года, но так и не стала общедоступной. Теперь Google представила Veo 2.0 со значительными улучшениями и расширенной функциональностью. Читать | DATApedia | #DS_AI

​​Возможности LLM и RAG на примере реализации бота для поддержки клиентов В этой статье я хочу рассказать об LLM и RAG, вариантах их использования на примере нашего бота для поддержки клиентов, а также о сценариях применения полученной реализации. Читать | DATApedia

​​Оценка RAG: Полное руководство по модульному тестированию RAG в CI/CD В этом руководстве мы рассмотрим, как настроить полностью автоматизированный набор оценки/тестирования для модульного тестирования приложений RAG в ваших конвейерах CI/CD. Читать | DATApedia