Data Science: Алгоритмы и Структуры данных
Kanalga Telegram’da o‘tish
Мы не претендуем на оригинальность контента, мы лишь собираем материал из открытых источников. Ссылка: @Portal_v_IT Сотрудничество, авторские права: @oleginc, @tatiana_inc Канал на бирже: https://telega.in/c/structuredata
Ko'proq ko'rsatish7 716
Obunachilar
Ma'lumot yo'q24 soatlar
-187 kunlar
-2030 kunlar
Postlar arxiv
Хватит писать «чистый» код. Пора писать понятный код
Да, это очередная статья по чистому коду. Но по разным источникам, соотношение времени, затрачиваемого на чтение и написание кода, может достигать 7 к 1 и даже больше. Когда вы исправляете ошибку, добавляете новую функциональность или проводите рефакторинг, вы сначала погружаетесь в логику, написанную другими людьми (или вами же, но несколько месяцев назад). Именно поэтому читаемость кода становится более важным фактором, чем скорость его первоначального написания. Нечитаемый код - это технический долг, который замедляет всю команду и увеличивает стоимость разработки в долгосрочной перспективе.
https://habr.com/ru/articles/952300/
Алгоритмы и Структуры данных
Курс "Дизайн карточек для WB и Ozon". Бесплатно и с нуля
Дизайнер карточек для маркетплейсов — востребованная и доходная профессия 💰
Научись ей бесплатно!
- Бесплатный доступ
- Разбор ДЗ от наставника
- Мощные кейсы в портфолио
Узнать больше
#реклама 16+
yudaevschool24.online
О рекламодателе
Алгоритмы, базы и порядок: практическая подборка книг для разработчиков
Алгоритмы, базы данных и качество данных — три темы, без которых сегодня не обходится ни один проект. От того, как разработчик обращается с ними, зависит не только скорость работы приложений, но и то, насколько вообще можно доверять системе. Если алгоритм выбран неправильно — система будет тормозить; если база построена на «костылях» — она станет источником ошибок; если данные не проверять на качество — отчеты превратятся в хаос.
Чтобы помочь разобраться в этом, команда Read IT Club собрала подборку из трех книг, которые проверили рецензенты клуба — эксперты из ведущих технологических компаний. В них нет академической скуки, зато есть практические советы: как выбрать правильный алгоритм, не угробить архитектуру базы и научиться бороться с «грязными» данными. Каждая из них решает свою часть головоломки, но вместе они дают цельную картину того, как работать с данными и кодом надежно, эффективно и без лишних драм.
https://habr.com/ru/companies/croc/articles/952010/
Алгоритмы и Структуры данных
Repost from Москва Инсайд
⚡️Запускаем КРУПНЕЙШИЙ розыгрыш на 1 000 000 рублей
Подготовили для вас сразу 8 крутых призов с последней презентации Apple:
— iPhone 17; — iPhone Air; — iPhone 17 Pro; — iPhone 17 Pro Max; — AirPods Pro 3; — Apple Watch Series 11; — Apple Watch SE 3; — Apple Watch Ultra 3.1. Для участия нужно быть подписанным на каналы Москва Инсайд и Московская хроника 2. Нажать на кнопку "Участвовать" Итоги подведем 20 октября в 18:00 — бот случайным образом выберет 8 победителей. Доставка бесплатная, всем удачи!
Как JPEG стал стандартом изображений в интернете
JPEG — формат-динозавр. Ему уже за тридцать, но он по-прежнему живее всех живых: даже в 2025 году изображения в JPEG встречаются повсюду.
В конце 80-х инженерам нужно было как-то справляться с растущими размерами файлов. Интернет был медленным, а фотографии — всё тяжелее. Тогда и придумали решение: сжатие с потерями, основанное на дискретном косинусном преобразовании (DCT). Если по-простому, DCT — это способ выкинуть из картинки то, чего наш глаз почти не заметит, и оставить главное. В итоге получаем файл в разы меньше, а картинка всё ещё выглядит прилично.
Почему именно этот подход победил конкурентов, кто его протолкнул и как JPEG стал «языком» интернета для изображений — обо всём этом дальше.
https://habr.com/ru/companies/first/articles/951960/
Алгоритмы и Структуры данных
Музыка и математика: как аккорды вдохновляют архитектуру алгоритмов
Эта статья — эксперимент на стыке музыки, математики и программирования. Мы попробуем взглянуть на аккорды не как на набор звуков, а как на архитектурные паттерны. Я покажу, как гармонические последовательности могут подсказать нам структуру алгоритмов, приведу примеры кода и проведу параллели между миром нот и миром вычислений.
https://habr.com/ru/articles/951718/
Алгоритмы и Структуры данных
REKONFA Live
6 ноября приглашаем всех, кто имеет отношение к маркетингу и рекламным технологиям, обсудить рынок, тренды, вызовы и их решения.
С докладами на актуальные темы выступят лидеры индустрии и медийные спикеры.
Принять участие можно офлайн и онлайн. Мероприятие бесплатное, нужно только зарегистрироваться.
Зарегистрироваться
#реклама 18+
ya.rekonfa.ru
О рекламодателе
ИИ-поиск в 2ГИС: как учим нейросети понимать настроение, фото и смыслы
Поиск — одна из ключевых функций в 2ГИС. Он помогает миллионам пользователей каждый день находить нужные места в городе. Долгое время мы опирались на классические методы: морфологию, справочник организаций, геопозицию и популярность объектов. Это позволяло покрывать множество сценариев, но со временем стало понятно — этого недостаточно.
Пользователи хотят искать так, как думают: по настроению, по смыслу или вообще без слов — по фотографии блюда или интерьера. Мы решили переосмыслить подход к поиску. В этой статье рассказываем, как мы решали три задачи:
https://habr.com/ru/companies/2gis/articles/951008/
Алгоритмы и Структуры данных
Коллеги, если вы работаете в е-коме, ритейле и онлайн-торговле — вы обязаны подписаться на Будни Русского Ритейла.
Тут рассказывают, как реально работает ритейл, показывают всю изнанку маркетплейсов и объясняют что будет с торговлей в 2026 году.
П.С. Такой контент на вес золота — так что обязательно держите в подписках: https://t.me/budni_retail
Разделяй и Властвуй. Разбор задач
Решение задач с помощью метода "Разделяй и Властвуй" или по-английски "Divide and Conquer" является одним из базовых методов по ускорению алгоритмов. Примером тому служит переход от квадратичной сложности пузырьковой сортировки или сортировки вставками к сложности \inline O(n\log{n}) при сортировке слиянием. Или переход от линейной сложности к логарифмической, при реализации поиска элемента в отсортированном массиве (см. бинарный поиск).
В этой статье мы рассмотрим два примера задач с пояснениями и кодом, в которых будет использоваться этот подход.
https://habr.com/ru/companies/otus/articles/599309/
Алгоритмы и Структуры данных
k-means in Clickhouse
Алгоритм k-means хорошо известен и применяется когда надо быстро разделить массив данных на группы или т.н. "кластеры". Предполагается, что каждый элемент данных имеет набор численных метрик, и мы можем говорить как о позиции точки в некотором многомерном пространстве, так и о их взаимной близости.
k-means относится к категории EM-алогоритмов (Expectanion-Maximization), где мы попеременно определяем насколько правильно текущее разбиение точек на кластеры, а затем немного его улучшаем.
Этот достаточно простой алгоритм, был сформулирован ещё в 1950-х, и с тех пор реализован на самых разных языках программирования. Есть реализации для MySQL и Postgress, и даже для Excel.
https://habr.com/ru/articles/645291/
Алгоритмы и Структуры данных
Где вести задачи и проекты? Конечно, в Битрикс24
Бесплатный онлайн-сервис для бизнеса и совместной работы.
— Удобный планировщик задач для всей команды с чек-листами и комментариями.
— Популярные проектные методики: канбан, скрам, диаграмма ганта.
— Видеозвонки в один клик из чата.
— Календарь и слоты для совместного планирования.
— Умный ИИ-помощник для постановки четких тз.
Полный комплект для эффективности вашей команды.
Ставьте первую задачу прямо сейчас.
Начать
#реклама 16+
task-24.bitrix24.ru
О рекламодателе
Как мы используем LLVM для ускорения формирования отчётов
Для бизнес-приложений очень важна возможность быстро сформировать нужный отчёт. Для этого, в частности, важно быстро получить результат запроса (часто – очень сложного запроса) к СУБД. Что не всегда просто, потому что с этой СУБД работают на чтение и запись тысячи (а иногда - десятки тысяч) пользователей.
Чтобы не нагружать рабочую СУБД запросами для отчетов мы разработали механизм копий баз данных, копирующий данные (все или их часть) из рабочей БД в отдельную БД для отчетности. Пользователи могут строить отчеты на «отчетной» БД, быстрее получая результат и не нагружая рабочую базу.
Для дальнейшего ускорения формирования отчетности мы разработали Дата акселератор — собственную SQL-совместимую in-memory базу данных, ориентированную на максимальную производительность в задачах OLAP. Дата акселератор может использоваться в качестве «отчетной БД» и позволяет существенно (иногда – на порядки) ускорить формирование отчетов.
https://habr.com/ru/companies/1c/articles/645365/
Алгоритмы и Структуры данных
Интерпретация моделей и диагностика сдвига данных: LIME, SHAP и Shapley Flow
В этом обзоре мы рассмотрим, как методы LIME и SHAP позволяют объяснять предсказания моделей машинного обучения, выявлять проблемы сдвига и утечки данных, осуществлять мониторинг работы модели в production и искать группы примеров, предсказания на которых объясняются схожим образом.
Также поговорим о проблемах метода SHAP и его дальнейшем развитии в виде метода Shapley Flow, объединяющего интерпретацию модели и многообразия данных.
https://habr.com/ru/companies/ods/articles/599573/
Алгоритмы и Структуры данных
Разберитесь в ИИ за 5 дней
Хайп вокруг нейросетей — это круто, но как они работают на деле? За 5 дней вы напишете код, построите ИИ-модель и соберёте первые проекты в портфолио.
Мини-курс подойдёт и новичкам, и тем, кто просто хочет пощупать Data Science. Эти специалисты умеют «разговаривать» с данными и находить решения с помощью нейросетей. И вы попробуете себя в этой роли — без лишней теории и сложностей.
Комьюнити, подарки, доступ навсегда. Учитесь когда удобно, главное успейте зарегистрироваться пока видео-курс бесплатный.
[Забрать мини-курс]
15 игр, которые прокачивают логику, алгоритмы, ассемблер и силу земли
Есть «Super Mario», признанная классика видео игр. Есть «Doom», который запускают на чайниках и тестах на беременность. Есть супер-популярные по статистике twitch.tv игры («League of Legends», «GTA V», «Fortnite», «Apex Legends») которые стримят пятая часть всех стриммеров.
А есть игры, на которые очень мало обзоров, но они супер крутые — игры про алгоритмы. Игры, в которых можно кодить на ретро-компьютере; игры, которые надо взламывать; игры, где можно программировать контроллеры или поведение персонажей; игры, где можно создавать свою игру внутри игры.
Под катом подборка классных игр про алгоритмы за последние 10 лет. Если что-то упустила — буду рада дополнениям.
https://habr.com/ru/companies/timeweb/articles/599835/
Алгоритмы и Структуры данных
Как измерить количество информации?
Мы ежедневно работаем с информацией из разных источников. При этом каждый из нас имеет некоторые интуитивные представления о том, что означает, что один источник является для нас более информативным, чем другой. Однако далеко не всегда понятно, как это правильно определить формально. Не всегда большое количество текста означает большое количество информации. Например, среди СМИ распространена практика, когда короткое сообщение из ленты информационного агентства переписывают в большую новость, но при этом не добавляют никакой «новой информации». Или другой пример: рассмотрим текстовый файл с романом Л.Н. Толстого «Война и мир» в кодировке UTF-8. Его размер — 3.2 Мб. Сколько информации содержится в этом файле? Изменится ли это количество, если файл перекодировать в другую кодировку? А если заархивировать? Сколько информации вы получите, если прочитаете этот файл? А если прочитаете его второй раз?
https://habr.com/ru/companies/JetBrains-education/articles/599637/
Алгоритмы и Структуры данных
Краткая история комплексных чисел
Вам это может показаться странным, но были времена, когда отрицательные числа казались людям чем-то неестественным, причём даже тем людям, которые зарабатывали себе на жизнь числами — математикам. Как можно считать числом то, что не имеет физического воплощения? С отрицательными числами в итоге смирились, но уж что точно невозможно было терпеть, так это совсем непонятную величинуi, квадрат которой-1, это уже противоречит всякому здравому смыслу. Тем не менее время показало, что законы физики и математики, сформулированные с использованиемi имеют больший смысл, чем законы, сформулированные без неё. Еще в 19 веке Карл Фридрих Гаусс отметил, что "Если бы вместо того, чтобы называть +1, −1,\sqrt{−1} положительной, отрицательной или мнимой (или даже невозможной) единицей, их назвали бы, скажем, прямой, обратной или боковой единицей, то едва ли можно было бы говорить о какой-либо темноте".
В статье хочу рассказать о том, как небольшой математический трюк, придуманный для решения кубических уравнений 500 лет назад, вошёл в фундамент современной науки и инженерии.
https://habr.com/ru/articles/950774/
Алгоритмы и Структуры данных
Как работать с нейросетями эффективно: теория и практика
Языковые нейросети являются мощнейшим инструментом, который может существенно ускорить и упростить работу во многих профессиях: разработчиков, SMM- и SEO-специалистов, маркетологов, копирайтеров и журналистов, HR, аналитиков, проджект- и продукт-менеджеров и многих других, кто ежедневно работает с информацией. Они могут помочь в разработке ПО, написании контента, поиске и обобщении информации, обработке и структурировании данных, могут давать советы, подсказывать пути и инструменты для принятия решений. Однако фундамент языковых ИИ хоть и был формально изобретен еще в середине прошлого века, в практический обиход нейросети вошли совсем недавно, и не все умеют эффективно ими пользоваться. В данной статье я опишу наиболее эффективные практики работы с языковыми нейросетями, которые известны на сегодняшний день.
Примечание: статья описывает работу только с нейросетями, которые генерируют текст. Для генерации изображений, звука, видео, синтеза речи существуют свои методы, которые выходят за рамки данного текста.
https://habr.com/ru/articles/950730/
Алгоритмы и Структуры данных
Как работать с нейросетями эффективно: теория и практика
Языковые нейросети являются мощнейшим инструментом, который может существенно ускорить и упростить работу во многих профессиях: разработчиков, SMM- и SEO-специалистов, маркетологов, копирайтеров и журналистов, HR, аналитиков, проджект- и продукт-менеджеров и многих других, кто ежедневно работает с информацией. Они могут помочь в разработке ПО, написании контента, поиске и обобщении информации, обработке и структурировании данных, могут давать советы, подсказывать пути и инструменты для принятия решений. Однако фундамент языковых ИИ хоть и был формально изобретен еще в середине прошлого века, в практический обиход нейросети вошли совсем недавно, и не все умеют эффективно ими пользоваться. В данной статье я опишу наиболее эффективные практики работы с языковыми нейросетями, которые известны на сегодняшний день.
https://habr.com/ru/articles/950730/
Алгоритмы и Структуры данных
