en
Feedback
Нейросеть | Эстетика

Нейросеть | Эстетика

Open in Telegram

Сообщество профессионалов в области работы с данными и искуственным интеллектом

Show more
2 127
Subscribers
No data24 hours
-47 days
-1330 days
Posts Archive
30 минут до 4-го запуска StarShip от SpaceX https://www.youtube.com/watch?v=2G-L0u_L0qU

Пост про RAG Тк основное внимание ИТ сообщества приковано сейчас к теме использования LLM в бизнесе, а надо отметить важность такого класса решений, как RAG (Retrieval-Augmented Generation ) платформы. На фоне того, что бы конкуренция в области LLM возрастает, что стоимость токенов кратно и постоянно падает, то именно RAG становится точкой соединения “бизнеса” и LLM и основной статьей бюджета компаний. В RAG платформу сейчас по сути сейчас “сгружаются” все существующие до LLM методы поиска и ранжирования информации и там они раскрываются в полной мере. Я не хочу описывать все, что может быть “под капотом” RAG, в статье ниже это все очень хорошо описано, почитайте. Кроме этого там еще затрагиваются и смежные технологии типа векторных баз данных (и в кои то веки дается очень человеческое объяснение что это такое и зачем нужно :)), методы промпирования LLM, Knowledge Graph и тд. В общем RAG - очень интересная и перспективная область развития. Это и самостоятельный класс решений и в целом достаточно наукоемкая область в которой инновации могут помочь получить конкретное преимущество и с тз бизнес модели они занимают очень правильное место в цепочке добавленной стоимости для бизнеса - есть есть и консалтинг, и внедрение и лицензионная составляющая + на самом деле RAG (или его владелец/пользователь) определяет, какая LLM будет получить бюджеты. Но вот если обратиться ко второй части статьи то там делает интересное и не безосновательное утверждение о том, что чем больше у LLM контекстное окно, тем все для более многих задач RAG просто не требуется (или не все его компоненты), т.к. все данные можно поместить в это контекстное окно. Но пока они еще требуются и есть причина по которой RAG может остаться с нами надолго - разделение прав и управление доступом. Делать это на уровне LLM никак нельзя, ибо LLM можно убедить в чем угодно и так останется ещё долго (если не всегда). Часть первая: https://habr.com/ru/companies/raft/articles/791034/ Часть вторая: https://habr.com/ru/companies/raft/articles/818781/

🌑 Взлётный модуль Chang'e-6 стартовал с Луны 📌 Он стал первым космическим аппаратом, взлетевшим с обратной стороны Луны. Теперь модуль должен состыковаться на орбите Луны с возвращаемым аппаратом, который вернёт образцы на Землю ~25 июня.

Новая веха в истории освоении Луны

+1
Grand Prix Formula LLM :)

THE 2024 MAD (MACHINE LEARNING, ARTIFICIAL INTELLIGENCE & DATA) LANDSCAPE

Конечно, никто смотреть не будет, но все добавят в закладки :)))

❗️Более 300+ лекций бесплатно по прикладной математике от MIT - Математика для информатики, - Разработка и анализ алгоритмов, - Матричные методы анализа данных, - Обработка сигналов и машинного обучения, - Вычислительные науки и инженерия, - Математические методы для инженеров II, - Прикладная теория категорий, - Темы математики с приложениями в финансах.

Дайджест статей Ландшафт Open Source Data Engineering в 2024 году: место России и мировые тенденции https://habr.com/ru/articles/809427/ Проектирование DWH с помощью Data Vault https://habr.com/ru/companies/otus/articles/816219/ Быстрая Data Quality проверка на базе алгоритма adversarial validation https://habr.com/ru/companies/ru_mts/articles/817483/ Enhancing data lineage and metadata management in ELT pipelines https://www.datasciencecentral.com/enhancing-data-lineage-and-metadata-management-in-elt-pipelines/ Разработка системы отчётности и BI: вопросы производительности https://habr.com/ru/companies/magnit/articles/815667/ Красиво и понятно: какие инструменты для визуализации данных нужны дата-аналитику https://habr.com/ru/companies/skillfactory/articles/818375/ Сквозная аналитика: комплексный подход к эффективности бизнеса https://habr.com/ru/articles/818283/ Meta and Google researchers’ new data curation method could transform self-supervised learning https://venturebeat.com/ai/meta-and-google-researchers-new-data-curation-method-could-transform-self-supervised-learning/ Использование генеративного ИИ для автоматизации дата инжиниринга https://habr.com/ru/articles/818811/

Небольшая методичка с базой про Data Lake

Статус всех публичных репозиториев GPDB (международный проект с открытым исходным кодом Greenplum) на GitHub изменён на архив
Статус всех публичных репозиториев GPDB (международный проект с открытым исходным кодом Greenplum) на GitHub изменён на архивный. Это означает, что разработка Greenplum в рамках open source, скорее всего, будет приостановлена и дальнейшее развитие проекта силами нового правообладателя проекта — компании Broadcom — будет происходить в рамках коммерческой версии VMware Tanzu Greenplum. Arenadata даёт свой комментарий относительно сложившейся ситуации для пользователей как продукта Arenadata DB (ADB), так и ванильной open source версии Greenplum.

тревожные новости

Любопытная статья от Facebook про их платформу работы с данными. Если коротко - мы не хотим пилить монолит, мы хотим быть гибкими, поэтому у нас зоопарк технологий под любые нужды. Но пользователи хотят единый интерфейс к данным поэтому мы напилил новый монолит над зоопарком - назвали Velox. Это такой движок SQL запросов который их выполняет обращаясь к разным другим платформам. Но что бы обращаться было проще он похоже еще много всего сам хранит «под ногами» :) А еще придумали новый формат фалов для BD - Nimble. Интересно будет потом глянуть подробнее его. https://engineering.fb.com/2024/05/22/data-infrastructure/composable-data-management-at-meta/

Коллеги, несмотря на отмену конференции OpenTalk.AI в Тбилиси, организаторам удалось собрать несколько оффлайновых митапов с докладчиками, которые приехали в Тбилиси. И главное — они собрали 2-х дневную микроконференцию из всех ключевых докладчиков и записали все эти доклады. Это получилась удивительная камерная суперинтересная конференция, где получилось больше внимания уделить каждому докладу и вопросам/ответам. Теперь наконец вы можете посмотреть все записи, включая интереснейшую заключительную сессию Эмерджентность, в которой, после выступлений, было еще прекрасное 2-х часовое обсуждение!) Все записи на русском, мы позднее добавим английские субтитры. https://ipaccelerator.timepad.ru/event/2879723/

А вы пробовали Perplexity? Приложение «поверх» нескольких LLM (включая свою) которая умеет извлекать данные из интернета в реальном времени и отвечать на вопросы о настоящем времени. Очередная попытка убить поиск. И в целом очень неплохая при умении задавать правильные вопросы :)

Добрый день! Коллеги из ВТБ на Хабре рассказали, как мигрировали озеро данных с Oracle на Arenadata Hadoop. Очень интересный материал получился. Посмотрите, пожалуйста, получится ли опубликовать в канале? https://habr.com/ru/companies/vtb/articles/816325/

Коллеги, делюсь контентом от подписчиков и призываю всех так же делиться материалами!

Дайджест статей Apache Superset 2024. Лучшие практики https://habr.com/ru/companies/otpbank/articles/815689/ LLM Leaderboard за май 2024 https://habr.com/ru/articles/816519/ Миграция Big Data на практике: как мы готовили напильники https://habr.com/ru/companies/vtb/articles/816325/ Как правильно визуализировать данные, чтобы принимать эффективные решения? https://habr.com/ru/articles/816191/ Зачем и как проектировать пользовательский опыт в B2B BI-проектах https://habr.com/ru/articles/816945/ The Modern AI Stack: Design Principles for the Future of Enterprise AI Architectures https://menlovc.com/perspective/the-modern-ai-stack-design-principles-for-the-future-of-enterprise-ai-architectures/ Искусственный интеллект спотыкается о данные https://www.kommersant.ru/doc/6509461 Анатомия визуализации. Часть первая: от задачи к исполнению https://habr.com/ru/companies/securityvison/articles/817011/