Нейросеть | Эстетика
Open in Telegram
Сообщество профессионалов в области работы с данными и искуственным интеллектом
Show more2 127
Subscribers
No data24 hours
-47 days
-1330 days
Posts Archive
2 127
Пост про RAG
Тк основное внимание ИТ сообщества приковано сейчас к теме использования LLM в бизнесе, а надо отметить важность такого класса решений, как RAG (Retrieval-Augmented Generation ) платформы. На фоне того, что бы конкуренция в области LLM возрастает, что стоимость токенов кратно и постоянно падает, то именно RAG становится точкой соединения “бизнеса” и LLM и основной статьей бюджета компаний.
В RAG платформу сейчас по сути сейчас “сгружаются” все существующие до LLM методы поиска и ранжирования информации и там они раскрываются в полной мере.
Я не хочу описывать все, что может быть “под капотом” RAG, в статье ниже это все очень хорошо описано, почитайте. Кроме этого там еще затрагиваются и смежные технологии типа векторных баз данных (и в кои то веки дается очень человеческое объяснение что это такое и зачем нужно :)), методы промпирования LLM, Knowledge Graph и тд.
В общем RAG - очень интересная и перспективная область развития. Это и самостоятельный класс решений и в целом достаточно наукоемкая область в которой инновации могут помочь получить конкретное преимущество и с тз бизнес модели они занимают очень правильное место в цепочке добавленной стоимости для бизнеса - есть есть и консалтинг, и внедрение и лицензионная составляющая + на самом деле RAG (или его владелец/пользователь) определяет, какая LLM будет получить бюджеты.
Но вот если обратиться ко второй части статьи то там делает интересное и не безосновательное утверждение о том, что чем больше у LLM контекстное окно, тем все для более многих задач RAG просто не требуется (или не все его компоненты), т.к. все данные можно поместить в это контекстное окно. Но пока они еще требуются и есть причина по которой RAG может остаться с нами надолго - разделение прав и управление доступом. Делать это на уровне LLM никак нельзя, ибо LLM можно убедить в чем угодно и так останется ещё долго (если не всегда).
Часть первая: https://habr.com/ru/companies/raft/articles/791034/
Часть вторая: https://habr.com/ru/companies/raft/articles/818781/
2 127
🌑 Взлётный модуль Chang'e-6 стартовал с Луны
📌 Он стал первым космическим аппаратом, взлетевшим с обратной стороны Луны.
Теперь модуль должен состыковаться на орбите Луны с возвращаемым аппаратом, который вернёт образцы на Землю ~25 июня.
2 127
❗️Более 300+ лекций бесплатно по прикладной математике от MIT
- Математика для информатики, - Разработка и анализ алгоритмов,
- Матричные методы анализа данных,
- Обработка сигналов и машинного обучения,
- Вычислительные науки и инженерия,
- Математические методы для инженеров II,
- Прикладная теория категорий, - Темы математики с приложениями в финансах.
2 127
Дайджест статей
Ландшафт Open Source Data Engineering в 2024 году: место России и мировые тенденции
https://habr.com/ru/articles/809427/
Проектирование DWH с помощью Data Vault
https://habr.com/ru/companies/otus/articles/816219/
Быстрая Data Quality проверка на базе алгоритма adversarial validation
https://habr.com/ru/companies/ru_mts/articles/817483/
Enhancing data lineage and metadata management in ELT pipelines
https://www.datasciencecentral.com/enhancing-data-lineage-and-metadata-management-in-elt-pipelines/
Разработка системы отчётности и BI: вопросы производительности
https://habr.com/ru/companies/magnit/articles/815667/
Красиво и понятно: какие инструменты для визуализации данных нужны дата-аналитику
https://habr.com/ru/companies/skillfactory/articles/818375/
Сквозная аналитика: комплексный подход к эффективности бизнеса
https://habr.com/ru/articles/818283/
Meta and Google researchers’ new data curation method could transform self-supervised learning
https://venturebeat.com/ai/meta-and-google-researchers-new-data-curation-method-could-transform-self-supervised-learning/
Использование генеративного ИИ для автоматизации дата инжиниринга
https://habr.com/ru/articles/818811/
2 127
Статус всех публичных репозиториев GPDB (международный проект с открытым исходным кодом Greenplum) на GitHub изменён на архивный. Это означает, что разработка Greenplum в рамках open source, скорее всего, будет приостановлена и дальнейшее развитие проекта силами нового правообладателя проекта — компании Broadcom — будет происходить в рамках коммерческой версии VMware Tanzu Greenplum. Arenadata даёт свой комментарий относительно сложившейся ситуации для пользователей как продукта Arenadata DB (ADB), так и ванильной open source версии Greenplum.
2 127
Любопытная статья от Facebook про их платформу работы с данными.
Если коротко - мы не хотим пилить монолит, мы хотим быть гибкими, поэтому у нас зоопарк технологий под любые нужды. Но пользователи хотят единый интерфейс к данным поэтому мы напилил новый монолит над зоопарком - назвали Velox.
Это такой движок SQL запросов который их выполняет обращаясь к разным другим платформам. Но что бы обращаться было проще он похоже еще много всего сам хранит «под ногами» :)
А еще придумали новый формат фалов для BD - Nimble. Интересно будет потом глянуть подробнее его.
https://engineering.fb.com/2024/05/22/data-infrastructure/composable-data-management-at-meta/
2 127
Коллеги, несмотря на отмену конференции OpenTalk.AI в Тбилиси, организаторам удалось собрать несколько оффлайновых митапов с докладчиками, которые приехали в Тбилиси. И главное — они собрали 2-х дневную микроконференцию из всех ключевых докладчиков и записали все эти доклады.
Это получилась удивительная камерная суперинтересная конференция, где получилось больше внимания уделить каждому докладу и вопросам/ответам.
Теперь наконец вы можете посмотреть все записи, включая интереснейшую заключительную сессию Эмерджентность, в которой, после выступлений, было еще прекрасное 2-х часовое обсуждение!)
Все записи на русском, мы позднее добавим английские субтитры.
https://ipaccelerator.timepad.ru/event/2879723/
2 127
А вы пробовали Perplexity? Приложение «поверх» нескольких LLM (включая свою) которая умеет извлекать данные из интернета в реальном времени и отвечать на вопросы о настоящем времени.
Очередная попытка убить поиск. И в целом очень неплохая при умении задавать правильные вопросы :)
2 127
Добрый день! Коллеги из ВТБ на Хабре рассказали, как мигрировали озеро данных с Oracle на Arenadata Hadoop. Очень интересный материал получился. Посмотрите, пожалуйста, получится ли опубликовать в канале? https://habr.com/ru/companies/vtb/articles/816325/
2 127
Коллеги, делюсь контентом от подписчиков и призываю всех так же делиться материалами!
2 127
Дайджест статей
Apache Superset 2024. Лучшие практики
https://habr.com/ru/companies/otpbank/articles/815689/
LLM Leaderboard за май 2024
https://habr.com/ru/articles/816519/
Миграция Big Data на практике: как мы готовили напильники
https://habr.com/ru/companies/vtb/articles/816325/
Как правильно визуализировать данные, чтобы принимать эффективные решения?
https://habr.com/ru/articles/816191/
Зачем и как проектировать пользовательский опыт в B2B BI-проектах
https://habr.com/ru/articles/816945/
The Modern AI Stack: Design Principles for the Future of Enterprise AI Architectures
https://menlovc.com/perspective/the-modern-ai-stack-design-principles-for-the-future-of-enterprise-ai-architectures/
Искусственный интеллект спотыкается о данные
https://www.kommersant.ru/doc/6509461
Анатомия визуализации. Часть первая: от задачи к исполнению
https://habr.com/ru/companies/securityvison/articles/817011/
2 127
Вот и Алекса поумнела :)
https://gizmodo.com/amazon-alexa-generative-ai-upgrade-prime-cost-1851493383
