Нейросеть | Эстетика
Open in Telegram
Сообщество профессионалов в области работы с данными и искуственным интеллектом
Show more2 127
Subscribers
No data24 hours
-47 days
-1330 days
Posts Archive
2 127
“AI Won't Replace Humans — But Humans With AI Will Replace Humans Without AI.” Harvard Business Review, 4 August, 2023
Это замечательная фраза, которая по мнению нашей редакции максимально точно описывает текущие возможности технологий AI и обозначает их место в нашей жизни и работе. И, конечно, с того момента, как ChatGPT стал публично доступен в виде B2C приложения мы стали активности использовать эту модель (ну и все другие так же) в своей работе.
Казалось бы - прорывная технология, максимально простая в использовании, довольно доступная широкому кругу потребителей и все должны ею активности пользоваться. Но давайте посмотрим на статистику - на текущий момент у ChatGPT глобально 180 мл пользователей. Если считать от общего количества людей на планете - то получается всего около 2-2.5% населения хоть раз ею пользовались. Другие модели сюда плюсовать имхо не стоит, потому что с большой долей вероятности их пользователи являются подмножеством пользователей ChatGPT.
Вот и получается хорошая характеристика уровня инертности людей и подтверждение тезиса о том, что все промывные инновации имеют довольно большой цикл адаптации, который надо учитывать в экономике ваших стартапов.
https://explodingtopics.com/blog/chatgpt-users
2 127
Дайджест статей
Lowe’s fine-tunes OpenAI’s models to improve ecommerce data quality
https://openai.com/index/lowes/
Principles of Modern Data Infrastructure
https://dzone.com/articles/principles-of-modern-data-infrastructure
Хранение данных в Postgresql
https://habr.com/ru/articles/841674/?utm_source=habrahabr&utm_medium=rss&utm_campaign=841674
Как наука о данных трансформирует здравоохранение
https://habr.com/ru/companies/sberbank/articles/841116/
Open Standards for Data Lineage: OpenLineage for Batch and Streaming
https://dzone.com/articles/open-standards-for-data-lineage-openlineage-for-ba
How To Conduct Effective Data Security Audits for Big Data Systems
https://dzone.com/articles/effective-data-security-audits-for-big-data-systems
Big Data в моде: как мы внедрили 1-to-1 персонализацию в каталоге и поиске
https://habr.com/ru/companies/lamoda/articles/840370/
Платформа данных 101: зачем она нужна и как ее построить
https://habr.com/ru/companies/arenadata/articles/840598/
Агрегация данных для аналитики продаж с помощью DataSphere Jobs и Airflow SDK
https://habr.com/ru/companies/yandex_cloud_and_infra/articles/839494/
Наш путь миграции on-prem аналитики в облако
https://habr.com/ru/companies/magnit/articles/837752/
Один за всех или каждый занят своим делом? Разбираемся в устройстве команд корпоративных хранилищ данных
https://habr.com/ru/companies/clevertec/articles/840328/
2 127
Цены на токены для LLM падают и это влияет на разработку ИИ-приложений
Эндрю Нг написал пост в своем блоге о том, как инновации в сфере оборудования, а также выпуск моделей с открытыми весами, таких как Llama 3.1 влияют на цену токенов для LLM.
Вот, на что обращает внимание Эндрю:
- OpenAI снизила цены на GPT-4: с $36 за миллион токенов при запуске в марте 2023 до $4 сейчас. Это~ 79% снижение цены в год.
Причины снижения цен:
- Выпуск моделей с открытыми весами (например, Llama 3.1).
- Конкуренция между провайдерами API (Anyscale, Fireworks, Together AI и др.).
- Инновации в аппаратном обеспечении от компаний: Groq, Samba Nova, Cerebras и других.
Какие он делает прогнозы:
- Ожидается дальнейшее быстрое снижение цен на токены.
- Это сделает экономически выгодными даже те ИИ-приложения, которые сейчас кажутся слишком дорогими.
Рекомендации для ИИ-компаний:
1. Фокусироваться на создании полезных приложений, а не на оптимизации затрат на LLM.
2. Рассмотреть возможность развертывания приложений, ожидая снижения цен в будущем.
3. Периодически пересматривать выбор модели, чтобы воспользоваться снижением цен или улучшенными возможностями.
Проблемы и возможности:
- Переход между провайдерами открытых моделей может быть относительно простым.
- Сложность проведения оценок (evals) при переходе на новые модели остается проблемой, но ситуация улучшается.
2 127
Вот и первый квадрат про AI Code Assistant подъехал.
Ожидаемо GitHub в лидерах, но и остальные не отстают.
https://aws.amazon.com/blogs/aws/aws-named-as-a-leader-in-the-first-gartner-magic-quadrant-for-ai-code-assistants/
2 127
Коллеги из Platforma не только изучили опыт Китая в части создания бирж данных но и поделились им в статье.
https://www.forbes.ru/tekhnologii/520274-big-data-s-molotka-kak-kitaj-sozdal-birzu-dannyh-i-nuzna-li-ona-rossii
2 127
Дайджест статей
Жизнь после SAP: импортозамещение платформы данных
https://habr.com/ru/companies/arenadata/articles/839516/
Data Architecture : A Brief Overview
https://medium.com/towards-data-engineering/data-architecture-a-brief-overview-a93286f3e1f7
When a Data Mesh Doesn’t Make Sense for Your Organization
https://barrmoses.medium.com/when-a-data-mesh-doesnt-make-sense-for-your-organization-20de8f3f48bd
Is Data Observability Critical to Successful Data Analytics?
https://sanjmo.medium.com/is-data-observability-critical-to-successful-data-analytics-d09b983b95c6
Best Practices for Data Lakehouse Ingestion
https://atwong.medium.com/best-practices-for-data-lakehouse-ingestion-201d72cf7d14
Maximizing Enterprise Data: Unleashing the Productive Power of AI With the Right Approach
https://dzone.com/articles/maximizing-enterprise-data-unleashing-the-producti-1
The rise of the data platform for hybrid cloud
https://www.technologyreview.com/2024/08/19/1096575/the-rise-of-the-data-platform-for-hybrid-cloud/
Personal Data Classification
https://medium.com/airbnb-engineering/personal-data-classification-2d816d8ea516
Poisoned Data — отравление данных для LLM и создание «Спящего Агента»
https://habr.com/ru/articles/833106/
2 127
@glyanka_ru 👀 — твой карманный гид по миру умопомрачителных интерьеров. Зависть соседей обеспечена! Подписывайся!
2 127
@glyanka_ru 👀 — твой карманный гид по миру умопомрачителных интерьеров. Зависть соседей обеспечена! Подписывайся!
2 127
Repost from Грешный Гурман
🤫 Хочешь узнать секрет идеального стейка? 🥩
👀 Ищешь ресторан, где подают самый вкусный борщ? 🍲
✨ Тогда тебе точно к @singurman ! ✨
"Грешный Гурман" — это канал для тех, кто любит вкусно поесть! 😋
Мы раскроем тебе секреты самых вкусных блюд:
* 🤤 Научим готовить так, чтобы пальчики оближешь!
* 🕵️♀️ Найдем лучшие рестораны, которые скрыты от посторонних глаз.
* 🍷 Подскажем, с каким вином лучше сочетать определенные блюда.
"Грешный Гурман" - это не просто еда, это гастрономическое приключение! 🗺️
Подписывайся, чтобы получить доступ к эксклюзивным рецептам, рекомендациям и секретам от настоящих гурманов!
✨ Вкусно покушать - это святое! ✨
2 127
Подписывайтесь на @banknota_rus — оперативно про банки, экономику и другие важные события. Иногда с щепоткой юмора.
2 127
Repost from Банкнота
Подписывайтесь на @banknota_rus — оперативно про банки, экономику и другие важные события. Иногда с щепоткой юмора.
2 127
Дайджест статей
AI assistant monitors teamwork to promote effective collaboration
https://news.mit.edu/2024/ai-assistant-monitors-teamwork-promote-effective-collaboration-0819
Improvements to data analysis in ChatGPT
https://openai.com/index/improvements-to-data-analysis-in-chatgpt/
Personal Data Classification
https://medium.com/airbnb-engineering/personal-data-classification-2d816d8ea516
LLM-Powered DevOps Assistant Clio Launches to Help Engineers Manage Cloud Infrastructure
https://www.infoq.com/news/2024/08/ai-devops-clio/?utm_campaign=infoq_content&utm_source=infoq&utm_medium=feed&utm_term=global
Architectural Patterns for Enterprise Generative AI Apps: DSFT, RAG, RAFT, and GraphRAG
https://dzone.com/articles/architectural-patterns-for-genai-dsft-rag-raft-graphrag
The Role of Data Governance in Data Strategy: Part 1
https://dzone.com/articles/the-role-of-data-governance-in-data-strategy-part
The Role of Data Governance in Data Strategy: Part II
https://dzone.com/articles/the-role-of-data-governance-in-data-strategy-part-1
The Role of Data Governance in Data Strategy: Part 3
https://dzone.com/articles/the-role-of-data-governance-in-data-strategy-part-3
Инфраструктура для data engineer Kafka
https://habr.com/ru/articles/836302/
Как мы перенесли архив данных из Teradata в GreenPlum с помощью Hadoop и PXF
https://habr.com/ru/companies/sberbank/articles/836942/
Poisoned Data — отравление данных для LLM и создание «Спящего Агента»
https://habr.com/ru/articles/833106/
Гайд по работе языковых моделей для начинающих
https://habr.com/ru/companies/skillfactory/articles/837366/
Как DWH и BI-аналитика может помочь устранить до 80% ошибок при планировании отгрузок на маркетплейсы
https://habr.com/ru/articles/837578/
Распределенные транзакции для самых маленьких
https://habr.com/ru/companies/maxilect/articles/837816/
Как мы переехали с Greenplum на Delta Table
https://habr.com/ru/articles/838112/
Build Efficient Recommender Systems with Co-Visitation Matrices and RAPIDS cuDF
https://developer.nvidia.com/blog/build-efficient-recommender-systems-with-co-visitation-matrices-and-rapids-cudf/
2 127
Ральф Кимбалл, Марджи Росс / Инструментарий хранений и анализа данных: полное руководство по размерному моделированию
«Сегодня тысячи компаний собирают и сохраняют большие данные о поведении своих клиентов, ассортименте, производственном процессе и других немаловажных для бизнеса вещах. Однако, чтобы принимать обоснованные решения на основе этих данных, недостаточно их просто собрать – нужно правильно их обработать и провести грамотный анализ. Благодаря этой книге вы освоите все необходимые инструменты для хранения и анализа большого
количества данных, научитесь правильно управлять ими и извлекать полезную информацию для развития бизнеса.»
Скачать книгу
2 127
AI-Генерация диаграмм, картинок, стикеров и заметок появилась в Miro, при это до п денег не спрашивает пока
2 127
Дайджест статей
Data Lineage из топора
https://habr.com/ru/articles/836648/
Прокачаться как аналитик данных: подборка полезных материалов для самостоятельного изучения
https://habr.com/ru/companies/pgk/articles/835044/
Машинное обучение в обучении человека. Развитие проекта RuLearn
https://habr.com/ru/articles/836458/
Chat With Your Code: Conversational AI That Understands Your Codebase
https://dzone.com/articles/conversational-ai-that-understands-your-codebase
Data Pipeline vs. ETL Pipeline
https://dzone.com/articles/data-pipeline-vs-etl-pipeline
Укрощение ClickHouse: почему ДанКо делает Visiology намного быстрее
https://habr.com/ru/companies/visiology/articles/835694/?utm_source=habrahabr&utm_medium=rss&utm_campaign=835694
2 127
@infocygan_ru — превращаем маркетинг в магию, а рекламу — в настоящее искусство! Раскрываем секреты влияния, обманки, и классических трюков маркетолога. Подписывайтесь!
2 127
Repost from Злой Банкстер
Подписывайтесь на @zloy_bankster — тут финансовая правда без прикрас. Новости и аналитика, которые помогут тебе разобраться в финансовом и банковском мире.
2 127
🔥 DataTalks 5.0 – конференция про работу с данными.
Хотите узнать, как государственный ИИ может улучшить жизнь граждан и помочь бизнесу? Нужна информация о передовых технологиях в области больших данных и кейсах их применения в российских компаниях? Тогда у нас для вас отличные новости – мы ответим на эти вопросы на DataTalks 5.0!
➡️ 17 и 18 сентября «Ростелеком» проведет 5-ю юбилейную конференцию про управление данными DataTalks.
В первый день мы ждем гостей в офисе ИТ-кластера «Ростелекома» в БЦ «Академик». В программе первого дня дискуссия с представителями гос. органов о том, как государственный ИИ помогает гражданам и бизнесу, доклады о практических кейсах управления данными и внедрения искусственного интеллекта, выставка отечественных продуктов для управления данными Дата-кластера «Ростелекома» и многое другое. Второй день пройдет в любимом всеми айтишниками режиме удаленки – в онлайн-режиме можно будет послушать технические лекции и задать вопросы экспертам.Ознакомиться с полной программой конференции, зарегистрироваться и оставить заявку на доклад можно по ссылке. 📞 А в канале DataTalks мы в ближайшие недели будем публиковать интервью со спикерами конференции.
2 127
Дайджест статей
История визуализации данных: краткий исторический очерк
https://habr.com/ru/companies/ddosguard/articles/834498/
Уроки, извлеченные из масштабирования до многотерабайтных датасетов
https://habr.com/ru/companies/magnus-tech/articles/834506/
Apache Kafka + Flink + Snowflake: Cost-Efficient Analytics and Data Governance
https://dzone.com/articles/kafka-flink-snowflake-cost-efficient-analytics-data
От текста к краткому изложению: библиотека Sumy
https://habr.com/ru/companies/otus/articles/832940/
Data Governance: Key takeaways from the Gartner Data & Analytics Summit
https://medium.com/selectstar/data-governance-key-takeaways-from-the-gartner-data-analytics-summit-41572285a7d9
Data lake vs data warehouse: What’s the difference?
https://medium.com/capital-one-tech/data-lake-vs-data-warehouse-whats-the-difference-da95b0ccb8c9
Do We Need the Lakehouse Architecture?
https://blog.det.life/do-we-need-the-lakehouse-architecture-f1a43bd2713d
Apache Superset 2024. Лучшие практики
https://habr.com/ru/companies/otpbank/articles/815689/
