247
Subscribers
No data24 hours
No data7 days
No data30 days
Posts Archive
Как ИИ меняет традиционный подход к ведению бизнеса и как стимулировать инновации?
Завтра 15 апреля в 20:00 выступаю на онлайн площадке NES Points в Российской Экономической Школе.
Как выпускник я буду рад поделиться с сообществом школы частью того опыта, который приобрел с момента выпуска и во многом благодаря тем знаниям и людям, которых мне дала школа.
Приходите и вы, даже если не связаны с РЭШ, встреча открытая.
AI Прорыв
#ai #nespoints #business
Продолжая тему LLM:
1️⃣OpenAI сегодня добавил в чат ChatGPT новую версию GPT-4-turbo-2024-04-09, которая на прошлой неделе появилась в API и уже успела отвоевать первое место в рейтинге LMSYS обратно у Claude 3 Opus (это был первый случай, когда GPT4 уступил другой модели в этом рейтинге).
О новой версии модели GPT4-turbo говорят, что это значительное улучшение, рост способностей в рассуждении и математике, более естественный язык. Посмотрим!
2️⃣А еще Элон Маск анонсировал скорый выход grok-1.5V со способностью воспринимать видео (grok-1 был выпущен лишь месяц назад)
Развитие моделей продолжается, гонка между производителями становится все более интенсивной и интересной. Конкуренция.
3️⃣Яндекс подключил к Алисе новую версию модели YandexGPT, благодаря чему она стала чаще отвечать сама и реже обращаться за ответом в поиск по интернету. Также появилась возможность подключить еще более мощную версию YandexGPT PRO, работающую на русском чуть лучше ChatGPT-3.5.
Получается Российские LLM-модели отстают от западных на 1.5-2 года. Что ж, хочется верить, что разрыв будет сокращаться, а не расти, хотя это и не простая задача.
#ai #llm #chatgpt #claude #grok #yandexGPT
Модель Command-R+ от Cohere – новый лидер рейтинга LMSYS среди OpenSource моделей (писал о нем ранее), она обошла прошлого OpenSource лидера Mistral-Large-2402 и даже некоторые версии платной GPT-4.
Главный плюс OpenSource моделей – их можно разворачивать на собственном железе, не зависеть от стороннего платного API от OpenAI/Google/Anthropic или других и не передавать ни куда свои данные.
Попробовать модель можно бесплатно на HuggingFace/chat
AI Прорыв
#ai #CommandR #LLM #emcr
5️⃣ Udio – еще один стартап по генерации музыки в продолжение темы.
Генерует и музыку, и вокал в хорошем качестве.
Примеры:
1) https://www.udio.com/songs/xtju1X31YfVbKWTCGd4yw7
2) https://www.udio.com/songs/jGjYfsRosZjYTkSBdFgEyF
3) https://www.udio.com/songs/oVgnC3RmxscmB4bUGg2MBn
Инструкция
Пробовать можно бесплатно до 1200 песен в месяц, пока идет бета-тест, но сейчас новых пользователей отправляют в лист ожидания из-за большого числа желающих.
#ai #music #udio
Еще один вариант обучения
Для своих корпоративных клиентов, нынешних и потенциальных, не могу не упомянуть, что со своей компанией belkin.digital регулярно провожу обучения:
– Работе с LLM (промпт инижинирингу)
– Основам ИИ, включая генеративный ИИ
– Поиску бизнес-кейсов применения ИИ
– Подходам к управлению ИИ-проектами в компании
– Подходам к ИИ-трансформации бизнеса
Участники обучений – ТОП-руководители, средний менеджмент и тим-лиды компаний.
Возможны форматы онлайн и офлайн. Нахожусь в Москве, но возможны поездки.
Большинство проектов закрыты NDA (nondisclosure agreement), я не могу о них говорить. Из того, о чем сказать могу, пример вот.
Среди клиентов представители индустрий: банки, страховые, EdTech, консалтинг
🤝 Связаться для сотрудничества со мной можно по контактам на сайте belkin.digital
Очень часто получаю вопросы о том, где можно обучиться промпт-инжинирингу, то есть работе с языковыми моделями (LLM), такими как ChatGPT, Gemini, Claude и другими.
У меня нет хорошей рекомендации для обучения на русском (если у Вас есть – поделитесь!)
Но есть хороший список курсов и руководств разного уровня для самостоятельного изучения:
1. Официальное руководство от OpenAI +CookBook открытый сборник примеров и практик
2. Официальное руководство от Anthropic, создателей языковой модели Claude
3. Курс для начинающих от Microsoft (версия 2)
4. Курс ChatGPT Prompt Engineering for Developers course от Эндрю Ына (одного из самых известных в мире экспертов по ИИ)
5. Гайд от Элвиса Саравия (работал в компаниях Meta AI и Elastic), русская версия
6. Prompt Engineering for ChatGPT от платформы Coursera
7. Prompt Engineering Guide для начинающих от The Neuron
(это обновленная версия предыдущего поста на эту тему)
AI Прорыв
#ai #promptengineering #learning
Тихо и без громких анонсов в ChatGPT у ассистента DALL-E появилась функция редактирования изображений – можно выделить часть картинки кистью и попросить ее переделать, дав свои инструкции. Очень полезно, когда нужно поправить какую-то небольшую деталь.
Также заявляется, что можно и словами описать желаемые изменения.
Для редактирования кликнете на изображение и появится интерфейс: чат справа и кнопка с кистью вверху, похожая на @.
Работает все не очень стабильно, будьте готовы сделать несколько попыток, чтобы получилось.
Документация:
https://help.openai.com/en/articles/9055440-editing-your-images-with-dall-e
Статья:
https://x.com/aliejules/status/1774991275600625805
#ai #DALLE3 #ChatGPT
🚩Чуть не забыл еще один большой релиз генеративной модели для музыки – Stable Audio 2.0 от Stability.ai
Варианты работы:
- text-to-audio по текстовому промпту
- audio-to-audio из другой музыки
- vocals-to-audio, то есть можно просто напеть то, что хочешь и получить трек
Попробовать на stableaudio.com
Или послушать бесконечный стрим на Youtube, сгенерированный этой моделью.
Поговорим сегодня о музыке. Долгое время проблемой в генерации музыкальных произведений оставался вокал. Похоже это уже уходит в прошле.
1️⃣Модель Suno.ai вот уже несколько недель всех удивляет генерацией музыки с вокалом (да-да, даже текст сама делает, причем неплохо рифмует и на русском). Тут примеры даже не привожу, попробуйте сами бесплатно по ссылке выше.
2️⃣MusicFX от Google пока без вокала, зато получила возможность миксовать вообще любые стили при генерации музыки. Иногда можно получить весьма интересные варианты. Тоже пробовать бесплатно.
3️⃣Emo от Alibaba – нейросеть, оживляются портрет по звуку, может петь и удивительно создавать эмоции (изображение лица + звук = видео). Пример 1 и 2. В комбинации с 1 и 2 можно будет сразу музыкальные клипы делать. Пока не нашел ее в открытом доступе.
Главные преимущества генеративной музыки:
– быстро
– дешево
– гибкость управления, легко посмотреть разные варианты настроения, стилей и аранжировок, перебрать идеи
– без ограничений авторских прав (обычно, но не всегда)
Главные недостатки:
– качество звучания не топ
– отсутствие точного контроля результата (если вы музыкант, вам проще самому сыграть спеть, чем заставить эту штуку дать в точности то, что вам нужно)
– отсутствие новизны – работа с существующими стилями (фундаментальное ограничение ИИ, ведь он учится на примерах)
– и все таки настоящую человеческую музыку ни что не заменит 🙂
А вы стали бы использовать генеративную музыку? Или может быть уже используете. Если да, как именно?
Repost from Ai Filmmaker
Синтетическое кино еще ближе? Или OpenAI опять нагоняет хайп?
Вчера на официальном сайте OpenAI первым представителям креативной индустрии дали пощупать всеми ожидаемую SORA. Посмотреть все работы и почитать впечатления участников закрытого тестирования можно здесь.
Мне же из всей подборки хочется показать вам только два ролика, которые на мой взгляд стоят внимания. Остальные выглядят как расширенные технодемки, которыми OpenAI постоянно спамит весь интернет заставляя представителей медиаиндустрии и корпорации впадать в экзистенциальный кризис.
1. Короткометражка “Air Head” от студии Shy kids . История про мужчину у которого вместо головы воздушный шарик. Показывает насколько сильно изменится короткая форма визуальных историй в ближайшем будущем. Безграничные возможности создания фотореалистичного сюрреализма позволят найти новые самые безумные и яркие формы для рассказа коротких историй. Поэтому важно развивать навыки внятного и увлекательного рассказа историй любыми визуальными средствами, чтобы не утонуть в потоке бессмысленного "артхауса" который затопит соц.сети после релиза SORA.
2. Музыкальное видео режиссера Paul Trillo. Это нельзя назвать полноценным клипом, но уже выглядит как "метеорит" летящий в сторону индустрии музыкальных видео, но когда он упадет неизвестно. Уверен мы увидим немало шедевральных клипов, когда режиссеры не будут скованы ограничениями бюджетов и возможностей производства.
Но когда все это дадут в открытый доступ? Вопрос до сих пор висит в воздухе. Есть обещания, но никаких конкретных дат нет. К тому же в еще одной статье рассказывается как Сэм Альтман (сооснователь OpenAI) торгует лицом на вечеринках киноиндустрии в Лос-Анджелесе. Подозреваю, чтобы не нажить себе могущественных врагов , бизнес которых очень пошатнет появление Sora в открытом доступе. И если интеграция в кинобизнес будет успешной, дадут ли нам плебеям доступ к божественной силе нейромиров?
Вопрос остаётся открытым. А пока смиренно ждем и надеемся на светлое нейро будущее.
Google открыл бесплатный доступ к языковой модели ассистенту Gemini Pro 1.5 с контекстным окном 1M токенов и возможность загружать туда документы и видео до 1 часа. Русский язык поддерживается.
https://aistudio.google.com/app/prompts/new_chat
Тестируем! 👍🔥
P.S. Не забудьте включить VPN в поддерживаемом регионе.
AI прорыв
#Gemini #ai #genAI #google
Repost from LLM под капотом
RAG Challenge на годовых отчетах компаний
В последнее время в комментариях было много обсуждений про эффективность разных подходов. Особенно вектора против knowledge maps. Но ведь технологии совсем не важны. Важно только, работает в итоге AI система с LLM под капотом или несет пургу.
И это можно измерить и сравнить. В чатике канала в итоге договорились до небольшого дружеского соревнования 🍻
Идея такая. Каждый желающий пилит свой RAG, который может давать ответы на вопросы по пачке годовых отчетов компаний. Вопросы на information retrieval - сколько человек работает в компании X? У какой компании ликвидность больше? У кого есть виноградники во Франции, и в каких провинциях. Вкладывается ли компания Y в green bonds? итп
Кстати, если у кого-то получатся хорошие результаты - это круто. Ведь кейс интересен стартапам и компаниям побольше. Это прямо ассистент для отдела продаж.
Каждый пилит свой RAG или использует существующую систему. Главное, чтобы там было две фишки:
1. Возможность загрузить тестовый набор отчетов (выберем случайно все вместе, штук 100)
2. Возможность загрузить список вопросов и получить список ответов.
Между первым и вторым шагом может пройти, скажем, часов 5-6 (чтобы система могла переварить данные, посчитать embeddings или прогнать экстракторы)
Исходники открывать не обязательно.
Если кому-то интересно, вот ссылка на набор файлов для обучения - ZIP, 100 MB. В тестовом наборе файлов их, естественно, не будет.
Что скажете?
Ваш, @llm_under_hood 🤗
PS: Что по срокам?
Я предлагаю так сделать - как несколько человек готовых наберется (хотя бы пара), то сформируем набор вопросов с документами и прогоним тесты вместе.
Если потом еще кто-то подтянется, можно заново будет это повторить, на новых документах и вопросах.
Когда я работал в финансах СБЕРа, команды IR и аналитики очень интересовались возможностью автоматически извлекать информацию из годовых отчетов компаний. Что ж, время пришло, инструменты все есть.
Возможно кому-то из коллег по финансам даже будет интересно поучаствовать в этом конкурсе :-)
(См. следующее сообщение)
Исследование творческих способностей ИИ-моделей, опубликованное в Nature/Scientific Reports 10 февраля, было множество раз процитировано в духе "Нейросеть обошла людей в креативности в тестах на творческое мышление". В исследовании принимали участие 151 человек и модель GPT4.
В тестах предлагалось придумать:
– нестандартные способы использования вилки и веревки,
– нестандартные ответы на вопрос "что если?" для ситуаций, что "людям не нужно спать" и "люди ходят на руках"
– как можно больше слов максимально различающихся по смысловому содержанию
Эти задания раскрывают взгляд науки на творческие способности, как на способность генерировать разнообразие в ответах. Возможно это и хорошая метрика разнообразия/ограниченности мышления. Но для меня это в корне отличается от творчества. Это лишь одна из компонент.
Для меня, как для художника, творчество – это способность художника почувствовать и выразить то, что у него внутри.
По этому определению невозможно сравнивать творчество ИИ и человека, так как для ИИ нечего чувствовать "внутри", это алгоритм обработки информации "данные на вход – данные на выход". Из определения следует, что роль ИИ – быть инструментом в руках художника, расширять интеллектуальные способности по сбору, сопоставлению, анализу и обработке информации для задач человека, устранять барьеры мышления и т.д.
Это подтверждается тем, что самый значимый фактор стоимости художественного произведения – личность художника, что хорошо известно в арт-бизнесе.
Я верю, что Человек – нечто большее чем Интеллект. И, что все глубинно человеческое, например любовь, творчество, красота, интуиция, свобода, стремление к истине... происходит не от ума, а из души и от сердца.
Я уверен, что помня об этом, люди смогут получить от ИИ больше пользы. И поэтому все свои проекты в области ИИ я тоже стараюсь направлять на раскрытие человеческих способностей 💫
А вы как считаете? Что для вас творчество? Обгонит ли ИИ человека в этом? Поделитесь в комментариях
AI Прорыв
#ai #art #GPT4 #creativity
За прошедшие 2 недели набралось немало интересных новостей. Ценю ваше время и делюсь в виде дайджеста:
1️⃣ Гуманоидный робот Figure 01, рожденный из партнерства Figure.ai и OpenAI (объявленного всего 2 недели назад), свободно управляет своими "руками" и общается как человек.
🌟 Мой комментарий:
2024 год обещал быть годом роботов и прогнозы сбываются. Будущее надвигается так стремительно, что порой реальность становится неотличима от фантастического фильма.
2️⃣X.ai (Илон Маск) опубликовал в Open Source модель Grok-1, ранее доступную только платным подписчикам X (бывшего Twitter). В модели Grok 314 млрд параметров, архитектура Mixture-of-experts и практически отсутствует цензура (готова ответить почти на любой вопрос 🔥).
🌟 Мой комментарий:
Во-первых, рад появлению еще одной OpenSource модели.
Во-вторых, при всей противоречивости ситуации (если смотреть детали) я уважаю стремление Илона Маска не дать революционным технологиям ИИ оказаться в одних руках на службе сугубо коммерческих интересов: он продолжает гнуть свою линию на открытость ИИ на фоне судебного иска, ранее поданного им против OpenAI. В иске он обвиняет OpenAI, которую основал и позже покинул, в нарушении ее собственного устава из-за закрытости ее ИИ разработок в угоду коммерческим интересам и Microsoft.
3️⃣Apple обсуждает с Google подключение модели Gemini к iOS 18 для внедрения генеративного ИИ в iPhone.
🌟 Мой комментарий: похоже Apple не добились желаемого успеха с собственными разработками языковых моделей и не хотят упустить стремительно растущий рынок ИИ приложений. У Google тоже есть трудности с моделями (хотя на фоне Apple это просто несколько легких неудач в начале пути), так что вероятно обе компании надеятся получить импульс к развитию через это партнерство. Скорее всего Apple будет отрабатывать интеграцию своих приложений с LLM Gemini (промпт-инжиниринг и т.д.) и продолжать попытки создать свою модель (о чем говорит их недавняя публикация статьи о модели MM1), чтобы потом просто заменить LLM на свою.
AI Прорыв
#ai #grok #LLM #OpenAI #Figure #Gemini #Apple #Google #Xai #MM1 #emcr
Кстати, вот тут, на сайте этого рейтинга, на вкладке Direct chat можно потестить ЛЮБУЮ модель рейтинга, включая новую Claude 3 и другие.
Это совершенно бесплатно и доступно без VPN и регистраций. Только время ответа чуть хуже, чем на официальных сайтах/API.
Пользуйтесь :-)
AI Прорыв
#ai #claude3 #LLM #emcr
Похоже, что Claude 3 действительно хороша, а ее создатели Anthropic в очередной раз показали, на что способны.
Claude 3 Opus заняла третью строчку в leaderboard arena на huggingface, обогнав Gemini pro от Google и более ранние версии GPT4.
Про этот рейтинг писал выше. Напомню, там пользователи попарно сравнивают ответы моделей на свои вопросы и выбирают лучшую, не зная, какая модель им отвечала, то есть вслепую. Десятки тысяч таких тестов и рейтинговая система Elo, как в шахматах, дают итоговый рейтинг модели.
Про этом модель Claude 3 Sonnet, чуть менее мощная в той же линейке, заняла 6 строчку, став более бюджетной альтернативой gpt4, практически не уступающей ему в качестве.
Пожалуй стоит присмотреться для использования. Ну и будем дальше следить за результатами в бизнес применении.
#ai #claude3 #gemini #gpt4 #emcr
Anthropic выпустил семейство моделей Claude-3, мощнейшая из которых превосходит GPT4 и Gemini Ultra по ряду бенчмарков согласно отчету Anthropic.
Семейство предлагает 3 варианта модели: Opus, Sonet и Haiku, где опус самый мощный, а хайку самый быстрый.
— Окно контекста 200К токенов с увеличением до 1М по запросу.
— Text-to-text и image-to-text способности.
— доступ по API и с сайта
Пока не тестировал, очень интересно попробовать. И посмотреть результаты независимых тестов.
AI прорыв
#ai #anthropic #claude3 #emcr
Продолжая тему карт экосистемы генИИ, предлагаю для сравнения карту от Sequoia, одного из топовых VC фондов, активно инвестирующих в ИИ.
Карта интересна тем, что на ней хорошо раскрыт технологический стек (второй файл). Правда модели Sora нет и здесь. Не просто поспеть за прогрессом ИИ 😅
+1 карта рынка от a16z в комментариях.
AI Прорыв
#ai #genAI #emcr #sequoia #a16z
