fa
Feedback

فریب کلاهبرداران را نخورید! تل‌متریو این کانال‌ها را شناسایی و برچسب‌گذاری می‌کند 👉 برای مشاهده برچسب، اشتراک تهیه کنید 👈

Dendi Math&AI

Dendi Math&AI

رفتن به کانال در Telegram

Канал Дениса Димитрова о математике и искусственном интеллекте. В основном разные интересные и актуальные новости и мысли. Руковожу командами Sber AI Research и AIRI FusionBrain

نمایش بیشتر
1 754
مشترکین
-124 ساعت
-37 روز
+1530 روز

در حال بارگیری داده...

ابر برچسب‌ها
هیچ داده‌ای
مشکلی وجود دارد؟ لطفاً صفحه را تازه کنید یا با مدیر پشتیبانی ما تماس بگیرید.
اشارات ورودی و خروجی
---
---
---
---
---
---
جذب مشترکین
دسامبر '24
دسامبر '24
+70
در 8 کانال‌ها
نوامبر '24
+36
در 0 کانال‌ها
Get PRO
اکتبر '24
+48
در 1 کانال‌ها
Get PRO
سپتامبر '24
+42
در 0 کانال‌ها
Get PRO
اوت '24
+503
در 1 کانال‌ها
Get PRO
ژوئیه '240
در 1 کانال‌ها
Get PRO
ژوئن '240
در 6 کانال‌ها
Get PRO
مه '240
در 1 کانال‌ها
Get PRO
آوریل '240
در 2 کانال‌ها
Get PRO
مارس '240
در 0 کانال‌ها
Get PRO
فوریه '240
در 0 کانال‌ها
Get PRO
ژانویه '240
در 0 کانال‌ها
Get PRO
دسامبر '230
در 0 کانال‌ها
Get PRO
نوامبر '230
در 0 کانال‌ها
Get PRO
اکتبر '230
در 0 کانال‌ها
Get PRO
سپتامبر '23
+69
در 0 کانال‌ها
Get PRO
اوت '23
+86
در 0 کانال‌ها
Get PRO
ژوئیه '23
+1 800
در 0 کانال‌ها
تاریخ
رشد مشترکین
اشارات
کانال‌ها
21 دسامبر+1
20 دسامبر+4
19 دسامبر+1
18 دسامبر+1
17 دسامبر+3
16 دسامبر+5
15 دسامبر+1
14 دسامبر+3
13 دسامبر+16
12 دسامبر0
11 دسامبر+2
10 دسامبر0
09 دسامبر+1
08 دسامبر0
07 دسامبر+3
06 دسامبر+29
05 دسامبر0
04 دسامبر0
03 دسامبر0
02 دسامبر0
01 دسامبر0
پست‌های کانال
🦌 RUDOLPH 🦌 Наконец-то дошли руки написать о нашей давней разработке, о модели RUDOLPH (RUssian Decoder On Language Picture Hyper-tasking), которая умеет решать много задач в модальностях текст и изображение и которая уже успела побывать бейзлайном соревнования FusionBrain Challenge 2.0 в 2022 году (и даже заняла там почётное третье место). 💡 Архитектурно модель представляет собой декодер-блок трансформера, работающий с входной последовательностью токенов, которую можно условно разделить на три основных сегмента: левые текстовые токены, токены изображения и правые текстовые токены. За счёт этого на претрейне можно показывать модели сэмплы по 3 задачам: text2image (генерация изображения по тексту), image2text (описание изображения) и text2text (языковое моделирование в левых текстовых токенах). 💡 Мы обучили 4 версии модели, которые различаются между собой как количеством параметров (соответственно, количеством и размером скрытых слоёв), так и соотношением количества токенов текста и изображения: 👉 RUDOLPH-350M 👉 RUDOLPH-1.3B 👉 RUDOLPH-2.7B 👉 RUDOLPH-2.7B-FBC2 💡 Последняя из этих моделей была дополнительно дообучена на инструктивном датасете (когда это ещё не стало мейнстримом 😊) решать 6 прикладных задач в модальностях текст и изображение: Text QA, Math QA, Image Generation, Image Captioning, Visual QA, Text Recognition in the Wild. RUDOLPH даже немного умеет в zero-shot object detection (после соответствующего файнтюна). Фишка этой версии модели также и в том, что она может понимать формулировку задачи на естественном (русском) языке 💪 Подробнее почитать про архитектуру RUDOLPH, узнать детали обучения и файнтюнинга, посмотреть примеры работы модели можно тут: 👉 Хабр Воспользоваться и протестировать RUDOLPH можно тут: 👉 GitHub 👉 HuggingFace 👉 Cloud В создании и обучении RUDOLPH успели принять участие многие ребята (@AShonenkov, @lizagonch - вам отдельное спасибо 👍, @kuznetsoff87, @bra_ket, @NastyaMittseva, @bom_bo0m👌). Всем огромное спасибо за крутую и качественную работу! @dendi_math_ai

2
🔺 Это GigaChat Друзья, несколько месяцев мы экспериментировали с инструктивным обучением и потихоньку начинаем делиться нашими наработками в области ChatGPT-подобных моделей. 🔸 Сегодня мы хотим анонсировать наше творение, которое было решено назвать GigaChat, а модели в его основе — NeONKA. 🔸 Текущая версия основана на претрейне ruGPT3.5 13B + SFT (supervised fine-tuning). 🔸 В side by side тестах GigaChat vs ChatGPT (когда разметчики выбирают предпочтительный вариант) результат — 30:70 в пользу последней (начинали с 3 против 97). 🔸 Детали "Неонки" мы будем потихоньку выкладывать в открытый доступ, чтобы сообщество могло самостоятельно тренировать подобные модели. 👉 Хабр
819