Мишин Лернинг 🇺🇦🇮🇱
Open in Telegram
Субъективный канал об искусстве машинного обучения, нейронных сетях и новостях из мира искусственного интеллекта.
Show more7 965
Subscribers
No data24 hours
-77 days
-4930 days
Posts Archive
7 965
DALL•E 3 от ОпенAI — Д И Ч Ь
генерить тут 👉 https://www.bing.com/create
🌊 делиться результатами тут (нейроэстетика re_hub)
7 965
🦔 OpenAI обучили DALL-E 3
Сложно назвать это релизом, скорее просто неплохая модель, работающая в связке с GPT-4. Мне лично кажется, что следующий Stable Diffusion будет куда умнее и интереснее эстетической точки зрения.
2021 DALL-E 1 — 12B модель, пейпер / API нет
2021 GLIDE — 2B модель, пейпер + опенсорс 300M модели
2022 DALL-E 2 — 2B модель, пейпер unCLIP + API
2023 DALL-E 3 — Хрен пойми что это, но будет интеграция с GPT-4 для подписчиков ChatGPT+
Про DALL-E 3 на сайте OpenAI
7 965
🦙 Llama 2 — Meta обучили и опенсорснули новую LLM Llama 2 (и внимание!) для коммерческого использования
Обучили 2 группы моделей: Llama 2 и Llama 2-Chat:
— Llama 2 обучена на открытых данных (размер корпуса увеличилина 40% в сравнение с Llama 1), удвоили контекст, используя adopted grouped-query attention (Ainslie et al., 2023).
— Llama 2-Chat это зафайтюненная с помощью RLHF (Reinforcement learning from human feedback) версия Llama 2, оптимизированная для диалогов (как Chat-GPT или GPT-4)
Опенсорснули Llama 2 с параметрами:
— Llama2-7B
— Llama2-13B
— Llama2-70B
Обидно то, что еще обучали Llama2-34B модель, но не зарелилзили. Именно там самый высокий TruthfulQA = 67.20, против 64.14 у Llama2-70B
Лицензия позволяет юзать Llama-2 не только для ресерча, но и для коммерческих целей!
По метрикам это лучшая опенсорс LLM-ка, а по качеству Llama2-Chat-70B, местами, сопоставимая с Chat-GTP 3.5
📄 Paper
📇 Blog
💻 Download Llama2
7 965
OpenAI выпустили приложение ChatGPT для iOS
Теперь GPT-4 стал находиться на расстоянии одного тапа.
ChatGPT for iOS
7 965
OpenAI выпустили приложение ChatGPT для iOS.
Теперь GPT-4 от нас на расстоянии одного свайпа и тапа.
📱ChatGPT for iOS
7 965
Google, google…
tl;dr гонка LLM в разгаре, и гугл пытается выжить. Натренировал PaLM-2. Но в этот раз не выпендривались оверпарасетрайзингом, так как в Шиншилла-эпоху бабло пустили на токены. Ну хоть на этом спасибо.
really tl;dr вся суть предсмертной агонии google на поле битвы поисковиков в одном ролике
7 965
🚨 Бесплатное Demo сети DeepFloyd IF теперь работают со всех браузеров и со смартфонов. Удачной генерации.
🤗 Папа, не генерь!
7 965
Примеры генераций пользователей DeepFloyd IF. Приятно видеть то, что люди делают с нашей нейронной сетью 🙃
7 965
Repost from DeepFloyd
Soo... Finally! Meet IF – a state-of-the-art text-to-image model that can also generate 'I ❤️ DeepFloyd' on your mug
👀 https://huggingface.co/spaces/DeepFloyd/IF
🐱 https://github.com/deep-floyd/IF
🔻 https://deepfloyd.ai/
@deepfloydai
7 965
👾 Мы DeepFloyd (Research AI Lab at StabilityAI) зарелизили лучшую Text-to-Image модель DeepFloyd IF
DeepFloyd IF это новая каскадная диффузионная модель основанная на идеи Imagen от Google:
— Текст кодируется T5 XXL v1.1
— Далее интерпретируется в пиксели через IF-I-XL (4.3B UNet), генерирующий изображения в 64х64
— IF-II-L (1.2B кастомный Optimal UNet) апскелит изображения 64х64 в 256х256, используя T5
— Для финальной картинки в 1024х1024, благодаря модульному подходу, можно использовать IF-III-L (пока не опенсорснут) или Stable x4
Благодаря тому, что:
— Модель параметризирована сильнее чем GLIDE, DALL-E 2, Imagen, eDiff-I: 2B против 4.3B у DeepFloyd IF
— Апскейлеры больше и имеют более оптимальную архитектуру в сравнение с Image и DALL-E 2
🏆 DeepFloyd IF выбивает Zero-Shot COCO@30K SOTA, тем самым являсь лучшей Text-to-Image моделью не только в опен-сорсе, но и вообще!
💻 Сайт лабы DeepFloyd
🤖 Страница нейроки DeepFloyd IF
👽 DeepFloyd Дискорд
🖥 GitHub
🤗 HuggingFace
👾 Генерить тут: Demo 👈
7 965
Repost from эйай ньюз
🔥DeepFloyd IF: новая text-2-image модель
StablityAI выпустили новую модель, которая очень похожа на Imagen от Google, но работает лучше и в open-source.
Архитектура IF, как и у Imagen состоит из трех диффузионных моделей, каждая из которых работает в пространстве RGB и прогрессивно увеличивают картинку. Сначала Text→64×64, затем (Text+64×64)→256×256, и наконец (Text+256×256)→1024×1024. А текст кодируется с помощью текстового энкодера T5.
Почему это круто?
— IF неплохо умеет генерировать текст (я даже генерил в канале ранее), явно лучше чем StableDiffusion XL
— Нормальная открытая имплементация по типу Imagen, которой до сих пор не было. Возможно с какими-то трюками, о которых мы узнаем, когда авторы выпустят блогпост
— FID скор измеряет похожесть снеренированных картинок на реальные. Это чуть ли не основная метрика для качества генерации. У IF FID=6.7, тогда как у Imagen 7.3. Меньше — лучше. Разрыв не космический, но приличный.
Код выложили, веса ждем тут. И ждем подробной статьи от авторов.
@ai_newz
7 965
prompt: a sunny side up egg but the yolk is blue. blue round yolk. the colour of yolk is blue
Красота никогда не давалась легко
7 965
🤗 HuggingChat доступен для всех
Удобный опенсорсный анлога ChatGPT на базе OpenAssistant (RLHF тюн LLaMa oasst-sft-6-llama-30b)
Потестил. Нейронку на numpy написало. Скажу, что OpenAssistant показывает очень неплохие результаты, хотя она и слабее ChatGPT. Не говоря уже про 4.
👉 https://huggingface.co/chat/
7 965
Repost from Нейроэстетика
III
prompt: perfect cute face 35mm analog portrait of a beautiful asian girl in a diner, sitting near the window, short hairs, tate modern, oil art, detailed texture, realistic body. by lucian freud, by david hockney. contemporary art. oil art, large strokes. oil art photo realism. hyper realism.
