тоже моушн
Open in Telegram
нейромагия + моушн дизайн тренды, новости, эксперименты связь с автором @vsewall чат канала https://t.me/+rmQcCIEN93ExMjUy
Show more9 841
Subscribers
No data24 hours
-227 days
-8430 days
Posts Archive
9 841
ArcaneGAN для видео на huggingface! без регистрации и смс) отправляешь файл, жмешь submit, ждешь, забираешь
9 841
допилил колаб для стилизации видео в аниме. теперь обрабатывает весь кадр. из нового:
можно подключить гугл.диск (с ним загрузка и скачивание гораздо быстрее);
фреймрейт и звук оригинального видео сохранятся в стилизованном;
после стилизации добавил улучшение алгоритмом Real-ESRGAN.
нужно помнить что сеть обучена на лицах и если их в кадре не определит, получится абстракция, примеры можно увидеть тут
новый колаб
предыдущая версия
animegan2-pytorch
Real-ESRGAN
9 841
👘 NeuralWardrobe v.1.0 👔
Около месяца назад меня посещала мысль погенерировать СтайлГАНом какие-нибудь новые модные наряды, но буквально недавно я наткнулся на примеры создания образов с помощью ruDALL-E и был приятно удивлен. Качество потрясающее и генерируется относительно быстро. А с помощью встроенного переводчика вы можете на любом языке подсказывать этому НейроГардеробу то, какую именно одежду вы хотите на себе видеть.
P.S. На примере выше Илон в спортивном костюме, Девушка из Матрицы в деловом костюме и Кристиан в платье. Каждый из этих наборов (8 картинок) генерировался 30 минут.
https://colab.research.google.com/github/tg-bomze/collection-of-notebooks/blob/master/NeuralWardrobe.ipynb
9 841
однажды я уже рассказывал про этого сумасшедшего видеохудожника. Glenn Marshall не перестает удивлять. здесь vqgan+clip явно внутри pytti с добавлением optical flow
9 841
слегка аркейнизировался с помощью ArcaneGAN v0.3 от @derplearning вот в этом колабе. для пущей красивости еще прогнал результат через Real-ESRGAN. мне нравится что получается, хотя есть несколько деталей которые смущают - статичная текстура губ, странное наполнение рта если он открыт, вторые брови если сильно их поднимаешь и конечно мерцание окружения, которое видно только в анимации. но это все придирки, крутой результат!) в колаб кстати можно закинуть секвенцию картинок и получить что то подобное
на волне хайпа даже сериал пришлось начать смотреть, ниче такой, красивый, и местами интересно
9 841
допилил колаб для стилизации видео в аниме. из нового:
можно подключить гугл.диск (с ним загрузка и скачивание гораздо быстрее);
фреймрейт и звук оригинального видео сохранятся в стилизованном;
после стилизации добавил улучшение алгоритмом Real-ESRGAN.
нужно помнить что сеть обучена на лицах и если их в кадре не определит, будет абстракция, примеры можно увидеть тут
новый колаб
предыдущая версия
animegan2-pytorch
Real-ESRGAN
9 841
нейроцензор от автора канала MLart получил обновление и теперь умеет замазывать лишнее с учетом time consistent (согласованность между кадрами). MTTR по текстовому запросу выделяет объект, а для его удаления можно выбрать алгоритм LaMa или FGVC. первый работает быстрее и оставляет странный призрачный эффект. второй удаляет гораздо лучше, но требует больше времени для просчета.
на видео сравнение прежнего и нового методов
колаб
9 841
🍿 Кому понравилась анимация в мультсериале Аркейн — теперь можно стилизовать любые фото и видео под мульт. На этой неделе @derplearning выкатил ArcaneGAN для превращения фото в стиль сериала, а сегодня на Reddit кто-то научил нейронку стилизовать также видео. Обрабатывается покадрово и получается вполне годно!
У этого есть и полезные применения: меньше затрат на стилизацию фильмов под мульты, а для пиара новинок можно выкатывать такие приложения для «аркейнизации» фото (берите на заметку, Netflix). Код проекта для стилизации видео пока не выпустили, ждём на GitHub. А на этом сайте можно перенести любое фото в Аркейн, работает почти мгновенно.
#Neural_network | Not Boring Tech
9 841
протестировал генерацию под музыку stylegan3 из этого колаба. до Lucid Sonic Dreams пока не дотягивает, но результат прикольный, очень гладкая анимация. надо теперь разобраться как накапливать смещение по латентному пространству как например в этом посте. кстати у меня есть подробный урок о создании анимации в колабе с помощью Lucid Sonic Dreams
9 841
✍️ NeuroCensor v.1.0 🚫
Версия 1.0, значит пока ничего серьезного. Хоть как-то работает, что уже хорошо, ведь все и всегда с чего-то простого начинается. В общем теперь можно выступать в роли цензора и удалять объекты, аля Черное зеркало, по текстовому описанию. Работает быстро, но есть вероятность, что памяти Колаба может не хватить на тяжелые видео, поэтому я поставил некоторые ограничения. Вместе с этим добавил возможность писать на любом языке (или сразу нескольких).
В видео продемонстрировано удаление «Grizzly bear» и «Мужчины в куртке».
https://colab.research.google.com/github/tg-bomze/collection-of-notebooks/blob/master/NeuroCensor.ipynb
9 841
крутую сетку которая умеет сегментировать объекты на видео по текстовому описанию теперь можно запустить в колабе
гитхаб
колаб
HuggingFace
9 841
один из ярких представителей pytti-арта собрал свои лучшие работы в почти двухчасовой ролик на ютубе. включай любимую музыку и улетай
ютуб
твиттер автора
9 841
9 841
мои попытки перепридумать Ebsynth для колаба еще не скоро принесут плоды. но глубоко погрузившись в эту тему я узнал кое что интересное: есть небольшая группа исследователей из Чешского Технического Университета в Праге, которые плотно сосредоточились над разными аспектами переноса стиля и именно они выдают самые крышесносные проекты, которые стреляют в motion design инфополе последние годы. самые популярные - Ebsynth и Monstermash. помимо этого есть ряд очень перспективных исследований (например по этой ссылке). кстати они почти не используют ИИ, в основном все решается за счет очень сложной математики.
2д флюидная симуляция
демо перенос стиля на 3д объект
реалтайм перенос стиля на видео
пусть звучит неоправданно пафосно, но это именно те люди которые формируют визуальный облик будущего анимации. и чую, в ближайшие годы они еще удивят нас несколькими очень мощными проектами и готовыми инструментами
9 841
в поисках интересного бесплатного VR контента для oculus quest 2 наткнулся на игру half half. и теперь знаю что бывают отличные игры для интровертов. предупреждение на входе - здесь никто никого не должен обижать. ничего милее я не видел.
графика - наивная, минималистичная и очень стильная. твой аватар в виртуальной реальности - странное эфемерное существо наподобие Безликого из Унесенных Призраками Миядзаки. и все вокруг такие же. диалоги между игроками звучат как бессмысленное детское "лалала" и это только усиливает иллюзорность происходящего. все вокруг танцуют, смешно двигаются и машут друг другу цветными лапками.
доступны несколько коллективных игр: просто полетать среди облаков на радужном кайте, совместить полеты с забиванием небольшой черной дыры в ворота противника, релакснуть утопая в бесконечном океане с рыбами итд.
и главная фишка half half - ПРЯТКИ! стильное геометричное игровое поле. водящий становится великаном а те кто прячется - уменьшаются в размерах и получают интересную механику перемещения - стреляют себя в новое место из рогатки чтоб перепрятаться.
короче это тот случай когда словами сложно адекватно передать детали, потому что авторы смогли придумать действительно атмосферную реальность со своей философией, образностью, фишечками. не столько игра, сколько vr experience. побольше бы таких инди игрушек. рекомендую!
9 841
Я думаю, что это популярная нейросетка, но я раньше не натыкался на неё. Cleanup.pictures может помочь удалить ненужные объекты. Причём она настолько идеально работает, что я сидел с открытым ртом и проклинал сотни часов, проведённых в фш со штампом или заплаткой))
9 841
🔥MTTR: End-to-End Text Referring Video Object Segmentation
Представлена новая SOTA в сегментации объектов на видео по их текстовому описанию. Качество просто невероятное!
Модель основана на мультимодальном трансформере, в который подаются фичи от текстового энкодера (RoBERTa) и видео энкодера (Video Swin). Примечательно, что в отличие от предыдущих решений, обучение здесь end2end — sequence prediction problem.
P.S. Авторы опубликали и код, и веса моделей 👍
Статья, GitHub
9 841
Отвал башки! Тут пацаны из гугла обучили NERF на RAW фотках. Получается просто башенного качества рендеринг HDR изображений. Можно менять экспозицию, фокус. Вы только посмотрите на получаемый эффект боке в ночных сценах!
Дополнительное преимущество этого метода перед обычным нерфом - это то, что он хорошо работает на шумных снимках с малым освещением. За счет того, что информация агрегируется с нескольких фотографий, метод хорошо справляется с шумом и недостатком освещения, превосходя специализированные single-photo denoising модели.
Статью ознаменовали как NeRF in the Dark: High Dynamic Range View Synthesis from Noisy Raw Images. Ну, разве что кода еще нет.
Сайт проекта | Arxiv
9 841
🦑 KAPAO | Новая сахарная SOTA на CrowdPose
KAPAO - это эффективный и точный single-stage метод детекции и оценки позы человека. Есть код и веса!
Ресерчеры представили 3 версии: KAPAO-S, KAPAO-M, KAPAO-L
- Эффективный (быстрый) и точный метод
- KAPAO-L(arge) бъет SOTA на CrowdPose
- Решение основано на yolov5 (s,m,l)
💻 Code 📰 Paper
p.s.: ребята шарят и умеют в demo!
