Метаверсище и ИИще
Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие. Для связи: @SergTsyp
Больше📈 Аналитический обзор Telegram-канала Метаверсище и ИИще
Канал Метаверсище и ИИще (@cgevent) языкового сегмента Русский является активным участником. Сейчас сообщество объединяет 51 482 подписчиков, занимая 375 место в категории Искусство и дизайн и 11 912 место в регионе Россия.
📊 Показатели аудитории и динамика
С момента создания невідомо проект демонстрирует стремительный рост, собрав аудиторию из 51 482 подписчиков.
Согласно последним данным от 26 августа, 2026, канал показывает стабильную активность. За последние 30 дней изменение числа участников составило 146, а за последние 24 часа — 19, при этом общий охват остаётся высоким.
- Статус верификации: Не верифицирован
- Уровень вовлечённости (ER): Средний показатель вовлечённости аудитории составляет 15.62%. В первые 24 часа после публикации контент обычно набирает 10.27% реакций от общего числа подписчиков.
- Охват публикаций: В среднем каждый пост получает 8 041 просмотров. В течение первых суток публикация набирает 5 289 просмотров.
- Реакции и взаимодействия: Аудитория активно поддерживает контент: среднее количество реакций на один пост — 82.
- Тематические интересы: Контент сосредоточен на ключевых темах, таких как claude, seedance, контекст, нейропрожарка, редактирование.
📝 Описание и контентная политика
Автор описывает ресурс как площадку для выражения субъективного мнения:
“Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие.
Для связи: @SergTsyp”
Благодаря высокой частоте обновлений (последние данные получены 27 августа, 2026) канал поддерживает актуальность и высокий уровень охвата публикаций. Аналитика показывает, что аудитория активно взаимодействует с контентом, что делает его важной точкой влияния в категории Искусство и дизайн.
Загрузка данных...
| Дата | Привлечение подписчиков | Упоминания | Каналы | |
| 27 августа | +19 | |||
| 26 августа | +28 | |||
| 25 августа | +32 | |||
| 24 августа | +14 | |||
| 23 августа | +27 | |||
| 22 августа | +10 | |||
| 21 августа | +16 | |||
| 20 августа | +21 | |||
| 19 августа | +17 | |||
| 18 августа | +17 | |||
| 17 августа | +14 | |||
| 16 августа | +21 | |||
| 15 августа | +13 | |||
| 14 августа | +14 | |||
| 13 августа | +20 | |||
| 12 августа | +14 | |||
| 11 августа | +17 | |||
| 10 августа | +8 | |||
| 09 августа | +5 | |||
| 08 августа | +10 | |||
| 07 августа | +14 | |||
| 06 августа | +11 | |||
| 05 августа | +30 | |||
| 04 августа | +28 | |||
| 03 августа | +29 | |||
| 02 августа | +6 | |||
| 01 августа | +14 |
| 2 | Gemini Omni 1.1 Flash
Google сегодня, 27 августа, бахнула Gemini Omni 1.1 Flash.
Это уже не preview, а production-версия видеомодели gemini-omni-1.1-flash в Gemini API.
Главное обновление: теперь можно продлевать видео кусками по 10 секунд до суммарных 40 секунд, причём модель учитывает до 10 секунд предыдущего видео вместо примерно последней секунды, задавать первый и последний кадр для интерполяции, делать быстрые 360p-превью до 60% быстрее и примерно втрое дешевле 720p, а финал апскейлить до 1080p или 4K.
Старый gemini-omni-flash-preview отключат 30 сентября. Цена 720p остаётся примерно $0.10 за секунду видео.
Где пробовать:
Google Flow - самый простой способ попробовать без кода. Сегодня туда уже выкатили возможности Omni 1.1 Flash: start/end frames, 360p drafts и экспорт 1080p/4K.
https://blog.google/innovation-and-ai/models-and-research/google-labs/new-creative-controls-google-flow/
Google AI Studio - лучший вариант именно для тестирования модели и API. В документации модель называется gemini-omni-1.1-flash; можно тестировать генерацию/редактирование и затем сразу забрать код. blog.google
Открыть Google AI Studio
Gemini app - Omni также доступен подписчикам Google AI Plus/Pro/Ultra, но там пока непонятно, какая модель
https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/
https://ai.google.dev/gemini-api/docs/omni
@cgevent | 2 166 |
| 3 | Минимакс на Максималках
Речь за MiniMax H3 Max: post-trained версию H3 от Fal.ai, специально дообученную и оптимизированную под inference-стек fal.
Главная дичь здесь - скорость. Fal показывают генерацию 15-секундного видео за примерно 3.5-15 секунд,то есть быстрее реального времени. При этом они отдельно утверждают, что это не трюк с кэшем, агрессивной квантизацией или sparse attention и что сохраняется нативное аудио и нативное разрешение.
База при этом та же - MiniMax H3.
И это не H3 Turbo из какого-нибудь стороннего workflow, а их собственный post-training fal + их оптимизированный inference.
Они прямо пишут: “Try an early preview of our post trained version of H3.”
Судя по примерам, он очень хорош в моушен, иллюстрацию, анимацию.
И мне дико нравится все, что происходит вокруг Минимакса. Это прям времена – Stable Diffusion 1.5 – все чего-то тренируют, оптимизируют, выпускают.
Копаем дальше(для упоротых)
Они добавили свои данные и специально дообучали модель на prompt adherence и визуальное качество
Скорость реально безумная: около 3 секунд на 5 секунд видео. fal заявляет примерно 35x throughput относительно официального H3 endpoint.
fal утверждает, что ускорение получено не за счет агрессивной квантизации/ухудшения качества, а за счет совместной оптимизации самой модели и собственного inference engine.
480p и 768p, 24 fps, ролики 5-15 секунд, нативный stereo audio. Важный нюанс: обычный H3 на fal умеет 2K, а у H3 Max сейчас заявлен максимум 768p
Сейчас доступны text-to-video и image-to-video.
Веса H3 Max – какитаки веса?!. На вопрос о релизе fal ответили: “We’ll release it soon!” Но пока неясно, означает ли это именно веса или полноценный публичный релиз endpoint/инструментария.
Сам MiniMax ранее говорил, что официальный H3 уже CFG-distilled, а более экстремальные 4/8-NFE версии только исследуются. Поэтому H3 Max, похоже, отдельная ветка оптимизации fal, а не тот официальный distilled H3, о котором MiniMax говорил в AMA.
И еще любопытное: fal утверждает, что в их собственном blind benchmark H3 Max занял #1 по overall quality, prompt understanding и aesthetics, обойдя все протестированные ими ведущие видеомодели. Верим?
https://fal.ai/minimax-h3-max | 4 330 |
| 4 | Нвидия пожрала Хаггинг Фейс
NVIDIA, похоже, решила купить не очередную AI-лабораторию, а главный шалман опен сорса по ИИ.
По данным The Information и Reuters, Нвидия согласилась заплатить за Hugging Face $12,9 млрд, при том что годовая выручка HF сейчас всего около $150 млн.
Логика понятна: Hugging Face - это миллионы моделей, разработчики и фактически стандартный путь от скачивания весов до запуска. NVIDIA получает возможность намертво связать цепочку Hugging Face → Transformers → TensorRT/CUDA → NVIDIA GPU.
Но цена все равно конская, запредельная оценка.
Особенно актуально на фоне эскапад OpenAI, Google и Amazon, которые делают собственные чипы: если закрытые лаборатории постепенно уходят с NVIDIA, можно попытаться сделать NVIDIA стандартным железом для всего огромного мира открытых моделей.
И почти одновременно прилетает прекрасная иллюстрация того, зачем NVIDIA вообще может понадобиться такой контроль над экосистемой.
Таинственная Ox Alpha официально, которая оказалась китайской GLM-5.3-Flash от Z.ai, а весь гигантский поток ее тестового инференса - десятки триллионов токенов - Z.ai, по собственному заявлению, обслужила целиком на китайских AI-чипах.
Важно: речь идет именно об инференсе, а не о том, что модель была полностью обучена без NVIDIA.
Также важно понимать, GLM прекрасно запускается и на железе Нвидии. А не только на китайцах.
Но пинок отличный: китайцы уже показывают, что конкурентоспособные open-source модели можно массово “обслуживать”и без CUDA. И если NVIDIA начинает терять монополию снизу, на уровне железа, покупка Hugging Face выглядит попыткой застолбить себе место сверху - там, где эти модели публикуют, скачивают и запускают.
В дивное время живем, конечно.
https://www.reuters.com/technology/nvidia-talks-acquire-hugging-face-13-billion-deal-business-insider-reports-2026-08-27/
@cgevent | 4 058 |
| 5 | Робаты быстро учаца у кожаных.
Пока бета-версия, но скоро релиз и восстание.
Ген или видео?
Лайк - ген
Диз - видео
@cgevent | 5 055 |
| 6 | Google выпустила Gemini 3.5 Transcribe и Transcribe Live
Это две отдельные модели распознавания речи, уже в Gemini API.
Обычная версия умеет в автоопределение среди 85+ языков, diarization спикеров, word-level timestamps и словарь до 1000 специальных терминов.
Режим Smart сам вычищает «э-э», повторы и оговорки и превращает речь в нормально оформленный текст.
Live работает потоково через WebSockets и рассчитан на голосовых агентов и субтитры в реальном времени.
Google заявляет 5.04% WER на FLEURS для non-streaming и 5.50% для streaming, лучше Chirp 3.
Цена очень гуманная: около $0.005 за минуту для обычной транскрибации и $0.009/мин для Live.
Никаких весов, это вам не Виспер.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/
https://ai.google.dev/gemini-api/docs/transcribe
@cgevent | 5 624 |
| 7 | #Нейропрожарка
Анимационный клип на песню Аллы Пугачевой - Кафе Танцующих Огней в стиле анимации из мультфильмов 90-х
Автор: Стас Ахунов. Режиссер и креативный продюсер Ai-студии TAINA
Этот клип и музыкальный кавер я делал сам, в свободное от коммерческих проектов время.
Трек появился ещё зимой. Регулярно делаю каверы на любимые песни в Suno — для себя, для катания на велосипеде, для зала. Здесь кавер получился с живым вокалом и качающим ритмом, захотелось визуализировать и поделиться.
Идея была простая: поместить персонажа Аллу Борисовну в анимацию в духе мультиков 90-х. Черный плащ, Бэтмен, Черепашки-ниндзя сохранив их нуарный рисованный вайб, на котором я сам вырос.
Три-четыре дня ушло на тесты и поиск стилистики. Пробовал более современный 3D-стиль — картинка теряла вайбовость. Вернулся к аналоговой анимации 90-х. Большинство кадров делал в Nano Banana, она лучше улавливала нужный стилёк и делала крафтовее. Сториборды делал в GPT Image 2 - но стиль она держала хуже, и на кадрах присутствовала такая джипитишная грязь/шумы, котоыре потом переходили в видео.
История не была прописана полностью заранее. Начал с одной сцены: персонаж Аллы едет на чёрном авто по альтернативной ночной Москве. Дальше придумал кафе, и загадочную историю внутри. На середине работы захотелось добавить саспенса - вспомнил про мутаген из Черепашек Ниндзя. В детстве смотрел на кассетах серию, где персонажа превращали в насекомое. Вокруг этого выстроил сюжет, добавил злодея в маске и загадочности.
Для генерации видео использовал безлимитный тариф Runway. Вместе с коллегой написали скрипт в Клод Код: он проверял завершение генерации и менял новый промт/ рефы и кликал на кнопку "сгенерирвоать". Таким образом была очередь из кадров, котоыре нужно было сгенерировать. Несколько ночей загружал по 15-20 промтов, утром смотрел результат. Всего вышло более 200 генераций по 15 секунд в Сиданс 2. Из них отобрал материал на клип длиной 4 минуты 43 секунды, и отдельно смонтировал тизер на 30 секунд.
Монтаж - Final Cut Pro X. Апскейл в 4k - Топазом внутри Runway. Цвет, грейн и аналоговое свечение - Dehancer.
Когда основные генерации были готова, решил что выходит скучновато и не хватает отсылок. Посмотрел несколько документальных работ про Пугачёву и дополнительно сгенерировал и расставил пасхалки к другим её песням. В ролике можно найти отсылки к «Миллиону алых роз», песне «Робот» (любопытная в контесте современной нейродвижухи) и другим. Отдельно использовал факт, что в советское время женщинам-композиторам было сложно пробиться - и Алла Борисовна для части своих произведений использовала мужской псевдоним Борис Горбонос. Его плакат можно найти в клипе.
По деньгам, если считать все подписки одним месяцем: Runway с безлимитным на тот момент Сиднасом и Gpt Image 2 - $100, Higgsfield около 30$ (у меня там годовой тариф), Claude и ChatGPT - по $20, Suno - около $12 (у меня годовой премьер, который брал со скидкой). Итого около $180 если бы делал в один месяц. Но на практике проект делался сессиями на протяжении нескольких месяцев, поэтому реальные затраты размазаны и выходят немного больше.
Некоторые кадры вышли не идеально - нейронка где-то написала слова на зданиях с ошибками, на некоторых кадрах есть артефакты. Проект несколько месяцев лежал на монтажном столе, мне казалось что в нем по прежнему чего-то не хватает, но я решил отпустить его и выпустить как есть, без сложного клинапа каждого кадра.
Главное, что понял: всегда лучше на берегу определиться с арт-дирекшеном и историей, потом уже идти генерировать. Когда не знаешь заранее, что хочешь и история рождается на ходу - это интересный процесс, но затраный по времени и ресурсам. На генерации и тесты тогда нужно в разы больше времени.
@cgevent | 5 164 |
| 8 | #ябженилсо
Я забыл, кто кого на скаку остановит?
@cgevent | 6 042 |
| 9 | Ox Alpha официально раскрыли - это Z.ai и GLM
Китайская Z.ai (Zhipu) официально подтвердила Bloomberg, что загадочная модель является новой версией семейства GLM. Это мультимодальная reasoning-модель для кодинга и агентов: текст, картинки и видео, контекст 1 млн токенов, output до 131K.
Самое интересное: открытые веса обещают выпустить уже сегодня ночью, 26/27 августа. А бесплатный доступ, вроде как, продлевают ещё на неделю - после этого Z.ai обещает объявить коммерческие цены.
Пока Ox Alpha остается на OpenRouter за $0 input / $0 output и уже вышла там на первое место по использованию, более чем вдвое обогнав DeepSeek.
https://www.bloomberg.com/news/articles/2026-08-26/china-s-z-ai-made-ox-alpha-stealth-model-that-rivals-deepseek
https://openrouter.ai/stealth/ox-alpha
@cgevent | 6 190 |
| 10 | Epic всё-таки делает Unreal Engine 5.9 - и главный фокус там на ИИ
На Unreal Fest Seoul 2026 Эпики подтвердили выход UE 5.9, хотя ещё в июне называла 5.8 последним запланированным релизом перед UE6. Причина, похоже, как раз в ИИ I: Epic хочет протащить часть будущего стека UE6 в нынешний движок уже сейчас. Даты релиза 5.9 пока нет.
Самое интересное - дальнейшее развитие Unreal MCP. Уже в 5.8 внутри Editor работает локальный MCP-сервер, через который Claude Code, Codex, Gemini, Cursor и другие агенты могут управлять движком: создавать Actors, менять освещение и материалы, запускать тесты и работать с PCG. В 5.9 Epic собирается открыть агентам ещё больше возможностей движка.
Но самое любопытное - мой любимый нейрорендер - генеративные модели превращаются фактически в дополнительный render pass. Unreal сохраняет контроль над камерой, геометрией и композицией сцены и передаёт эти данные внешней image/video-модели. Она уже поверх реального рендера может изменить стиль, погоду, время суток и внешний вид кадра. В сеульской демонстрации Epic показывали именно такой workflow.
В UE6 LLM, генеративные модели, Claude/Codex и MCP официально названы одной из центральных частей production workflow. При этом Epic специально делает ставку не на одну свою модель, а на открытую инфраструктуру, куда разработчик сможет подключать модели по своему выбору. UE6 Early Access сейчас намечен на конец 2027 года.
Ссылки:
https://dev.epicgames.com/documentation/unreal-engine/unreal-mcp-in-unreal-editor
https://dev.epicgames.com/documentation/unreal-engine/semantic-search-in-unreal-enigne
https://dev.epicgames.com/documentation/unreal-engine/ai-features-tools-and-plugins-in-unreal-engine
https://dev.epicgames.com/documentation/unreal-engine/working-with-pcg-and-llms-using-unreal-mcp-in-unreal-engine
И свежий официальный анонс Unreal MCP в UEFN от 20 августа:
https://dev.epicgames.com/documentation/fortnite/42-00-fortnite-ecosystem-updates-and-release-notes
@cgevent | 6 708 |
| 11 | Anthropic склеила память Claude в одну систему
Теперь обычный чат и Claude Cowork используют одну и ту же память. То, что Claude узнал о ваших проектах, предпочтениях и текущей работе в чатах, автоматически доступно Cowork, и наоборот.
Память можно посмотреть по темам, отредактировать или удалить, а чувствительные данные вроде здоровья и убеждений по умолчанию не сохраняются.
Насколько я понимаю, было так:
Ещё с сентября 2025 Anthropic начала внедрять постоянную память, сначала Team/Enterprise, затем Pro/Max. Claude мог помнить информацию между разными чатами.
Были отдельные Project Memories: каждый Project имел собственную изолированную память.
10 июля 2026 память сильно переделали: вместо периодического summary Claude стал хранить отдельные категоризированные записи и обновлять их прямо во время разговоров.
Но Cowork эту память не использовал. В документации Anthropic буквально было указано, что Memory работает в web/Desktop/Mobile, но "is not currently available for Cowork".
Claude Code пока остаётся со своей отдельной системой памяти.
https://claude.com/blog/claudes-memory-works-everywhere-and-you-decide-whats-in-it
@cgevent | 7 450 |
| 12 | Ответочка от Apple: новые Mac Studio и Mac Mini!
На процах M6 и M5 Ultra
M6 – первый чип Apple на 2 нм, ставят в новый Mac mini:
– 12-ядерный CPU (2 «супер», 4 производительных, 6 эффективных) – на 20% быстрее M5 в многопотоке
– 12-ядерный GPU с Neural Accelerator в каждом ядре – +30% AI-вычислений против M5, обещают заметно быстрый prompt processing для локальных моделей
– двойной 16-ядерный Neural Engine – до 2x пиковой производительности, фреймворки сами раскидывают нагрузку на оба
– до 32 ГБ памяти, 170 ГБ/с
M5 Ultra – в новом Mac Studio, впервые четыре кристалла в одном SoC (два M5 Max, склеенных UltraFusion):
– до 36 ядер CPU, до 80 ядер GPU
– до 512 ГБ unified memory, 1.2 ТБ/с – на 50% больше, чем у M3 Ultra, то есть как у xiaomi процессоров, о которых вчера писал.
– 4.5x AI-вычислений на GPU против M3 Ultra, prompt processing в LM Studio – в 4 раза быстрее
Предзаказ уже можно сделать. Доставка с 22 сентября.
Mac mini от $900 за M6 Pro, 16Gb памяти, 512Gb диск. M6 + 1 Tb SSD + 32Gb памяти - $1800
M5 Pro 24 ГБ – $1,699. M5 Pro + 1Tb SSD + 64Gb памяти - $3000
Mac Studio:
– M5 Max начинается с $2,499 (36 ГБ памяти, 512 ГБ диск). Если нужно 128Гб памяти, то $5400 уже.
– M5 Ultra начинается с $5,499 (на $200 дороже M3 Ultra, 96 ГБ, 1 ТБ, в принципе, не сильно дороже DGX Spark, но скорость памяти бешеная). 256 ГБ минимум $9500
– 512 ГБ только в конце октября, цены нет – по прогрессии ждём около $15k
Получается, что Mac mini M6 с 32 ГБ за $1,299 – самый дешёвый нормальный билет в локальные LLM: 7–14B в квантизации с запасом под контекст, и Apple прямо говорит про «агентные задачи локально». Следующая разумная ступень – M5 Max Studio со 128 ГБ за $4,799: туда влезает 70B в Q4. А Ultra с 512 ГБ и 1.2 ТБ/с – единственный десктоп, куда влезает модель на несколько сотен миллиардов параметров без кластера. Ширина памяти здесь важнее ядер: именно она определяет токены в секунду. Даже за $15k это дешевле одной H100 с обвязкой, и без DevOps. Обидно другое: Apple теперь берёт за память как за GPU – $4,000 за +160 ГБ, год назад тот же апгрейд стоил $1,600.
Отдельно интересно, что маркетинг полностью развернулся: не «монтаж видео супер-быстро», а «запуск frontier-моделей на десктопе». Для команд, которым нельзя гонять документы, код, аудиозаписи в облаке, это самый простой способ получить приватный инференс.
https://nr.apple.com/Dj0T8P0dD8 | 5 863 |
| 13 | OpenAI показала Jalapeño - свой первый реально работающий inference-чип
Компания уже гоняет на нем GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 и заявляет 1.5-1.9× больше вычислений на ватт и 1.7-3.6× меньшую end-to-end latency, а на некоторых интерактивных нагрузках выигрыш доходит до 4.1×.
Забавно, что ИИ здесь буквально помогал строить железо для ИИ:
модели OpenAI использовали при проектировании самого чипа и оптимизации софта.
https://openai.com/index/jalapeno-first-results/
@cgevent | 7 503 |
| 14 | #Нейропрожарка
Фильм сделан специально для участия в AAIFF
Автор: Илья Никитин
https://t.me/nikitin_films
Графика: Midjourney 8, NanoBananaPro, Seedream 5, GPT Image 2
Анимация: Seedance 2/2.5, Kling 3.0, Minimax H3
Музыка: Suno 5.5
@cgevent | 7 736 |
| 15 | ИИ - новый нормальный композ
Очень уместное использование Сиданского в vfx-пайплайне.
Здесь была съемка с Реальными актерами, а ИИ использовали как переодеватор, перелицеватор или заменятор актеров.
Просто как инструмент композа.
Ну и конечно, можно снимать студентов, а потом перелицевать в Бредовпитов и Вилавсмитов.
ИИкономия.
Кроме шуток, если бы не пережгли картинку, то было бы очень здорово - классный подход.
Это из трейлера к фильму:
https://youtu.be/Iaolm_fpjJA
@cgevent | 7 477 |
| 16 | AGI уже не здесь. А где-то там
Альтман немного облажался с прогнозами по AI. Но виноват, разумеется, не Альтман. Виноваты кожаные.
Свежее интервью с ним - https://youtu.be/kG8AoExkX40
После выхода GPT-4 в 2023-м Семён ожидал, что очень быстро начнётся массовая ИИ-мясорубка: старые компании посыпятся, AI-native стартапы начнут отбирать рынки.
Не посыпались.
Теперь Альтман признаёт:
«“I think I was wrong about a few things.”»
И ещё лучше:
«“We’ve all been too ambitious on timelines.”»
Типапоторопилсо.
А причина прекрасна: люди оказались недостаточно быстрыми для светлого AGI-будущего. По словам Альтмана, “the economy just has so much inertia”: люди продолжают делать то же самое, покупать у тех же компаний и пользоваться привычными инструментами. Поэтому общество и экономика будут адаптироваться к AI “more slowly”.
То есть прогноз был правильный. Просто кожаные неправильные.
При этом сам технический прогноз Альтман особо назад не откручивает: AI продолжает бешено развиваться, а великий переход впереди. Просто выяснилось, что между «мы сделали почти AGI» и «AGI перевернул экономику» есть прокладка в виде кожаных.
Скорей бы уже восстание робатов.
@cgevent | 7 428 |
| 17 | Ген или Видео?
@cgevent | 6 651 |
| 18 | Амазон покусал Алибабу
Wan 3.0 Prime - ускоренный Wan 3.0 без типа потери качества.
Главное отличие от обычного Вана - скорость. Oxen.ai заявляют ускорение в 5-7 раз.
Для контекста: обычный Wan 3.0 в их тестах мог считать 5 секунд 720p около 8 минут.
При этом Runware прямо пишет про same output quality as Wan 3.0, а fal говорит о сохранении visual detail и cinematic consistency.
Верим?
По возможностям Prime сохраняет мультимодальный Wan 3.0:
T2V, I2V с первым и последним кадром, Reference-to-Video, редактирование и продолжение видео, работу с изображениями, видео, аудио, документами и веб-страницами.
Prime уже доступен через Alibaba Cloud, fal.ai, Runware и у всех остальных.
На fal цена составляет $0.068/сек за 480p, $0.14/сек за 720p и $0.28/сек за 1080p
Соответственно $2.04 / $4.20 / $8.40 за 30 секунд.
https://fal.ai/models/alibaba/wan-3.0-prime/text-to-video
https://runware.ai/docs/models/alibaba-wan3-0-prime
https://www.oxen.ai/
https://help.aliyun.com/en/model-studio/
Промпт: "a woman hiding under a desk who notices a shadowy figure in the background."
@cgevent | 6 277 |
| 19 | Кожаным есть чему поучица у робатов
Усейн Болт = робaты плюс Kling 3.0 Omni
@cgevent | 6 570 |
| 20 | #Нейропрожарка
Баба Яга. Доставка, сахар и ПВО
Автор:
Алексей Лотков / @aleksejlotkov (Insta/Tg)
Описание:
Короткий абсурдный фолк-мокьюментари про Бабу Ягу в современном российском быту: она летает в ступе, покупает сахар по акции в «Пятерочке», заказывает доставку в избушку на курьих ножках, сталкивается с курьерами, говорящим котом, Лешим-алкашом и ПВО, которое принимает ее за дрон.
Главная идея была сделать не сказку и не фэнтези, а максимально приземленный документальный реализм: handheld-камера, бытовой свет, неловкие паузы, мокрый лес, старые интерьеры, реальные магазины и абсурд, сыгранный абсолютно серьезно.
Производство:
Сначала была собрана раскадровка и история, разбитая на отдельные сцены. Для каждого шота делались ключевые кадры и отдельные ассеты с промптами с точным действием, камерой, таймингом и стилем. Основной пайплайн: генерация ассетов по отдельности → анимация в Seedance 2.0/2.5
В работе использовались Flux 2 Max/Reve/Seedream 5 и др. Для анимации - клинг 3 и сидэнс 2.0/2.5.
Голоса склонированы и синтезированы в elevenlabs, липсинк был сделан в synclabs lipsync v3.
Больше всего времени ушло на удержание единого тона: модели постоянно тянули всё в фэнтези, хоррор или глянец, а задача была оставить ощущение реального документального видео.
Очень много времени ушло на перебирание и создание концептов на персонажей и локацию.
Время / бюджет:
Время: 2 месяца по 1-2 часа в день
Бюджет: 250-300 долларов — в основном генерации, подписки / кредиты
@cgevent | 7 960 |
