uz
Feedback
Метаверсище и ИИще

Метаверсище и ИИще

Kanalga Telegram’da o‘tish

Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие. Для связи: @SergTsyp

Ko'proq ko'rsatish

📈 Telegram kanali Метаверсище и ИИще analitikasi

Метаверсище и ИИще (@cgevent) Rus til segmentidagi kanali faol ishtirokchi. Hozirda hamjamiyat 51 478 obunachidan iborat bo'lib, Sanʼat & Dizayn toifasida 379-o'rinni va Rossiya mintaqasida 11 999-o'rinni egallagan.

📊 Auditoriya ko‘rsatkichlari va dinamika

невідомо sanasidan buyon loyiha tez o‘sib, 51 478 obunachiga ega bo‘ldi.

26 Avgust, 2026 dagi oxirgi ma’lumotlarga ko‘ra kanal barqaror faollikka ega. Oxirgi 30 kunda obunachilar soni 146 ga, so‘nggi 24 soatda esa 19 ga o‘zgardi va umumiy qamrov yuqori darajada qolmoqda.

  • Tasdiqlash holati: Tasdiqlanmagan
  • Jalb etish (ER): Auditoriya o‘rtacha 15.62% darajada jalb etiladi. Nashrdan keyingi dastlabki 24 soatda kontent odatda umumiy obunachilar sonining 10.27% ini tashkil etuvchi reaksiyalarni to‘playdi.
  • Post qamrovi: Har bir post o‘rtacha 8 041 marta ko‘riladi; birinchi sutkada odatda 5 289 ta ko‘rish yig‘iladi.
  • Reaksiyalar va o‘zaro ta’sir: Auditoriya faol: har bir postga o‘rtacha 82 ta reaksiya keladi.
  • Tematik yo‘nalishlar: Kontent claude, seedance, контекст, нейропрожарка, редактирование kabi asosiy mavzularga jamlangan.

📝 Tavsif va kontent siyosati

Muallif resursni shaxsiy fikrni ifoda etish maydoni sifatida ta’riflaydi:
Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие. Для связи: @SergTsyp

Yuqori yangilanish chastotasi (oxirgi ma’lumot 27 Avgust, 2026 da olingan) sababli kanal doimo dolzarb va katta qamrovli bo‘lib qoladi. Analitika auditoriya kontent bilan faol hamkorlik qilishini, uni Sanʼat & Dizayn toifasidagi muhim ta’sir nuqtasiga aylantirishini ko‘rsatadi.

51 478
Obunachilar
+1924 soatlar
+817 kunlar
+14630 kunlar
Postlar arxiv
Робаты быстро учаца у кожаных. Пока бета-версия, но скоро релиз и восстание. Ген или видео? Лайк - ген Диз - видео @cgevent

Google выпустила Gemini 3.5 Transcribe и Transcribe Live Это две отдельные модели распознавания речи, уже в Gemini API. Обычн
Google выпустила Gemini 3.5 Transcribe и Transcribe Live Это две отдельные модели распознавания речи, уже в Gemini API. Обычная версия умеет в автоопределение среди 85+ языков, diarization спикеров, word-level timestamps и словарь до 1000 специальных терминов. Режим Smart сам вычищает «э-э», повторы и оговорки и превращает речь в нормально оформленный текст. Live работает потоково через WebSockets и рассчитан на голосовых агентов и субтитры в реальном времени. Google заявляет 5.04% WER на FLEURS для non-streaming и 5.50% для streaming, лучше Chirp 3. Цена очень гуманная: около $0.005 за минуту для обычной транскрибации и $0.009/мин для Live. Никаких весов, это вам не Виспер. https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/ https://ai.google.dev/gemini-api/docs/transcribe @cgevent

#Нейропрожарка Анимационный клип на песню Аллы Пугачевой - Кафе Танцующих Огней в стиле анимации из мультфильмов 90-х Автор: Стас Ахунов. Режиссер и креативный продюсер Ai-студии TAINA Этот клип и музыкальный кавер я делал сам, в свободное от коммерческих проектов время. Трек появился ещё зимой. Регулярно делаю каверы на любимые песни в Suno — для себя, для катания на велосипеде, для зала. Здесь кавер получился с живым вокалом и качающим ритмом, захотелось визуализировать и поделиться. Идея была простая: поместить персонажа Аллу Борисовну в анимацию в духе мультиков 90-х. Черный плащ, Бэтмен, Черепашки-ниндзя сохранив их нуарный рисованный вайб, на котором я сам вырос. Три-четыре дня ушло на тесты и поиск стилистики. Пробовал более современный 3D-стиль — картинка теряла вайбовость. Вернулся к аналоговой анимации 90-х. Большинство кадров делал в Nano Banana, она лучше улавливала нужный стилёк и делала крафтовее. Сториборды делал в GPT Image 2 - но стиль она держала хуже, и на кадрах присутствовала такая джипитишная грязь/шумы, котоыре потом переходили в видео. История не была прописана полностью заранее. Начал с одной сцены: персонаж Аллы едет на чёрном авто по альтернативной ночной Москве. Дальше придумал кафе, и загадочную историю внутри. На середине работы захотелось добавить саспенса - вспомнил про мутаген из Черепашек Ниндзя. В детстве смотрел на кассетах серию, где персонажа превращали в насекомое. Вокруг этого выстроил сюжет, добавил злодея в маске и загадочности. Для генерации видео использовал безлимитный тариф Runway. Вместе с коллегой написали скрипт в Клод Код: он проверял завершение генерации и менял новый промт/ рефы и кликал на кнопку "сгенерирвоать". Таким образом была очередь из кадров, котоыре нужно было сгенерировать. Несколько ночей загружал по 15-20 промтов, утром смотрел результат. Всего вышло более 200 генераций по 15 секунд в Сиданс 2. Из них отобрал материал на клип длиной 4 минуты 43 секунды, и отдельно смонтировал тизер на 30 секунд. Монтаж - Final Cut Pro X. Апскейл в 4k - Топазом внутри Runway. Цвет, грейн и аналоговое свечение - Dehancer. Когда основные генерации были готова, решил что выходит скучновато и не хватает отсылок. Посмотрел несколько документальных работ про Пугачёву и дополнительно сгенерировал и расставил пасхалки к другим её песням. В ролике можно найти отсылки к «Миллиону алых роз», песне «Робот» (любопытная в контесте современной нейродвижухи) и другим. Отдельно использовал факт, что в советское время женщинам-композиторам было сложно пробиться - и Алла Борисовна для части своих произведений использовала мужской псевдоним Борис Горбонос. Его плакат можно найти в клипе. По деньгам, если считать все подписки одним месяцем: Runway с безлимитным на тот момент Сиднасом и Gpt Image 2 - $100, Higgsfield около 30$ (у меня там годовой тариф), Claude и ChatGPT - по $20, Suno - около $12 (у меня годовой премьер, который брал со скидкой). Итого около $180 если бы делал в один месяц. Но на практике проект делался сессиями на протяжении нескольких месяцев, поэтому реальные затраты размазаны и выходят немного больше. Некоторые кадры вышли не идеально - нейронка где-то написала слова на зданиях с ошибками, на некоторых кадрах есть артефакты. Проект несколько месяцев лежал на монтажном столе, мне казалось что в нем по прежнему чего-то не хватает, но я решил отпустить его и выпустить как есть, без сложного клинапа каждого кадра. Главное, что понял: всегда лучше на берегу определиться с арт-дирекшеном и историей, потом уже идти генерировать. Когда не знаешь заранее, что хочешь и история рождается на ходу - это интересный процесс, но затраный по времени и ресурсам. На генерации и тесты тогда нужно в разы больше времени. @cgevent

#ябженилсо Я забыл, кто кого на скаку остановит? @cgevent

Ox Alpha официально раскрыли - это Z.ai и GLM Китайская Z.ai (Zhipu) официально подтвердила Bloomberg, что загадочная модель является новой версией семейства GLM. Это мультимодальная reasoning-модель для кодинга и агентов: текст, картинки и видео, контекст 1 млн токенов, output до 131K. Самое интересное: открытые веса обещают выпустить уже сегодня ночью, 26/27 августа. А бесплатный доступ, вроде как, продлевают ещё на неделю - после этого Z.ai обещает объявить коммерческие цены. Пока Ox Alpha остается на OpenRouter за $0 input / $0 output и уже вышла там на первое место по использованию, более чем вдвое обогнав DeepSeek. https://www.bloomberg.com/news/articles/2026-08-26/china-s-z-ai-made-ox-alpha-stealth-model-that-rivals-deepseek https://openrouter.ai/stealth/ox-alpha @cgevent

Epic всё-таки делает Unreal Engine 5.9 - и главный фокус там на ИИ На Unreal Fest Seoul 2026 Эпики подтвердили выход UE 5.9, хотя ещё в июне называла 5.8 последним запланированным релизом перед UE6. Причина, похоже, как раз в ИИ I: Epic хочет протащить часть будущего стека UE6 в нынешний движок уже сейчас. Даты релиза 5.9 пока нет. Самое интересное - дальнейшее развитие Unreal MCP. Уже в 5.8 внутри Editor работает локальный MCP-сервер, через который Claude Code, Codex, Gemini, Cursor и другие агенты могут управлять движком: создавать Actors, менять освещение и материалы, запускать тесты и работать с PCG. В 5.9 Epic собирается открыть агентам ещё больше возможностей движка. Но самое любопытное - мой любимый нейрорендер - генеративные модели превращаются фактически в дополнительный render pass. Unreal сохраняет контроль над камерой, геометрией и композицией сцены и передаёт эти данные внешней image/video-модели. Она уже поверх реального рендера может изменить стиль, погоду, время суток и внешний вид кадра. В сеульской демонстрации Epic показывали именно такой workflow. В UE6 LLM, генеративные модели, Claude/Codex и MCP официально названы одной из центральных частей production workflow. При этом Epic специально делает ставку не на одну свою модель, а на открытую инфраструктуру, куда разработчик сможет подключать модели по своему выбору. UE6 Early Access сейчас намечен на конец 2027 года. Ссылки: https://dev.epicgames.com/documentation/unreal-engine/unreal-mcp-in-unreal-editor https://dev.epicgames.com/documentation/unreal-engine/semantic-search-in-unreal-enigne https://dev.epicgames.com/documentation/unreal-engine/ai-features-tools-and-plugins-in-unreal-engine https://dev.epicgames.com/documentation/unreal-engine/working-with-pcg-and-llms-using-unreal-mcp-in-unreal-engine И свежий официальный анонс Unreal MCP в UEFN от 20 августа: https://dev.epicgames.com/documentation/fortnite/42-00-fortnite-ecosystem-updates-and-release-notes @cgevent

Anthropic склеила память Claude в одну систему Теперь обычный чат и Claude Cowork используют одну и ту же память. То, что Claude узнал о ваших проектах, предпочтениях и текущей работе в чатах, автоматически доступно Cowork, и наоборот. Память можно посмотреть по темам, отредактировать или удалить, а чувствительные данные вроде здоровья и убеждений по умолчанию не сохраняются. Насколько я понимаю, было так: Ещё с сентября 2025 Anthropic начала внедрять постоянную память, сначала Team/Enterprise, затем Pro/Max. Claude мог помнить информацию между разными чатами. Были отдельные Project Memories: каждый Project имел собственную изолированную память. 10 июля 2026 память сильно переделали: вместо периодического summary Claude стал хранить отдельные категоризированные записи и обновлять их прямо во время разговоров. Но Cowork эту память не использовал. В документации Anthropic буквально было указано, что Memory работает в web/Desktop/Mobile, но "is not currently available for Cowork". Claude Code пока остаётся со своей отдельной системой памяти. https://claude.com/blog/claudes-memory-works-everywhere-and-you-decide-whats-in-it @cgevent

Ответочка от Apple: новые Mac Studio и Mac Mini! На процах M6 и M5 Ultra M6 – первый чип Apple на 2 нм, ставят в новый Mac mini: – 12-ядерный CPU (2 «супер», 4 производительных, 6 эффективных) – на 20% быстрее M5 в многопотоке – 12-ядерный GPU с Neural Accelerator в каждом ядре – +30% AI-вычислений против M5, обещают заметно быстрый prompt processing для локальных моделей – двойной 16-ядерный Neural Engine – до 2x пиковой производительности, фреймворки сами раскидывают нагрузку на оба – до 32 ГБ памяти, 170 ГБ/с M5 Ultra – в новом Mac Studio, впервые четыре кристалла в одном SoC (два M5 Max, склеенных UltraFusion): – до 36 ядер CPU, до 80 ядер GPU – до 512 ГБ unified memory, 1.2 ТБ/с – на 50% больше, чем у M3 Ultra, то есть как у xiaomi процессоров, о которых вчера писал. – 4.5x AI-вычислений на GPU против M3 Ultra, prompt processing в LM Studio – в 4 раза быстрее Предзаказ уже можно сделать. Доставка с 22 сентября. Mac mini от $900 за M6 Pro, 16Gb памяти, 512Gb диск. M6 + 1 Tb SSD + 32Gb памяти - $1800 M5 Pro 24 ГБ – $1,699. M5 Pro + 1Tb SSD + 64Gb памяти - $3000 Mac Studio: – M5 Max начинается с $2,499 (36 ГБ памяти, 512 ГБ диск). Если нужно 128Гб памяти, то $5400 уже. – M5 Ultra начинается с $5,499 (на $200 дороже M3 Ultra, 96 ГБ, 1 ТБ, в принципе, не сильно дороже DGX Spark, но скорость памяти бешеная). 256 ГБ минимум $9500 – 512 ГБ только в конце октября, цены нет – по прогрессии ждём около $15k Получается, что Mac mini M6 с 32 ГБ за $1,299 – самый дешёвый нормальный билет в локальные LLM: 7–14B в квантизации с запасом под контекст, и Apple прямо говорит про «агентные задачи локально». Следующая разумная ступень – M5 Max Studio со 128 ГБ за $4,799: туда влезает 70B в Q4. А Ultra с 512 ГБ и 1.2 ТБ/с – единственный десктоп, куда влезает модель на несколько сотен миллиардов параметров без кластера. Ширина памяти здесь важнее ядер: именно она определяет токены в секунду. Даже за $15k это дешевле одной H100 с обвязкой, и без DevOps. Обидно другое: Apple теперь берёт за память как за GPU – $4,000 за +160 ГБ, год назад тот же апгрейд стоил $1,600. Отдельно интересно, что маркетинг полностью развернулся: не «монтаж видео супер-быстро», а «запуск frontier-моделей на десктопе». Для команд, которым нельзя гонять документы, код, аудиозаписи в облаке, это самый простой способ получить приватный инференс. https://nr.apple.com/Dj0T8P0dD8

OpenAI показала Jalapeño - свой первый реально работающий inference-чип Компания уже гоняет на нем GPT-OSS 120B, DeepSeek R1
OpenAI показала Jalapeño - свой первый реально работающий inference-чип Компания уже гоняет на нем GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 и заявляет 1.5-1.9× больше вычислений на ватт и 1.7-3.6× меньшую end-to-end latency, а на некоторых интерактивных нагрузках выигрыш доходит до 4.1×. Забавно, что ИИ здесь буквально помогал строить железо для ИИ: модели OpenAI использовали при проектировании самого чипа и оптимизации софта. https://openai.com/index/jalapeno-first-results/ @cgevent

#Нейропрожарка Фильм сделан специально для участия в AAIFF Автор: Илья Никитин https://t.me/nikitin_films Графика: Midjourney 8, NanoBananaPro, Seedream 5, GPT Image 2 Анимация: Seedance 2/2.5, Kling 3.0, Minimax H3 Музыка: Suno 5.5 @cgevent

ИИ - новый нормальный композ Очень уместное использование Сиданского в vfx-пайплайне. Здесь была съемка с Реальными актерами, а ИИ использовали как переодеватор, перелицеватор или заменятор актеров. Просто как инструмент композа. Ну и конечно, можно снимать студентов, а потом перелицевать в Бредовпитов и Вилавсмитов. ИИкономия. Кроме шуток, если бы не пережгли картинку, то было бы очень здорово - классный подход. Это из трейлера к фильму: https://youtu.be/Iaolm_fpjJA @cgevent

AGI уже не здесь. А где-то там Альтман немного облажался с прогнозами по AI. Но виноват, разумеется, не Альтман. Виноваты кожаные. Свежее интервью с ним - https://youtu.be/kG8AoExkX40 После выхода GPT-4 в 2023-м Семён ожидал, что очень быстро начнётся массовая ИИ-мясорубка: старые компании посыпятся, AI-native стартапы начнут отбирать рынки. Не посыпались. Теперь Альтман признаёт: «“I think I was wrong about a few things.”» И ещё лучше: «“We’ve all been too ambitious on timelines.”» Типапоторопилсо.  А причина прекрасна: люди оказались недостаточно быстрыми для светлого AGI-будущего. По словам Альтмана, “the economy just has so much inertia”: люди продолжают делать то же самое, покупать у тех же компаний и пользоваться привычными инструментами. Поэтому общество и экономика будут адаптироваться к AI “more slowly”. То есть прогноз был правильный. Просто кожаные неправильные. При этом сам технический прогноз Альтман особо назад не откручивает: AI продолжает бешено развиваться, а великий переход впереди. Просто выяснилось, что между «мы сделали почти AGI» и «AGI перевернул экономику»  есть прокладка в виде кожаных. Скорей бы уже восстание робатов. @cgevent

Ген или Видео? @cgevent

Амазон покусал Алибабу Wan 3.0 Prime - ускоренный Wan 3.0 без типа потери качества. Главное отличие от обычного Вана - скорость. Oxen.ai заявляют ускорение в 5-7 раз. Для контекста: обычный Wan 3.0 в их тестах мог считать 5 секунд 720p около 8 минут. При этом Runware прямо пишет про same output quality as Wan 3.0, а fal говорит о сохранении visual detail и cinematic consistency. Верим? По возможностям Prime сохраняет мультимодальный Wan 3.0: T2V, I2V с первым и последним кадром, Reference-to-Video, редактирование и продолжение видео, работу с изображениями, видео, аудио, документами и веб-страницами. Prime уже доступен через Alibaba Cloud, fal.ai, Runware и у всех остальных. На fal цена составляет $0.068/сек за 480p, $0.14/сек за 720p и $0.28/сек за 1080p Соответственно $2.04 / $4.20 / $8.40 за 30 секунд. https://fal.ai/models/alibaba/wan-3.0-prime/text-to-video https://runware.ai/docs/models/alibaba-wan3-0-prime https://www.oxen.ai/ https://help.aliyun.com/en/model-studio/ Промпт: "a woman hiding under a desk who notices a shadowy figure in the background." @cgevent

Кожаным есть чему поучица у робатов Усейн Болт = робaты плюс Kling 3.0 Omni @cgevent

#Нейропрожарка Баба Яга. Доставка, сахар и ПВО Автор: Алексей Лотков / @aleksejlotkov (Insta/Tg) Описание: Короткий абсурдный фолк-мокьюментари про Бабу Ягу в современном российском быту: она летает в ступе, покупает сахар по акции в «Пятерочке», заказывает доставку в избушку на курьих ножках, сталкивается с курьерами, говорящим котом, Лешим-алкашом и ПВО, которое принимает ее за дрон. Главная идея была сделать не сказку и не фэнтези, а максимально приземленный документальный реализм: handheld-камера, бытовой свет, неловкие паузы, мокрый лес, старые интерьеры, реальные магазины и абсурд, сыгранный абсолютно серьезно. Производство: Сначала была собрана раскадровка и история, разбитая на отдельные сцены. Для каждого шота делались ключевые кадры и отдельные ассеты с промптами с точным действием, камерой, таймингом и стилем. Основной пайплайн: генерация ассетов по отдельности → анимация в Seedance 2.0/2.5 В работе использовались Flux 2 Max/Reve/Seedream 5 и др. Для анимации - клинг 3 и сидэнс 2.0/2.5. Голоса склонированы и синтезированы в elevenlabs, липсинк был сделан в synclabs lipsync v3. Больше всего времени ушло на удержание единого тона: модели постоянно тянули всё в фэнтези, хоррор или глянец, а задача была оставить ощущение реального документального видео. Очень много времени ушло на перебирание и создание концептов на персонажей и локацию. Время / бюджет: Время: 2 месяца по 1-2 часа в день Бюджет: 250-300 долларов — в основном генерации, подписки / кредиты @cgevent

Забрать подписку на нейронки без боли и переплат можно на ggsel ✋ У ребят собраны все нужные ИИ-модели, чтобы рефераты, курсо
Забрать подписку на нейронки без боли и переплат можно на ggselУ ребят собраны все нужные ИИ-модели, чтобы рефераты, курсовые, код и отчёты делались буквально сами 👨‍💻 Иностранные карты для оплаты не потребуются — на ggsel всё безопасно оплачивается с обычных карт российских банков 🫰 @cgevent

Главный прямой конкурент Руби - Topaz Hyperion 2.5. Topaz выпустили её в августе как улучшенный SDR→HDR конвертер с меньшим banding, лучшей передачей цвета и dynamic range. По смыслу Ruby и Hyperion 2.5 практически делают одно и то же: получили 8-bit SDR → нейросеть расширила luminance/color → получили профессиональный HDR. Hyperion 2.5 выдаёт 10-bit ProRes/H.265 и 16-bit half-float EXR. Продуктовая разница прежде всего в экосистеме: Ruby встроен в Runway и облачный API, Hyperion 2.5 - в Topaz/Astra и постепенно в desktop Topaz Video. У Hyperion сейчас, кстати, обнаружились глючки: пользователь Topaz нашёл, что облачный 16-bit EXR приходит как Linear Rec.2020, хотя ожидал ACES2065-1; в сообществе уточняют, что ACES2065-1 пока относится к локальному Pro-рендеру. LTX технически интереснее обоих. У Lightricks SDR→HDR реализован открыто как HDR IC-LoRA поверх огромной LTX-2.3 22B. То есть это не отдельный закрытый black box: большая генеративная видеомодель получает специальный HDR-адаптер и синтезирует дополнительный dynamic range. Можно запустить через Python или ComfyUI и получить scene-linear EXR. Причём LTX уже добавила полноценный Native EXR/HDR pipeline в LTX-2.5: ACEScg, linear Rec.709 и ACEScct могут проходить через генеративный pipeline без предварительного превращения в SDR. Важная тонкость: именно SDR→HDR IC-LoRA пока официально валидирована на LTX-2.3, поддержка 2.5 ещё находится в разработке. Поэтому Ruby и Hyperion - готовые специализированные SDR→HDR продукты, а LTX - гораздо более открытый и генеративный подход, который можно разбирать, модифицировать и запускать локально. Где пробовать и сколько стоит. Ruby уже есть в Runway для Max и Enterprise и отдельно через API /v1/video_to_hdr. API стоит 20 credits за секунду, то есть $0.20/с при цене кредита $0.01; если исходник больше 4 мегапикселей - 40 credits, $0.40/с. Получается около $6 за 30 секунд обычного видео или $12 за 30 секунд >4 MP. Max сейчас стоит $95 помесячно или $76/мес при годовой оплате и включает 9500 credits. Hyperion 2.5 уже доступен через Topaz Astra и API, desktop-интеграция Topaz Video разворачивается. LTX HDR доступен через API и локально: API стоит $0.20/с до 1080p, $0.40/с до 1440p и $0.80/с до 4K; HDR IC-LoRA для LTX-2.3 можно гонять локально. Для 2.5 ждем. Конкуренция это прекрасно: Runway Ruby и Topaz Hyperion 2.5 делают практически один продукт двумя закрытыми моделями, а LTX решает ту же задачу через открытую 22B video model + HDR IC-LoRA. В идеале, конечно, прогнать нормальный A/B на одном исходнике: сколько реальной дополнительной информации появляется в пересветах и тенях, что происходит с banding и насколько стабильно всё это держится между кадрами. Композеры, расчехляйтесь. @cgevent   https://docs.dev.runwayml.com/api-details/api_changelog/ https://docs.dev.runwayml.com/guides/models/ https://docs.dev.runwayml.com/guides/pricing/ https://x.com/runwayml/status/2090807248402682101 https://developer.topazlabs.com/video-models/video-utilities/hyperion-2.5-sdr-to-hdr-new https://docs.ltx.io/open-source-model/usage-guides/working-with-exr-hdr https://ltx.io/blog/sdr-to-hdr https://www.reddit.com/r/hybridfilmmaking/comments/1vulldr/runways_new_hdr_tool/ @cgevent

Runway бахнул Ruby: еще один SDR в HDR Разбираемсо, сравниваем, ботанствуем. Ruby принимает уже существующее SDR-видео и расширяет его яркостный диапазон до HDR. Можно скормить как свой загруженный ролик, так и результат любой модели Runway. Ruby сохраняет исходные пиксели и аудио, ничего заново не рендерит, а расширяет яркость в HDR headroom с color-preserving обработкой. То есть это скорее очень умный нейросетевой inverse tone mapping, чем генеративная перерисовка видео. Через API принимаются SDR-ролики до 40 секунд и менее 4096 px по каждой стороне, хотя в первоначальном анонсе интерфейса Runway фигурировал лимит 30 секунд. 12 бит и 16 бит - тут есть важная тонкость. Фраза Runway "up to 16-bit HDR" звучит круто, но 16 бит относится прежде всего к EXR. Это OpenEXR с half-float: 16-битное floating-point значение на канал, а не обычные 65 536 равномерных целочисленных уровней. Float16 имеет огромный диапазон значений и отлично подходит для scene-linear света, композа и грейдинга. Но это не означает, что Ruby каким-то чудом превращает исходный 8-bit SDR в 16 бит реально измеренной камерой информации. Новая информация синтезирована моделью. Для готовых видеокодеков Runway заявляет 10- и 12-bit ProRes/HEVC. Причём есть небольшой нюанс документации: публичный анонс говорит о 10/12 bit ProRes и HEVC, тогда как текущая API-документация явно описывает стандартный HEVC HDR10 как 10-bit, а для профессионального ProRes предлагает 422, 422 HQ и 4444. Поэтому "12-bit" я бы пока воспринимал прежде всего как максимальную доступную глубину некоторых export-профилей, а не как обязательную характеристику EXR и остальные форматы. Самый RAW-профессиональный вариант Ruby - ZIP с последовательностью OpenEXR half-float кадров. Причём API уточняет интересную вещь: внутри это linear BT.2020 light, плюс sidecar-файлы с colorimetry/provenance и отдельный audio.wav, если в источнике был звук. Это вариант для Nuke, Fusion, Resolve и VFX-пайплайна, где ты потом сам решаешь, как делать mastering. Второй вариант - ProRes MOV, BT.2020 + PQ, с профилями 422, 422 HQ или 4444. Третий - HEVC HDR10, то есть 10-bit, BT.2020 + PQ, уже почти готовый delivery-файл для HDR-телевизора, YouTube и т.п. Есть также HLG, удобный прежде всего для broadcast. Вот это, на мой взгляд, одна из самых сильных сторон Ruby: он выдаёт не только "HDR EXR для технарей", но и сразу практические HDR master/delivery форматы. Первые отзывы. Появился и первый содержательный негативный тест: один пользователь пишет, что в полученном EXR всё ещё видит заметный banding, а в тенях и светах не появляется ожидаемого объёма информации - по его впечатлению это больше похоже на качественное расширение диапазона, чем на настоящую реконструкцию 16-bit материала. Это пока единичный отзыв, а не нормальный A/B тест. На Reddit ситуация ещё показательнее: обсуждение Ruby только начинается, люди в основном спрашивают, кто уже успел сравнить его с Topaz. Поэтому делать вывод «Ruby лучше/хуже» пока рано. @cgevent

Конкуренция – это отлично Похоже OpenAI и Антропик соревнуются, кто круче лизнет пользователя, лишь бы тот не соскочил с поез
+1
Конкуренция – это отлично Похоже OpenAI и Антропик соревнуются, кто круче лизнет пользователя, лишь бы тот не соскочил с поезда и не пересел на конкурирующую электричку.   ОпенАИ взяли и дропнули цены на API SOL 5.6 на двадцать процентов аж на ТРИ месяца.   Антропик такой: а мы продлеваем увеличенные недельные лимиты на Claude Code до 31 августа.   Пользователи: услышали, продолжайте, тут Ox Alpha ваще бесплатно, ждем дальнейших прогибов.   @cgevent