Нейронавт | Нейросети в творчестве
前往频道在 Telegram
Канал про нейросети в компьютерной графике, в кино и вообще В папках и запусках не участвую для связи @Neuronauticus РКН: https://hf.ru/link8e56d
显示更多📈 Telegram 频道 Нейронавт | Нейросети в творчестве 的分析概览
频道 Нейронавт | Нейросети в творчестве (@greenneuralrobots) 俄语 语言赛道中的 是活跃参与者。目前社区聚集了 12 842 名订阅者,在 艺术与设计 类别中位列第 2 756,并在 俄罗斯 地区排名第 50 618 位。
📊 受众指标与增长动态
自 невідомо 创建以来,项目保持高速增长,吸引了 12 842 名订阅者。
根据 01 九月, 2026 的最新数据,频道保持稳定运转。过去 30 天订阅人数变化为 166,过去 24 小时变化为 15,整体触达仍然可观。
- 认证状态: 未认证
- 互动率 (ER): 平均受众互动率为 13.79%。内容发布后 24 小时内通常能获得 9.92% 的反应,占订阅者总量。
- 帖子覆盖: 每篇帖子平均可获得 1 769 次浏览,首日通常累积 1 272 次浏览。
- 互动与反馈: 受众积极参与,单帖平均反应数为 16。
- 主题关注点: 内容集中在 гитхаб, assistant, claude, imageediting, параметр 等核心主题上。
📝 描述与内容策略
作者将该频道定位为表达主观观点的平台:
“Канал про нейросети в компьютерной графике, в кино и вообще
В папках и запусках не участвую
для связи @Neuronauticus
РКН: https://hf.ru/link8e56d”
凭借高频更新(最新数据采集于 02 九月, 2026),频道始终保持新鲜度与高覆盖。分析显示受众积极互动,使其成为 艺术与设计 类别中的关键影响点。
12 842
订阅者
+1524 小时
+337 天
+16630 天
帖子存档
+2
Nemotron 3 Diarization preview
NVIDIA выложила превью модели для диаризации речи - определения, кто и когда говорит в аудиозаписи. Работает на архитектуре streaming-sortformer, то есть умеет размечать спикеров в потоке, а не только по готовой записи.
Диаризация — это процесс определения, КТО говорит в аудиозаписи. Система анализирует звук и разбирает его по голосам: выделяет разные говорящих, отмечает моменты, где они начинают и заканчивают говорить
Доступ по запросу, лицензия nvidia-software-and-model-evaluation-license: использовать можно только для внутреннего тестирования, не в продакшене
Доступны блокноты для Google Colab и Kaggle, интеграция с библиотекой NeMo.
#diarize
VK | MAX
Orbis
непрерывная интерактивная генерация видео из текста или картинки. Сюжет меняется командами на ходу без остановки потока. Многоуровневая память держит персонажей, окружение и стиль в длинных сессиях. Продолжение видео, синхронный звук. 18fps в 832×480, апскейл до 4K
Демо
———
H3-World
#MiniMaxH3 научили реагировать на клавиши движения и камеры. Команды переводятся в текстовые инструкции к моментам видео, отдельный модуль действий не нужен, только #LoRA
Пока генерация по последовательности клавиш, не real-time.
Код
HF
Спасибо @Endorpheen
#interactive #world
VK | MAX
Prompting Claude Fable 5.1
Официальный промпт-гайд
Как изменилось поведение модели между Claude Fable 5.1 и Claude Mythos 5.1 и что с этим делать в промптах для агентов
• effort уровни low medium high xhigh max дают другой объём размышлений чем раньше - тестировать заново
• модель реже шлет промежуточные апдейты между вызовами инструментов, может молчать минутами - статус проси явно
• в agent loops лучше батчить независимые tool calls за один ход
• история диалога должна быть append-only, иначе запрос падает с ошибкой bound to a different conversation
• на low effort модель реже лезет в search и retrieval, чаще отвечает по памяти
• безобидные запросы на код иногда получают stop_reason refusal из-за safety классификаторов
• на xhigh и max для длинных ответов нужен запас по max_tokens
#prompting #guide
VK | MAX
Atlas
Новая модель мира от World Labs для пространственного интеллекта. Предобучена с нуля работать сразу с текстом, изображениями, видео и 3D в общем пространственном контексте: по всему увиденному генерирует что будет дальше и держит сцену согласованной в 3D.
• генерация с управлением камерой - видео из одного или нескольких снимков с точным заданием ракурса
• реконструкция сцен - из нескольких фото восстанавливает новые ракурсы и явную 3D-геометрию, обходя специализированные модели реконструкции
• симуляция пространства и времени - перекадрирует видео и готовит данные для робототехники по принципу реального в симуляцию
• генерация изображений - текст в картинку и в 360-панораму, сложные промпты, рендер текста, разные стили
• видео до 1 минуты при 1440p
• реконструкция по 1-100+ входным изображениям
Поклянчить ранний доступ
#world #image2world #gaussian
Muse Voice Transcribe
Meta (запрещено в РФ) Superintelligence Labs выкатила первую модель распознавания речи в реальном времени. Разбирает голос, диаризацию и определение конца фразы на лету без задержек
Возможности:
• потоковое распознавание речи
• диаризация 20+ говорящих одновременно
• определение конца реплики в потоке
• переключение между языками внутри одной фразы
• настройка на конкретные имена и термины
Поддержка 25+ языков. Русский не указан. В демонстрации модель разбирает восемь человек, говорящих одновременно, и правильно понимает кто что сказал.
Отдельно точность подтягивается контекстом: если упомянуть конкретное имя или место, модель его узнает и не путает с похожими словами
#stt #diarize #realtime
VK | MAX
UNSEEN Gemma 4 26B NSFW
Дообученная версия Gemma в формате GGUF, заточена под NSFW-контент
———
GLM-5.3-Flash-UNCENSORED-FP8
Обесцензуренный FP8 GLM-5.3-Flash
#uncensored #gguf #fp8
VK | MAX
Google Pics
Google запустил Canva-подобный сервис для создания и редактирования картинок внутри Workspace. В основе естественно модель Nano Banana.
Генерация изображений по текстовому запросу, точечная правка, выделение отдельных объектов, редактирование и перевод текста на картинке.
Работает как отдельный продукт и встраивается в Docs, Slides и Drive - редактировать можно, не выходя из документа. Над одной картинкой уже можно работать командой
Доступ уже получают подписчики Google AI Pro и Ultra, а также большинство бизнес-клиентов Workspace
#imageediting #design
VK | MAX
Накопилось по #minimaxH3 - часть 13
t.me/rublev_cgai/50 - Minimax Studio от @Evgeny_Rublev
github.com/seitanism/ComfyUI-H3-Motion-Context-MultiRef - продление генерации с контекстом движения, референсами, латентным маскированием
github.com/ethanfel/ComfyUI-MiniMaxH3-Contex-Loop - чейнер сцен со сценарным подходом: просмотр, retry, досборка
github.com/KursatAs/ComfyUI-H3-Multishot-Advance - рендер последовательности, закрыл ComfyUI, открыл - продолжил
github.com/chflame163/ComfyUI_Qwen_H3_Prompt - Qwen3.8-27B + офисные скиллы H3 в ноде ComfyUI. Свой llama.cpp сервер, выгрузка из VRAM после использования
github.com/YixuAnsensei/minimax-h3-comfyui-all-in-one - ресурс-пак для запуска H3 на 8GB VRAM ноутбуке
civitai.com/models/2899220/minimax-h3-t2va-t2v-polyhedron-perfect-eyes-perfect-skin-perfect-hands - LoRA на реалистичную кожу с дефектами, улучшает руки и глаза. Триггеры perfe8ct, perfect skin, perfect hands, perfect eyes
#lora #realism #longvideo #multishot
Qwen3.8-Max-0902
Обновление флагманской модели Qwen. Дополнительное обучение на Coding и Cowork подтянуло результаты на сложных корпоративных задачах, научных расчетах и длинных многошаговых сценариях
• работает с задачами уровня enterprise
• держит длинные цепочки шагов без потери контекста
• заточена под кодинг и совместную работу над проектами
• 2.4T параметров
• 1M токенов контекста
Цены за 1M токенов
• $2 за входные, $6 за выходные
• $0.17 explicit cache hit
• $0.25 implicit cache hit
Уже доступна по API на QwenCloud
#news #flagship
VK | MAX
Claude Fable 5.1 и Claude Mythos 5.1
Одна и та же модель под капотом, разный уровень защитных мер. Fable 5.1 в открытом доступе для кодинга и работы со знаниями, Mythos 5.1 - только через доверенные программы, заточен под кибербезопасность и науки о жизни
• поиск уязвимостей в коде разрешен, разработка эксплойтов - нет
• в кибербезопасности на 60% меньше ложных срабатываний
• доступ к биологическим возможностям Mythos 5.1 откроют ученым через программу с правительством США
• для типичных нагрузок Fable 5.1 дешевле Fable 5 примерно на 25%, для агентной работы - до 45%
• Enterprise Frontier Safeguards хранит данные в облаке клиента, начнут подключать поэтапно этой осенью
#news #flagship
VK | MAX
MiniMax-H3 Acc LoRAs — ComfyUI conversion
Сконвертированные для #Comfyui ускоряющие лоры
#optimization #minimaxH3 #lora
VK | MAX
VibeCoded AI-Slop License v1.0
Кто-то наконец написал честную лицензию для кода, который написала нейросеть по смутному промпту. Гист на GitHub разрешает делать с софтом что угодно - без спроса, без указания авторства, без объяснений.
Автор прямо признает: он мог не писать код, не читать код, не тестировать код и не заметить, что половины зависимостей не существует.
Пункт про качество отдельного упоминания достоин: софт может "выглядеть рабочим, тихо делая что-то совсем другое", содержать функции с именами вроде processData2FinalNew и архитектурные решения, принятые потому что "нейросеть сказала - надежнее сделать так"
Гарантий и поддержки нет. Если задеплоил в прод не читая - это было твое решение
#news #coding
VK | MAX
ICE-012 Audio (DarkPs)
Многоязычная говорилка с клонированием голоса. 590 языков и диалектов, есть русский.
- Клонирование голоса по 2 секундам
- Управление голосом: пол, возраст, высота, акцент, стиль (шепот), скорость
- Стриминг-генерация без ожидания полного файла
- Активный акустический адаптер: обрабатывает кодек-эмбеддинги до и после основного блока
Подходит для озвучки на редких языках, где коммерческие TTS отсутствуют
#tts #russian #voicecloning
VK | MAX
+1
DreamX-Creator
Исследовательский фреймворк для нативной генерации видео со звуком в 2K. Первый кадр + текстовый промпт - модель генерирует видео и аудио совместно. Развитие идей Wan и OpenMOSS
- Gated Cross-Modal Attention: видео и аудиопотоки обмениваются информацией в обе стороны
- Финальный апскейл до 2K в один шаг сохраняет движение и тайминг звука
- Развитие идей Wan Team и OpenMOSS (MOVA)
- Ещё не для продакшена: веса, код инференса и инструменты оценки обещают позже
Код / веса ждем
#va #t2va #2k #i2va
VK | MAX
А что, если не выбирать один курс?
В Дизайн-библиотеке BBE — 80+ курсов по дизайну и смежным направлениям. Здесь можно изучать то, что интересно именно сейчас: от типографики, иллюстрации и Photoshop до брендинга, управления, кино и музыки.
И главное — не нужно покупать каждый курс отдельно.
Можно собрать свою собственную траекторию и учиться в свободном ритме — проходить несколько курсов одновременно или переключаться между совершенно разными темами.
С 1 по 14 сентября можно попробовать билиотеку за 1 ₽.
Если давно хотели чему-то научиться, но каждый раз зависали на вопросе «а что именно выбрать?» — возможно, это ваш знак 👀
Посмотреть Дизайн-библиотеку → https://tglink.io/922c88c09d4d3d
#реклама
О рекламодателе
erid: 2W5zFJdN84q
+6
ComfyUI-DLSS5-NR
Неофициальная экспериментальная интеграция NVIDIA DLSS 5 в #ComfyUI. Нода поднимает Neural Rendering внутри процесса ComfyUI через собственный native D3D12-мост, без отдельного исполняемого файла и без временных файлов на диске
• прогоняет IMAGE из ComfyUI через Python/ctypes и dlss5nr_bridge.dll напрямую в D3D12 и NGX
• работает без сторонних процессов и без записи на диск
• доступна как нода DLSS 5 Neural Rendering (Unofficial) в категории experimental
Нужны Windows 10/11 x64, RTX-видеокарта, свежий драйвер NVIDIA и свой легально полученный nvngx_dlssnr.dll - проект его не раздаtт. Целится в недокументированный pre-release интерфейс NVIDIA, не связан с NVIDIA или Comfy Org
#dlss5 #upscale
VK | MAX
