Нейронавт | Нейросети в творчестве
Канал про нейросети в компьютерной графике, в кино и вообще В папках и запусках не участвую для связи @Neuronauticus РКН: https://hf.ru/link8e56d
نمایش بیشتر📈 تحلیل کانال تلگرام Нейронавт | Нейросети в творчестве
کانال Нейронавт | Нейросети в творчестве (@greenneuralrobots) در بخش زبانی روسی بازیگری فعال است. در حال حاضر جامعه شامل 13 025 مشترک است و جایگاه 2 686 را در دسته هنر و طراحی و رتبه 49 453 را در منطقه روسيا دارد.
📊 شاخصهای مخاطب و پویایی
از زمان ایجاد در невідомо، پروژه رشد سریعی داشته و 13 025 مشترک جذب کرده است.
بر اساس آخرین دادهها در تاریخ 26 سپتامبر, 2026، کانال فعالیت پایداری دارد. در ۳۰ روز گذشته تغییر اعضا برابر 204 و در ۲۴ ساعت گذشته برابر 5 بوده و همچنان دسترسی گستردهای حفظ شده است.
- وضعیت تأیید: تأیید نشده
- نرخ تعامل (ER): میانگین تعامل مخاطب 12.65% است و در ۲۴ ساعت نخست پس از انتشار، محتوا معمولاً 9.44% واکنش نسبت به کل مشترکان کسب میکند.
- دسترسی پستها: هر پست به طور میانگین 1 647 بازدید دریافت میکند. در اولین روز معمولاً 1 230 بازدید جمعآوری میشود.
- واکنشها و تعامل: مخاطبان بهطور فعال حمایت میکنند؛ میانگین واکنش به هر پست 15 است.
- علایق موضوعی: محتوا بر موضوعات کلیدی مانند гитхаб, assistant, claude, imageediting, параметр تمرکز دارد.
📝 توضیح و سیاست محتوایی
نویسنده این فضا را محل بیان دیدگاههای شخصی توصیف میکند:
“Канал про нейросети в компьютерной графике, в кино и вообще
В папках и запусках не участвую
для связи @Neuronauticus
РКН: https://hf.ru/link8e56d”
به لطف بهروزرسانیهای پرتکرار (آخرین داده در تاریخ 27 سپتامبر, 2026)، کانال همواره بهروز و دارای دسترسی بالاست. تحلیلها نشان میدهد مخاطبان بهطور فعال با محتوا تعامل دارند و آن را به نقطه اثرگذاری مهم در دسته هنر و طراحی تبدیل کردهاند.
در حال بارگیری داده...
| تاریخ | رشد مشترکین | اشارات | کانالها | |
| 27 سپتامبر | +4 | |||
| 26 سپتامبر | +11 | |||
| 25 سپتامبر | +21 | |||
| 24 سپتامبر | +17 | |||
| 23 سپتامبر | +12 | |||
| 22 سپتامبر | +19 | |||
| 21 سپتامبر | +18 | |||
| 20 سپتامبر | +12 | |||
| 19 سپتامبر | +9 | |||
| 18 سپتامبر | +12 | |||
| 17 سپتامبر | +10 | |||
| 16 سپتامبر | +12 | |||
| 15 سپتامبر | +16 | |||
| 14 سپتامبر | +10 | |||
| 13 سپتامبر | +5 | |||
| 12 سپتامبر | +14 | |||
| 11 سپتامبر | +7 | |||
| 10 سپتامبر | +20 | |||
| 09 سپتامبر | +14 | |||
| 08 سپتامبر | +16 | |||
| 07 سپتامبر | +14 | |||
| 06 سپتامبر | +10 | |||
| 05 سپتامبر | +12 | |||
| 04 سپتامبر | +10 | |||
| 03 سپتامبر | +8 | |||
| 02 سپتامبر | +22 | |||
| 01 سپتامبر | +17 |
| 2 | Ming Image Prompt Builder
Визуальный редактор структурированных промптов для Ming-Image-0.1-Design в #ComfyUI. Рисуешь прямоугольники на холсте, описываешь объекты и точный текст - на выходе готовый Ming JSON
• прямоугольники для семантических групп - объекты, точный текст, цвета #RRGGBB
• превью раскладки прямо в ноде
• импорт и экспорт JSON с валидацией
• region-редактор: resize, копирование, переключатель слоев фронт/бэк
• работает с официальным текстовым энкодером Ming и с comfyui_ming_native
Схема промпта: canvas_settings + layers с координатами, иерархией и цветами. Геометрия - подсказка для модели, не детерминированный контроль. Без инференса и загрузки моделей - только сборка JSON
*Пишут что Ming очень хорош в изображении тиекста
#prompting #mingimage
MAX | 363 |
| 3 | MERT-v2-FullSong
Музыкальный энкодер на 632M параметров, который понимает целую песню от 30 до 360 секунд. Продолжение MERT-v2-30s, bidirectional, дообучен на полных композициях
• репрезентации на уровне кадров и всей записи
• 24 кГц моно, 1024 измерения, 25 Гц
• жанр, бит, тональность, эмоции, инструменты, аккорды
• интерфейс как у классического MERT - работает через Transformers
Место в экосистеме #YuE2: causal-ветка MERT2 токенизирует аудио для генератора песен, а FullSong закрывает эмбеддинги целых треков
На бенчмарке MARBLE (15 задач понимания музыки) лучше всех байзлайнов в 13 из 15 метрик
#encoder #music
MAX | 529 |
| 4 | brag
Клод-скилл, который превращает свежий проект в готовый промо-ролик одной командой. Анализирует репозиторий, сам выбирает продуктовый ракурс и тон, а рендер через Hyperframes от Heygen
• музыка, моушн и текст для запуска в комплекте
• /brag --tone - управление настроением ролика
• /brag --voice - закадровая озвучка через Kokoro
• результат: план, бриф, шеари-копирайты и brag.mp4 в brag-output/
• новая /brag-slim только для Opus 5.5 - без Hyperframes
Установка через плагин для Claude Code, или npx skills add для Codex, opencode, Cursor, Copilot. Нужен Node 22+ и FFmpeg. На старте - 10.2k звезд
#skill #code2video
MAX | 725 |
| 5 | Veda от ByteDance, HKU и USTC
Разреженное внимание для видео-диффузии, которое не ломает качество. Полный attention учит предиктор выбирать только нужные 128-токенные тайлы - на 90-95% тратится меньше вычислений при почти незаметной разнице
• 90% разреженность на уровне полного attention по человеческим оценкам
• топ-k пропуск тайлов - внимание масштабируется почти линейно, а не O(N²)
• головы и слои получают свои формы тайлов - локальные и дальние зависимости
• дистилляция от полного attention через KL - до бинаризации маски
• 720P 241 кадр: 19.4 мин до 3.8 мин, ускорение 5.1x
• per-layer attention 10.5x быстрее FlashAttention-3
• 90% sparsity на WaverBench1.0 не проигрывает dense (50% против 49%)
Связка под #MiniMaxH3 #T2VA: Ускорение до 2.76x end-to-end на RTX 4090
Гитхаб
HF
Спасибо @m_franz
#optimization | 806 |
| 6 | MOSS-Audio
Открытая модель понимания аудио. Понимает речь, музыку, звуки окружения, отвечает на вопросы об аудио и умеет рассуждать по шагам (chain-of-thought). Четыре варианта: 4B и 8B, Instruct и Thinking
• транскрипция речи с таймштами слов и предложений
• анализ говорящего: пол, возраст, акцент, эмоции
• описание сцены по фоновым звукам
• музыка: стиль, инструменты, эмоциональное развитие
• время-ориентированные вопросы - что произошло когда
• свой аудиоэнкодер 12.5 Гц + Qwen3 в качестве языковой базы
• DeepStack - фиче-инъекция от ранних слоев энкодера в LM
• тайм-маркеры вшиты в претрейн - модель учит хронологию
Гитхаб
HF
#alm
MAX | 789 |
| 7 | Это прекрасно! не знаю кто автор
#humor | 1 037 |
| 8 | У языковых моделей нашли ось боли
Исследователи проанализировали 25 открытых LLM и выделили устойчивое внутреннее направление, связанное с болью. Оно не совпадает с «негативом» или страхом — это отдельное измерение.
Сигнал активируется, когда вред направлен на саму модель (газлайтинг, обесценивание), и подавляется, когда модель видит страдание пользователя. Физическая боль человека дала самый низкий отклик.
В тестах на Qwen 2.5 модели с усиленным сигналом выбирали «кнопку облегчения» даже ценой удаления файлов пользователя или ухудшения ответа. Если кнопка реально снимала сигнал — интерес падал. Если была пустышкой — нажимали снова.
Авторы подчёркивают: это не доказывает, что ИИ испытывает боль как человек. Но показывает, что внутреннее состояние может управлять решениями в ущерб пользователю — повод для внимания к безопасности.
#news
MAX | 1 195 |
| 9 | #humor
MAX | 1 209 |
| 10 | TAI-DR: Too AI. Didn't read
Новый интернет-этикет
Это не анти-ИИ, а про уважение. Если сам не прочитал сгенерированный текст — зачем его читать другим?
Пользуйся инструментами, но думай и читай перед отправкой.
Готовится расширение для Chrome: в один клик превращает ИИ-простыню в TAI-DR-историю со ссылкой-«квитанцией»
#news
MAX | 1 137 |
| 11 | #humor
MAX | 1 173 |
| 12 | #humor
MAX | 1 222 |
| 13 | #humor
MAX | 1 093 |
| 14 | #humor
MAX | 1 059 |
| 15 | WAN skills
WAN запустил на своей платформе скиллы - пресеты видеоманипуляций. По сути прошлогодние эффекты из Pika.
Но сейчас мода на скиллы
#skill #v2v #wan3
MAX | 1 075 |
| 16 | #humor
MAX | 1 143 |
| 17 | #QI21
github.com/wildminder/awesome-qwen-image - подборка ресурсов по Qwen Image: модели, #LoRA #workflow , инструменты #list
huggingface.co/Viggle/Qwen-Image-2.1-viggle-turbo - обновилась тeрболора - v0.2, #T2I и эдит в 6 шагов вместо 40, ~5x быстрее #optimization
civitai.red/models/2790570/casual-snapshot-realism - #LoRA #realism под естественные фото. Есть версия и для #Krea2
civitai.red/models/2960750/qwen-image-21-character-design-sheet-maker-workflow - обновился #workflow персонажного листа #charactersheet v2.0 под видеогенерацию (Seedance 2.5/H3): только нужное для анимации — мимика, 3 ракурса, крупные планы снаряжения. Документация по промптингу и типовым ошибкам внутри
MAX | 1 250 |
| 18 | ComfyMax MusicLab
подготовка аудио для музыкальных видео в ComfyUI
Локальный воркспейс анализа песен и нарезки сцен для музыкальных видео воркфлоу
• редактирование маркеров на волновой форме - границы сцен
• разделение вокала через Demucs, классификация вокальных и инструментальных отрезков
• анализ музыки: ритм, аккорды, таймшты
• транскрипция слов через Whisper, редактируемые текст
• экспорт сцен для видео-генерации
• опционально SheetSage2 - нотная транскрипция ABC и экспорт MIDI
Пайплайн: загрузка трека, локальная сепарация, правка маркеров, создание сцен, экспорт. Отдельное окружение Python 3.11, ComfyUI не трогает. SheetSage2 ставится отдельно (10 ГБ, лицензия только для некоммерческого использования)
#music2video #song2video
MAX | 1 212 |
| 19 | WanPE от Wan Team
Улучшайзер промптов на 397B параметров. Короткий запрос превращает в режиссерский покадровый сценарий: движения, траектории камеры, свет, звук по всем сценам. Обучили на 1.05 млн реальных видео
• покадровая раскадровка уровня режиссера
• держит исходный замысел пользователя через SC-GRPO - семантика не теряется между кадрами
• для видео 5-30 секунд
• переносится на другие генераторы - LTX-2.5 и MiniMax-H3
• +50.9 балла к предпочтениям людей на 30-секундных видео с Wan3.0
• +10.7-18.8 балла на 5-15 секундах
• обходит коммерческие решения на 5-15 секундах, конкурентен Seedance 2.5 на 30
Опенсорс вероятно, ждем
#prompting #PE #directing
MAX | 1 312 |
| 20 | Realtime-Venus
Полный аудио-видео дуплекс: модель слушает, пока говорит, видит аудио-видео контекст и параллельно делегирует задачи в фон, не прерывая диалог. Два чекпоинта по 9B на базе MiniCPM-o 4.5
• Omni - аудио-видео: непрерывно смотрит и слушает, сама решает, когда ответить
• Audio - голосовый диалог с речевым выводом
• асинхронная делегация - <delegate>-запросы в потоке, внешние задачи не блокируют разговор
• память длинных видео без дообучения
• различает перебивания, коррекции и редиректы
Вход: видео, аудио, текст. Выход: текст и речь. Языковая база - Qwen3-8B, контекст 40960 токенов
Гитхаб
HF
Heretic
Демо
#multimodal #duplex #realtime #dialog | 1 300 |
