en
Feedback
Нейронавт | Нейросети в творчестве

Нейронавт | Нейросети в творчестве

Open in Telegram

Канал про нейросети в компьютерной графике, в кино и вообще В папках и запусках не участвую для связи @Neuronauticus РКН: https://hf.ru/link8e56d

Show more

📈 Analytical overview of Telegram channel Нейронавт | Нейросети в творчестве

Channel Нейронавт | Нейросети в творчестве (@greenneuralrobots) in the Russian language segment is an active participant. Currently, the community unites 13 037 subscribers, ranking 2 686 in the Art & Design category and 49 418 in the Russia region.

📊 Audience metrics and dynamics

Since its creation on невідомо, the project has demonstrated rapid growth, gathering an audience of 13 037 subscribers.

According to the latest data from 27 September, 2026, the channel demonstrates stable activity. Although there has been a change in the number of participants by 209 over the last 30 days and by 5 over the last 24 hours, overall reach remains high.

  • Verification status: Not verified
  • Engagement rate (ER): The average audience engagement rate is 12.57%. Within the first 24 hours after publication, content typically collects 9.40% reactions from the total number of subscribers.
  • Post reach: On average, each post receives 1 637 views. Within the first day, a publication typically gains 1 225 views.
  • Reactions and interaction: The audience actively supports content: the average number of reactions per post is 14.
  • Thematic interests: Content is focused on key topics such as гитхаб, assistant, claude, imageediting, параметр.

📝 Description and content policy

The author describes the resource as a platform for expressing subjective opinions:
“Канал про нейросети в компьютерной графике, в кино и вообще В папках и запусках не участвую для связи @Neuronauticus РКН: https://hf.ru/link8e56d”

Thanks to the high frequency of updates (latest data received on 28 September, 2026), the channel maintains relevance and a high level of publication reach. Analytics show that the audience actively interacts with content, making it an important point of influence in the Art & Design category.

13 037
Subscribers
+524 hours
+707 days
+20930 days
Posts Archive
ElevenLabs v4 Две новых #TTS Eleven v4 для выразительной подачи и v4 Turbo для риалтайма. Доступны по API и в агентах, включая бесплатный тариф • управление подачей текстом: (laughs), (angry in French accent) - теги стекаются • Turbo: первая речь за ~150 мс, аудио стартует до конца фразы • 90+ языков, включая русский • клон голоса по 10-секундной записи • до 10 000 символов на запрос, тембр держится весь скрипт Первое место на Voice Arena за сентябрь, ~75% предпочтений в слепых тестах. Старую SSML-разметку придется переписать под новый синтаксис. Бесплатно 10 000 кредитов в месяц. Но только для стран первого сорта. У меня анонс даже через квн не открывается MAX

TrackGleam Мастеринг для музыкальных треков Делает звук плотнее и аккуратнее, как после студии • чинит частотный баланс, давит резкость и сибилянты • отдельно контролирует низ, середину и верх • добавляет плотности и громкости без клипов • режимы AI Fix Gentle и Strong - специально против артефактов генераторов Бесплатный режим: без регистрации и вотермарков, WAV скачивается, обработка в браузере, файл не уходит на сервер. Есть платный GleamAI с индивидуальной обработкой #mastering MAX

+6
#krea2 huggingface.co/yijunwang2/krea2-anygles - смена ракурса - для креа тоже сделали. Ноды: github.com/alexw5702-afk/krea2-anygles huggingface.co/Cierpliwy/krea2-inpaint-edit huggingface.co/yijunwang2/krea2-anypaint - инпейнтинг по черной области #inpainting civitai.red/articles/35782/krea-2-bboxbounding-box-text-to-image - статья/гайд по bbox тексту huggingface.co/lvladikov/Krea2-Turbo-Distill-2step-LoRA - 2-шаговая дистилляция Turbo обновилась (chk00031600): 4.2x быстрее денойзинг, детали на уровне учителя civitai.com/models/2911560/realistic-custom-face - #LoRA на 356 реальных портретах с разбором черт — тип лица, глаза, нос, губы, скулы, челюсть, подбородок. На 1.0 стандартное лицо Krea исчезает, теги дают точные черты #realism civitai.red/models/2967466/hm1girl-phone-camera-realism-lora-for-krea-2 - еще реализм MAX

Naive-N0.5-Flash от NaiveAI Модель для кодинга и AI-исследований: 309B параметров MoE при 15.5B активных. Нативный контекст в
+1
Naive-N0.5-Flash от NaiveAI Модель для кодинга и AI-исследований: 309B параметров MoE при 15.5B активных. Нативный контекст в 1 млн токенов без полного внимания - гибрид скользящего окна и разреженного внимания DSA от DeepSeek • 1M контекста целиком • до 2000 токенов/сек в режиме Ultrafast через свою систему NaiveRT • 50 токенов/сек на юзера в стандартном режиме • построена на базе Xiaomi MiMo-V2.5, дообучена на 3.25T токенов • веса под MIT, FP8 • API: $0.10 вход / $0.40 выход / $0.01 кэш за миллион токенов Только NVIDIA с FP8, веса ~315 ГБ Гитхаб HF Спасибо @m_franz #flagship #coding MAX

#QI21 pastebin.com/NVJCj4Xk pastebin.com/Q4uQrq9B - консистентные персонажи: Head shot и Multiview #workflow github.com/Pyrol
+3
#QI21 pastebin.com/NVJCj4Xk pastebin.com/Q4uQrq9B - консистентные персонажи: Head shot и Multiview #workflow github.com/Pyrolistical/qwen-image-2.1-workflows - редактирование, управляемое JSON-файлом рядом с картинкой civitai.com/articles/35828/2x-faster-qwen-image-21-using-4-steps-lora-comfyui-low-vram-workflow - #lowVRAM : INT8 ConvRot + Kitchen Attention + 4-шаговая LoRA = ~2x быстрее. Как эдит-модель Qwen 2.1 силен (стиль, одежда, character sheet), чистый T2I слабее — кожа, руки, мелкий текст github.com/shootthesound/Fizgig - Fizgig 6.5.0: тренировка LoRA и LoKR Qwen Image 2.1, турбо-превью, адаптер с более резкой картинкой (huggingface.co/ShootTheSound/Fizgig-Qwen-Image-2.1-Training-Adapter), 10GB VRAM+ huggingface.co/WarmBloodAban/Qwen-Image-2.1-LoRAs - Anime_consistency, Anything2RealCharacters, huggingface.co/lilylilith/QI_2.1_AnyAngle - произвольные ракурсы для любого изображения #LoRA #cameracontrol MAX

Ember-1 от Fireworks Research Специализированная модель на базе Kimi K3, которая научилась думать меньше. Reasoning-токены ур
Ember-1 от Fireworks Research Специализированная модель на базе Kimi K3, которая научилась думать меньше. Reasoning-токены урезаны примерно на 40%, качество держится - K3 рассуждает дольше, чем нужно задаче, и лишнее можно срезать без потерь • качество уровня K3 при 35-50% меньших тратах токенов • проверено на бенчмарках, живых A/B с двумя клиентами и внутреннем трафике • на DeepSWE 1.1 Ember-1 даже обходит K3 max: 75.2% против 66.4% • внутренние разработчики Fireworks не заметили подмены - норм реклама для модели • цена за задачу ниже: до минус 126 долларов на DeepSWE против K3 max Доступна как Research Preview. Уже есть в Cline, включая десктопное приложение #coding #agent MAX

Создавайте рекламные AI-видеоролики от идеи до монтажа в одном сервисе. Danart — AI-студия для профессионалов: идея → материа
Создавайте рекламные AI-видеоролики от идеи до монтажа в одном сервисе. Danart — AI-студия для профессионалов: идея → материалы → сцены → звук → монтаж. 🎬 Топовые AI-модели 💡 ИИ-чат для идей и сценариев 👤 Персонажи, товары, локации 🎞 Сборка ролика по сценам 🎵 Музыка и русская AI-озвучка ✂️ Монтаж внутри Danart 💰 Дешевле большинства аналогов на 20% и более 💳 Оплата картами МИР и СБП 🎁 Попробуйте бесплатно https://danart.app/?utm_source=greenneuralrobots #промо

+6
Накопилось по #minimaxH3 - часть 28 github.com/fukkun2705-commits/ComfyUI-H3-FaceAutoBypass - сам решает, нужен ли клипу фейсфикс huggingface.co/vpakarinen/natural-face-speech-h3-lora - #lora мимика + четкая английская речь, добавлены мужской/женский голоса с синхронизацией huggingface.co/Alissonerdx/Minimax-H3-ComfyUI - экспериментальные #LoRA на перенос стиля и VFX-эдит (тот же шот с одной правкой) #styletransfer Лора на замену головы #headswap #LoRA huggingface.co/LiseTY/Minimax-H3-ref2v_Anime_2_Realism - #LoRA для аниме→фотореализм #realism huggingface.co/JOKER141/MiniMaxH3-GunFu-Gunfight-LORA - #LoRA перестрелок github.com/RK-BoilingPoint/H3-Visual-Marker-Control - управление кадрами-маркерами: синяя рамка вокруг персонажа и вокруг цели — персонаж сам подходит. Двух персонажей: синий/красный, жtлтый — «дальняя цель» github.com/dntpi/ComfyUI-H3-Refine - H3 Chain Tone v0.3: компенсация накопленного сдвига яркости при склейке клипов #longvideo huggingface.co/akatz-ai/MiniMax-H3-Character-Swap-LoRA - LoRA замены персонажа: фон сохраняется лучше базы, но тайминг движений и мимика ненадежны #characterswap huggingface.co/neph1/minimax_h3_headmounted_fpv_cam - #LoRA «камера на голове» в стиле шутеров от первого лица #pov huggingface.co/ostris/minimax_h3_training_adapter/tree/main - Ostris H3 Training Adapter v3 #finetuning huggingface.co/pablodawson/MiniMax-H3-360-Orbit-LoRA - 360-орбита: одни и те же первый/последний кадр, камера облетает застывшую сцену, петля. Для #FL2VA, нужен спец-промпт #cameracontrol github.com/aaruyou/ComfyUI-RemoteMiniMaxH3 - энкодер H3 на другом ПК, VRAM основной машины свободнее github.com/aroslanov/ComfyUI-VideoAnalyzer - видео → H3-промпт через VLM. Несколько Qwen VL на выбор под VRAM #prompting #video2prompt slopus.ai - Slopus: десктоп-приложение для AI-видео локально. Сцены (first/last, animate, pose, replace, extend, bridge), таймлайн с эффектами и экспортом, встроенный агент с отменой #desktop #agent github.com/lisitskyaa/ComfyUI_UltimateSDUpscaleGuider_H3 - USDU гайдер-апскейл для H3 #upscale github.com/bbaudio-2025/Comfyui-MMH3-UltimateUpscale - ультимативный #upscale huggingface.co/Efficient-Large-Model/H3-to-LTX-Latent-Adapter - адаптер латентов H3 → LTX

+1
TrackEverything от CMU и Meta (запрещено в РФ) Плотный 3D-трекер точек на длинных видео. Отслеживает все видимые точки всех кадров на горизонте 1000+ кадров, представляя видео как постоянные 3D-трассы в мировых координатах • все точки, а не только с первого кадра - трек начинается, как только точка появилась • 3D и 2D трассы одновременно, с учётом движения камеры • классификация статика/динамика покадрово по окнам • разбиение на дубликаты в 3D-представлении убирает двойные соответствия Метод через дедупликацию 3D-сцен-репрезентаций - в отличие от предшественников с ретроспективой на первый кадр. Слабые места честно называются: быстрые смещения и текстуры с повторами ломают соответствие Гитхаб ждем #tracking MAX

supersplat-snap Выравнивание нескольких сцен yf гауссианах в SuperSplat по контрольным точкам • ставишь парные точки на двух и более сплэтах, метод Umeyama считает поворот, сдвиг и масштаб • вторичные сплэты подгоняются под первый (Splat A) • точки редактируются после расстановки - значения X/Y/Z дотягиваются • после выравнивания точки едут вместе со сплэтом - можно итерировать • полный undo, работает с .splat и .ply, поддерживает 3+ сплэтов Установка - клонировать SuperSplat v2.27.3 и перекопировать четыре файла, форк не нужен. Советы по точкам: не ставить все на одной плоскости, 4-6 точек по разным высотам для точного совпадения #gaussian MAX

2026 такой #humor MAX
2026 такой #humor MAX

TostAI Sprite Sheet Studio Делает из видео - игровой спрайт-шит за один проход, полностью локально без внешних API. В одном сервере два инструмента • генератор - маттинг VRMBG-3.0, автокроп, упаковка в сетку + JSON, превью и GIF • редактор - правит готовый лист: пивотируй, чини матт, выбивай фон, перепалитровывай • 44 операции в 9 группах - от pixel-art снэпа до вставки промежуточных кадров • выравнивание пивота по кадру - убирает джиттер от маттинга • Docker-образ с моделью в комплекте, нужен NVIDIA GPU от 24 ГБ VRAM • работает и без докера через Python, веб-морда на 8765 порту • модель VRMBG-3.0 гейтед - свой HF-токен для скачивания Есть готовый превью-плеер с лупами и оnion skin. Docker тянет ~7.4 ГБ github.com/camenduru/TostAI-Sprite-Sheet-Studio github.com/camenduru/TostUI-tost-sprite-video-docker #video2sprite #gamedev MAX

Nanosaur 2 Компактная модель генерации изображений без цензуры с фокусом на аниме Неофициальный релиз модели на 670M параметр
+3
Nanosaur 2 Компактная модель генерации изображений без цензуры с фокусом на аниме Неофициальный релиз модели на 670M параметров, обученной на датасете из 14 миллионов изображений по тегам (аниме-стиль, обширный набор персонажей и стилей). Принимает и естественный язык, и теги Похоже, в отличие от нескольких недавних бесполезных компактных поделок, способных только на 256х256, способен и на полное 1024х1024. Прямо выходное разрешение не указано • родной VAE и текстовый энкодер на 270M в комплекте • понимает натуральный язык и теги - что удобнее • большое покрытие персонажей, арт-стилей и концептов • часто выигрывает у SDXL, несмотря на меньший размер • модель 1.3 ГБ, с энкодером и VAE - 2 ГБ • int8 и w4a8 квантизации уменьшают DiT до 388 МБ • запускается на слабом железе Проект ищет финансирование на версию побольше Есть #int8 и #w4a8 (not recommended #compact #t2i MAX

Ming Image Prompt Builder Визуальный редактор структурированных промптов для Ming-Image-0.1-Design в #ComfyUI. Рисуешь прямоу
Ming Image Prompt Builder Визуальный редактор структурированных промптов для Ming-Image-0.1-Design в #ComfyUI. Рисуешь прямоугольники на холсте, описываешь объекты и точный текст - на выходе готовый Ming JSON • прямоугольники для семантических групп - объекты, точный текст, цвета #RRGGBB • превью раскладки прямо в ноде • импорт и экспорт JSON с валидацией • region-редактор: resize, копирование, переключатель слоев фронт/бэк • работает с официальным текстовым энкодером Ming и с comfyui_ming_native Схема промпта: canvas_settings + layers с координатами, иерархией и цветами. Геометрия - подсказка для модели, не детерминированный контроль. Без инференса и загрузки моделей - только сборка JSON *Пишут что Ming очень хорош в изображении тиекста #prompting #mingimage MAX

MERT-v2-FullSong Музыкальный энкодер на 632M параметров, который понимает целую песню от 30 до 360 секунд. Продолжение MERT-v
MERT-v2-FullSong Музыкальный энкодер на 632M параметров, который понимает целую песню от 30 до 360 секунд. Продолжение MERT-v2-30s, bidirectional, дообучен на полных композициях • репрезентации на уровне кадров и всей записи • 24 кГц моно, 1024 измерения, 25 Гц • жанр, бит, тональность, эмоции, инструменты, аккорды • интерфейс как у классического MERT - работает через Transformers Место в экосистеме #YuE2: causal-ветка MERT2 токенизирует аудио для генератора песен, а FullSong закрывает эмбеддинги целых треков На бенчмарке MARBLE (15 задач понимания музыки) лучше всех байзлайнов в 13 из 15 метрик #encoder #music MAX

brag Клод-скилл, который превращает свежий проект в готовый промо-ролик одной командой. Анализирует репозиторий, сам выбирает продуктовый ракурс и тон, а рендер через Hyperframes от Heygen • музыка, моушн и текст для запуска в комплекте • /brag --tone - управление настроением ролика • /brag --voice - закадровая озвучка через Kokoro • результат: план, бриф, шеари-копирайты и brag.mp4 в brag-output/ • новая /brag-slim только для Opus 5.5 - без Hyperframes Установка через плагин для Claude Code, или npx skills add для Codex, opencode, Cursor, Copilot. Нужен Node 22+ и FFmpeg. На старте - 10.2k звезд #skill #code2video MAX

Veda от ByteDance, HKU и USTC Разреженное внимание для видео-диффузии, которое не ломает качество. Полный attention учит предиктор выбирать только нужные 128-токенные тайлы - на 90-95% тратится меньше вычислений при почти незаметной разнице • 90% разреженность на уровне полного attention по человеческим оценкам • топ-k пропуск тайлов - внимание масштабируется почти линейно, а не O(N²) • головы и слои получают свои формы тайлов - локальные и дальние зависимости • дистилляция от полного attention через KL - до бинаризации маски • 720P 241 кадр: 19.4 мин до 3.8 мин, ускорение 5.1x • per-layer attention 10.5x быстрее FlashAttention-3 • 90% sparsity на WaverBench1.0 не проигрывает dense (50% против 49%) Связка под #MiniMaxH3 #T2VA: Ускорение до 2.76x end-to-end на RTX 4090 Гитхаб HF Спасибо @m_franz #optimization