Нейронавт | Нейросети в творчестве
Канал про нейросети в компьютерной графике, в кино и вообще В папках и запусках не участвую для связи @Neuronauticus РКН: https://hf.ru/link8e56d
Показати більше📈 Аналітичний огляд Telegram-каналу Нейронавт | Нейросети в творчестве
Канал Нейронавт | Нейросети в творчестве (@greenneuralrobots) у мовному сегменті Російська є активним учасником. На даний момент спільнота об'єднує 12 579 підписників, посідаючи 2 819 місце в категорії Мистецтво та дизайн та 52 045 місце у регіоні Росія.
📊 Показники аудиторії та динаміка
З моменту свого створення невідомо, проект продемонстрував стрімке зростання, зібравши аудиторію у 12 579 підписників.
За останніми даними від 21 липня, 2026, канал демонструє стабільну активність. Хоча за останні 30 днів спостерігається зміна кількості учасників на 268, а за останні 24 години на 10, загальне охоплення залишається високим.
- Статус верифікації: Не верифікований
- Рівень залученості (ER): Середній показник залученості аудиторії становить 13.42%. Протягом перших 24 годин після публікації контент зазвичай збирає 9.75% реакцій від загальної кількості підписників.
- Охоплення публікацій: В середньому кожен допис отримує 1 688 переглядів. Протягом першої доби публікація в середньому набирає 1 226 переглядів.
- Реакції та взаємодія: Аудиторія активно підтримує контент: середня кількість реакцій на один пост – 15.
- Тематичні інтереси: Контент зосереджений навколо ключових тем, таких як гитхаб, assistant, claude, imageediting, параметр.
📝 Опис та контентна політика
Автор описує ресурс як майданчик для висловлення суб'єктивної думки:
“Канал про нейросети в компьютерной графике, в кино и вообще
В папках и запусках не участвую
для связи @Neuronauticus
РКН: https://hf.ru/link8e56d”
Завдяки високій частоті оновлень (останні дані отримано 22 липня, 2026), канал підтримує актуальність та високий рівень охоплення публікацій. Аналітика показує, що аудиторія активно взаємодіє з контентом, що робить його важливою точкою впливу в категорії Мистецтво та дизайн.
Триває завантаження даних...
| Дата | Залучення підписників | Згадування | Канали | |
| 22 липня | +8 | |||
| 21 липня | +16 | |||
| 20 липня | +16 | |||
| 19 липня | +7 | |||
| 18 липня | +3 | |||
| 17 липня | +6 | |||
| 16 липня | +9 | |||
| 15 липня | +15 | |||
| 14 липня | +14 | |||
| 13 липня | +11 | |||
| 12 липня | +4 | |||
| 11 липня | +4 | |||
| 10 липня | +11 | |||
| 09 липня | +15 | |||
| 08 липня | +10 | |||
| 07 липня | +12 | |||
| 06 липня | +14 | |||
| 05 липня | +16 | |||
| 04 липня | +8 | |||
| 03 липня | +9 | |||
| 02 липня | +12 | |||
| 01 липня | +12 |
| 2 | MuScriptor
Модель для извлечения MIDI-партий из сведенного музыкалного трека
• разделяет трек на партии барабанов, баса, клавиш, вокала и др.
• учитывает заданный список инструментов для снижения ошибок
Попробовать
Гитхаб
HF
Демо
Галерея
Pinokio
#audio2midi #music2midi #midi #unmix | 551 |
| 3 | FedorAiToolkit
Форк AI Toolkit
Автор добавил в него SAM 3D Body Scanning, чтобы обучать лоры не только на лицо но и на форму тела
Процесс обучения состоит из двух этапов:
1. Обычное обучение LoRA/LoKr на фотографиях пользователя (около 200 шагов)
2. Второй этап: модель генерирует изображения, SAM 3D сканирует их, и обучение подгоняет LoRA под отсканированное тело и лицо
Это позволяет добиться большего сходства с реальным человеком в полных портретах. Время обучения на RTX 5090 около 30 минут для лица и около 60 минут с учетом тела
Реализовано для Krea 2
Есть еще похожий проект BodyRec - помогает лоре запомнить пропорции тела
#finetuning #personalization #krea2 | 724 |
| 4 | #humor | 747 |
| 5 | TimeLens2
Модель для поиска моментов в видео по текстовому запросу. Превращает видеопоток в постоянную визуальную память с привязкой к сущностям. По запросу на естественном языке выдаст интервалы на временной шкале
• обрабатывает однократные и повторяющиеся события
• работает с видео от третьего лица и эгоцентрическими
• выдаёт один или несколько временных интервалов
• использует мультимодальные LLM
• есть несколько версий модели: TimeLens2-4B и TimeLens2-8B
Гитхаб
HF
Демо
#vlm #captioning #video2text #mllm | 887 |
| 6 | IGGT4D
Онлайн-понимание 4D-сцен в видеопотоке. Строит единую модель сцены на лету - геометрия, движение камеры, объекты.
• сегментирование и олтслеживание объектов, глубина
• обрабатывает кадры по очереди
• переиспользует прошлый контекст через causal spatial-temporal modeling. Всю историю не хранит для экономии памяти
• обновляет представление сцены инкрементально
• чётко выделяет отдельные объекты.
код / веса ждем
#vlm #tracking #segmentation #videoto4d #vidfeo2depth | 816 |
| 7 | Seed Audio 1.0
Аудиомодель от ByteDance. Генерирует за один проход целую звуковую сцену по одному промпту. Озвучка, подкасты, дубляж
• Можно жестко задавать тайминг реплик с точностью до 100 мс
• 20+ языков, перенос тембра между ними
• Клонирование голоса по референсам. До трёх аудиоклипов подключаются к промпту как @Audio1, @Audio2, @Audio3. Вместо аудио можно дать картинку с описанием персонажа.
Русский язык почти не тянет, промпт надо на английском. Лимит 2 минуты аудио, промпт до 3000 знаков. Цена ~$0.15–0.19/минута
Попробовать
Спасибо @QuantumFast
#t2a #text2audio #tts #voicecloning #voicedesign #online | 912 |
| 8 | Laguna S 2.1
#MoE модель от Poolside для программирования и долгих агентных задач
• 118B параметров, на токен активны 8B
• контекст до 1 млн токенов
• два режима - с рассуждением и без
• Terminal-Bench 70,2%, SWE-Bench Multilingual 78,5%
• запускается на одном DGX Spark
• веса под лицензией OpenMDW-1.1
• возможны ошибки в агентных оболочках и при долгих рассуждениях
Доступна бесплатно в OpenCode и KiloCode
HF
Квантизации
Чат
Openrouter
Спасибо @Endorpheen
#coding #agent | 934 |
| 9 | HOMIE
Фреймворк для персонализации видео с фокусом на взаимодействии человека и объектов. Решает проблему неестественных движений и потери идентичности при генерации сцен.
• генерация сложных взаимодействий с сохранением естественности движений
• точное размещение и удержание логотипов в динамике
• стабильная читаемость текста от кадра к кадру
• согласованность образа при смене ракурса
В основе - MLLM плюс WAN 2.1
Гитхаб
HF
#wan21 #hoi #personalization #i2v #referencing | 1 055 |
| 10 | Mage-Flow
У нас новый игрок в опенсорсе для работы с картинками
Компактная модель от Microsoft для создания и редактирования изображений. 4B параметров
• генерация изображений по тексту
• редактирование по инструкциям
• работа с разрешением от 512 до 2048
• поддержка любых пропорций
• высокая скорость генерации
• семантическое редактирование
• трансформация внешнего вида
• реставрация изображений
Выпущен в трёх вариантах: Base, RL-aligned и Turbo. На A100 генерирует изображение за 0.59 секунды, редактирование - за 1.02 секунды. Используют Mage-VAE для эффективного кодирования
Гитхаб
HF
Демо
#t2i #i2i #imageediting #image2normals | 1 117 |
| 11 | LTX-2.3 Clean Plate IC-LoRA
лора удаляет из видео людей и движущиеся объекты, оставляя задний план
Демо
Спасибо @m_franz
#lora #ltx23 #cleanup #cleanplate | 977 |
| 12 | Gemini 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber
Gemini 3.6 Flash
на базе 3.5 Flash
- Цена: $1.50/1M input, $7.50/1M output.
- Экономия токенов: 17% output против 3.5 Flash
- DeepSWE: экономия до 65% токенов.
- Меньше шагов рассуждения и tool calls в многошаговых воркфлоу
Gemini 3.5 Flash-Lite
Быстрая и экономичная для high-throughput задач, поиска и обработки документов
- Скорость: 350 output tokens/s
- Цена: $0.3/1M input, $2.5/1M output
- Регулируемые уровни мышления
- Computer Use встроен как нативный инструмент
Gemini 3.5 Flash Cyber в CodeMender
Специализированная модель на базе 3.5 Flash для кибербезопасности
- Агенты кооперируются для единого отчёта
- Только для доверенных партнеров
Studio
#coding #agent #security | 1 015 |
| 13 | #humor | 1 219 |
| 14 | #humor | 1 227 |
| 15 | SHELLS: Topologically Consistent Multi-view 3D Head Reconstruction via Coarse-Guided Layered Surface Sampling
Реконструкция 3D‑головы с текстурами от Google по нескольким видам. Держит топологию, избегает артефактов
Сразу пригодная для анимации топология
Точность до субмиллиметровых деталей.
Жрет 2.4 GB VRAM. Но это VRAM у кого надо VRAM. Кода-весов нет
#head #HMR #imageto3d #photogrammetry | 1 527 |
| 16 | 🎨 Most-AI — российский сервис нейросетей: картинки, видео, музыка и текст в одном окне.
Более 100 нейросетей: генерируй изображения, видео и озвучку, общайся с ИИ-чатом — без зарубежных подписок и без VPN, оплата картой РФ.
🎁 Промокод PIXO — +50% бонусами на первое пополнение (бонусами оплачиваются любые генерации).
👉 most-ai.com | 1 067 |
| 17 | Qwen‑Image 3.0
Генератор-редактор в одной модели.
Главная обнова - промпт до 4500 токенов против 1000 токенов у версии 2.0
* Справляется со сложными макетами (газеты, сториборды, слайды), держит порядок в 3×3 сетке без склейки. Горизонтально раскидывает много блоков, вертикально вкладывает интерфейсы друг в друга
* Детальность. Мелкий текст от 10 px, поры, волоски, текстуры как в фото. Точно рисует LaTeX‑формулы, делает рукописные пометки, реставрирует старые картины
* 12 языков, 100+ стилей, уйма UI, крепкая база знаний. Генерит научные инфографики, прогнозы погоды, стримы с художниками, добавляет к фото научные подписи и шкалы, прям под публикацию
Весов, кода, техотчета нет. Видать решили что можно уже с этой версии в проприетарные модели идти
бананы, GPT-Image - потеснитесь. Впрочем, Qwen пишет что для модели 1.0 лозунг был "Точность" а там было мыло мыльное, так что посмотрим
Чат
#qi3 #t2i #i2i | 1 502 |
| 18 | Wan 2.2 I2V: One Expert, FP4, on a Single RTX 5090
Как вы помните, видеогенератор WAN 2.2 состоит из двух экспертов: low noise и high noise. Так вот, TheStage AI взяли low noise и дообучили ему лору на high noise. Получилось: 1 модель + лора
Ну и сверху еще навалили ускорений: NVFP4 + FP4 attention
На сайте два автора подписались - судя по фамилиям русские
Первое видео - обычный low noise
Второе - low noise с лорой
HF
ComfyUI
#wan22 #optimization #nvfp4 #fp4 #lora | 1 200 |
| 19 | Lucida
Модель для удаления фона от MIT на базе BiRefNet. Создает PNG с альфа-каналом
Справляется лучше коммерческих моделей с камуфляжем, иллюстрациями и сохранением текста
Использует точную промежуточную альфу для стекла
Есть слабые места: коммерческий API всё же лучше справляется с прозрачностью. InSPyReNet круче в сложных сценах и тонких структурах. RMBG-2.0 лучше обрабатывает волосы
Гитхаб
HF
Галерея
Демо
#image2matte #rgb2rgba #backgroundremoval | 1 340 |
| 20 | Cosmos 3 Edge
Еще один релиз от NVIDIA, фронтир-модель мира для локального запуска. Для роботов, автопилотов, ИИ-агентов. Понимание сцен, предсказание намерений, действия по видео.
• 4B параметров, reasoner на 2B на базе Nemotron
• авторегрессионный и диффузионный transformer-блоки
• мультимодальное внимание, единый механизм для понимания и симуляции
• управление с частотой 15 Гц
• первое место в VANTAGE-Bench среди открытых моделей такого размера
HF
#mobile #robot #vlm #multimodal #videoto3d | 1 267 |
