Нейронавт | Нейросети в творчестве
Канал про нейросети в компьютерной графике, в кино и вообще В папках и запусках не участвую для связи @Neuronauticus РКН: https://hf.ru/link8e56d
إظهار المزيد📈 نظرة تحليلية على قناة تيليجرام Нейронавт | Нейросети в творчестве
تُعد قناة Нейронавт | Нейросети в творчестве (@greenneuralrobots) في القطاع اللغوي الروسية لاعباً نشطاً. يضم المجتمع حالياً 12 579 مشتركاً، محتلاً المرتبة 2 819 في فئة الفن والتصميم والمرتبة 52 045 في منطقة روسيا.
📊 مؤشرات الجمهور والحراك
منذ تأسيسه في невідомо، حقق المشروع نمواً سريعاً وجمع 12 579 مشتركاً.
بحسب آخر البيانات بتاريخ 21 يوليو, 2026، تحافظ القناة على نشاط مستقر. خلال آخر 30 يوماً تغيّر عدد الأعضاء بمقدار 268، وفي آخر 24 ساعة بمقدار 10، مع بقاء الوصول العام مرتفعاً.
- حالة التحقق: غير موثّقة
- معدل التفاعل (ER): يبلغ متوسط تفاعل الجمهور 13.42%. وخلال أول 24 ساعة من النشر يحصد المحتوى عادةً 9.75% من ردود الفعل نسبةً إلى إجمالي المشتركين.
- وصول المنشورات: يحصل كل منشور على متوسط 1 688 مشاهدة. وخلال اليوم الأول يجمع عادةً 1 226 مشاهدة.
- التفاعلات والاستجابة: يتفاعل الجمهور بانتظام؛ متوسط التفاعلات لكل منشور يبلغ 15.
- الاهتمامات الموضوعية: يركز المحتوى على مواضيع رئيسية مثل гитхаб, assistant, claude, imageediting, параметр.
📝 الوصف وسياسة المحتوى
يصف المؤلف القناة بأنها مساحة للتعبير عن الآراء الذاتية:
“Канал про нейросети в компьютерной графике, в кино и вообще
В папках и запусках не участвую
для связи @Neuronauticus
РКН: https://hf.ru/link8e56d”
بفضل وتيرة التحديث المرتفعة (أحدث البيانات بتاريخ 22 يوليو, 2026) تحافظ القناة على حداثتها ومستوى وصول مرتفع. وتُظهر التحليلات تفاعلاً نشطاً من الجمهور، ما يجعلها نقطة تأثير مهمة ضمن فئة الفن والتصميم.
جاري تحميل البيانات...
| التاريخ | نمو المشتركين | الإشارات | القنوات | |
| 22 يوليو | +8 | |||
| 21 يوليو | +16 | |||
| 20 يوليو | +16 | |||
| 19 يوليو | +7 | |||
| 18 يوليو | +3 | |||
| 17 يوليو | +6 | |||
| 16 يوليو | +9 | |||
| 15 يوليو | +15 | |||
| 14 يوليو | +14 | |||
| 13 يوليو | +11 | |||
| 12 يوليو | +4 | |||
| 11 يوليو | +4 | |||
| 10 يوليو | +11 | |||
| 09 يوليو | +15 | |||
| 08 يوليو | +10 | |||
| 07 يوليو | +12 | |||
| 06 يوليو | +14 | |||
| 05 يوليو | +16 | |||
| 04 يوليو | +8 | |||
| 03 يوليو | +9 | |||
| 02 يوليو | +12 | |||
| 01 يوليو | +12 |
| 2 | MuScriptor
Модель для извлечения MIDI-партий из сведенного музыкалного трека
• разделяет трек на партии барабанов, баса, клавиш, вокала и др.
• учитывает заданный список инструментов для снижения ошибок
Попробовать
Гитхаб
HF
Демо
Галерея
Pinokio
#audio2midi #music2midi #midi #unmix | 551 |
| 3 | FedorAiToolkit
Форк AI Toolkit
Автор добавил в него SAM 3D Body Scanning, чтобы обучать лоры не только на лицо но и на форму тела
Процесс обучения состоит из двух этапов:
1. Обычное обучение LoRA/LoKr на фотографиях пользователя (около 200 шагов)
2. Второй этап: модель генерирует изображения, SAM 3D сканирует их, и обучение подгоняет LoRA под отсканированное тело и лицо
Это позволяет добиться большего сходства с реальным человеком в полных портретах. Время обучения на RTX 5090 около 30 минут для лица и около 60 минут с учетом тела
Реализовано для Krea 2
Есть еще похожий проект BodyRec - помогает лоре запомнить пропорции тела
#finetuning #personalization #krea2 | 724 |
| 4 | #humor | 747 |
| 5 | TimeLens2
Модель для поиска моментов в видео по текстовому запросу. Превращает видеопоток в постоянную визуальную память с привязкой к сущностям. По запросу на естественном языке выдаст интервалы на временной шкале
• обрабатывает однократные и повторяющиеся события
• работает с видео от третьего лица и эгоцентрическими
• выдаёт один или несколько временных интервалов
• использует мультимодальные LLM
• есть несколько версий модели: TimeLens2-4B и TimeLens2-8B
Гитхаб
HF
Демо
#vlm #captioning #video2text #mllm | 887 |
| 6 | IGGT4D
Онлайн-понимание 4D-сцен в видеопотоке. Строит единую модель сцены на лету - геометрия, движение камеры, объекты.
• сегментирование и олтслеживание объектов, глубина
• обрабатывает кадры по очереди
• переиспользует прошлый контекст через causal spatial-temporal modeling. Всю историю не хранит для экономии памяти
• обновляет представление сцены инкрементально
• чётко выделяет отдельные объекты.
код / веса ждем
#vlm #tracking #segmentation #videoto4d #vidfeo2depth | 816 |
| 7 | Seed Audio 1.0
Аудиомодель от ByteDance. Генерирует за один проход целую звуковую сцену по одному промпту. Озвучка, подкасты, дубляж
• Можно жестко задавать тайминг реплик с точностью до 100 мс
• 20+ языков, перенос тембра между ними
• Клонирование голоса по референсам. До трёх аудиоклипов подключаются к промпту как @Audio1, @Audio2, @Audio3. Вместо аудио можно дать картинку с описанием персонажа.
Русский язык почти не тянет, промпт надо на английском. Лимит 2 минуты аудио, промпт до 3000 знаков. Цена ~$0.15–0.19/минута
Попробовать
Спасибо @QuantumFast
#t2a #text2audio #tts #voicecloning #voicedesign #online | 912 |
| 8 | Laguna S 2.1
#MoE модель от Poolside для программирования и долгих агентных задач
• 118B параметров, на токен активны 8B
• контекст до 1 млн токенов
• два режима - с рассуждением и без
• Terminal-Bench 70,2%, SWE-Bench Multilingual 78,5%
• запускается на одном DGX Spark
• веса под лицензией OpenMDW-1.1
• возможны ошибки в агентных оболочках и при долгих рассуждениях
Доступна бесплатно в OpenCode и KiloCode
HF
Квантизации
Чат
Openrouter
Спасибо @Endorpheen
#coding #agent | 934 |
| 9 | HOMIE
Фреймворк для персонализации видео с фокусом на взаимодействии человека и объектов. Решает проблему неестественных движений и потери идентичности при генерации сцен.
• генерация сложных взаимодействий с сохранением естественности движений
• точное размещение и удержание логотипов в динамике
• стабильная читаемость текста от кадра к кадру
• согласованность образа при смене ракурса
В основе - MLLM плюс WAN 2.1
Гитхаб
HF
#wan21 #hoi #personalization #i2v #referencing | 1 055 |
| 10 | Mage-Flow
У нас новый игрок в опенсорсе для работы с картинками
Компактная модель от Microsoft для создания и редактирования изображений. 4B параметров
• генерация изображений по тексту
• редактирование по инструкциям
• работа с разрешением от 512 до 2048
• поддержка любых пропорций
• высокая скорость генерации
• семантическое редактирование
• трансформация внешнего вида
• реставрация изображений
Выпущен в трёх вариантах: Base, RL-aligned и Turbo. На A100 генерирует изображение за 0.59 секунды, редактирование - за 1.02 секунды. Используют Mage-VAE для эффективного кодирования
Гитхаб
HF
Демо
#t2i #i2i #imageediting #image2normals | 1 117 |
| 11 | LTX-2.3 Clean Plate IC-LoRA
лора удаляет из видео людей и движущиеся объекты, оставляя задний план
Демо
Спасибо @m_franz
#lora #ltx23 #cleanup #cleanplate | 977 |
| 12 | Gemini 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber
Gemini 3.6 Flash
на базе 3.5 Flash
- Цена: $1.50/1M input, $7.50/1M output.
- Экономия токенов: 17% output против 3.5 Flash
- DeepSWE: экономия до 65% токенов.
- Меньше шагов рассуждения и tool calls в многошаговых воркфлоу
Gemini 3.5 Flash-Lite
Быстрая и экономичная для high-throughput задач, поиска и обработки документов
- Скорость: 350 output tokens/s
- Цена: $0.3/1M input, $2.5/1M output
- Регулируемые уровни мышления
- Computer Use встроен как нативный инструмент
Gemini 3.5 Flash Cyber в CodeMender
Специализированная модель на базе 3.5 Flash для кибербезопасности
- Агенты кооперируются для единого отчёта
- Только для доверенных партнеров
Studio
#coding #agent #security | 1 015 |
| 13 | #humor | 1 219 |
| 14 | #humor | 1 227 |
| 15 | SHELLS: Topologically Consistent Multi-view 3D Head Reconstruction via Coarse-Guided Layered Surface Sampling
Реконструкция 3D‑головы с текстурами от Google по нескольким видам. Держит топологию, избегает артефактов
Сразу пригодная для анимации топология
Точность до субмиллиметровых деталей.
Жрет 2.4 GB VRAM. Но это VRAM у кого надо VRAM. Кода-весов нет
#head #HMR #imageto3d #photogrammetry | 1 527 |
| 16 | 🎨 Most-AI — российский сервис нейросетей: картинки, видео, музыка и текст в одном окне.
Более 100 нейросетей: генерируй изображения, видео и озвучку, общайся с ИИ-чатом — без зарубежных подписок и без VPN, оплата картой РФ.
🎁 Промокод PIXO — +50% бонусами на первое пополнение (бонусами оплачиваются любые генерации).
👉 most-ai.com | 1 067 |
| 17 | Qwen‑Image 3.0
Генератор-редактор в одной модели.
Главная обнова - промпт до 4500 токенов против 1000 токенов у версии 2.0
* Справляется со сложными макетами (газеты, сториборды, слайды), держит порядок в 3×3 сетке без склейки. Горизонтально раскидывает много блоков, вертикально вкладывает интерфейсы друг в друга
* Детальность. Мелкий текст от 10 px, поры, волоски, текстуры как в фото. Точно рисует LaTeX‑формулы, делает рукописные пометки, реставрирует старые картины
* 12 языков, 100+ стилей, уйма UI, крепкая база знаний. Генерит научные инфографики, прогнозы погоды, стримы с художниками, добавляет к фото научные подписи и шкалы, прям под публикацию
Весов, кода, техотчета нет. Видать решили что можно уже с этой версии в проприетарные модели идти
бананы, GPT-Image - потеснитесь. Впрочем, Qwen пишет что для модели 1.0 лозунг был "Точность" а там было мыло мыльное, так что посмотрим
Чат
#qi3 #t2i #i2i | 1 502 |
| 18 | Wan 2.2 I2V: One Expert, FP4, on a Single RTX 5090
Как вы помните, видеогенератор WAN 2.2 состоит из двух экспертов: low noise и high noise. Так вот, TheStage AI взяли low noise и дообучили ему лору на high noise. Получилось: 1 модель + лора
Ну и сверху еще навалили ускорений: NVFP4 + FP4 attention
На сайте два автора подписались - судя по фамилиям русские
Первое видео - обычный low noise
Второе - low noise с лорой
HF
ComfyUI
#wan22 #optimization #nvfp4 #fp4 #lora | 1 200 |
| 19 | Lucida
Модель для удаления фона от MIT на базе BiRefNet. Создает PNG с альфа-каналом
Справляется лучше коммерческих моделей с камуфляжем, иллюстрациями и сохранением текста
Использует точную промежуточную альфу для стекла
Есть слабые места: коммерческий API всё же лучше справляется с прозрачностью. InSPyReNet круче в сложных сценах и тонких структурах. RMBG-2.0 лучше обрабатывает волосы
Гитхаб
HF
Галерея
Демо
#image2matte #rgb2rgba #backgroundremoval | 1 340 |
| 20 | Cosmos 3 Edge
Еще один релиз от NVIDIA, фронтир-модель мира для локального запуска. Для роботов, автопилотов, ИИ-агентов. Понимание сцен, предсказание намерений, действия по видео.
• 4B параметров, reasoner на 2B на базе Nemotron
• авторегрессионный и диффузионный transformer-блоки
• мультимодальное внимание, единый механизм для понимания и симуляции
• управление с частотой 15 Гц
• первое место в VANTAGE-Bench среди открытых моделей такого размера
HF
#mobile #robot #vlm #multimodal #videoto3d | 1 267 |
