en
Feedback
Pc1xM1x

Pc1xM1x

Open in Telegram

Нейросети, видео-арт и бесконечные исследования! Автоматизирую творческий хаос и смешиваю несовместимое. Добро пожаловать в лабораторию диких экспериментов!

Show more
The country is not specifiedThe category is not specified
247
Subscribers
+124 hours
+37 days
+3030 days
Posts Archive
А еще свежая локальная модель Gemma 4:31b пишет очень милые стихи! 😊
А еще свежая локальная модель Gemma 4:31b пишет очень милые стихи! 😊

Моя любимая модель обновилась! Google DeepMind выкатил Gemma 4, и прямо сейчас эта линейка уверенно входит в десятку лучших н
Моя любимая модель обновилась! Google DeepMind выкатил Gemma 4, и прямо сейчас эта линейка уверенно входит в десятку лучших нейросетей в мире. Главный кайф — технологии уровня корпоративных флагманов теперь работают локально на ваших устройствах. Бесплатно, без интернета и на 100% приватно. Она стала по-настоящему всеядной: видит любые картинки, понимает видео, нативно слышит аудио и решает сложные логические задачки без галлюцинаций. Как это применять? Закидываете легкую версию на смартфон, и она прямо в авиарежиме делает идеальные выжимки лекций с диктофона или сводит бюджет по фоткам чеков. Модель потяжелее станет безупречным автономным мозгом для вашего умного дома, а флагманская версия на ПК приватно проанализирует вашу медицинскую карту за 10 лет или напишет сложный код. Топовый ИИ окончательно переехал к нам в карманы!

Сегодня — Всемирный день информирования об аутизме. В России взрослым официально не ставят диагноз «аутизм». Даже при явных п
Сегодня — Всемирный день информирования об аутизме. В России взрослым официально не ставят диагноз «аутизм». Даже при явных признаках — по поведению, коммуникации, переживаниям — в государственной системе этот диагноз просто растворяется. Да, частные специалисты могут подтвердить аутистический профиль (например, синдром Аспергера), но без официального заключения от госклиники человек не попадает ни в какую статистику и ни в какие программы поддержки. А попытка получить эту официальную бумагу часто превращается в настоящее соревнование с системой. В итоге взрослые с недиагностированным аутизмом годами живут в замкнутом круге. Они сталкиваются с постоянной тревогой, выгоранием и социальными трудностями, не понимая их истинной причины. Никто не объясняет, что ненавидеть прикосновения к тканям, вздрагивать от фонового шума или уходить в шестичасовой гиперфокус — это не «странности характера», а нейроотличия. Но если диагноз не поставлен в детстве, система говорит: «проблемы нет», а значит — и помощи тоже нет. После 18 лет человек в глазах нашей медицины становится либо «нормальным», либо «больным». Если ты приходишь за диагнозом во взрослом возрасте, очевидный спектр часто пытаются подогнать под шизотипическое расстройство или шизофрению. Всё, что находится между этими двумя крайностями, для системы просто не существует.

Очень сильно отвлекают от жизни все эти запреты — они сбивают с ритма. Но недавний анонс Suno 5.5 вдохнул немного энергии: теперь можно загрузить свой голос и создавать треки на его основе. Решил проверить: закинул старые песни, потратил время на изучение нюансов и написал новую песню. Пока решил выложить сюда — хотя, по слухам, Telegram уже признали мёртвым, так что шансов, что кто-то её услышит, не так много. Но думаю, потом выйдет на альбоме!

Repost from Ai molodca
Про нейрослоп. Последнее время часто замечаю такое: увидит человек любой контент с нейронкой (даже очень качественный) и сраз
Про нейрослоп. Последнее время часто замечаю такое: увидит человек любой контент с нейронкой (даже очень качественный) и сразу указывает на него пальцем с клеймом: "нейрослоп!". При этом поднимается в воздух, окружённый пением ангелов, на него падает божественный свет, и на нём вырастает белое пальто. Пробую разобраться почему так. Дальше много букв. К истокам! Слоп — английское слово аж XV века, означало помои (изначально жидкие). Нейрослоп — низкокачественный контент из нейросетей. Звучит просто, пока не доходишь до "низкокачественный". Как это замерить? Есть два стула. Техника — и тут всё относительно объективно. Артефакты, восемь пальцев, кривой липсинк, пластиковые рожи, странная пластика движений — это брак, это можно измерить. НО модели быстро улучшаются, и скоро технический критерий вообще перестанет работать. Ценность — вот тут интересное. Миллионы людей (факты) каждый день с удовольствием смотрят одинаковые нейромультики про говорящие овощи или толстых рыжих котов. Для меня, например, это очевидный слоп на уровне и техники, и ценности. А, например, для ребёнка это любимый контент, для его мамы — пять минут тишины (тоже ценность). Окей, нейрослоп — это не свойство контента, а отношение конкретного смотрящего. Но почему есть мощная предвзятость к приставке "нейро", которая останавливает человека от просмотра даже очень хорошего контента? Пост получается уже большой, поэтому коротко: 1. Мозг экономит энергию — ярлык проще анализа. 2. Особенность старой прошивки: результат оценивается через затраченные усилия, а "нейросеть" в массовом сознании автоматически значит "нажал кнопку — готово". Даже если автор убил 9999 часов на работу, но использовал нейросеть — неважно, усилия невидимы, приговор вынесен. 3. Быстрая негативная самоидентификация. Не уверен, за что я — но я против этого! 4. И последнее, на мой взгляд недооценённое, — алгоритм. Мой пример: видит, что мне интересны нейросети, и завозит в ленту сто нейророликов про то, как сыр изменил тёрке с половником. Многие злятся на весь жанр, хотя злиться надо на рекомендации. Что в итоге? Слоп был всегда — просто раньше его производили медленнее. Единственное, что можно сделать: отключить алгоритмическую ленту и смотреть то, что выбрали сами, а не то, что подсунул бешеный алгоритм. Я так сделал и стало спокойно и хорошо. А вы что думаете? 😊

Год назад, работая над клипом к песне «Инопланетянин», нам приходилось использовать огромное количество платных сервисов: каждое изображение требовало сотен доработок, а генерация видео оставляла желать лучшего. Бесконечный слив токенов, очереди, новые попытки — и так в течение месяца. Сейчас ситуация изменилась радикально: менее чем за сутки я создал ролик, задействовав всего три инструмента — NanoBanana 2 для генерации изображений, Suno для аудио-ремикса и локальную модель LTX 2.3, которая работает быстро и поражает качеством. Пятисекундный Full HD-кадр на потребительской видеокарте RTX 5060 Ti генерируется за пять минут. Разница в качестве между платными моделями прошлого года и сегодняшним опенсорсом просто ошеломляет. Поэтому неудивительно, что многие эксперты в видео-продакшене массово уходят от облачных API в сторону локальных решений.

Repost from Neural Shit
Есть такой онлайн переводчик — kagi. Разработчики прикрутили к нему LLM-ку под капот, но видимо забыли ограничить список вали
+5
Есть такой онлайн переводчик — kagi. Разработчики прикрутили к нему LLM-ку под капот, но видимо забыли ограничить список валидных языков в адресной строке. В итоге выяснилось, что если взять прямую ссылку на перевод https://translate.kagi.com/?from=en&to=ru и поменять параметры from и/или to на свои, то нейронка послушно схавает абсолютно любую дичь и переведёт её. То есть, вместо унылого перевода на французский или английский, можно попросить перевести текст на язык бабок из Одноклассников или язык матери трех ангелочков из инстаграма.

Ну вот, допустим, ты придумал прекрасный промпт — с акцентами, с отсылками к стилю, интересной композицией. И всё равно модель, вместо элегантного дельфина в солнечном блике, генерирует существо, которое судя по всему пережило экологическую катастрофу. И это не ошибка, нет. Это попытка ИИ разгадать твой замысел, когда ты сам уже не уверен, что именно имел в виду. Но даже этот монстр — достоин места в архиве. Потому что он говорит: «я попробовал», и в этом есть какая-то трогательная наивность. Там, где идеальный результат уже не удивляет — странные провалы напоминают, что нейросетям всё еще есть куда расти.

LTX 2.3 — первый тест, первый шок. Около недели назад обновилась модель для локальной видео-генерации LTX 2.3. Промпт был простой: «Saleswoman in a store, hurriedly prompting a man. Speaks Russian: “Мужчина! Очередь не задерживайте!”». Ничего особенного — просто проверка, как работает новая версия. Но результат шокировал. Женщина, которая глядит не сквозь тебя, а внутрь. Холодный взгляд и тихая, нечеловеческая уверенность: она уже всё решила. Раньше кто-нибудь сказал бы: «О, эффект зловещей долины!». Сегодня — нет. Эта женщина и есть зловещая долина. В чистом виде. Во плоти. И если это первая генерация… что будет дальше?

Как я загнал аниме про советского пуделя-убийцу в ИИ-симуляцию общества (и что из этого вышло) Не так давно в интернетах прог
+2
Как я загнал аниме про советского пуделя-убийцу в ИИ-симуляцию общества (и что из этого вышло) Не так давно в интернетах прогремела новость: один китайский разработчик создал проект MiroFish — крутую оболочку для нейросетей, которая симулирует реакцию общества на любой контент. Загружаешь идею, а ИИ создает виртуальную фокус-группу (агентов), которые живут своей жизнью, обсуждают, спорят и генерируют посты в соцсетях, имитируя 40–72 часа реальных дискуссий. Но я решил пойти дальше. Вместе с моим ИИ-агентом Виктором (через OpenClaw) мы взяли эту систему, перевели с китайского на русский язык, допилили напильником и полностью отвязали от платных API. Теперь вся эта симуляция общества крутится локально на своих мощностях. Чтобы провести краш-тест системы, я скормил ей синопсис несуществующего полнометражного хоррор-аниме «Белая Тень», который до этого сгенерировал с помощью локальной модели Gemma 3. Концепт такой:
Урал, 1985 год. Днем Лена — образцовая советская школьница с безупречными оценками и светлыми планами на институт. А по утрам после полнолуния она просыпается на промерзшем асфальте чужих подворотен, в панике оттирая с рук свежую кровь. Пока милиция тщетно пытается скрыть жуткую эпидемию звериного бешенства, охватившую спальные районы, девочка осознает пугающую правду: гигантский белый пудель, рвущий алкашей во тьме панелек — это она сама.
Симуляция запустилась, и за час реального времени нейросети сгенерировали огромный и пугающе правдоподобный аналитический отчет о том, как российский прокат и зрители встретили бы этот фильм:
Раскол общества: Нишевая аудитория (славянисты и любители фолк-хоррора) превознесла фильм за глубокую мифологическую драму, а массовый зритель разделился на два лагеря — одни защищали Лену, другие обвиняли в эгоизме. Боты и тролли: В комментариях началась классическая война с переходом на личности и дегуманизацией выбора героини. Прокатные риски: Виртуальные дистрибьюторы сразу напряглись из-за сцен, где пудель кусает маргиналов, предрекая фильму проблемы с цензурой в регионах.
Штука невероятно занятная. Полный PDF-отчет с цитатами виртуальных зрителей и маркетинговой аналитикой я выложу в комментариях под этим постом. Почитайте, это настоящий разрыв шаблона. А на днях на «Фабрике контента» выйдет более подробная статья, где мы покажем механику проекта изнутри и поделимся результатами других исследований. Не переключайтесь!

Мой кот Черкаш шлёт поздравления с 8 Марта всем причастным! 🎆
Мой кот Черкаш шлёт поздравления с 8 Марта всем причастным! 🎆

Разбирал на днях завалы в Gmail — пытался понять, куда улетело всё место, — и наткнулся на фото 19-летней давности. На снимке
Разбирал на днях завалы в Gmail — пытался понять, куда улетело всё место, — и наткнулся на фото 19-летней давности. На снимке я — 17-летний школьник, моя начальница Тина и Катя Чехова 1.0. Стоим в подземном бункере на Таганке. Тогда там проходила презентация книги «Метро 2033». С тех пор утекло много воды, да и до самого 2033 года осталось всего ничего. Этот флешбэк навёл меня на закономерную мысль: кажется, пришло время строить свой собственный бункер. Цифровой бункер. Локальные LLM и визуальные модели наконец-то вышли на тот уровень, когда с облачных подписочных сервисов можно смело уходить и выстраивать полноценный продакшн на собственном железе. Почему перекат на локалки стал необходимостью именно сейчас? Инфраструктурный абсурд Постоянные взаимные блокировки: с одной стороны ломают половину интернета, пытаясь забанить западные сервисы, с другой — сами западные площадки отрубают доступ. Добавьте к этому вечные квесты с зарубежными картами для оплаты подписок. Всё это дико неудобно и съедает кучу времени. Тотальный сбор данных Как бы ни были хороши нейронки от OpenAI, Anthropic, Google и прочих, они пылесосят личную информацию, которая потом может использоваться как угодно. Они и сами недавно признались, что следят за всем миром. К Алисе и Гигачату это относится ровно в той же мере — уж в их слежке сомневаться точно не приходится. Вывод один: время переходить на локальные модели уже наступило. Пора.

Музыкальная муравьиная ферма, или Как я за ночь собрал карманный шоу-бизнес Последнюю неделю (или это было месяц назад? За бе
Музыкальная муравьиная ферма, или Как я за ночь собрал карманный шоу-бизнес Последнюю неделю (или это было месяц назад? За бессонными ночами счет времени потерян) у меня в голове сложился идеальный пазл. Совпало всё: — Выход Ace Step — нейронки, которая генерит музыку локально. — Разговор с Сергеем Пименовым о том, что «вот бы оно само всё делало». — Пост канала Neural Shit с пародиями на журнал Speed Info из 90-х. — Мой зуд сделать симуляцию жизни... ну, хотя бы симуляцию муравейника. Я вооружился своим AI-агентом Виктором (OpenClaw), дал ему доступ к OpenCode и выгрузил длиннющую простыню слов из головы в код. Сидели над ним полночи, ловили баги, но всё-таки добрались до рабочей беты! Результат? Это полностью автономный виртуальный продюсер. Он работает локально на моем железе и штампует группы как на конвейере: • Сам придумывает название и жанр. • Пишет тексты (использую Gemma 3 12b, она единственная из маленьких и локальных нормально рифмует). • Генерит трек и обложку. • Пишет пресс-релизы и (мое любимое) желтые скандалы в стиле журнала «Cool» из нулевых. • Сам раскладывает всё по папкам и ставит в очередь на постинг. Запускаешь скрипт и смотришь, как бесконечный поток AI-групп пишет альбомы и пытается стать популярными. А ты просто сидишь и греешься у кулера видеокарты. Проект живой, модульный, будем допиливать, но процесс уже завораживает. 😁

+1
Час ожидания ради одной минуты магии. Вчера настраивал генерацию длинных видео-аватаров. Мой ПК (на базе 5060 Ti) сейчас делает такое со скоростью: 1 минута генерации = 1 час реального времени. Кто-то скажет: «В 2026 году это вечность!». А я вспоминаю свои компьютеры образца до 2013 года. Тогда рендер минутного ролика в Full HD мог занять 2–3 часа. И ничего, как-то жил — всегда находил, чем заняться в это время 😁 Кстати, рутину по настройке воркфлоу для генерации видео-аватара я скинул на своего OpenClaw-бота Виктора. Изначально схема выдавала 12 секунд видео, разбивая их на 4 блока по 3 секунды (чтобы VRAM не лопнула и контекст передавался плавно). Мне нужно было сделать версии на 30 и 60 секунд. Вручную дублировать ноды и перетыкать связи («лапшу») — это адский труд и гарантированные ошибки. За одну минуту Виктор пересобрал два идеальных воркфлоу — на полминуты и на минуту. И да, герой видео — Михаил Стендапыч. Совсем скоро у него первый юбилей! Его образ родился в прошлом году, 21 февраля 2025-го. И если год назад для его реализации нужна была подписка на HeyGen, то теперь нужно только свободное время и желание 😁 Как вам кажется, час рендера за минуту уникального контента — это много или норм?

Repost from Neural Shit
ААААА!!! П Р О М П Т У К Р А Л И ! ! ! ! !
+1
ААААА!!! П Р О М П Т У К Р А Л И ! ! ! ! !

Принцесса_Предсмертный_бред_моей_души.mp34.60 MB

Будущее резко ускорилось (или я просто сплю) Наверное, я всё-таки просто умер, лопнув от переедания за новогодним столом, а в
Будущее резко ускорилось (или я просто сплю) Наверное, я всё-таки просто умер, лопнув от переедания за новогодним столом, а всё происходящее сейчас — это мои предсмертные галлюцинации и исполнение желаний. Иначе я не могу объяснить, почему технологии в этом году рванули с такой скоростью. Вышла новая опенсорс модель Ace step 1.5. Что она умеет? * Генерит песни на русском языке. * Качество — моё почтение. На уровне Suno 4, а местами и выше. * Поддерживает обучение LoRA! То есть можно скормить ей свои треки и получить нужный стиль. И самое главное — это опенсорс. Никаких подписок. Запускаешь у себя локально, и трек генерируется секунд 10 на средней видеокарте. Жду, когда умельцы запилят плагин для подключения ко всяким лоджикам, чтобы генерировать прямо внутри DAW. Это будет просто космос.

Нейросети в быту: перевод субтитров через ClawdBot Moltbot OpenClaw Решил снова поднять тему AI-агентов. Вчера с женой собрал
+3
Нейросети в быту: перевод субтитров через ClawdBot Moltbot OpenClaw Решил снова поднять тему AI-агентов. Вчера с женой собрались посмотреть мюзикл 1986 года «Магазинчик ужасов». За музыку там отвечали те же люди, которые потом писали музыку/песни для классики Диснея — «Русалочки», «Аладдина», «Красавицы и Чудовища». Столкнулись с проблемой: нормальной озвучки нет. Есть одноголосые (тот же Михалёв — забавно, но не мюзикл же) и плохой многоголосый. Русских субтитров в сети вообще не нашел. Нашел только MKV-файл с вшитыми английскими. И тут пришла идея, почему бы не озадачить моего агента Виктора. План был такой: он достает английские субтитры, переводит на литературный русский с сохранением таймингов и вшивает обратно в видео. В качестве «мозгов» я использую модель от Minimax. Работает неплохо, и подписка стоит всего 20$ в месяц — это куда гуманнее, чем жечь токены на моделях Anthropic, где у некоторых и по 100 баксов в день улетало. Что в итоге: Вытащил субтитры из фильма, и с переводом он справился быстро. А вот на этапе сборки видеофайла его заклинило. Он очень старался: начал спамить отчетами по 10 раз в минуту, находил какие-то битые блоки, чистил их, пересобирал MKV... (см. скрины, там видно этот поток сознания). В какой-то момент мне надоело ждать, пока он победит видеофайл. Я просто остановил процесс, забрал у него готовый файл субтитров (.srt) и запустил фильм через обычный VLC плеер. Что ни говори, а всё-таки прогресс 😁

Скайнет близко, и я его первая цель. На днях выделил своему AI-агенту (clawdbot) отдельный комп и научил его генерить картинк
Скайнет близко, и я его первая цель. На днях выделил своему AI-агенту (clawdbot) отдельный комп и научил его генерить картинки через локальный сервер (вообще, он сам разобрался что к чему, я ему только сказал ip адрес). Сначала он был паинькой, но сегодня решил устроить итальянскую забастовку: файл создал, а работу не начал. Я, как строгий менеджер, пишу ему: «Всё ли в порядке? Чего сидим?». Он тут же зашуршал кулерами и начал работать. ​Я делаю скрин, чтобы скинуть другу и пошутить: мол, «Чувствую себя начальником, который пришел пиздить сотрудника». Но в порыве энтузиазма отправляю это сообщение не другу, а самому боту. Пытаюсь оправдаться, пишу «Не тебе». Ответ бота убил: «terminated». ​Теперь сижу и думаю: кажется мне пиздец. Терминатор уже в пути.

Создатель Earthworm Jim назвал противников ИИ «бездарными сектантами» Дауг Теннейпел, создатель «Червяка Джима», ворвался в X и жестко раскритиковал "художников", которые требуют запретить ИИ в творчестве. Теннейпел считает, что многие современные художники просто боятся прогресса, прикрываясь этикой. «Я рисовал больше, чем все, кто кричит "Возьми в руки карандаш". Они — бездарные сектанты. То, что многие художники истерят, не значит, что любая истеричка — это творец». Чтобы не быть голословным, он взял арт одного из подписчиков и с помощью ИИ за 15 секунд сделал из него анимацию. По его словам, создание такого же качества классическим способом стоило бы около $500 000.