Галера Морева
Відкрити в Telegram
Канал Антона Морева о разработке, IT бизнесе https://t.me/gmoreva?direct - вопросы @WormsoftBot - заказать разработку чего-либо @galera_talks - чат amorev.ru/contact ai.wormsoft.ru мой ИИ-провайдер
Показати більше4 494
Підписники
+624 години
+587 днів
+24330 днів
Архів дописів
4 495
DeepSeek V4.1 Flash: хайп vs реальность. Тестирую модель, которую называют «убийцей топов»
Первый раз DeepSeek на моём канале! Я долго его саботировал, но V4.1 Flash не удержался: по бенчмаркам и мнениям он будто бы на уровне моделей, которые в 10 раз дороже, при этом маленький, с миллионом контекста и — главное — наконец с Vision. Кандидат на замену Minimax M3 в моём сетапе. Проверяем на реальных задачах из моего провайдера, без синтетики.
Мой вердикт (субъективный, не кидайте тапками): по факту это модель уровня GLM 5.3 Flash — а это хорошая модель! Проблема в другом: 5.3 Flash знает своё место и не называет себя заменой топов, а DeepSeek заявляет ровно это.
Хайп сильно опережает реальные возможности. Где нужен vision — останусь на своём стеке, где не нужен — на GLM 5.3. DeepSeek V4.1 Flash пока обхожу стороной (как и все года обходил дипсик).
Ссылки на ролик на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 495
Что я имел в виду
В прошлом посте я написал, что заказной разработке наступает конец. Хочу уточнить, что имел в виду — речь не о том, что разработка вообще не нужна и все клиенты теперь будут вайб-кодить сами.
Я про другое: очень большой пласт вещей, которые раньше делали разработчики даже по мелочи, теперь человек может реализовать сам для себя.
У нас внутри компании все внутренние продукты уже пилятся самими пользователями. До разработчика доходит только финальная проверка.
И если этот пласт мелких автоматизаций выпадает из ротации, рынок становится менее ёмким. Остаются крупные разработки, где работают крупные игроки (вроде нашей компании). В больших проектах сама разработка занимает процентов 30–40 времени. Остальное — дознавание, выяснение, как что должно работать и как чего должно запускаться. Тут ИИ заказную разработку не убивает.
А вот мелкие продукты, которые раньше делали фрилансеры и небольшие местечковые команды, — вот этот сегмент сильно пошатнулся. Спрос на такие команды и индивидуальных разработчиков заметно сократится и, в том числе, из-за роликов вроде моего гайда по вайбкодингу.
4 495
Люди без кода делают продукты
У нас в компании начинают кодить всё больше людей, которые раньше код в глаза не видели и имели только базовое представление о работе наших продуктов.
Менеджеры, дизайнеры начинают напрямую заниматься разработкой продуктов. Через прослойку в виде вайб-кодинга.Это меняет привычные процессы. Меняет и невероятно ускоряет!
Раньше был длинный цикл: дизайнер рисует в Figma, верстальщик переносит, бэкендер подключает. На каждом этапе нужны разговоры и корректировки.
Теперь дизайнер иногда может сам скорректировать существующий функционал — агент правит код, создаёт MR, а разработчик просто проверяет, что всё в порядке.
Я поэтапно внедряю наши же разработанные инструменты для вайбкодинга всем сотрудникам. Некоторые фичи стали долетать до прода за 1 час вместо 2-4 дней.
Оптимизация процессов выходит на совершенно другой уровень. Можно смело констатировать: заказной разработке, такой, какой она была последние годы, наступает конец.
4 495
Мысли про "ограничение развития ИИ"
Сейчас много разговоров про "ограничение ИИ". И, если честно, сама эта идея звучит странно. Остановить этот прогресс практически невозможно.
Технологии развивают разные компании в разных странах одновременно. Чтобы реально затормозить, нужен по сути картельный сговор: все договариваются, что дальше не развивают. И при этом надо быть уверенным, что никто тайком не продолжит.
Учитывая текущую ситуацию в мире и дефицит доверия между компаниями странами, рассчитывать на такое было бы наивно.
Поэтому все будут развивать ИИ настолько быстро, насколько это возможно. Просто чтобы опередить другие компании и другие страны. Гонка продолжается, и финишировать в ней никто не хочет.
4 495
+8
Отзывы с YouTube
Решил, в связи с юбилейными 10 тысячами подписчиков на канале, поделиться с вами подборкой приятных отзывов на мой контент:)
4 495
10 000 на YouTube
Спасибо всем, кто подписался. Спасибо всем, кто смотрит и читает меня:)
4 495
4 часа про вайб-кодинг
Снял 4.5 часовой ролик про то, как можно и (по-моему) нужно вайбкодить Получился самый длинный бесплатный курс по вайб-кодингу с нуля!
Пройдём путь от «вообще ничего нет» — до работающего веб-приложения с бэкендом, базой данных, регистрацией пользователей, опубликованного на собственном сервере с бесплатным доменом и HTTPS.
Всё это — вместе с ИИ-агентом, практически без написания кода руками.
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 495
Qwen 3.8 Flash Next без reasoning? 4 часа разочарования
Модель быстрая — факт. Но она делает столько ерунды, а я столько времени трачу на её проверку, что внутренний тест на «ассистента» она не прошла. Пропасти в интеллекте между ней и плотной Qwen 3.8 я не увидел, а вот пропасть в требуемых ресурсах — огромная.
А вчера мне в комментах дали понять, что я снова тестировал модель без рассуждений. Новая волна тестов на подходе
📹 YouTube | VK | Rutube | Dzen 📹
4 495
Qwen 3.8 Flash Next . Пишем с ним систему умной техподдержки
Сегодня тестирую Qwen 3.8 Flash Next — интересную MoE-модель на 125 млрд параметров с хитрым механизмом n-gram embedding-таблиц, которые можно выгружать на диск или в оперативку (на каждый токен всего ~3 КБ чтения — справится даже HDD).
Ссылки на видео на всех платформах:
📹 YouTube | VK | Rutube | Dzen 📹
4 495
Мне 32
Уже 32-й раз встречаю свой день рождения. Поражает то, как с каждым годом скорость времени больше и больше. Раньше между днями рождения была вечность, а сейчас мозг этого времени даже не замечает.
За последние полгода мой блог в телеге и в ютубе заметно вырос (телега на 25%, ютуб в 3 раза). Этому подарку я очень рад и ко дню своего рождения запустил свое платное сообщество с контентом на тему ИИ и смежных IT областей.
Я вспоминаю, как я воспринимал 30+ летних "взрослых мужиков" в своем детстве и это совсем не вяжется с восприятием меня, 32-летнего пацана, который повез сегодня своих детей и жену смотреть человека паука в соседний город:)
Но я чувствую как скучнее и спокойнее, с каждым годом, становится жизнь и её восприятие. Но эти скукота и спокойствие, с каждым годом, мне нравится все больше.
На фото и я мой старший брат готовые делать для наших клиентов разного сложности IT-проекты. Продолжаю традицию в свой др делиться с вами своей детской фоткой, как в 2025, 2024, 2023.
4 495
Qwen 3.8 Q8.0 против FP8
Продолжаю цепочку роликов про Qwen 3.8. Сегодня — битва двух титанов: квант Q8_0 от Unsloth (llama.cpp, 2×2080, NVLink) против официального FP8 от Qwen (vLLM, 2×3090).
Условия максимально честные: у обеих 8-битный KV-кэш (вы меня убедили отказаться от 4-битного), 200 000 контекста и самый крутой режим reasoning — X-High с неограниченным бюджетом на размышления. Никаких синтетических бенчмарков — только реальные задачи из моей работы, с одного и того же промпта, параллельно.
📹 YouTube | VK | Rutube | Dzen 📹
4 495
📹 GLM 5.3 Flash на личных автоматизациях
Два дня работы на GLM 5.3 Flash — и я готов вынести вердикт. Сначала я на неё забил, потом понял, что она обходится мне как компании в полтора-два раза дешевле 5.3, работает быстрее — и решил начать на ней экономить. В этом ролике тестирую её не на игрушечных задачках, а на реальной автоматизации своего YouTube-продакшна: приложение, которое само нарезает исходники из OBS, генерит прокси для DaVinci Resolve, вытаскивает таймкоды и подключает всё это к проекту. Цель — записать видео, нажать одну кнопку, уйти домой, а утром получить готовый проект для монтажа.
Что в ролике:
🔹 Моя кухня продакшна: OBS, 8 мониторов, мультикам в DaVinci, прокси-файлы (100 ГБ → 4 ГБ)
🔹 Как GLM 5.3 Flash писал FFmpeg-скрипты нарезки — кадр в кадр, без рассинхрона звука
🔹 Работа через скиллы: task-creator готовит ТЗ, task-solver реализует по одной задаче
🔹 Electron-приложение: экстрактор таймкодов, прогресс-бар конвертации, подключение к DaVinci
🔹 Честные фейлы: зависания, 5 заброшенных копий приложения и 12 минут мучений с багом
Видео по ссылкам тут:
📹 YouTube | VK | Rutube | Dzen 📹
4 495
GLM 5.3 Flash, Kimi K3, GLM 5.2, Qwen 3.8 - кто лучший советник?
Новый формат теста моделей: беру четыре нейросети — GLM-5.2, свежую GLM-5.3 Flash (вышла 26 августа), Kimi K3 и Qwen 3.8 27B — и отправляю их на одну большую аналитическую задачу: модель выступает в роли советника и разбирает мой YouTube-канал.
Ссылки на видео на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
4 495
Люди в контуре
При работе с ИИ важно оставаться в процессе там, где без человека не обойтись. На мой взгляд, при работе с агентами таких точек две.
Первая — постановка задачи. Агенту нужно понять, что именно от него хотят, и вот тут человек критически необходим. Если разработчик пропускает этот этап, то с вероятностью процентов в семьдесят в конце получится трэш, который придется переделывать.
Вторая — приемка результата. Если не верифицировать то, что выдала нейросеть, ошибки копятся как лавина: она сходит с горы и с каждым метром становится только больше, жестче и проблемнее.
Так что осознанное участие в процессах, которые, казалось бы, могут пройти и без тебя, — это то, что отличает хорошего разработчика с ИИ в руках от обезьяны с гранатой в тех же руках.
Не смотрите на футболку на фотке. У нас таких нет и я этот пост придумал просто так, а не после того, как увидел разраба с ордой агентов, ломающих проект.
4 495
Видео про Ornith 1.5 9B
Меня давно просили протестировать Ornith. Вот вышла версия 1.5 от DeepReinforce, которую называют «самообучаемой»: при RL-обучении модель сама генерирует себе задачи, скаффолды и роллауты, без фиксированных человеческих датасетов. Разбираюсь, что это значит на практике, и гоняю плотную 9B-версию в реальных задачах.
Спойлер: я не ожидал такого от 9 миллиардов параметров.
Ссылки на видео на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
4 495
Qwen 3.8 на RTX 2080. Рабочий день с реальными задачами
Целый рабочий день гонял Qwen 3.8 27B в реальных агентских и разработческих сценариях — без постановочных задачек, только боевые проекты.
План был такой: начинаем с Q4_K_M на одной 2080 (22 ГБ VRAM), если не справится — поднимаем ставки до Q8.0 на двух 2080, а потом и до FP8 на двух 3090.
Но всё пошло не по плану и все задачи решил первый кандидат: RTX 2080 с Q4_K_M на борту.
Выложил на все площадки ролик с тестами и моим мнением на тему этой крутой модели.
Ссылки на видео на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
4 495
Qwen 3.8 на RTX 2080. Рабочий день с реальными задачами
Целый рабочий день гонял Qwen 3.8 27B в реальных агентских и разработческих сценариях — без постановочных задачек, только боевые проекты.
План был такой: начинаем с Q4_K_M на одной 2080 (22 ГБ VRAM), если не справится — поднимаем ставки до Q8.0 на двух 2080, а потом и до FP8 на двух 3090.
Но всё пошло не по плану и все задачи решил первый кандидат: RTX 2080 с Q4_K_M на борту.
Выложил на все площадки ролик с тестами и моим мнением на тему этой крутой модели.
Ссылки на видео на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
4 495
Снижение мощности видеокарты с целью ее сохранения
Видеокарты с нейронками работают очень активно и очень горячо. Иногда у меня 3090 разогревается до 85+ градусов, что уже губительно для нее.
Разобрался как можно снизить максимальную мощность видеокарты, чтобы нагрева было меньше => температура теперь не поднимается выше 72 градусов и скорость работы почти не упала.
Снял ролик про этот способ решения проблемы перегрева.
Ссылки на видео на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
