Галера Морева
الذهاب إلى القناة على Telegram
Канал Антона Морева о разработке, IT бизнесе https://t.me/gmoreva?direct - вопросы @WormsoftBot - заказать разработку чего-либо @galera_talks - чат amorev.ru/contact ai.wormsoft.ru мой ИИ-провайдер
إظهار المزيد4 702
المشتركون
+1324 ساعات
+897 أيام
+28230 أيام
أرشيف المشاركات
4 702
Ornith 1.5 35b-a3b | Достойная повседневная модель
Наконец-то добрался до Ornith 1.5 35B-A3B. После ролика про 9-милиардную версию было логично снять видео про старшую модель, а я всё откладывал. И зря. Не смог заставить её не сделать задачу, которую её передавал. Пока, из всех локальных моделей, запущенных у меня, это лучшая модель по сочетанию интеллект+скорость.
Видео по ссылкам ниже:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
Уехал в Китай
Это уже третья поездка за последний год. Но в этот раз отправился вместе с женой и детьми — в основном на пляжный отдых.
И продолжаю вести тот же отдельный канал про свои экспресс-поездки в Китай. Буду делиться впечатлениями, маршрутами и всем, что происходит по дороге.
Буду рад увидеть вас там :)
https://t.me/china_express_travel
4 702
Bonsai 2 27B: локальная модель, которая удивила меня 5 задачами подряд
Bonsai 2 27B: по сути переквантованный плотный Qwen 27B с тернарными весами, сжатый до ~7 ГБ. Саму модель реально уместить даже в 8 ГБ, я тестировал в честном сценарии — 16 ГБ видеопамяти (отсечка на 3090 и связка из двух P104-100 — дров по 2000 рублей). Заявляют 98% качества оригинала — в контексте моих задач это близко к правде.
Год назад с 16 ГБ видеопамяти можно было только плакать, а сейчас можно даже какие-то полезные дела делать с моделями, которые влезают в 16гб.
Видео по ссылкам ниже:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
Текстовая версия обзора JEV-модели
Временно выпал из создания видео-контента (заболел и снимать ролики пока невозможно).
Нашел плюсы и в этой ситуации — вернулся к оптимизации процесса создания текстового контента и делюсь первым результатом.
Подготовил текстовую версию ролика про Jev — https://habr.com/ru/articles/1087480/.
4 702
📹 Qwen 3.8 27B GSC-RCO. Качество FP8 на одной 3090?
Мне посоветовали попробовать квант Qwen 3.8 27B — GSC-RCO, у которого другая механика квантования и по бенчмаркам качество не отстаёт от FP8. И так совпало, что одну из моих 3090 как раз переводили на воду — а работать с локальной моделью надо.
Запустил квант на одной 3090: уместилось 220 000 контекста в 23.1 ГБ с vision. Прогнал модель через реальные задачи
Видео по ссылкам ниже:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
📹 Jev не умеет писать. Зато решает быстрее и в разы дешевле LLM
Мы привыкли, что ИИ — это «текст на вход, текст на выход». Jev от TypeSafe AI работает иначе: на входе — состояние (текст или JSON) и типизированные вопросы, на выходе — готовые решения с откалиброванными вероятностями.
Это новый класс моделей, который TypeSafe называет System One — по канемановской «быстрой» Системе 1: пока LLM-ки с их цепочками рассуждений живут в территории медленной Системы 2 .
Видео по ссылкам ниже:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
Вайбкодинг — это новый Excel
Посмотрите это видео — реклама Excel, которая в своё время произвела фурор.
Прикол в том, что раньше сводную таблицу с пересчётом значений на коленке не собрать. Вариантов было два: либо активно кликать по калькулятору и записывать результаты на листочке, либо писать консольное приложение. А для этого нужно было знать COBOL, Fortran, dBase или тот же C.
И тут появляется Excel — и человек без опыта и знания языков программирования просто открывает таблицу и сам решает свою задачу. Формулы, пересчёты, сводные — всё из коробки.
Excel при этом не убил программистов. Он просто навсегда изменил то, за что готовы платить: огромный пласт задач перестал требовать разработчика вообще.
С вайб-кодингом сейчас происходит то же самое. Менеджер, дизайнер, аналитик — любой открывает агента и делает себе нужную автоматизацию. Не идеально, не production-ready, но для своей задачи — достаточно.
Мысли написать этот пост появились после того, как я увидел, что мой брат, который совсем не программист, навайбкодил внутреннюю систему учёта финансов для нашей компании. Которая раньше состояла из огромного монструозного Excel-файла :)
История повторяется. Только на этот раз таблицы заменили кодом.
4 702
Вайбкодинг — это новый Excel
Посмотрите это видео — реклама Excel, которая в своё время произвела фурор.
Прикол в том, что раньше сводную таблицу с пересчётом значений на коленке не собрать. Вариантов было два: либо активно кликать по калькулятору и записывать результаты на листочке, либо писать консольное приложение. А для этого нужно было знать COBOL, Fortran, dBase или тот же C.
И тут появляется Excel — и человек без опыта и знания языков программирования просто открывает таблицу и сам решает свою задачу. Формулы, пересчёты, сводные — всё из коробки.
Excel при этом не убил программистов. Он просто навсегда изменил то, за что готовы платить: огромный пласт задач перестал требовать разработчика вообще.
С вайб-кодингом сейчас происходит то же самое. Менеджер, дизайнер, аналитик — любой открывает агента и делает себе нужную автоматизацию. Не идеально, не production-ready, но для своей задачи — достаточно.
Мысли написать этот пост появились после того, как я увидел, что мой брат, который совсем не программист, навайбкодил внутреннюю систему учёта финансов для нашей компании. Которая раньше состояла из огромного монструозного Excel-файла :)
История повторяется. Только на этот раз таблицы заменили кодом.
4 702
Qwen 3.8 Flash Next c Reasoning. Я был не прав
В прошлых двух роликах про Qwen 3.8 Flash Next я тестировал модель без ризонинга и сделал слишком резкие выводы. Подписчики в комментариях подсказали — ризонинг на этой модели надо включать именно на medium. Я так и сделал, плюс дал ей контекст 260К на железе подписчика — и это оказалась прямо другая модель.
Ссылки на ролик на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
DeepSeek V4.1 Flash: хайп vs реальность. Тестирую модель, которую называют «убийцей топов»
Первый раз DeepSeek на моём канале! Я долго его саботировал, но V4.1 Flash не удержался: по бенчмаркам и мнениям он будто бы на уровне моделей, которые в 10 раз дороже, при этом маленький, с миллионом контекста и — главное — наконец с Vision. Кандидат на замену Minimax M3 в моём сетапе. Проверяем на реальных задачах из моего провайдера, без синтетики.
Мой вердикт (субъективный, не кидайте тапками): по факту это модель уровня GLM 5.3 Flash — а это хорошая модель! Проблема в другом: 5.3 Flash знает своё место и не называет себя заменой топов, а DeepSeek заявляет ровно это.
Хайп сильно опережает реальные возможности. Где нужен vision — останусь на своём стеке, где не нужен — на GLM 5.3. DeepSeek V4.1 Flash пока обхожу стороной (как и все года обходил дипсик).
Ссылки на ролик на всех площадках:
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
Что я имел в виду
В прошлом посте я написал, что заказной разработке наступает конец. Хочу уточнить, что имел в виду — речь не о том, что разработка вообще не нужна и все клиенты теперь будут вайб-кодить сами.
Я про другое: очень большой пласт вещей, которые раньше делали разработчики даже по мелочи, теперь человек может реализовать сам для себя.
У нас внутри компании все внутренние продукты уже пилятся самими пользователями. До разработчика доходит только финальная проверка.
И если этот пласт мелких автоматизаций выпадает из ротации, рынок становится менее ёмким. Остаются крупные разработки, где работают крупные игроки (вроде нашей компании). В больших проектах сама разработка занимает процентов 30–40 времени. Остальное — дознавание, выяснение, как что должно работать и как чего должно запускаться. Тут ИИ заказную разработку не убивает.
А вот мелкие продукты, которые раньше делали фрилансеры и небольшие местечковые команды, — вот этот сегмент сильно пошатнулся. Спрос на такие команды и индивидуальных разработчиков заметно сократится и, в том числе, из-за роликов вроде моего гайда по вайбкодингу.
4 702
Люди без кода делают продукты
У нас в компании начинают кодить всё больше людей, которые раньше код в глаза не видели и имели только базовое представление о работе наших продуктов.
Менеджеры, дизайнеры начинают напрямую заниматься разработкой продуктов. Через прослойку в виде вайб-кодинга.Это меняет привычные процессы. Меняет и невероятно ускоряет!
Раньше был длинный цикл: дизайнер рисует в Figma, верстальщик переносит, бэкендер подключает. На каждом этапе нужны разговоры и корректировки.
Теперь дизайнер иногда может сам скорректировать существующий функционал — агент правит код, создаёт MR, а разработчик просто проверяет, что всё в порядке.
Я поэтапно внедряю наши же разработанные инструменты для вайбкодинга всем сотрудникам. Некоторые фичи стали долетать до прода за 1 час вместо 2-4 дней.
Оптимизация процессов выходит на совершенно другой уровень. Можно смело констатировать: заказной разработке, такой, какой она была последние годы, наступает конец.
4 702
Мысли про "ограничение развития ИИ"
Сейчас много разговоров про "ограничение ИИ". И, если честно, сама эта идея звучит странно. Остановить этот прогресс практически невозможно.
Технологии развивают разные компании в разных странах одновременно. Чтобы реально затормозить, нужен по сути картельный сговор: все договариваются, что дальше не развивают. И при этом надо быть уверенным, что никто тайком не продолжит.
Учитывая текущую ситуацию в мире и дефицит доверия между компаниями странами, рассчитывать на такое было бы наивно.
Поэтому все будут развивать ИИ настолько быстро, насколько это возможно. Просто чтобы опередить другие компании и другие страны. Гонка продолжается, и финишировать в ней никто не хочет.
4 702
+8
Отзывы с YouTube
Решил, в связи с юбилейными 10 тысячами подписчиков на канале, поделиться с вами подборкой приятных отзывов на мой контент:)
4 702
10 000 на YouTube
Спасибо всем, кто подписался. Спасибо всем, кто смотрит и читает меня:)
4 702
4 часа про вайб-кодинг
Снял 4.5 часовой ролик про то, как можно и (по-моему) нужно вайбкодить Получился самый длинный бесплатный курс по вайб-кодингу с нуля!
Пройдём путь от «вообще ничего нет» — до работающего веб-приложения с бэкендом, базой данных, регистрацией пользователей, опубликованного на собственном сервере с бесплатным доменом и HTTPS.
Всё это — вместе с ИИ-агентом, практически без написания кода руками.
📹 YouTube | VK | Rutube | Dzen 📹
🎓 Мое платное сообщество 🎓
4 702
Qwen 3.8 Flash Next без reasoning? 4 часа разочарования
Модель быстрая — факт. Но она делает столько ерунды, а я столько времени трачу на её проверку, что внутренний тест на «ассистента» она не прошла. Пропасти в интеллекте между ней и плотной Qwen 3.8 я не увидел, а вот пропасть в требуемых ресурсах — огромная.
А вчера мне в комментах дали понять, что я снова тестировал модель без рассуждений. Новая волна тестов на подходе
📹 YouTube | VK | Rutube | Dzen 📹
