Мы пилим сук, на котором сидим
Open in Telegram
Инженеры учат нейронки работать за себя. Кейсы из жизни. https://ai.ovc.me/ https://youtube.com/@wearefired_ai Для связи @ovcme
Show moreThe country is not specifiedThe category is not specified
393
Subscribers
No data24 hours
+47 days
+5330 days
Posts Archive
https://telegra.ph/Kak-kupit-VPS-ILI-10-dollarov-ehto-10-dollarov-04-11
А я тут задумался - а как сейчас дела с хостингами для простых сайтов - и спросил друга. И получилась внезапно авторская колонка про несправедливость мира для маленьких людей.
Я смотрю всем очень понравился нейросайтик.
Так что я его обновил, а заодно добавил туда блок про RAG и, самое важное, кого ИИ заменят. Да, я наконец-то решил хайпануть по теме! Да и с коллегами сегодня на этот счет спорили. Так что мы все подумали, спросили виновников торжества - сами ИИ и получился прикольный документ. Я сильно править ИИ текст не стал, решил что так интереснее. Совместное творчество Клода, Гемини и Квена.
Так же добавил блок про законы, о чем завтра буду говорить на BIM завтраке - https://t.me/legkobim/953
https://chernetchenko-dev.github.io/nicecharts/#replace
https://chernetchenko-dev.github.io/nicecharts/
что бы вы не скучали я веселым Клодом сделал интерактивный гид по принципу работы ИИ моделей и по их типам.
Наслаждайтесь, может еще туда что то добавлю.
Попробовал новую локальную модель Gemma4 в Олламе и это прямо хорошо. Шустрая, умная, хороший язык. Пока самая комфортная модель для локалки. На моем Легионе даже вентиляторы не включились. Пока выглядит прекрасно, будем тестировать.
Техника безопасности при использовании ИИ!
Пока я урывками добиваю РАГ и визуалки напишу коротко о наболевшем.
ИИ это очень круто, но, напоминаю, он не мыслит, он не думает, в нашем понимании этого, даже если кажется иначе.
Отсюда правила безопасности:
1. Не доверяйте ИИ. Вообще никогда. Проверяйте формулы, проверяйте команды для консоли что он вам дает. Даже если кажется что ошибиться нельзя - он справится.
2. Не надо грузить в ИИ вообще все задачи. Во первых, помните про реки, которые вы осушаете. Во вторых - не лишайте себя удовольствия думать самостоятельно. Лично я недавно чуть не пошел в клод просить переделать простую табличку, где работы руками по времени на перекур.
3. Для сложных задач, да и лучше для всех - напиши кратко что вы хотите, как хотите, что на выходе и как проверить. Это в принципе хорошая практика при любой работе, а в случае с ИИ особенно. Воспринимайте его как совсем зеленого стажера-отличника.
4. Не считайте что базовое освоение ИИ делает вас всемогущим и всеведующим. Это просто интересный инструмент.
5. Проверяйте один ИИ другим, по тем вопросам где вам не хватает уверенности. К тому же это очень интересно.
6. Не гонитесь за всеми ИИ приколами, используйте только то, что нужно. Рынок ИИ каждый день меняется, нет смысла за ним гнаться. Нашли что вас устраивает - пользуйтесь. Не надо метаться.
7. Немного противоречит прошлому, но. Не работайте с ИИ только как с чат ботом для приколов и мемов. Он может много больше, и это несложно.
8. Не надо ходить на курсы где вас обучат ИИ секретам. Просто не надо. ИИ вас сам себе обучит.
9.Если что-то в ответе смущает - попросите ИИ подумать ещё раз.
Не принимайте первый ответ как окончательный. Уточните, переформулируйте вопрос, попросите проверить себя или подойти с другой стороны. ИИ часто даёт существенно лучший результат со второй-третьей итерации - и это нормально, так и должно работать.
10. Если вы везде видите ИИ, даже в том тексте что писали сами - вам бы на отдых пора.
11. Помните, чей это результат. Если вы подписываете документ, сдаёте проект или принимаете решение - ответственность ваша, не ИИ. Он не несёт последствий. Вы - да. Это не призыв бояться, это призыв оставаться автором своей работы, а не её редактором.
https://apps.apple.com/ru/app/google-ai-edge-gallery/id6749645337
Гугл выпустил прилож для своих локальных моделей и не только. Бесплатно, очень неглупые
Мы, для экономии токенов:
Переводим данные в раг
Чистим диалоги
Делаем сложные промты
Придумываем суеверные привычки
Кто-то:
Просто заставил Клода говорить как пещерный человек из комиксов
Немножко поделюсь планами. Я больше всего заинтересован в теме хранения и обработки инфы с рагом. В планах примерно такая штука. Я подобрал технологии, буду тестировать на локальной машине и смотреть что получается. Конечно же выйдет не то и не так, но ведь интересно!
А вот и нейропреза. Наверняка там есть какой то технотреп бредовый, но картинка в целом вышла верная.
А еще я не настоящий сварщик программист
И да, мне не надоест делать презы в NBLM!
Вкратце - NET 8, Windsurf как IDE, Gemini для помощи, Клод для серьезной помощи. Написал кратко свое видение, прогнал через гемини и клода и поехали.
Лайфхак - очень полезно бывает сказать ИИ - "Подумай еще раз"
Иногда я скучаю по продуктовой работе, и, поэтому, на пару с Клодом породил полноценный и очень нелепый PRD (Product Requirements Document) - что-то вроде детального ТЗ на продукт. Всерьез воспринимать не надо, но вышло очень продуктово.
Итак. Есть такая штука - Veras. Я еще давно думал как бы такое свое завести. А еще я из каждого утюга слышу как все дружно заняты вайбкодингом и как им хорошо.
Решил совместить две идеи.
Результат на экране. Плагин для Ревит 2025, забиты шаблоны на 12 API провайдеров, включая локальный CompyUI.
Есть функция референса, настройки силы промта, галерея, экспорт и импорт.
Пока то что вышло на скрине получить довольно сложно, но иногда получается, будем мучать дальше.
В планах - протестировать всех провайдеров, понять как правильно строить промты и завести на локалку. Обязательно выложу исходники, как будет не так стыдно.
Потом закину нейропрезу с котиками.
А вы думали все было просто так? А вот и нет. Просто я как обычно решил что я самый умный и полчаса все сделаю. План был идеален, а вышло как вышло.
Завтра будет полная история полууспеха, а пока вводная.
Есть такой крутейший сервис Veras - делает норм ИИ рендеры прямо из ревита. Всем хороший, но дорогой и не гибкий. А ведь формально это просто форма, которая по API кидает в Stabble жипег + промт.
А давай я с помощью Виндсерфа такое заделаю за час под кофеек.
Увы, ИИ очень умный когда его оператор понимает что хочет и понимает что делает и понимает что происходит. Так что первый день я был как на правой части картинки, а на второй резко поумнел, прочитал кратко как вообще плагины для Ревита работают и делаю и вспомнил, что я когда то подрабатывал продакт-менеджером.
Завтра будет:
лог всей истории
все технологии
ТЗ
код
https://sebastianraschka.com/llm-architecture-gallery/ вдруг кому надо - сравнивалка моделей и энциклопедия по ним
Не совсем кейс, но не могу не поделиться.
Что делать если вам хочется поделиться знаниями, но мало времени, нет желания мучить фигму/паверпойнт и так далее.
Можно просто собрать все свои наработки в NBLM и он сделает все красиво.
Вот мой коллега сделал шпаргалку про работу ГИПа.
🍎 Вы думали уже выбросить свой iPhone с 1 апреля и перейти на тёмную сторону Android? Не спешите.
Apple тихо сделала для россиян то, чего не делала ни для одной страны мира — и ИИ за 30 минут собрал рабочую схему как сохранить всё и жить дальше в экосистеме.
→ https://telegra.ph/Apple-04-04-12
API - что это и зачем
API - это способ обратиться к модели из своего кода или инструмента напрямую, минуя интерфейс чата. Написал запрос - получил ответ. Именно на этом работают все инструменты из прошлого поста: Cline, Continue, Cursor - под капотом у каждого API-ключ.
Без API ты пользователь. С API - ты строишь что хочешь.
Провайдеры
Основные игроки: Anthropic (Claude), OpenAI (GPT), Google (Gemini). Схема получения ключа везде одинаковая - регистрируешься, пополняешь баланс, создаёшь ключ в личном кабинете. Цены примерно сопоставимые, конкуренция высокая.
Локальные модели
Ollama - ставишь на свою машину, скачиваешь модель (Llama, Mistral, Qwen), подключаешь в Cline или Continue как локальный endpoint. Карта не нужна, данные никуда не уходят. Минус - качество ниже топовых облачных моделей, без нормальной видеокарты будет медленно.
Агрегаторы для РФ
Прямой рублёвой оплаты нет ни у одного крупного провайдера. Решение - агрегаторы: ProxyAPI, APIBot, NovitaAI и тысячи их. Принимают рублёвые карты или крипту, дают ключ который работает с моделями OpenAI, Anthropic, Google и всем на свете. Берут наценку 10-30%, но экономят головную боль с иностранными картами
OpenRouter отдельно удобен тем, что один ключ даёт доступ к сотням моделей сразу - можно переключаться между Claude, GPT, Gemini и опенсорсом не регистрируясь у каждого провайдера отдельно. Так же может выдавать просто бесплатные модели.
Но, если вы думаете что можно воткнуть на комп Квен и у вас будет домашний Клодыч, понимающий вас с полуслова - то нет. Локальные ИИ - это просто инструменты для четко поставленных задача. Они все умеют, но ничего толком не знают.
Разберем сначала технологии и инструменты. Я верю, что тут все профи и все знают, но ведь не все и не все.
Я думаю многие до сих пор пишут скрипты в формате - пишу клодычу/гемини/квену в чатик - он пишет скрипт - вставляю в ВС Код - пишу в чат ошибку. Так тоже можно, но я себя при этом чувствую эффективным менеджером, который пересылает письма, не читая.
Чем такой подход еще плох:
1. Машина не видит весь код и проект, потому часто теряет контекст.
2. Машина каждый раз думает перебирая всю переписку и потому токены улетают как сыр и колбаса в офисе ВК по средам.
3. Машина заставляет вас делать тыщи команд в терминале.
4. Вы тратите больше времени на объяснения и перекидывание текста, чем на саму задачу.
Альтернатива?
Агентные IDE. Термин "Агент" я страшно не люблю, но буду использовать. Изначально это просто IDE, которые подсказывали что писать дальше, где какие скобки и тд. Сейчас - это полноценные среды для разработки, где внутри сидит нейронка или целая толпа нейронок.
Разберём что сейчас есть. Все инструменты ниже объединяет одно: машина работает внутри твоего проекта, а не в отдельном чате. Видит файлы, запускает терминал, читает ошибки.
Дальше - кратко плюсы, минусы, подводные камни.
VS Code + GitHub Copilot - знакомый редактор, которым большинство уже пользуется. Режим Agent появился недавно - агент сам правит файлы, читает ошибки, запускает терминал. Плюс - ноль порога входа если уже сидишь в VS Code. Минус - агентные возможности слабее чем у конкурентов, пока догоняет
Cline - расширение для VS Code, не отдельный продукт. Ставишь плагин, подключаешь любую модель через API (Claude, GPT, локальные через Ollama) - и VS Code становится агентным. Видит проект, запускает команды, правит файлы. Плюс - гибкость: сам выбираешь модель и платишь только за токены. Минус - надо самому настраивать, нет "из коробки". Цена - бесплатно само расширение, платишь за API модели напрямую.
Continue - аналог Cline, тоже плагин для VS Code (и JetBrains). Упор на кастомизацию: можно подключить хоть локальную модель через Ollama, хоть облако. Плюс - работает полностью локально, никакой код никуда не улетает. Минус - агентные возможности чуть слабее Cline. Цена - бесплатно, платишь только за модель.
Cursor - VS Code, которому пришили мозги. Внешне не отличишь. AI видит весь проект целиком. Режим Composer: говоришь задачу - он сам правит нужные файлы, создаёт новые. Минус - иногда галлюцинирует по крупным кодовым базам. Цена - от $20/мес
Windsurf - конкурент Cursor, тоже форк VS Code. Фича Cascade - агент выполняет задачи цепочкой: прочитал файл, написал код, запустил, поправил ошибку. Чуть дешевле Cursor. Минус - продукт моложе, иногда ведёт себя непредсказуемо. Цена - от $15/мес
TRAE (от ByteDance) - бесплатный на текущий момент, интерфейс похож на Cursor, под капотом свои модели плюс доступ к Claude и GPT. Плюс - бесплатно и щедро по лимитам. Минус - сырой, и открытый вопрос куда улетает твой код, учитывая владельца. Цена - бесплатно, пока.
Claude Code - не IDE, а CLI-агент от Anthropic. Запускаешь в терминале внутри проекта, видит всё дерево файлов. Никакого GUI. Плюс - очень точный, хорошо держит контекст больших проектов. Минус - только терминал, токены жгёт быстро.
OpenAI Codex - облачный агент, работает в браузере. Запускает задачи в изолированном контейнере: клонирует репо, пишет код, делает коммит. Плюс - хорошо для автономных задач типа "реши этот баг и открой PR". Минус - медленно, нет интерактивности в реальном времени. Авторизация через аккаунт OpenAI без API-ключа.
Qwen (Tongyi Lingma) - официальный плагин для VS Code от Alibaba, авторизация через аккаунт Alibaba Cloud без API-ключа. Бесплатный уровень есть. Плюс - работает без карты вообще, китайская регистрация доступна из РФ без проблем. Минус - качество модели уступает топовым западным, и снова вопрос про то, куда улетает код.
Суть не в том, какой инструмент выбрать. Суть в том, чтобы перестать быть курьером между чатом и редактором. Любой из списка это решает.
А чтобы всё это вообще работало - нужен API. Про него дальше.
Прекрасная суббота, надеюсь все выспались и яростно отдыхают.
А мы пока займемся нашим контент-планом, а то неделя вышла тяжелая, было не до канала.
Сегодня мы разберемся в ИИ агентах для кода и в API, а потом применим знания на практике. Все как в школе!
Сначала немного лирики и моего бесценного мнения.
Я не программист, хотя даже такое образование есть и пару лет я кнопки нажимал и писал что то там на С. Было это очень давно и сейчас я технологии разработки прикладного ПО представляю на уровне совсем базовом.
Я не считаю что ИИ заменит всех программистов, это просто еще один инструмент, облегчающий жизнь и логичное развитие. Если кто помнит, то когда-то появление ООП воспринималось как "Это конец, теперь программировать будут ВСЕ". Нельзя создать что то рабочее, не понимая что ты хочешь, зачем и как оно работает. И это я рассматриваю только тему личных нужд, про рынок тема отдельная.
Бесценное мнение высказано, дальше перейдем к теории.
Кстати, кому интересно - Квен новую модуль выпустил, обещают что лучше и быстрее. Будем изучать.
