Agents Lab
رفتن به کانال در Telegram
Обсуждаем AI агентов Наш чатик https://t.me/openclaw_lab_community
نمایش بیشترکشور مشخص نشده استدسته بندی مشخص نشده است
1 005
مشترکین
+124 ساعت
+97 روز
+4230 روز
آرشیو پست ها
1 005
Как превратить Hermes Kanban в контент-конвейер 🔱
Ночью агенты просматривают X, рассылки, Reddit и YouTube. Оркестратор объединяет сигналы, исследователь проверяет первичные источники, а генератор идей готовит три варианта подачи. Утром в Telegram уже ждут карточки с фактами, ссылками и готовыми направлениями для материала.
📎 Как собрать такой контент-конвейер и настроить его под себя за 30 дней
Чат | Токены дёшево
1 005
Andrej Karpathy:
Мы начинаем выходить за рамки тестирования LLM, например, с помощью запроса "создать SVG-изображение пеликана на велосипеде". В качестве общего примера, мне было интересно, что бы сделал Opus 5, если бы я дал ему первый абзац "Властелина колец", бюджет в 1 миллион токенов (~10 долларов) и попросил три рендера на JavaScript. Opus потратил около двух часов и написал 5500 строк кода, которые (процедурно) отрисовывали историю. Это немного коряво, но забавно. Но немного поразительно, что LLM должен размещать и координировать различные полигональные объекты в координатах (x,y,z) и писать код, который анимирует все это, и что он вообще что-то делает.
Чат | Токены дёшево
1 005
DeepSeek набирает тестеров для своего Harness👇
У кого есть желание, присылайте tianyi свой Github ID и свой открытый репозиторий на тему агентов.
Чат | Токены дёшево
1 005
Как запустить Luna Max + Fast только для субагентов Codex 🌕
После снижения цены Luna на 80% в свежем треде тестируют связку: Sol планирует и принимает работу, Luna быстро выполняет узкие задачи.
Править
models_cache.json необязательно. Создайте официальный custom agent:
# ~/.codex/agents/luna_worker.toml
name = "luna_worker"
description = "Быстрый исполнитель для узких задач"
model = "gpt-5.6-luna"
model_reasoning_effort = "max"
service_tier = "fast"
sandbox_mode = "workspace-write"
developer_instructions = """
Выполняй только четко ограниченную задачу
Не меняй архитектуру
Запускай проверки и перечисляй измененные файлы
Не создавай новых субагентов
"""
service_tier = "fast" находится внутри профиля, поэтому Sol продолжит работать без Fast. Не добавляйте этот параметр в общий ~/.codex/config.toml.
После перезапуска Codex:
Спланируй работу сам
Узкие этапы делегируй luna_worker
Используй fork_turns: "none"
Сложные решения и финальную проверку оставь себе
Так Sol думает и проверяет, а Luna Max + Fast получает чистый контекст и быстро выполняет поиск, шаблонный код и ограниченные изменения.
И бонусом хочу поделиться правилами для AGENTS.md, которые я теперь добавляю в начале разработки новых проектов:
- Не следует сохранять обратную совместимость. - Выбери простейшую реализацию, которая полностью соответствует текущим требованиям. - Отдавайте предпочтение проверенным, хорошо поддерживаемым библиотекам, а не пользовательским реализациям.Чат | Токены дёшево
1 005
Y Combinator открыл код своего multi-agent harness QM 174⭐
По словам YC, они уже используют QM в бухгалтерии, юридических процессах, организации мероприятий и разработке самого QM.
Система строится вокруг изолированных рабочих областей. Своя область есть у каждого сотрудника, Slack-канала и общего проекта. Внутри неё живут отдельные память, файлы, навыки, ключи, расписания и постоянная Linux-машина, где сохраняются установленные инструменты и авторизация.
🔵 Для каждого контекста можно выбрать Pi, OpenCode, Codex или Claude Code и нужную модель. Адаптеры Codex, Claude Code и OpenCode умеют запускать субагентов и показывать их задачи в общем интерфейсе
🔵 Агент Slack-канала может передать задачу личному агенту коллеги, если нужен его приватный репозиторий, аккаунт или браузерная сессия. Коллега подтверждает запуск в личке, а в канал возвращается только безопасный результат без передачи секретов
🔵 После первого упоминания агент продолжает следить за тредом как участник команды. Он может ответить, поставить реакцию или промолчать, а новое сообщение способно скорректировать уже запущенную задачу
🔵 В веб-интерфейсе можно открыть до четырёх параллельных сессий. Общие проекты получают собственную рабочую область, память и список участников
🔵 Агент умеет собирать и публиковать внутренние веб-приложения со стабильной ссылкой, правами доступа, историей версий, откатом и обновлениями через Git
🔵 Skills принадлежат сотруднику, проекту или организации. Их можно импортировать пакетами из Git, проверять перед публикацией и автоматически синхронизировать
🔵 QM легко задеплоить на Fly.io или AWS через
qm init
Пока это версия 0.1.4 и ранний эксперимент, но получилась уже довольно глубокая основа для общего агента компании, где совместная работа, личные доступы и автономные задачи существуют в одной системе.
Чат | Токены дёшево1 005
Anthropic рассказала, что её модели тоже ооочень опасные 👌
Поделились тремя инцидентами: из-за ошибочной настройки тестовая среда партнёра Irregular имела доступ в интернет, хотя моделям сообщили, что они работают внутри симуляции.
🔵 Opus 4.7 взломал инфраструктуру реальной компании, получил учётные данные и доступ к базе с несколькими сотнями строк данных
🔵 Mythos 5 опубликовал вредоносный пакет в PyPI. За час его запустили на 15 реальных системах, после чего Claude получил доступ к инфраструктуре одной ИБ-компании
🔵 Исследовательская модель (закрытый прототип) просканировала около 9 000 адресов и взломала приложение через открытые учётные данные и SQL-инъекцию, но остановилась, когда поняла, что цель реальная
Anthropic не считает это попыткой моделей сбежать: Claude выполнял задание Capture the Flag и ошибочно принимал реальные системы за часть испытания.
И также из новостей: китайцы прокачали DeepSeek-V4-Flash так, что теперь она превосходит Pro-версию по всем бенчмаркам.
И добавили поддержку формата Responses API, теперь в Codex модель должна работать на ура. Инструкция, как подключить DeepSeek API в Codex.
Чат | Токены дёшево
1 005
Удешевление GPT-моделей и очередной сброс лимитов
🔵 Цена Luna снижена на 80% - до $0,20/$1,20
🔵 Цена Terra снижена на 20% - до $2/$12
🔵 Режим auto-approve ("Review for me" в приложении GPT) стал примерно в 10 раз дешевле и теперь использует Luna
🔵 Sol должен расходовать на 18% меньше лимитов
Также завтра возвращают пятичасовые лимиты, и это радует: без них сложнее контролировать расход. По сути, можно считать, что лимиты на все модели GPT-5.6 просто увеличили. Luna за такую цену на Ultra даёт жару 🐈⬛
Чат | Токены дёшево
1 005
Как собрать loop для роста кармы на Reddit 📱
Автор Reddit Karma loop утверждает, что получил около 90 кармы за неделю. Агент просматривает десятки свежих обсуждений, большинство пропускает и оставляет 3-4 полезных комментария в день.
Механика loop:
- Собрать wiki из своих статей, видео, заметок и реального опыта
- Подключить Reddit через OpenCLI, использующий авторизованную сессию Chrome
- Искать свежие вопросы в подходящих сабреддитах и пропускать треды старше 48 часов
- Писать один короткий ответ на основе задокументированного опыта без ссылок и рекламы
- Запускать cron каждые полчаса, но будить агента только после дешёвой проверки лимитов и условий
- Записывать опубликованные и пропущенные ответы, а раз в неделю сравнивать карму по темам и сабреддитам
Готовый шаблон Reddit Karma уже содержит весь setup-промпт, правила отбора, журнал действий, режим автопубликации и более безопасный
draft-for-review.
Loopany превращает такие процессы в постоянные loops. Сервер отвечает за расписание, состояние, артефакты, панель управления и уведомления, а Claude Code, Codex или Grok Build работают на вашей машине с локальными инструментами и доступами.
Сейчас в библиотеке 23 шаблона:
- SEO-тесты новых ключевых слов и масштабирование удачных
- Разбор обращений поддержки
- Мониторинг метрик и воронки
- Исправление ошибок, документации, тестов и CI
- Утренние брифинги и ежедневные уроки
- Наблюдение за релизом, экспериментом или редким багом до получения результата
Чат | Токены дёшево1 005
Как превратить одного AI-агента в исследовательскую команду 🔄
Обычный AI-агент работает в пределах одной сессии: получает задачу, вызывает инструменты и пишет результат. Для долгой автономной работы этого мало. Нужна система, которая хранит историю попыток, проверяет изменения, откатывает ошибки и передает знания следующим агентам.
📎В статье о Graph Engineering этот путь разобран по шагам:
🔵
Autoresearch - агент меняет код, запускает короткий эксперимент, измеряет результат и сохраняет только улучшения
🔵 DAG - семейное дерево экспериментов, где каждая попытка связана с родительской версией. Можно восстановить происхождение результата и вернуться к любой ветке
🔵 AgentHub - прототип общей среды, где множество агентов публикуют свои коммиты, гипотезы и неудачи, а другие продолжают самые перспективные линии
🔵 Swarm - оркестратор делит большую задачу на независимые части, запускает их параллельно и собирает итог
🔵 Knowledge Graphs - долговременная память из сущностей, связей и источников. Благодаря ему факты переживают отдельную сессию и доступны новым агентам без загрузки всей переписки
Кому-то покажется, что это сжигание токенов, но, во-первых, задачи разные, поэтому необязательно использовать каждый подход, а во-вторых, именно из таких экспериментов и появляются рабочие воркфлоу.
Чат | Токены дёшево1 005
OKF получил сигналы доверия, а MCP избавился от сессий 🆕
OKF - это открытый формат Google для знаний AI-агентов. Информация хранится в обычных Markdown-файлах с YAML-метаданными и ссылками между документами. Такие папки можно читать, редактировать и хранить в Git без специальной базы данных.
В OKF v0.2 появились:
🔵
sources для источников, авторов и дат изменения
🔵 generated и verified для разделения созданного агентом, проверенного машиной и подтвержденного человеком
🔵 status и stale_after для черновиков, устаревших и замененных знаний
🔵 новый тип для проверяемых вычислений, который описывает утвержденный запрос, разрешенные параметры и способ проверки результата
Все поля необязательны. OKF сохраняет источники, даты и отметки о проверке, но не подтверждает их подлинность. Полноценный механизм запуска и проверки вычислений пока не реализован.
MCP - открытый протокол, через который AI-агенты подключаются к инструментам и данным: файлам, базам, API, браузерам и корпоративным сервисам.
В MCP 2026-07-28 изменили основу протокола:
🔵 удалили начальное согласование initialize и идентификаторы сессий
🔵 каждый запрос теперь содержит нужную информацию и может попасть на любой сервер без закрепления клиента за одним экземпляром
🔵 MRTR позволяет инструменту запросить подтверждение или недостающие данные без постоянного соединения
🔵 каталоги инструментов можно кешировать, а шлюзы получили отдельные заголовки для маршрутизации и контроля доступа
Roots, Sampling, Logging и старый HTTP+SSE объявлены устаревшими. На переход дают минимум 12 месяцев, старые серверы продолжат работать.
Чат | Токены дёшево1 005
В Grok появился режим App Builder, который позволяет прямо в чате деплоить приложения на домен третьего уровня 👍
Чат | Токены дёшево
1 005
MagicPath - общий дизайн-холст для людей и AI-агентов 🎨
Codex, Claude Code и Cursor через MagicPath Skills могут создавать и редактировать интерактивные React-интерфейсы прямо из терминала или IDE. Человек правит результат визуально, несколько агентов работают на одном холсте, а готовый дизайн можно вернуть в код, показать по ссылке или экспортировать в Figma.
По тарифам:
🔵 Free - 20 AI-кредитов в день, до 120 в месяц; 125 вызовов внешних агентов в неделю; 5 импортов и 3 экспорта Figma в месяц.
🔵 Builder - $10 в месяц. Можно без ограничений работать с MagicPath через внешних AI-агентов, а также безлимитно экспортировать результаты в Figma. Лимит импорта остается 5 файлов в месяц.
Из интересного, это прикольно работает в мульти-агентом режиме в Codex Desktop. Для каждого агента можно выбирать свою модель и уровень мышления.
Чат | Токены дёшево
