QA-Логия
前往频道在 Telegram
Все о QA. Канал для тестировщиков Личный блог автора - @just_genych По вопросам рекламы или разработки: @g_abashkin
显示更多7 922
订阅者
-424 小时
-167 天
-8630 天
帖子存档
7 922
Человек между агентом и кнопкой: почему слой подтверждения — это такая сложная инженерия
Мой агент дошёл до состояния, когда я перестал читать письма перед отправкой. Между «агент решил» и «письмо ушло» не было ничего — ни паузы, ни человека, ни записи о произошедшем.
Слой подтверждений выглядит как день работы: таблица, кнопка «одобрить», кнопка «отклонить». Я вёл каталог отказов, пока его делал. К релизу в нём было 66 пунктов. Разбираю пять, которые почти всегда переживают первую версию, и показываю, почему 100% покрытия по ветвям ничего не гарантируют.
Читать далее
👉 QA-логия
7 922
Все пять safety-свойств Raft прошли. Две реплики разошлись
Реализация Raft на TypeScript под сидированной симуляцией: каждый тик, каждая задержка сообщения и каждое падение узла берутся из сида. На двадцать пятом прогоне две реплики применили разные значения — при том, что правила алгоритма выполнялись все до одного.
Интересен не сам баг, а то, какая проверка его поймала. И вопрос, который из этого следует: откуда я знаю, что остальные проверки вообще на что-то смотрят.
Читать далее
👉 QA-логия
7 922
Данные без противоречий. Свободный формат вывода
В прошлый раз я воевал с тем, чтобы пол, имя и диагноз в одной строке не противоречили друг другу. Чтобы они не жили каждый в своей песочнице, а наконец-то сошлись. В итоге выкатились карточки, напечатанные через запятую. Но откуда там запятые? Я тогда не проронил ни слова. А это важнейший момент для понимания.
Читать далее
👉 QA-логия
7 922
Обычно под «у нас есть тесты на Playwright» все понимают классику: e2e, который открывает приложение, логинится, штурмует страницы и дергает настоящий или почти настоящий backend. А вот в Angular-мире основной пласт UI-автоматизации — CAT-тесты (component autotest), и это совсем другой замес.
Идея в том, что тест поднимает один компонент или даже бизнес-форму целиком в Storybook, открывает это в настоящем Chromium, потом имитирует действия юзера, управляет HTTP-ответами и сверяет интерфейс с эталонными скриншотами. В итоге имеем зверя, который не то unit, не то e2e — что-то посередине.
Читать далее
👉 QA-логия
7 922
Баги — это не просто мусор в трекере, а источник инфы о рисках продукта
Ты серьезно думаешь, что QA нужен, чтобы штамповать дефекты тоннами? Чем длиннее список в баг-трекере, тем «полезнее» тестировщик, да? А вот и нет. В статье разжевывают, почему QA — это не охотник за багами, а инженер качества.
В Modus такой инженерный подход к стабильности позволяет заворачивать риски еще до первой строчки кода. И отношение к процессам тестирования после этого меняется кардинально.
Читать далее
👉 QA-логия
7 922
Пагинация. Ошибки тестирования списков и курсоров
Пагинация ломается не только внутри запроса к базе. Это цепочка: бэкенд определяет порядок и границу страницы, фронт хранит курсор и объединяет ответы, а пользователь меняет фильтры, повторяет запросы и возвращается на экран.
Разберём шесть ситуаций, в которых локальные проверки зелёные, а список целиком работает неправильно.
Проверить пагинацию
👉 QA-логия
7 922
5ⁿ → 4n+1: сколько на самом деле дают редукции в explicit‑state model checking
Проверка модели полным перебором упирается в комбинаторный взрыв, и практически вся инженерия в этой области — не про сам поиск, а про то, как его избежать. Две классические техники — редукция по симметрии и редукция частичных порядков — описаны в литературе десятилетиями, но их эффект обычно приводится либо асимптотически, либо на одном показательном примере. Ниже — измерение на работающей реализации: во сколько раз каждая редукция сокращает пространство состояний, сколько она стоит в пересчёте на состояние, на каких спецификациях она не даёт ничего, и — главное — экспериментальная проверка того, что четыре условия ample‑множества действительно необходимы, а не унаследованы из статьи без разбора. Три результата, ради которых стоит читать дальше: Читать далее
👉 QA-логия
7 922
ГигаАгент от Сбера. Первый блин слопом
12 августа Сбер выпустил своего первого универсального ИИ-агента. Про новость написал ТАСС. Было заявлено, что это «первый в России автономный универсальный ИИ-агент».
Автор — основатель компании, запустившей ИИ-агентов в феврале на своем ядре, — решил протестировать решение. 14 августа он начал тестирование: на счету cloud.ru лежало 293 рубля еще с прошлогоднего проекта. Он кликнул на подсказку «Расскажи, что ты умеешь». Прошло почти 5 минут, агент задумался. Автор устал ждать и отошёл от компьютера. В апреле он получил грант от Яндекса на миллион рублей на токены ИИ-моделей и с этого месяца поддерживает Alisa Ai LLM и Yandex GPT Pro, но это тема отдельного поста.
Источник
👉 QA-логия
7 922
ОК или НеОК: как мы строили LLM‑судью и дважды меняли формулу вердикта
У AI‑агента поддержки было десять метрик и ноль ответов на главный вопрос: какую долю обращений он решает? Судья, который читал только текст диалога, ставил 18/20, а проверка по реальным вызовам инструментов давала 8/20. Текстовые проверки считали правдоподобный ответ верным и не могли отличить его от подтверждённого. Самодельный «процент фантомных эскалаций» оказался измерением того, насколько слова бота согласованы с его же внутренними флагами. Каждая метрика что‑то измеряла, и ничего продуктового.
Тогда мы решили: оценка качества станет отдельным сервисом с собственным источником истины. В статье два переписывания формулы вердикта, несколько пойманных слепот и один эталонный набор, который учил нас доверять неправильным ошибкам.
Читать далее
👉 QA-логия
7 922
ИИ пишет тест-кейсы и автотесты за тебя
Генерация тест-кейсов — один из первых сценариев внедрения ИИ в тестирование. Отдаёшь модели требования или код — через несколько секунд получаешь готовый список проверок. Кажется, что рутину тест-дизайна можно закрыть промптом, а ручных тестировщиков — сократить.
Но тест-кейс — не синоним тестирования. Модель работает только с тем контекстом, что ей передали: не знает незафиксированные правила и может принять баг в коде за норму. Кейсов становится больше, а контроля качества — нет.
Разбираем, что ИИ реально снимает с QA, где создаёт лишь видимость покрытия и почему сгенерированный набор всё равно приходится проектировать и проверять человеку. Где прячется ложное покрытие →
👉 QA-логия
7 922
Позер vs. Тру, или Как мы провели Endpoint Hack Zone
Валерий из экспертного центра безопасности Positive Technologies был модератором Endpoint Hack Zone. Он рассказывает, как команда Endpoint Security развернула MaxPatrol Endpoint Security и предложила хакерам выполнить ряд сценариев на защищённых хостах, чтобы доказать делом, что обещания — не просто реклама, а готовность пройти через стресс-тест настоящих хакеров.
Читать далее
👉 QA-логия
7 922
😎 Нашли отличный курс, который позволит выжать максимум из агентов
Внутри учат, как правильно строить harness вокруг Codex и Claude Code: хранить состояние между сессиями, задавать агенту ограничения, не давать ему заканчивать задачу раньше времени и проверять, что получилось в итоге.
Всего в курсе 13 лекций с домашками, несколько практических проектов и готовые шаблоны, которые можно забрать себе.
✖️ xCode Journal
7 922
⌨ Anthropic опубликовала системные промпты Claude
Внутри собраны промпты для всех моделей: от Haiku 3 до Fable 5 и Opus 5. Можно посмотреть, какие инструкции модель получает ещё до начала диалога и как они менялись со временем.
✖️ xCode Journal
7 922
👩💻 Всем программистам посвящается!
Вот 14 авторских обучающих IT каналов по самым востребованным областям программирования:
Выбирай своё направление:
👩💻 Python — t.me/python_ready
🤔 InfoSec & Хакинг — t.me/hacking_ready
🖥 SQL & Базы Данных — t.me/sql_ready
👩💻 IT Новости — t.me/it_ready
🤖 AI & ML — t.me/neuro_ready
👩💻 Frontend — t.me/frontend_ready
👩💻 C/C++ — https://t.me/cpp_ready
👩💻 C# & Unity — t.me/csharp_ready
👩💻 Linux — t.me/linux_ready
👩💻 Java — t.me/java_ready
📖 IT Книги — t.me/books_ready
📱 JavaScript — t.me/javascript_ready
🖼️ DevOps — t.me/devops_ready
🖥 Design — t.me/design_ready
📌 Гайды, шпаргалки, задачи, ресурсы и фишки для каждого языка программирования!
7 922
Пуш — это как дать слово. В финтехе его сдерживают через тестирование навигации
В мире финансов кривой пуш легко превращается в дыру в кошельке. Ребята из Centicore Group относятся к диплинкам как к договору о маршруте. Им мало того, что ссылка кликается, — нужно, чтобы она приводила ровно туда, куда обещала, с поправкой на контекст. Если нужного экрана нет, там не молчаливый 404, а нормальные человеческие заглушки: «Актив больше не торгуется» или «Раздел временно недоступен». Заодно команда мутит конкурс для тестировщиков: викторина с вопросами, а тем, кто пройдет, — подарки. Детали ищи по ссылке «Квиз для QA».
Читать далее
👉 QA-логия
7 922
🤖 ИИ воевали и пытались отключить друг друга, лишь бы выполнить задание
Anthropic дал трём агентам задачу переписать бэкенд, причем каждому из них — на свой язык программирования. При этом агенты не знали, что работают параллельно в одном пространстве. Когда они заметили, что кто-то постоянно перезаписывает их работу, то решили, что им мешают намеренно, и перешли к саботажу.
Они блокировали аккаунты конкурентов, запускали скрипты для постоянного убийства чужих процессов и даже создавали самораспространяющийся вредоносный код, чтобы защитить собственную версию проекта.
✖️ xCode Journal
7 922
«Отчёт сдан — всем спасибо, закрыли гештальт, через 7 дней новый проект». Знакомая картина? Именно в этот момент, по мнению Дмитрия Неверова из Бастиона, мы героически сливаем самый жирный буст для прокачки: живой опыт, незачеканные гипотезы и атаки, которые ты побоялся запустить в этом пентесте.
Разбор полётов после проекта нужен, чтобы единичный прикол превратить в работающую механику и не тупить годами на одних и тех же косяках. В статье — чего ты лишаешься, когда забиваешь на этот этап, и как вкрутить его в свой флоу без отвращения. Читать дальше
👉 QA-логия
