Где модель сильна

Не в поиске багов — она не видит вашего продукта. В генерации вариантов и в формулировках.

Придумать двадцать краевых случаев для поля ввода — задача, где человек устаёт на восьмом, а модель выдаёт двадцать за секунду. Оформить найденный дефект так, чтобы разработчик воспроизвёл его без переписки, — задача формулировки.

Работать удобно в чате; хорошо справляются DeepSeek V4 Pro и Claude Opus 5.

Краевые случаи

«Вот описание формы регистрации: [поля и правила]. Перечисли 25 краевых случаев для проверки: границы значений, спецсимволы, разные раскладки, вставка из буфера, повторная отправка, поведение при обрыве сети.»

Половину вы и так знаете, но остальные — те, что обычно вспоминаются уже после релиза.

КатегорияЧто просить
ГраницыМинимум, максимум, на единицу больше и меньше
ПустотаПустое поле, только пробелы, только перенос строки
ЯзыкКириллица, латиница, смешанное, эмодзи, RTL
ВремяСмена суток, високосный год, разные пояса
СостояниеДвойной клик, повторная отправка, обрыв связи
ПраваЧужой идентификатор, истёкшая сессия

Последняя строка стоит отдельного внимания: проверки прав — то, что чаще всего пропускают, и то, что дороже всего обходится.

Баг-репорт, который воспроизведут

Плохой репорт стоит двух переписок и дня задержки. Хороший содержит шаги, ожидаемое и фактическое — и ничего лишнего.

«Вот мои заметки о дефекте. Оформи баг-репорт: краткий заголовок с сутью, окружение, шаги воспроизведения по пунктам, ожидаемый результат, фактический результат. Без предположений о причине.»

Последнее условие важно: догадка о причине в репорте уводит разработчика в сторону, если она неверна.

Разбор требований

Самое дешёвое тестирование — до написания кода.

«Вот требования к функции. Найди: что не определено, где возможны противоречия, какие состояния не описаны, что произойдёт при ошибке. Задай вопросы, которые я должен задать аналитику.»

Список из десяти вопросов к требованиям экономит недели переделок. Это то применение, где выгода максимальна, а риск ошибки минимален — модель ничего не утверждает, а только спрашивает.

Попробовать можно на ГПТ Россия: новичку начисляется приветственный бонус 50 ₽, сервис работает без VPN, оплата в рублях российской картой.

Автотесты

Черновик автотеста по описанию сценария модель пишет прилично: структура, ожидания, подготовка данных.

Но проверять его обязательно. Тест, который проходит, но проверяет не то, хуже отсутствия теста: он создаёт ложную уверенность. Читайте утверждения в тесте — именно там прячется расхождение между тем, что вы имели в виду, и тем, что написано.

Правила безопасной работы с генерируемым кодом — в гайде про код для непрограммиста, они применимы и здесь.

Чего не поручать

Оценку критичности. Приоритет дефекта зависит от бизнес-контекста, которого модель не знает.

Решение о релизе. Ни при каких обстоятельствах.

Тестирование безопасности как таковое. Модель предложит типовые проверки, но полноту она не гарантирует, а ощущение покрытия создаёт.

И общее: она не проверяет факты и может уверенно назвать несуществующий метод библиотеки — механика в гайде про то, почему нейросеть врёт.

Частые вопросы

Можно ли давать модели наш код и требования?

Платформа размещена в России в соответствии с требованиями 152-ФЗ. Тем не менее, если код или требования составляют коммерческую тайну, уточните политику у себя в компании и при необходимости обезличивайте фрагменты.

Заменит ли это ручное тестирование?

Нет. Модель генерирует варианты и формулировки, но выполнять проверки, замечать странность в поведении и понимать продукт по-прежнему приходится человеку.

Сколько стоит такая работа за месяц?

Текстовые модели тарифицируются по объёму. Ежедневное использование для сценариев и репортов на экономичной модели укладывается в скромную сумму; точные цены — на странице тарифов.