Принимается не отдельная модель ИИ, а вся система: данные, правила, пользовательские экраны, подключения к другим системам, ограничения, журнал действий, документация и действия команды при ошибке.
Зафиксируйте требования к результату
Для каждого сценария описываются вход, допустимый выход, обязательные поля, источники, максимальная задержка и действия при низкой уверенности.
Критерий «ответ выглядит хорошо» заменяется измеримыми условиями.
Проверяйте на независимом наборе
Приёмочные примеры не должны совпадать с демонстрационными. Набор включает отрицания, короткие реплики, смену контекста, противоречия, длинные документы, пустые данные и попытки обойти правила.
Результаты сохраняются, чтобы повторить проверку после обновления модели ИИ или её инструкции.
- Обычные сценарии
- Граничные случаи
- Негативные тесты
- Безопасность
- Недоступность зависимостей
Проверьте интеграции и данные
Проверяются права доступа, повторные входящие события, повторная отправка, превышение времени ожидания, частичные ошибки и корректность записей. Ни одна ошибка ИИ не должна приводить к неконтролируемому изменению данных.
Проверьте работу после запуска
Команда должна видеть состояние системы, стоимость, задержку, ошибки, случаи передачи сотруднику и текущую версию системы. Должны существовать инструкция запуска, резервный сценарий, порядок обновления и возврата к предыдущей версии.
Что передаётся заказчику
Исходный код, настройки без секретных данных, схема системы, структура данных, правила обмена данными, тесты, показатели, перечень ограничений, инструкции запуска и журнал известных рисков.
Приёмочный акт не должен скрывать ограничения. Они фиксируются вместе с планом контроля и ответственными.