Короткий ответ: поместите тонкий внутренний прокси Node.js перед OpenAI, Claude и Gemini, предоставьте приложению одну логическую модель обзора игры, разрешите ее из единого каталога моделей и отклоните каждый ответ, который не соответствует схеме результатов. Э...
Короткий ответ: поместите тонкий внутренний прокси Node.js перед OpenAI, Claude и Gemini, предоставьте приложению одну логическую модель обзора игры, разрешите ее из единого каталога моделей и отклоните каждый ответ, который не соответствует схеме результатов.
Решающим ограничением является правильность структурированного вывода. Свободная проверка, в которой не указан путь к файлу или выдается «критический» уровень серьезности, не может быть включена в автоматический рабочий процесс запроса на включение. Широта поставщика имеет значение только после того, как ответ преодолеет эту границу.
Держите тест острым.
Начните с приемочного теста, а не с поставщика
Самый маленький полезный эксперимент пропускает одни и те же различия игрового кода через каждый маршрут-кандидат и сначала задает один бинарный вопрос: можно ли проанализировать результат в контракте приложения? В моем контракте для этого примера требуется массив с именем «findings»; каждый элемент имеет файл, положительный номер строки, одно из трех значений серьезности и сообщение. Пустой массив действителен. Отсутствующий массив — нет.
Это различие предотвращает распространенную ошибку оценки. Если для получения хотя бы одного результата требуется достоверная информация, тест вознаграждает за ложные срабатывания. Если некорректный JSON считается чистой проверкой, тест вознаграждает за сбой транспорта.