OpenAI Responses 호환 — 내부적으로 채팅 요청으로 변환하는 shim 입니다.
previous_response_id 같은 stateful 저장은 미지원입니다.
본문
modelstring필수- 모델 ID
inputstring | array필수- 문자열, 또는 message /
function_call/function_call_output항목 배열 instructionsstring선택- system 지시문
max_output_tokensinteger선택- 최대 출력 토큰
temperaturenumber선택- 0~2
top_pnumber선택- 0~1
streamboolean선택- 토큰 단위 이벤트 스트리밍
backgroundboolean선택true면 비동기 잡으로 제출하고 즉시queued응답tools/tool_choicearray / string|object선택- chat 과 동일 형식
reasoning_effortstring선택none/low/medium/highuserstring선택- 최종 사용자 식별자
everyaisobject선택- 게이트웨이 캐싱 옵션
모델별 옵션 지원
GET /v1/models의 capabilities·limits 및 Chat 옵션의 모델별 제한이 동일하게 적용됩니다. 미지원 옵션·값·조합은 400입니다. capabilities.sampling: false이면 temperature·top_p를 생략하세요.
reasoning_effort: "none"은 추론 비활성화 요청으로 그대로 전달됩니다. 생략하거나 low로 바뀌지 않으며, Gemini 3처럼 비활성화를 지원하지 않는 모델에서는 400입니다. 지원 단계는 limits.reasoning_efforts를 확인하세요.
웹 검색은 Chat 전용이며 Responses의 tools는 함수 도구만 지원합니다. response_format·parallel_tool_calls는 이 shim에서 미지원(명시하면 400)입니다. 이 옵션은 Chat Completions로 요청하세요.
GET /v1/responses/{id}
background: true 로 제출한 잡의 상태를 폴링합니다.
{
"id": "resp_abc123",
"object": "response",
"created_at": 1709884800,
"model": "everyais/claude-opus-5",
"status": "queued",
"output": [],
"error": null,
"incomplete_details": null,
"usage": null
}status 는 queued → in_progress → completed / incomplete / failed / cancelled 로 전이합니다.
완료되면 저장된 전체 Response 본문이 반환됩니다.
잡이 없거나·만료됐거나·다른 키/사용자의 것이면 404 를 반환합니다.
POST /v1/responses/{id}/cancel
queued · in_progress 상태의 잡을 cancelled 로 전환하고 예약된 크레딧을 환불합니다.
이미 종료된 잡은 상태 변경 없이 현재 Response 를 그대로 돌려줍니다.