모델명 prefix 생략
everyais/ 없이도 호출됩니다. 마지막 세그먼트가 카탈로그에서 유일하면
claude-opus-5 는 everyais/claude-opus-5 로 붙습니다. 점 표기
(gemini-3.5-flash)와 큐레이션된 공개 ID(gpt-5.4 → everyais/openai-gpt-5-4)도
판매 중인 canonical 이 있을 때만 매핑됩니다. 후보가 둘 이상이면 추측하지 않고 404 입니다.
프로바이더 native 모델 ID 는 어드민 ModelAlias 로 매핑됩니다.
GET /v1/models 의 aliases 가 이 모델이 받는 공개 이름 목록입니다.
호출당 비용 헤더
비스트림 응답에 x-everyais-cost-usd 헤더로 해당 요청의 서비스 가격(USD)이 포함됩니다.
에이전트 예산 가드에 사용하세요.
Idempotency-Key
채팅·Messages·Responses·이미지 생성/편집에 지원합니다. 비디오 제출은 대상이 아닙니다.
같은 API 키·경로·인가 정책에서 동일한 본문을 재시도할 때 같은 Idempotency-Key를 보내세요.
키는 최대 255자이고 기록은 24시간 유지됩니다. JSON의 공백이나 필드 순서가 달라도 다른 본문으로 판정합니다.
- 성공한 JSON 응답은 300 KiB 이하일 때 재생하며
Idempotent-Replayed: true를 반환합니다. - 같은 키로 다른 본문을 보내거나 진행 중이면 409입니다.
- SSE와 큰 성공 응답은 재생하지 않습니다. 중복 실행을 막는 기록을 남기며 같은 키 재요청은 409입니다.
- 실패 응답은 캐시하지 않습니다. 멱등성 저장소 장애 시 요청은 진행될 수 있어 절대적인 1회 실행 보장은 아닙니다.
자동 재시도를 붙이기 전에 에러와 재시도를 확인하세요.
usage 세부 토큰
프로바이더가 제공할 경우 usage.prompt_tokens_details.cached_tokens(캐시 적중)와
cache_creation_tokens(캐시 생성)가 포함됩니다.
per-key 예산 · 스코프
대시보드에서 API 키별 월/일/분 지출 한도(USD)와 허용 엔드포인트 스코프
(chat · images · video · models:read)를 설정할 수 있습니다.
한도 초과 시 402, 스코프 밖 호출 시 403 을 반환합니다(스코프를 모두 비우면 전체 허용).
엔드포인트별 제약
| 항목 | 제약 |
|---|---|
/v1/chat/completions 의 n | 1 만 지원 — 2 이상은 400 |
/v1/images/generations 의 n | 1~10 |
/v1/images/edits 의 n | 1~4 |
요청 시간 예산과 본문 용량은 Base URL · 요청 제한을 참고하세요.
전용 /v1/embeddings와 /v1/audio/* API는 제공하지 않습니다.