모델명 prefix 생략
everyais/ 없이도 호출됩니다. 마지막 세그먼트가 카탈로그에서 유일하면
claude-opus-5 는 everyais/claude-opus-5 로 붙습니다. 점 표기
(gemini-3.5-flash)와 큐레이션된 공개 ID(gpt-5.4 → everyais/openai-gpt-5-4)도
판매 중인 canonical 이 있을 때만 매핑됩니다. 후보가 둘 이상이면 추측하지 않고 404 입니다.
프로바이더 native 모델 ID 는 어드민 ModelAlias 로 매핑됩니다.
GET /v1/models 의 aliases 가 이 모델이 받는 공개 이름 목록입니다.
호출당 비용 헤더
비스트림 응답에 x-everyais-cost-usd 헤더로 해당 요청의 서비스 가격(USD)이 포함됩니다.
에이전트 예산 가드에 사용하세요.
Idempotency-Key
POST 요청에 Idempotency-Key 헤더를 보내면 재시도 시 중복 호출·중복 과금을 방지합니다
(24시간, 비스트림 한정). 재생된 응답에는 Idempotent-Replayed: true 헤더가 붙습니다.
usage 세부 토큰
프로바이더가 제공할 경우 usage.prompt_tokens_details.cached_tokens(캐시 적중)와
cache_creation_tokens(캐시 생성)가 포함됩니다.
per-key 예산 · 스코프
대시보드에서 API 키별 월/일 지출 한도(USD)와 허용 엔드포인트 스코프
(chat · images · video · models:read)를 설정할 수 있습니다.
한도 초과 시 402, 스코프 밖 호출 시 403 을 반환합니다(스코프를 모두 비우면 전체 허용).
엔드포인트별 제약
| 항목 | 제약 |
|---|---|
/v1/chat/completions 의 n | 1 만 지원 — 2 이상은 400 |
/v1/images/generations 의 n | 1~10 |
/v1/images/edits 의 n | 1~4 |
/v1/moderations | 미지원(501) |
| 추론 POST 상한 | 5분 (스트리밍 여부 무관) |
| 조회·폴링 요청 상한 | 29초 |