1. 키로 사용할 수 있는 모델 찾기
GET /v1/models는 키의 허용 모델과 계정·조직 정책을 적용합니다.
공개 모델 페이지에는 동의가 필요한 모델도 표시되므로, 공개 목록과 키의 목록은 다를 수 있습니다.
모델을 선택할 때는 응답의 id를 그대로 사용하세요.
2. 기능 확인
| 확인할 값 | 용도 |
|---|---|
category | LLM / IMAGE / VIDEO |
supported_endpoints | 모델에 연결된 공개 경로 확인 |
capabilities.streaming · tool_use · vision · json_mode | 스트리밍·도구·이미지 입력·JSON 출력 요청 지원 확인 |
capabilities.web_search | Chat에서 서버 실행 웹 검색 사용 가능 여부 |
capabilities.json_mode_with_tools · web_search_with_tools | JSON+도구·웹 검색+함수 도구 조합 지원 |
capabilities.sampling · structured_outputs · parallel_tool_calls · image_mask | 샘플링·strict 스키마·병렬 호출 제어·마스크 지원 |
limits.reasoning_efforts · supported_sizes · supported_qualities · supported_durations · max_images | 모델별 지원값과 개수. 필드 생략은 지원 미확인 |
limits.max_tokens · context_window | 모델별 출력·컨텍스트 한도 |
available | 현재 카탈로그의 호출 가능 상태 |
모델별 파라미터 제약은 게이트웨이의 공통 상한보다 작을 수 있습니다. Messages와 Responses는 채팅 호환 변환을 사용하며, 모든 공급사의 전체 기능을 그대로 제공하지는 않습니다.
3. 접근 정책 확인
커뮤니티 공급(supply)과 공급사의 학습 사용(training_use)은 별개의 동의이며 모두 기본 꺼짐입니다.
개인 키는 계정 설정, 조직 키는 조직 설정을 따릅니다.
| 필요한 동의 | Chat · Messages · Responses에 호출 가능한 후보가 없을 때 |
|---|---|
| 커뮤니티 공급 전용 모델 | 404 model_not_found |
| 학습 사용 전용 모델 | 404 model_not_found |
mixed 모델은 허용된 경로만 사용합니다. 원하는 모델이 목록에 없으면 키의 허용 모델, 두 동의 설정과
모델의 활성 상태를 확인하세요.
4. 라우팅 힌트
채팅 요청에 provider: {"sort": "latency", "allow_fallbacks": true}를 지정할 수 있습니다.
sort는 price / latency / throughput, allow_fallbacks는 공급 경로 재시도 허용 여부입니다.
공급자 이름을 지정하던 only / order / ignore는 폐기되어 보내도 무시됩니다.
models 배열에는 대체 모델을 최대 5개 지정합니다. 기본 모델이 호출 불가할 때 크레딧 예약 전에만
다음 모델을 시도합니다. 생성 도중 실패했다고 다른 모델로 이어서 생성하는 기능은 아닙니다.
가격 숫자는 기준 원가이며 실제 청구는 계정 요율을 적용합니다. 모델 응답과 가격 필드를 참고하세요.