API 문서

OpenAI 호환 API 엔드포인트

Base URL

https://api.everyais.com/v1

OpenAI SDK·Cursor·opencode 등에 base URL 을 입력할 때는 반드시 /v1 까지 포함하세요. 클라이언트가 /chat/completions 등 경로를 뒤에 붙입니다./v1/chat/completionsstream: true 시 토큰 단위 실시간 SSE 스트리밍을 지원합니다 (최대 5분). 비스트리밍 요청은 30초 한도가 적용되므로 긴 응답이 예상되면 stream: true 를 사용하세요.

인증

모든 요청에 API 키를 헤더로 전달하세요:

Authorization: Bearer everyais_your_api_key

퀵스타트

curl:

curl https://api.everyais.com/v1/chat/completions \
  -H "Authorization: Bearer everyais_your_api_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "everyais/claude-sonnet-4-6",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Python (openai SDK):

from openai import OpenAI

client = OpenAI(
    base_url="https://api.everyais.com/v1",
    api_key="everyais_your_api_key",
)
resp = client.chat.completions.create(
    model="everyais/claude-sonnet-4-6",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)

Node.js (openai SDK):

import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.everyais.com/v1",
  apiKey: "everyais_your_api_key",
});
const resp = await client.chat.completions.create({
  model: "everyais/claude-sonnet-4-6",
  messages: [{ role: "user", content: "Hello!" }],
});
console.log(resp.choices[0].message.content);

코딩 도구 연동 (Cursor / opencode / Continue / Claude Code)

Claude Code / Anthropic SDK

Anthropic Messages 호환 /v1/messages 를 제공하므로 anthropic-native 도구도 붙습니다. 환경변수로 ANTHROPIC_BASE_URL=https://api.everyais.com,ANTHROPIC_API_KEY=everyais_... 를 설정하세요 (base URL 은 /v1 미포함 — SDK 가 /v1/messages 를 붙입니다).

Cursor

  1. Settings → Models → API Keys 에서 OpenAI API Key 에 everyais 키 입력
  2. Override OpenAI Base URL 활성화 후 https://api.everyais.com/v1 입력
  3. 모델 목록에 everyais/claude-sonnet-4-6 등 모델 ID 를 직접 추가하고 Verify

참고: Cursor 커스텀 키는 채팅 모델에만 적용됩니다 (Tab 자동완성은 Cursor 자체 모델 사용).

opencode

// opencode.json
{
  "provider": {
    "everyais": {
      "npm": "@ai-sdk/openai-compatible",
      "options": {
        "baseURL": "https://api.everyais.com/v1",
        "apiKey": "{env:EVERYAIS_API_KEY}"
      },
      "models": {
        "everyais/claude-sonnet-4-6": { "name": "Claude Sonnet 4.6" },
        "everyais/g/gemini-3-pro-preview": { "name": "Gemini 3 Pro" }
      }
    }
  }
}

Continue / Cline / 기타 OpenAI 호환 도구

provider 를 openai 로 두고 base URL 에 https://api.everyais.com/v1, API key 에 everyais 키, model 에 아래 카탈로그의 모델 ID 를 입력하면 됩니다.

POST/v1/chat/completions채팅 완성
{
  "model": "everyais/claude-sonnet-4-6",
  "messages": [{"role": "user", "content": "Hello!"}],
  "stream": false
}
POST/v1/messagesAnthropic Messages 호환 (Claude Code 등 anthropic-native 클라이언트) — stream 지원
{
  "model": "everyais/claude-sonnet-4-6",
  "max_tokens": 1024,
  "messages": [{"role": "user", "content": "Hello!"}]
}
POST/v1/responsesOpenAI Responses 호환 (변환 shim — stateful 저장 미지원)
{
  "model": "everyais/claude-sonnet-4-6",
  "input": "Hello!",
  "instructions": "Be concise."
}
POST/v1/images/generations이미지 생성
{
  "model": "everyais/g/imagen-4",
  "prompt": "a beautiful sunset",
  "n": 1
}
POST/v1/videos/generations비디오 생성 (초당 과금, async operation — 응답의 id 로 /v1/outputs/{requestId} 폴링)
{
  "model": "everyais/g/veo-3-1-generate-001",
  "prompt": "a timelapse of a blooming flower",
  "duration": 8,
  "pricingVariant": "with-audio"
}
GET/v1/models사용 가능한 모델 목록
GET/v1/outputs/{requestId}출력 조회 (24h presigned URL)

에러 형식 & 레이트리밋

모든 에러는 OpenAI 호환 envelope 으로 반환됩니다:

{
  "error": {
    "message": "Incorrect API key provided. ...",
    "type": "authentication_error",
    "param": null,
    "code": "invalid_api_key"
  }
}
상태type / code의미
400invalid_request_error잘못된 파라미터 / 컨텍스트 초과 (재시도 금지)
401authentication_error / invalid_api_key키 누락·오류·만료
402insufficient_quota_error / insufficient_quota크레딧 부족 또는 지출 한도 도달
403permission_error / model_not_allowed키의 허용 모델 제한
404invalid_request_error / model_not_found존재하지 않는 모델
429rate_limit_error / rate_limit_exceeded레이트리밋 — Retry-After 헤더 후 재시도
502api_error / upstream_error업스트림 프로바이더 장애 (재시도 가능)

기본 레이트리밋은 키당 100 req/min 이며 키 생성 시 조정할 수 있습니다. 응답의 X-RateLimit-Limit / X-RateLimit-Remaining / X-RateLimit-Reset 헤더로 잔여량을 확인하세요.

호환 편의 기능

  • 모델명 prefix 생략everyais/ 없이도 호출됩니다.claude-sonnet-4-6everyais/claude-sonnet-4-6 로, 프로바이더 native 모델 ID 도 자동 매핑됩니다.
  • 호출당 비용 헤더 — 비스트림 응답에 x-everyais-cost-usd 헤더로 해당 요청의 서비스 가격(USD)이 포함됩니다. 에이전트 예산 가드에 사용하세요.
  • Idempotency-Key — POST 요청에 Idempotency-Key 헤더를 보내면 재시도 시 중복 호출·중복 과금을 방지합니다(24h, 비스트림 한정). 재생된 응답에는 Idempotent-Replayed: true 헤더가 붙습니다.
  • usage 세부 토큰 — 프로바이더가 제공할 경우 usage.prompt_tokens_details.cached_tokens (캐시 적중) 및 cache_creation_tokens (캐시 생성) 가 포함됩니다.
  • Prompt caching — Claude 계열 모델은 prompt caching 을 지원합니다. Anthropic /v1/messagescache_control breakpoint 는 그대로 전달되며, 별도 설정 없이도 게이트웨이가 시스템·도구·직전 메시지에 자동으로 캐시 breakpoint 를 부착해 반복 컨텍스트 비용을 절감합니다. 캐시 read/write 토큰은 공급자 단가에 맞춰 분해 청구됩니다.
  • per-key 예산 · 스코프 — 대시보드에서 API 키별 월/일 지출 한도(USD)와 허용 엔드포인트 스코프(chat·images·video·models:read)를 설정할 수 있습니다. 한도 초과 시 402, 스코프 밖 호출 시 403 을 반환합니다. (스코프를 모두 비우면 전체 허용)
  • 긴 응답/v1/chat/completions·/v1/messages 스트리밍과 /v1/responses 는 최대 5분까지 처리됩니다. 그 외 비스트리밍 요청은 30초 한도이므로 긴 생성은 stream: true 를 사용하세요.
  • 제약n 은 1 만 지원합니다(2 이상은 400). /v1/moderations 는 미지원(501)입니다.

모델 카탈로그

전체 목록은 GET /v1/models 로도 조회할 수 있습니다 (인증 필요). 단가 전체는 가격 페이지에서 확인하세요.

모델 ID타입출시일컨텍스트단가
everyais/n/nemotron-3-nano-omnichat2026-07-258,000입력 $0.078 · 출력 $0.312 /1M
everyais/n/cosmos3-super-reasonerchat2026-07-25262,144입력 $0.13 · 출력 $0.39 /1M
everyais/n/hermes-4-405bchat2026-07-25131,072입력 $1.3 · 출력 $3.9 /1M
everyais/n/hermes-4-70bchat2026-07-25131,072입력 $0.169 · 출력 $0.52 /1M
everyais/n/gemma-3-27b-itchat2026-07-25110,000입력 $0.13 · 출력 $0.39 /1M
everyais/n/glm-5-2chat2026-07-25432,000입력 $1.82 · 출력 $5.72 /1M
everyais/n/deepseek-v4-prochat2026-07-251,048,576입력 $2.275 · 출력 $4.55 /1M
everyais/n/minimax-m3chat2026-07-258,000입력 $0.39 · 출력 $1.56 /1M
everyais/n/kimi-k2-7-codechat2026-07-25262,144입력 $1.235 · 출력 $5.2 /1M
everyais/n/nemotron-3-ultra-550b-a55bchat2026-07-25262,144입력 $1.3 · 출력 $3.9 /1M
everyais/n/kimi-k2-6chat2026-07-25262,144입력 $1.235 · 출력 $5.2 /1M
everyais/n/qwen3-5-397b-a17bchat2026-07-25262,144입력 $0.78 · 출력 $4.68 /1M
everyais/g/gemini-3-1-flash-lite-imageimage2026-06-308,192입력 $0.325 · 출력 $39 /1M
everyais/g/gemini-omni-flash-previewvideo2026-06-308,192$0.1318 /초
everyais/claude-fable-5chat2026-06-098,192입력 $11.7 · 출력 $58.5 /1M
everyais/claude-opus-4-8chat2026-05-288,192입력 $5.85 · 출력 $29.25 /1M
everyais/g/gemini-3-1-flash-imageimage2026-05-288,192입력 $0.65 · 출력 $78 /1M
everyais/g/gemini-3-5-flash-litechat2026-05-198,192입력 $0.39 · 출력 $3.25 /1M
everyais/g/gemini-3-5-flashchat2026-05-198,192입력 $1.95 · 출력 $11.7 /1M
everyais/g/gemini-3-1-flash-litechat2026-05-078,192입력 $0.325 · 출력 $1.95 /1M
everyais/g/gemini-3-1-pro-previewchat2026-02-198,192입력 $2.6 · 출력 $15.6 /1M
everyais/g/gemini-3-pro-imageimage2025-11-208,192입력 $2.6 · 출력 $156 /1M
everyais/claude-haiku-4-5chat2025-10-158,192입력 $1.17 · 출력 $5.85 /1M
everyais/g/veo-3-1-fast-generate-001video2025-10-158,192$0.13 /초 (4k-with-audio $0.39/초 · 1080p-with-audio $0.156/초 · 720p-with-audio $0.13/초)
everyais/g/veo-3-1-generate-001video2025-10-158,192$0.52 /초 (1080p-with-audio $0.52/초 · 4k-with-audio $0.78/초 · 720p-with-audio $0.52/초)
everyais/g/gemini-2-5-prochat2025-06-178,192입력 $1.625 · 출력 $13 /1M
everyais/g/gemini-3-6-flashchat-8,192입력 $1.95 · 출력 $9.75 /1M