Kimi K3

moonshotai/kimi-k3

Kimi K3는 코드, 지식 작업, 장기 에이전트를 위한 Moonshot AI의 공개 가중치 멀티모달 모델입니다. 저장소, 이미지, 로그, 실행 피드백에 따른 반복 작업을 강조합니다.

입력 · 크레딧 요금
$3.00

100만 토큰당

실결제 환산 $0.30

출력 · 크레딧 요금
$15.00

100만 토큰당

실결제 환산 $1.50

컨텍스트 윈도
1,048,576

tokens · OpenRouter

입력 → 출력
텍스트 · 이미지 · 동영상→ 텍스트
모델 사양
출처 확인일: Y-API 요금 스냅샷:

모델 선택 안내

Y-API의 선택 가이드입니다. 아래 확인 방법은 평가 제안이며, 이미 측정한 결과가 아닙니다.

먼저 평가할 작업

실패 분석, 패치, 테스트, 재수정의 실제 루프로 평가하세요. 계획 길이보다 완료한 요구사항과 의도하지 않은 변경을 측정합니다.

주의할 점

도구, 상태, 실행 제한은 에이전트 환경이 제공합니다. 모델 지정만으로 생기지 않으며 긴 이력을 재전송하는 비용도 계산해야 합니다.

모델 사양

OpenRouter의 모델 수준 사양으로, Y-API 호환성 테스트 결과가 아닙니다. 경로에 따라 입력 형식, 매개변수, 토큰 한도가 더 제한될 수 있습니다. 작은 요청으로 필요한 기능을 확인하세요. 텍스트 응답 성공만으로 이미지 인식이나 도구 호출을 검증할 수 없습니다.

컨텍스트 윈도
1,048,576 tokens
입력
텍스트 · 이미지 · 동영상
출력
텍스트
OpenRouter 등록일
OpenRouter에 기재된 매개변수
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
OpenRouter 모델 페이지와 사양

비용 계산

예상 사용 크레딧
US$10.50
예상 실결제 환산액
US$1.05

예시 토큰 예산이며 실측 사용량이나 견적 보장이 아닙니다. 입출력은 포함하지만 별도 미디어 요금, 캐시 할인, 재시도는 제외합니다. 과금되는 추론 토큰도 출력 예산에 포함하세요. 실제 과금은 서비스가 반환하는 사용량에 따릅니다.

$1 결제로 $10 크레딧을 받습니다. 실결제 환산액 = 사용 크레딧 ÷ 10이며, 모델 개발사의 공식 요금이 아닙니다.

동일 토큰 예산으로 비교
모델예상 사용 크레딧예상 실결제 환산액
Kimi K3US$10.50US$1.05
Kimi K2.6US$2.95US$0.295
Claude Opus 5US$17.50US$1.75

API 사용

정확한 Y-API 모델 ID를 사용하는 최소 텍스트 요청입니다. 이미지, 오디오, 동영상, 파일, 도구 지원을 검증하는 예시는 아닙니다. 출력 한도에는 추론 공간도 필요합니다. 본문이 비고 finish_reason=length라면 예산 소진을 확인하세요.

먼저 해볼 작업

대용량 내보내기에서만 API가 시간 초과됩니다. 데이터를 바꾸지 않고 SQL, 직렬화, 프록시를 구별하는 조사를 설계하세요.

콘솔의 키를 환경 변수 TOKEN에 설정해 로컬이나 서버에서 실행하세요. 브라우저 코드나 공개 저장소에 키를 넣지 마세요.

cURL · Kimi K3
curl --fail-with-body --silent --show-error --max-time 120 \
  'https://api.y-api.bestvirtualgoods.com/v1/chat/completions' \
  -H "Authorization: Bearer ${TOKEN:?Set TOKEN first}" \
  -H 'Content-Type: application/json' \
  --data-binary @- <<'JSON'
{
  "model": "moonshotai/kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "대용량 내보내기에서만 API가 시간 초과됩니다. 데이터를 바꾸지 않고 SQL, 직렬화, 프록시를 구별하는 조사를 설계하세요."
    }
  ],
  "max_tokens": 4096
}
JSON

결과 평가 방법

각 단계의 독립 측정과 안전한 순서가 필요합니다. 도구 결과를 다음 판단에 반영하는지도 확인하세요.

선택 전 확인

K3 호출이 여러 에이전트를 시작하나요?

아닙니다. 병렬 에이전트는 앱이나 클라이언트의 오케스트레이션이 필요합니다. 권한, 예산, 종료 조건을 따로 설정하세요.

출처와 적용 범위

기술 정보는 명시된 모델 페이지와 연결된 개발사 카드에 근거합니다. 카드는 해당 체크포인트를 설명하며, 게이트웨이가 실제로 제공하는 가중치의 증거는 아닙니다. 요금은 Y-API 목록에서만 가져옵니다. 이 엔드포인트의 실측 지연, 가동률, 벤치마크 점수는 제시하지 않습니다.