문샷 AI 키미 K3(Kimi K3) 2.8조 파라미터 오픈 예정 모델의 스펙, API 모델명 kimi-k3, reasoning_effort, 캐시 히트·미스·출력 토큰 단가, 장시간 코딩 에이전트 한계를 공식 문서 기준으로 정리한다. 개발자 LLM·AI 코딩 도구·오픈소스 가중치 선택과 클로드·코파일럿 분기, 보안 체크까지 한 글에 담았다.
2026년 7월 16일 문샷 AI(Moonshot AI)가 키미 K3(Kimi K3)를 공개했다. 파라미터 2.8조(2.8T), 컨텍스트 100만 토큰, 네이티브 비전. 회사 표현으로는 3조 파라미터급 오픈 모델 중 첫 사례다. 전체 가중치 공개 목표는 7월 27일이다.
지금 당장 쓸 수 있는 경로는 키미 웹·앱, 키미 코드(Kimi Code), API 모델명 kimi-k3다. 아래는 스펙 표, API 호출, 가격 감각, 코딩 에이전트로 쓸 때 주의점, 클로드·오픈AI 대비 분기만 정리한다. “써 보니 최고” 같은 체감 평가는 빼고, 공식 문서·기술 블로그에 적힌 숫자와 제약만 따른다.
키미 K3가 뭔지 | 2.8T · 1M 컨텍스트 · 오픈 예정
키미 K3는 베이징 기반 문샷 AI의 플래그십 모델이다. 공식 기술 블로그·플랫폼 문서 기준으로 고정할 수 있는 항목은 아래 표다.
항목
공식 발표 기준
규모
2.8조 파라미터 · MoE(896 전문가 중 16 활성)
컨텍스트
100만 토큰 · 컨텍스트 캐시 자동
멀티모달
네이티브 비전(이미지·영상 입력 지원 문서화)
초점
장시간 코딩 · 지식 업무 · 추론
가중치
2026-07-27까지 전체 가중치 공개 예정(발표 시점 기준)
아키텍처 키워드
Kimi Delta Attention(KDA) · Attention Residuals · Stable LatentMoE
회사 스스로도 “전체 성능은 가장 강한 폐쇄 모델(클로드 페이블 5·GPT-5.6 솔 등)에 아직 못 미친다”고 적었다. 오픈 3T급 스케일과 코딩·에이전트 벤치에서 앞선 지점이 차별 포인트다. 이전 오픈웨이트 계열 맥락: 코파일럿 앱·키미 K2.7 선택.
키미 K3 | 2.8T 오픈 예정 플래그십 · 장시간 코딩·1M 컨텍스트가 공식 메시지
API로 호출하기 | 모델명 kimi-k3 · OpenAI SDK
플랫폼 문서 기준 base URL은 https://api.moonshot.ai/v1, 모델 문자열은 kimi-k3다. OpenAI 호환 SDK로 붙는다. 플래그십이라 최소 충전(문서상 $1) 후 잠금이 풀리는 계정 정책이 있다. 레이트리밋·티어는 누적 충전액에 연동된다.
추론(thinking)은 항상 켜져 있다. 끌 수는 없고, reasoning_effort로 low / high / max(기본 max)만 조절한다. 스트리밍 시 reasoning_content와 최종 content가 분리된다. 멀티턴·툴 호출에서는 assistant 메시지를 잘라 버리지 말고 통째로 다음 요청에 넣어야 한다.
키미 K3 기본 호출 (Python · OpenAI SDK)
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["MOONSHOT_API_KEY"],
base_url="https://api.moonshot.ai/v1",
)
completion = client.chat.completions.create(
model="kimi-k3",
reasoning_effort="max", # low | high | max
messages=[
{"role": "user", "content": "이 레포의 실패 테스트 원인 후보 3가지만 짧게."}
],
)
print(completion.choices[0].message.content)
비전 입력은 content를 문자열로 직렬화하면 안 되고, 객체 배열로 넣는다. 공개 이미지 URL은 지원하지 않고 base64 또는 업로드 파일 ms://<file-id> 형태다. 웹 검색 공식 툴은 문서상 “업데이트 중·당분간 프로덕션 비권장”이다. 에이전트 도구는 Formula 엔드포인트 연동 패턴이 별도 가이드로 있다.