
⚡ 한 줄 요약: 같은 작업이라도 어느 모델·어느 회사에서 돌리느냐에 따라 비용이 몇 배씩 갈리는 지금, 주요 AI 서비스의 최신 가격을 한 표에 모아 비교합니다.
📑 목차
💡 왜 지금 가격을 비교하나
불과 얼마 전까지 AI API 선택지는 GPT·클로드·제미나이 정도로 좁았습니다.
지금은 여기에 중국(딥시크·큐원·GLM·Kimi)과 유럽(미스트랄), 그리고 오픈웨이트 진영까지 가세하면서 고를 수 있는 모델이 폭발적으로 늘었습니다.
문제는 성능이 비슷해 보이는 모델들 사이에서도 토큰당 단가는 큰 폭으로 벌어진다는 점입니다.
결국 "같은 작업을 어디서 돌리느냐"가 매달 청구서를 좌우하기 때문에, 주기적으로 가격을 비교해 둘 필요가 있습니다.
💰 API 토큰 가격 비교
아래 표는 각 회사 대표 모델의 API 토큰 단가를 정리한 것입니다.
플래그십과 경량 모델을 함께 담았습니다.
| 기업 | 모델 | 입력 $/1M | 출력 $/1M | 비고 |
|---|---|---|---|---|
| OpenAI 미국 |
GPT-5.5 | $5 | $30 | 캐시입력 $0.50·배치 -50% |
| OpenAI 미국 |
GPT-5.4 Nano (경량) | $0.2 | $1.25 | 캐시입력 $0.02 (Mini는 $0.75/$4.50) |
| Anthropic 미국 |
Claude Opus 4.8 | $5 | $25 | 캐시읽기 ~1/10·배치 -50% |
| Anthropic 미국 |
Claude Sonnet 5 (중급) | $3 | $15 | 도입가 $2/$10 (8/31까지) |
| Anthropic 미국 |
Claude Haiku 4.5 (경량) | $1 | $5 | 캐시읽기 ~1/10 |
| Google 미국 |
Gemini 2.5 Pro | $1.25 | $10 | >20만 토큰 구간 $2.50/$15 |
| Google 미국 |
Gemini 2.5 Flash (경량) | $0.3 | $2.5 | 배치 -50% |
| xAI 미국 |
Grok 4.3 | $1.25 | $2.5 | 1M 컨텍스트 |
| DeepSeek 중국 |
DeepSeek-V4 Pro (추론) | $0.435 | $0.87 | 캐시히트 입력 $0.004 |
| DeepSeek 중국 |
DeepSeek-V4 Flash (기본) | $0.14 | $0.28 | 캐시히트 입력 $0.003 |
| Alibaba Qwen 중국 |
Qwen-Max | $2.5 | $7.5 | 배치 -50% (국제 엔드포인트 USD) |
| Alibaba Qwen 중국 |
Qwen-Turbo (경량) | $0.05 | $0.2 | Plus 등급 $0.4/$1.6 |
| Zhipu (Z.ai) 중국 |
GLM-4.6 | $0.6 | $2.2 | 캐시히트 입력 $0.11 (최신 5.2=$1.4/$4.4) |
| Zhipu (Z.ai) 중국 |
GLM-4.5-Air (경량) | $0.2 | $1.1 | Flash 등급은 무료 |
| Moonshot (Kimi) 중국 |
Kimi K2.6 | $0.95 | $4 | 캐시히트 입력 $0.16 |
| Moonshot (Kimi) 중국 |
moonshot-v1-8k (경량) | $0.2 | $2 | |
| Mistral 유럽 |
Mistral Large 3 | $0.5 | $1.5 | 배치 -50% (구 Large 2는 $2/$6) |
| Mistral 유럽 |
Mistral Small 4 (경량) | $0.15 | $0.6 | Ministral 3=$0.10/$0.10 |
| Meta Llama 오픈소스 |
Llama 4 Maverick | $0.27 | $0.85 | 오픈웨이트·호스팅사별(Together 기준) |
| Meta Llama 오픈소스 |
Llama 3.3 70B (경량) | $1.04 | $1.04 | 오픈웨이트·호스팅사별 |
기준일 2026-07-05 · 통화 USD · 캐시·배치 할인 별도
'입력'은 우리가 모델에 밀어 넣는 프롬프트, '출력'은 모델이 생성해 돌려주는 답변에 매겨지는 요금입니다.
단위인 $/1M은 '토큰 100만 개당 달러'라는 뜻으로, 보통 영어 기준 100만 토큰은 대략 책 몇 권 분량의 텍스트에 해당합니다.
실제 청구액은 입력·출력 토큰 수에 각각의 단가를 곱해 합산되므로, 답변이 길어질수록 출력 단가의 영향이 커집니다.
📱 소비자 구독료 비교
API 대신 웹·앱에서 바로 쓰는 월정액 요금제는 다음과 같습니다.
| 서비스 | 요금제 | 월 요금 | 비고 |
|---|---|---|---|
| ChatGPT | Plus | $20/월 | 무료 등급 있음 |
| ChatGPT | Pro | $200/월 | 최상위(20x) |
| Claude | Pro | $20/월 | 연간결제 시 $17 |
| Claude | Max | $100/월 | Max 5x (20x는 $200) |
| Google Gemini | Google AI Pro | $19.99/월 | 구 Gemini Advanced |
| Google Gemini | Google AI Ultra | $200/월 | 20x (엔트리 $100) |
| xAI Grok | SuperGrok | $30/월 | 무료 등급 있음 |
| Mistral | Le Chat Pro | $14.99/월 | 무료 등급 있음 |
| DeepSeek | 소비자 앱 | 무료 | 무료 (API만 유료) |
API는 쓴 만큼만 내는 종량제라 사용량이 들쭉날쭉하거나 적은 사람에게 유리하고, 월정액은 매일 꾸준히 채팅하듯 쓰는 사람에게 예측 가능하고 이득입니다.
가볍게 써 볼 생각이라면 무료 등급으로 시작해 보고, 유료 구독 중에서는 Mistral Le Chat Pro($14.99/월)가 가장 문턱이 낮습니다.
반대로 대량 자동화·서비스 연동이 목적이라면 구독보다 API 쪽을 들여다보는 편이 맞습니다.
🧭 그래서 뭘 골라야 하나
- 대량 배치·비용 최우선: 전체 최저가 축인 Alibaba Qwen Qwen-Turbo를 기본 후보로 두세요. 단가 절감 폭이 가장 큽니다.
- 저렴하면서도 추론이 필요할 때: 플래그십 중 출력 기준 가장 저렴한 DeepSeek DeepSeek-V4 Pro(출력 $0.87/1M)가 가격 대비 만족도가 높은 편입니다.
- 코딩 품질·복잡한 추론 최우선: 비용보다 결과가 중요하다면 플래그십 최고가인 OpenAI GPT-5.5(출력 $30/1M)나 상위 클로드 등 검증된 대형 모델을 씁니다.
- 입력이 길고 출력이 짧은 작업(요약·분류·추출): 출력 단가가 낮은 경량 모델로 충분한 경우가 많으니 무리해서 플래그십을 쓸 필요가 없습니다.
- 실전 팁: 라우팅을 두어 쉬운 요청은 저가 경량 모델로, 어려운 요청만 플래그십으로 보내면 품질과 비용을 동시에 잡을 수 있습니다.
🔄 가격은 계속 바뀐다
이 표는 매주 각 회사의 공식 가격 페이지를 기준으로 갱신합니다.
다만 실제 청구액은 캐시 적중 여부, 배치 처리 할인, 컨텍스트 길이 구간 등에 따라 표의 기본 단가와 달라질 수 있습니다.
중요한 의사결정이나 예산 산정 전에는 반드시 해당 서비스의 공식 페이지에서 최신 가격을 다시 확인하시길 권합니다.
📅 가격 기준일: 2026-07-05 · 통화: USD. 실제 청구는 캐시·배치·컨텍스트 길이에 따라 달라질 수 있습니다.
참고(출처)
- OpenAI 공식 API 가격
- Anthropic(Claude) 공식 가격
- Google Gemini API 가격
- xAI Grok 모델·가격
- DeepSeek API 가격
- Alibaba Qwen(Model Studio) 가격
- Zhipu Z.ai 가격
- Moonshot Kimi 가격
- Mistral API 가격
- Together.ai(오픈모델 호스팅) 가격
🔗 이어서 읽기
'AI·테크 브리핑' 카테고리의 다른 글
| 미래대응기금 신설, 개발자가 챙길 3가지 (0) | 2026.07.06 |
|---|---|
| 미스트랄AI란? 개발자용 오픈웨이트 LLM 정리 (0) | 2026.07.05 |
| 미스트랄AI, 개발자가 주목할 오픈소스 강자 (1) | 2026.07.05 |
| 웍스AI 쓰기 전 알아둘 AI 용어 10개 (0) | 2026.07.04 |
| AI 용어 정리 개발자가 헷갈리는 5쌍 (0) | 2026.07.04 |