스레드
이온디

AI API 를 실제로 붙여 쓰다 보면 모델 성능보다 토큰 단가가 먼저 발목을 잡습니다. 주요 5개 공급사(Anthropic Claude, OpenAI, Google Gemini, xAI Grok, DeepSeek)의 API 단가를 2026년 7월 기준으로 한 표에 모았습니다.

순위는 입력:출력 = 3:1 혼합 단가 기준입니다. 코딩이나 에이전트처럼 읽는 양이 쓰는 양보다 많은 실제 워크로드에 가까운 비율입니다. 단위는 모두 100만 토큰당 USD.

결론부터

표를 다 읽기 전에 결론만 필요하다면 이렇게 정리됩니다.

대량·단순 작업의 실질 최저가는 Gemini 2.5 Flash-Lite 입니다. 표에서는 DeepSeek V4-Flash 와 공동 1위($0.18)지만, DeepSeek 은 한국 업무시간에 요금이 2배($0.35)가 되기 때문입니다.

야간 배치로 돌릴 수 있다면 DeepSeek V4-Flash 가 가장 쌉니다. 오프피크 $0.18 에 캐시 히트 시 입력이 50배까지 떨어집니다.

가성비 구간의 승자는 지금 Claude Sonnet 5 입니다. 8월 31일까지 프로모션가 $4.00 로, 동급인 Gemini 3.1 Pro($4.50)·GPT-5.6 Terra($5.63)보다 쌉니다. 기간 한정이라는 점만 감안하면 됩니다.

어려운 작업은 Claude Opus 5 가 유리합니다. 최상위 구간에서 GPT-5.6 Sol($11.25)보다 싸고($10.00), 장문 할증이 없어 긴 컨텍스트에서 격차가 더 벌어집니다.

다만 이 순위 자체보다 중요한 게 있습니다. 캐시와 배치 할인의 절감 폭이 모델을 갈아타는 것보다 훨씬 큽니다. 그리고 어려운 작업에 싼 모델을 쓰면 재작업 왕복 때문에 총비용이 오히려 늘어납니다. 아래에서 하나씩 봅니다.

한눈에 보는 단가 순위

# 모델 공급사 입력 출력 혼합(3:1) 1V4-FlashDeepSeek$0.14$0.28$0.18 1Gemini 2.5 Flash-LiteGemini$0.10$0.40$0.18 3Chat V3.2DeepSeek$0.28$0.42$0.32 4GPT-5.4 nanoOpenAI$0.20$1.25$0.46 5V4-ProDeepSeek$0.435$0.87$0.54 6R1DeepSeek$0.55$2.19$0.96 7grok-code-fast-1Grok$1.00$2.00$1.25 8Grok 4.3Grok$1.25$2.50$1.56 9Haiku 4.5Claude$1.00$5.00$2.00 10GPT-5.6 LunaOpenAI$1.00$6.00$2.25 11Gemini 3.6 FlashGemini$1.50$7.50$3.00 11Grok 4.5Grok$2.00$6.00$3.00 13Gemini 3.5 FlashGemini$1.50$9.00$3.38 14Sonnet 5 (프로모션)Claude$2.00$10.00$4.00 15Gemini 3.1 ProGemini$2.00$12.00$4.50 16GPT-5.6 TerraOpenAI$2.50$15.00$5.63 17Sonnet 5 (정가)Claude$3.00$15.00$6.00 18Opus 5Claude$5.00$25.00$10.00 19GPT-5.6 Sol / 5.5OpenAI$5.00$30.00$11.25 20Fable 5Claude$10.00$50.00$20.00

공급사별 최저가 모델만 뽑으면 이렇게 정리됩니다.

DeepSeek($0.18) = Gemini($0.18) < OpenAI($0.46) < Grok($1.25) < Claude($2.00)

DeepSeek 은 시간대에 따라 가격이 2배가 됩니다

표에서 가장 싼 DeepSeek 에는 함정이 하나 있습니다. 2026년 7월 중순부터 피크/오프피크 요금제가 적용돼, 피크 시간에는 모든 과금 항목이 정가의 2배가 됩니다.

DeepSeek 이 공지한 피크 시간은 UTC 기준 01:00~04:00, 06:00~10:00 입니다. 한국 시간(KST)으로 바꾸면 이렇게 됩니다.

UTC 한국 시간(KST) 01:00 ~ 04:0010:00 ~ 13:00 06:00 ~ 10:0015:00 ~ 19:00

하필 한국의 업무시간과 정확히 겹칩니다. 오전 10시부터 오후 7시 사이에 일하면서 API 를 호출하면, 하루 중 상당 시간을 2배 요금으로 쓰게 된다는 뜻입니다. 피크 기준으로 다시 계산하면 V4-Flash 의 혼합 단가는 $0.18 에서 $0.35 로 올라가고, 순위도 Gemini 2.5 Flash-Lite($0.18)에게 1위를 내줍니다.

배치성 작업이라면 밤에 돌리는 것만으로 요금이 절반이 됩니다. 반대로 실시간 응답이 필요한 서비스라면 DeepSeek 의 표시가를 그대로 믿으면 안 됩니다.

표시가보다 중요한 것 세 가지

1. 배치와 캐시 할인이 모델 선택보다 큽니다

대부분의 공급사가 배치 API 50% 할인을 제공하고, 프롬프트 캐시는 최대 90% 까지 입력 비용을 줄여줍니다. DeepSeek V4-Flash 는 캐시 히트 시 입력이 $0.0028 까지 떨어져 50배 차이가 납니다.

같은 시스템 프롬프트를 반복해서 보내는 구조라면, 더 싼 모델로 갈아타는 것보다 캐시를 제대로 태우는 쪽이 절감 폭이 훨씬 큽니다.

2. 긴 컨텍스트는 할증이 붙습니다

Grok 은 프롬프트가 20만 토큰을 넘으면 전 요금이 2배가 됩니다. OpenAI 는 약 27만2천 토큰을 넘으면 입력 2배, 출력 1.5배입니다. 긴 문서를 통째로 넣는 방식이라면 표시가와 실제 청구액이 크게 벌어집니다. Claude 는 100만 토큰 컨텍스트에 별도 장문 할증이 없습니다.

3. 출력 단가가 비싼 모델은 뒤집힙니다

Gemini Flash 계열은 출력 단가가 입력의 5~6배입니다. 짧게 묻고 길게 답하는 용도(문서 생성, 번역, 코드 작성)에서는 입력 단가만 보고 고르면 손해입니다. 반대로 검색이나 분류처럼 긴 입력에 짧은 답을 내는 작업이라면 유리합니다.

그래서 어떻게 고르면 되나

  • 분류, 추출, 요약 등 판단이 거의 없는 대량 작업 - DeepSeek V4-Flash 나 Gemini 2.5 Flash-Lite. 단, DeepSeek 은 오프피크에 돌릴 수 있을 때.
  • 일반적인 기능 구현, 정해진 패턴의 코드 작성 - Claude Haiku 4.5, Grok 4.3, GPT-5.6 Luna 대역.
  • 원인 모를 버그 조사, 설계 판단, 전략 수립 - Claude Opus 5 나 GPT-5.6 Sol 대역. 여기서 싼 모델을 쓰면 재작업 왕복이 늘어 오히려 총비용이 커집니다.

가장 흔한 실수는 비용을 아끼려고 어려운 작업에 싼 모델을 쓰는 것입니다. 판단이 필요한 일에 저가 모델을 넣으면 결과가 부족해 다시 시키게 되고, 그 왕복 비용이 모델 단가 차이를 금방 넘어섭니다. 아껴야 한다면 모델을 내리는 게 아니라 그 작업 자체를 더 싼 파이프라인으로 옮기는 것이 맞습니다.

참고

기준일은 2026년 7월 28일입니다. AI API 가격은 자주 바뀌고 프로모션도 잦으니, 실제 결제 전에는 각 공급사 공식 가격 페이지를 확인하시기 바랍니다. Claude 수치는 Anthropic 공식 문서로 교차 검증했고, 나머지는 가격 집계 사이트와 각사 공지를 기준으로 정리했습니다. DeepSeek 피크 요금제 내용은 DeepSeek 콘솔 공지 원문을 따랐습니다.

Claude Sonnet 5 의 $2.00 / $10.00 은 2026년 8월 31일까지 적용되는 프로모션 가격이며, 이후 정가 $3.00 / $15.00 으로 돌아갑니다.

0 좋아요 0 답글 10 조회