2026년 09월 27일 Stories worth reading. Perspectives worth sharing.
가장 저렴한 AI API 모델은? 100만 토큰당 가격 비교
AI 도구 활용

가장 저렴한 AI API 모델은? 100만 토큰당 가격 비교

Caston 7월 4, 2026 1 min read

AI를 서비스에 붙여 놓으면 어느 순간 요금이 사람 월급처럼 나가기 시작한다. 사용자가 늘어서가 아니라, 호출 한 번에 얼마인지를 모르고 시작했기 때문인 경우가 많다. 나도 무료 모델만 쓰던 기간에 크레딧이 11달러 빠져나간 걸 뒤늦게 알았다.

모델 가격은 공개돼 있고 차이도 크다. 가장 싼 모델과 가장 비싼 모델의 차이가 500배가 넘는다. 그 차이가 어디서 나오는지 보면 어느 일에 무엇을 붙일지가 정해진다.

입력과 출력 가격이 다른 이유

AI 요금은 토큰 단위로 매긴다. 토큰은 글을 잘게 자른 조각이다. 영어는 단어 하나가 보통 한두 토큰, 한국어는 한 글자가 한 토큰 안팎이다. 100만 토큰이면 한국어로 대략 책 세 권 분량이다.

가격표를 보면 값이 두 개 적혀 있다. 앞이 입력, 뒤가 출력이다. 입력은 내가 모델에게 보낸 글, 출력은 모델이 만들어낸 글이다. 출력이 보통 3배에서 10배 비싸다. 글을 읽는 것보다 만드는 데 계산이 훨씬 많이 들기 때문이다.

이 구조 때문에 비용 계산이 직관과 어긋날 때가 있다. 긴 문서를 통째로 넣고 짧은 답을 받는 일이라면 입력 가격이 중요하고, 짧게 묻고 긴 글을 받는 일이라면 출력 가격이 전부를 좌우한다. 같은 모델을 쓰는 두 서비스의 월 요금이 열 배 차이 나는 이유가 여기 있다.

가장 싼 모델들

아래는 이 블로그의 모델 비교표 기준으로 입력과 출력 합이 가장 낮은 모델들이다. 원본은 OpenRouter가 공개하는 모델 목록이며 매주 일요일 자동으로 갱신한다.

모델제공사입력출력컨텍스트오픈 가중치
Mistral NemoMistral$0.019$0.0313만예
Qwen3.7 FlashAlibaba$0.03$0.13100만아니요
Nemotron 3.5 LightningNVIDIA$0.08$0.2100만예
DeepSeek V4.1 FlashDeepSeek$0.035$0.29105만예
Llama 4 ScoutMeta$0.1$0.3131만예
GLM 5.3 FlashZ.AI$0.04$0.5131만예
GPT-6 LunaOpenAI$0.1$0.5105만아니요
100만 토큰당 가격이 낮은 모델. 2026-09-27 기준

맨 위 Mistral Nemo는 입력 100만 토큰에 2센트다. 다만 컨텍스트가 13만으로 목록에서 가장 작다. 컨텍스트는 한 번에 읽을 수 있는 글의 총량인데, 긴 문서를 통째로 넣는 일에는 부족할 수 있다.

같은 저가 구간에서도 성격이 갈린다. Qwen3.7 Flash는 출력이 $0.13으로 매우 낮아 답을 길게 받는 일에 유리하다. GLM 5.3 Flash는 입력이 $0.04로 싼 대신 출력이 $0.5라, 긴 문서를 읽히고 짧게 요약받는 쪽에 맞는다. 같은 작업이라도 어느 쪽에 글이 몰리느냐에 따라 유리한 모델이 달라진다.

비교를 위해 비싼 쪽을 보면 차이가 분명해진다. GPT-6 Astra와 Claude Fable 5.1은 입력 $10, 출력 $50이다. Mistral Nemo 대비 입력은 526배, 출력은 1,667배다.

싼 모델이 성능도 바닥인 것은 아니다. Artificial Analysis처럼 모델을 같은 조건에서 재는 곳의 자료를 보면, 최상위 모델과 중급 모델의 종합 점수 차이는 가격 차이만큼 벌어지지 않는다. 가격은 수백 배 차이인데 점수는 두 배가 안 되는 구간이 있다.

가격표에 없는 비용

표에 적힌 숫자만으로 월 요금이 정해지지 않는다. 내가 실제로 겪은 것 세 가지가 있다.

첫째는 조용한 대체다. 서비스가 무료 모델을 쓰도록 설정해뒀는데, 그 모델이 잠깐 장애가 나자 유료 모델로 자동으로 넘어갔다. 실패하지 않고 넘어가니 알림도 없었다. 한 달 뒤 크레딧이 줄어든 걸 보고서야 알았다. 자동 선택 기능을 쓸 때는 대체 모델을 직접 지정해두는 편이 안전하다.

둘째는 무료 티어의 소멸이다. 2026년 들어서만 여러 회사의 무료 개발자 등급이 종료되거나 기간 한정으로 바뀌었다. 무료라는 이유로 고른 모델은 예고 없이 사라질 수 있다.

셋째는 모델 이름 뒤에 붙는 꼬리표다. 같은 모델이라도 배치 처리용은 절반 가격인 경우가 많다. 즉시 답이 필요 없는 작업, 예를 들어 밤사이 문서를 분류하는 일이라면 이쪽을 쓰면 비용이 절반이 된다.

오픈 가중치라는 선택지

표의 마지막 칸에 있는 오픈 가중치는 모델 파일이 공개돼 있다는 뜻이다. 회사 서버를 거치지 않고 내 컴퓨터나 내 서버에 직접 올려 돌릴 수 있다.

저가 구간에서는 오픈 가중치 모델의 비중이 높다. 위 표 7개 중 5개가 여기 해당한다. 직접 돌리면 호출 요금이 0이 되지만, 대신 그래픽카드와 전기요금이 든다. 손익분기는 생각보다 높은 편이라 하루 수천 번 이상 호출하는 규모가 아니면 API 쪽이 싼 경우가 많다.

그래도 파일이 공개돼 있다는 사실 자체가 안전장치가 된다. 회사가 모델을 내리거나 가격을 올려도 쓰던 것을 계속 쓸 수 있다. 데이터를 밖으로 내보낼 수 없는 환경이라면 선택지가 이쪽뿐이기도 하다.

고를 때 따져볼 것

가격표를 보기 전에 내 작업이 입력이 긴지 출력이 긴지부터 정한다. 문서 요약이나 분류처럼 읽는 양이 많은 일은 입력 가격을, 글 생성이나 코드 작성처럼 만드는 양이 많은 일은 출력 가격을 기준으로 삼는다.

그 다음 월 호출량을 어림잡는다. 하루 1,000번, 회당 입력 5천 토큰에 출력 1천 토큰이면 한 달에 입력 1억 5천만, 출력 3천만 토큰이다. Mistral Nemo로는 월 3.8달러, GPT-6 Luna로는 30달러, Claude Fable 5.1로는 3,000달러다.

계산이 끝나면 실제로 얼마가 나갔는지 확인할 방법을 먼저 만들어둔다. 대시보드를 한 달에 한 번 보는 것만으로도 조용한 대체 같은 문제를 초기에 잡는다. 나는 이걸 안 해서 한 달치를 놓쳤다.

싼 모델로 시작해서 품질이 부족한 지점에서만 비싼 모델로 올리는 순서가 안전하다. 반대로 하면 비용을 먼저 치르고 나중에 그 돈이 필요했는지 확인하게 된다.

함께 읽기

2 Comments

  1. […] 가장 저렴한 AI API 모델은? 100만 토큰당 가격 비교 […]

    답글
  2. […] 가장 저렴한 AI API 모델은? 100만 토큰당 가격 비교 […]

    답글

Leave a Comment