제미나이 3.8 플래시 값이 연말까지 반값이라는데, 1월부터 얼마가 되나 — 도입가 만료 뒤 청구액 계산

구글이 2026년 9월 2일 내놓은 제미나이 3.8 플래시의 API 가격표에는 다른 모델에 없는 문장이 붙어 있습니다. “12월 31일까지 100만 토큰당 입력 0.75달러·출력 3.75달러, 2027년 1월 1일부터 1.50달러·7.50달러.” 넉 달짜리 도입가이고, 해가 바뀌면 정확히 두 배가 됩니다. 이 글은 3.8 플래시가 어떤 모델인지, 도입가가 끝난 뒤 청구액이 어떻게 달라지는지, 그리고 지금 이 모델로 파이프라인을 짜도 되는지를 공식 문서 기준으로 정리합니다. 수치는 2026년 9월 6일 기준입니다.

3.8 플래시는 어떤 모델인가

구글의 발표문은 이 모델을 “3.7 플래시와 같은 속도와 낮은 비용으로, 추론과 코딩이 가장 뛰어난 플래시”라고 소개합니다. 플래시는 구글 모델 가운데 빠르고 싼 등급의 이름이고, 프로가 그 위입니다. 발표문이 내세운 수치는 도구 없이 푸는 어려운 문제 모음 HLE-Verified에서 54.9%, 그리고 소프트웨어 공학 문제 DeepSWE v1.1에서 “대부분의 더 큰 최상위 모델을 앞선다”는 것입니다. 구글의 표현대로 “상위 모델의 성능에 자주 근접”하는 보급형이라는 자리입니다.

쓸 수 있는 곳은 제미나이 앱(Pro·Ultra 구독), AI 스튜디오와 안드로이드 스튜디오, 제미나이 엔터프라이즈, 구글 검색의 AI 모드, 구글 시트입니다. 같은 날 사이버보안 작업에 맞춘 3.8 플래시 사이버도 나왔는데, 이쪽은 정부·핵심 인프라·소프트웨어 관리자에게 우선 제공하는 Fairwind 프로그램을 통해서만 열립니다. 취약점 찾기 벤치마크 CWE-Bench에서 47.2%로 상위 모델(47.8%)에 근접했다고 밝혔습니다.

가격표 — 연말까지와 1월부터

API 가격 문서의 값을 그대로 옮기면 아래와 같습니다. 100만 토큰당 단가이고, 출력에는 모델이 생각하는 데 쓴 토큰(thinking)이 포함됩니다.

항목2026년 12월 31일까지2027년 1월 1일부터
입력$0.75$1.50
출력(사고 토큰 포함)$3.75$7.50
컨텍스트 캐시 읽기$0.075$0.15
캐시 저장(100만 토큰·시간당)$0.50$1.00
배치(표준의 50%) 입력 / 출력$0.375 / $1.875$0.75 / $3.75

모든 항목이 정확히 두 배입니다. 도입가라는 이름은 흔하지만, 만료일과 이후 단가를 표에 미리 적어 둔 경우는 드뭅니다. 좋게 보면 예측 가능하고, 나쁘게 보면 지금 값으로 예산을 짜면 1월 청구서가 두 배라는 뜻입니다.

두 배가 되면 다른 모델과 어디쯤인가

1월 이후 단가 1.50달러·7.50달러는 여전히 최상위 모델의 6분의 1 수준입니다. 9월 첫 주에 함께 나온 GPT-6 아스트라와 클로드 페이블 5.1은 10달러·50달러이고, 클로드 소네트 5는 2달러·10달러, OpenAI의 GPT-5.6 테라는 2달러·12달러입니다. 즉 도입가가 끝나도 3.8 플래시는 “중간 칸”의 값이지 “최상위 칸”의 값이 아닙니다. 다만 출력에 사고 토큰이 포함된다는 점이 다른 회사와 비교할 때 함정입니다. 어려운 질문일수록 사고 토큰이 늘어나 실제 출력 청구량이 답변 길이보다 훨씬 커집니다. 추론 강도가 비용에 어떻게 얹히는지는 추론 수준 설정 글에서 다뤘습니다.

청구액으로 계산해 보면

한 달에 입력 1억 토큰, 출력 2,000만 토큰을 쓰는 서비스를 가정합니다. 도입가로는 입력 75달러에 출력 75달러, 합해 150달러입니다. 1월부터는 같은 사용량이 300달러가 됩니다. 배치 API로 돌릴 수 있는 작업이라면 각각 75달러와 150달러입니다. 여기에 사고 토큰이 얹힙니다. 어려운 질문에 모델이 답보다 긴 사고 과정을 쓰면 출력 2,000만 토큰이 실제로는 3,000만~4,000만 토큰으로 청구될 수 있습니다. 이 가정에서는 출력 단가가 입력의 5배라, 사고 토큰 1,000만 개가 도입가 기준 37.5달러, 1월 단가 기준 75달러를 더합니다. 예산을 잡을 때 “1월 단가 × 사고 토큰 포함 출력량”으로 계산하는 것이 안전합니다.

가정: 월 입력 1억·출력 2,000만 토큰도입가(~12/31)정가(1/1~)
표준 호출$150$300
배치 API$75$150
사고 토큰 1,000만 추가 시+$37.5+$75

지금 이 모델로 파이프라인을 짜도 되나

  • 연말까지 끝나는 일회성 작업(대량 분류·요약·번역): 도입가를 그대로 누리면 됩니다. 배치 API를 쓰면 다시 절반입니다.
  • 2027년에도 돌아가는 상시 서비스: 예산은 1월 단가로 잡아야 합니다. 도입가 기간의 청구액에 2를 곱해 보고 그래도 맞으면 갑니다.
  • 같은 문맥을 반복하는 작업: 캐시 읽기가 입력의 10분의 1이라 캐시를 적극 쓰는 편이 유리합니다. 다만 캐시 저장료가 시간당으로 붙으므로, 몇 시간 뒤 다시 쓸 문맥을 계속 올려 두면 저장료가 읽기 절감분을 잡아먹습니다.
  • 제미나이 앱만 쓰는 사용자: API 단가와 무관합니다. Pro·Ultra 구독에서 3.8 플래시가 제공되고, 무료 사용자는 AI 스튜디오에서 쓸 수 있습니다.

왜 도입가를 쓸까

구글이 이유를 밝히지는 않았습니다. 다만 세 회사가 같은 주에 모델을 내놓은 상황에서, 개발자가 모델을 갈아타는 비용은 가격표보다 “지금 붙여 볼 이유”에 좌우됩니다. 넉 달간 반값은 그 이유를 만드는 장치이고, 만료일을 표에 박아 둔 것은 나중에 “값이 올랐다”는 불만을 미리 차단하는 장치로 읽힙니다. OpenAI의 GPT-5.6 솔도 11월 21일까지의 프로모션 단가를 쓰고 있어, 기간이 명시된 가격은 올해 하반기 모델 시장의 공통 패턴이 됐습니다.

자주 묻는 질문

도입가 기간에 쓴 캐시는 1월에도 싼 값으로 읽나요?

아닙니다. 단가는 호출 시점 기준입니다. 1월 1일 이후의 읽기는 새 단가가 적용됩니다.

컨텍스트 창은 얼마인가요?

발표문과 가격 문서에 명시돼 있지 않습니다. 모델 카드나 AI 스튜디오의 모델 정보에서 확인해야 합니다. 이 글은 확인되지 않은 값을 적지 않았습니다.

3.8 프로는 언제 나오나요?

가격 문서에는 3.1 프로 프리뷰까지만 올라 있고 3.8 프로는 없습니다. 발표문도 플래시 두 종만 다룹니다.

정리

3.8 플래시는 “싸고 빠른데 꽤 똑똑한” 칸을 노린 모델이고, 값은 넉 달간 반값입니다. 파이프라인을 짤 때는 표의 오른쪽 열(1월 단가)로 계산하고, 사고 토큰이 출력에 포함된다는 점을 잊지 않으면 됩니다. 아스트라·페이블 5.1과 같은 작업에 무엇을 쓸지는 세 모델 비교 글에서 정리했습니다.

공식 출처: 구글 제미나이 3.8 플래시 발표(2026-09-02), 제미나이 API 가격 문서 (2026년 9월 6일 확인)

이 갈래에서 이어 읽기