최근 이슈 · 2026-09-24
새 모델과 함께 바뀐 AI 가격표, 이번 주 발표 셋
이 글은 AI로 수집한 결과입니다. 원문 기사와 발표 자료를 대조해 정리했지만, 최종 확인은 출처 원문에서 해 주세요. 자료 수집 2026-09-24 10:10.
한 줄로
이번 주 오픈AI와 구글이 모델을 새로 내면서 값도 함께 바꿨습니다. 오픈AI는 중간급·보급형 모델 둘을 내며 API 가격을 절반으로 낮췄고, 구글은 목소리를 만들어 읽어 주는 음성 합성 모델 둘을 내며 올해 말까지만 적용되는 가격을 붙였습니다.
이번 주 소식
2026년 9월 24일 오전 10시 10분(한국 시간)에, 각 회사의 발표문과 가격표를 직접 열어 확인한 것입니다. 날짜는 발표문과 공식 RSS에 적힌 미국 날짜입니다.
| 소식 | 날짜 | 기관 |
|---|---|---|
| GPT-6 Sol·Luna 출시 | 9월 22일 | 오픈AI |
| GPT-6 프롬프트 캐싱 개편 | 9월 22일 | 오픈AI |
| Gemini 3.8 음성 합성 모델 둘 | 9월 23일 | 구글 |
오픈AI — GPT-6 Sol·Luna, API 가격 절반
이달 초 낸 최상위 모델 GPT-6 Astra 아래에 중간급 Sol과 보급형 Luna를 더했습니다.
| 모델 | 입력 | 출력 |
|---|---|---|
| GPT-6 Sol | $4 → $2 | $20 → $10 |
| GPT-6 Luna | $0.20 → $0.10 | $1.20 → $0.50 |
- 값은 100만 토큰당이고, 화살표 앞은 이전 모델(GPT-5.6)의 프로모션 가격입니다. 오픈AI는 두 모델 모두 「50% 저렴」이라고 적었습니다.
- ChatGPT Work와 Codex에서 Plus·Pro·Business·Enterprise·Edu 이용자에게 열었고, 무료·Go 이용자는 데스크톱 앱에서 Luna를 쓸 수 있다고 밝혔습니다. 일반 대화 화면(Chat)에는 아직 들어오지 않았습니다.
- 사용자가 오류를 신고한 대화로 잰 자체 평가에서 Sol의 사실 오류가 이전 모델의 절반가량이라고 했습니다. 다만 이 자료는 「평소 사용을 대표하지 않는다」고 스스로 적었습니다.
오픈AI — 같은 내용을 다시 보낼 때 덜 내는 캐싱
에이전트는 같은 지시문과 도구 설명을 요청마다 되풀이해 보냅니다. 이렇게 앞부분이 같은 입력을 30분 안에 다시 쓰면 입력값을 최대 90% 깎아 주는 방식(프롬프트 캐싱)을 GPT-6에 맞춰 고쳤습니다.
- 캐시가 얼마나 맞았는지 보는 대시보드와, 왜 빗나갔는지 알려 주는 진단 도구를 새로 냈습니다.
- 대화 중간에 추론 강도를 바꾸거나 쓸 도구를 좁혀도 앞서 쌓인 캐시가 깨지지 않게 했습니다.
- 깃허브는 이런 개선으로 새로 처리해야 하는 프롬프트 토큰 비중이 50% 넘게 줄었다고 보고했다고 오픈AI가 전했습니다.
구글 — 목소리를 지어내는 Gemini 3.8 음성 합성
글을 읽어 주는 모델 둘을 냈습니다. 3.8 Flash TTS는 오디오북·게임 캐릭터처럼 연기가 필요한 쪽, 3.8 Flash-Lite TTS는 더빙·상담 음성처럼 양이 많은 쪽을 겨냥했다고 설명합니다.
- 100개 넘는 언어·방언을 지원하고, 기본 음성 30개에서 2,000개 넘는 음성 라이브러리로 넓혔다고 밝혔습니다.
- 30초 녹음으로 목소리를 복제할 수 있는데, 목소리 주인이 직접 녹음한 동의 음성이 있어야 만들어집니다. 만든 음성에는 모두 눈에 안 띄는 워터마크(SynthID)가 들어갑니다.
- 일반 이용자는 Flash TTS를 Gemini Notebook에서, Flash-Lite TTS를 Google Vids에서 만나게 됩니다.
| 모델 | 출력(오디오) 올해 말까지 | 2027년 1월부터 |
|---|---|---|
| 3.8 Flash TTS | $9.00 | $18.00 |
| 3.8 Flash-Lite TTS | $6.00 | $12.00 |
가격표는 100만 토큰당 값이고, 오디오 1초를 25토큰으로 셉니다. 저희가 이 기준으로 셈해 보면 음성 1시간(9만 토큰)의 출력값은 Flash TTS가 올해 약 0.81달러, 내년부터 약 1.62달러입니다(입력 글자값 제외).
누구에게 무슨 의미인가
여기까지가 발표문과 가격표에 적힌 사실이고, 아래는 저희 추정입니다.
- AI로 서비스를 만드는 개발자: 모델 값이 내린 데다 캐싱 할인까지 겹치면, 같은 지시문을 되풀이하는 챗봇·에이전트일수록 비용 차이가 크게 날 것으로 보입니다.
- 아이에게 동화를 읽어 주는 앱이나 영상 더빙을 만드는 쪽: 음성 합성 가격이 올해 말 두 배로 오르게 적혀 있어, 올해 안에 시험해 보고 내년 비용을 따로 잡는 편이 안전해 보입니다.
- 일반 이용자: 30초 녹음이면 목소리를 흉내 낼 수 있는 시대라, 가족 목소리로 걸려 온 급한 돈 요구 전화는 한 번 끊고 다시 확인하는 습관이 더 중요해졌습니다.
확인하지 못한 것
- 성능 비교: 오픈AI는 경쟁사 모델과 여러 벤치마크로 비교했지만, 경쟁사 점수는 공개 보고서에서 가져왔다고 적었습니다. 저희가 재현하지 않아 수치를 옮기지 않았습니다.
- 「50%」의 계산: Luna 출력값 $1.20 → $0.50은 산술로는 약 58% 인하인데, 발표문 표에는 「50% 저렴」이라고 적혀 있습니다.
- 한국에서 음성 복제: 구글은 일리노이·텍사스·유럽경제지역·영국·스위스·인도에서 AI Studio 음성 복제를 막는다고 적었습니다. 한국은 목록에 없지만 된다고 명시한 문장도 없습니다.
- 직접 확인한 범위: 오픈AI 페이지는 직접 접속이 막혀 본문 중계 서비스(r.jina.ai)로 받은 텍스트를 읽었고, 날짜는 오픈AI 공식 RSS의 값입니다.
출처
- OpenAI, Introducing GPT-6 Sol and Luna (2026-09-22) https://openai.com/index/introducing-gpt-6-sol-and-luna
- OpenAI, Better prompt caching for GPT-6 (2026-09-22) https://openai.com/index/better-prompt-caching-for-gpt-6
- Google 블로그, Gemini 3.8 text-to-speech says hello (2026-09-23) https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
- Google DeepMind, 같은 발표문 https://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech/
- Gemini API 가격표 (2026-09-23 UTC 갱신) https://ai.google.dev/gemini-api/docs/pricing
- OpenAI 공식 뉴스 RSS(게시일 확인) https://openai.com/news/rss.xml