ChatGPT, Claude, Gemini — 무엇을 어디에 쓸까
질문은 거의 항상 같은 모양으로 온다: “어떤 걸 써야 해?” 그리고 거의 항상, 묻는 사람은 이름 하나를 기대한다.
여기서는 그 이름을 얻지 못한다. 비겁해서가 아니라, 대략 1년 전부터 정직한 답이 달라졌기 때문이다: 대부분의 작업에서 세 최상위 모델 사이의 차이는 잘 던진 질문과 못 던진 질문 사이의 차이보다 작다. 그리고 정말 뚜렷한 차이가 있는 곳은, 비교표가 찾아보는 자리에 있는 경우가 드물다.
그래서 이 글은 순위표가 아니다. 작업별 선택이다 — 기준일을 달아둔다, 이 글에는 유효기간이 있으니까.
미리 밝혀둘 것
이 글의 초고는 Claude로 작성했다. 어떤 모델이 무엇을 더 잘하는지 이야기하기 전에, 이 사실부터 밝혀두는 게 맞다.
여기서 두 가지가 따라온다. 첫째, 모든 수치 뒤에는 직접 열어볼 수 있는 출처가 있다 — 비교 사이트에서 가져온 것은 하나도 없고, 전부 공급사 자신의 가격·문서 페이지이거나 이름을 밝힌 관찰자의 글이다. 둘째, 이 글은 어떤 모델도 승자로 세우지 않는다. 의견이 있는 곳은 의견이라고 표시해둔다.
그리고, 제휴 링크는 없다. 있을 수가 없다 — OpenAI, Anthropic, Google 모두 파트너 프로그램을 운영하지 않는다. 이 경우엔 그게 오히려 단순해서 다행이다.
지금 무엇을 쓸 수 있나
What's available right now
GPT-5.6 Sol
Top model, coding and agents
Knowledge cutoff 16 February 2026 — anything later it only knows if it searches.
GPT-5.6 Terra
Everyday work
The model the free and Go tiers run on.
GPT-5.6 Luna
Fast and cheap
Claude Fable 5
Strongest model, long-horizon work
Requires 30-day data retention — not available under zero data retention.
Claude Opus 4.8
Coding and agents
Claude Sonnet 5
Everyday work
Introductory price 2 / 10 until 31 August 2026.
Claude Haiku 4.5
Fast and cheap
The only model in this field without a million-token context.
Gemini 3.6 Flash
Workhorse
17% cheaper on output than 3.5 Flash — Google's current default model.
Gemini 3.5 Flash
Predecessor, still available
Gemini 3.5 Flash-Lite
High-volume work
The cheapest output price in the whole field.
Gemini 3.1 Pro
Google's largest model — still labelled preview
Price rises above a 200,000-token prompt. The announced successor 3.5 Pro still hasn't shipped two months after the announcement.
Price per token says less than it promises: the models think for different lengths of time, and those thinking tokens are on the same bill. The cheaper model can be the more expensive job.
24 July 2026 기준. 미국 달러 표시 정가이며 배치 처리나 캐싱 할인은 반영하지 않았습니다 — 이 할인들은 세 업체 모두에서 청구액을 크게 낮춥니다. 결정을 내리기 전에 반드시 해당 업체에서 직접 확인하세요.
나란히 놓고 보면 두 가지가 눈에 띈다.
컨텍스트 윈도우는 논거로서는 죽었다. 2년 동안 “얼마나 많은 텍스트가 들어가는가”는 가장 강력한 차별점이었다. 지금은 셋 다 대략 백만 토큰 선에 있다 — 대략 70만 단어, 두꺼운 소설 여러 권을 한 번에 넣는 수준이다. 가장 작은 Claude 모델만 20만으로 대열에서 벗어난다. 오늘 컨텍스트 윈도우로 고른다는 건, 공급사들이 이미 오래전에 치워버린 기준으로 결정한다는 뜻이다.
Google의 최대 모델은 몇 달째 “프리뷰”라는 이름을 달고 있다. 5월 19일, Google은 자사 개발자 컨퍼런스에서 Gemini 3.5 Pro를 발표했다 — “이미 내부적으로 쓰이고 있다”, 출시는 “다음 달”. 7월 21일, 두 달 뒤, 대신 새 모델 셋이 나왔고 그중 3.5 Pro는 없었다. Google의 가장 강력한 사용 가능 모델은 여전히 버전 번호 3.1과 이름 속 “Preview”라는 단어를 달고 있다. 나머지 라인업은 전부 Flash 모델, 즉 빠르고 저렴한 등급이다.
이건 스캔들은 아니지만 패턴이다: 발표되는 것과 실제로 살 수 있는 것은, 셋 다에서 서로 다른 목록이다.
작업별 선택
코드 작성과 장시간 자율 작업
여기가 가장 다투는 지점이다 — 그리고 벤치마크들은 서로 모순되는 게 아니라, 서로 다른 걸 재고 있을 뿐이다.
Claude Opus 4.8은 SWE-Bench Pro(실제 GitHub 이슈)에서 69.2%로 앞선다. GPT-5.6 Sol은 “Agents’ Last Exam”에서 53.6이라는 새 최고치를 기록하며 Claude Fable 5를 여유 있게 앞선다. Gemini 3.5 Flash는 Terminal-Bench 2.1에서 76.2%를 보고한다. 시험 세 개, 승자 세 명.
셋 다를 매일 쓰고 몇 년째 담담하게 글을 써온 Simon Willison은 GPT-5.6 출시 후 이렇게 말했다: 기록적인 점수에도 불구하고, 복잡한 코딩 작업에서 이 모델이 Claude Fable보다 낫다고 느껴지지는 않았다고.
내 조언: 여기서는 모델이 아니라 그 주변 도구로 결정하라 — 그게 당신의 에디터, 터미널, 습관에 얼마나 잘 맞는지. 모델들은 그것들이 돌아가는 환경보다 서로 더 가깝다.
이미지, 영상, 음성
명확한 답이 있는 유일한 지점: Google.
Google은 셋 중 유일하게 이미지·영상 생성이 언어 모델과 같은 가격표에 올라 있는 곳이다 — Veo 3.1은 영상 1초당 최소 0.05달러, Imagen 4는 이미지 1장당 최소 0.02달러부터. 여기에 Gemini Omni가 더해진다. 여러 차례의 대화 턴에 걸쳐 편집할 수 있는 영상 모델로, 세션 안에서 앞서 나눈 이야기를 기억한다.
미디어가 당신의 주제라면, 이건 접전이 아니다.
긴 문서 읽고 요약하기
상관없다. 정말로 상관없다. 위에서 본 대로 — 셋 다 몇백 페이지를 한 번에 삼킨다. 이미 열어둔 걸 쓰면 된다.
자잘한 일 대량으로, 자동화
Gemini 3.5 Flash-Lite는 입력 0.30달러·출력 2.50달러(백만 토큰당)로 전체 필드에서 가장 저렴한 출력 가격을 갖고 있다 — 다른 두 회사의 소형 모델 대비 2~3배 차이다.
다만 이 계산은 조심할 필요가 있다. 다음 절을 보라.
이미 Google 안에 살고 있다면
필드에서 가장 저렴한 진입점은 Google AI Plus, 4.99달러다 — 게다가 스토리지 400GB가 얹힌다. 그리고 Google의 19.99달러 요금제에는 YouTube Premium Lite가 포함된다.
이게 Google이 개인 사용자층에서 이기는 진짜 이유이고, 모델 품질과는 아무 상관이 없다. 어차피 스토리지와 YouTube 값을 내고 있다면, AI는 계산상 거의 공짜에 가깝다.
직업적으로 데이터 보호가 중요하다면
거의 어떤 비교에도 나오지 않는 디테일 하나: Anthropic의 최강 모델 Fable 5는 30일 데이터 보관이 필수이며 제로 데이터 보관 아래서는 아예 쓸 수 없다. 당신의 회사·병원·의뢰인이 바로 그걸 요구한다면, 플래그십은 선택지에서 빠진다 — 그러면 Fable이 아니라 Opus 4.8로 가게 된다.
이런 문장들은 제품 페이지가 아니라 개발자 문서에 산다.
벤치마크가 말해주지 않는 것
토큰당 가격은 측정 지표로서 고장 났다. 모델은 답하기 전에 “생각”하고, 그 생각 토큰은 답변과 같은 청구서에 올라간다. 토큰 가격이 절반이면서 세 배 더 오래 추론하는 모델은 월말엔 더 비싸다. Willison도 정확히 이렇게 말한다: 토큰당 원가 비교는 이제 오해를 부른다고. 정말 비용을 알고 싶은 사람은 자신의 전형적인 작업을 셋 다에 직접 돌려보고 청구서를 봐야 한다 — 가격표가 아니라.
시험은 시험 응시자 자신이 채점한다. OpenAI 모델들이 SWE-Bench Pro에서 Anthropic에 뒤처진 뒤, OpenAI는 이 벤치마크를 비판하는 글을 냈다 — 과제의 약 30%가 결함이 있다는 추정이었다. 사실관계로는 전적으로 맞을 수도 있다. 그래도 이건 자기 사건에서 증언하는 증인이다. 그리고 같은 조심성은 반대 방향에도 적용된다: 자신이 앞선 벤치마크를 자축하는 쪽 역시 똑같이 이해관계자다.
그리고 2026년 7월부터는, 모델 출시 시점을 공급사 혼자 결정하지 않는다. GPT-5.6은 미국 정부 기관 — 상무부 산하 Center for AI Standards and Innovation — 의 완료된 검토를 거친 뒤에야 광범위한 출시 승인을 받았다. 이건 이 글의 어떤 퍼센트보다 앞으로 몇 년에 대해 더 많은 걸 말해준다.
얼마인가
What it costs
ChatGPT Go
€8 / month
The cheap middle tier. Runs on Terra.
ChatGPT Plus
€23 / month
The plan most people mean. Free choice of model.
ChatGPT Pro
€229 / month
For constant use and Sol reasoning without a tight cap.
Claude Pro
$20 / month ($17 billed annually)
Includes Claude Code. No cheaper middle tier exists.
Claude Max
from $100 / month ($200 for 20×)
5× or 20× Pro's usage limits. Same models.
Google AI Plus
$4.99 / month
The cheapest entry in the field, incl. 400 GB storage.
Google AI Pro
$19.99 / month
Plus YouTube Premium Lite and storage — the bundle is the argument.
Google AI Ultra
$99.99 / month ($199.99 for 20×)
5× or 20× Pro's limits, 20 TB storage.
24 July 2026 기준. OpenAI는 독일 기준으로 유로 가격을 표시하고, Anthropic과 Google은 달러로 표시합니다 — 그래서 여기서는 각 업체가 명시한 그대로 두 통화가 함께 나타납니다.
눈에 띄는 간극: Claude에는 저렴한 중간 등급이 없다. 무료에서 바로 20달러로 뛴다. ChatGPT는 Go가 8유로에 있고, Google AI Plus는 4.99달러다. AI를 꾸준히 쓰지만 업무용은 아니라면, Anthropic에는 그냥 맞는 상품이 없다.
반대 방향으로 보면: Claude Pro는 프로그래밍 도구인 Claude Code를 추가 비용 없이 포함한다. 이게 중요한 사람은 이미 알고 있다.
이 글에 유효기간이 있는 이유
속도를 보라.
OpenAI: GPT-5.1은 2025년 11월, 5.2는 12월, 5.4는 2026년 3월, 5.5는 4월 23일, 5.6은 7월 9일. 8개월 만에 다섯 세대.
Google: Gemini 3.5 Flash는 5월 19일, Gemini 3.6 Flash는 7월 21일. 두 달.
실제로 이게 뜻하는 바: 연간 요금제는 모델에 거는 베팅이 아니라 공급사에 거는 베팅이다 — 당신이 고른 모델은 1년 뒤 지금 그 형태로는 존재하지 않는다. Anthropic은 연간 결제 시 20달러 대신 17달러를 내세운다 — 12개월 동안 마음을 바꿀 수 없는 대가로 36달러를 아끼는 셈이다. 8주마다 새 플래그십이 나오는 필드에서, 그건 더 나쁜 거래다.
월 단위로 내라. 이게 이 글 전체에서 가장 실용적인 조언이다.
내 결론
하나만 고르고 더는 생각하고 싶지 않다면: 인터페이스가 가장 덜 거슬리는 걸 골라라. 품질 차이는 그 물건을 열고 싶은지 아닌지보다 작업에 미치는 영향이 더 작을 것이다.
둘을 낼 수 있다면, 합리적인 조합은 “1등 플러스 2등”이 아니라 텍스트·코드용 하나, 미디어용 하나다 — 그리고 그 두 번째 자리에서는 Google이 사실상 경쟁자가 없다.
그리고 석 달 뒤 다시 제대로 골랐는지 궁금해진다면: 그때쯤 이 글은 업데이트되어 있을 것이다. 맨 아래 버전 기록이 무엇이 바뀌었는지 보여준다.
모델을 둘러싼 도구들 — 이미지, 영상, 음악, 편집, 자동화 — 을 위해서는 계속 관리하는 별도의 AI 도구 137개 인덱스를 두고 있다.
출처
모두 2026년 7월 24일 확인.
- Gemini API 가격 — Google, 모든 모델 가격과 컨텍스트 윈도우
- Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 소개 — Google, 2026년 7월 21일
- Google, 새 Gemini 모델 3개 출시 — 그러나 3.5 Pro는 없었다 — TechCrunch, 2026년 7월 21일
- Google I/O 2026에서 발표된 모든 것 — Google, 2026년 5월 20일
- Google의 AI 구독 상품 — Google, 2026년 5월
- 새로운 GPT-5.6 패밀리: Luna, Terra, Sol — Simon Willison, 2026년 7월 9일, API 가격과 벤치마크 맥락 포함
- 요금제와 가격 — Anthropic
여기서 뭔가 오래되었거나 틀려 보인다면: 연락해달라. 맨 위 날짜가 바로 그걸 위한 것이다.
댓글
댓글, 좋아요, 저장을 하려면 로그인하세요. 로그인 →
아직 댓글이 없어요. 첫 댓글을 남겨보세요.