این پرسش تقریباً همیشه به یک شکل می‌رسد: «کدام‌یک را بگیرم؟» و تقریباً همیشه پرسنده انتظار یک اسم را دارد.

اینجا اسمی نمی‌گیری. نه از سرِ جاخالی‌دادن، بلکه چون تقریباً یک سال است پاسخ صادقانه چیز دیگری‌ست: در بیشتر کارها، فاصلهٔ میان سه مدل برتر کمتر از فاصلهٔ میان یک پرسشِ خوب‌پرسیده‌شده و یک پرسشِ بد‌پرسیده‌شده است. و جایی که واقعاً تفاوتی روشن هست، به‌ندرت همان جایی‌ست که جدول‌های مقایسه دنبالش می‌گردند.

پس این یک رده‌بندی نیست. یک تصمیم است بر اساس کار — با تاریخ اعتبار، چون این متن تاریخ انقضا دارد.

شفاف‌سازی

پیش‌نویس نخست این متن با ⁦Claude⁩ نوشته شده است. این نکته باید پیش از هر داوری دربارهٔ اینکه کدام مدل در چه کاری بهتر است، روی میز باشد.

از این، دو نتیجه می‌آید. نخست، پشت هر رقم منبعی هست که خودت می‌توانی بازش کنی — هیچ‌کدام از یک سایت مقایسه‌ای نمی‌آید؛ همه از صفحات قیمت‌گذاری و مستندات خودِ ارائه‌دهنده‌ها می‌آیند یا از ناظرانی که نامشان آمده. دوم، این نوشته هیچ برنده‌ای تاج نمی‌گذارد. جایی که نظری دارم، به‌روشنی به‌عنوان نظر علامت‌گذاری شده است.

و: اینجا هیچ لینک کمیسیونی نیست. نمی‌تواند باشد — ⁦OpenAI⁩، ⁦Anthropic⁩ و ⁦Google⁩ اساساً برنامهٔ همکاریِ کمیسیونی ندارند. که در این مورد کار را به‌خوشایندی ساده می‌کند.

همین حالا چه چیزی موجود است

What's available right now

ChatGPT OpenAI

GPT-5.6 Sol

Top model, coding and agents

$۵ / $۳۰ ۱٬۰۵۰٬۰۰۰ tokens 9 July 2026

Knowledge cutoff 16 February 2026 — anything later it only knows if it searches.

GPT-5.6 Terra

Everyday work

$۲٫۵۰ / $۱۵ ۱٬۰۵۰٬۰۰۰ tokens 9 July 2026

The model the free and Go tiers run on.

GPT-5.6 Luna

Fast and cheap

$۱ / $۶ ۱٬۰۵۰٬۰۰۰ tokens 9 July 2026

Claude Anthropic

Claude Fable 5

Strongest model, long-horizon work

$۱۰ / $۵۰ ۱٬۰۰۰٬۰۰۰ tokens 2026

Requires 30-day data retention — not available under zero data retention.

Claude Opus 4.8

Coding and agents

$۵ / $۲۵ ۱٬۰۰۰٬۰۰۰ tokens 2026

Claude Sonnet 5

Everyday work

$۳ / $۱۵ ۱٬۰۰۰٬۰۰۰ tokens 2026

Introductory price 2 / 10 until 31 August 2026.

Claude Haiku 4.5

Fast and cheap

$۱ / $۵ ۲۰۰٬۰۰۰ tokens 2025

The only model in this field without a million-token context.

Gemini Google

Gemini 3.6 Flash

Workhorse

$۱٫۵۰ / $۷٫۵۰ ۱٬۰۴۸٬۵۷۶ tokens 21 July 2026

17% cheaper on output than 3.5 Flash — Google's current default model.

Gemini 3.5 Flash

Predecessor, still available

$۱٫۵۰ / $۹ ۱٬۰۴۸٬۵۷۶ tokens 19 May 2026

Gemini 3.5 Flash-Lite

High-volume work

$۰٫۳۰ / $۲٫۵۰ ۱٬۰۴۸٬۵۷۶ tokens 21 July 2026

The cheapest output price in the whole field.

Gemini 3.1 Pro

Google's largest model — still labelled preview

$۲–$۴ / $۱۲–$۱۸ ۱٬۰۴۸٬۵۷۶ tokens 2026

Price rises above a 200,000-token prompt. The announced successor 3.5 Pro still hasn't shipped two months after the announcement.

Price per token says less than it promises: the models think for different lengths of time, and those thinking tokens are on the same bill. The cheaper model can be the more expensive job.

تا تاریخ 24 July 2026. قیمت‌های فهرست به دلار آمریکا، پیش از تخفیف‌های پردازش دسته‌ای یا کش — که در هر سه مورد هزینه را به‌طور قابل‌توجهی کاهش می‌دهند. پیش از هر تصمیمی، نزد ارائه‌دهنده بررسی کنید.

وقتی همه را کنار هم بگذاری، دو نکته توی چشم می‌زند.

پنجرهٔ زمینه به‌عنوان یک استدلال مرده است. دو سال تمام «چقدر متن جا می‌شود» قوی‌ترین وجه تمایز بود. امروز هر سه حدود یک میلیون توکن دارند — یعنی تقریباً ⁦700,000⁩ کلمه، چندین رمانِ قطور در یک نفس. تنها کوچک‌ترین مدل ⁦Claude⁩ با ⁦200,000⁩ از صف بیرون می‌زند. انتخاب بر اساس پنجرهٔ زمینه امروز یعنی تصمیم‌گیری بر پایهٔ معیاری که ارائه‌دهنده‌ها مدت‌ها پیش از روی میز برداشته‌اند.

بزرگ‌ترین مدل ⁦Google⁩ ماه‌هاست برچسبِ «پیش‌نمایش» دارد. در ⁦19⁩ مه، در کنفرانس توسعه‌دهندگانِ خودش، ⁦Google⁩ از ⁦Gemini 3.5 Pro⁩ خبر داد — «همین حالا در داخل استفاده می‌شود»، عرضه «ماه آینده». در ⁦21⁩ ژوئیه، دو ماه بعد، به‌جای آن سه مدل تازه از راه رسید و هیچ‌کدام ⁦3.5 Pro⁩ نبود. قوی‌ترین مدلِ در دسترسِ ⁦Google⁩ هنوز شمارهٔ نسخهٔ ⁦3.1⁩ و کلمهٔ «⁦Preview⁩» را در نامش دارد. هرچه دیگر در پیشنهاد هست یک مدلِ ⁦Flash⁩ است — ردهٔ سریع و ارزان.

این رسوایی نیست، اما یک الگوست: در هر سه، آنچه اعلام می‌شود و آنچه واقعاً می‌توانی بخری، دو فهرست جداست.

تصمیم، بر اساس کار

نوشتن کد و کارهای طولانی و خودمختار

این پرمناقشه‌ترین بخش است — و بنچمارک‌ها با هم تناقض ندارند، فقط چیزهای متفاوتی را می‌سنجند.

⁦Claude Opus 4.8⁩ در ⁦SWE-Bench Pro⁩ (تیکت‌های واقعیِ ⁦GitHub⁩) با ⁦69.2%⁩ پیشتاز است. ⁦GPT-5.6 Sol⁩ با ⁦53.6⁩ در «⁦Agents’ Last Exam⁩» رکورد تازه‌ای می‌زند و در آن ⁦Claude Fable 5⁩ را با فاصلهٔ راحتی پشت سر می‌گذارد. ⁦Gemini 3.5 Flash⁩ در ⁦Terminal-Bench 2.1⁩ عدد ⁦76.2%⁩ را گزارش می‌دهد. سه امتحان، سه برنده.

⁦Simon Willison⁩ که هر سه را روزانه استفاده می‌کند و سال‌هاست دربارهٔ آن‌ها با خونسردی می‌نویسد، بعد از عرضهٔ ⁦GPT-5.6⁩ این‌طور گفت: با وجود امتیازهای رکورد، این مدل در کارهای پیچیدهٔ کدنویسی به نظرش بهتر از ⁦Claude Fable⁩ نیامده است.

توصیهٔ من: اینجا بر اساس مدل تصمیم نگیر، بر اساس ابزارهای دور و برش تصمیم بگیر — اینکه چقدر خوب توی ویرایشگر، ترمینال و عادت‌هایت جا می‌افتد. مدل‌ها به هم نزدیک‌ترند تا محیط‌هایی که در آن‌ها اجرا می‌شوند.

تصویر، ویدیو، صدا

تنها نقطه‌ای با پاسخی روشن: ⁦Google⁩.

⁦Google⁩ تنها موردی از این سه است که تولید تصویر و ویدیو در همان فهرست قیمتِ مدل‌های زبانی جا گرفته — ⁦Veo 3.1⁩ از ⁦$0.05⁩ در هر ثانیهٔ ویدیو، ⁦Imagen 4⁩ از ⁦$0.02⁩ در هر تصویر. روی این‌ها ⁦Gemini Omni⁩ هم هست، یک مدل ویدیویی که می‌توانی در چند نوبتِ گفت‌وگو ویرایشش کنی و آنچه پیش‌تر در همان نشست گفته‌اید را به خاطر می‌سپارد.

اگر موضوعِ کارت رسانه است، این یک انتخاب نزدیک نیست.

خواندن و خلاصه‌کردن سندهای بلند

فرقی نمی‌کند. واقعاً فرقی نمی‌کند. بالا را ببین — هر سه چند صد صفحه را در یک نفس می‌بلعند. همانی را استفاده کن که همین حالا بازش داری.

کارهای کوچکِ زیاد، به‌صورت خودکار

⁦Gemini 3.5 Flash-Lite⁩ ارزان‌ترین قیمتِ خروجی در کلِ این میدان را دارد: ⁦$0.30⁩ ورودی و ⁦$2.50⁩ خروجی به‌ازای هر میلیون توکن — ضریبی دو تا سه برابر نسبت به مدل‌های کوچکِ آن دو ارائه‌دهندهٔ دیگر.

اما با این حساب‌وکتاب مراقب باش؛ بخش بعدی را ببین.

اگر همین حالا در دنیای ⁦Google⁩ زندگی می‌کنی

ارزان‌ترین نقطهٔ ورود در این میدان ⁦Google AI Plus⁩ با ⁦$4.99⁩ است — همراه با ⁦400⁩ گیگابایت فضای ذخیره‌سازی روی آن. و ردهٔ ⁦$19.99⁩ ⁦Google⁩ شامل ⁦YouTube Premium Lite⁩ هم می‌شود.

این دلیل واقعیِ برد ⁦Google⁩ نزدِ کاربران خصوصی است، و ربطی به کیفیت مدل ندارد. اگر به‌هرحال داری برای فضای ذخیره‌سازی و ⁦YouTube⁩ پول می‌دهی، هوش مصنوعی روی کاغذ تقریباً مجانی است.

اگر حفاظت از داده برایت به‌صورت حرفه‌ای اهمیت دارد

جزئیاتی که در تقریباً هیچ مقایسه‌ای دیده نمی‌شود: قوی‌ترین مدلِ ⁦Anthropic⁩، ⁦Fable 5⁩، به نگه‌داریِ ⁦30⁩-روزهٔ داده نیاز دارد و اصلاً تحتِ «⁦Zero Data Retention⁩» در دسترس نیست. اگر مؤسسه، مطب یا طرفِ قراردادت دقیقاً همین را الزامی کند، پرچم‌دار از روی میز کنار می‌رود — و در نهایت به ⁦Opus 4.8⁩ می‌رسی، نه ⁦Fable⁩.

چنین جمله‌هایی در مستندات توسعه‌دهنده زندگی می‌کنند، نه در صفحات محصول.

آنچه بنچمارک‌ها نمی‌گویند

قیمت به‌ازای هر توکن به‌عنوان یک معیار خراب شده است. مدل‌ها پیش از پاسخ «فکر می‌کنند»، و این توکن‌های فکرکردن روی همان صورت‌حسابِ پاسخ می‌نشینند. مدلی با نصفِ قیمتِ هر توکن که سه برابر بیشتر فکر می‌کند، در پایانِ ماه گران‌تر تمام می‌شود. ⁦Willison⁩ دقیقاً همین را می‌گوید: مقایسهٔ خامِ قیمت-به-ازای-توکن گمراه‌کننده شده است. هرکس واقعاً بخواهد بداند چیزی چقدر برایش هزینه دارد، باید کارِ روزمرهٔ معمولِ خودش را از هر سه رد کند و به صورت‌حساب نگاه کند — نه به فهرستِ قیمت.

امتحان‌ها را خودِ امتحان‌دهنده‌ها نمره می‌دهند. بعد از اینکه مدل‌های ⁦OpenAI⁩ در ⁦SWE-Bench Pro⁩ از مدل‌های ⁦Anthropic⁩ عقب افتادند، ⁦OpenAI⁩ نقدی بر همین بنچمارک منتشر کرد — با این برآورد که حدود ⁦30%⁩ از تکالیفش خراب است. این ممکن است از نظرِ واقعیت کاملاً درست باشد. اما بازهم شاهدی‌ست که در پروندهٔ خودش شهادت می‌دهد. و همین احتیاط در جهتِ عکس هم هست: هرکس بنچمارکی را جشن بگیرد که در آن پیشتاز است، به همان اندازه ذی‌نفع است.

و از ژوئیهٔ 2026 دیگر فقط ارائه‌دهنده نیست که تصمیم می‌گیرد کِی مدلی عرضه شود. ⁦GPT-5.6⁩ تنها پس از بازبینیِ کامل‌شده از سوی یک نهادِ دولتیِ آمریکا — ⁦Center for AI Standards and Innovation⁩ در وزارتِ بازرگانی — چراغِ سبزِ عرضهٔ گسترده گرفت. این از هر درصدی در این نوشته بیشتر دربارهٔ چند سالِ آینده می‌گوید.

هزینه‌اش چقدر است

What it costs

ChatGPT OpenAI

ChatGPT Go

€8 / month

The cheap middle tier. Runs on Terra.

ChatGPT Plus

€23 / month

The plan most people mean. Free choice of model.

ChatGPT Pro

€229 / month

For constant use and Sol reasoning without a tight cap.

Claude Anthropic

Claude Pro

$20 / month ($17 billed annually)

Includes Claude Code. No cheaper middle tier exists.

Claude Max

from $100 / month ($200 for 20×)

5× or 20× Pro's usage limits. Same models.

Gemini Google

Google AI Plus

$4.99 / month

The cheapest entry in the field, incl. 400 GB storage.

Google AI Pro

$19.99 / month

Plus YouTube Premium Lite and storage — the bundle is the argument.

Google AI Ultra

$99.99 / month ($199.99 for 20×)

5× or 20× Pro's limits, 20 TB storage.

تا تاریخ 24 July 2026. OpenAI برای آلمان قیمت‌ها را به یورو اعلام می‌کند، Anthropic و Google به دلار — بنابراین هر دو ارز اینجا دقیقاً همان‌طور که هر ارائه‌دهنده اعلام کرده نمایش داده می‌شوند.

شکافی که توی چشم می‌زند: ⁦Claude⁩ ردهٔ میانیِ ارزان ندارد. مستقیم از رایگان به ⁦$20⁩ می‌پرد. ⁦ChatGPT⁩ در عوض ⁦Go⁩ را با ⁦€8⁩ دارد، ⁦Google AI Plus⁩ روی ⁦$4.99⁩ نشسته. اگر منظم اما نه به‌صورتِ حرفه‌ای از هوش مصنوعی استفاده می‌کنی، ⁦Anthropic⁩ اساساً پیشنهادی برایت ندارد.

از طرفِ دیگر: ⁦Claude Pro⁩ شاملِ ⁦Claude Code⁩ می‌شود، همان ابزارِ برنامه‌نویسی، بدون هزینهٔ اضافه. هرکس این برایش مهم باشد، از قبل می‌داندش.

چرا این متن تاریخ انقضا دارد

به سرعتش نگاه کن.

⁦OpenAI⁩: ⁦GPT-5.1⁩ در نوامبرِ ⁦2025⁩، ⁦5.2⁩ در دسامبر، ⁦5.4⁩ در مارسِ ⁦2026⁩، ⁦5.5⁩ در ⁦23⁩ آوریل، ⁦5.6⁩ در ⁦9⁩ ژوئیه. پنج نسل در هشت ماه.

⁦Google⁩: ⁦Gemini 3.5 Flash⁩ در ⁦19⁩ مه، ⁦Gemini 3.6 Flash⁩ در ⁦21⁩ ژوئیه. دو ماه.

این در عمل یعنی چه: یک اشتراکِ سالانه شرط‌بندی روی یک مدل نیست، شرط‌بندی روی یک ارائه‌دهنده است — مدلی که انتخاب کرده‌ای، یک سالِ دیگر به همین شکل وجود نخواهد داشت. ⁦Anthropic⁩ به‌جایِ ⁦$20⁩، ⁦$17⁩ برای پرداختِ سالانه تبلیغ می‌کند؛ یعنی ⁦$36⁩ صرفه‌جویی در ازای اینکه دوازده ماه نتوانی نظرت را عوض کنی. در میدانی که هر هشت هفته یک پرچم‌دارِ تازه عرضه می‌کند، این معاملهٔ بدتری‌ست.

ماهانه پرداخت کن. این عملی‌ترین توصیهٔ کلِ این نوشته است.

نظر من

اگر یکی می‌خواهی و ترجیح می‌دهی دیگر به آن فکر نکنی: همانی را بگیر که رابطِ کاربری‌اش کمترین مزاحمت را برایت دارد. تفاوتِ کیفیت کمتر از این روی کارت اثر می‌گذارد که آیا از بازکردنِ آن لذت می‌بری یا نه.

اگر می‌توانی پولِ دوتا را بدهی، ترکیبِ عاقلانه «بهترین به‌علاوهٔ دومین بهترین» نیست — بلکه یکی برای متن و کد، یکی برای رسانه است — و در آن جایگاهِ دوم، ⁦Google⁩ تقریباً بی‌رقیب است.

و اگر سه ماهِ دیگر دوباره از خودت بپرسی که درست انتخاب کرده‌ای یا نه: تا آن‌موقع این نوشته به‌روزرسانی شده. تاریخچهٔ نسخه‌ها در پایینِ صفحه نشانت می‌دهد چه چیزی تغییر کرده.

برای ابزارهای پیرامونِ این مدل‌ها — تصویر، ویدیو، موسیقی، تدوین، اتوماسیون — یک فهرستِ ⁦137⁩ ابزارِ هوش مصنوعی جداگانه دارم که پیوسته به‌روز نگه‌اش می‌دارم.

منابع

همه در ⁦24⁩ ژوئیهٔ ⁦2026⁩ بررسی شده‌اند.

اگر چیزی اینجا به نظرت قدیمی یا اشتباه می‌آید: بهم پیام بده. دقیقاً برای همین تاریخِ بالای صفحه آنجاست.