Gemini 3.8 Flash: همان تعرفه، اما چرا ممکن است صورتحسابتان بالا برود؟
گوگل سومین مدل Flash خود را در شش هفته منتشر کرد: Gemini 3.8 Flash، با همان تعرفهی دو نسل قبل و ادعای پیشرفت محسوس در کدنویسی و کارهای چندمرحلهای. اما در همین معرفی رسمی یک جمله هست که بیشتر از جدولها به کار شما میآید و معمولاً از قلم میافتد: این مدل عمداً بیشتر کار میکند — و بیشتر کار کردن یعنی توکن بیشتر. در این مقاله میبینیم چه چیزی عوض شده، چرا «تعرفهی یکسان» با «صورتحساب یکسان» فرق دارد، و این مدل کجای جدول هزینه میایستد.
Gemini 3.8 Flash دقیقاً چیست؟
تازهترین عضو ردهی Flash از خانوادهی Gemini، یک مدل زبانی بزرگ ساخت گوگل. ردهی Flash در این خانواده یعنی مدلِ کارِ روزمره: سریع، ارزان، و ساختهشده برای حجم بالا — نه بزرگترین مدل ممکن. مشخصات کلیدی:
- پنجرهی متن یک میلیون توکن — همان حافظهی گفتوگوی مدلهای ردهبالا.
- ورودی متن و تصویر، با تمرکز اعلامشده روی کارهای عاملی و کدنویسی طولانی.
- سطوح تلاش قابل تنظیم — و در این نسخه، انتخاب این سطح از همیشه مهمتر است؛ در بخش بعد میبینیم چرا.
- سازنده همزمان نسخهای تخصصی برای کارهای امنیتی معرفی کرده که در دسترس عموم نیست و فقط از راه یک برنامهی تأییدشده به مدافعان امنیتی داده میشود. آنچه در هوشواره و در بازار عمومی هست، همین نسخهی استاندارد است.
«تعرفهی یکسان» با «صورتحساب یکسان» یکی نیست
تعرفهی هر توکن این مدل دقیقاً برابر دو نسل قبل است. اما سازنده صریحاً مینویسد که این نسخه روی مسائل پیچیده «کوشاتر» است: گامهای استدلال بیشتری برمیدارد، ابزارها را پشتسرهم صدا میزند، و — به عبارت خودش — ممکن است توکن بیشتری مصرف کند تا نتیجهی بهتری بگیرد، بهویژه در سطوح تلاش بالا.
این برای شما یک معادلهی ساده میسازد: صورتحساب شما حاصلضرب تعرفه در تعداد توکن است. تعرفه ثابت مانده، پس اگر تعداد توکن بالا برود، هزینهی همان کار بالا میرود — حتی وقتی روی کاغذ «قیمت عوض نشده». در عوض نرخ موفقیت هم بالاتر است، و کاری که در یک بار درست انجام شود از کاری که سه بار تکرار شود ارزانتر تمام میشود.
خودِ سازنده راهحل را هم گفته است، و همان توصیهی عملی ماست: اگر کارتان ساده است سطح تلاش را پایین بیاورید، یا حتی روی نسل قبلی بمانید که هنوز کامل پشتیبانی میشود. سطح بالا را برای مسئلهای نگه دارید که واقعاً سخت است.
«قیمت عوض نشده» یک جملهی نصفه است. قیمتِ هر توکن عوض نشده؛ تعداد توکنها میتواند عوض شده باشد. تنها عددی که به شما دروغ نمیگوید، رقم پایین همان گفتوگوی واقعی خودتان است.
در سنجهها چه چیزی عوض شده؟
سازنده چند سنجه منتشر کرده است. آنچه با اطمینان میشود گفت:
- در DeepSWE — سنجهی حل مستقل مسائل مهندسی نرمافزار از ابتدا تا انتها — از نسل قبل جلو زده (حدود ۶۵ به حدود ۷۱) و به گفتهی سازنده از بیشتر مدلهای بزرگترِ ردهبالا هم بالاتر میایستد.
- در HLE-Verified — آزمون استدلال چندمرحلهای در رشتههای علمی و تخصصی — امتیاز ۵۴٫۹ گرفته است.
- در سنجههای مالی و حقوقی تخصصی، سازنده میگوید هم از نسل قبل و هم از مدلهای ردهبالا جلوتر است.
- مقاومت در برابر «تزریق دستور» — حملهای که در آن متنِ ورودی سعی میکند مدل را از کار اصلیاش منحرف کند — بهطور محسوسی بهتر شده. برای هر کسی که مدل را روی محتوای بیرونی مثل صفحهی وب یا سند ناشناس اجرا میکند، این از خیلی از ردیفهای دیگر مهمتر است.
یک نکته دربارهی روش: بعضی رسانهها برای سنجهی کار در خط فرمان دو عدد متفاوت منتشر کردهاند و ما نتوانستیم هیچکدام را از منبع رسمی تأیید کنیم، بنابراین اینجا نیاوردیم. عددی که نشود راستیآزماییاش کرد، بهتر است اصلاً نوشته نشود.
سنجهها را سازندهها منتشر میکنند و طبیعی است که بهترین ردیفهایشان را نشان دهند. کار ما این نیست که باورشان کنیم یا ردشان کنیم؛ این است که بدانیم کدام ردیف به کار ما میخورد.
— تیم هوشواره
سه نسل، یک تعرفه
نکتهی جالب این خانواده، ثبات قیمت در سه نسل پیاپی است. جدول زیر تعرفه را بهصورت شاخص نسبی نشان میدهد (Gemini 3.8 Flash برابر ۱):
| نسل | تعرفهی ورودی (شاخص) | تعرفهی خروجی (شاخص) | تاریخ انتشار |
|---|---|---|---|
| Gemini 3.8 Flash | ۱٫۰ | ۱٫۰ | شهریور ۱۴۰۵ |
| Gemini 3.7 Flash | ۱٫۰ | ۱٫۰ | مرداد ۱۴۰۵ |
| Gemini 3.6 Flash | ۱٫۰ | ۱٫۰ | تیر ۱۴۰۵ |
| Gemini 3.5 Flash | ۲٫۰ | ۲٫۴ | اردیبهشت ۱۴۰۵ |
یعنی از نسل ۳٫۶ تا امروز، تعرفه دستنخورده مانده و آنچه عوض شده کیفیت بوده است — و پیش از آن، در جهش از ۳٫۵ به ۳٫۶، تعرفه به نصف رسیده بود. برای کسی که روی این خانواده گردشکار ساخته، این ثبات خودش یک ویژگی است.
یک تذکر لازم: سازنده این تعرفه را «قیمت معرفی» مینامد، نه قیمت دائمی. پس بعید نیست روزی تغییر کند؛ مرجع همیشگی، عدد بهروزِ هر مدل در کاتالوگ مدلهاست، نه این جدول.
مقایسهی هزینه با بقیهی بازار
برای اینکه مقایسه معنادار باشد، هزینهی Gemini 3.8 Flash را برابر ۱ میگیریم. ستون آخر یک ترکیب واقعگرایانه از گفتوگوی معمولی است (۵ واحد ورودی به ازای هر ۱ واحد خروجی).
| مدل | شاخص ورودی | شاخص خروجی | شاخص گفتوگوی معمول |
|---|---|---|---|
| Gemini 3.8 Flash | ۱٫۰ | ۱٫۰ | ۱٫۰۰ |
| GLM-5.3 Flash | ۰٫۱۰ | ۰٫۰۷ | ۰٫۰۸ |
| DeepSeek V4 Flash | ۰٫۱۲ | ۰٫۰۵ | ۰٫۰۸ |
| GLM-5.3 | ۱٫۸۷ | ۱٫۱۷ | ۱٫۵۲ |
| Claude Sonnet 5 | ۲٫۶۷ | ۲٫۶۷ | ۲٫۶۷ |
| Claude Opus 5 | ۶٫۶۷ | ۶٫۶۷ | ۶٫۶۷ |
| Claude Fable 5.1 | ۱۳٫۳۳ | ۱۳٫۳۳ | ۱۳٫۳۳ |
این جدول جای دقیق مدل را نشان میدهد: در میانه. حدود یکسیزدهمِ گرانترین پرچمدار بازار، اما حدود دوازده برابرِ ارزانترین مدلهای سبک مثل GLM-5.3 Flash. پس برچسب «Flash» را نباید با «ارزانترین» یکی گرفت؛ در این خانواده Flash یعنی ردهی کارِ روزمرهی همان سازنده، نه ارزانترین گزینهی بازار.
پس چهوقت این مدل، چهوقت مدل دیگر؟
- سراغ Gemini 3.8 Flash بروید وقتی کار عاملی و چندمرحلهای دارید، کدنویسی طولانی در جریان است، با محتوای بیرونی و ناشناس کار میکنید (بهخاطر مقاومت بهتر در برابر تزریق دستور)، یا کارتان مالی و حقوقی تخصصی است.
- سراغ یک مدل سبکتر بروید برای ترجمه، خلاصه و پاسخ کوتاه. اختلاف هزینه بیش از ده برابر است و در این دسته کارها معمولاً اختلاف کیفیتی حس نمیشود.
- سراغ یک پرچمدار بروید فقط وقتی مسئله واقعاً سخت است و شکستخوردن گرانتر از هزینهی مدل تمام میشود.
- سطح تلاش را جدی بگیرید. در این نسخه، پایینآوردن سطح تلاش مؤثرترین اهرمی است که برای کنترل هزینه در اختیار دارید.
لازم هم نیست از پیش تصمیم بگیرید: در آرنای مدلها همان درخواست واقعی خودتان را همزمان به چند مدل بدهید و پاسخ و هزینه را کنار هم ببینید.
پرسشهای متداول
اگر روی Gemini 3.7 Flash کار میکنم، ارتقا بدهم؟
اگر کارتان پیچیده و چندمرحلهای است، بله — کیفیت بالاتر است و تعرفه یکسان. اگر کارتان ساده و پرحجم است، لزوماً نه: ممکن است همان کار با توکن بیشتری تمام شود و گرانتر دربیاید. نسل قبل هنوز کامل پشتیبانی میشود و سازنده خودش آن را برای بارهای کاریِ «کاراییمحور» پیشنهاد میدهد.
چرا ممکن است هزینهام بالا برود وقتی قیمت عوض نشده؟
چون قیمت هر توکن ثابت است، نه تعداد توکنها. این نسخه عمداً برای مسائل سخت گامهای بیشتری برمیدارد. راه کنترلش پایینآوردن سطح تلاش است. بهترین کار این است که یک کار واقعی خودتان را یکبار با هر دو نسل اجرا کنید و رقم پایین صفحه را مقایسه کنید.
نسخهی امنیتیاش را میشود استفاده کرد؟
نه. آن نسخه فقط از راه یک برنامهی تأییدشده به مدافعان امنیتی و نهادهای مشخص داده میشود و در بازار عمومی — و در نتیجه در هوشواره — در دسترس نیست. آنچه اینجا میبینید نسخهی استاندارد است.
فارسی را خوب میفهمد؟
خانوادهی Gemini در کار چندزبانه قوی است، اما هیچ سنجهی عمومیای کیفیت فارسی را جداگانه اندازه نمیگیرد. توصیهی ما ساده است: یک نمونهی واقعی از کار خودتان را در آرنا به دو سه مدل بدهید و خودتان قضاوت کنید.
چطور در هوشواره از آن استفاده کنم؟
مثل هر مدل دیگر: در صفحهی گفتوگو از فهرست مدلها انتخابش کنید. هزینهی هر پاسخ پیش و پس از ارسال بهصورت تومانی نمایش داده میشود. اگر توسعهدهندهاید، از طریق API هم در دسترس است.
جمعبندی
Gemini 3.8 Flash یک بهروزرسانی سنجیده است: کیفیت بالاتر در کدنویسی و کارهای چندمرحلهای، مقاومت بهتر در برابر تزریق دستور، و تعرفهای که سه نسل است تکان نخورده. در عین حال، این نسخه عمداً بیشتر «فکر میکند» و همین میتواند صورتحساب کارهای ساده را بالا ببرد — چیزی که با انتخاب درست سطح تلاش کنترل میشود.
سادهترین راه قضاوت، امتحانکردن با کار خودتان است. فهرست کامل مدلها و تعرفهی تومانی هرکدام در کاتالوگ مدلها و طرحهای اشتراک در صفحهی تعرفهها است. حساب ندارید؟ ثبتنام کمتر از یک دقیقه طول میکشد.