Gemini 3.8 Flash: همان تعرفه، اما چرا ممکن است صورت‌حساب‌تان بالا برود؟

Gemini 3.8 Flash: همان تعرفه، اما چرا ممکن است صورت‌حساب‌تان بالا برود؟

Gemini 3.8 Flash جمینای گوگل مدل زبانی بزرگ مقایسه مدل‌های هوش مصنوعی هزینه هوش مصنوعی بنچمارک هوش مصنوعی هوش مصنوعی عاملی

گوگل سومین مدل Flash خود را در شش هفته منتشر کرد: Gemini 3.8 Flash، با همان تعرفه‌ی دو نسل قبل و ادعای پیشرفت محسوس در کدنویسی و کارهای چندمرحله‌ای. اما در همین معرفی رسمی یک جمله هست که بیشتر از جدول‌ها به کار شما می‌آید و معمولاً از قلم می‌افتد: این مدل عمداً بیشتر کار می‌کند — و بیشتر کار کردن یعنی توکن بیشتر. در این مقاله می‌بینیم چه چیزی عوض شده، چرا «تعرفه‌ی یکسان» با «صورت‌حساب یکسان» فرق دارد، و این مدل کجای جدول هزینه می‌ایستد.

Gemini 3.8 Flash دقیقاً چیست؟

تازه‌ترین عضو رده‌ی Flash از خانواده‌ی Gemini، یک مدل زبانی بزرگ ساخت گوگل. رده‌ی Flash در این خانواده یعنی مدلِ کارِ روزمره: سریع، ارزان، و ساخته‌شده برای حجم بالا — نه بزرگ‌ترین مدل ممکن. مشخصات کلیدی:

  • پنجره‌ی متن یک میلیون توکن — همان حافظه‌ی گفت‌وگوی مدل‌های رده‌بالا.
  • ورودی متن و تصویر، با تمرکز اعلام‌شده روی کارهای عاملی و کدنویسی طولانی.
  • سطوح تلاش قابل تنظیم — و در این نسخه، انتخاب این سطح از همیشه مهم‌تر است؛ در بخش بعد می‌بینیم چرا.
  • سازنده هم‌زمان نسخه‌ای تخصصی برای کارهای امنیتی معرفی کرده که در دسترس عموم نیست و فقط از راه یک برنامه‌ی تأییدشده به مدافعان امنیتی داده می‌شود. آنچه در هوشواره و در بازار عمومی هست، همین نسخه‌ی استاندارد است.

«تعرفه‌ی یکسان» با «صورت‌حساب یکسان» یکی نیست

تعرفه‌ی هر توکن این مدل دقیقاً برابر دو نسل قبل است. اما سازنده صریحاً می‌نویسد که این نسخه روی مسائل پیچیده «کوشاتر» است: گام‌های استدلال بیشتری برمی‌دارد، ابزارها را پشت‌سرهم صدا می‌زند، و — به عبارت خودش — ممکن است توکن بیشتری مصرف کند تا نتیجه‌ی بهتری بگیرد، به‌ویژه در سطوح تلاش بالا.

این برای شما یک معادله‌ی ساده می‌سازد: صورت‌حساب شما حاصل‌ضرب تعرفه در تعداد توکن است. تعرفه ثابت مانده، پس اگر تعداد توکن بالا برود، هزینه‌ی همان کار بالا می‌رود — حتی وقتی روی کاغذ «قیمت عوض نشده». در عوض نرخ موفقیت هم بالاتر است، و کاری که در یک بار درست انجام شود از کاری که سه بار تکرار شود ارزان‌تر تمام می‌شود.

خودِ سازنده راه‌حل را هم گفته است، و همان توصیه‌ی عملی ماست: اگر کارتان ساده است سطح تلاش را پایین بیاورید، یا حتی روی نسل قبلی بمانید که هنوز کامل پشتیبانی می‌شود. سطح بالا را برای مسئله‌ای نگه دارید که واقعاً سخت است.

«قیمت عوض نشده» یک جمله‌ی نصفه است. قیمتِ هر توکن عوض نشده؛ تعداد توکن‌ها می‌تواند عوض شده باشد. تنها عددی که به شما دروغ نمی‌گوید، رقم پایین همان گفت‌وگوی واقعی خودتان است.

در سنجه‌ها چه چیزی عوض شده؟

سازنده چند سنجه منتشر کرده است. آنچه با اطمینان می‌شود گفت:

  • در DeepSWE — سنجه‌ی حل مستقل مسائل مهندسی نرم‌افزار از ابتدا تا انتها — از نسل قبل جلو زده (حدود ۶۵ به حدود ۷۱) و به گفته‌ی سازنده از بیشتر مدل‌های بزرگ‌ترِ رده‌بالا هم بالاتر می‌ایستد.
  • در HLE-Verified — آزمون استدلال چندمرحله‌ای در رشته‌های علمی و تخصصی — امتیاز ۵۴٫۹ گرفته است.
  • در سنجه‌های مالی و حقوقی تخصصی، سازنده می‌گوید هم از نسل قبل و هم از مدل‌های رده‌بالا جلوتر است.
  • مقاومت در برابر «تزریق دستور» — حمله‌ای که در آن متنِ ورودی سعی می‌کند مدل را از کار اصلی‌اش منحرف کند — به‌طور محسوسی بهتر شده. برای هر کسی که مدل را روی محتوای بیرونی مثل صفحه‌ی وب یا سند ناشناس اجرا می‌کند، این از خیلی از ردیف‌های دیگر مهم‌تر است.

یک نکته درباره‌ی روش: بعضی رسانه‌ها برای سنجه‌ی کار در خط فرمان دو عدد متفاوت منتشر کرده‌اند و ما نتوانستیم هیچ‌کدام را از منبع رسمی تأیید کنیم، بنابراین اینجا نیاوردیم. عددی که نشود راستی‌آزمایی‌اش کرد، بهتر است اصلاً نوشته نشود.

سنجه‌ها را سازنده‌ها منتشر می‌کنند و طبیعی است که بهترین ردیف‌هایشان را نشان دهند. کار ما این نیست که باورشان کنیم یا ردشان کنیم؛ این است که بدانیم کدام ردیف به کار ما می‌خورد.

— تیم هوشواره

سه نسل، یک تعرفه

نکته‌ی جالب این خانواده، ثبات قیمت در سه نسل پیاپی است. جدول زیر تعرفه را به‌صورت شاخص نسبی نشان می‌دهد (Gemini 3.8 Flash برابر ۱):

نسلتعرفه‌ی ورودی (شاخص)تعرفه‌ی خروجی (شاخص)تاریخ انتشار
Gemini 3.8 Flash۱٫۰۱٫۰شهریور ۱۴۰۵
Gemini 3.7 Flash۱٫۰۱٫۰مرداد ۱۴۰۵
Gemini 3.6 Flash۱٫۰۱٫۰تیر ۱۴۰۵
Gemini 3.5 Flash۲٫۰۲٫۴اردیبهشت ۱۴۰۵

یعنی از نسل ۳٫۶ تا امروز، تعرفه دست‌نخورده مانده و آنچه عوض شده کیفیت بوده است — و پیش از آن، در جهش از ۳٫۵ به ۳٫۶، تعرفه به نصف رسیده بود. برای کسی که روی این خانواده گردش‌کار ساخته، این ثبات خودش یک ویژگی است.

یک تذکر لازم: سازنده این تعرفه را «قیمت معرفی» می‌نامد، نه قیمت دائمی. پس بعید نیست روزی تغییر کند؛ مرجع همیشگی، عدد به‌روزِ هر مدل در کاتالوگ مدل‌هاست، نه این جدول.

مقایسه‌ی هزینه با بقیه‌ی بازار

برای اینکه مقایسه معنادار باشد، هزینه‌ی Gemini 3.8 Flash را برابر ۱ می‌گیریم. ستون آخر یک ترکیب واقع‌گرایانه از گفت‌وگوی معمولی است (۵ واحد ورودی به ازای هر ۱ واحد خروجی).

مدلشاخص ورودیشاخص خروجیشاخص گفت‌وگوی معمول
Gemini 3.8 Flash۱٫۰۱٫۰۱٫۰۰
GLM-5.3 Flash۰٫۱۰۰٫۰۷۰٫۰۸
DeepSeek V4 Flash۰٫۱۲۰٫۰۵۰٫۰۸
GLM-5.3۱٫۸۷۱٫۱۷۱٫۵۲
Claude Sonnet 5۲٫۶۷۲٫۶۷۲٫۶۷
Claude Opus 5۶٫۶۷۶٫۶۷۶٫۶۷
Claude Fable 5.1۱۳٫۳۳۱۳٫۳۳۱۳٫۳۳

این جدول جای دقیق مدل را نشان می‌دهد: در میانه. حدود یک‌سیزدهمِ گران‌ترین پرچم‌دار بازار، اما حدود دوازده برابرِ ارزان‌ترین مدل‌های سبک مثل GLM-5.3 Flash. پس برچسب «Flash» را نباید با «ارزان‌ترین» یکی گرفت؛ در این خانواده Flash یعنی رده‌ی کارِ روزمره‌ی همان سازنده، نه ارزان‌ترین گزینه‌ی بازار.

پس چه‌وقت این مدل، چه‌وقت مدل دیگر؟

  • سراغ Gemini 3.8 Flash بروید وقتی کار عاملی و چندمرحله‌ای دارید، کدنویسی طولانی در جریان است، با محتوای بیرونی و ناشناس کار می‌کنید (به‌خاطر مقاومت بهتر در برابر تزریق دستور)، یا کارتان مالی و حقوقی تخصصی است.
  • سراغ یک مدل سبک‌تر بروید برای ترجمه، خلاصه و پاسخ کوتاه. اختلاف هزینه بیش از ده برابر است و در این دسته کارها معمولاً اختلاف کیفیتی حس نمی‌شود.
  • سراغ یک پرچم‌دار بروید فقط وقتی مسئله واقعاً سخت است و شکست‌خوردن گران‌تر از هزینه‌ی مدل تمام می‌شود.
  • سطح تلاش را جدی بگیرید. در این نسخه، پایین‌آوردن سطح تلاش مؤثرترین اهرمی است که برای کنترل هزینه در اختیار دارید.

لازم هم نیست از پیش تصمیم بگیرید: در آرنای مدل‌ها همان درخواست واقعی خودتان را هم‌زمان به چند مدل بدهید و پاسخ و هزینه را کنار هم ببینید.

پرسش‌های متداول

اگر روی Gemini 3.7 Flash کار می‌کنم، ارتقا بدهم؟

اگر کارتان پیچیده و چندمرحله‌ای است، بله — کیفیت بالاتر است و تعرفه یکسان. اگر کارتان ساده و پرحجم است، لزوماً نه: ممکن است همان کار با توکن بیشتری تمام شود و گران‌تر دربیاید. نسل قبل هنوز کامل پشتیبانی می‌شود و سازنده خودش آن را برای بارهای کاریِ «کارایی‌محور» پیشنهاد می‌دهد.

چرا ممکن است هزینه‌ام بالا برود وقتی قیمت عوض نشده؟

چون قیمت هر توکن ثابت است، نه تعداد توکن‌ها. این نسخه عمداً برای مسائل سخت گام‌های بیشتری برمی‌دارد. راه کنترلش پایین‌آوردن سطح تلاش است. بهترین کار این است که یک کار واقعی خودتان را یک‌بار با هر دو نسل اجرا کنید و رقم پایین صفحه را مقایسه کنید.

نسخه‌ی امنیتی‌اش را می‌شود استفاده کرد؟

نه. آن نسخه فقط از راه یک برنامه‌ی تأییدشده به مدافعان امنیتی و نهادهای مشخص داده می‌شود و در بازار عمومی — و در نتیجه در هوشواره — در دسترس نیست. آنچه اینجا می‌بینید نسخه‌ی استاندارد است.

فارسی را خوب می‌فهمد؟

خانواده‌ی Gemini در کار چندزبانه قوی است، اما هیچ سنجه‌ی عمومی‌ای کیفیت فارسی را جداگانه اندازه نمی‌گیرد. توصیه‌ی ما ساده است: یک نمونه‌ی واقعی از کار خودتان را در آرنا به دو سه مدل بدهید و خودتان قضاوت کنید.

چطور در هوشواره از آن استفاده کنم؟

مثل هر مدل دیگر: در صفحه‌ی گفت‌وگو از فهرست مدل‌ها انتخابش کنید. هزینه‌ی هر پاسخ پیش و پس از ارسال به‌صورت تومانی نمایش داده می‌شود. اگر توسعه‌دهنده‌اید، از طریق API هم در دسترس است.

جمع‌بندی

Gemini 3.8 Flash یک به‌روزرسانی سنجیده است: کیفیت بالاتر در کدنویسی و کارهای چندمرحله‌ای، مقاومت بهتر در برابر تزریق دستور، و تعرفه‌ای که سه نسل است تکان نخورده. در عین حال، این نسخه عمداً بیشتر «فکر می‌کند» و همین می‌تواند صورت‌حساب کارهای ساده را بالا ببرد — چیزی که با انتخاب درست سطح تلاش کنترل می‌شود.

ساده‌ترین راه قضاوت، امتحان‌کردن با کار خودتان است. فهرست کامل مدل‌ها و تعرفه‌ی تومانی هرکدام در کاتالوگ مدل‌ها و طرح‌های اشتراک در صفحه‌ی تعرفه‌ها است. حساب ندارید؟ ثبت‌نام کمتر از یک دقیقه طول می‌کشد.

مطالب دیگر