وبلاگ / Gemini 3.8 Flash چیست و چرا پیش‌فرض llmapi است؟

Gemini 3.8 Flash چیست و چرا پیش‌فرض llmapi است؟

2026-10-06

اگر Claude Code، Codex یا هر ابزار دیگری را با دستور یک‌خطی llmapi راه‌اندازی کرده باشید، اولین مدلی که جواب می‌دهد Gemini 3.8 Flash (high) است. این مطلب توضیح می‌دهد این مدل چیست، سطح‌های استدلالش چه فرقی دارند، چرا پیش‌فرض شده و کی بهتر است مدل دیگری انتخاب کنید.

Gemini 3.8 Flash در یک نگاه

Gemini 3.8 Flash از خانوادهٔ Flash گوگل است؛ خانواده‌ای که برای سرعت و هزینهٔ کم طراحی شده، ولی در نسل‌های جدید توانایی استدلال و کار با ابزار هم پیدا کرده. برای ایجنت‌های برنامه‌نویسی چند ویژگی آن مهم است:

  • استدلال قابل تنظیم: مدل می‌تواند قبل از جواب دادن «فکر کند» و میزان این فکر کردن را شما تعیین می‌کنید.
  • پشتیبانی از tool calling: ایجنت‌ها برای خواندن فایل، ویرایش و اجرای دستور به همین قابلیت نیاز دارند.
  • context بزرگ: در llmapi تا حدود یک میلیون توکن context می‌پذیرد، پس بخش بزرگی از یک پروژه در دید مدل جا می‌شود.
  • سرعت: در حلقهٔ ایجنتی که ده‌ها بار مدل را صدا می‌زند، سرعت هر مرحله در زمان کل خیلی اثر دارد.

سه سطح استدلال: low، medium، high

در llmapi این مدل با سه شناسه در دسترس است:

شناسهسطح استدلالمناسب برای
gemini-3.8-flash-highhighکار ایجنتی چندمرحله‌ای، رفع باگ، فیچر جدید
gemini-3.8-flashmediumتعادل بین سرعت و دقت
gemini-3.8-flash-lowlowویرایش ساده، تغییر نام، فرمت، سؤال سریع

فرق این سطح‌ها در مقدار «فکر کردن» قبل از جواب است. در سطح high مدل بیشتر برنامه‌ریزی می‌کند، احتمال‌ها را بررسی می‌کند و بعد اقدام می‌کند؛ در سطح low سریع‌تر جواب می‌دهد.

یک نکتهٔ مهم دربارهٔ مصرف: توکن‌های فکر کردن جزو خروجی حساب می‌شوند. پس سطح low برای کارهای ساده هم سریع‌تر است هم کردیت کمتری مصرف می‌کند.

چرا Gemini 3.8 Flash پیش‌فرض است؟

۱. بزرگ‌ترین سهمیه

مصرف در llmapi در دو بخش جدا حساب می‌شود: سهمیهٔ Gemini و سهمیهٔ Claude & GPT-OSS. سهمیهٔ Gemini خیلی بزرگ‌تر است؛ مثلاً در پلن Plus (ماهی ۵ دلار) ۲۱ میلیون کردیت در هر بازهٔ پنج‌ساعته، در مقابل ۱ میلیون برای Claude. Gemini 3.8 Flash هم به ازای هر توکن یک کردیت حساب می‌شود، در حالی که مدل‌های بزرگ‌تر کردیت بیشتری مصرف می‌کنند.

۲. در دورهٔ آزمایشی هم فعال است

دورهٔ آزمایشی رایگان (۲ میلیون کردیت، یک ساعت از اولین درخواست) همهٔ مدل‌های Gemini را پوشش می‌دهد. پیش‌فرض بودن Gemini 3.8 Flash یعنی هر ابزاری که با دستور یک‌خطی تنظیم شود، از همان اول کار می‌کند.

۳. مناسب حلقهٔ ایجنتی

ایجنت‌ها در هر مرحله کل گفتگو و فایل‌ها را دوباره می‌فرستند. مدلی که سریع است، ابزارها را درست صدا می‌زند و با سطح high قبل از اقدام فکر می‌کند، برای این حلقه انتخاب منطقی است. بیشتر کارهای روزمرهٔ برنامه‌نویسی به چیزی بیشتر نیاز ندارند.

۴. کش ورودی

ورودی کش‌شده فقط ۱۰٪ ورودی عادی حساب می‌شود. در سشن‌های طولانی که بخش بزرگ هر درخواست تکراری است، این یعنی سهمیهٔ Flash خیلی بیشتر دوام می‌آورد.

کی سراغ مدل دیگری برویم؟

Gemini 3.1 Pro

قوی‌ترین مدل Gemini در llmapi (gemini-3.1-pro-high و gemini-3.1-pro-low). وقتی سراغش بروید که:

  • Flash چند بار پشت سر هم یک راه‌حل اشتباه را تکرار می‌کند.
  • مسئله به در نظر گرفتن هم‌زمان قیدهای زیادی نیاز دارد؛ مثل طراحی معماری یا باگ‌های هم‌زمانی.
  • استدلال طولانی و چندمرحله‌ای لازم است.

Gemini 3.1 Pro کردیت بیشتری به ازای هر توکن مصرف می‌کند، اما همچنان از سهمیهٔ Gemini.

Claude Sonnet 4.6 و Claude Opus 4.6

در پلن‌های پولی در دسترس‌اند و از سهمیهٔ جداگانه و کوچک‌تر «Claude & GPT-OSS» مصرف می‌کنند. مناسب وقتی که:

  • سبک کار Claude را برای یک کار ایجنتی پیچیده ترجیح می‌دهید.
  • یک مسئلهٔ واقعاً سخت دارید و می‌خواهید نظر یک مدل دیگر را هم داشته باشید (Opus برای سخت‌ترین موارد).

الگوی پیشنهادی: برنامه‌ریزی یا باز کردن گره یک مسئلهٔ سخت با Claude، بعد برگشتن به Gemini 3.8 Flash برای پیاده‌سازی. در Claude Code این فقط دو بار دستور /model است.

Gemini 3.8 Flash (low)

برای کارهای مکانیکی: تغییر نام یک متغیر در کل پروژه، اضافه کردن type، نوشتن تست‌های ساده، یا سؤال‌های کوتاه. سریع‌تر و کم‌مصرف‌تر.

چطور مدل را عوض کنیم؟

ابزارروش
Claude Codeدستور /model یا claude --model gemini-3.1-pro-high
Codexدستور /model یا codex --model gemini-3.8-flash-low
Gemini CLIمقدار GEMINI_MODEL در ~/.gemini/.env یا gemini --model …
OpenCodeدستور /models
Cline / Roo Codeفیلد Model ID در تنظیمات

راهنمای کامل هر ابزار در صفحهٔ راهنماها هست.

جمع‌بندی

Gemini 3.8 Flash (high) پیش‌فرض llmapi است چون در حلقهٔ ایجنتی سریع و قابل اعتماد است، بزرگ‌ترین سهمیه را دارد و در دورهٔ آزمایشی هم کار می‌کند. سطح low را برای کارهای ساده نگه دارید، و Gemini 3.1 Pro و Claude را برای وقتی که واقعاً لازم‌اند.

حساب رایگان بسازید و با یک ساعت آزمایش رایگان، Gemini 3.8 Flash را روی پروژهٔ خودتان امتحان کنید:

curl -fsSL https://llmapi.cheap/install.sh | sh