قیمت API gemini-flash-lite-latest به تومانجمنای
نسخه سبک Gemini Flash با context یکمیلیون توکنی برای کارهای پرحجم و روزمره
معرفی.
gemini-flash-lite-latest مدل چت استاندارد از خانواده Gemini شرکت Google است که روی 1xAi با همان endpoint سازگار با OpenAI یعنی /v1/chat/completions فراخوانی میشود. پنجره context آن 1,048,576 توکن است، بنابراین برای دادن اسناد طولانی، لاگها یا مجموعهای از فایلها در یک درخواست جا دارد.
این مدل از تخفیف cached input پشتیبانی میکند؛ اگر بخش ابتدایی prompt شما (مثل system prompt یا یک سند مرجع ثابت) بین درخواستها تکرار شود، هزینه آن بخش کمتر حساب میشود. برچسب latest یعنی به آخرین نسخه منتشرشده اشاره میکند و ممکن است با بهروزرسانیهای Google تغییر کند، پس برای محیط production این را در نظر بگیرید.
برای چه چیزی خوب است.
- ●پردازش اسناد و متنهای طولانی
- ●درخواستهای پرتکرار با prompt ثابت
- ●کارهای چت روزمره و سبک
- ●بهعنوان tier استاندارد، برای مسائل سنگین استدلالی انتخاب اول نیست
- ●رفتار دقیق و توانمندیهای آن هنوز مستند نشده و باید با تست خودتان سنجیده شود
جزئیات.
- سرویسدهنده
- خانواده
- Gemini
- پنجرهٔ context
- ۱٬۰۴۸٬۵۷۶ توکن
- استریم
- بله — Server-Sent Events
- اندپوینتها
- /v1/chat/completions
- معرفی
- بهصورتِ خودکار از مشخصاتِ منتشرشدهٔ مدل نوشته شده — بدون ادعای بنچمارک.
یک مثالِ کوتاه.
کافی است را به تنظیم کنی و کلیدِ بومیات را از داشبورد بگیری.
مستنداتِ کاملfrom openai import OpenAI
client = OpenAI(
base_url="https://1xai.ir/v1",
api_key="1xai-...",
)
resp = client.chat.completions.create(
model="gemini-flash-lite-latest",
messages=[{"role": "user", "content": "سلام"}],
)
print(resp.choices[0].message.content)سوالهای رایج.
دربارهٔ و استفادهاش از داخل ایران.
قیمت gemini-flash-lite-latest برای کاربران ایرانی چقدر است؟
هزینهٔ هر ۱ میلیون توکنِ ورودی ۲۷٬۹۴۸ تومان و هر ۱ میلیون توکنِ خروجی ۱۱۱٬۷۹۲ تومان است — قیمتِ رسمیِ Google بهاضافهٔ ۲۰٪ مارکآپِ 1xAi. نرخِ دلار هر روز ساعتِ ۹ صبح با بازار همگام میشود.
آیا میتوانم gemini-flash-lite-latest را بدون VPN از داخل ایران استفاده کنم؟
بله. کافی است base_url کلاینتِ OpenAI خود را به https://1xai.ir/v1 تغییر دهید و کلیدِ بومیِ 1xAi را جایگزین کنید. هیچ VPN، پروکسی، یا تنظیمِ شبکهای لازم نیست. مدلِ gemini-flash-lite-latest مستقیماً از طریقِ زیرساختِ 1xAi در دسترس است.
gemini-flash-lite-latest برای چه کارهایی مناسبتر است؟
نسخه سبک Gemini Flash با context یکمیلیون توکنی برای کارهای پرحجم و روزمره بهترین کاربردها: پردازش اسناد و متنهای طولانی، درخواستهای پرتکرار با prompt ثابت، کارهای چت روزمره و سبک.
gemini-flash-lite-latest در چه کارهایی ضعیف است؟
این مدل برای: بهعنوان tier استاندارد، برای مسائل سنگین استدلالی انتخاب اول نیست، رفتار دقیق و توانمندیهای آن هنوز مستند نشده و باید با تست خودتان سنجیده شود مناسب نیست. در این موارد مدلِ دیگری از خانوادهٔ Gemini یا مدلِ تخصصیتری انتخاب کنید.
پنجرهٔ context مدلِ gemini-flash-lite-latest چقدر است؟
این مدل تا ۱۰۴۸۵۷۶ توکن را در یک درخواست میپذیرد. این محدودیت شامل پیامِ ورودی، تاریخچهٔ گفتگو، و پاسخِ مدل میشود.
چگونه با کارت ایرانی هزینهٔ gemini-flash-lite-latest را پرداخت کنم؟
از طریق درگاهِ زرینپال در داشبوردِ 1xAi شارژ کنید. هر کارتِ بانکیِ شتاب قابل قبول است. حداقل ۱۰۰هزار تومان و حداکثر ۲۵میلیون تومان در هر تراکنش.
- gpt-5-nanoارزانترین مدلِ خانوادهٔ GPT-5 — برای ترافیکِ خیلی سنگین
- gpt-4.1مدلِ متعادلِ GPT-4 — هنوز قویترین گزینهٔ بدونِ استدلال
- gpt-4.1-miniنسخهٔ سبکِ GPT-4.1 — تعادلِ خوبی بینِ قیمت و کیفیت
- gpt-4.1-nanoارزانترین مدلِ GPT-4.1 — برای کارهای سادهٔ پرحجم
- gpt-4oمدلِ چندحالتهٔ کلاسیکِ OpenAI — متن + تصویر + صدا
- gpt-4o-miniنسخهٔ مقرونبهصرفهٔ GPT-4o — قهرمانِ ارزشبرابرِ هزینه
فراتر از مدلهای متنی، با همان کلید و همان کیفِ پولِ تومانی API تبدیل گفتار به متن فارسی (Whisper) و API تولید عکس با هوش مصنوعی هم در دسترساند.