قیمت API gemini-embedding-2 به تومانجمنای
مدل embedding از خانواده Gemini 2 برای جستوجوی معنایی و RAG
معرفی.
gemini-embedding-2 مدل embedding گوگل است؛ خروجی آن به جای متن، بردار عددی است. برای جستوجوی معنایی، خوشهبندی، طبقهبندی و ساخت پایپلاینهای RAG روی پایگاهدادههای برداری استفاده میشود. فراخوانی از طریق endpoint استاندارد /v1/embeddings انجام میشود و با کلاینتهای سازگار با OpenAI کار میکند.
پنجره ورودی آن ۸۱۹۲ توکن است، یعنی متنهای طولانیتر را باید پیش از ارسال chunk کنید. تخفیف cached input برای این مدل اعمال نمیشود.
برای چه چیزی خوب است.
- ●جستوجوی معنایی و RAG
- ●خوشهبندی و طبقهبندی متن
- ●ایندکسگذاری در vector database
- ●تولید یا خلاصهسازی متن — خروجی فقط بردار است
- ●ورودیهای بلندتر از ۸۱۹۲ توکن بدون chunking
جزئیات.
- سرویسدهنده
- خانواده
- Gemini 2
- پنجرهٔ context
- ۸٬۱۹۲ توکن
- استریم
- خیر
- اندپوینتها
- /v1/embeddings
- معرفی
- بهصورتِ خودکار از مشخصاتِ منتشرشدهٔ مدل نوشته شده — بدون ادعای بنچمارک.
یک مثالِ کوتاه.
کافی است را به تنظیم کنی و کلیدِ بومیات را از داشبورد بگیری.
مستنداتِ کاملfrom openai import OpenAI
client = OpenAI(
base_url="https://1xai.ir/v1",
api_key="1xai-...",
)
resp = client.chat.completions.create(
model="gemini-embedding-2",
messages=[{"role": "user", "content": "سلام"}],
)
print(resp.choices[0].message.content)سوالهای رایج.
دربارهٔ و استفادهاش از داخل ایران.
قیمت gemini-embedding-2 برای کاربران ایرانی چقدر است؟
هزینهٔ هر ۱ میلیون توکن ۵۴٬۸۶۴ تومان است — قیمتِ رسمیِ Google بهاضافهٔ ۲۰٪ مارکآپِ 1xAi. نرخِ دلار هر روز ساعتِ ۹ صبح با بازار همگام میشود.
آیا میتوانم gemini-embedding-2 را بدون VPN از داخل ایران استفاده کنم؟
بله. کافی است base_url کلاینتِ OpenAI خود را به https://1xai.ir/v1 تغییر دهید و کلیدِ بومیِ 1xAi را جایگزین کنید. هیچ VPN، پروکسی، یا تنظیمِ شبکهای لازم نیست. مدلِ gemini-embedding-2 مستقیماً از طریقِ زیرساختِ 1xAi در دسترس است.
gemini-embedding-2 برای چه کارهایی مناسبتر است؟
مدل embedding از خانواده Gemini 2 برای جستوجوی معنایی و RAG بهترین کاربردها: جستوجوی معنایی و RAG، خوشهبندی و طبقهبندی متن، ایندکسگذاری در vector database.
gemini-embedding-2 در چه کارهایی ضعیف است؟
این مدل برای: تولید یا خلاصهسازی متن — خروجی فقط بردار است، ورودیهای بلندتر از ۸۱۹۲ توکن بدون chunking مناسب نیست. در این موارد مدلِ دیگری از خانوادهٔ Gemini 2 یا مدلِ تخصصیتری انتخاب کنید.
پنجرهٔ context مدلِ gemini-embedding-2 چقدر است؟
این مدل تا ۸۱۹۲ توکن را در یک درخواست میپذیرد. این محدودیت شامل پیامِ ورودی، تاریخچهٔ گفتگو، و پاسخِ مدل میشود.
چگونه با کارت ایرانی هزینهٔ gemini-embedding-2 را پرداخت کنم؟
از طریق درگاهِ زرینپال در داشبوردِ 1xAi شارژ کنید. هر کارتِ بانکیِ شتاب قابل قبول است. حداقل ۱۰۰هزار تومان و حداکثر ۲۵میلیون تومان در هر تراکنش.
- text-embedding-3-largeبزرگترین مدلِ تعبیهسازیِ OpenAI — برای جستوجوی معناییِ دقیق
- text-embedding-3-smallمدلِ ارزانترِ تعبیهسازی — برای ترافیکِ سنگین
فراتر از مدلهای متنی، با همان کلید و همان کیفِ پولِ تومانی API تبدیل گفتار به متن فارسی (Whisper) و API تولید عکس با هوش مصنوعی هم در دسترساند.