رفتن به محتوا

قیمت‌گذاری و صورت‌حساب

نحوه محاسبه هزینه و مدیریت موجودی

مستندات

قیمت هر مدل کجاست؟

این صفحه قیمت‌ها را فهرست نمی‌کند؛ توضیح می‌دهد که قیمت چطور به مبلغ کسرشده تبدیل می‌شود. عدد هر مدل (قیمت هر یک میلیون توکن ورودی و خروجی) در لیست مدل‌ها است و برای مقایسهٔ چند مدل کنار هم مقایسهٔ مدل‌ها را ببینید.

اگر دنبال یک عدد مشخص هستید، از آنجا شروع کنید و برای فهمیدن اینکه آن عدد چطور به ریال کسرشده تبدیل می‌شود به این صفحه برگردید.

مدل‌های متنی

قیمت‌گذاری بر اساس توکن‌های مصرف شده:

  • ورودی: قیمت برای هر 1 میلیون توکن ورودی
  • خروجی: قیمت برای هر 1 میلیون توکن خروجی
هزینه = (توکن ورودی / 1,000,000) × قیمت ورودی + (توکن خروجی / 1,000,000) × قیمت خروجی

«توکن ورودی» یعنی هرچه شما فرستاده‌اید (پیام سیستم، کل تاریخچهٔ گفت‌وگو و پرسش تازه) و «توکن خروجی» یعنی چیزی که مدل نوشته است. هر دو در فیلد usage پاسخ برمی‌گردند، پس لازم نیست خودتان توکن بشمارید.

چون کل تاریخچه در هر درخواست دوباره فرستاده می‌شود، هزینهٔ یک گفت‌وگوی طولانی با هر پیام تازه بیشتر می‌شود. ساختار messages در Chat Completions توضیح داده شده است.

تولید تصویر

  • Standard: قیمت پایه از price_per_m_input
  • HD: هزینه 2 برابر کیفیت استاندارد

price_per_m_input همان «قیمت هر یک میلیون توکن ورودی» است که در لیست مدل‌ها برای هر مدل نوشته شده؛ برای تولید تصویر همان عدد مبنای هزینهٔ هر تصویر قرار می‌گیرد. نحوهٔ ساخت تصویر و پارامترهایش در تولید تصویر با AI است.

هزینهٔ پیوست

پیوست‌ها مثل توکن ورودی عادی حساب می‌شوند، ولی حجم فایل هزینه را پیش‌بینی نمی‌کند. برای متن، حدوداً یک توکن به ازای هر چهار بایت: یک فایل ۲۵۶ کیلوبایتی چیزی نزدیک ۶۴٬۰۰۰ توکن ورودی است.

PDF گران‌تر و بسیار متغیرتر است. در اندازه‌گیری‌ها یک گواهی یک‌صفحه‌ای ۱٬۶۸۲ توکن و یک سند ۹۸ صفحه‌ای ۲۲۸٬۸۵۳ توکن مصرف کرد؛ آن دو به ازای هر بایت ۲۳ برابر با هم فرق دارند، پس بر پایهٔ حجم برآورد نکنید. قاعدهٔ سرانگشتی ۱٬۵۰۰ تا ۳٬۰۰۰ توکن برای هر صفحه است.

شکل درخواست و محدودیت‌ها در ورودی فایل آمده است.

تبدیل ارز

قیمت‌ها در سیستم به USD ذخیره می‌شوند اما به ریال ایرانی صورت‌حساب می‌شوند:

USD: $0.000006نرخ تبدیل: 1 USD = 43,000 ریالریال: 0.000006 × 43,000 = 0.258 ریال ≈ 1 ریال

مدیریت موجودی

بررسی موجودی:

موجودی فعلی را در داشبورد مشاهده کنید

شارژ کردن:

  1. به بخش "کیف پول" بروید
  2. مبلغ مورد نظر را انتخاب کنید
  3. پرداخت را تکمیل کنید
  4. موجودی فوری بروز می‌شود

اخطار موجودی کم:

درخواست با کد 402 رد می‌شود اگر موجودی <= 0

موجودی را از داخل برنامه هم می‌توانید بخوانید و پیش از یک کار سنگین بررسی کنید:

curl -X GET "https://api-ai.hibanacloud.ir/v1/user/balance" \  -H "Authorization: Bearer YOUR_API_KEY"

فیلدهای پاسخ و بهترین شیوه‌های استفاده از آن در بررسی موجودی کاربر آمده است. دو حالتِ خطای 402 (تمام‌شدن کیف پول در برابر پر شدن سقف بودجهٔ همان کلید) در مدیریت خطاها از هم تفکیک شده‌اند.

پاسخ با هزینه

{  "usage": {    "prompt_tokens": 42,    "completion_tokens": 17,    "total_tokens": 59,    "cost_rial": 125000  }}

هر پاسخ موفق این بلوک را دارد. cost_rial هزینهٔ همان یک درخواست به ریال است، تبدیل ارز پیش‌تر انجام شده و همین مبلغ از کیف پول کسر می‌شود، پس برای گزارش‌گیری لازم نیست چیزی را دوباره حساب کنید.

ردیابی هزینه‌ها

داشبورد فراهم می‌کند:

  • تفکیک هزینه برای هر کلید API
  • مصرف هر مدل
  • نمودار هزینه در طول زمان
  • خروجی گزارش‌های استفاده

نکات صرفه‌جویی

نکات صرفه‌جویی:

  • از مدل‌های ارزان‌تر برای کارهای ساده استفاده کنید.
  • max_tokens را محدود کنید.
  • batch processing را ترجیح دهید.
  • درخواست‌های غیرضروری را کاهش دهید.

«batch processing» یعنی چند ورودی را در یک درخواست بفرستید به‌جای چند درخواست جدا؛ برای Embeddings پارامتر input آرایه می‌پذیرد. محدود کردن max_tokens هم فقط سقف خروجی را می‌بندد و روی کیفیت پاسخ‌های کوتاه اثری ندارد.