قیمتگذاری API AvalAI
📞 پشتیبانی و بازخورد
برای دریافت کمک یا گزارش مشکلات مربوط به این مستندات، با تیم پشتیبانی ما در تلگرام تماس بگیرید: t.me/AvalAISupport
ما آماده پاسخگویی به سوالات فنی، استعلامات مالی و بهبود مستندات هستیم.
در AvalAI، ما به شفافیت کامل اعتقاد داریم. قیمتگذاری ما ۱۰۰٪ با نرخهای پایه API ارائهدهندگان اصلی همسو است و اطمینان حاصل میکند که شما همیشه هزینههای منصفانه و رقابتی را بدون هیچگونه افزایش پنهانی از خدمات اصلی ما دریافت میکنید.
مهم
قیمتگذاری AvalAI بر اساس مصرف توکن در API استاندارد است؛ مشابه API رسمی Anthropic، پلتفرم OpenAI API، OpenRouter.ai و سایر سرویسهای API پرداخت به میزان مصرف. این مدل با اشتراکهای مصرفی یا CLI مانند Claude Pro/Max یا اشتراکهای Codex یکسان نیست؛ در آن سرویسها دسترسی ممکن است همراه با یک محصول ارائه شود و قوانین استفاده با صورتحساب API مبتنی بر توکن تفاوت داشته باشد.
اعتبار رایگان برای کاربران جدید AvalAI
کاربران جدید میتوانند بدون پرداخت، تا ۲۰۰٬۰۰۰ تومان اعتبار رایگان API دریافت کنند:
- ثبتنام با شمارهٔ تلفن و تأیید آن: دریافت ۲۰۰٬۰۰۰ تومان اعتبار رایگان.
- ثبتنام اولیه با ایمیل: دریافت فوری ۲۵٬۰۰۰ تومان اعتبار رایگان.
- اتصال و تأیید شمارهٔ تلفن در ادامه: دریافت ۱۷۵٬۰۰۰ تومان دیگر تا مجموع اعتبار رایگان ثبتنام به ۲۰۰٬۰۰۰ تومان برسد.
پاداش تأیید تلفن، مجموع اعتبار ثبتنام را به ۲۰۰٬۰۰۰ تومان میرساند؛ یعنی ۲۰۰٬۰۰۰ تومان جداگانه علاوه بر اعتبار اولیه ایمیل نیست. حساب خود را در داشبورد AvalAI بسازید و تأیید کنید، سپس پیش از شارژ از موجودی رایگان برای آزمایش مدلهای API پشتیبانیشده استفاده کنید.
برای جزئیات کامل در مورد تمامی مدلها و قابلیتهای آنها، لطفا از صفحه جزئیات مدل بازدید کنید.
برای الگوهای پیادهسازی که هزینه را از مسیر انتخاب مدل، بودجه توکن، prompt caching، کار async و routing با flex کاهش میدهند، بهینهسازی هزینه را ببینید.
دریافت فهرست زنده مدلها
برای دریافت فهرست فعلی مدلها و جزئیات قیمتگذاری آنها از endpoint عمومی زیر استفاده کنید. این endpoint به API key نیاز ندارد. پاسخ شامل همان شناسههای مدل، فیلدهای تودرتوی pricing و شیء tier_rate_limits (محدودیت نرخ بهازای هر سطح حساب) است که در این صفحه استفاده میشوند.
# پاسخ را بهجای چاپ در ترمینال در فایل models.json ذخیره کنید.
curl --fail --silent --show-error \
https://api.avalai.ir/public/models \
--output models.json# Windows PowerShell: ذخیره پاسخ در فایل models.json
Invoke-RestMethod -Uri "https://api.avalai.ir/public/models" `
-OutFile "models.json"import requests
response = requests.get(
"https://api.avalai.ir/public/models",
timeout=30,
)
response.raise_for_status()
models = response.json()["data"]
for model in models:
print(model["id"], model.get("pricing", {}))
# محدودیت نرخ برای سطح حساب شما (برای مثال سطح ۲)
tier_limits = model.get("tier_rate_limits", {}).get("2", {})
print(
" tier 2:",
tier_limits.get("max_requests_per_1_minute"),
"RPM",
tier_limits.get("max_tokens_per_1_minute"),
"TPM",
)ساختار پاسخ
پاسخ سطح بالا یک فهرست مدل است:
{
"object": "list",
"data": [
{
"id": "example-model",
"object": "model",
"owned_by": "provider",
"min_tier": 0,
"mode": "chat",
"pricing": {
"input": 1.25,
"input_above_128K": 2.5,
"cached_input": 0.125,
"output": 10.0,
"output_above_128K": 15.0
},
"max_input_tokens": 200000,
"max_output_tokens": 32000,
"max_requests_per_1_minute": 1000,
"max_tokens_per_1_minute": 2000000,
"tier_rate_limits": {
"0": {
"max_requests_per_1_minute": 1,
"max_tokens_per_1_minute": 40000
},
"1": {
"max_requests_per_1_minute": 50,
"max_tokens_per_1_minute": 500000
},
"2": {
"max_requests_per_1_minute": 250,
"max_tokens_per_1_minute": 1000000
},
"3": {
"max_requests_per_1_minute": 1000,
"max_tokens_per_1_minute": 2000000
}
},
"supported_endpoints": [
"/v1/chat/completions"
],
"supports_vision": true,
"supports_function_calling": true
}
]
}فیلدهای مهم:
| فیلد | مفهوم |
|---|---|
id | نام دقیق مدل برای ارسال در درخواست API و مسیر مستندات مدل. |
owned_by | مالک یا ارائهدهنده مدل که در فهرست قیمت نمایش داده میشود. |
mode | دسته عملیات و صورتحساب مانند chat، embedding، image_generation، video_generation، audio_transcription، audio_speech، ocr، rerank یا search. |
min_tier | حداقل سطح حساب AvalAI موردنیاز برای دسترسی. شیء tier_rate_limits همیشه از همین سطح آغاز میشود. |
pricing.input، pricing.cached_input، pricing.output | قیمت دلاری هر ۱ میلیون توکن. |
pricing.*_above_* | نرخ پویای زمینه بلند پس از آستانه توکنی که در نام کلید آمده است؛ مانند input_above_128K. |
pricing.input_cost_per_page | هزینه پردازش OCR برای هر صفحه. |
pricing.input_cost_per_annotation_page | هزینه حاشیهنویسی OCR برای هر صفحه. |
pricing.output_cost_per_image_* | قیمت هر تصویر؛ پسوند، رزولوشن یا گونه کیفیت را مشخص میکند. |
pricing.output_cost_per_video_per_second_* | قیمت هر ثانیه ویدئو؛ پسوند، رزولوشن را مشخص میکند. |
max_input_tokens، max_output_tokens | محدودیت منتشرشده توکن ورودی و خروجی، در صورت وجود. |
max_requests_per_1_minute، max_tokens_per_1_minute | بالاترین محدودیت نرخ در دسترس مدل (درخواست در دقیقه و توکن در دقیقه) که با بالاترین سطح ارائهشده مدل مطابقت دارد. |
tier_rate_limits | محدودیت نرخ بهازای هر سطح که با کلید سطح حساب AvalAI ("0" تا "5") ایندکس میشود. هر ورودی مقدار max_requests_per_1_minute (RPM) و max_tokens_per_1_minute (TPM) آن سطح را میدهد. سطوح بالاتر توان عملیاتی بیشتری باز میکنند. |
supported_endpoints | مسیرهای API پشتیبانیشده توسط مدل. |
supports_* | پرچمهای قابلیت مانند بینایی، function calling، صوت، ورودی PDF، کش و structured output. |
فیلدهای قیمتگذاری بر اساس حالت مدل متفاوت هستند. همیشه کل شیء pricing را بررسی کنید و فرض نکنید همه مدلها فقط نرخ توکن ورودی و خروجی دارند. محدودیتهای نرخ بسته به سطح حساب شما متفاوت است؛ برای برنامهریزی توان عملیاتی سطح خود از tier_rate_limits استفاده کنید و به بیشینه سطح بالا اکتفا نکنید.
نحوه محاسبه صورتحساب
برای برنامهریزی از جدولهای زیر استفاده کنید، اما هزینه نهایی production را با User API بررسی کنید؛ چون هزینه واقعی میتواند بیشتر از توکنهای قابل مشاهده خروجی باشد.
صورتحساب توکنهای استدلال یا reasoning: برای همه ارائهدهندگان و مدلها، توکنهای پنهان
reasoning_tokensبا نرخ توکن خروجی مدل انتخابی محاسبه میشوند، حتی اگر در متن پاسخ دیده نشوند. وقتیoutput_tokensاز قبل توکنهای reasoning را شامل میشود،output_tokens_details.reasoning_tokensفقط تفکیک آن است؛ این دو فیلد را با هم جمع نکنید، چون هزینه دوبارهشماری میشود. اگر route خروجی قابل مشاهده و reasoning را جدا گزارش میکند، تعداد این توکنها را جمع کنید و همان نرخ توکن خروجی را برای هر دو به کار ببرید.
- توکنهای مدل: ورودی، ورودی کششده، خروجی و توکنهای پنهان reasoning بر اساس مدل و ارائهدهنده انتخابی محاسبه میشوند.
- قابلیتهای route: Responses، Chat Completions، Batch، تصویر، صوت، ویدئو و workflowهای ابزارمحور ممکن است فیلدهای متفاوتی داشته باشند، اما واحد قابلپرداخت از مدل، واحد رسانه، route ارائهدهنده، سطح سرویس یا فراخوانی ابزار میآید.
- ابزارهای میزبانیشده: ابزارهایی مثل web search، file search، containerهای میزبانیشده و runtimeهای مشابه code interpreter در صورت فعال بودن برای route شما میتوانند هزینه جداگانه برای call، storage یا session اضافه کنند.
- قواعد ارائهدهنده: بعضی ارائهدهندگان علاوه بر قیمت پایه توکن، هزینه cache creation، افزایش قیمت long-context، ثانیه رسانه، واحد تصویر یا نرخهای وابسته به سطح حساب دارند.
- کنترلهای عملیاتی: بودجه توکن بگذارید، برای زمینه تکراری از cached prefix استفاده کنید،
service_tierرا آگاهانه انتخاب کنید وavalai-request-idرا log کنید تا تیمهای مالی و پشتیبانی بتوانند تراکنش دقیق را reconcile کنند.
سطح سرویس Flex
سطح سرویس Flex با ۵۰٪ کاهش هزینه نسبت به سطح استاندارد برای مدلهای منتخب OpenAI ارائه میشود. این سطح قیمتگذاری صرفهجویی قابل توجهی برای استفاده حجم بالا از API فراهم میکند.
⚠️ ملاحظات مهم
سطح سرویس flex دارای تاخیر بالاتر نسبت به سطح استاندارد است. درخواستها ممکن است زمان بیشتری ببرند، تایماوت شوند، یا در طول پردازش با شکست مواجه شوند.
- برای پردازش سریعتر درخواستهای API، از سطح سرویس استاندارد (
"default") استفاده کنید- برای قیمتهای پایینتر با تاخیر بالاتر، از سطح پردازش flex (
"flex") استفاده کنید- تایماوت سرور: درخواستهای flex ممکن است تا ۹۰۰ ثانیه (۱۵ دقیقه) طول بکشند
- استفاده در محیط پروداکشن: برای کاربردهای حساس به زمان، توصیه میشود مکانیزم retry با بازگشت به
service_tier: "default"پیادهسازی کنید- سازگاری با Priority: بعضی مثالهای OpenAI ممکن است
service_tier: "priority"داشته باشند؛ در AvalAI ازdefaultاستفاده کنید مگر اینکه پردازش priority صراحتا برای حساب شما فعال شده باشد
نحوه کار
- رفتار پیشفرض: همه درخواستها از سطح سرویس
"default"استفاده میکنند مگر اینکه طور دیگری مشخص شود - فعالسازی: پارامتر
"service_tier": "flex"را در درخواست خود ارسال کنید تا از قیمتگذاری flex استفاده کنید - اعتبارسنجی مدل: سرور درخواستهایی با
service_tier: "flex"را برای مدلهای پشتیبانی نشده رد میکند - فیلد پاسخ: همه پاسخهای API شامل فیلد
"service_tier"هستند که نشان میدهد کدام سطح استفاده شده است - مقادیر عمومی پشتیبانیشده: مقادیر عمومی AvalAI برابر
"default"و"flex"هستند؛"priority"را تا زمان مستندسازی برای route خود، account-specific در نظر بگیرید
قیمتگذاری سطح Flex
قیمتها بر اساس ۱ میلیون توکن لیست شدهاند. این قیمتها نشاندهنده ۵۰٪ صرفهجویی در مقایسه با قیمتگذاری سطح استاندارد است.
| مدل | ورودی (دلار/۱م توکن) | ورودی کش شده (دلار/۱م توکن) | خروجی (دلار/۱م توکن) |
|---|---|---|---|
gpt-5.2 | $0.875 | $0.0875 | $7.00 |
gpt-5.1 | $0.625 | $0.0625 | $5.00 |
gpt-5 | $0.625 | $0.0625 | $5.00 |
gpt-5-mini | $0.125 | $0.0125 | $1.00 |
gpt-5-nano | $0.025 | $0.0025 | $0.20 |
o3 | $1.00 | $0.25 | $4.00 |
o4-mini | $0.55 | $0.275 | $2.20 |
مثال استفاده
curl -i https://api.avalai.ir/v1/chat/completions \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5-mini",
"messages": [{"role": "user", "content": "سلام!"}],
"stream": false,
"service_tier": "flex"
}'نمونه پاسخ:
{
"id": "chatcmpl-123",
"created": 1765789075,
"model": "gpt-5-mini-2025-08-07",
"object": "chat.completion",
"choices": [
{
"finish_reason": "stop",
"index": 0,
"message": {
"content": "سلام — چطور میتوانم امروز به شما کمک کنم؟",
"role": "assistant"
}
}
],
"usage": {
"completion_tokens": 123,
"prompt_tokens": 7,
"total_tokens": 130
},
"service_tier": "flex",
"estimated_cost": {
"unit": "0.0001238750",
"irt": 16.27,
"exchange_rate": 131350
}
}⚠️ مهم: بستههای اعتباری و سطح Flex
بستههای اعتباری هزینههای سطح سرویس flex را پوشش نمیدهند. هنگام استفاده از
service_tier: "flex"، هزینهها از موجودی حساب استاندارد شما کسر میشود، نه از تخصیص بستههای اعتباری. بستههای اعتباری فقط برای استفاده از سطح سرویس استاندارد اعمال میشوند.
نمای کلی قیمتگذاری مدلها
این فهرست از data/models.json تولید میشود که مرجع اصلی موجودبودن مدلها و قیمتگذاری است. هر شناسه فعلی مدل دقیقا یک بار آمده است. قیمت توکنها برای ۱ میلیون توکن است، مگر اینکه واحد دیگری نمایش داده شود.
قیمتهای دارای برچسب بالاتر از N توکن هنگامی اعمال میشوند که زمینه قابلصورتحساب از آستانه ارائهدهنده عبور کند. ابعاد رسانه، گونههای کیفیت، صفحههای حاشیهنویسی OCR، جستجو و واحدهای دیگر در صورت وجود جداگانه آمدهاند. قیمت تشویقی GLM-5.3-Flash: نرخهای $0.075 ورودی، $0.015 ورودی کششده و $0.25 خروجی تا ۱۸ شهریور ۱۴۰۵ (September 9, 2026) اعمال میشوند؛ نرخهای استاندارد پس از آن تاریخ $0.15 ورودی، $0.03 ورودی کششده و $0.50 خروجی هستند. قیمت تشویقی Gemini 3.8 Flash: نرخهای $0.75 ورودی، $0.075 ورودی کششده و $3.75 خروجی برای
gemini-3.8-flashو نام مستعار آن،gemini-flash-latest، تا ۱۰ دی ۱۴۰۵ (December 31, 2026) اعمال میشوند؛ نرخهای استاندارد پس از آن تاریخ $1.50 ورودی، $0.15 ورودی کششده و $7.50 خروجی هستند.
ستون محدودیت نرخ سقف درخواست در دقیقه (RPM) و توکن در دقیقه (TPM) را برای هر سطح حساب AvalAI از شیء
tier_rate_limitsنمایش میدهد. سطوح بالاتر توان عملیاتی بیشتری باز میکنند. سطوح پایینتر ازmin_tierمدل با برچسب دسترسی ندارد مشخص میشوند، زیرا مدل روی آن سطوح در دسترس نیست.
مدلهای چت، Responses و Completion
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|---|---|---|
gemini-3.8-flash | ورودی$0.75 / ۱ میلیون توکنورودی کششده$0.075 / ۱ میلیون توکنخروجی$3.75 / ۱ میلیون توکن | سطح پایه1 RPM · 40K TPMسطح 150 RPM · 500K TPMسطح 2250 RPM · 1M TPMسطح 31K RPM · 2M TPMسطح 43500 RPM · 5M TPMسطح 525K RPM · 30M TPM | |
claude-fable-5-1 | anthropic | ورودی$10 / ۱ میلیون توکنورودی کششده$0.25 / ۱ میلیون توکنورودی ایجاد کش$12.50 / ۱ میلیون توکنخروجی$50 / ۱ میلیون توکن | سطح پایهدسترسی نداردسطح 1دسترسی نداردسطح 225 RPM · 450K TPMسطح 350 RPM · 800K TPMسطح 4100 RPM · 1M TPMسطح 5150 RPM · 4M TPM |
glm-5.3-flash | zai | ورودی$0.075 / ۱ میلیون توکنورودی کششده$0.015 / ۱ میلیون توکنخروجی$0.25 / ۱ میلیون توکن | سطح پایه3 RPM · 40K TPMسطح 125 RPM · 10M TPMسطح 2250 RPM · 4M TPMسطح 3500 RPM · 8M TPMسطح 4750 RPM · 10M TPMسطح 51500 RPM · 30M TPM |
glm-5.3 | zai | ورودی$1.40 / ۱ میلیون توکنورودی کششده$0.26 / ۱ میلیون توکنخروجی$4.40 / ۱ میلیون توکن | سطح پایه3 RPM · 40K TPMسطح 125 RPM · 10M TPMسطح 2250 RPM · 4M TPMسطح 3500 RPM · 8M TPMسطح 4750 RPM · 10M TPMسطح 51500 RPM · 30M TPM |
gemini-3.7-flash | ورودی$0.75 / ۱ میلیون توکنورودی کششده$0.075 / ۱ میلیون توکنخروجی$3.75 / ۱ میلیون توکن | سطح پایه1 RPM · 40K TPMسطح 150 RPM · 500K TPMسطح 2250 RPM · 1M TPMسطح 31K RPM · 2M TPMسطح 43500 RPM · 5M TPMسطح 525K RPM · 30M TPM | |
qwen3.8-flash | alibaba | ورودی$0.15 / ۱ میلیون توکنورودی ایجاد کش$0.20 / ۱ میلیون توکنورودی کششده$0.016 / ۱ میلیون توکنخروجی$0.47 / ۱ میلیون توکن | سطح پایه3 RPM · 40K TPMسطح 120 RPM · 500K TPMسطح 2150 RPM · 2M TPMسطح 3350 RPM · 4M TPMسطح 4750 RPM · 8M TPMسطح 51500 RPM · 20M TPM |
qwen3.8-27b | alibaba | ورودی$0.50 / ۱ میلیون توکنورودی ایجاد کش$0.625 / ۱ میلیون توکنورودی کششده$0.10 / ۱ میلیون توکنخروجی$2 / ۱ میلیون توکن | سطح پایه3 RPM · 40K TPMسطح 120 RPM · 500K TPMسطح 2150 RPM · 2M TPMسطح 3350 RPM · 4M TPMسطح 4750 RPM · 8M TPMسطح 51500 RPM · 20M TPM |
qwen3.8-2.4t-a95b | alibaba | ورودی$2 / ۱ میلیون توکنورودی ایجاد کش$2.50 / ۱ میلیون توکنورودی کششده$0.25 / ۱ میلیون توکنخروجی$6 / ۱ میلیون توکن | سطح پایهدسترسی نداردسطح 120 RPM · 500K TPMسطح 2150 RPM · 2M TPMسطح 3350 RPM · 4M TPMسطح 4750 RPM · 8M TPMسطح 51500 RPM · 20M TPM |
qwen3.8-max | alibaba | ورودی$2 / ۱ میلیون توکنورودی ایجاد کش$2.50 / ۱ میلیون توکنورودی کششده$0.25 / ۱ میلیون توکنخروجی$6 / ۱ میلیون توکن | سطح پایهدسترسی نداردسطح 110 RPM · 100K TPMسطح 250 RPM · 450K TPMسطح 3150 RPM · 1M TPMسطح 4350 RPM · 2M TPMسطح 5750 RPM · 4M TPM |
claude-opus-5 | anthropic | ورودی$5 / ۱ میلیون توکنورودی کششده$0.50 / ۱ میلیون توکنورودی ایجاد کش$6.25 / ۱ میلیون توکنخروجی$25 / ۱ میلیون توکن | سطح پایهدسترسی نداردسطح 12 RPM · 30K TPMسطح 225 RPM · 450K TPMسطح 350 RPM · 800K TPMسطح 4100 RPM · 1M TPMسطح 5150 RPM · 4M TPM |
gemini-3.6-flash | ورودی$1.50 / ۱ میلیون توکنورودی کششده$0.15 / ۱ میلیون توکنخروجی$7.50 / ۱ میلیون توکن | سطح پایه1 RPM · 40K TPMسطح 150 RPM · 500K TPMسطح 2250 RPM · 1M TPMسطح 31K RPM · 2M TPMسطح 43500 RPM · 5M TPMسطح 525K RPM · 30M TPM | |
gemini-3.5-flash-lite | ورودی$0.30 / ۱ میلیون توکنورودی کششده$0.03 / ۱ میلیون توکنخروجی$2.50 / ۱ میلیون توکن | سطح پایه3 RPM · 40K TPMسطح 150 RPM · 500K TPMسطح 2500 RPM · 1M TPMسطح 31K RPM · 3M TPMسطح 43500 RPM · 5M TPMسطح 525K RPM · 20M TPM | |
kimi-k3 | moonshot | ورودی$3 / ۱ میلیون توکنورودی کششده$0.30 / ۱ میلیون توکنخروجی$15 / ۱ میلیون توکنزمینه جستجو (low)$0.005 / درخواستزمینه جستجو (medium)$0.005 / درخواستزمینه جستجو (high)$0.01 / درخواست | سطح پایه3 RPM · 40K TPMسطح 150 RPM · 1M TPMسطح 2100 RPM · 4M TPMسطح 3250 RPM · 8M TPMسطح 4500 RPM · 10M TPMسطح 55K RPM · 30M TPM |
gpt-5.6-sol | openai | ورودی$5 / ۱ میلیون توکنورودی بالاتر از 272K توکن$10 / ۱ میلیون توکنورودی کششده$0.50 / ۱ میلیون توکنورودی کششده بالاتر از 272K توکن$1 / ۱ میلیون توکنورودی ایجاد کش$2.50 / ۱ میلیون توکنورودی ایجاد کش بالاتر از 272K توکن$12.50 / ۱ میلیون توکنخروجی$12 / ۱ میلیون توکنخروجی بالاتر از 272K توکن$45 / ۱ میلیون توکنزمینه جستجو (low)$0.03 / درخواستزمینه جستجو (medium)$0.035 / درخواستزمینه جستجو (high)$0.05 / درخواست | سطح پایه1 RPM · 10K TPMسطح 150 RPM · 500K TPMسطح 2150 RPM · 2M TPMسطح 3250 RPM · 4M TPMسطح 41500 RPM · 8M TPMسطح 510K RPM · 20M TPM |
gpt-5.6-terra | openai | ورودی$2 / ۱ میلیون توکنورودی بالاتر از 272K توکن$4 / ۱ میلیون توکنورودی کششده$0.20 / ۱ میلیون توکنورودی ایجاد کش$2.50 / ۱ میلیون توکنورودی کششده بالاتر از 272K توکن$0.40 / ۱ میلیون توکنورودی ایجاد کش بالاتر از 272K توکن$5 / ۱ میلیون توکنخروجی$12 / ۱ میلیون توکنخروجی بالاتر از 272K توکن$18 / ۱ میلیون توکنزمینه جستجو (low)$0.03 / درخواستزمینه جستجو (medium)$0.035 / درخواستزمینه جستجو (high)$0.05 / درخواست | سطح پایه1 RPM · 10K TPMسطح 150 RPM · 500K TPMسطح 2150 RPM · 2M TPMسطح 3250 RPM · 4M TPMسطح 41500 RPM · 8M TPMسطح 510K RPM · 20M TPM |
gpt-5.6-luna | openai | ورودی$0.20 / ۱ میلیون توکنورودی بالاتر از 272K توکن$0.40 / ۱ میلیون توکنورودی کششده$0.02 / ۱ میلیون توکنورودی کششده بالاتر از 272K توکن$0.04 / ۱ میلیون توکنخروجی$1.20 / ۱ میلیون توکنخروجی بالاتر از 272K توکن$1.80 / ۱ میلیون توکنزمینه جستجو (low)$0.03 / درخواستزمینه جستجو (medium)$0.035 / درخواستزمینه جستجو (high)$0.05 / درخواست | سطح پایه1 RPM · 10K TPMسطح 150 RPM · 500K TPMسطح 2150 RPM · 2M TPMسطح 3250 RPM · 4M TPMسطح 41500 RPM · 8M TPMسطح 510K RPM · 20M TPM |
grok-4.5 | xai | ورودی$2 / ۱ میلیون توکنورودی بالاتر از 200K توکن$4 / ۱ میلیون توکنورودی کششده$0.50 / ۱ میلیون توکنورودی کششده بالاتر از 200K توکن$1 / ۱ میلیون توکنخروجی$6 / ۱ میلیون توکنخروجی بالاتر از 200K توکن$12.50 / ۱ میلیون توکن | سطح پایه1 RPM · 40K TPMسطح 150 RPM · 500K TPMسطح 2100 RPM · 1M TPMسطح 3150 RPM · 1.50M TPMسطح 4200 RPM · 2.40M TPMسطح 5400 RPM · 4M TPM |
مدلهای Embedding
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای تولید تصویر
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای تولید ویدئو
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای رونویسی صوت
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای تبدیل متن به گفتار
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای OCR
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای Moderation
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای Reranking
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
مدلهای جستجو
| شناسه مدل | ارائهدهنده | جزئیات قیمتگذاری | محدودیت نرخ |
|---|
ابزارهای داخلی
ابزارهای داخلی شناسه مدل نیستند و از فهرست مدلها خوانده نمیشوند. توکنهای مصرفشده توسط ابزار همچنان با نرخ مدل انتخابی محاسبه میشوند.
| ابزار | هزینه | توضیحات |
|---|---|---|
| Code Interpreter | $0.03 / نشست | |
| File Search Storage | $0.10 / گیگابایت در روز | ۱ گیگابایت اول رایگان |
| File Search Tool Call | $2.50 / ۱۰۰۰ فراخوانی | Responses API |
ردیابی هزینه
AvalAI دو روش برای ردیابی هزینههای API ارائه میدهد:
۱. هزینه تخمینی (پایه)
پاسخهای API شامل یک دیکشنری اختیاری estimated_cost برای تخمین سریع هزینه هستند:
| فیلد | توضیحات |
|---|---|
unit | هزینه به دلار آمریکا/تتر (USD/USDT) |
irt | هزینه به تومان (IRT)، محاسبه شده به عنوان هزینه دلاری × نرخ تبدیل تتر به تومان |
exchange_rate | نرخ تبدیل فعلی تتر به تومان که برای تبدیل استفاده شده است |
مثال پاسخ API با هزینه تخمینی:
{
"id": "response-123456",
"object": "chat.completion",
"created": 1714911234,
"model": "gpt-4o",
"choices": [...],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 128,
"total_tokens": 170
},
"estimated_cost": {
"unit": 0.0025,
"irt": 200,
"exchange_rate": 80000
}
}نکات مهم:
- این فیلد ممکن است در تمامی پاسخها وجود نداشته باشد.
- برای درخواستهای عادی (غیر جریانی)، در پاسخ اصلی گنجانده میشود.
- برای درخواستهای جریانی، به آخرین تکه از پاسخ جریانی پیوست میشود.
- هزینه تخمینی تضمین نمیشود و نباید برای صورتحساب یا حسابداری استفاده شود.
۲. User API (دقیق و تضمینشده)
برای ردیابی دقیق هزینه و صورتحساب، از User API در آدرس https://api.avalai.ir/user/v1 استفاده کنید:
ویژگیهای کلیدی:
- هزینههای دقیق 100٪ - هزینههای دقیق تضمینشده برای هر فراخوانی API
- ردیابی شناسه درخواست - از
avalai-request-idدر هدرهای پاسخ برای جستجوی هزینههای دقیق استفاده کنید - در دسترس ظرف 30 ثانیه - هزینهها پردازش شده و آماده بازیابی
- تاریخچه تراکنشها - رد تراکنش کامل با قابلیت فیلتر
- تحلیل استفاده - خلاصههای دقیق بر اساس مدل، ارائهدهنده، تاریخ یا ساعت
مناسب برای:
- فروشندگان - محاسبه دقیق هزینه برای مشتریان بر اساس هزینههای واقعی
- سازمانهای بزرگ - تخصیص دقیق هزینه و تسویه حساب
- برنامههای تولیدی - صورتحساب قابل اعتماد و نظارت بر استفاده
مثال سریع:
# 1. فراخوانی API و دریافت avalai-request-id از هدرهای پاسخ
curl -i "https://api.avalai.ir/v1/chat/completions" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-4o-mini", "messages": [{"role": "user", "content": "سلام"}]}'
# پاسخ شامل: avalai-request-id: 019ac4a0-a8f4-7041-845f-3ea8f15dcf1a
# 2. دریافت هزینه دقیق (ظرف 30 ثانیه در دسترس است)
curl "https://api.avalai.ir/user/v1/transactions/lookup" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"transaction_ids": ["019ac4a0-a8f4-7041-845f-3ea8f15dcf1a"]}'اطلاعات بیشتر:
- مستندات User API - مرجع کامل API
- راهنمای ردیابی هزینه برای فروشندگان - راهنمای گام به گام پیادهسازی
- راهنمای استفاده برای سازمانها - الگوهای پیشرفته برای مقیاس بزرگ