مدلهای جدید اضافه شدند: سری GPT-5.4 و Gemini 3.1 Flash-Lite Preview
تاریخ: ۱۴۰۴-۱۲-۱۹ / (2026-03-10)
خلاصه
ما افزودن مدلهای سری GPT-5.4 از OpenAI (شامل GPT-5.4 Pro، GPT-5.4 و GPT-5.3 Chat) و Gemini 3.1 Flash-Lite Preview از گوگل را اعلام میکنیم. این مدلها قابلیتهای استدلال پیشرو، پنجرههای زمینه گسترده تا ۱.۰۵ میلیون توکن و پردازش چندوجهی مقرونبهصرفه برای وظایف حجم بالا را ارائه میدهند.
جزئیات
OpenAI
GPT-5.4 Pro
gpt-5.4-pro پیشرفتهترین مدل استدلالی OpenAI است که برای کارهای پیچیده حرفهای طراحی شده است. این مدل از محاسبات بیشتری برای تفکر عمیقتر و ارائه پاسخهای بهتر استفاده میکند.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۱٬۰۵۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی |
| دادههای آموزشی | تا ۳۱ اوت ۲۰۲۵ |
| قیمتگذاری ورودی | ۳۰.۰۰ دلار / ۱ میلیون توکن |
| قیمتگذاری ورودی کش شده | ۰.۳۰ دلار / ۱ میلیون توکن |
| قیمتگذاری خروجی | ۱۸۰.۰۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions، v1/responses |
| تلاش استدلال | متوسط، زیاد، بسیار زیاد |
| در دسترس بودن | کاربران سطح ۲ به بالا |
ویژگیهای کلیدی:
- زمینه گسترده: پنجره زمینه ۱.۰۵ میلیون توکن برای مدیریت پایگاههای کد و اسناد عظیم
- پشتیبانی از توکن استدلال: پشتیبانی از تنظیمات تلاش استدلال متوسط، زیاد و بسیار زیاد
- تعاملات چند نوبتی: طراحی شده برای تعاملات چند نوبتی مدل قبل از پاسخ به درخواستهای API
- پشتیبانی از جستجوی وب: پشتیبانی از ابزار جستجوی وب برای اطلاعات بلادرنگ
- استفاده از کامپیوتر: پشتیبانی از قابلیتهای استفاده از کامپیوتر
- پشتیبانی MCP: پشتیبانی از پروتکل زمینه مدل
توجه: برای پرامپتهایی با بیش از ۲۷۲ هزار توکن ورودی، قیمتگذاری ۲ برابر ورودی و ۱.۵ برابر خروجی برای کل جلسه است. GPT-5.4 Pro برای حل مسائل سخت طراحی شده - برخی درخواستها ممکن است چندین دقیقه طول بکشند. از حالت پسزمینه برای جلوگیری از وقفه زمانی استفاده کنید.
GPT-5.4
gpt-5.4 مدل پیشرو OpenAI برای کارهای پیچیده حرفهای است که بهترین هوش در مقیاس برای گردشهای کاری عاملی، کدنویسی و حرفهای ارائه میدهد.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۱٬۰۵۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی |
| دادههای آموزشی | تا ۳۱ اوت ۲۰۲۵ |
| قیمتگذاری ورودی | ۲.۵۰ دلار / ۱ میلیون توکن |
| قیمتگذاری ورودی کش شده | ۰.۲۵ دلار / ۱ میلیون توکن |
| قیمتگذاری خروجی | ۱۵.۰۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions، v1/responses |
| تلاش استدلال | بدون (پیشفرض)، کم، متوسط، زیاد، بسیار زیاد |
ویژگیهای کلیدی:
- زمینه گسترده: پنجره زمینه ۱.۰۵ میلیون توکن
- بالاترین استدلال: سطوح تلاش استدلال قابل تنظیم
- پشتیبانی کامل از ابزارها: جستجوی وب، جستجوی فایل، تولید تصویر، مفسر کد، شل میزبانی شده، استفاده از کامپیوتر، MCP و موارد دیگر
- پشتیبانی از تقطیر: قابل استفاده برای تقطیر مدل
- خروجیهای ساختاریافته: پشتیبانی کامل از خروجیهای ساختاریافته و فراخوانی تابع
توجه: برای پرامپتهایی با بیش از ۲۷۲ هزار توکن ورودی، قیمتگذاری ۲ برابر ورودی و ۱.۵ برابر خروجی برای کل جلسه است.
GPT-5.3 Chat
gpt-5.3-chat مدل فوری GPT-5.3 است که در حال حاضر در ChatGPT استفاده میشود و برای موارد استفاده گفتگویی با هوش بالا در نقطه قیمت رقابتی بهینهسازی شده است.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۱۲۸٬۰۰۰ توکن ورودی، ۱۶٬۳۸۴ توکن خروجی |
| دادههای آموزشی | تا ۳۱ اوت ۲۰۲۵ |
| قیمتگذاری ورودی | ۱.۷۵ دلار / ۱ میلیون توکن |
| قیمتگذاری ورودی کش شده | ۰.۱۷۵ دلار / ۱ میلیون توکن |
| قیمتگذاری خروجی | ۱۴.۰۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions، v1/responses |
ویژگیهای کلیدی:
- هوش بالا: آخرین بهبودها برای موارد استفاده گفتگویی
- پشتیبانی از بینایی: میتواند تصاویر را به عنوان ورودی پردازش کند
- فراخوانی تابع: پشتیبانی کامل از فراخوانی تابع و خروجیهای ساختاریافته
- جریانسازی: پشتیبانی کامل از جریانسازی
توجه: ما GPT-5.2 را برای استفاده عمومی API توصیه میکنیم، اما GPT-5.3 Chat برای آزمایش آخرین بهبودهای ChatGPT در برنامههای محاورهای ایدهآل است.
گوگل (Gemini)
Gemini 3.1 Flash-Lite Preview
gemini-3.1-flash-lite-preview مقرونبهصرفهترین مدل چندوجهی گوگل است که سریعترین عملکرد را برای وظایف سبک و با فرکانس بالا ارائه میدهد.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۱٬۰۴۸٬۵۷۶ توکن ورودی، ۶۵٬۵۳۶ توکن خروجی |
| تاریخ قطع دانش | ژانویه ۲۰۲۵ |
| قیمتگذاری ورودی | ۰.۲۵ دلار / ۱ میلیون توکن |
| قیمتگذاری ورودی کش شده | ۰.۰۲۵ دلار / ۱ میلیون توکن |
| قیمتگذاری خروجی | ۱.۵۰ دلار / ۱ میلیون توکن |
| قیمتگذاری ورودی صوتی | ۰.۵۰ دلار / ۱ میلیون توکن |
| ورودی صوتی کش شده | ۰.۰۵ دلار / ۱ میلیون توکن |
| قیمتگذاری خروجی صوتی | ۱.۵۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر، ویدیو، صوت، PDF |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions، v1beta/ |
ویژگیهای کلیدی:
- مقرونبهصرفه: ارزانترین مدل Gemini برای وظایف حجم بالا
- عملکرد سریع: بهینهسازی شده برای برنامههای با تاخیر بسیار کم
- ورودی چندوجهی: پشتیبانی از ورودیهای متن، تصویر، ویدیو، صوت و PDF
- پشتیبانی از تفکر: سطوح تفکر قابل تنظیم برای استدلال گامبهگام
- خروجیهای ساختاریافته: پشتیبانی کامل از JSON schema و خروجیهای ساختاریافته
- فراخوانی تابع: پشتیبانی بومی از فراخوانی تابع
- پایهگذاری جستجو: یکپارچهسازی Google Search برای پاسخهای دقیق
- زمینه URL: میتواند محتوای وب را دریافت و پردازش کند
بهترین موارد استفاده:
- ترجمه: ترجمه سریع، ارزان و حجم بالا در مقیاس
- رونویسی: رونویسی صوتی و ویدیویی بدون خطوط لوله جداگانه
- استخراج داده: استخراج موجودیت، طبقهبندی و پردازش داده سبک
- خلاصهسازی اسناد: تجزیه PDF و بازگرداندن خلاصههای مختصر
- مسیریابی مدل: استفاده به عنوان طبقهبندیکننده برای هدایت کوئریها به مدلهای مناسب بر اساس پیچیدگی وظیفه
خلاصه قیمتگذاری
| مدل | ورودی (دلار/۱م توکن) | ورودی کش شده (دلار/۱م توکن) | خروجی (دلار/۱م توکن) |
|---|---|---|---|
gpt-5.4-pro | $30.00 | $0.30 | $180.00 |
gpt-5.4 | $2.50 | $0.25 | $15.00 |
gpt-5.3-chat | $1.75 | $0.175 | $14.00 |
gemini-3.1-flash-lite-preview | $0.25 | $0.025 | $1.50 |
نمونه درخواست و پاسخ API
نمونه GPT-5.4 Pro
curl https://api.avalai.ir/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-5.4-pro",
"input": "یک معماری سیستم توزیعشده جامع با در نظر گرفتن تحمل خطا، مقیاسپذیری و امنیت برای یک پلتفرم مالی جهانی طراحی کنید.",
"reasoning": {"effort": "high"}
}'نمونه GPT-5.4
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-5.4",
"messages": [
{
"role": "user",
"content": "یک ویرایشگر سند مشترک بلادرنگ با حل تعارض پیادهسازی کنید."
}
],
"max_tokens": 4096
}'نمونه GPT-5.3 Chat
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-5.3-chat",
"messages": [
{
"role": "user",
"content": "محاسبات کوانتومی را به زبان ساده توضیح دهید."
}
]
}'نمونه Gemini 3.1 Flash-Lite Preview
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [
{
"role": "user",
"content": "متن زیر را به آلمانی ترجمه کنید: سلام، دوست داری بعدا پیتزا بخوریم؟ من خیلی گرسنهام!"
}
]
}'پاسخ:
{
"id": "chatcmpl-xyz123",
"created": 1741608788,
"model": "gemini-3.1-flash-lite-preview",
"object": "chat.completion",
"system_fingerprint": null,
"choices": [
{
"finish_reason": "stop",
"index": 0,
"message": {
"content": "Hey, hast du Lust, später Pizza zu holen? Ich bin am Verhungern!",
"role": "assistant",
"thinking_blocks": [],
"annotations": []
}
}
],
"usage": {
"completion_tokens": 22,
"prompt_tokens": 28,
"total_tokens": 50,
"completion_tokens_details": null,
"prompt_tokens_details": {
"audio_tokens": null,
"cached_tokens": null,
"text_tokens": 28,
"image_tokens": null
}
},
"estimated_cost": {
"unit": "0.0000400000",
"irt": 4.58,
"exchange_rate": 114600
}
}نمونههای استفاده از SDK
استفاده از GPT-5.4 Pro با پایتون
from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
# استفاده از API پاسخها برای استدلال پیشرفته
response = client.responses.create(
model="gpt-5.4-pro",
input="یک معماری سیستم توزیعشده جامع برای یک پلتفرم مالی جهانی طراحی کنید.",
reasoning={"effort": "high"},
)
print(response.output)استفاده از GPT-5.4 با پایتون
from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
response = client.chat.completions.create(
model="gpt-5.4",
messages=[
{"role": "system", "content": "شما یک معمار نرمافزار متخصص هستید."},
{
"role": "user",
"content": "یک ویرایشگر سند مشترک بلادرنگ با حل تعارض پیادهسازی کنید.",
},
],
max_tokens=4096,
)
print(response.choices[0].message.content)استفاده از Gemini 3.1 Flash-Lite با پایتون
from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
response = client.chat.completions.create(
model="gemini-3.1-flash-lite-preview",
messages=[
{
"role": "user",
"content": "نکات کلیدی این سند را به صورت نقطهای خلاصه کنید.",
}
],
)
print(response.choices[0].message.content)استفاده از Gemini 3.1 Flash-Lite با تفکر
from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
response = client.chat.completions.create(
model="gemini-3.1-flash-lite-preview",
messages=[{"role": "user", "content": "هوش مصنوعی چگونه کار میکند؟"}],
extra_body={"generationConfig": {"thinkingConfig": {"thinkingLevel": "high"}}},
)
print(response.choices[0].message.content)