داشبورد توسعه‌دهنده
پرسش از هوش مصنوعی
پرسش از هوش مصنوعی

مدل‌های جدید اضافه شدند: سری GPT-5.4 و Gemini 3.1 Flash-Lite Preview

تاریخ: ۱۴۰۴-۱۲-۱۹ / (2026-03-10)

خلاصه

ما افزودن مدل‌های سری GPT-5.4 از OpenAI (شامل GPT-5.4 Pro، GPT-5.4 و GPT-5.3 Chat) و Gemini 3.1 Flash-Lite Preview از گوگل را اعلام می‌کنیم. این مدل‌ها قابلیت‌های استدلال پیشرو، پنجره‌های زمینه گسترده تا ۱.۰۵ میلیون توکن و پردازش چندوجهی مقرون‌به‌صرفه برای وظایف حجم بالا را ارائه می‌دهند.


جزئیات

OpenAI

GPT-5.4 Pro

gpt-5.4-pro پیشرفته‌ترین مدل استدلالی OpenAI است که برای کارهای پیچیده حرفه‌ای طراحی شده است. این مدل از محاسبات بیشتری برای تفکر عمیق‌تر و ارائه پاسخ‌های بهتر استفاده می‌کند.

ویژگیجزئیات
پنجره زمینه۱٬۰۵۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی
داده‌های آموزشیتا ۳۱ اوت ۲۰۲۵
قیمت‌گذاری ورودی۳۰.۰۰ دلار / ۱ میلیون توکن
قیمت‌گذاری ورودی کش شده۰.۳۰ دلار / ۱ میلیون توکن
قیمت‌گذاری خروجی۱۸۰.۰۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions، v1/responses
تلاش استدلالمتوسط، زیاد، بسیار زیاد
در دسترس بودنکاربران سطح ۲ به بالا

ویژگی‌های کلیدی:

  • زمینه گسترده: پنجره زمینه ۱.۰۵ میلیون توکن برای مدیریت پایگاه‌های کد و اسناد عظیم
  • پشتیبانی از توکن استدلال: پشتیبانی از تنظیمات تلاش استدلال متوسط، زیاد و بسیار زیاد
  • تعاملات چند نوبتی: طراحی شده برای تعاملات چند نوبتی مدل قبل از پاسخ به درخواست‌های API
  • پشتیبانی از جستجوی وب: پشتیبانی از ابزار جستجوی وب برای اطلاعات بلادرنگ
  • استفاده از کامپیوتر: پشتیبانی از قابلیت‌های استفاده از کامپیوتر
  • پشتیبانی MCP: پشتیبانی از پروتکل زمینه مدل

توجه: برای پرامپت‌هایی با بیش از ۲۷۲ هزار توکن ورودی، قیمت‌گذاری ۲ برابر ورودی و ۱.۵ برابر خروجی برای کل جلسه است. GPT-5.4 Pro برای حل مسائل سخت طراحی شده - برخی درخواست‌ها ممکن است چندین دقیقه طول بکشند. از حالت پس‌زمینه برای جلوگیری از وقفه زمانی استفاده کنید.

GPT-5.4

gpt-5.4 مدل پیشرو OpenAI برای کارهای پیچیده حرفه‌ای است که بهترین هوش در مقیاس برای گردش‌های کاری عاملی، کدنویسی و حرفه‌ای ارائه می‌دهد.

ویژگیجزئیات
پنجره زمینه۱٬۰۵۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی
داده‌های آموزشیتا ۳۱ اوت ۲۰۲۵
قیمت‌گذاری ورودی۲.۵۰ دلار / ۱ میلیون توکن
قیمت‌گذاری ورودی کش شده۰.۲۵ دلار / ۱ میلیون توکن
قیمت‌گذاری خروجی۱۵.۰۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions، v1/responses
تلاش استدلالبدون (پیش‌فرض)، کم، متوسط، زیاد، بسیار زیاد

ویژگی‌های کلیدی:

  • زمینه گسترده: پنجره زمینه ۱.۰۵ میلیون توکن
  • بالاترین استدلال: سطوح تلاش استدلال قابل تنظیم
  • پشتیبانی کامل از ابزارها: جستجوی وب، جستجوی فایل، تولید تصویر، مفسر کد، شل میزبانی شده، استفاده از کامپیوتر، MCP و موارد دیگر
  • پشتیبانی از تقطیر: قابل استفاده برای تقطیر مدل
  • خروجی‌های ساختاریافته: پشتیبانی کامل از خروجی‌های ساختاریافته و فراخوانی تابع

توجه: برای پرامپت‌هایی با بیش از ۲۷۲ هزار توکن ورودی، قیمت‌گذاری ۲ برابر ورودی و ۱.۵ برابر خروجی برای کل جلسه است.

GPT-5.3 Chat

gpt-5.3-chat مدل فوری GPT-5.3 است که در حال حاضر در ChatGPT استفاده می‌شود و برای موارد استفاده گفتگویی با هوش بالا در نقطه قیمت رقابتی بهینه‌سازی شده است.

ویژگیجزئیات
پنجره زمینه۱۲۸٬۰۰۰ توکن ورودی، ۱۶٬۳۸۴ توکن خروجی
داده‌های آموزشیتا ۳۱ اوت ۲۰۲۵
قیمت‌گذاری ورودی۱.۷۵ دلار / ۱ میلیون توکن
قیمت‌گذاری ورودی کش شده۰.۱۷۵ دلار / ۱ میلیون توکن
قیمت‌گذاری خروجی۱۴.۰۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions، v1/responses

ویژگی‌های کلیدی:

  • هوش بالا: آخرین بهبودها برای موارد استفاده گفتگویی
  • پشتیبانی از بینایی: می‌تواند تصاویر را به عنوان ورودی پردازش کند
  • فراخوانی تابع: پشتیبانی کامل از فراخوانی تابع و خروجی‌های ساختاریافته
  • جریان‌سازی: پشتیبانی کامل از جریان‌سازی

توجه: ما GPT-5.2 را برای استفاده عمومی API توصیه می‌کنیم، اما GPT-5.3 Chat برای آزمایش آخرین بهبودهای ChatGPT در برنامه‌های محاوره‌ای ایده‌آل است.

گوگل (Gemini)

Gemini 3.1 Flash-Lite Preview

gemini-3.1-flash-lite-preview مقرون‌به‌صرفه‌ترین مدل چندوجهی گوگل است که سریع‌ترین عملکرد را برای وظایف سبک و با فرکانس بالا ارائه می‌دهد.

ویژگیجزئیات
پنجره زمینه۱٬۰۴۸٬۵۷۶ توکن ورودی، ۶۵٬۵۳۶ توکن خروجی
تاریخ قطع دانشژانویه ۲۰۲۵
قیمت‌گذاری ورودی۰.۲۵ دلار / ۱ میلیون توکن
قیمت‌گذاری ورودی کش شده۰.۰۲۵ دلار / ۱ میلیون توکن
قیمت‌گذاری خروجی۱.۵۰ دلار / ۱ میلیون توکن
قیمت‌گذاری ورودی صوتی۰.۵۰ دلار / ۱ میلیون توکن
ورودی صوتی کش شده۰.۰۵ دلار / ۱ میلیون توکن
قیمت‌گذاری خروجی صوتی۱.۵۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر، ویدیو، صوت، PDF
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions، v1beta/

ویژگی‌های کلیدی:

  • مقرون‌به‌صرفه: ارزان‌ترین مدل Gemini برای وظایف حجم بالا
  • عملکرد سریع: بهینه‌سازی شده برای برنامه‌های با تاخیر بسیار کم
  • ورودی چندوجهی: پشتیبانی از ورودی‌های متن، تصویر، ویدیو، صوت و PDF
  • پشتیبانی از تفکر: سطوح تفکر قابل تنظیم برای استدلال گام‌به‌گام
  • خروجی‌های ساختاریافته: پشتیبانی کامل از JSON schema و خروجی‌های ساختاریافته
  • فراخوانی تابع: پشتیبانی بومی از فراخوانی تابع
  • پایه‌گذاری جستجو: یکپارچه‌سازی Google Search برای پاسخ‌های دقیق
  • زمینه URL: می‌تواند محتوای وب را دریافت و پردازش کند

بهترین موارد استفاده:

  • ترجمه: ترجمه سریع، ارزان و حجم بالا در مقیاس
  • رونویسی: رونویسی صوتی و ویدیویی بدون خطوط لوله جداگانه
  • استخراج داده: استخراج موجودیت، طبقه‌بندی و پردازش داده سبک
  • خلاصه‌سازی اسناد: تجزیه PDF و بازگرداندن خلاصه‌های مختصر
  • مسیریابی مدل: استفاده به عنوان طبقه‌بندی‌کننده برای هدایت کوئری‌ها به مدل‌های مناسب بر اساس پیچیدگی وظیفه

خلاصه قیمت‌گذاری

مدلورودی (دلار/۱م توکن)ورودی کش شده (دلار/۱م توکن)خروجی (دلار/۱م توکن)
gpt-5.4-pro$30.00$0.30$180.00
gpt-5.4$2.50$0.25$15.00
gpt-5.3-chat$1.75$0.175$14.00
gemini-3.1-flash-lite-preview$0.25$0.025$1.50

نمونه درخواست و پاسخ API

نمونه GPT-5.4 Pro

bash
curl https://api.avalai.ir/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gpt-5.4-pro",
    "input": "یک معماری سیستم توزیع‌شده جامع با در نظر گرفتن تحمل خطا، مقیاس‌پذیری و امنیت برای یک پلتفرم مالی جهانی طراحی کنید.",
    "reasoning": {"effort": "high"}
  }'

نمونه GPT-5.4

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gpt-5.4",
    "messages": [
      {
        "role": "user",
        "content": "یک ویرایشگر سند مشترک بلادرنگ با حل تعارض پیاده‌سازی کنید."
      }
    ],
    "max_tokens": 4096
  }'

نمونه GPT-5.3 Chat

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gpt-5.3-chat",
    "messages": [
      {
        "role": "user",
        "content": "محاسبات کوانتومی را به زبان ساده توضیح دهید."
      }
    ]
  }'

نمونه Gemini 3.1 Flash-Lite Preview

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gemini-3.1-flash-lite-preview",
    "messages": [
      {
        "role": "user",
        "content": "متن زیر را به آلمانی ترجمه کنید: سلام، دوست داری بعدا پیتزا بخوریم؟ من خیلی گرسنه‌ام!"
      }
    ]
  }'

پاسخ:

json
{
  "id": "chatcmpl-xyz123",
  "created": 1741608788,
  "model": "gemini-3.1-flash-lite-preview",
  "object": "chat.completion",
  "system_fingerprint": null,
  "choices": [
    {
      "finish_reason": "stop",
      "index": 0,
      "message": {
        "content": "Hey, hast du Lust, später Pizza zu holen? Ich bin am Verhungern!",
        "role": "assistant",
        "thinking_blocks": [],
        "annotations": []
      }
    }
  ],
  "usage": {
    "completion_tokens": 22,
    "prompt_tokens": 28,
    "total_tokens": 50,
    "completion_tokens_details": null,
    "prompt_tokens_details": {
      "audio_tokens": null,
      "cached_tokens": null,
      "text_tokens": 28,
      "image_tokens": null
    }
  },
  "estimated_cost": {
    "unit": "0.0000400000",
    "irt": 4.58,
    "exchange_rate": 114600
  }
}

نمونه‌های استفاده از SDK

استفاده از GPT-5.4 Pro با پایتون

python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

# استفاده از API پاسخ‌ها برای استدلال پیشرفته
response = client.responses.create(
    model="gpt-5.4-pro",
    input="یک معماری سیستم توزیع‌شده جامع برای یک پلتفرم مالی جهانی طراحی کنید.",
    reasoning={"effort": "high"},
)

print(response.output)

استفاده از GPT-5.4 با پایتون

python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

response = client.chat.completions.create(
    model="gpt-5.4",
    messages=[
        {"role": "system", "content": "شما یک معمار نرم‌افزار متخصص هستید."},
        {
            "role": "user",
            "content": "یک ویرایشگر سند مشترک بلادرنگ با حل تعارض پیاده‌سازی کنید.",
        },
    ],
    max_tokens=4096,
)

print(response.choices[0].message.content)

استفاده از Gemini 3.1 Flash-Lite با پایتون

python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite-preview",
    messages=[
        {
            "role": "user",
            "content": "نکات کلیدی این سند را به صورت نقطه‌ای خلاصه کنید.",
        }
    ],
)

print(response.choices[0].message.content)

استفاده از Gemini 3.1 Flash-Lite با تفکر

python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite-preview",
    messages=[{"role": "user", "content": "هوش مصنوعی چگونه کار می‌کند؟"}],
    extra_body={"generationConfig": {"thinkingConfig": {"thinkingLevel": "high"}}},
)

print(response.choices[0].message.content)

مستندات