داشبورد توسعه‌دهنده
پرسش از هوش مصنوعی
پرسش از هوش مصنوعی

مدل‌های جدید اضافه شدند: Grok 4.20 Beta، GLM-5-Turbo، GPT-5.4 Mini/Nano و MiniMax M2.7

تاریخ: ۱۴۰۴-۱۲-۲۷ / (2026-03-18)

خلاصه

ما افزودن هفت مدل جدید را اعلام می‌کنیم: Grok 4.20 Beta از X.AI (نسخه‌های استدلالی و غیراستدلالی) با سرعت پیشرو در صنعت و پنجره زمینه ۲ میلیون توکن، GLM-5-Turbo از Z.AI بهینه‌سازی شده برای سناریوهای عاملی OpenClaw، GPT-5.4 Mini و Nano از OpenAI برای کارهای حجم بالا با هزینه کارآمد، و M2.7 از MiniMax با قابلیت‌های خودتکاملی و عملکرد SOTA در کدنویسی.


جزئیات

X.AI (Grok)

Grok 4.20 Beta Reasoning

grok-4.20-beta-0309-reasoning جدیدترین مدل پرچمدار X.AI با سرعت پیشرو در صنعت و قابلیت‌های فراخوانی ابزار عاملی است. این مدل کمترین نرخ توهم‌زایی در بازار را با پایبندی دقیق به پرامپت ترکیب می‌کند و پاسخ‌های دقیق و صادقانه ارائه می‌دهد.

ویژگیجزئیات
پنجره زمینه۲٬۰۰۰٬۰۰۰ توکن
قیمت ورودی۲.۰۰ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۲۰ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه)
قیمت خروجی۶.۰۰ دلار / ۱ میلیون توکن
قیمت ورودی (بالای ۲۰۰K)۴.۰۰ دلار / ۱ میلیون توکن
ورودی کش شده (بالای ۲۰۰K)۰.۴۰ دلار / ۱ میلیون توکن
قیمت خروجی (بالای ۲۰۰K)۱۲.۰۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions

ویژگی‌های کلیدی:

  • حالت استدلال: مدل قبل از پاسخ‌دهی فکر می‌کند برای حل مسائل پیچیده
  • زمینه عظیم: پنجره زمینه ۲ میلیون توکن برای اسناد و مکالمات گسترده
  • کمترین نرخ توهم‌زایی: دقت و صداقت پیشرو در صنعت
  • پایبندی دقیق به پرامپت: پاسخ‌های دقیق و مداوم
  • فراخوانی تابع: اتصال مدل به ابزارها و سیستم‌های خارجی
  • خروجی‌های ساختاریافته: بازگرداندن پاسخ‌ها در قالب‌های خاص و سازمان‌یافته

نام‌های مستعار: grok-4.20-beta، grok-4.20-beta-0309، grok-4.20-beta-latest، grok-4.20-beta-latest-reasoning، grok-4.20-beta-reasoning

Grok 4.20 Beta Non-Reasoning

grok-4.20-beta-0309-non-reasoning نسخه غیراستدلالی بهینه‌سازی شده برای پاسخ‌های سریع بدون تفکر گسترده، مناسب برای برنامه‌های با توان عملیاتی بالا.

ویژگیجزئیات
پنجره زمینه۲٬۰۰۰٬۰۰۰ توکن
قیمت ورودی۲.۰۰ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۲۰ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه)
قیمت خروجی۶.۰۰ دلار / ۱ میلیون توکن
قیمت ورودی (بالای ۲۰۰K)۴.۰۰ دلار / ۱ میلیون توکن
قیمت خروجی (بالای ۲۰۰K)۱۲.۰۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions

ویژگی‌های کلیدی:

  • استنتاج سریع: بهینه‌سازی شده برای پاسخ‌های سریع بدون سربار استدلال
  • زمینه عظیم: پنجره زمینه ۲ میلیون توکن
  • توان عملیاتی بالا: مناسب برای برنامه‌های حساس به تأخیر
  • فراخوانی تابع و خروجی‌های ساختاریافته: پشتیبانی کامل از ابزارها

Z.AI (GLM)

GLM-5-Turbo

glm-5-turbo مدل پایه Z.AI است که عمیقا برای سناریوی عاملی OpenClaw بهینه‌سازی شده است. این مدل از مرحله آموزش برای نیازمندی‌های اصلی وظایف OpenClaw بهینه‌سازی شده و قابلیت‌های کلیدی مانند فراخوانی ابزار، پیروی از دستورات، وظایف زمان‌بندی‌شده و پایدار، و اجرای زنجیره بلند را تقویت می‌کند.

ویژگیجزئیات
پنجره زمینه۲۰۰٬۰۰۰ توکن
حداکثر خروجی۱۲۸٬۰۰۰ توکن
قیمت ورودی۱.۳۲ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۲۶۴ دلار / ۱ میلیون توکن (۸۰٪ کاهش هزینه)
قیمت خروجی۴.۴۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions

ویژگی‌های کلیدی:

  • مدل بومی OpenClaw: ساخته شده به طور سیستماتیک برای گردش‌های کاری عاملی دنیای واقعی
  • فراخوانی ابزار: فراخوانی دقیق با ثبات و قابلیت اطمینان بیشتر در وظایف چند مرحله‌ای
  • پیروی از دستورات: تجزیه پیشرفته دستورات پیچیده و چندلایه
  • وظایف زمان‌بندی‌شده: درک بهتر ابعاد زمانی برای تریگرهای زمان‌بندی‌شده و وظایف طولانی‌مدت
  • زنجیره‌های بلند با توان بالا: اجرای سریع‌تر و پایدارتر برای وظایف با توان داده بالا
  • حالت تفکر: حالت‌های تفکر متعدد برای سناریوهای مختلف
  • خروجی جریانی: پاسخ‌های جریانی بلادرنگ
  • کش زمینه: مکانیزم کش هوشمند برای بهینه‌سازی عملکرد
  • خروجی ساختاریافته: پشتیبانی از JSON و سایر قالب‌های ساختاریافته
  • پشتیبانی MCP: یکپارچه‌سازی انعطاف‌پذیر ابزارها و منابع داده MCP خارجی

OpenAI

GPT-5.4 Mini

gpt-5.4-mini قوی‌ترین مدل مینی OpenAI برای کدنویسی، استفاده از کامپیوتر و زیرعامل‌ها است. این مدل قدرت‌های GPT-5.4 را به مدلی سریع‌تر و کارآمدتر طراحی شده برای حجم کاری بالا می‌آورد.

ویژگیجزئیات
پنجره زمینه۴۰۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی
داده‌های آموزشیتا ۳۱ اوت ۲۰۲۵
قیمت ورودی۰.۷۵ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۰۷۵ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه)
قیمت خروجی۴.۵۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions، v1/responses

ویژگی‌های کلیدی:

  • پشتیبانی از توکن استدلال: قابلیت‌های استدلال بالاتر با سرعت بالا
  • پنجره زمینه ۴۰۰K: مکالمات و پردازش اسناد گسترده
  • حداکثر ۱۲۸K توکن خروجی: قابلیت تولید گسترده
  • فراخوانی تابع و خروجی‌های ساختاریافته: پشتیبانی کامل از ابزارها
  • جریان‌سازی: پشتیبانی کامل از جریان‌سازی
  • پشتیبانی از تقطیر: قابل استفاده برای تقطیر مدل
  • استفاده از کامپیوتر: پشتیبانی از طریق Responses API
  • پشتیبانی MCP: پشتیبانی از پروتکل زمینه مدل

نام‌های مستعار: gpt-5.4-mini-2026-03-17

GPT-5.4 Nano

gpt-5.4-nano ارزان‌ترین مدل کلاس GPT-5.4 برای وظایف ساده با حجم بالا است. طراحی شده برای وظایفی که سرعت و هزینه مهم‌ترین هستند مانند طبقه‌بندی، استخراج داده، رتبه‌بندی و زیرعامل‌ها.

ویژگیجزئیات
پنجره زمینه۴۰۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی
داده‌های آموزشیتا ۳۱ اوت ۲۰۲۵
قیمت ورودی۰.۲۰ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۰۲ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه)
قیمت خروجی۱.۲۵ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن، تصویر
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions، v1/responses

ویژگی‌های کلیدی:

  • استدلال بالا: استدلال قوی با کمترین هزینه
  • سرعت بالا: بهینه‌سازی شده برای وظایف حجم بالا
  • پنجره زمینه ۴۰۰K: مدیریت زمینه گسترده
  • حداکثر ۱۲۸K توکن خروجی: تولید گسترده
  • فراخوانی تابع و خروجی‌های ساختاریافته: پشتیبانی کامل
  • جریان‌سازی: پشتیبانی کامل از جریان‌سازی
  • پشتیبانی MCP: پشتیبانی از پروتکل زمینه مدل

نام‌های مستعار: gpt-5.4-nano-2026-03-17

MiniMax

MiniMax M2.7

minimax-m2.7 اولین مدل MiniMax است که عمیقا در تکامل خود شرکت می‌کند. M2.7 قادر به ساخت هارنس‌های عامل پیچیده و تکمیل وظایف بهره‌وری بسیار پیچیده با استفاده از قابلیت‌هایی مانند تیم‌های عامل، مهارت‌های پیچیده و جستجوی ابزار پویا است.

ویژگیجزئیات
پنجره زمینه۲۰۴٬۰۰۰ توکن
حداکثر خروجی۱۲۸٬۰۰۰ توکن
قیمت ورودی۰.۳۰ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۰۶ دلار / ۱ میلیون توکن (۸۰٪ کاهش هزینه)
قیمت ایجاد کش۰.۳۷۵ دلار / ۱ میلیون توکن
قیمت خروجی۱.۲۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions

ویژگی‌های کلیدی:

  • خودتکاملی: اولین مدلی که عمیقا در تکامل خود شرکت می‌کند
  • مهندسی نرم‌افزار SOTA: ۵۶.۲۲٪ در SWE-Pro، تقریبا هم‌سطح با بهترین سطح Opus
  • بهره‌وری حرفه‌ای: امتیاز ELO 1495 در GDPval-AA (بالاترین بین مدل‌های متن‌باز)
  • تعامل با محیط پیچیده: ۹۷٪ نرخ پایبندی به مهارت با ۴۰+ مهارت پیچیده
  • تیم‌های عامل: پشتیبانی بومی از همکاری چند عامله
  • یکپارچه‌سازی مجموعه آفیس: مدیریت پیشرفته Word، Excel، PPT با ویرایش چند دوری با وفاداری بالا
  • ثبات شخصیت: هوش هیجانی عالی برای سرگرمی تعاملی
  • سرعت خروجی: تقریبا ۶۰ توکن در ثانیه

نقاط قوت عملکرد:

  • تحویل پروژه کامل انتها به انتها (VIBE-Pro 55.6%)
  • Terminal Bench 2 (57.0%) برای درک عمیق سیستم‌های مهندسی پیچیده
  • Multi-SWE-Bench (52.7%)
  • SWE Multilingual (76.5%)

MiniMax M2.7 Highspeed

minimax-m2.7-highspeed نسخه فوق‌سریع M2.7، بهینه‌سازی شده برای سرعت با حفظ قابلیت‌های یکسان.

ویژگیجزئیات
پنجره زمینه۲۰۴٬۰۰۰ توکن
حداکثر خروجی۱۲۸٬۰۰۰ توکن
قیمت ورودی۰.۶۰ دلار / ۱ میلیون توکن
قیمت ورودی کش شده۰.۰۶ دلار / ۱ میلیون توکن
قیمت ایجاد کش۰.۳۷۵ دلار / ۱ میلیون توکن
قیمت خروجی۲.۴۰ دلار / ۱ میلیون توکن
ورودی‌های پشتیبانی‌شدهمتن
خروجی‌های پشتیبانی‌شدهمتن
نقاط پایانی پشتیبانی‌شدهv1/chat/completions

ویژگی‌های کلیدی:

  • سرعت خروجی: تقریبا ۱۰۰ توکن در ثانیه (سریع‌تر از سایر مدل‌های پیشرو)
  • قابلیت‌های مشابه M2.7: هوش یکسان با توان عملیاتی بالاتر
  • عملیات کم‌هزینه: کارآمد برای برنامه‌های بلادرنگ
  • پشتیبانی کامل از ابزار: همان پشتیبانی فراخوانی ابزار و مهارت مانند M2.7

خلاصه قیمت‌گذاری

مدلورودی (دلار/۱م توکن)ورودی کش شده (دلار/۱م توکن)خروجی (دلار/۱م توکن)
grok-4.20-beta-0309-reasoning$2.00$0.20$6.00
grok-4.20-beta-0309-non-reasoning$2.00$0.20$6.00
glm-5-turbo$1.32$0.264$4.40
gpt-5.4-mini$0.75$0.075$4.50
gpt-5.4-nano$0.20$0.02$1.25
minimax-m2.7$0.30$0.06$1.20
minimax-m2.7-highspeed$0.60$0.06$2.40

نمونه درخواست و پاسخ API

نمونه Grok 4.20 Beta Reasoning

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "grok-4.20-beta-0309-reasoning",
    "messages": [
      {
        "role": "user",
        "content": "یک استراتژی بازاریابی دیجیتال جامع برای یک استارتاپ فناوری طراحی کنید."
      }
    ],
    "max_tokens": 4096
  }'

نمونه GLM-5-Turbo با حالت تفکر

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "glm-5-turbo",
    "messages": [
      {
        "role": "user",
        "content": "به عنوان یک متخصص بازاریابی، یک شعار جذاب برای پلتفرم باز Z.AI ایجاد کنید."
      }
    ],
    "thinking": {
      "type": "enabled"
    },
    "max_tokens": 4096,
    "temperature": 1.0
  }'

نمونه GPT-5.4 Mini

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gpt-5.4-mini",
    "messages": [
      {
        "role": "user",
        "content": "یک کلاینت API با محدودیت نرخ در پایتون با بازگشت نمایی پیاده‌سازی کنید."
      }
    ],
    "max_tokens": 4096
  }'

نمونه GPT-5.4 Nano

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gpt-5.4-nano",
    "messages": [
      {
        "role": "user",
        "content": "متن زیر را به عنوان مثبت، منفی یا خنثی طبقه‌بندی کنید: 'محصول خوب کار می‌کند اما ارسال کند بود.'"
      }
    ]
  }'

نمونه MiniMax M2.7

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "minimax-m2.7",
    "messages": [
      {
        "role": "user",
        "content": "یک هارنس عامل تحقیقاتی بسازید که بتواند خطوط لوله داده، محیط‌های آموزش و همکاری بین تیمی را مدیریت کند."
      }
    ],
    "max_tokens": 8192
  }'

نمونه‌های استفاده از SDK

bash
curl https://api.avalai.ir/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $AVALAI_API_KEY" \
  -d '{
    "model": "gpt-5.4-mini",
    "messages": [
      {
        "role": "user",
        "content": "تفاوت‌های کلیدی بین معماری میکروسرویس و مونولیتیک را توضیح دهید."
      }
    ]
  }'
python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

# استفاده از GPT-5.4 Mini
response = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[
        {
            "role": "user",
            "content": "تفاوت‌های کلیدی بین معماری میکروسرویس و مونولیتیک را توضیح دهید.",
        }
    ],
)

print(response.choices[0].message.content)

# استفاده از Grok 4.20 Beta
response = client.chat.completions.create(
    model="grok-4.20-beta-0309-reasoning",
    messages=[
        {
            "role": "user",
            "content": "یک معماری سیستم توزیع‌شده با تحمل خطا طراحی کنید.",
        }
    ],
    max_tokens=4096,
)

print(response.choices[0].message.content)
javascript
import { OpenAI } from "openai";

const client = new OpenAI({
  apiKey: process.env.AVALAI_API_KEY,
  baseURL: "https://api.avalai.ir/v1",
});

// استفاده از GPT-5.4 Mini
const response = await client.chat.completions.create({
  model: "gpt-5.4-mini",
  messages: [
    {
      role: "user",
      content: "تفاوت‌های کلیدی بین معماری میکروسرویس و مونولیتیک را توضیح دهید.",
    },
  ],
});

console.log(response.choices[0].message.content);

// استفاده از MiniMax M2.7
const m2Response = await client.chat.completions.create({
  model: "minimax-m2.7",
  messages: [
    {
      role: "user",
      content: "یک عامل بسازید که بتواند به طور خودمختار آزمایش‌های ML را مدیریت کند.",
    },
  ],
  max_tokens: 8192,
});

console.log(m2Response.choices[0].message.content);

لینک‌های مستندات