مدلهای جدید اضافه شدند: Grok 4.20 Beta، GLM-5-Turbo، GPT-5.4 Mini/Nano و MiniMax M2.7
تاریخ: ۱۴۰۴-۱۲-۲۷ / (2026-03-18)
خلاصه
ما افزودن هفت مدل جدید را اعلام میکنیم: Grok 4.20 Beta از X.AI (نسخههای استدلالی و غیراستدلالی) با سرعت پیشرو در صنعت و پنجره زمینه ۲ میلیون توکن، GLM-5-Turbo از Z.AI بهینهسازی شده برای سناریوهای عاملی OpenClaw، GPT-5.4 Mini و Nano از OpenAI برای کارهای حجم بالا با هزینه کارآمد، و M2.7 از MiniMax با قابلیتهای خودتکاملی و عملکرد SOTA در کدنویسی.
جزئیات
X.AI (Grok)
Grok 4.20 Beta Reasoning
grok-4.20-beta-0309-reasoning جدیدترین مدل پرچمدار X.AI با سرعت پیشرو در صنعت و قابلیتهای فراخوانی ابزار عاملی است. این مدل کمترین نرخ توهمزایی در بازار را با پایبندی دقیق به پرامپت ترکیب میکند و پاسخهای دقیق و صادقانه ارائه میدهد.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۲٬۰۰۰٬۰۰۰ توکن |
| قیمت ورودی | ۲.۰۰ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۲۰ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه) |
| قیمت خروجی | ۶.۰۰ دلار / ۱ میلیون توکن |
| قیمت ورودی (بالای ۲۰۰K) | ۴.۰۰ دلار / ۱ میلیون توکن |
| ورودی کش شده (بالای ۲۰۰K) | ۰.۴۰ دلار / ۱ میلیون توکن |
| قیمت خروجی (بالای ۲۰۰K) | ۱۲.۰۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions |
ویژگیهای کلیدی:
- حالت استدلال: مدل قبل از پاسخدهی فکر میکند برای حل مسائل پیچیده
- زمینه عظیم: پنجره زمینه ۲ میلیون توکن برای اسناد و مکالمات گسترده
- کمترین نرخ توهمزایی: دقت و صداقت پیشرو در صنعت
- پایبندی دقیق به پرامپت: پاسخهای دقیق و مداوم
- فراخوانی تابع: اتصال مدل به ابزارها و سیستمهای خارجی
- خروجیهای ساختاریافته: بازگرداندن پاسخها در قالبهای خاص و سازمانیافته
نامهای مستعار: grok-4.20-beta، grok-4.20-beta-0309، grok-4.20-beta-latest، grok-4.20-beta-latest-reasoning، grok-4.20-beta-reasoning
Grok 4.20 Beta Non-Reasoning
grok-4.20-beta-0309-non-reasoning نسخه غیراستدلالی بهینهسازی شده برای پاسخهای سریع بدون تفکر گسترده، مناسب برای برنامههای با توان عملیاتی بالا.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۲٬۰۰۰٬۰۰۰ توکن |
| قیمت ورودی | ۲.۰۰ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۲۰ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه) |
| قیمت خروجی | ۶.۰۰ دلار / ۱ میلیون توکن |
| قیمت ورودی (بالای ۲۰۰K) | ۴.۰۰ دلار / ۱ میلیون توکن |
| قیمت خروجی (بالای ۲۰۰K) | ۱۲.۰۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions |
ویژگیهای کلیدی:
- استنتاج سریع: بهینهسازی شده برای پاسخهای سریع بدون سربار استدلال
- زمینه عظیم: پنجره زمینه ۲ میلیون توکن
- توان عملیاتی بالا: مناسب برای برنامههای حساس به تأخیر
- فراخوانی تابع و خروجیهای ساختاریافته: پشتیبانی کامل از ابزارها
Z.AI (GLM)
GLM-5-Turbo
glm-5-turbo مدل پایه Z.AI است که عمیقا برای سناریوی عاملی OpenClaw بهینهسازی شده است. این مدل از مرحله آموزش برای نیازمندیهای اصلی وظایف OpenClaw بهینهسازی شده و قابلیتهای کلیدی مانند فراخوانی ابزار، پیروی از دستورات، وظایف زمانبندیشده و پایدار، و اجرای زنجیره بلند را تقویت میکند.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۲۰۰٬۰۰۰ توکن |
| حداکثر خروجی | ۱۲۸٬۰۰۰ توکن |
| قیمت ورودی | ۱.۳۲ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۲۶۴ دلار / ۱ میلیون توکن (۸۰٪ کاهش هزینه) |
| قیمت خروجی | ۴.۴۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions |
ویژگیهای کلیدی:
- مدل بومی OpenClaw: ساخته شده به طور سیستماتیک برای گردشهای کاری عاملی دنیای واقعی
- فراخوانی ابزار: فراخوانی دقیق با ثبات و قابلیت اطمینان بیشتر در وظایف چند مرحلهای
- پیروی از دستورات: تجزیه پیشرفته دستورات پیچیده و چندلایه
- وظایف زمانبندیشده: درک بهتر ابعاد زمانی برای تریگرهای زمانبندیشده و وظایف طولانیمدت
- زنجیرههای بلند با توان بالا: اجرای سریعتر و پایدارتر برای وظایف با توان داده بالا
- حالت تفکر: حالتهای تفکر متعدد برای سناریوهای مختلف
- خروجی جریانی: پاسخهای جریانی بلادرنگ
- کش زمینه: مکانیزم کش هوشمند برای بهینهسازی عملکرد
- خروجی ساختاریافته: پشتیبانی از JSON و سایر قالبهای ساختاریافته
- پشتیبانی MCP: یکپارچهسازی انعطافپذیر ابزارها و منابع داده MCP خارجی
OpenAI
GPT-5.4 Mini
gpt-5.4-mini قویترین مدل مینی OpenAI برای کدنویسی، استفاده از کامپیوتر و زیرعاملها است. این مدل قدرتهای GPT-5.4 را به مدلی سریعتر و کارآمدتر طراحی شده برای حجم کاری بالا میآورد.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۴۰۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی |
| دادههای آموزشی | تا ۳۱ اوت ۲۰۲۵ |
| قیمت ورودی | ۰.۷۵ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۰۷۵ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه) |
| قیمت خروجی | ۴.۵۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions، v1/responses |
ویژگیهای کلیدی:
- پشتیبانی از توکن استدلال: قابلیتهای استدلال بالاتر با سرعت بالا
- پنجره زمینه ۴۰۰K: مکالمات و پردازش اسناد گسترده
- حداکثر ۱۲۸K توکن خروجی: قابلیت تولید گسترده
- فراخوانی تابع و خروجیهای ساختاریافته: پشتیبانی کامل از ابزارها
- جریانسازی: پشتیبانی کامل از جریانسازی
- پشتیبانی از تقطیر: قابل استفاده برای تقطیر مدل
- استفاده از کامپیوتر: پشتیبانی از طریق Responses API
- پشتیبانی MCP: پشتیبانی از پروتکل زمینه مدل
نامهای مستعار: gpt-5.4-mini-2026-03-17
GPT-5.4 Nano
gpt-5.4-nano ارزانترین مدل کلاس GPT-5.4 برای وظایف ساده با حجم بالا است. طراحی شده برای وظایفی که سرعت و هزینه مهمترین هستند مانند طبقهبندی، استخراج داده، رتبهبندی و زیرعاملها.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۴۰۰٬۰۰۰ توکن ورودی، ۱۲۸٬۰۰۰ توکن خروجی |
| دادههای آموزشی | تا ۳۱ اوت ۲۰۲۵ |
| قیمت ورودی | ۰.۲۰ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۰۲ دلار / ۱ میلیون توکن (۹۰٪ کاهش هزینه) |
| قیمت خروجی | ۱.۲۵ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن، تصویر |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions، v1/responses |
ویژگیهای کلیدی:
- استدلال بالا: استدلال قوی با کمترین هزینه
- سرعت بالا: بهینهسازی شده برای وظایف حجم بالا
- پنجره زمینه ۴۰۰K: مدیریت زمینه گسترده
- حداکثر ۱۲۸K توکن خروجی: تولید گسترده
- فراخوانی تابع و خروجیهای ساختاریافته: پشتیبانی کامل
- جریانسازی: پشتیبانی کامل از جریانسازی
- پشتیبانی MCP: پشتیبانی از پروتکل زمینه مدل
نامهای مستعار: gpt-5.4-nano-2026-03-17
MiniMax
MiniMax M2.7
minimax-m2.7 اولین مدل MiniMax است که عمیقا در تکامل خود شرکت میکند. M2.7 قادر به ساخت هارنسهای عامل پیچیده و تکمیل وظایف بهرهوری بسیار پیچیده با استفاده از قابلیتهایی مانند تیمهای عامل، مهارتهای پیچیده و جستجوی ابزار پویا است.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۲۰۴٬۰۰۰ توکن |
| حداکثر خروجی | ۱۲۸٬۰۰۰ توکن |
| قیمت ورودی | ۰.۳۰ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۰۶ دلار / ۱ میلیون توکن (۸۰٪ کاهش هزینه) |
| قیمت ایجاد کش | ۰.۳۷۵ دلار / ۱ میلیون توکن |
| قیمت خروجی | ۱.۲۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions |
ویژگیهای کلیدی:
- خودتکاملی: اولین مدلی که عمیقا در تکامل خود شرکت میکند
- مهندسی نرمافزار SOTA: ۵۶.۲۲٪ در SWE-Pro، تقریبا همسطح با بهترین سطح Opus
- بهرهوری حرفهای: امتیاز ELO 1495 در GDPval-AA (بالاترین بین مدلهای متنباز)
- تعامل با محیط پیچیده: ۹۷٪ نرخ پایبندی به مهارت با ۴۰+ مهارت پیچیده
- تیمهای عامل: پشتیبانی بومی از همکاری چند عامله
- یکپارچهسازی مجموعه آفیس: مدیریت پیشرفته Word، Excel، PPT با ویرایش چند دوری با وفاداری بالا
- ثبات شخصیت: هوش هیجانی عالی برای سرگرمی تعاملی
- سرعت خروجی: تقریبا ۶۰ توکن در ثانیه
نقاط قوت عملکرد:
- تحویل پروژه کامل انتها به انتها (VIBE-Pro 55.6%)
- Terminal Bench 2 (57.0%) برای درک عمیق سیستمهای مهندسی پیچیده
- Multi-SWE-Bench (52.7%)
- SWE Multilingual (76.5%)
MiniMax M2.7 Highspeed
minimax-m2.7-highspeed نسخه فوقسریع M2.7، بهینهسازی شده برای سرعت با حفظ قابلیتهای یکسان.
| ویژگی | جزئیات |
|---|---|
| پنجره زمینه | ۲۰۴٬۰۰۰ توکن |
| حداکثر خروجی | ۱۲۸٬۰۰۰ توکن |
| قیمت ورودی | ۰.۶۰ دلار / ۱ میلیون توکن |
| قیمت ورودی کش شده | ۰.۰۶ دلار / ۱ میلیون توکن |
| قیمت ایجاد کش | ۰.۳۷۵ دلار / ۱ میلیون توکن |
| قیمت خروجی | ۲.۴۰ دلار / ۱ میلیون توکن |
| ورودیهای پشتیبانیشده | متن |
| خروجیهای پشتیبانیشده | متن |
| نقاط پایانی پشتیبانیشده | v1/chat/completions |
ویژگیهای کلیدی:
- سرعت خروجی: تقریبا ۱۰۰ توکن در ثانیه (سریعتر از سایر مدلهای پیشرو)
- قابلیتهای مشابه M2.7: هوش یکسان با توان عملیاتی بالاتر
- عملیات کمهزینه: کارآمد برای برنامههای بلادرنگ
- پشتیبانی کامل از ابزار: همان پشتیبانی فراخوانی ابزار و مهارت مانند M2.7
خلاصه قیمتگذاری
| مدل | ورودی (دلار/۱م توکن) | ورودی کش شده (دلار/۱م توکن) | خروجی (دلار/۱م توکن) |
|---|---|---|---|
grok-4.20-beta-0309-reasoning | $2.00 | $0.20 | $6.00 |
grok-4.20-beta-0309-non-reasoning | $2.00 | $0.20 | $6.00 |
glm-5-turbo | $1.32 | $0.264 | $4.40 |
gpt-5.4-mini | $0.75 | $0.075 | $4.50 |
gpt-5.4-nano | $0.20 | $0.02 | $1.25 |
minimax-m2.7 | $0.30 | $0.06 | $1.20 |
minimax-m2.7-highspeed | $0.60 | $0.06 | $2.40 |
نمونه درخواست و پاسخ API
نمونه Grok 4.20 Beta Reasoning
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "grok-4.20-beta-0309-reasoning",
"messages": [
{
"role": "user",
"content": "یک استراتژی بازاریابی دیجیتال جامع برای یک استارتاپ فناوری طراحی کنید."
}
],
"max_tokens": 4096
}'نمونه GLM-5-Turbo با حالت تفکر
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "glm-5-turbo",
"messages": [
{
"role": "user",
"content": "به عنوان یک متخصص بازاریابی، یک شعار جذاب برای پلتفرم باز Z.AI ایجاد کنید."
}
],
"thinking": {
"type": "enabled"
},
"max_tokens": 4096,
"temperature": 1.0
}'نمونه GPT-5.4 Mini
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-5.4-mini",
"messages": [
{
"role": "user",
"content": "یک کلاینت API با محدودیت نرخ در پایتون با بازگشت نمایی پیادهسازی کنید."
}
],
"max_tokens": 4096
}'نمونه GPT-5.4 Nano
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-5.4-nano",
"messages": [
{
"role": "user",
"content": "متن زیر را به عنوان مثبت، منفی یا خنثی طبقهبندی کنید: 'محصول خوب کار میکند اما ارسال کند بود.'"
}
]
}'نمونه MiniMax M2.7
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "minimax-m2.7",
"messages": [
{
"role": "user",
"content": "یک هارنس عامل تحقیقاتی بسازید که بتواند خطوط لوله داده، محیطهای آموزش و همکاری بین تیمی را مدیریت کند."
}
],
"max_tokens": 8192
}'نمونههای استفاده از SDK
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-5.4-mini",
"messages": [
{
"role": "user",
"content": "تفاوتهای کلیدی بین معماری میکروسرویس و مونولیتیک را توضیح دهید."
}
]
}'from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
# استفاده از GPT-5.4 Mini
response = client.chat.completions.create(
model="gpt-5.4-mini",
messages=[
{
"role": "user",
"content": "تفاوتهای کلیدی بین معماری میکروسرویس و مونولیتیک را توضیح دهید.",
}
],
)
print(response.choices[0].message.content)
# استفاده از Grok 4.20 Beta
response = client.chat.completions.create(
model="grok-4.20-beta-0309-reasoning",
messages=[
{
"role": "user",
"content": "یک معماری سیستم توزیعشده با تحمل خطا طراحی کنید.",
}
],
max_tokens=4096,
)
print(response.choices[0].message.content)import { OpenAI } from "openai";
const client = new OpenAI({
apiKey: process.env.AVALAI_API_KEY,
baseURL: "https://api.avalai.ir/v1",
});
// استفاده از GPT-5.4 Mini
const response = await client.chat.completions.create({
model: "gpt-5.4-mini",
messages: [
{
role: "user",
content: "تفاوتهای کلیدی بین معماری میکروسرویس و مونولیتیک را توضیح دهید.",
},
],
});
console.log(response.choices[0].message.content);
// استفاده از MiniMax M2.7
const m2Response = await client.chat.completions.create({
model: "minimax-m2.7",
messages: [
{
role: "user",
content: "یک عامل بسازید که بتواند به طور خودمختار آزمایشهای ML را مدیریت کند.",
},
],
max_tokens: 8192,
});
console.log(m2Response.choices[0].message.content);