افزودن Qwen3.8-Max و ارتقای DeepSeek-V4-Flash
تاریخ: 1405-05-12 / (2026-08-03)
خلاصه
مدل پرچمدار جدید Alibaba با نام qwen3.8-max اکنون برای کدنویسی بلندمدت، کار حرفهای، درک چندوجهی و گردشکارهای عاملی در AvalAI در دسترس است. شناسه موجود deepseek-v4-flash نیز اکنون بهطور خودکار به DeepSeek-V4-Flash-0731، نسخه رسمی با قابلیتهای عاملی قویتر، هدایت میشود؛ هیچ تغییری در کد لازم نیست و قیمتگذاری بدون تغییر باقی میماند.
جزئیات
Alibaba: Qwen3.8-Max
دسترسی به Qwen3.8-Max (qwen3.8-max)، مدل پرچمدار جدید mixture-of-experts شرکت Alibaba با ۲٫۴ تریلیون پارامتر را اعلام میکنیم. این مدل برای برنامهریزی، اجرا و راستیآزمایی گردشکارهای طولانی کدنویسی و کار حرفهای طراحی شده و متن، تصویر، ویدئو و اسناد بسیار بزرگ را درک میکند. مستندات مدلهای Alibaba
ویژگیهای کلیدی:
- کدنویسی بلندمدت: طراحیشده برای پیادهسازی و تحویل خودکار پروژههای چندمرحلهای که میتوانند بیش از ۱۰ روز ادامه داشته باشند
- کار حرفهای: پشتیبانی از وظایف سرتاسری در حوزههای حقوقی، مالی، طراحی و سایر زمینههای تخصصی
- چندوجهی بومی: پذیرش ورودی متن، تصویر و ویدئو و تولید خروجی متنی
- زمینه ۱M توکنی: حداکثر ۹۹۱٬۰۰۰ توکن ورودی برای مخازن بزرگ، مجموعه اسناد و تحلیل ویدئوی طولانی
- ظرفیت خروجی ۱۲۸K: حداکثر ۱۲۸٬۰۰۰ توکن خروجی برای کد، تحلیل و خروجیهای حجیم
- تفکر عمیق و ابزارها: پشتیبانی از استدلال، فراخوانی تابع، انتخاب ابزار، خروجی ساختاریافته، کش پرامپت و جستجوی وب
- پشتیبانی نقاط پایانی: پشتیبانی کامل در
v1/chat/completionsوv1/messagesو پشتیبانی جزئی درv1/responses
DeepSeek: ارتقای خودکار V4 Flash
شناسه مدل deepseek-v4-flash در AvalAI اکنون به DeepSeek-V4-Flash-0731، نسخه رسمی V4 Flash شرکت DeepSeek، اشاره میکند. این نسخه جایگزین پیشنمایش شده و کدنویسی بلندمدت، کار با ترمینال، استفاده از ابزار، اتوماسیون و سایر بارهای کاری عاملی را بهطور قابلتوجهی بهبود میدهد.
- بدون نیاز به تغییر کد: همچنان
"model": "deepseek-v4-flash"را ارسال کنید - قیمتگذاری بدون تغییر: نرخ ورودی، ورودی کششده و خروجی همان قیمت قبلی است
- ساختار مدل: ۲۸۴ میلیارد پارامتر کل، ۱۳ میلیارد پارامتر فعال و ماژول speculative decoding از نوع DSpark
- تلاش استدلالی: پشتیبانی از
low،highوmax - پنجره زمینه: ۱ میلیون توکن
- نسخه رسمی: checkpoint مدل 0731 در پشت شناسه پایدار AvalAI جایگزین پیشنمایش قبلی شده است
دسترسی نقاط پایانی
| مدل | v1/chat/completions | v1/messages | v1/responses |
|---|---|---|---|
qwen3.8-max | کامل | کامل | جزئی |
deepseek-v4-flash | کامل | — | — |
قیمتگذاری
قیمتها به دلار آمریکا و به ازای ۱ میلیون توکن هستند.
| مدل | ورودی | ورودی کششده | ورودی ایجاد کش | خروجی |
|---|---|---|---|---|
qwen3.8-max | $2.00 | $0.25 | $2.50 | $6.00 |
deepseek-v4-flash | $0.14 | $0.0028 | — | $0.28 |
ارتقای DeepSeek هیچ تغییری در نرخهای موجود deepseek-v4-flash ایجاد نمیکند.
نمونه درخواست و پاسخ API
درخواست
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "qwen3.8-max",
"messages": [
{
"role": "user",
"content": "این معماری پلتفرم را بررسی کن و یک برنامه پیادهسازی مرحلهای با دروازههای راستیآزمایی پیشنهاد بده."
}
],
"extra_body": {"enable_thinking": false}
}'پاسخ
پاسخ کوتاهشده زیر ساختار استاندارد Chat Completions را نشان میدهد:
{
"id": "chatcmpl-qwen38-example",
"created": 1785744000,
"model": "qwen3.8-max",
"object": "chat.completion",
"system_fingerprint": null,
"choices": [
{
"finish_reason": "stop",
"index": 0,
"message": {
"content": "ابتدا مرزهای پایدار سرویس و معیارهای قابل اندازهگیری rollback را تعریف کنید. پیش از مهاجرت یک گردشکار کمریسک پشت feature flag، observability و contract testها را اضافه کنید و فقط پس از عبور از هر دروازه راستیآزمایی، ترافیک را افزایش دهید.",
"role": "assistant",
"thinking_blocks": [],
"annotations": []
}
}
],
"usage": {
"completion_tokens": 55,
"prompt_tokens": 23,
"total_tokens": 78,
"completion_tokens_details": null,
"prompt_tokens_details": {
"audio_tokens": null,
"cached_tokens": 0,
"text_tokens": 23,
"image_tokens": null
}
},
"estimated_cost": {
"unit": "0.0003760000",
"irt": 57.6,
"exchange_rate": 153200
}
}نمونههای استفاده از SDK
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "qwen3.8-max",
"messages": [
{
"role": "user",
"content": "برای این پلتفرم چندسرویسی یک برنامه پیادهسازی قابل اتکا طراحی کن."
}
],
"extra_body": {"enable_thinking": false}
}'from openai import OpenAI
client = OpenAI(
api_key="your-avalai-api-key",
base_url="https://api.avalai.ir/v1",
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[
{
"role": "user",
"content": "برای این پلتفرم چندسرویسی یک برنامه پیادهسازی قابل اتکا طراحی کن.",
}
],
extra_body={"enable_thinking": False},
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.AVALAI_API_KEY,
baseURL: "https://api.avalai.ir/v1",
});
const response = await client.chat.completions.create({
model: "qwen3.8-max",
messages: [
{
role: "user",
content: "برای این پلتفرم چندسرویسی یک برنامه پیادهسازی قابل اتکا طراحی کن.",
},
],
extra_body: { enable_thinking: false },
});
console.log(response.choices[0].message.content);ادامه استفاده از DeepSeek-V4-Flash بدون تغییر
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "علت ریشهای این استقرار ناموفق را پیدا کن و امنترین اصلاح را پیشنهاد بده."
}
],
"reasoning_effort": "high"
}'همین شناسه پایدار مدل اکنون بهطور خودکار از DeepSeek-V4-Flash-0731 استفاده میکند.