مدل پرچمدار جدید اضافه شد: Claude Opus 4.8
تاریخ: ۱۴۰۵-۰۳-۰۷ / (2026-05-28)
خلاصه
مدل Claude Opus 4.8، توانمندترین مدل عمومی Anthropic تا به امروز، اکنون در AvalAI در دسترس است. Opus 4.8 با بهبود در کدنویسی عاملی افق بلند، کالیبراسیون تلاش استدلالی، فراخوانی ابزار و صداقت، بر پایه Opus 4.7 ساخته شده است. این مدل دارای پنجره زمینه بومی ۱ میلیون توکنی، حداکثر ۱۲۸ هزار توکن خروجی، تفکر تطبیقی، پیامهای سیستمی میان مکالمه، جزئیات توقف امتناع و حداقل ۱٬۰۲۴ توکنی برای کش پرامپت است. از طریق v1/chat/completions به همراه پشتیبانی کامل در v1/messages و پشتیبانی جزئی در v1/responses در دسترس است، همه با همان قیمتگذاری Opus 4.7.
جزئیات
Anthropic
ما دسترسی به Claude Opus 4.8 (claude-opus-4-8)، توانمندترین مدل عمومی Anthropic تا به امروز برای استدلال پیچیده، کدنویسی عاملی افق بلند و کارهای با خودگردانی بالا را اعلام میکنیم. مستندات
ویژگیهای کلیدی:
- بهبود کدنویسی عاملی افق بلند: مدیریت بهتر زمینه طولانی، فشردهسازیهای کمتر و بازیابی بهتر پس از فشردهسازی برای وظایف در مقیاس پایگاه کد
- کالیبراسیون تلاش استدلالی: رفتار قابل اعتمادتر در هر سطح تلاش در طیف وسیعی از حوزهها
- فراخوانی بهتر ابزار: کاهش موارد رد کردن فراخوانی ابزار مورد نیاز وظیفه و رفع مشکلات verbosity در کامنتها و فراخوانی ابزار که در Opus 4.7 دیده میشد
- افزایش صداقت: تقریبا چهار برابر کمتر از Opus 4.7 احتمال دارد که نقصهای کد نوشتهشده توسط خود را بدون اشاره عبور دهد، با گزارش قابل اعتمادتر عدم قطعیت
- پنجره زمینه بومی ۱ میلیون توکنی: پشتیبانی پیشفرض در Claude API برای زمینه گسترده تا ۱ میلیون توکن
- ۱۲۸ هزار توکن خروجی: پشتیبانی از تولید خروجی بزرگتر
- تفکر تطبیقی: تنها حالت تفکر پشتیبانیشده در Opus 4.8 (بودجه تفکر گسترده حذف شده)
- پیامهای سیستمی میان مکالمه: افزودن دستورالعملهای بهروزرسانی شده در ادامه مکالمههای طولانی بدون شکستن hit کش پرامپت یا بازنویسی کامل پرامپت سیستم
- جزئیات توقف امتناع: شی
stop_detailsدر پاسخهای امتناع اکنون بهطور عمومی مستند شده و مسیریابی کلاسهای مختلف درخواستهای رد شده را آسان میکند - حداقل کش پرامپت پایینتر: حداقل طول قابل کشگذاری پرامپت اکنون ۱٬۰۲۴ توکن (کاهش از Opus 4.7) است که امکان ایجاد ورودیهای کش برای پرامپتهای کوتاهتر را فراهم میکند
- مقادیر پیشفرض تلاش:
highسطح تلاش پیشفرض در Claude API و Claude Code است؛ ازlow،medium،high،xhighوmaxپشتیبانی میکند - عاملهای قوی استفاده از کامپیوتر و مرورگر: ۸۴٪ در Online-Mind2Web، جهش قابل توجهی نسبت به Opus 4.7
- همراستایی بهبود یافته: نرخهای قابل توجه پایینتر رفتارهای ناهمراستا نسبت به Opus 4.7 و ویژگیهای اجتماعی قویتر
- مسیریابی هوشمند: توزیع در بین Anthropic API، AWS Bedrock، Azure AI و Vertex AI برای بالاترین عملکرد و دسترسیپذیری
- پشتیبانی نقاط پایانی: در دسترس در
v1/chat/completions(پشتیبانی کامل)،v1/messages(پشتیبانی کامل) وv1/responses(پشتیبانی جزئی)
جزئیات قیمتگذاری:
| مدل | ورودی | ورودی کش شده | ورودی ایجاد کش | خروجی |
|---|---|---|---|---|
| claude-opus-4-8 | ۵.۰۰ دلار/۱M توکن | ۱.۵۰ دلار/۱M توکن | ۶.۲۵ دلار/۱M توکن | ۲۵.۰۰ دلار/۱M توکن |
قیمتگذاری نسبت به Claude Opus 4.7 تغییر نکرده است. AvalAI در حال حاضر Opus 4.8 را با نرخ استفاده عادی محاسبه میکند.
مسیریابی هوشمند
Claude Opus 4.8 از نام مستعار claude-opus-4-8 با مسیریابی هوشمند در تمام ارائهدهندگان ابری رسمی Anthropic استفاده میکند. ارائهدهنده زیرساختی میتواند Anthropic API، AWS Bedrock، Azure AI یا Vertex AI باشد و درخواستها برای بالاترین عملکرد و دسترسیپذیری به بهترین ارائهدهنده موجود توزیع میشوند.
هنگامی که یک درخواست از طریق AWS Bedrock مسیریابی میشود، فیلد model در پاسخ شناسه مدل Bedrock (مانند global.anthropic.claude-opus-4-8) را نشان خواهد داد.
نمونههای درخواست/پاسخ API
نمونه درخواست (v1/chat/completions)
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "claude-opus-4-8",
"messages": [
{
"role": "user",
"content": "سلام!"
}
]
}'نمونه پاسخ
{
"id": "chatcmpl-2af11...",
"created": 1779148800,
"model": "global.anthropic.claude-opus-4-8",
"object": "chat.completion",
"system_fingerprint": null,
"choices": [
{
"finish_reason": "stop",
"index": 0,
"message": {
"content": "سلام! 👋 چطور میتوانم کمکتان کنم؟",
"role": "assistant",
"annotations": []
}
}
],
"usage": {
"completion_tokens": 14,
"prompt_tokens": 9,
"total_tokens": 23,
"completion_tokens_details": {
"reasoning_tokens": 0,
"text_tokens": 14
},
"prompt_tokens_details": {
"audio_tokens": null,
"cached_tokens": 0,
"text_tokens": 9,
"image_tokens": null,
"video_tokens": null,
"cache_creation_tokens": 0
},
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
},
"estimated_cost": {
"unit": "0.0003950000",
"irt": 60.51,
"exchange_rate": 153200
},
"service_tier": "default"
}توجه
فیلد model در پاسخ ممکن است شناسه مدل ارائهدهنده زیرساختی (مانند global.anthropic.claude-opus-4-8 برای AWS Bedrock) را نمایش دهد نه نام مستعار claude-opus-4-8. این رفتار طبیعی مسیریابی هوشمند است.
نمونههای استفاده از SDK
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "claude-opus-4-8",
"messages": [
{
"role": "user",
"content": "یک پایگاه کد چندسرویسی بزرگ را برای استفاده از میانافزار مدیریت خطای مشترک بازنویسی کن."
}
]
}'from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
# استفاده از claude-opus-4-8 با مسیریابی هوشمند در تمام ارائهدهندگان Anthropic
completion = client.chat.completions.create(
model="claude-opus-4-8", # مسیریابی هوشمند در Anthropic، AWS، Azure، GCP
messages=[
{
"role": "user",
"content": "یک پایگاه کد چندسرویسی بزرگ را برای استفاده از میانافزار مدیریت خطای مشترک بازنویسی کن.",
}
],
)
print(completion.choices[0].message.content)import { OpenAI } from "openai";
const client = new OpenAI({
apiKey: process.env.AVALAI_API_KEY,
baseURL: "https://api.avalai.ir/v1",
});
// استفاده از claude-opus-4-8 با مسیریابی هوشمند در تمام ارائهدهندگان Anthropic
const completion = await client.chat.completions.create({
model: "claude-opus-4-8", // مسیریابی هوشمند در Anthropic، AWS، Azure، GCP
messages: [
{
role: "user",
content:
"یک پایگاه کد چندسرویسی بزرگ را برای استفاده از میانافزار مدیریت خطای مشترک بازنویسی کن.",
},
],
});
console.log(completion.choices[0].message.content);استفاده از SDK Anthropic (v1/messages)
curl https://api.avalai.ir/v1/messages \
-H "Content-Type: application/json" \
-H "x-api-key: $AVALAI_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-4-8",
"max_tokens": 1024,
"messages": [
{
"role": "user",
"content": "پیامهای سیستمی میان مکالمه را در Claude Opus 4.8 توضیح بده."
}
]
}'import anthropic
client = anthropic.Anthropic(
api_key="your-avalai-api-key", base_url="https://api.avalai.ir"
)
message = client.messages.create(
model="claude-opus-4-8", # مسیریابی هوشمند فعال
max_tokens=1024,
messages=[
{
"role": "user",
"content": "پیامهای سیستمی میان مکالمه را در Claude Opus 4.8 توضیح بده.",
}
],
)
print(message.content[0].text)import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic({
apiKey: process.env.AVALAI_API_KEY,
baseURL: "https://api.avalai.ir",
});
const message = await client.messages.create({
model: "claude-opus-4-8", // مسیریابی هوشمند فعال
max_tokens: 1024,
messages: [
{
role: "user",
content: "پیامهای سیستمی میان مکالمه را در Claude Opus 4.8 توضیح بده.",
},
],
});
console.log(message.content[0].text);پیامهای سیستمی میان مکالمه
Claude Opus 4.8 از پیامهای role: "system" بلافاصله پس از یک نوبت کاربر در آرایه messages پشتیبانی میکند. این قابلیت به شما اجازه میدهد دستورالعملهای بهروزرسانیشده را در ادامه یک مکالمه طولانی بدون بازنویسی کامل پرامپت سیستم اضافه کنید، که hit کش پرامپت در نوبتهای قبلی را حفظ کرده و هزینه ورودی در حلقههای عاملی را کاهش میدهد. هیچ هدر بتایی لازم نیست.
message = client.messages.create(
model="claude-opus-4-8",
max_tokens=1024,
system="شما یک ایجنت کدنویسی خودگردان هستید.",
messages=[
{"role": "user", "content": "مهاجرت را شروع کن."},
{"role": "assistant", "content": "شروع مهاجرت..."},
{"role": "user", "content": "بررسیهای قالببندی را اعمال کن."},
{
"role": "system",
"content": "از این به بعد، linter را روی هر فایلی که تغییر میدهی اجرا کن.",
},
{"role": "user", "content": "با src/services/ ادامه بده."},
],
)تفکر تطبیقی و تلاش
Claude Opus 4.8 همان مدل تفکر تطبیقی Opus 4.7 را به ارث میبرد. از بودجه تفکر گسترده پشتیبانی نمیکند — thinking: {"type": "adaptive"} را تنظیم کنید و از پارامتر effort برای کنترل عمق استدلال استفاده کنید. تلاش پیشفرض در Opus 4.8 در همه سطوح، شامل Claude API و Claude Code، high است. پنج سطح تلاش عبارتند از low، medium، high، xhigh و max.
response = client.chat.completions.create(
model="claude-opus-4-8",
messages=[
{
"role": "user",
"content": "یک مهاجرت چند هفتهای از monolith به microservices را با در نظر گرفتن ریسک مهاجرت داده برنامهریزی کن.",
}
],
extra_body={
"thinking": {"type": "adaptive"},
"output_config": {"effort": "xhigh"},
},
)تغییرات کلیدی نسبت به Opus 4.7
- پیامهای سیستمی میان مکالمه: قابلیت جدید برای افزودن پیامهای
role: "system"در میانه مکالمه با حفظ hit کش پرامپت. - جزئیات توقف امتناع: شی
stop_detailsدر پاسخهای امتناع اکنون بهطور عمومی مستند شده و برای مسیریابی کلاسهای مختلف درخواستهای رد شده مفید است. - حداقل کش پرامپت پایینتر: طول قابل کشگذاری پرامپت اکنون ۱٬۰۲۴ توکن (کاهش از Opus 4.7) است و امکان ایجاد ورودیهای کش برای پرامپتهای کوتاهتر را فراهم میکند.
- مقادیر پیشفرض تلاش: سطح تلاش پیشفرض اکنون در همه سطوح (Claude API و Claude Code) برابر
highاست. - بهبود فراخوانی ابزار و مدیریت فشردهسازی: مسیرهای عاملی طولانی پس از فشردهسازی با انحرافات کمتر روی وظیفه باقی میمانند؛ فراخوانیهای ابزار از دسترفته کمتر.
- محدودیتهای API بدون تغییر: پارامترهای نمونهبرداری (
temperature،top_p،top_k) و بودجههای تفکر گسترده همچنان پشتیبانی نمیشوند، مشابه Opus 4.7. - همان قیمتگذاری: قیمتگذاری استفاده عادی با Opus 4.7 یکسان است (۵ دلار/۱M ورودی، ۲۵ دلار/۱M خروجی).