افزودن مدل پرچمدار جدید: GPT-6 Astra
تاریخ: ۱۴۰۵-۰۶-۱۴ / (2026-09-05)
خلاصه
مدل پرچمدار جدید OpenAI، یعنی GPT-6 Astra، اکنون با شناسه gpt-6-astra در AvalAI در دسترس است. این مدل برای بارهای کاری دشوار در استفاده از رایانه، مهندسی نرمافزار، امور حرفهای، علوم، ریاضیات، امنیت سایبری و پردازش زمینههای طولانی طراحی شده است. AvalAI از این مدل در v1/chat/completions، v1/messages و v1/responses بهطور کامل پشتیبانی میکند.
جزئیات
OpenAI
GPT-6 Astra نسل جدید مدل پرچمدار OpenAI است. بر پایه گزارش OpenAI، این مدل در استفاده از مرورگر و رایانه، برنامهنویسی، کار حرفهای، تحلیل علمی، امنیت سایبری، بازیابی اطلاعات از زمینههای طولانی و پایبندی به محدوده وظیفه بهبود یافته است.
ویژگیهای کلیدی:
- استفاده از رایانه و مرورگر: برای کار با رابطها، گردآوری اطلاعات و انجام وظایف چندمرحلهای طراحی شده است
- مهندسی نرمافزار: برای تحلیل مخزنهای بزرگ، پیادهسازی، اشکالزدایی و راستیآزمایی مناسب است
- کار حرفهای: پژوهش، تحلیل سند، محاسبات کمی و تهیه خروجیهای ساختاریافته را انجام میدهد
- علوم و ریاضیات: OpenAI از عملکرد بهتر در ارزیابیهای پیشرفته علمی و استدلال انتزاعی خبر داده است
- امنیت سایبری: از تحلیل دفاعی و جریانهای کاری امنیتی مجاز با سازوکارهای ایمنی بهتر پشتیبانی میکند
- بازیابی از زمینه طولانی: برای یافتن و استفاده از شواهد مرتبط در زمینههای گسترده طراحی شده است
- پایبندی به محدوده وظیفه: هدف، دامنه و محدودیتهای عملیاتی کاربر را بهتر رعایت میکند
- تلاش استدلالی: امکان تنظیم میزان استدلال برای ایجاد توازن میان کیفیت پاسخ، تأخیر و هزینه را فراهم میکند
- پشتیبانی نقاط پایانی: پشتیبانی کامل در
v1/chat/completions،v1/messagesوv1/responses
دسترسی نقاط پایانی
| نقطه پایانی | پشتیبانی | توضیحات |
|---|---|---|
v1/chat/completions | کامل | گفتوگو، استدلال، خروجی ساختاریافته و استفاده از ابزار با سازگاری OpenAI |
v1/messages | کامل | پیامها و جریانهای کاری ابزارمحور با سازگاری Anthropic |
v1/responses | کامل | استدلال Responses-first، جریانهای دارای وضعیت و ابزارهای پشتیبانیشده |
قیمتگذاری
قیمتها بر حسب دلار آمریکا برای هر ۱ میلیون توکن هستند. درخواستهایی با بیش از ۲۷۲ هزار توکن ورودی از نرخهای زمینه طولانی جدول زیر استفاده میکنند.
| دسته توکن | ورودی تا ۲۷۲ هزار | ورودی بیش از ۲۷۲ هزار |
|---|---|---|
| ورودی | $10.00 | $20.00 |
| ورودی ذخیرهشده | $1.00 | $2.00 |
| ایجاد ورودی کش | $12.50 | $25.00 |
| خروجی | $50.00 | $75.00 |
نرخهای بالاتر فقط برای درخواستهایی اعمال میشوند که ورودی آنها از آستانه ۲۷۲ هزار توکن عبور کند. هزینه واقعی به ورودی ذخیرهنشده، خواندن و نوشتن واجد شرایط کش، خروجی تولیدشده و طول کل ورودی درخواست بستگی دارد.
نمونه درخواست و پاسخ API
درخواست
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-6-astra",
"messages": [
{
"role": "user",
"content": "Review this incident timeline, identify the most likely root cause, and propose a verification plan."
}
]
}'پاسخ
پاسخ کوتاهشده زیر ساختار استاندارد Chat Completions را نشان میدهد. تعداد توکنها و هزینه نمونه هستند و با هر درخواست تغییر میکنند.
{
"id": "chatcmpl-gpt-6-astra-example",
"created": 1788624000,
"model": "gpt-6-astra",
"object": "chat.completion",
"system_fingerprint": null,
"choices": [
{
"finish_reason": "stop",
"index": 0,
"message": {
"content": "The strongest hypothesis is a race between lease expiry and retry processing. Verify it by correlating duplicate job IDs with lease timestamps, reproducing the timing under load, and confirming that an idempotency guard prevents duplicate writes.",
"role": "assistant",
"annotations": []
}
}
],
"usage": {
"completion_tokens": 70,
"prompt_tokens": 25,
"total_tokens": 95,
"completion_tokens_details": null,
"prompt_tokens_details": {
"audio_tokens": null,
"cached_tokens": 0,
"text_tokens": 25,
"image_tokens": null
}
},
"estimated_cost": {
"unit": "0.0037500000",
"irt": 574.5,
"exchange_rate": 153200
}
}نمونههای استفاده از SDK
curl https://api.avalai.ir/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-6-astra",
"messages": [
{
"role": "user",
"content": "Analyze this repository architecture and propose a verified modernization plan."
}
]
}'from openai import OpenAI
client = OpenAI(
api_key="your-avalai-api-key",
base_url="https://api.avalai.ir/v1",
)
response = client.chat.completions.create(
model="gpt-6-astra",
messages=[
{
"role": "user",
"content": "Analyze this repository architecture and propose a verified modernization plan.",
}
],
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.AVALAI_API_KEY,
baseURL: "https://api.avalai.ir/v1",
});
const response = await client.chat.completions.create({
model: "gpt-6-astra",
messages: [
{
role: "user",
content: "Analyze this repository architecture and propose a verified modernization plan.",
},
],
});
console.log(response.choices[0].message.content);API Responses
برای استدلال Responses-first و جریانهای کاری دارای وضعیت از API Responses استفاده کنید:
curl https://api.avalai.ir/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AVALAI_API_KEY" \
-d '{
"model": "gpt-6-astra",
"reasoning": {"effort": "high"},
"input": "Design a staged migration and verify its rollback strategy."
}'from openai import OpenAI
client = OpenAI(
api_key="your-avalai-api-key",
base_url="https://api.avalai.ir/v1",
)
response = client.responses.create(
model="gpt-6-astra",
reasoning={"effort": "high"},
input="Design a staged migration and verify its rollback strategy.",
)
print(response.output_text)import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.AVALAI_API_KEY,
baseURL: "https://api.avalai.ir/v1",
});
const response = await client.responses.create({
model: "gpt-6-astra",
reasoning: { effort: "high" },
input: "Design a staged migration and verify its rollback strategy.",
});
console.log(response.output_text);تلاش استدلالی
برای کارهای عمومی با تلاش استدلالی medium آغاز کنید و هنگامی از high استفاده کنید که ارزیابیها بهبود معنادار موفقیت وظیفه را نشان دهند. ارزیابیهای منتشرشده OpenAI شامل پیکربندیهای تلاش کم، متوسط و زیاد هستند. از مدل نخواهید زنجیره فکر پنهان خود را آشکار کند؛ در عوض، دلیل کوتاه، شواهد پشتیبان یا فهرست راستیآزمایی بخواهید.
بارهای کاری پیشنهادی
| بار کاری | دلیل تناسب GPT-6 Astra |
|---|---|
| استفاده از رایانه و مرورگر | برای تعامل چندمرحلهای با رابطهای نرمافزاری و محیطهای وب طراحی شده است |
| مهندسی نرمافزار پیچیده | تحلیل مخزن، پیادهسازی، اشکالزدایی و راستیآزمایی را پشتیبانی میکند |
| کار حرفهای و دانشی | پژوهش، تحلیل و خروجیهای کمی و ساختاریافته تولید میکند |
| علوم و ریاضیات | OpenAI از نتایج قوی در ارزیابیهای پیشرفته علمی و استدلالی خبر داده است |
| تحلیل امنیتی مجاز | از بررسی دفاعی امنیت سایبری با سازوکارهای ایمنی بهتر پشتیبانی میکند |
| وظایف دارای زمینه طولانی | شواهد را از اسناد و کدهای گسترده بازیابی و به کار میگیرد |