داشبورد توسعه‌دهنده
پرسش از هوش مصنوعی
پرسش از هوش مصنوعی

مدل‌های DeepSeek-V3.1، Grok Code Fast 1، و بهبود عملکرد استریمینگ

تاریخ: 1404-06-24 / (2025-09-14)

خلاصه

AvalAI مدل‌های DeepSeek-V3.1 را از طریق Azure AI در چندین endpoint معرفی می‌کند، grok-code-fast-1 جدید X.AI را که برای محیط‌های کدنویسی بر پایه Agent بهینه‌سازی شده اضافه می‌کند، و بهبودهای قابل توجهی در API جریانی (استریمینگ) با سرعت پاسخ تا 6 برابر سریع‌تر و دستیابی به 95% برابری عملکرد ارائه‌دهنده ارائه می‌دهد.


جزئیات

خرسندیم سه پیشرفت کلیدی را معرفی کنیم که نه‌ تنها قابلیت‌های هوش مصنوعی ما را به سطحی نوین ارتقا می‌دهد، بلکه عملکرد کلی پلتفرم را نیز به شکلی چشمگیر بهبود می‌بخشد.

مدل‌های DeepSeek-V3.1 از طریق Azure AI

ما DeepSeek-V3.1، آخرین پیشرفت در هوش مصنوعی استدلالی که برای عصر عامل طراحی شده است، را از طریق Azure AI در چندین endpoint ادغام کرده‌ایم.

DeepSeek

  • deepseek-v3.1: DeepSeek-V3.1 در حالت غیر تفکری، برای پاسخ‌های سریع و کارآمد با قابلیت‌های استنتاج ترکیبی و استفاده بهبود یافته از ابزار بهینه‌سازی شده است. مستندات

ویژگی‌های کلیدی:

  • پنجره متن: 128K توکن
  • حداکثر توکن‌های خروجی: محدودیت‌های استاندارد خروجی
  • حالت: حالت غیر تفکری برای پاسخ‌های کارآمد
  • قیمت ورودی (cache hit): $0.07 / 1M توکن
  • قیمت ورودی (cache miss): $0.27 / 1M توکن
  • قیمت خروجی: $1.10 / 1M توکن
  • نقاط قوت: پاسخ‌های سریع، پردازش کارآمد، قابلیت‌های کلی قوی، استفاده بهبود یافته از ابزار
  • بهترین برای: گفتگوی عمومی، پاسخ‌های سریع، برنامه‌های پرحجم، گردش‌کارهای عامل
  • استدلال: استدلال استاندارد بدون فرآیند تفکر آشکار
  • در دسترس در: v1/chat/completions، v1/responses، v1/messages
python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

response = client.chat.completions.create(
    model="deepseek-v3.1",
    messages=[
        {
            "role": "user",
            "content": "مفهوم درهم‌تنیدگی کوانتومی را به زبان ساده توضیح دهید",
        }
    ],
)

print(response.choices[0].message.content)
javascript
import { OpenAI } from "openai";

const client = new OpenAI({
    apiKey: process.env.AVALAI_API_KEY,
    baseURL: "https://api.avalai.ir/v1",
});

const response = await client.chat.completions.create({
    model: "deepseek-v3.1",
    messages: [
        {
            role: "user",
            content: "مفهوم درهم‌تنیدگی کوانتومی را به زبان ساده توضیح دهید",
        },
    ],
});

console.log(response.choices[0].message.content);

X.AI Grok Code Fast 1

ما grok-code-fast-1 جدید X.AI را اضافه کرده‌ایم، یک مدل استدلالی سریع و اقتصادی که در گردش‌کارهای کدنویسی عامل با سرعت استنتاج فوق‌العاده عالی عمل می‌کند.

X.AI

  • grok-code-fast-1: مدلی که به طور خاص برای گردش‌کارهای کدنویسی عامل با سرعت استثنایی و تسلط بر ابزارها بهینه‌سازی شده است. مستندات

ویژگی‌های کلیدی:

  • پنجره متن: پشتیبانی از متن بزرگ برای کدبیس‌های گسترده
  • قیمت ورودی: $0.20 / 1M توکن
  • قیمت خروجی: $1.50 / 1M توکن
  • قیمت ورودی کش شده: $0.02 / 1M توکن
  • نقاط قوت: پاسخ‌های فوق‌العاده سریع، کدنویسی عامل، تسلط بر ابزارها (grep، terminal، ویرایش فایل)
  • بهترین برای: ادغام IDE، تولید کد، دیباگ، تجزیه و تحلیل pull request
  • عملکرد: 190+ توکن در ثانیه با نرخ cache hit بالای 90%
  • زبان‌ها: TypeScript، Python، Java، Rust، C++، Go
  • در دسترس در: v1/chat/completions، v1/responses، v1/messages
python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

response = client.chat.completions.create(
    model="grok-code-fast-1",
    messages=[
        {
            "role": "user",
            "content": "یک تابع Python برای پیاده‌سازی جستجوی دودویی با مدیریت خطای مناسب ایجاد کنید",
        }
    ],
)

print(response.choices[0].message.content)
javascript
import { OpenAI } from "openai";

const client = new OpenAI({
    apiKey: process.env.AVALAI_API_KEY,
    baseURL: "https://api.avalai.ir/v1",
});

const response = await client.chat.completions.create({
    model: "grok-code-fast-1",
    messages: [
        {
            role: "user",
            content: "یک interface TypeScript برای سیستم مدیریت کاربر ایجاد کنید",
        },
    ],
});

console.log(response.choices[0].message.content);

بهبود عملکرد API استریمینگ

ما زیرساخت اصلی API خود را با بهبودهای مهم استریمینگ که عملکرد استثنایی را در تمام endpoint های پشتیبانی شده ارائه می‌دهد، به طور قابل توجهی ارتقا داده‌ایم.

بهبودهای عملکرد:

  • بهبود سرعت: تا 6 برابر سریع‌تر پاسخ‌های استریمینگ (chunks/second)
  • برابری ارائه‌دهنده: 95% عملکرد یکسان با استریمینگ ارائه‌دهنده اصلی
  • پوشش: بهبودها در API های Chat Completions، Responses، Messages، و Gemini v1beta/models
  • بهینه‌سازی: پردازش chunk پیشرفته و مدیریت اتصال
  • قابلیت اطمینان: مدیریت خطای بهبود یافته و پایداری اتصال

Endpoint های تحت تاثیر:

این بهبودها تضمین می‌کنند که پاسخ‌های استریمینگ اکنون با سرعت و قابلیت اطمینان دسترسی مستقیم ارائه‌دهنده مطابقت دارند در حالی که تمام مزایای رویکرد API یکپارچه AvalAI را حفظ می‌کنند.


لینک‌های مرتبط