داشبورد توسعه‌دهنده
پرسش از هوش مصنوعی
پرسش از هوش مصنوعی

مدل‌های BytePlus

BytePlus، پلتفرم ابری ByteDance، مدل‌های هوش مصنوعی پیشرفته را از طریق API یکپارچه AvalAI ارائه می‌دهد. BytePlus در قابلیت‌های پیشرفته تولید و ویرایش تصویر تخصص دارد و مدل‌های پیشرفته‌ای را برای کاربردهای خلاقانه و تجاری فراهم می‌کند.

نکته مهم

برای بهترین نتایج در تولید و ویرایش تصویر، توصیه می‌شود از پرامپت‌های انگلیسی استفاده کنید زیرا مدل‌های تولید تصویر معمولا برای زبان انگلیسی بهینه‌سازی شده‌اند. برای پشتیبانی فنی یا سوالات، با t.me/AvalAISupport تماس بگیرید.

مدل‌های موجود

مدل‌های BytePlus از طریق endpoint های استاندارد AvalAI قابل دسترسی هستند و ادغام یکپارچه با API های سازگار با OpenAI را ارائه می‌دهند در حالی که دسترسی به فناوری‌های نوآورانه هوش مصنوعی ByteDance را فراهم می‌کنند.

مدل‌های تولید تصویر

BytePlus پیشرفته‌ترین مدل‌های تولید تصویر موجود را ارائه می‌دهد که دارای قابلیت‌های متن-به-تصویر و تصویر-به-تصویر با کیفیت و انعطاف‌پذیری بی‌نظیر است.

Seedream 5.0

شناسه مدل: seedream-5-0-260128

Seedream 5.0 پیشرفته‌ترین مدل تولید تصویر BytePlus است که دارای استدلال زنجیره فکر (Chain of Thought - CoT) برای بهینه‌سازی هوشمند پرامپت و تولید زیبایی‌شناسی داخلی به سبک MJ است. این مدل نشان‌دهنده یک جهش قابل توجه در تولید خلاقانه مبتنی بر هوش مصنوعی است.

ویژگیجزئیات
نوع مدلتولید و ویرایش تصویر
حداکثر وضوح4K (4096x4096 پیکسل)
فرمت‌های پشتیبانی شدهJPEG، PNG
روش‌های ورودیپرامپت‌های متنی، URL تصویر، Base64
تولید دسته‌ایتا 15 تصویر در هر درخواست
ورودی چند تصویرتا 10 تصویر مرجع
پشتیبانی جریانیبله
استدلال CoTبهینه‌سازی هوشمند پرامپت داخلی
قیمت0.035 دلار به ازای هر تصویر (35.00$/1K تصویر)

قابلیت‌های کلیدی

🧠 استدلال زنجیره فکر

  • تحلیل هوشمند پرامپت: تحلیل پرامپت‌ها برای درک هدف هنری
  • بهبود خودکار: بهینه‌سازی پرامپت‌ها برای نتایج بصری بهتر
  • شناسایی سبک: شناسایی و تقویت سبک‌های هنری مورد نظر
  • برنامه‌ریزی ترکیب‌بندی: برنامه‌ریزی ترکیب‌بندی تصویر قبل از تولید

🎨 تولید زیبایی‌شناسی به سبک MJ

  • زیبایی‌شناسی داخلی: پشتیبانی بومی از تولید هنری به سبک Midjourney
  • کیفیت فتورئالیستیک: خروجی‌های فتورئالیستیک با کیفیت حرفه‌ای
  • تنوع هنری: پشتیبانی از سبک‌ها و رسانه‌های هنری مختلف
  • برتری تایپوگرافی: رندر متن پیشرفته با ثبات برتر

برتری فنی

  • پشتیبانی از وضوح بالا: تولید تصاویر تا وضوح 4K
  • نسبت‌های ابعاد انعطاف‌پذیر: پشتیبانی از نسبت‌های 1:16 تا 16:1
  • جریان بلادرنگ: تولید تصویر تدریجی با به‌روزرسانی‌های زنده
  • پردازش دسته‌ای هوشمند: تعیین خودکار تعداد بهینه تصویر

نمونه‌های استفاده

تولید متن-به-تصویر با CoT

python
from openai import OpenAI

client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")

response = client.images.generate(
    model="seedream-5-0-260128",
    prompt="A serene Japanese garden at sunset with cherry blossoms",
    size="4K",
    response_format="url",
    extra_body={"sequential_image_generation": "disabled", "watermark": False},
)

print(f"Generated image: {response.data[0].url}")

ویرایش تصویر با استدلال CoT

python
response = client.images.edit(
    model="seedream-5-0-260128",
    image="https://example.com/input-image.jpg",
    prompt="Transform into a professional portrait with studio lighting and subtle background blur",
    size="2K",
    response_format="url",
    extra_body={"sequential_image_generation": "disabled", "watermark": False},
)

print(f"Edited image: {response.data[0].url}")

ترکیب چند تصویر

python
response = client.images.generate(
    model="seedream-5-0-260128",
    prompt="Combine these architectural styles into a modern building design",
    extra_body={
        "image": [
            "https://example.com/gothic-architecture.jpg",
            "https://example.com/modern-architecture.jpg",
            "https://example.com/art-deco-building.jpg",
        ],
        "sequential_image_generation": "disabled",
        "size": "2K",
        "watermark": False,
    },
)

print(f"Blended design: {response.data[0].url}")

تولید جریانی

python
import requests
import json


def stream_image_generation():
    url = "https://api.avalai.ir/v1/images/generations"
    headers = {
        "Authorization": "Bearer your-avalai-api-key",
        "Content-Type": "application/json",
    }

    data = {
        "model": "seedream-5-0-260128",
        "prompt": "A detailed digital artwork of a magical forest",
        "size": "2K",
        "stream": True,
        "sequential_image_generation": "auto",
        "sequential_image_generation_options": {"max_images": 3},
    }

    response = requests.post(url, headers=headers, json=data, stream=True)

    for line in response.iter_lines():
        if line:
            try:
                chunk = json.loads(line.decode("utf-8").replace("data: ", ""))
                if "data" in chunk:
                    for image in chunk["data"]:
                        if "url" in image:
                            print(f"Image ready: {image['url']}")
            except json.JSONDecodeError:
                continue


stream_image_generation()

پارامترهای کلیدی

پارامترهای اصلی

پارامترنوعتوضیحاتپیش‌فرض
modelstringشناسه مدلالزامی
promptstringتوضیحات متنی (حداکثر 600 کلمه)الزامی
sizestringوضوح: "1K"، "2K"، "4K" یا "WxH""2048x2048"
response_formatstring"url" یا "b64_json""url"

پارامترهای اختصاصی BytePlus

پارامترنوعتوضیحاتپیش‌فرض
sequential_image_generationstring"auto" یا "disabled""disabled"
sequential_image_generation_optionsobjectتنظیمات تولید دسته‌ای-
max_imagesintegerحداکثر تصاویر در دسته (1-15)15
streambooleanفعال‌سازی خروجی جریانیfalse
watermarkbooleanافزودن واترمارک AItrue
imagestring/arrayتصویر(های) مرجع برای ویرایش-

وضوح‌های پشتیبانی شده

نسبت ابعادابعاد توصیه شده
1:12048x2048
4:32304x1728
3:41728x2304
16:92560x1440
9:161440x2560
3:22496x1664
2:31664x2496
21:93024x1296

بهترین شیوه‌ها

مهندسی پرامپت

  1. توصیفی باشید: از پرامپت‌های تفصیلی تا 600 کلمه انگلیسی استفاده کنید
  2. مشخص کردن سبک: شامل سبک هنری، حال و هوا و جزئیات فنی
  3. جزئیات ترکیب‌بندی: نورپردازی، دیدگاه و عناصر بصری را مشخص کنید
  4. کلمات کلیدی کیفیت: از عباراتی مثل "کیفیت بالا"، "تفصیلی"، "حرفه‌ای" استفاده کنید

بهینه‌سازی فنی

  1. برنامه‌ریزی وضوح: وضوح مناسب را برای مورد استفاده خود انتخاب کنید
  2. تولید دسته‌ای: از تولید متوالی برای سری تصاویر مرتبط استفاده کنید
  3. جریان برای دسته‌های بزرگ: جریان را برای درخواست‌های چندتصویره فعال کنید
  4. انتخاب فرمت: از فرمت URL برای برنامه‌های وب، Base64 برای پردازش مستقیم استفاده کنید

راهنمای ورودی تصویر

  1. الزامات فرمت: فقط فرمت‌های JPEG یا PNG
  2. محدودیت‌های اندازه: حداکثر 10MB در هر تصویر، 6000x6000 پیکسل
  3. نسبت‌های ابعاد: در محدوده 1:3 تا 3:1 نگه دارید
  4. تصاویر متعدد: تا 10 تصویر مرجع برای ترکیب

موارد استفاده

کاربردهای خلاقانه

  • تولید هنر دیجیتال: آثار هنری و تصاویر با کیفیت بالا
  • هنر مفهومی: توسعه بصری برای بازی‌ها، فیلم‌ها و محصولات
  • انتقال سبک: تبدیل تصاویر به سبک‌های هنری مختلف
  • کاوش خلاقانه: تولید تنوع و تکرار ایده‌ها

کاربردهای تجاری

  • مواد بازاریابی: تجسم محصولات و گرافیک‌های تبلیغاتی
  • دارایی‌های برند: تنوع لوگو، تصاویر برند و هویت بصری
  • تولید محتوا: گرافیک‌های رسانه‌های اجتماعی، تصاویر وبلاگ
  • تجارت الکترونیک: نمونه‌سازی محصولات و تصاویر سبک زندگی

کاربردهای فنی

  • نمونه‌سازی: تجسم سریع مفاهیم طراحی
  • پردازش دسته‌ای: تولید کارآمد سری تصاویر مرتبط
  • بهبود تصویر: بهبود و تبدیل تصاویر موجود
  • گردش‌کارهای سفارشی: ادغام با خط‌لوله‌های خلاقانه موجود

ادغام با AvalAI

Seedream 5.0 به‌طور یکپارچه با اکوسیستم API یکپارچه AvalAI ادغام می‌شود:

  • سازگاری OpenAI: از کتابخانه‌های کلاینت آشنای OpenAI استفاده کنید
  • Endpoint های استاندارد: v1/images/generations و v1/images/edits
  • احراز هویت یکپارچه: کلید API واحد برای همه مدل‌ها
  • فرمت پاسخ یکسان: پاسخ‌های JSON استاندارد در همه ارائه‌دهندگان
  • مدیریت خطا: کدهای خطا و پیام‌های متحد

محدودیت‌ها

  1. فیلتر محتوا: تصاویر ممکن است توسط فیلترهای ایمنی محتوا رد شوند
  2. زمان تولید: تصاویر با وضوح بالا ممکن است زمان بیشتری برای تولید نیاز داشته باشند
  3. محدودیت‌های دسته‌ای: حداکثر 15 تصویر در هر درخواست (شامل تصاویر مرجع)
  4. پشتیبانی زبان: پرامپت‌ها بهترین عملکرد را به زبان انگلیسی دارند
  5. انقضای URL: URL های تصاویر تولید شده پس از 24 ساعت منقضی می‌شوند

منابع مرتبط


مدل‌های BytePlus از طریق پلتفرم ابری ByteDance ارائه می‌شوند و در API یکپارچه AvalAI برای دسترسی یکپارچه و تجربه توسعه‌دهنده یکسان ادغام شده‌اند.