مدلهای BytePlus
BytePlus، پلتفرم ابری ByteDance، مدلهای هوش مصنوعی پیشرفته را از طریق API یکپارچه AvalAI ارائه میدهد. BytePlus در قابلیتهای پیشرفته تولید و ویرایش تصویر تخصص دارد و مدلهای پیشرفتهای را برای کاربردهای خلاقانه و تجاری فراهم میکند.
نکته مهم
برای بهترین نتایج در تولید و ویرایش تصویر، توصیه میشود از پرامپتهای انگلیسی استفاده کنید زیرا مدلهای تولید تصویر معمولا برای زبان انگلیسی بهینهسازی شدهاند. برای پشتیبانی فنی یا سوالات، با t.me/AvalAISupport تماس بگیرید.
مدلهای موجود
مدلهای BytePlus از طریق endpoint های استاندارد AvalAI قابل دسترسی هستند و ادغام یکپارچه با API های سازگار با OpenAI را ارائه میدهند در حالی که دسترسی به فناوریهای نوآورانه هوش مصنوعی ByteDance را فراهم میکنند.
مدلهای تولید تصویر
BytePlus پیشرفتهترین مدلهای تولید تصویر موجود را ارائه میدهد که دارای قابلیتهای متن-به-تصویر و تصویر-به-تصویر با کیفیت و انعطافپذیری بینظیر است.
Seedream 5.0
شناسه مدل: seedream-5-0-260128
Seedream 5.0 پیشرفتهترین مدل تولید تصویر BytePlus است که دارای استدلال زنجیره فکر (Chain of Thought - CoT) برای بهینهسازی هوشمند پرامپت و تولید زیباییشناسی داخلی به سبک MJ است. این مدل نشاندهنده یک جهش قابل توجه در تولید خلاقانه مبتنی بر هوش مصنوعی است.
| ویژگی | جزئیات |
|---|---|
| نوع مدل | تولید و ویرایش تصویر |
| حداکثر وضوح | 4K (4096x4096 پیکسل) |
| فرمتهای پشتیبانی شده | JPEG، PNG |
| روشهای ورودی | پرامپتهای متنی، URL تصویر، Base64 |
| تولید دستهای | تا 15 تصویر در هر درخواست |
| ورودی چند تصویر | تا 10 تصویر مرجع |
| پشتیبانی جریانی | بله |
| استدلال CoT | بهینهسازی هوشمند پرامپت داخلی |
| قیمت | 0.035 دلار به ازای هر تصویر (35.00$/1K تصویر) |
قابلیتهای کلیدی
🧠 استدلال زنجیره فکر
- تحلیل هوشمند پرامپت: تحلیل پرامپتها برای درک هدف هنری
- بهبود خودکار: بهینهسازی پرامپتها برای نتایج بصری بهتر
- شناسایی سبک: شناسایی و تقویت سبکهای هنری مورد نظر
- برنامهریزی ترکیببندی: برنامهریزی ترکیببندی تصویر قبل از تولید
🎨 تولید زیباییشناسی به سبک MJ
- زیباییشناسی داخلی: پشتیبانی بومی از تولید هنری به سبک Midjourney
- کیفیت فتورئالیستیک: خروجیهای فتورئالیستیک با کیفیت حرفهای
- تنوع هنری: پشتیبانی از سبکها و رسانههای هنری مختلف
- برتری تایپوگرافی: رندر متن پیشرفته با ثبات برتر
⚡ برتری فنی
- پشتیبانی از وضوح بالا: تولید تصاویر تا وضوح 4K
- نسبتهای ابعاد انعطافپذیر: پشتیبانی از نسبتهای 1:16 تا 16:1
- جریان بلادرنگ: تولید تصویر تدریجی با بهروزرسانیهای زنده
- پردازش دستهای هوشمند: تعیین خودکار تعداد بهینه تصویر
نمونههای استفاده
تولید متن-به-تصویر با CoT
from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
response = client.images.generate(
model="seedream-5-0-260128",
prompt="A serene Japanese garden at sunset with cherry blossoms",
size="4K",
response_format="url",
extra_body={"sequential_image_generation": "disabled", "watermark": False},
)
print(f"Generated image: {response.data[0].url}")ویرایش تصویر با استدلال CoT
response = client.images.edit(
model="seedream-5-0-260128",
image="https://example.com/input-image.jpg",
prompt="Transform into a professional portrait with studio lighting and subtle background blur",
size="2K",
response_format="url",
extra_body={"sequential_image_generation": "disabled", "watermark": False},
)
print(f"Edited image: {response.data[0].url}")ترکیب چند تصویر
response = client.images.generate(
model="seedream-5-0-260128",
prompt="Combine these architectural styles into a modern building design",
extra_body={
"image": [
"https://example.com/gothic-architecture.jpg",
"https://example.com/modern-architecture.jpg",
"https://example.com/art-deco-building.jpg",
],
"sequential_image_generation": "disabled",
"size": "2K",
"watermark": False,
},
)
print(f"Blended design: {response.data[0].url}")تولید جریانی
import requests
import json
def stream_image_generation():
url = "https://api.avalai.ir/v1/images/generations"
headers = {
"Authorization": "Bearer your-avalai-api-key",
"Content-Type": "application/json",
}
data = {
"model": "seedream-5-0-260128",
"prompt": "A detailed digital artwork of a magical forest",
"size": "2K",
"stream": True,
"sequential_image_generation": "auto",
"sequential_image_generation_options": {"max_images": 3},
}
response = requests.post(url, headers=headers, json=data, stream=True)
for line in response.iter_lines():
if line:
try:
chunk = json.loads(line.decode("utf-8").replace("data: ", ""))
if "data" in chunk:
for image in chunk["data"]:
if "url" in image:
print(f"Image ready: {image['url']}")
except json.JSONDecodeError:
continue
stream_image_generation()پارامترهای کلیدی
پارامترهای اصلی
| پارامتر | نوع | توضیحات | پیشفرض |
|---|---|---|---|
model | string | شناسه مدل | الزامی |
prompt | string | توضیحات متنی (حداکثر 600 کلمه) | الزامی |
size | string | وضوح: "1K"، "2K"، "4K" یا "WxH" | "2048x2048" |
response_format | string | "url" یا "b64_json" | "url" |
پارامترهای اختصاصی BytePlus
| پارامتر | نوع | توضیحات | پیشفرض |
|---|---|---|---|
sequential_image_generation | string | "auto" یا "disabled" | "disabled" |
sequential_image_generation_options | object | تنظیمات تولید دستهای | - |
max_images | integer | حداکثر تصاویر در دسته (1-15) | 15 |
stream | boolean | فعالسازی خروجی جریانی | false |
watermark | boolean | افزودن واترمارک AI | true |
image | string/array | تصویر(های) مرجع برای ویرایش | - |
وضوحهای پشتیبانی شده
| نسبت ابعاد | ابعاد توصیه شده |
|---|---|
| 1:1 | 2048x2048 |
| 4:3 | 2304x1728 |
| 3:4 | 1728x2304 |
| 16:9 | 2560x1440 |
| 9:16 | 1440x2560 |
| 3:2 | 2496x1664 |
| 2:3 | 1664x2496 |
| 21:9 | 3024x1296 |
بهترین شیوهها
مهندسی پرامپت
- توصیفی باشید: از پرامپتهای تفصیلی تا 600 کلمه انگلیسی استفاده کنید
- مشخص کردن سبک: شامل سبک هنری، حال و هوا و جزئیات فنی
- جزئیات ترکیببندی: نورپردازی، دیدگاه و عناصر بصری را مشخص کنید
- کلمات کلیدی کیفیت: از عباراتی مثل "کیفیت بالا"، "تفصیلی"، "حرفهای" استفاده کنید
بهینهسازی فنی
- برنامهریزی وضوح: وضوح مناسب را برای مورد استفاده خود انتخاب کنید
- تولید دستهای: از تولید متوالی برای سری تصاویر مرتبط استفاده کنید
- جریان برای دستههای بزرگ: جریان را برای درخواستهای چندتصویره فعال کنید
- انتخاب فرمت: از فرمت URL برای برنامههای وب، Base64 برای پردازش مستقیم استفاده کنید
راهنمای ورودی تصویر
- الزامات فرمت: فقط فرمتهای JPEG یا PNG
- محدودیتهای اندازه: حداکثر 10MB در هر تصویر، 6000x6000 پیکسل
- نسبتهای ابعاد: در محدوده 1:3 تا 3:1 نگه دارید
- تصاویر متعدد: تا 10 تصویر مرجع برای ترکیب
موارد استفاده
کاربردهای خلاقانه
- تولید هنر دیجیتال: آثار هنری و تصاویر با کیفیت بالا
- هنر مفهومی: توسعه بصری برای بازیها، فیلمها و محصولات
- انتقال سبک: تبدیل تصاویر به سبکهای هنری مختلف
- کاوش خلاقانه: تولید تنوع و تکرار ایدهها
کاربردهای تجاری
- مواد بازاریابی: تجسم محصولات و گرافیکهای تبلیغاتی
- داراییهای برند: تنوع لوگو، تصاویر برند و هویت بصری
- تولید محتوا: گرافیکهای رسانههای اجتماعی، تصاویر وبلاگ
- تجارت الکترونیک: نمونهسازی محصولات و تصاویر سبک زندگی
کاربردهای فنی
- نمونهسازی: تجسم سریع مفاهیم طراحی
- پردازش دستهای: تولید کارآمد سری تصاویر مرتبط
- بهبود تصویر: بهبود و تبدیل تصاویر موجود
- گردشکارهای سفارشی: ادغام با خطلولههای خلاقانه موجود
ادغام با AvalAI
Seedream 5.0 بهطور یکپارچه با اکوسیستم API یکپارچه AvalAI ادغام میشود:
- سازگاری OpenAI: از کتابخانههای کلاینت آشنای OpenAI استفاده کنید
- Endpoint های استاندارد:
v1/images/generationsوv1/images/edits - احراز هویت یکپارچه: کلید API واحد برای همه مدلها
- فرمت پاسخ یکسان: پاسخهای JSON استاندارد در همه ارائهدهندگان
- مدیریت خطا: کدهای خطا و پیامهای متحد
محدودیتها
- فیلتر محتوا: تصاویر ممکن است توسط فیلترهای ایمنی محتوا رد شوند
- زمان تولید: تصاویر با وضوح بالا ممکن است زمان بیشتری برای تولید نیاز داشته باشند
- محدودیتهای دستهای: حداکثر 15 تصویر در هر درخواست (شامل تصاویر مرجع)
- پشتیبانی زبان: پرامپتها بهترین عملکرد را به زبان انگلیسی دارند
- انقضای URL: URL های تصاویر تولید شده پس از 24 ساعت منقضی میشوند
منابع مرتبط
مدلهای BytePlus از طریق پلتفرم ابری ByteDance ارائه میشوند و در API یکپارچه AvalAI برای دسترسی یکپارچه و تجربه توسعهدهنده یکسان ادغام شدهاند.