مدلهای Stability AI
AvalAI دسترسی به مدلهای قدرتمند تولید تصویر Stability AI را از طریق API یکپارچه ما فراهم میکند. این صفحه جزئیات مدلهای موجود Stability AI، قابلیتهای آنها و موارد استفاده بهینه را با تمرکز بر آخرین نسلها شرح میدهد.
مدلهای موجود
Stability AI چندین مدل تولید تصویر پیشرفته ارائه میدهد که هر کدام دارای نقاط قوت و قابلیتهای خاصی هستند.
مدلهای SD3
مدلهای SD3 نماینده مدلهای انتشار پیشرفته Stability AI هستند که برای تولید تصاویر واقعگرایانه با قابلیتهای استثنایی پیروی از پرامپت تخصصی شدهاند.
| ویژگی | جزئیات |
|---|---|
| ارائه دهنده | AWS Bedrock |
| نقاط قوت | تولید تصاویر واقعگرایانه، پیروی قوی از پرامپت، جزئیات با کیفیت بالا |
| بهترین برای | تصاویر با کیفیت حرفهای، تجسمهای واقعگرایانه، هنر مفهومی با جزئیات |
هشدار
هشدار مهم:
هنگام استفاده از مدلهای Stability AI، از این محدودیتهای مهم آگاه باشید:
عدم پشتیبانی از کاراکتر U+200C: پرامپتها نمیتوانند شامل کاراکتر U+200C (نیمفاصله) باشند. استفاده از این کاراکتر باعث شکست درخواست خواهد شد.
توصیه به استفاده از پرامپتهای انگلیسی: مدلهای Stability AI درک ضعیفی از زبانهای غیرانگلیسی، بهویژه فارسی دارند. برای بهترین نتایج، حتی اگر بقیه برنامه شما به زبان دیگری است، از پرامپتهای انگلیسی استفاده کنید.
~~stability.sd3-large-v1:0~~ - منسوخ شده
مدل SD3 large کیفیت تصویر استثنایی با قابلیتهای واقعگرایانه قوی ارائه میدهد.
stability.sd3-5-large-v1:0
مدل SD3.5 large جدیدترین نسخه با قابلیتهای بهبودیافته برای تولید تصاویر بسیار دقیق و واقعی است.
response = client.images.generate(
model="stability.sd3-5-large-v1:0",
prompt="یک پرتره دقیق از یک شخصیت با طراحی لباس پیچیده، نورپردازی استودیویی، عکاسی حرفهای",
size="1024x1024",
extra_body={
"seed": 12345,
"negative_prompt": "تار، کیفیت پایین، تحریف شده، ویژگیهای صورت نامتناسب",
},
)مدلهای Stable Image
مدلهای Stable Image از Stability AI در دو نوع ارائه میشوند: Core و Ultra، که هر کدام برای موارد استفاده و نیازهای کیفیتی متفاوت طراحی شدهاند.
مدلهای Stable Image Core
مدلهای Stable Image Core برای تولید تصویر همهمنظوره با تعادل خوبی بین کیفیت و سرعت بهینهسازی شدهاند.
| ویژگی | جزئیات |
|---|---|
| شناسههای مدل | stability.stable-image-core-v1:0, stability.stable-image-core-v1:1 |
| ارائه دهنده | AWS Bedrock |
| نقاط قوت | تعادل خوب کیفیت/سرعت، تولید تصویر همهمنظوره |
| بهترین برای | تولید تصویر همهمنظوره، تجسم مفاهیم، تولید محتوا |
response = client.images.generate(
model="stability.stable-image-core-v1:1",
prompt="یک تصویرسازی رنگارنگ از یک منظره فانتزی با جزیرههای شناور و آبشارها",
size="1024x1024",
extra_body={"seed": 67890, "negative_prompt": "کسلکننده، تکرنگ، مسطح، بدون عمق"},
)مدلهای Stable Image Ultra
مدلهای Stable Image Ultra خروجیهای با بالاترین کیفیت و کنترل جزئیات بیشتر را ارائه میدهند که برای موارد استفاده حرفهای که کیفیت اهمیت زیادی دارد، ایدهآل هستند.
| ویژگی | جزئیات |
|---|---|
| شناسههای مدل | stability.stable-image-ultra-v1:0, stability.stable-image-ultra-v1:1 |
| ارائه دهنده | AWS Bedrock |
| نقاط قوت | خروجیهای با بالاترین کیفیت، کنترل جزئیات دقیق |
| بهترین برای | آثار هنری حرفهای، تجسمهای دقیق، مواد بازاریابی با کیفیت بالا |
response = client.images.generate(
model="stability.stable-image-ultra-v1:1",
prompt="یک اثر هنری دیجیتال فوقالعاده دقیق از یک منظره شهری آیندهنگر در شب با چراغهای نئون که در خیابانهای خیس منعکس میشوند، نورپردازی سینمایی، وضوح ۸k",
size="1024x1024",
extra_body={
"seed": 54321,
"negative_prompt": "نور روز، تار، وضوح پایین، جزئیات ضعیف",
"mode": "text-to-image",
},
)پارامترهای کلیدی
مدلهای Stability AI از چندین پارامتر پشتیبانی میکنند که امکان تنظیم دقیق فرآیند تولید تصویر را فراهم میکنند. این پارامترها باید با استفاده از پارامتر extra_body در کلاینت OpenAI ارسال شوند:
پارامترهای اصلی
| پارامتر | توضیحات | پیشفرض | دسترسی |
|---|---|---|---|
prompt | توضیح متنی تصویر مورد نظر | الزامی | همه مدلها |
negative_prompt | توضیح متنی آنچه باید در تصویر اجتناب شود | هیچ | همه مدلها |
seed | بذر نویز تصادفی برای نتایج قابل تکرار | تصادفی | همه مدلها |
mode | حالت تولید ("text-to-image" یا "image-to-image") | "text-to-image" | همه مدلها |
strength | قدرت اثر هنگام ویرایش تصاویر | ۰.۸ | برخی مدلها (با حالت image-to-image استفاده میشود) |
output_format | فرمت تصویر خروجی | "png" | برخی مدلها |
aspect_ratio | نسبت تصویر تولید شده | مخصوص هر مدل | برخی مدلها |
گزینههای اندازه
مدلهای مختلف از محدودیتهای ابعاد متفاوتی پشتیبانی میکنند:
- مدلهای SD3 معمولا از ابعاد بین ۵۱۲x۵۱۲ تا ۱۰۲۴x۱۰۲۴ پشتیبانی میکنند
- مدلهای Stable Image ممکن است از اندازهها و نسبتهای تصویر اضافی پشتیبانی کنند
مثالهای استفاده
تولید پایه تصویر
برای تولید یک تصویر با حداقل پارامترها:
from openai import OpenAI
client = OpenAI(api_key="your-avalai-api-key", base_url="https://api.avalai.ir/v1")
response = client.images.generate(
model="stability.sd3-5-large-v1:0",
prompt="یک باغ آرام ژاپنی با شکوفههای گیلاس، پل کوچکی روی برکه، و معماری سنتی",
response_format="url", # or b64_json
)
# دریافت URL تصویر
image_url = response.data[0].url
print(f"Generated image URL: {image_url}")استفاده از پارامترهای پیشرفته
برای کنترل بیشتر روی تصویر تولید شده:
response = client.images.generate(
model="stability.stable-image-ultra-v1:1",
prompt="یک پرتره دقیق از یک شخصیت فانتزی، جنگجو با زره تزئینی، نورپردازی دراماتیک، ویژگیهای صورت دقیق",
size="1024x1024",
extra_body={
"seed": 42424, # بذر ثابت برای تکرارپذیری
"negative_prompt": "تار، کیفیت پایین، ویژگیهای صورت نامتناسب، نورپردازی غیرواقعی",
"mode": "text-to-image", # حالت پیشفرض تولید
},
response_format="url", # or b64_json
)
# دریافت URL تصویر
image_url = response.data[0].urlبهترین شیوهها
برای دریافت بهترین نتایج از مدلهای Stability AI:
در پرامپتهای خود دقیق و جزئی باشید - جزئیات مربوط به سبک، نورپردازی، ترکیببندی و ویژگیهای موضوع را شامل کنید.
از پرامپتهای منفی به طور موثر استفاده کنید - مشخص کنید چه چیزی را نمیخواهید در تصویر ببینید تا از مشکلات رایج مانند تاری، تحریف یا عناصر ناخواسته جلوگیری کنید.
برای ثبات از مقادیر seed استفاده کنید - وقتی تصویری را پیدا کردید که دوست دارید، مقدار seed آن را ذخیره کنید تا بعدا بتوانید تغییرات یا تصاویر مشابه تولید کنید.
نسبت تصویر را با دقت در نظر بگیرید - نسبتهای تصویر مختلف میتوانند به طور چشمگیری بر ترکیببندی تاثیر بگذارند. بر اساس استفاده مورد نظر خود (افقی، عمودی، مربع) انتخاب کنید.
از حالت صحیح استفاده کنید - برای ایجاد تصاویر جدید از ابتدا از "text-to-image" استفاده کنید و هنگامی که میخواهید یک تصویر موجود را اصلاح کنید، از "image-to-image" استفاده کنید.
پرامپتهای خود را خوب ساختاربندی کنید - با موضوع شروع کنید، سپس جزئیات، سبک، نورپردازی و سایر ویژگیها را توصیف کنید.
استفاده از مدلهای Stability AI از طریق AvalAI
تمام مدلهای Stability AI از طریق نقاط پایانی استاندارد API AvalAI با استفاده از کتابخانههای کلاینت سازگار با OpenAI قابل دسترسی هستند:
from openai import OpenAI
client = OpenAI(
api_key="your-avalai-api-key", # با کلید API واقعی خود جایگزین کنید
base_url="https://api.avalai.ir/v1", # نقطه پایانی API AvalAI
)
# مثال: استفاده از مدل SD3.5 Large
response = client.images.generate(
model="stability.sd3-5-large-v1:0",
prompt="یک منظره زیبا با کوهها و دریاچهها",
)
# مثال: استفاده از مدل Stable Image Ultra
response = client.images.generate(
model="stability.stable-image-ultra-v1:1",
prompt="یک پرتره شخصیت دقیق در سبک فانتزی",
size="1024x1024",
extra_body={
"negative_prompt": "تار، کیفیت پایین، ویژگیهای صورت نامتناسب",
"seed": 12345,
"mode": "text-to-image",
},
)