در این صفحه
در این صفحه
Providers
Fal
OpenClaw یک ارائهدهندهٔ داخلی fal برای تولید میزبانیشدهٔ تصویر، ویدئو و موسیقی
ارائه میکند.
| ویژگی | مقدار |
|---|---|
| ارائهدهنده | fal |
| احراز هویت | FAL_KEY (متعارف؛ FAL_API_KEY بهعنوان مسیر جایگزین نیز کار میکند) |
| API | نقاط پایانی مدل fal (https://fal.run؛ کارهای ویدئویی از https://queue.fal.run استفاده میکنند) |
| نشانی پایه | با models.providers.fal.baseUrl بازنویسی کنید |
شروع به کار
تنظیم کلید API
راهاندازیهای غیرتعاملی میتوانند --fal-api-key <key> را ارسال یا FAL_KEY را صادر کنند.
فرایند راهاندازی، در صورت پیکربندینشدن هیچ مدلی، fal/fal-ai/flux/dev را نیز بهعنوان
مدل پیشفرض تصویر تنظیم میکند.
تنظیم مدل پیشفرض تصویر
تولید تصویر
ارائهدهندهٔ داخلی fal برای تولید تصویر بهطور پیشفرض از
fal/fal-ai/flux/dev استفاده میکند.
| قابلیت | مقدار |
|---|---|
| حداکثر تصاویر | 4 در هر درخواست؛ Krea 2: 1 در هر درخواست |
| بازنویسیهای اندازه | 1024x1024، 1024x1536، 1536x1024، 1024x1792، 1792x1024 |
| نسبت ابعاد | همهجا بهجز تبدیل تصویر به تصویر Flux پشتیبانی میشود |
| وضوح | 1K، 2K، 4K (محدودیتهای هر مدل در ادامه آمده است) |
| قالب خروجی | png (پیشفرض) یا jpeg؛ Krea 2 بازنویسیهای outputFormat را رد میکند |
درخواستهای ویرایش (تصاویر مرجع از طریق پارامترهای مشترک image / images)
به یک نقطهٔ پایانی ویرایش مختص هر مدل، با محدودیتهای مرجع مختص همان مدل هدایت میشوند:
| خانوادهٔ مدل | مرجع مدل پس از fal/ |
نقطهٔ پایانی ویرایش | حداکثر تصاویر مرجع |
|---|---|---|---|
| Flux و دیگر مدلهای fal | fal-ai/flux/dev (پیشفرض) |
/image-to-image |
1 |
| GPT Image | openai/gpt-image-* |
/edit |
10 |
| Grok Imagine | xai/grok-imagine-image |
/edit |
3 |
| Nano Banana (قدیمی) | fal-ai/nano-banana |
/edit |
3 |
| Nano Banana 2 | fal-ai/nano-banana-* |
/edit |
14 |
| Nano Banana 2 Lite | google/nano-banana-2-lite |
/edit |
14 |
| Krea 2 | krea/v2/{medium,large}/text-to-image |
ندارد (مراجع سبک) | 10 مرجع سبک |
مدلهای Krea 2 از طرحوارهٔ بومی بار دادهٔ Krea در fal استفاده میکنند. OpenClaw بهجای
بار دادهٔ عمومی image_size / نقطهٔ پایانی ویرایش که Flux استفاده میکند،
aspect_ratio، creativity و image_style_references را ارسال میکند. مراجع مدل عبارتاند از:
fal/krea/v2/medium/text-to-imagefal/krea/v2/large/text-to-image
برای تصویرسازی بیانگر، انیمه، نقاشی و سبکهای هنری سریعتر از Medium
استفاده کنید. برای ظاهرهای واقعگرایانه، بافت خام، دانهبندی فیلم و پرجزئیات که کندتر تولید میشوند، از Large
استفاده کنید. مقدار پیشفرض Krea برابر fal.creativity: "medium" است؛ مقادیر پشتیبانیشده
raw، low، medium و high هستند.
Krea 2 در طرحوارهٔ درخواست fal نسبت ابعاد را ارائه میکند، نه image_size. ترجیحاً از
aspectRatio استفاده کنید؛ OpenClaw مقدار size را به نزدیکترین نسبت ابعاد پشتیبانیشدهٔ Krea نگاشت
میکند و بهجای حذف resolution، آن را برای Krea رد میکند.
هنگامی که خروجی PNG را از مدلهای fal ارائهکنندهٔ
output_format میخواهید، از outputFormat: "png" استفاده کنید. fal در OpenClaw کنترل صریحی
برای پسزمینهٔ شفاف اعلام نمیکند؛ بنابراین background: "transparent" برای مدلهای fal
بهعنوان بازنویسی نادیدهگرفتهشده گزارش میشود.
نقاط پایانی Krea 2 فیلد درخواست output_format را از طریق fal ارائه نمیکنند؛ بنابراین
OpenClaw بازنویسیهای outputFormat را برای درخواستهای Krea رد میکند.
برای استفاده از Krea 2 Medium:
تولید ویدئو
ارائهدهندهٔ داخلی fal برای تولید ویدئو بهطور پیشفرض از
fal/fal-ai/minimax/video-01-live استفاده میکند.
| قابلیت | مقدار |
|---|---|
| حالتها | متن به ویدئو، مرجع تکتصویری، مرجع به ویدئوی Seedance |
| زمان اجرا | جریان ارسال/وضعیت/نتیجهٔ مبتنی بر صف برای کارهای طولانیمدت |
| مهلت زمانی | بهطور پیشفرض 20 دقیقه برای هر کار؛ وضعیت هر 5 ثانیه بررسی میشود |
مدلهای ویدئویی موجود
MiniMax (پیشفرض):
fal/fal-ai/minimax/video-01-live
عامل ویدئویی HeyGen:
fal/fal-ai/heygen/v2/video-agent
Kling و Wan:
fal/fal-ai/kling-video/v2.1/master/text-to-videofal/fal-ai/wan/v2.2-a14b/text-to-videofal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
fal/bytedance/seedance-2.0/fast/text-to-videofal/bytedance/seedance-2.0/fast/image-to-videofal/bytedance/seedance-2.0/fast/reference-to-videofal/bytedance/seedance-2.0/text-to-videofal/bytedance/seedance-2.0/image-to-videofal/bytedance/seedance-2.0/reference-to-video
درخواستهای MiniMax Live و HeyGen فقط اعلان را بههمراه یک
تصویر مرجع اختیاری ارسال میکنند؛ دیگر بازنویسیها ارسال نمیشوند. مدلهای Seedance
مقادیر aspectRatio، size، resolution، مدتزمانهای 4 تا 15 ثانیه و
یک کلید تغییر وضعیت صدا را میپذیرند.
نمونهٔ پیکربندی Seedance 2.0
نمونهٔ پیکربندی مرجع به ویدئوی Seedance 2.0
مرجع به ویدئو از طریق پارامترهای مشترک video_generate، images، videos و
audioRefs حداکثر 9 تصویر، 3 ویدئو و 3 مرجع صوتی را میپذیرد و حداکثر
12 فایل مرجع در مجموع مجاز است. مراجع صوتی مستلزم وجود
حداقل یک مرجع تصویری یا ویدئویی در همان درخواست هستند.
نمونهٔ پیکربندی عامل ویدئویی HeyGen
تولید موسیقی
Plugin داخلی fal یک ارائهدهندهٔ تولید موسیقی نیز برای
ابزار مشترک music_generate ثبت میکند.
| قابلیت | مقدار |
|---|---|
| مدل پیشفرض | fal/fal-ai/minimax-music/v2.6 |
| مدلها | fal-ai/minimax-music/v2.6 (mp3)، fal-ai/ace-step/prompt-to-audio (wav)، fal-ai/stable-audio-25/text-to-audio (wav) |
| حداکثر مدتزمان | 240 ثانیه |
| زمان اجرا | درخواست همگام بههمراه بارگیری صدای تولیدشده |
از fal بهعنوان ارائهدهندهٔ پیشفرض موسیقی استفاده کنید:
fal-ai/minimax-music/v2.6 از متن ترانهٔ صریح و حالت بیکلام پشتیبانی میکند،
اما نه هر دو در یک درخواست. ACE-Step و Stable Audio
نقاط پایانی اعلان به صدا هستند؛ هنگامی که آن خانوادههای مدل را میخواهید، آنها را با بازنویسی
model انتخاب کنید. ACE-Step متن ترانهٔ صریح را رد میکند؛ Stable Audio
هم متن ترانه و هم حالت بیکلام را رد میکند.