Providers
Fal
OpenClaw یک ارائهدهندهٔ داخلی fal برای تولید میزبانیشدهٔ تصویر، ویدئو و موسیقی
ارائه میکند.
| ویژگی | مقدار |
|---|---|
| ارائهدهنده | fal |
| احراز هویت | FAL_KEY (متعارف؛ FAL_API_KEY بهعنوان مسیر جایگزین نیز کار میکند) |
| API | نقاط پایانی مدل fal (https://fal.run؛ کارهای ویدئویی از https://queue.fal.run استفاده میکنند) |
| نشانی پایه | با models.providers.fal.baseUrl بازنویسی کنید |
شروع به کار
تنظیم کلید API
openclaw onboard --auth-choice fal-api-keyراهاندازیهای غیرتعاملی میتوانند --fal-api-key <key> را ارسال یا FAL_KEY را صادر کنند.
فرایند راهاندازی، در صورت پیکربندینشدن هیچ مدلی، fal/fal-ai/flux/dev را نیز بهعنوان
مدل پیشفرض تصویر تنظیم میکند.
تنظیم مدل پیشفرض تصویر
{ agents: { defaults: { imageGenerationModel: { primary: "fal/fal-ai/flux/dev", }, }, },}تولید تصویر
ارائهدهندهٔ داخلی fal برای تولید تصویر بهطور پیشفرض از
fal/fal-ai/flux/dev استفاده میکند.
| قابلیت | مقدار |
|---|---|
| حداکثر تصاویر | 4 در هر درخواست؛ Krea 2: 1 در هر درخواست |
| بازنویسیهای اندازه | 1024x1024، 1024x1536، 1536x1024، 1024x1792، 1792x1024 |
| نسبت ابعاد | همهجا بهجز تبدیل تصویر به تصویر Flux پشتیبانی میشود |
| وضوح | 1K، 2K، 4K (محدودیتهای هر مدل در ادامه آمده است) |
| قالب خروجی | png (پیشفرض) یا jpeg؛ Krea 2 بازنویسیهای outputFormat را رد میکند |
درخواستهای ویرایش (تصاویر مرجع از طریق پارامترهای مشترک image / images)
به یک نقطهٔ پایانی ویرایش مختص هر مدل، با محدودیتهای مرجع مختص همان مدل هدایت میشوند:
| خانوادهٔ مدل | مرجع مدل پس از fal/ |
نقطهٔ پایانی ویرایش | حداکثر تصاویر مرجع |
|---|---|---|---|
| Flux و دیگر مدلهای fal | fal-ai/flux/dev (پیشفرض) |
/image-to-image |
1 |
| GPT Image | openai/gpt-image-* |
/edit |
10 |
| Grok Imagine | xai/grok-imagine-image |
/edit |
3 |
| Nano Banana (قدیمی) | fal-ai/nano-banana |
/edit |
3 |
| Nano Banana 2 | fal-ai/nano-banana-* |
/edit |
14 |
| Nano Banana 2 Lite | google/nano-banana-2-lite |
/edit |
14 |
| Krea 2 | krea/v2/{medium,large}/text-to-image |
ندارد (مراجع سبک) | 10 مرجع سبک |
مدلهای Krea 2 از طرحوارهٔ بومی بار دادهٔ Krea در fal استفاده میکنند. OpenClaw بهجای
بار دادهٔ عمومی image_size / نقطهٔ پایانی ویرایش که Flux استفاده میکند،
aspect_ratio، creativity و image_style_references را ارسال میکند. مراجع مدل عبارتاند از:
fal/krea/v2/medium/text-to-imagefal/krea/v2/large/text-to-image
برای تصویرسازی بیانگر، انیمه، نقاشی و سبکهای هنری سریعتر از Medium
استفاده کنید. برای ظاهرهای واقعگرایانه، بافت خام، دانهبندی فیلم و پرجزئیات که کندتر تولید میشوند، از Large
استفاده کنید. مقدار پیشفرض Krea برابر fal.creativity: "medium" است؛ مقادیر پشتیبانیشده
raw، low، medium و high هستند.
Krea 2 در طرحوارهٔ درخواست fal نسبت ابعاد را ارائه میکند، نه image_size. ترجیحاً از
aspectRatio استفاده کنید؛ OpenClaw مقدار size را به نزدیکترین نسبت ابعاد پشتیبانیشدهٔ Krea نگاشت
میکند و بهجای حذف resolution، آن را برای Krea رد میکند.
هنگامی که خروجی PNG را از مدلهای fal ارائهکنندهٔ
output_format میخواهید، از outputFormat: "png" استفاده کنید. fal در OpenClaw کنترل صریحی
برای پسزمینهٔ شفاف اعلام نمیکند؛ بنابراین background: "transparent" برای مدلهای fal
بهعنوان بازنویسی نادیدهگرفتهشده گزارش میشود.
نقاط پایانی Krea 2 فیلد درخواست output_format را از طریق fal ارائه نمیکنند؛ بنابراین
OpenClaw بازنویسیهای outputFormat را برای درخواستهای Krea رد میکند.
برای استفاده از Krea 2 Medium:
{ agents: { defaults: { imageGenerationModel: { primary: "fal/krea/v2/medium/text-to-image", }, }, },}تولید ویدئو
ارائهدهندهٔ داخلی fal برای تولید ویدئو بهطور پیشفرض از
fal/fal-ai/minimax/video-01-live استفاده میکند.
| قابلیت | مقدار |
|---|---|
| حالتها | متن به ویدئو، مرجع تکتصویری، مرجع به ویدئوی Seedance |
| زمان اجرا | جریان ارسال/وضعیت/نتیجهٔ مبتنی بر صف برای کارهای طولانیمدت |
| مهلت زمانی | بهطور پیشفرض 20 دقیقه برای هر کار؛ وضعیت هر 5 ثانیه بررسی میشود |
مدلهای ویدئویی موجود
MiniMax (پیشفرض):
fal/fal-ai/minimax/video-01-live
عامل ویدئویی HeyGen:
fal/fal-ai/heygen/v2/video-agent
Kling و Wan:
fal/fal-ai/kling-video/v2.1/master/text-to-videofal/fal-ai/wan/v2.2-a14b/text-to-videofal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
fal/bytedance/seedance-2.0/fast/text-to-videofal/bytedance/seedance-2.0/fast/image-to-videofal/bytedance/seedance-2.0/fast/reference-to-videofal/bytedance/seedance-2.0/text-to-videofal/bytedance/seedance-2.0/image-to-videofal/bytedance/seedance-2.0/reference-to-video
درخواستهای MiniMax Live و HeyGen فقط اعلان را بههمراه یک
تصویر مرجع اختیاری ارسال میکنند؛ دیگر بازنویسیها ارسال نمیشوند. مدلهای Seedance
مقادیر aspectRatio، size، resolution، مدتزمانهای 4 تا 15 ثانیه و
یک کلید تغییر وضعیت صدا را میپذیرند.
نمونهٔ پیکربندی Seedance 2.0
{ agents: { defaults: { videoGenerationModel: { primary: "fal/bytedance/seedance-2.0/fast/text-to-video", }, }, },}نمونهٔ پیکربندی مرجع به ویدئوی Seedance 2.0
{ agents: { defaults: { videoGenerationModel: { primary: "fal/bytedance/seedance-2.0/fast/reference-to-video", }, }, },}مرجع به ویدئو از طریق پارامترهای مشترک video_generate، images، videos و
audioRefs حداکثر 9 تصویر، 3 ویدئو و 3 مرجع صوتی را میپذیرد و حداکثر
12 فایل مرجع در مجموع مجاز است. مراجع صوتی مستلزم وجود
حداقل یک مرجع تصویری یا ویدئویی در همان درخواست هستند.
نمونهٔ پیکربندی عامل ویدئویی HeyGen
{ agents: { defaults: { videoGenerationModel: { primary: "fal/fal-ai/heygen/v2/video-agent", }, }, },}تولید موسیقی
Plugin داخلی fal یک ارائهدهندهٔ تولید موسیقی نیز برای
ابزار مشترک music_generate ثبت میکند.
| قابلیت | مقدار |
|---|---|
| مدل پیشفرض | fal/fal-ai/minimax-music/v2.6 |
| مدلها | fal-ai/minimax-music/v2.6 (mp3)، fal-ai/ace-step/prompt-to-audio (wav)، fal-ai/stable-audio-25/text-to-audio (wav) |
| حداکثر مدتزمان | 240 ثانیه |
| زمان اجرا | درخواست همگام بههمراه بارگیری صدای تولیدشده |
از fal بهعنوان ارائهدهندهٔ پیشفرض موسیقی استفاده کنید:
{ agents: { defaults: { musicGenerationModel: { primary: "fal/fal-ai/minimax-music/v2.6", }, }, },}fal-ai/minimax-music/v2.6 از متن ترانهٔ صریح و حالت بیکلام پشتیبانی میکند،
اما نه هر دو در یک درخواست. ACE-Step و Stable Audio
نقاط پایانی اعلان به صدا هستند؛ هنگامی که آن خانوادههای مدل را میخواهید، آنها را با بازنویسی
model انتخاب کنید. ACE-Step متن ترانهٔ صریح را رد میکند؛ Stable Audio
هم متن ترانه و هم حالت بیکلام را رد میکند.