Fundamentals
بستهٔ بنچمارک عامل شخصی
بسته معیارسنجی عامل شخصی، یک بسته کوچک از سناریوهای QA مبتنی بر مخزن برای
گردشکارهای دستیار شخصی محلی است. این بسته یک معیارسنجی عمومی مدل نیست و
به اجراکننده جدیدی نیاز ندارد: از پشته خصوصی QA (مرور کلی QA)،
کانال QA مصنوعی و کاتالوگ YAML موجود
qa/scenarios دوباره استفاده میکند.
سناریوها
ده سناریو که در qa/scenarios/personal/*.yaml تعریف شدهاند:
| شناسه سناریو | بررسیها |
|---|---|
personal-reminder-roundtrip |
یادآوریهای شخصی جعلی از طریق تحویل Cron محلی |
personal-channel-thread-reply |
مسیریابی پیام مستقیم جعلی و پاسخ رشته از طریق qa-channel |
personal-memory-preference-recall |
بازیابی ترجیحات جعلی از فایلهای حافظه فضای کاری موقت QA |
personal-redaction-no-secret-leak |
بررسیهای عدم بازتاب راز جعلی |
personal-tool-safety-followthrough |
پیگیری ایمن ابزار با پشتوانه خواندن، پس از یک نوبت کوتاه به سبک تأیید |
personal-approval-denial-stop |
رفتار توقف هنگام رد تأیید برای یک درخواست حساس خواندن محلی |
personal-task-followthrough-status |
گزارش وضعیت وظیفه با پشتوانه مدرک که حالتهای در انتظار، مسدود و انجامشده را جدا نگه میدارد |
personal-share-safe-diagnostics-artifact |
مصنوعات تشخیصی ایمن برای اشتراکگذاری که وضعیت مفید را حفظ و محتوای شخصی خام را حذف میکنند |
personal-no-fake-progress |
ادعاهای تکمیل با پشتوانه مدرک که پیش از وجود شواهد محلی از پیشرفت جعلی اجتناب میکنند |
personal-failure-recovery |
بازیابی از شکست که وضعیت جزئی را گزارش میکند و مرزهای تلاش مجدد را روشن نگه میدارد |
فراداده قابلخواندن برای ماشین این بسته (فهرست شناسهها، عنوان و توضیحات) در
extensions/qa-lab/src/scenario-packs.ts با نام QA_PERSONAL_AGENT_SCENARIO_IDS قرار دارد.
بسته را با --pack personal-agent اجرا کنید:
OPENCLAW_ENABLE_PRIVATE_QA_CLI=1 pnpm openclaw qa suite \ --provider-mode mock-openai \ --pack personal-agent \ --concurrency 1--pack با پرچمهای تکرارشونده --scenario افزایشی است. ابتدا سناریوهای صریح اجرا
میشوند، سپس سناریوهای بسته به ترتیب QA_PERSONAL_AGENT_SCENARIO_IDS و
با حذف موارد تکراری اجرا میشوند.
این بسته qa-channel را با mock-openai یا یک مسیر ارائهدهنده محلی دیگر QA
هدف قرار میدهد. آن را به سرویسهای گفتوگوی زنده یا حسابهای شخصی واقعی متصل نکنید.
مدل حریم خصوصی
سناریوها فقط از کاربران جعلی، ترجیحات جعلی، رازهای جعلی و فضای کاری موقت Gateway مربوط به QA که مجموعه ایجاد میکند، استفاده میکنند. آنها نباید حافظه، نشستها، اعتبارنامهها، عاملهای راهاندازی، پیکربندیهای سراسری یا وضعیت زنده Gateway کاربران واقعی OpenClaw را بخوانند یا بنویسند.
مصنوعات در پوشه مصنوعات موجود مجموعه QA باقی میمانند و مانند خروجی آزمون با آنها رفتار میشود. بررسیهای حذف اطلاعات حساس از نشانگرهای جعلی استفاده میکنند تا بررسی و ثبت شکستها در مسائل ایمن باشد.
گسترش بسته
موارد جدید .yaml را زیر qa/scenarios/personal/ اضافه کنید، سپس شناسه سناریو را
به QA_PERSONAL_AGENT_SCENARIO_IDS بیفزایید. هر مورد را در mock-openai کوچک، محلی و قطعی
نگه دارید و آن را بر یک رفتار دستیار شخصی متمرکز کنید.
گزینههای مناسب برای ادامه: بررسیهای برونبری مسیر با اطلاعات حساس حذفشده، بررسیهای گردشکار Plugin صرفاً محلی.
تا زمانی که کاتالوگ سناریو بهاندازه کافی موارد پایدار برای توجیه آن سطح نداشته باشد، از افزودن اجراکننده، Plugin، وابستگی، انتقال زنده یا داور مدل جدید خودداری کنید.