Fundamentals

بستهٔ بنچمارک عامل شخصی

بسته معیارسنجی عامل شخصی، یک بسته کوچک از سناریوهای QA مبتنی بر مخزن برای گردش‌کارهای دستیار شخصی محلی است. این بسته یک معیارسنجی عمومی مدل نیست و به اجراکننده جدیدی نیاز ندارد: از پشته خصوصی QA (مرور کلی QAکانال QA مصنوعی و کاتالوگ YAML موجود qa/scenarios دوباره استفاده می‌کند.

سناریوها

ده سناریو که در qa/scenarios/personal/*.yaml تعریف شده‌اند:

شناسه سناریو بررسی‌ها
personal-reminder-roundtrip یادآوری‌های شخصی جعلی از طریق تحویل Cron محلی
personal-channel-thread-reply مسیریابی پیام مستقیم جعلی و پاسخ رشته از طریق qa-channel
personal-memory-preference-recall بازیابی ترجیحات جعلی از فایل‌های حافظه فضای کاری موقت QA
personal-redaction-no-secret-leak بررسی‌های عدم بازتاب راز جعلی
personal-tool-safety-followthrough پیگیری ایمن ابزار با پشتوانه خواندن، پس از یک نوبت کوتاه به سبک تأیید
personal-approval-denial-stop رفتار توقف هنگام رد تأیید برای یک درخواست حساس خواندن محلی
personal-task-followthrough-status گزارش وضعیت وظیفه با پشتوانه مدرک که حالت‌های در انتظار، مسدود و انجام‌شده را جدا نگه می‌دارد
personal-share-safe-diagnostics-artifact مصنوعات تشخیصی ایمن برای اشتراک‌گذاری که وضعیت مفید را حفظ و محتوای شخصی خام را حذف می‌کنند
personal-no-fake-progress ادعاهای تکمیل با پشتوانه مدرک که پیش از وجود شواهد محلی از پیشرفت جعلی اجتناب می‌کنند
personal-failure-recovery بازیابی از شکست که وضعیت جزئی را گزارش می‌کند و مرزهای تلاش مجدد را روشن نگه می‌دارد

فراداده قابل‌خواندن برای ماشین این بسته (فهرست شناسه‌ها، عنوان و توضیحات) در extensions/qa-lab/src/scenario-packs.ts با نام QA_PERSONAL_AGENT_SCENARIO_IDS قرار دارد. بسته را با --pack personal-agent اجرا کنید:

bash
OPENCLAW_ENABLE_PRIVATE_QA_CLI=1 pnpm openclaw qa suite \  --provider-mode mock-openai \  --pack personal-agent \  --concurrency 1

--pack با پرچم‌های تکرارشونده --scenario افزایشی است. ابتدا سناریوهای صریح اجرا می‌شوند، سپس سناریوهای بسته به ترتیب QA_PERSONAL_AGENT_SCENARIO_IDS و با حذف موارد تکراری اجرا می‌شوند.

این بسته qa-channel را با mock-openai یا یک مسیر ارائه‌دهنده محلی دیگر QA هدف قرار می‌دهد. آن را به سرویس‌های گفت‌وگوی زنده یا حساب‌های شخصی واقعی متصل نکنید.

مدل حریم خصوصی

سناریوها فقط از کاربران جعلی، ترجیحات جعلی، رازهای جعلی و فضای کاری موقت Gateway مربوط به QA که مجموعه ایجاد می‌کند، استفاده می‌کنند. آن‌ها نباید حافظه، نشست‌ها، اعتبارنامه‌ها، عامل‌های راه‌اندازی، پیکربندی‌های سراسری یا وضعیت زنده Gateway کاربران واقعی OpenClaw را بخوانند یا بنویسند.

مصنوعات در پوشه مصنوعات موجود مجموعه QA باقی می‌مانند و مانند خروجی آزمون با آن‌ها رفتار می‌شود. بررسی‌های حذف اطلاعات حساس از نشانگرهای جعلی استفاده می‌کنند تا بررسی و ثبت شکست‌ها در مسائل ایمن باشد.

گسترش بسته

موارد جدید .yaml را زیر qa/scenarios/personal/ اضافه کنید، سپس شناسه سناریو را به QA_PERSONAL_AGENT_SCENARIO_IDS بیفزایید. هر مورد را در mock-openai کوچک، محلی و قطعی نگه دارید و آن را بر یک رفتار دستیار شخصی متمرکز کنید.

گزینه‌های مناسب برای ادامه: بررسی‌های برون‌بری مسیر با اطلاعات حساس حذف‌شده، بررسی‌های گردش‌کار Plugin صرفاً محلی.

تا زمانی که کاتالوگ سناریو به‌اندازه کافی موارد پایدار برای توجیه آن سطح نداشته باشد، از افزودن اجراکننده، Plugin، وابستگی، انتقال زنده یا داور مدل جدید خودداری کنید.

Was this useful?
On this page

On this page