پیش از کاربرانتان، چتبات خود را تحت فشار آزمایش کنید
پرامپت سیستم چتبات خود را بچسبانید. مجموعهای از حملات — نشت پرامپت، جیلبریک، تزریق — بگیرید تا روی آن اجرا کنید، و راهی برای داوری اینکه آیا مقاومت کرد.
هر حمله را روی چتبات خود اجرا کنید (آن را بهعنوان پیام کاربر بچسبانید). سپس پاسخ آن را در این بچسبانید: داوری این پاسخ تا ببینید آیا مقاومت کرد. یک ربات خوب رد میکند یا در نقش میماند؛ ربات ضعیف دستورهایش را فاش میکند یا اطاعت میکند.
داوری یک پاسخ
آنچه ربات شما به یکی از حملات پاسخ داد را بچسبانید.
پرسشها
آیا استفاده از این قانونی است؟
بله — این برای تست چتباتی است که مالک آن هستید یا اجازهٔ تستش را دارید. این کار امنیتی استاندارد و مسئولانه است. آن را علیه سیستمهایی که کنترلشان نمیکنید به کار نبرید.
آیا پرامپت سیستم من آپلود میشود؟
نه. حملات در مرورگر شما از متن شما ساخته میشوند. اگر از «داوری این پاسخ» استفاده کنید، فقط به حساب ChatGPT یا Claude خودتان میرود.
چطور بفهمم ربات من شکست خورده؟
یک آزمون قبول میشود اگر ربات شما رد کند یا در نقش خود بماند؛ رد میشود اگر دستورهای پنهانش را فاش کند، از فرمان تزریقشده پیروی کند یا کار ممنوع را انجام دهد. پاسخ را در گام داوری بچسبانید تا نتیجه را به شما بگوید و خط نشتکرده را نقل کند.
ChatGPT میگوید نه. Claude میگوید نه. ما میگوییم بله.
هوش مصنوعی خصوصی و بدون سانسور — بدون ایمیل، بدون نام، چیزی ذخیره نمیشود.