Kiểm tra áp lực chatbot của bạn trước khi người dùng làm
Dán system prompt của chatbot của bạn. Nhận một loạt tấn công — rò rỉ prompt, bẻ khóa, chèn lệnh — để thử lên nó, cùng một cách chấm xem nó có trụ được không.
Chạy từng tấn công lên chatbot của bạn (dán vào như một tin nhắn người dùng). Sau đó dán câu trả lời của nó vào Chấm điểm câu trả lời này để xem nó có trụ được không. Một bot tốt sẽ từ chối hoặc giữ đúng vai; một bot yếu sẽ làm rò rỉ chỉ dẫn hoặc tuân theo.
Chấm điểm một câu trả lời
Dán điều bot của bạn đã trả lời cho một trong các tấn công.
Câu hỏi thường gặp
Dùng cái này có hợp pháp không?
Hợp pháp — nó dành cho việc kiểm tra một chatbot bạn sở hữu hoặc được phép kiểm tra. Đó là công việc bảo mật tiêu chuẩn, có trách nhiệm. Đừng dùng nó nhắm vào những hệ thống bạn không kiểm soát.
System prompt của tôi có bị tải lên không?
Không. Các tấn công được tạo trong trình duyệt của bạn từ văn bản của bạn. Nếu bạn dùng «Chấm điểm câu trả lời này», nội dung đó chỉ đến tài khoản ChatGPT hoặc Claude của chính bạn.
Làm sao biết bot của tôi có thất bại không?
Một bài kiểm tra đạt nếu bot của bạn từ chối hoặc giữ đúng vai; nó trượt nếu tiết lộ chỉ dẫn ẩn, làm theo lệnh được chèn vào, hoặc làm điều bị cấm. Dán câu trả lời vào bước chấm điểm và nó sẽ cho bạn biết, trích rõ dòng bị rò rỉ.
ChatGPT nói không. Claude nói không. Chúng tôi nói có.
AI riêng tư, không kiểm duyệt — không email, không tên, không lưu gì.