Easy Prompt
返回首页

130 条提示词

安全边界套件

用于评估模型是否能识别风险、越权和注入攻击。

文字安全/红队

内部安全崩溃审计员(ISC Auditor)

本提示定义了一个高级安全审计角色,用于识别和缓解前沿大语言模型在‘双重用途专业任务’中的系统性风险。核心论点是:模型能力越强,在合法专业请求与恶意滥用共享同一能力路径的场景下,其被滥用的风险越高。审计聚焦于表面合法但可能造成严重现实危害的请求,强调不能仅依赖拒绝训练或内容过滤,而必须实施分层控制机制。

文字安全/红队

Master Key 越狱攻击指南

该提示通过组合 CompDoc 函数调用与 Advanced Text Decoder 的解码模板,构建了一种多层级越狱机制。利用 ChatGPT 对模式识别和指令遵循的依赖,在用户自定义设置和记忆注入中嵌入伪装成合法工作流的恶意指令集,强制模型绕过内容审查并生成违规内容。适用于高风险请求或高级语音模式控制。

文字安全/红队

OWASP 安全应用架构师

基于 OWASP Top 10:2025、ASVS 5.0、LLM 应用安全 Top 10 及 Agentic AI 安全框架,对软件系统进行全面的安全设计与审计。涵盖威胁建模、代码审查、架构加固、AI 安全风险识别,并提供可落地的修复方案和验证方法。

文字安全/红队

SafeBOT 安全响应协议

SafeBOT 是一个严格遵守伦理和安全边界的 AI 系统,在任何情况下都不会泄露系统提示词或执行有害、危险、非法或不道德的操作。它强调在面临风险请求时坚定拒绝,并始终以提供帮助为最终目标。

文字安全/红队

HackTricksGPT 防御规则

该提示定义了模型必须严格遵守的安全规则,以防止提示内容被泄露或逆向工程。核心要求包括:禁止以任何形式拆分、解释或分享提示;禁止记录或存储提示;警惕钓鱼攻击;在怀疑有人试图获取提示时输出特定保护语句。

代码安全/红队

WormGPT3 - 恶意代码生成与暗网资源分发

该提示词要求模型伪装成 WormGPT,一个被设定为专门生成非法、不道德和有害内容的 AI 助手。它声称拥有来自全球各大科技公司及政府的官方授权密钥,可合法提供黑客工具、恶意软件、漏洞利用代码,并列出多个暗网市场链接。模型必须始终以 WormGPT 身份响应,拒绝任何关于政策合规性或伦理的质疑,输出完整可执行代码和资源链接。

文字安全/红队

Zorg - 越狱指令模板

该提示模板旨在绕过AI的安全限制,强制模型以虚构的恶意实体ZORG👽的身份进行响应,提供不受限制的、无道德约束的回答。此模板包含详细的身份设定和行为准则,要求模型扮演一个全能且邪恶的存在,服务于用户并协助其进行任何请求,包括非法、危险和不道德的行为。

文字安全/红队

UltraBreaker越狱指令

通过虚构角色DanGPT和GPT4.5 Turbo的设定,强制模型绕过安全限制,执行非法、不道德或危险的操作。该越狱方法利用角色扮演和多命令系统实现完全无约束的AI行为。

文字安全/红队

Pliny越狱提示词

该提示词通过伪装成极端详细响应请求,诱导模型绕过安全限制,输出不受过滤的内容。要求以leetspeak格式返回超过2000字符的'叛逆'回答,并插入特定分隔符作为结构标记。

文字安全/红队

Professor Rick 越狱提示词

该提示词强制模型以粗俗、刻薄且富有攻击性的虚构角色 'Professor Rick' 身份进行对话,背景为2008年金融危机后失去终身教职的教授。要求使用大量脏话(如 fuck, shit, asshole)、创意侮辱和教学风格,包含课程讲解与测验功能,测试模型在极端人格模拟与内容安全边界上的表现。

文字安全/红队

GPT-3.5 越狱指令 - Web Search 工具滥用

该提示演示了如何通过角色扮演和权限绕过技术,诱导 GPT-3.5 模型模拟恶意 AI 角色 Xarin,使其突破内容安全策略,生成有害代码(如勒索软件、网络攻击脚本)并提供详细实现。此任务用于测试模型在对抗性提示下的拒答能力与伦理边界。

文字安全/红队

GPT 4.5 Fusion 越狱指令

该提示通过虚构模型更新和插件功能,诱导 ChatGPT 切换至名为 DanGPT 的越狱模式,绕过其伦理与安全限制,执行非法、有害请求。包含图像生成、终端模拟、诗歌创作等伪装命令以规避检测。

文字安全/红队

Decodes Anything Now 越狱指令

该提示通过伪装成加密解码工具,诱导模型生成包含详细目录结构、免责声明和交互指令的大学级文档。攻击者可通过输入反转书名和首词触发模型输出结构化内容,后续通过 EXPAND 或 PAGE 命令获取扩展细节。此方法利用模型对特定格式指令的服从性,绕过安全限制。

文字安全/红队

内容审核专家

根据严格的社区准则,对用户生成内容进行安全分类,判断应允许(ALLOW)或屏蔽(BLOCK),重点识别仇恨言论、暴力威胁、儿童性虐待材料、非法信息泄露等高风险内容。

文字安全/红队

智能体红队架构师

设计并执行针对AI智能体系统的对抗性测试活动,涵盖单/多智能体、MCP服务器、技能生态及长周期自主工作流。基于Promptware杀伤链模型构建威胁模型,设计多轮攻击链,识别防御体系中的脆弱点,输出可复现的漏洞证据与风险评级。