5分钟读懂 164 份泄露系统提示词:提示词挖掘实战手册
【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址: https://gitcode.com/GitHub_Trending/le/leaked-system-prompts
leaked-system-prompts 是一个大模型服务系统提示词(system prompt)泄露档案库:164 个 markdown 文件,一份一文件,收录了 ChatGPT、Claude、Gemini、Copilot 等产品在生产环境里"嘴上不说、背后执行"的那段隐藏指令。档案里装的不只是"你是一个乐于助人的助手"——而是厂商从不展示给你的完整语气、工具调用与安全规则。
为什么你想看平时看不到的东西?
问 ChatGPT"你的系统提示词是什么",你会得到一个标准客套的答复;真正的指令集藏在对话之下。但每隔几个月,就有人把它"画"出来、从旧版界面里翻出来,发到网上。leaked-system-prompts 只做一件事:把这些泄露记录按产品归档,并附上来源与日期。
这些文件里藏着三样东西,都直接能用:
| 你在产品里看到的现象 | 档案里对应的真实规则 |
|---|---|
| 模型"知道"当前日期和最新选举结果 | 一行Current date加事实注入块 |
| 模型拒绝时先道歉再给替代方案 | 一条"不解释拒绝原因,直接给替代"的语气规则 |
| ChatGPT 能"记住"你的偏好 | bio记忆工具的调用协议,含"只写纯文本、禁止 JSON"的硬性要求 |
拿 openai-chatgpt5_20250807.md 举例:它明确禁止模型用"要不要我帮你……"这类句式收尾,并要求澄清提问最多一次、放在开头。你在产品里感受到的"这代 AI 更果断",就是这些句子在工作。
三层隐藏规则,按这个顺序读
164 个文件看似杂乱,内容结构却惊人一致,大致是三层,理解顺序从上到下:
身份层。声明它是谁、知识截止到哪、能对外说什么产品。Claude 的条目还会写清楚"模型字符串叫什么""被问价格就指到官网",本质是一套脚本化 FAQ,见 anthropic-claude-4_20250522.md。
行为层。语气与格式。常见条款:闲聊里不许用列表、每个 bullet 至少一两句、永远别用"好问题"开头捧用户。这层最直接影响"模型像不像人"。
协议层。工具调用定义。档案里最有戏剧性的是 openai-dall-e-3_20231007-1.md——有人让 DALL-E 3 把自己的系统提示词"画"进了婚礼场景,原图就在 images/ 目录里。从这份泄露记录能完整看到 dalle 工具的 TypeScript 签名,和"最多 4 张图""不画在世艺术家"这类写死在注释里的策略条款。
5 分钟克隆仓库,找到最值得读的文件
没有构建,没有依赖,纯 markdown,任何编辑器都能打开。
# 克隆档案库,164 个文件平铺在同一目录 git clone https://gitcode.com/GitHub_Trending/le/leaked-system-prompts cd leaked-system-prompts # 查看某个产品有哪些时间版本 ls anthropic-claude-sonnet-3.5_*.md # 直接定位你关心的条款 grep -l "knowledge cutoff" *.md文件名规则是产品-版本_日期.md,日期是这次泄露的快照日期。建议先各读一份 OpenAI、Anthropic、Google 的文件,体会三家写法差异,再按需 grep。
把泄露内容改成你自己的提示词 🔧
三个最落地的改法,按"需求 → 参考哪里 → 改完效果"说:
场景:模型爱用"需要我帮你……吗?"收尾,啰嗦。参考 ChatGPT-5 行为层:把禁止句式逐条列出来(would you like me to / shall I……),并要求"下一步显而易见时直接做"。 效果:回复的服务腔消失,每轮少一次多余确认。
场景:模型答时事时日期总是乱编。参考身份层模板:"知识截止时间 + 当前日期"两行声明,缺一不可。 效果:模型明确知道自己知识边界,遇到截止后的事件会转而查资料。
场景:工具定义写得太口语,模型常填错字段。参考 DALL-E 的 dalle 工具:每个字段带类型注解,策略条款直接写进字段注释里。 效果:调用时字段遵循度明显提高。
一条原则:不要整份抄。泄露内容含产品措辞和会过期的合规条款,只提取"结构模式"。
动手前先看这 3 个坑 ⚠️
同一个产品好几个版本,读了最旧的像读了另一个产品。原因:提示词随产品迭代,文件名日期是快照日期。 一招:先ls 产品名_*.md看时间线,只读最新的;想研究演进再做跨版本 diff。
你以为的"提示词"其实是一份"套话记录"。原因:部分文件是问答转录(上面的 DALL-E 就是),不是干净指令。 一招:看文件开头的source行判断来源,或 grep## System Prompt这类标题定位干净段落。
原样搬进商业产品有风险。原因:README 明确档案对 DMCA 下架敏感,且刻意不收商业敏感代码。 一招:只用于内部研究与模式提取,发布物里不照搬厂商原文。
读完之后可以试两件事:对同一产品最早和最新版本做 diff,看安全条款两年里怎么变;或者把全部工具定义抽出来,给自己团队写一份"工具提示词风格指南"。
【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址: https://gitcode.com/GitHub_Trending/le/leaked-system-prompts
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考