news 2026/9/11 14:46:35

5分钟读懂 164 份泄露系统提示词:提示词挖掘实战手册

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
5分钟读懂 164 份泄露系统提示词:提示词挖掘实战手册

5分钟读懂 164 份泄露系统提示词:提示词挖掘实战手册

【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址: https://gitcode.com/GitHub_Trending/le/leaked-system-prompts

leaked-system-prompts 是一个大模型服务系统提示词(system prompt)泄露档案库:164 个 markdown 文件,一份一文件,收录了 ChatGPT、Claude、Gemini、Copilot 等产品在生产环境里"嘴上不说、背后执行"的那段隐藏指令。档案里装的不只是"你是一个乐于助人的助手"——而是厂商从不展示给你的完整语气、工具调用与安全规则。

为什么你想看平时看不到的东西?

问 ChatGPT"你的系统提示词是什么",你会得到一个标准客套的答复;真正的指令集藏在对话之下。但每隔几个月,就有人把它"画"出来、从旧版界面里翻出来,发到网上。leaked-system-prompts 只做一件事:把这些泄露记录按产品归档,并附上来源与日期。

这些文件里藏着三样东西,都直接能用:

你在产品里看到的现象档案里对应的真实规则
模型"知道"当前日期和最新选举结果一行Current date加事实注入块
模型拒绝时先道歉再给替代方案一条"不解释拒绝原因,直接给替代"的语气规则
ChatGPT 能"记住"你的偏好bio记忆工具的调用协议,含"只写纯文本、禁止 JSON"的硬性要求

拿 openai-chatgpt5_20250807.md 举例:它明确禁止模型用"要不要我帮你……"这类句式收尾,并要求澄清提问最多一次、放在开头。你在产品里感受到的"这代 AI 更果断",就是这些句子在工作。

三层隐藏规则,按这个顺序读

164 个文件看似杂乱,内容结构却惊人一致,大致是三层,理解顺序从上到下:

身份层。声明它是谁、知识截止到哪、能对外说什么产品。Claude 的条目还会写清楚"模型字符串叫什么""被问价格就指到官网",本质是一套脚本化 FAQ,见 anthropic-claude-4_20250522.md。

行为层。语气与格式。常见条款:闲聊里不许用列表、每个 bullet 至少一两句、永远别用"好问题"开头捧用户。这层最直接影响"模型像不像人"。

协议层。工具调用定义。档案里最有戏剧性的是 openai-dall-e-3_20231007-1.md——有人让 DALL-E 3 把自己的系统提示词"画"进了婚礼场景,原图就在 images/ 目录里。从这份泄露记录能完整看到 dalle 工具的 TypeScript 签名,和"最多 4 张图""不画在世艺术家"这类写死在注释里的策略条款。

5 分钟克隆仓库,找到最值得读的文件

没有构建,没有依赖,纯 markdown,任何编辑器都能打开。

# 克隆档案库,164 个文件平铺在同一目录 git clone https://gitcode.com/GitHub_Trending/le/leaked-system-prompts cd leaked-system-prompts # 查看某个产品有哪些时间版本 ls anthropic-claude-sonnet-3.5_*.md # 直接定位你关心的条款 grep -l "knowledge cutoff" *.md

文件名规则是产品-版本_日期.md,日期是这次泄露的快照日期。建议先各读一份 OpenAI、Anthropic、Google 的文件,体会三家写法差异,再按需 grep。

把泄露内容改成你自己的提示词 🔧

三个最落地的改法,按"需求 → 参考哪里 → 改完效果"说:

场景:模型爱用"需要我帮你……吗?"收尾,啰嗦。参考 ChatGPT-5 行为层:把禁止句式逐条列出来(would you like me to / shall I……),并要求"下一步显而易见时直接做"。 效果:回复的服务腔消失,每轮少一次多余确认。

场景:模型答时事时日期总是乱编。参考身份层模板:"知识截止时间 + 当前日期"两行声明,缺一不可。 效果:模型明确知道自己知识边界,遇到截止后的事件会转而查资料。

场景:工具定义写得太口语,模型常填错字段。参考 DALL-E 的 dalle 工具:每个字段带类型注解,策略条款直接写进字段注释里。 效果:调用时字段遵循度明显提高。

一条原则:不要整份抄。泄露内容含产品措辞和会过期的合规条款,只提取"结构模式"。

动手前先看这 3 个坑 ⚠️

同一个产品好几个版本,读了最旧的像读了另一个产品。原因:提示词随产品迭代,文件名日期是快照日期。 一招:先ls 产品名_*.md看时间线,只读最新的;想研究演进再做跨版本 diff。

你以为的"提示词"其实是一份"套话记录"。原因:部分文件是问答转录(上面的 DALL-E 就是),不是干净指令。 一招:看文件开头的source行判断来源,或 grep## System Prompt这类标题定位干净段落。

原样搬进商业产品有风险。原因:README 明确档案对 DMCA 下架敏感,且刻意不收商业敏感代码。 一招:只用于内部研究与模式提取,发布物里不照搬厂商原文。

读完之后可以试两件事:对同一产品最早和最新版本做 diff,看安全条款两年里怎么变;或者把全部工具定义抽出来,给自己团队写一份"工具提示词风格指南"。

【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址: https://gitcode.com/GitHub_Trending/le/leaked-system-prompts

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/11 14:42:06

SystemInformer DLL 注入从入口到内核全解

SystemInformer DLL 注入从入口到内核全解 【免费下载链接】systeminformer A free, powerful, multi-purpose tool that helps you monitor system resources, debug software and detect malware. Brought to you by Winsider Seminars & Solutions, Inc. https://windo…

作者头像 李华
网站建设 2026/9/11 14:41:28

贪心算法实战:跳跃游戏问题解析与Java实现

1. 跳跃游戏问题解析:贪心算法的完美舞台LeetCode上的跳跃游戏问题(Jump Game)是算法练习中的经典题目,也是面试中的高频考点。题目描述看似简单:给定一个非负整数数组,每个元素代表你在该位置可以跳跃的最…

作者头像 李华
网站建设 2026/9/11 14:40:53

DAX窗口函数实战:从基础到高级应用

1. DAX窗口函数基础解析 在数据分析领域,DAX(Data Analysis Expressions)作为Power BI和Excel Power Pivot的核心公式语言,其窗口函数功能正逐渐成为处理复杂分析场景的利器。不同于基础聚合函数,窗口函数能够在保留原…

作者头像 李华
网站建设 2026/9/11 14:39:14

MAVLink协议详解:从报文结构到无人机飞控通信实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/11 14:39:11

模型训练与测试规范:YOLOv8实战避坑指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/11 14:38:55

RK3588边缘盒子随机掉线排查实录:从网络到USB的完整复盘

前阵子给客户做的一批RK3588智能边缘盒子出了个大问题:在客户现场跑着跑着就掉线,而且是随机性掉线,有时候一天一次,有时候半小时一次。客户那边负责现场运维的兄弟一开始还以为是网线松了,后来发现根本不是那么回事—…

作者头像 李华