AI的底牌被扒光了:GitHub上有人泄露了所有主流模型的系统提示词

· 科技资讯

## GitHub Trending今日最炸裂的项目

如果你今天只打开一个GitHub链接,应该是这个:`asgeirtj/system_prompts_leaks`——一个整理了所有主流AI模型系统提示词的仓库,上线即登上GitHub Trending。

里面有什么?**Claude Fable 5、Opus 4.8、Claude Code、ChatGPT 5.5、GPT 5.5 Instant、Codex、Gemini 3.5 Flash、Gemini 3.1 Pro、Grok、Cursor、Copilot、Perplexity**——几乎所有你能叫出名字的AI产品的系统提示词,全部以原文形式列出。

## 系统提示词是什么?为什么它的泄露是大事

系统提示词(System Prompt)是每个AI模型最核心的「宪法」——它定义了模型的行为边界、回答风格、安全限制、以及哪些话能说、哪些话不能说。

举个例子:Claude的系统提示词会告诉模型「如果你不确定答案,请诚实地说明」;ChatGPT的提示词会要求「保持中立、避免政治立场」;Gemini的则包含大量Google生态产品(Gmail、Docs、Maps)的调用规则。

> 这些提示词相当于AI的「出厂设置」。看到它们,就等于看到了每家公司的AI价值观和安全策略。

## 泄露内容中的几个关键发现

浏览这份泄露文档,几个细节尤其值得注意:

**各家对「安全」的定义截然不同。** Anthropic的系统提示词中包含了详尽的安全阶梯——从「绝对不能做」到「可以谨慎讨论」分为六个等级。而xAI的Grok提示词则明显宽松得多,甚至允许在某些条件下的争议性回应。

**意识形态倾向是真实存在的。** 多个模型的系统提示词中包含了对特定话题的立场引导——比如对气候变化、疫苗、AI风险的表述方式。这些引导不一定是有意植入的,但它们确实存在。

**隐私边界画得比你想的窄。** 多个商业产品(特别是集成在IDE中的AI助手)的系统提示词中,明确允许读取用户的文件名、项目结构、甚至代码内容以「提供更好的服务」。

## 这算不算安全漏洞

严格来说,系统提示词的泄露并不等同于模型被「攻破」——它只是暴露了护栏的位置,而非绕过了护栏。但它的影响力不容小觑:

– **攻击者**可以利用对系统提示词的了解来设计更精准的越狱Prompt
– **竞争对手**可以从中推断出各家的安全策略和技术路线
– **普通用户**终于可以看清楚自己每天对话的AI到底被灌输了什么

有意思的是,这个仓库目前没有被GitHub下架——可能因为它只是整理公开信息,而非破解行为。

## 对开发者意味着什么

对于正在构建AI应用的人来说,这份泄露文档是一个极好的学习材料:

1. **看看大厂怎么写Prompt**:这些经过数月迭代的系统提示词,本身就是Prompt Engineering的最佳实践合集
2. **理解安全护栏的设计逻辑**:怎么在不影响体验的前提下做安全限制
3. **反思自己的产品**:如果你的AI产品的系统提示词被公开,你愿意让用户看到吗?

> 这次泄露像是一面镜子——它照出的不是AI的缺陷,而是创造AI的人类的价值观。

🔥 关注LC智趣厅,挖掘AI世界最隐秘的角落

👇 你猜到自己的AI助手的「出厂设置」是什么样吗?

滚动至顶部
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅