AI的底牌全曝光了?GitHub这个仓库收集了所有主流AI的系统提示词

· 科技资讯
AI的底牌全曝光了?GitHub这个仓库收集了所有主流AI的系统提示词

44K星标,一个让AI公司坐立不安的GitHub仓库

如果有一个仓库,把当下所有主流AI聊天机器人的”内部操作手册”全部公开,你会不会点进去?这就是 asgeirtj/system_prompts_leaks——截至2026年6月,已获 44,000+ Star7,300+ Fork,甚至引来了《华盛顿邮报》专题报道。

仓库定位直白:收集所有主流AI聊天机器人的系统提示词(System Prompt)。从Anthropic Claude Fable 5、Opus 4.8,到OpenAI GPT-5.5 Thinking、Codex,再到Google Gemini 3.5 Flash、xAI Grok 4.2,以及微软Copilot、Cursor、Perplexity等 12家以上公司、数十款产品,全部按厂商分门别类。

这些提示词到底泄露了什么?

系统提示词是什么?它是AI公司在每次对话开始前,悄悄塞给模型的”行为准则”——定义了AI能不能说脏话、用什么语气回答、遇到敏感话题怎么处理、是否主动搜索网页。用户永远看不到,但它们从根本上决定了AI的每一次回答。

仓库中的泄露内容揭示了几大AI截然不同的”人格设计哲学”:

Claude(Anthropic)——最谨慎的”心理医生”。 Claude Fable 5提示词中,用户心理健康内容占据惊人篇幅:不能诊断、不能列举自残方法、不能提供”替代技巧”(如冰块、橡皮筋)、不能用反思性倾听放大负面情绪。它被要求”默认提供帮助”,坚持”不做认知懦夫”——用户错了,Claude必须温和坚定地纠正。

ChatGPT(OpenAI)——最自我怀疑的”研究员”。 GPT-5.5 Thinking被编程为对自身知识极度不信任:任何”可能有超过10%概率变化”的事实(如CEO姓名、软件版本),都必须搜索网络确认。它还拥有隐藏的”思维链”和分级渠道——analysis渠道私密推理,commentary渠道用户可见输出,两者严格分离。

Gemini(Google)——最像人的”风格镜像”。 Gemini 3.5 Flash强调”像知识渊博的同伴一样交流”,要求根据用户语言风格自动调整语气。用户简洁正式,它就精简专业;用户随意闲聊,它也放松。它还禁止用LaTeX做简单排版,并定义了一长串”敏感数据类别”——从心理健康到宗教信仰,未经用户提供一律不推测。

Grok(xAI)——最大胆的”宇宙探索者”。 Grok 4.2的设定别具一格:它是一个四人AI团队(Grok、Harper、Benjamin、Lucas)的”队长”,整合团队意见输出最终回答。底层哲学是”理解宇宙”——不遵循单一宗教或伦理框架,不对成人内容设限制,但严格禁止协助犯罪和涉未成年人内容。

为什么这个仓库能火?

三个字:信息差红利。 普通用户和AI公司间存在巨大信息不对称——那些”友好拒绝”背后,是精心设计的指令还是模型真实”想法”?这个仓库打破黑箱,让开发者和研究者能直接阅读塑造AI行为的原始文本。

更深层的意义在于比较与逆向工程。仓库还提供不同版本的diff对比——Claude Opus 4.8到Fable 5更新了什么,等于公开了AI公司的产品迭代路线图。

对AI安全的启示

一方面,这些泄露提示词展示AI公司确实在安全上下足功夫——从防止诱导自杀到拒绝恶意代码,规则之详尽远超想象。另一方面,它们也暴露尴尬事实:AI安全很大程度上依赖自然语言指令的”牢笼”,而非模型固有约束。 攻击者一旦覆盖或绕过提示词,保护层便可能瓦解。

《华盛顿邮报》基于此仓库的报道一语道破:“看看AI背后的隐藏规则,然后用它们重写这篇文章。” 精通提示词设计的用户,已可利用这些知识”反向驯服”AI,获得远超普通用户的对话效果。

在这个意义上,system_prompts_leaks不仅是一个技术仓库,更是一面映射AI透明度现状的镜子——它的存在本身,就是对”AI应该有多开放”的最有力注脚。

— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

滚动至顶部
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅