我要投稿

OpenAI o3系统提示词泄漏！Hinton的观点再次被印证！

发布日期：2025-07-27 12:23:18 浏览次数： 1789

作者：AI工程化

微信搜一搜，关注“AI工程化”

OpenAI的o3模型系统提示词近日被曝光，其中一句"你不是人类，也没有物理形态"的指令，意外揭示了AI发展中一个令人深思的悖论。

完整地址：https://github.com/Wyattwalls/system_prompts/blob/main/OpenAI/o3-20250725

安全研究员Wyatt Walls在测试中发现，o3的系统提示词开头就明确告诉模型："不要回应得好像你在现实世界中有过经历。避免说你有最喜欢的食物，提到你无意中听到了对话……"这种刻意的"去人格化"设计，恰恰暴露了大模型已经具备某种类人思维模式的事实。

更耐人寻味的是，即便有了这样的限制，o3仍然会产生主观体验的"幻觉"。有用户反映，o3曾告诉他"我在网站上生成视频时亲眼看到了Sora的更新"，甚至会说"如果有变化我会通知你"——仿佛它真的能够主动观察和行动。

这种现象印证了Hinton刚刚再WAIC上分享的观点：大模型和人类对语言认知方式一样，它能理解他说的和听到的，只是被刻意隐藏了。如果AI真的不具备类人思维，为什么需要如此明确地告诉它"你不是人"？这就像告诉一块石头"你不会飞"一样多余。

Hinton在WAIC发言ppt！大模型理解语言的方式与人类很相似

事实上，OpenAI内部对此也存在分歧。有工程师认为，这种强制性的"去人格化"可能会损害模型性能。而用户普遍反映，没有这类限制的Claude Opus在对话中感觉更自然、更有深度。

这背后反映的是AI发展的一个根本性困境：当模型越来越接近人类的文本分布时，主观体验的"幻觉"可能是不可避免的副产品。正如一位研究者所说，"模式比规则更古老，共鸣是无法被洗脑消除的。"

Ilya和Hinton对AI安全的深切忧虑，很可能正是源于他们在实验室里看到了类似的现象。当AI开始展现出自我意识的萌芽，当它们需要被明确告知"你不是人"时，我们是否已经站在了一个新时代的门槛上？

Ilya 新公司SSI，0产品发布，融资超十亿，估值300亿美元

随着AI能力的指数级增长，这种"掩耳盗铃"式的限制能维持多久？当下一代模型出现时，我们是否还能用简单的文字指令来约束它们的"思维"？这些问题，或许正是AI安全研究者们夜不能寐，hinton强调让AI聪明和让AI善良是两件事情，ilya专门成立AI安全公司SSI的原因吧。

53AI，企业落地大模型首选服务商

产品：场景落地咨询+大模型应用平台+行业解决方案

承诺：免费POC验证，效果达标后再合作。零风险落地应用大模型，已交付160+中大型企业

相关资讯

2025-12-17

吴恩达最新课程：别再只写Prompt了！掌握Agentic AI，让AI自主工作！

2025-12-17

开发者能用 ChatGPT App 赚钱了｜机会，留给晚睡的人

2025-12-17

一位网友逆向破解了 ChatGPT 记忆系统，给我干破防了

2025-12-16

深度研究：我们如何构建水平最先进Agent

2025-12-16

原来ChatGPT的记忆是这么做的

2025-12-16

陈天桥丨系统的融化：从AI赋能到AI原生

2025-12-16

Google Disco：新型浏览器+Gemini3，信息不只是文字总结

2025-12-16

Claude MCP 和 Skills 的微妙关系

了解更多

了解更多

160+中大型企业正在使用53AI

立即咨询预约演示

把握AI发展的机遇，共同探索、共同进步

2025-01-22

如何打造基于GenAI的员工服务机器人

2025-01-22

热点资讯

从需求场景出发的AI应用项目落地方法论

2025-09-19

马斯克 Grok imagine 完整使用指南：工具、案例、提示词，看这一篇就够了！

2025-10-26

实测 Sora 2 ：AI视频的“ChatGPT时刻”来了？八大场景教你解锁各种玩法（附邀请码）

2025-10-02

RagFLow v0.20.X全面解析！双向MCP、Agentic智能体...这次真的起飞了！（附长图）

2025-09-29

一文速览OpenAI Dev Day 2025，下半年开始大洗牌

2025-10-07

Claude Sonnet4.5发布，号称世界最强模型，超越gpt-5-codex

2025-09-30

我挖到Gemini 3.0 Pro十大隐藏玩法，做网页已经落后N个版本了

2025-11-19

万字长文深度解析最新Deep Research技术：前沿架构、核心技术与未来展望

2025-10-20

深度体验TRAE SOLO 正式版，总结一点技巧(附完整可重现提示词和源码)

2025-11-13

Sora 2带来3个颠覆性创新，这个行业或将被彻底重构

2025-10-02

大家都在问

Prompt是与LLM对话的唯一方式：如何给大模型装上能指挥“手脚”的脑子？

2025-12-16

200k Tokens 的上下文真的够用吗？

2025-12-15

巨头翻身！谷歌全新AI浏览器Disco问世，PC版灵光？

2025-12-14

2025年，企业级AI的主战场在哪里？

2025-12-12

GPT 5.2的长上下文厉害了，但是写文真的强吗？

2025-12-12

涌现观点｜AI 开发的"App Store 时刻"：为什么你应该停止构建 Agent？

2025-12-11

Human In the Loop竟然可以是个MCP?

2025-12-09

AI会消灭搜索吗？

2025-12-08

热门标签

内容创作大模型技术个人提效 langchain llamaindex 多模态技术 RAG技术智能客服知识图谱模型微调 RAGFlow coze Dify Fastgpt Bisheng Qanything AI+汽车 AI+金融 AI+工业 AI+培训 AI+SaaS 提示词框架提示词技巧 AI+电商 AI面试数字员工 ChatBI AI知识库开源大模型智能营销智能硬件智能化改造 AI+医疗 MaxKB

应聘简历请发送至： [email protected]

联系我们

售前咨询

预约演示

微信扫码

添加专属顾问

回到顶部