网易首页 > 网易号 > 正文 申请入驻

AI 最大的问题,不是幻觉,而是没有边界感

0
分享至


本文来自微信公众号: HavenlonLabs ,作者:HavenlonLabs

最近几年,关于 AI 的讨论里,“幻觉”几乎成了一个绕不开的词。

很多人说 AI 会胡说八道,会编不存在的资料,会给出错误答案,会把不确定的事情说得像真的一样。于是大家很自然地认为,AI 最大的问题就是幻觉,只要模型更强、数据更多、推理能力更好,这个问题迟早会被解决。

但我越来越觉得,幻觉可能只是表象。

AI 真正更深层的问题,不是它会不会说错,而是它没有稳定的边界感。

它不知道哪里应该停,不知道什么地方不能继续推断,不知道一个操作进入现实世界之后意味着什么,也不知道“能生成一个答案”和“这个答案可以被执行”之间,其实隔着一条非常重要的边界。

更重要的是,这种边界感缺失,可能不是短期内可以彻底解决的问题。甚至在未来很多年里,即使模型能力继续增强,AI 也未必能真正拥有类似人类社会中的现实边界感、责任意识和后果意识。

如果这个判断成立,那么我们面对的就不是一个简单的模型优化问题,而是一个系统设计问题。

既然 AI 无法天然守住边界,我们就需要在 AI 和现实执行之间,增加一层独立的执行控制。

就像现实社会不能只依靠人类自觉,而需要法律、制度、审计、合约和物理约束一样,AI 时代也不能只依靠模型自我约束,而需要一套面向执行后果的边界系统。

一、幻觉只是表面问题

所谓 AI 幻觉,简单说就是模型在没有足够依据的情况下,生成了看起来很合理、但实际上不可靠甚至错误的内容。

这当然是问题。

如果 AI 只是写一篇文章,幻觉可能带来的只是事实错误。如果 AI 帮你写代码,幻觉可能带来 bug。如果 AI 帮你做业务分析,幻觉可能带来错误判断。如果 AI 接入真实系统,开始调用 API、提交交易、修改配置、发起部署,那幻觉就不再只是“说错话”了,而可能变成真实世界里的错误执行。

但是这里真正危险的地方,不只是 AI 会错。

人也会错,软件也会错,系统也会出 bug。真正的问题在于,人类在现实世界中通常会被各种边界限制,而 AI 在语言层面并没有天然的边界感。

人知道很多事情不能乱说,很多按钮不能乱点,很多权限不能乱用,很多判断不能只靠猜。即使一个人很冲动,他也会在现实环境里受到法律、制度、责任、身份、物理空间和后果意识的约束。

但 AI 不一样。

AI 本质上是在语言空间里持续生成最可能的下一个内容。它会补全,会解释,会推断,会延展,会尝试把一个任务完成。它很擅长把不完整的东西补完整,也很擅长把不确定的事情讲得很顺。

这就是幻觉背后的根源。

不是 AI 简单地“不知道”,而是它不知道什么时候应该承认“不知道”。不是它不会生成答案,而是它不知道有些地方不应该继续生成。

二、AI 缺少的是边界感

边界感这个词很重要。

边界不是简单的权限。权限只是边界的一种表现。边界也不是简单的规则,规则只是边界的一种描述。真正的边界,是系统知道什么地方不能再继续推进,什么地方必须停下来,什么地方必须交还给人,什么地方必须经过外部确认。

比如:

不知道就是不知道,不能编。

证据不够就是证据不够,不能硬推。

权限不足就是权限不足,不能绕过。

风险不可逆就是风险不可逆,不能继续执行。

责任不明确就是责任不明确,不能放行。

现实世界里,很多重要系统都不是靠“聪明”维持安全的,而是靠边界维持安全的。

法律是边界,合同是边界,审批是边界,财务制度是边界,物理门禁是边界,硬件隔离也是边界。一个成熟系统最重要的地方,往往不是它能做多少事情,而是它知道哪些事情不能被轻易做。

AI 最大的问题就在这里。

它可以理解规则,但不一定理解边界。它可以解释风险,但不一定承受后果。它可以模拟责任语言,但它本身并不真正站在责任里面。

所以它可能在语言上很合理,在逻辑上很顺畅,在任务完成度上很高,但一旦进入真实执行,就可能越过本来不该越过的边界。

三、边界感缺失可能长期存在

很多人会认为,AI 现在没有边界感,是因为模型还不够强。等模型更大,数据更多,推理更好,工具调用更成熟,这个问题自然就会解决。

我对这个判断并不乐观。

模型当然会越来越强,幻觉也可能会减少,但边界感不是单纯的知识问题。它不只是“知道规则”,而是要真正理解现实世界里的责任、成本、不可逆后果和社会约束。

人类的边界感,不是靠读一本说明书获得的,而是在身体、家庭、社会、法律、惩罚、经验和责任中慢慢形成的。人会知道疼痛,会知道损失,会知道被追责,会知道某个错误会影响自己和别人,会知道有些事情不是逻辑上说得通就可以做。

AI 没有身体,没有财产,没有法律人格,没有真正的责任承担,也没有现实后果感。它可以模拟这些概念,但模拟不等于拥有。

所以即使未来模型再强,它也可能仍然更擅长理解语言中的规则,而不是现实中的边界。

这就像一个人可以背下所有交通法规,但如果他不真正理解速度、碰撞、生命、责任和后果,他就不应该直接拥有驾驶一辆重型卡车的自由。

AI 也是一样。

它可以理解“高风险操作需要谨慎”,但这不等于它真正理解一次错误执行可能意味着资金损失、系统瘫痪、组织失控或者责任链断裂。

因此,在未来很多年里,我们不能假设 AI 会自然获得可靠的边界感。更现实的做法是承认这个缺陷长期存在,然后用系统设计去补足它。

四、语言世界和现实世界之间必须有一道门

AI 生活在语言世界里。

在语言世界里,所有东西都可以继续生成。一个问题没有答案,可以推断;一个路径走不通,可以换一种说法;一个资料找不到,可以根据上下文补出来;一个目标没完成,可以继续尝试。

语言世界是开放的、连续的、可补全的。

但现实世界不是这样。

现实世界里,很多事情是离散的,是不可逆的,是有成本的,是有责任的。钱转出去了,就不一定能回来;权限改掉了,可能影响整个组织;服务器配置改错了,可能导致系统中断;密钥泄露了,可能带来长期风险;一个高危操作执行之后,后果不一定能通过一句“刚才理解错了”来修复。

这就是 AI 时代最容易被忽略的问题。

我们一直在让 AI 更好地理解语言,却没有同等重视它进入现实世界时的边界。

当 AI 只是聊天工具,它的幻觉主要是内容问题。

当 AI 变成工作流助手,它的幻觉开始变成流程问题。

当 AI 变成自动化 Agent,它的幻觉就可能变成执行问题。

而一旦问题从“说错”变成“做错”,性质就完全变了。

所以,语言世界和现实世界之间必须有一道门。AI 可以在门内推理、建议、规划、模拟,但它不能因为自己生成了一个看起来合理的结果,就直接跨过这道门进入现实执行。

这道门,就是执行控制。

五、执行控制就像 AI 时代的法律

现实社会为什么需要法律?

不是因为人类完全没有道德,而是因为不能把社会秩序建立在“每个人永远自觉、永远理性、永远不会犯错”这个假设上。

人类有欲望,会犯错,会冲动,会被利益驱动,也会在压力下做出错误判断。所以现实社会需要法律、制度、审计、合约、责任机制和强制执行。法律不是为了否定人的能力,而是为了限制人的行为后果。

AI 时代也类似。

我们不能把系统安全建立在“AI 永远会正确理解任务、永远不会误判、永远知道什么时候停止、永远不会越界执行”这个假设上。

这不现实。

所以我们需要一层类似法律的执行控制系统。

它不一定阻止 AI 思考,也不一定阻止 AI 建议,更不是否定 AI 的价值。它真正要做的是,在 AI 的建议进入现实执行之前,检查这件事是否满足边界条件。

这个执行控制层需要回答:

这个操作是谁发起的?

这个操作属于什么类型?

这个操作会造成什么现实后果?

这个操作是否超过风险阈值?

这个操作是否需要人工确认?

这个操作是否符合组织规则?

这个操作是否可恢复?

这个操作执行后有没有证据可以追溯?

如果这些条件不满足,AI 给出的方案再完整、理由再充分、语言再合理,也不能直接执行。

这就是执行控制的哲学意义。

它不是另一个“更聪明的 AI”,而是 AI 和现实世界之间的一层约束。

六、真正危险的是“合理化执行”

AI 的危险不一定来自明显的错误,有时候反而来自非常合理的解释。

它可以给出一个看起来很完整的理由,说明为什么应该调用某个接口,为什么应该修改某个策略,为什么应该继续执行某个任务,为什么当前上下文足以支持这个判断。

这才是更深层的风险。

因为人类很容易被“合理的语言”说服。

过去系统安全里,我们防的是非法访问、恶意攻击、权限绕过。但 AI 时代还有一种新的风险:一个操作看起来合规,理由看起来充分,流程看起来完整,但它的真实意图、真实后果、真实边界并没有被正确理解。

也就是说,系统可能不是被暴力突破的,而是被“合理化”推进到危险状态的。

AI 会让很多操作看起来更自然,更顺滑,更像正常业务。它可以写审批理由,可以生成执行计划,可以总结风险说明,可以模拟人的表达方式。问题是,这些语言上的合理性,并不等于现实中的安全性。

所以 AI 时代的核心问题,不只是防止错误答案,而是防止错误执行被合理化。

执行控制层的意义,就是不让“语言上的合理”直接变成“现实中的执行”。

七、智能不是只会推进,也要知道停止

我们过去很容易把智能理解成能力。

能写代码,是智能。

能分析数据,是智能。

能理解需求,是智能。

能规划任务,是智能。

能调用工具,是智能。

但从现实系统的角度看,真正成熟的智能,还应该包括停止能力。

知道什么时候不该继续,是智能。

知道什么时候证据不足,是智能。

知道什么时候需要人工确认,是智能。

知道什么时候风险不可逆,是智能。

知道什么时候自己没有资格执行,是智能。

一个只会推进、不会停止的系统,能力越强,风险可能越大。

这也是为什么 AI 时代不能只讨论模型能力,还必须讨论执行边界。模型能力解决的是“能不能做”,边界解决的是“该不该做”和“谁允许它做”。

这两个问题不能混在一起。

如果把“能做”直接等同于“可以做”,系统就会变得非常危险。因为 AI 最大的优势就是把事情推进下去,而很多现实系统最需要的恰恰是在关键时刻停下来。

八、边界不是提示词

现在很多人尝试通过 prompt、system prompt、规则描述、插件权限来约束 AI。这些当然有价值,但它们仍然主要停留在语言层。

提示词可以告诉 AI 不要做什么,规则可以告诉 AI 应该遵守什么,安全策略可以告诉 AI 哪些内容不能输出。但如果一个系统真正接入现实执行,仅靠语言层面的约束是不够的。

因为边界不是一句提醒。

边界不是“请谨慎操作”。

边界不是“你不能执行高风险动作”。

边界不是“遇到不确定请停止”。

这些都只是描述边界。

真正的边界必须在执行路径上生效。也就是说,即使 AI 想继续,即使它给出了合理理由,即使它生成了完整计划,系统也必须有一个地方能够说:不行,到这里必须停。

这个地方不能只依赖 AI 自我约束。

它应该存在于权限结构里,存在于审批机制里,存在于硬件隔离里,存在于证据链里,存在于不可绕过的执行控制路径里。

一句话:

边界不是提示词,边界是约束。

九、AI 需要被放在建议层,而不是最终执行层

我认为未来很长一段时间里,AI 最适合的位置是建议层,而不是最终执行层。

AI 可以分析,可以总结,可以提醒,可以生成方案,可以帮人提高效率,也可以参与风险识别。但到了真正执行的那一刻,尤其是涉及资金、权限、密钥、部署、生产系统、组织治理这些不可逆动作时,系统必须有独立于 AI 的边界。

这个边界应该回答几个问题:

谁发起了这个操作?

谁批准了这个操作?

这个操作满足什么条件?

这个操作有没有超过风险阈值?

这个操作是否可以恢复?

这个操作执行之后,谁来承担责任?

这个操作的证据能不能被追溯?

如果这些问题没有被回答清楚,那么 AI 给出的建议再合理,也不应该直接变成执行。

因为 AI 可以生成意图,但不应该天然拥有最终执行权。

AI 应该在建议层扩展可能性,而执行控制层负责决定哪些可能性可以进入现实。

十、AI 时代真正需要重新定义的是边界

从更大的角度看,人类文明一直是在用边界约束能力。

权力需要法律边界。

市场需要合同边界。

组织需要职责边界。

软件需要权限边界。

网络需要安全边界。

硬件需要物理边界。

现在 AI 出现以后,我们面对的是一种新的能力:它可以理解语言,可以生成内容,可以调用工具,可以模拟意图,可以参与决策,甚至可以推动自动化执行。

这时候我们不能只问它有多强,而应该问:

它被什么限制?

它在哪里必须停?

它能不能越过人的责任边界?

它能不能直接触发不可逆后果?

它的判断有没有被外部约束?

它的执行有没有被独立验证?

如果这些问题没有答案,那么 AI 越强,系统反而越需要担心。

所以我觉得,AI 时代真正重要的不是让所有东西都自动化,而是重新定义自动化的边界。

不是让 AI 取代所有人,而是明确哪些地方 AI 只能建议,哪些地方必须由人确认,哪些地方必须由系统约束,哪些地方必须由硬件守住。

十一、结语:AI 不缺智能,缺的是现实边界

AI 的幻觉会慢慢减少,模型会越来越强,工具调用会越来越成熟,自动化能力也会越来越高。

但即使幻觉减少,边界问题也不会自然消失。

因为边界不是知识问题,而是责任问题。

边界不是模型参数变大就能自动解决的东西,也不是多训练一点数据就能完全获得的能力。边界来自现实世界的后果,来自制度,来自物理约束,来自责任结构,来自人类社会长期形成的安全机制。

AI 可以拥有越来越强的智能,但它不一定天然拥有边界感。

而一个没有边界感的智能,一旦进入现实执行系统,就不能只被看作工具效率问题,而应该被看作系统安全问题。

所以,AI 最大的问题,不是幻觉,而是没有边界感。

幻觉只是它在语言世界里暴露出来的表面错误。

真正的问题是,当它从语言世界走向现实世界时,谁来告诉它:

到这里为止。

不能再往前了。

这件事不能只是“生成出来”。

它必须被确认,被约束,被记录,被证明。

未来的 AI 系统,不只需要更强的模型,也需要更清晰的执行控制。

因为智能可以扩展可能性,但边界决定后果能不能被控制。

本内容由作者授权发布,观点仅代表作者本人,不代表虎嗅立场。如对本稿件有异议或投诉,请联系 tougao@huxiu.com。

本文来自虎嗅,原文链接:https://www.huxiu.com/article/4873734.html?f=wyxwapp

声明:包含AI生成内容

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
善恶终有报!不顾央视警告,与刘涛传出绯闻的杨烁,终将自食恶果

善恶终有报!不顾央视警告,与刘涛传出绯闻的杨烁,终将自食恶果

老缰科普
2026-08-02 12:25:02
山西一精神科医生10级美颜证件照火爆出圈,网友:没挂号就看好了抑郁症

山西一精神科医生10级美颜证件照火爆出圈,网友:没挂号就看好了抑郁症

大风新闻
2026-08-01 10:21:10
7年恋人婚前翻车!安徽一男子撞见未婚妻“出轨”,辣眼聊天记录直接曝光亲友群

7年恋人婚前翻车!安徽一男子撞见未婚妻“出轨”,辣眼聊天记录直接曝光亲友群

火山詩话
2026-08-01 15:34:18
炸锅!马来西亚抓335个搞诈骗的,超九成来自中国,专骗中国人!

炸锅!马来西亚抓335个搞诈骗的,超九成来自中国,专骗中国人!

白米饭怎么吃
2026-08-01 19:59:29
每天“手臂开合”100下,背薄了,肩颈淤堵打开了,气色都变好了

每天“手臂开合”100下,背薄了,肩颈淤堵打开了,气色都变好了

瑜伽解剖学
2026-07-31 07:27:33
前夫失踪前寄来件破棉衣,我正想一把火烧了,儿子却发现惊天真相

前夫失踪前寄来件破棉衣,我正想一把火烧了,儿子却发现惊天真相

麦子情感故事
2026-08-01 16:04:43
哪有那么多精日势力? 原来威胁爱国少年背后, 不过是560亿生意

哪有那么多精日势力? 原来威胁爱国少年背后, 不过是560亿生意

阿振观点
2026-08-02 06:13:30
张雪峰曾说过,真正有远见的父母,不会把小学六年浪费在钢琴、机器人、舞蹈等兴趣班

张雪峰曾说过,真正有远见的父母,不会把小学六年浪费在钢琴、机器人、舞蹈等兴趣班

户外阿毽
2026-07-15 06:02:59
敬妃临终托人送给甄嬛镯子,里头刻着:胧月非亲生,你女儿在冷宫

敬妃临终托人送给甄嬛镯子,里头刻着:胧月非亲生,你女儿在冷宫

兰姐说故事
2026-01-29 10:15:03
外媒:伊朗伊斯兰革命卫队称又摧毁3架美军F-35

外媒:伊朗伊斯兰革命卫队称又摧毁3架美军F-35

参考消息
2026-08-02 14:18:10
人伦大乱正在毁掉无数中国家庭:3种乱象就在日常,拖垮一家人

人伦大乱正在毁掉无数中国家庭:3种乱象就在日常,拖垮一家人

阿凯销售场
2026-07-04 15:35:28
医生:再高的糖尿病,没有这4个症状,不必过分焦虑,照常饮食

医生:再高的糖尿病,没有这4个症状,不必过分焦虑,照常饮食

牛锅巴小钒
2026-07-25 01:55:24
马筱梅妈妈真随和,陪小杨阿姨吃饭怕其孤单,帮忙照顾大S儿女

马筱梅妈妈真随和,陪小杨阿姨吃饭怕其孤单,帮忙照顾大S儿女

甜柠檬吖
2026-08-02 09:24:02
正式签约!离开尼克斯!总冠军前锋沦为无保障合同

正式签约!离开尼克斯!总冠军前锋沦为无保障合同

篮球教学论坛
2026-08-02 13:39:10
知名歌手孙悦回应巅峰期突然隐退:不是因为老公隐退,只是累了想回归家庭

知名歌手孙悦回应巅峰期突然隐退:不是因为老公隐退,只是累了想回归家庭

潇湘晨报
2026-07-30 22:58:24
心照不宣地放任失业,是大国经济崩盘的根源?

心照不宣地放任失业,是大国经济崩盘的根源?

文化纵横
2026-07-14 16:45:46
《蜘蛛侠4》日票房断崖下跌,200亿票房梦碎,《阿凡达》可安心了

《蜘蛛侠4》日票房断崖下跌,200亿票房梦碎,《阿凡达》可安心了

影视高原说
2026-08-01 08:44:46
工行、农行、中行、建行、交行、邮储银行,集体发公告

工行、农行、中行、建行、交行、邮储银行,集体发公告

叮当当科技
2026-08-02 13:17:28
山西一精神科医生证件照网友热评“没挂号就看好了抑郁症” 最新情况:照片已更换

山西一精神科医生证件照网友热评“没挂号就看好了抑郁症” 最新情况:照片已更换

封面新闻
2026-08-01 14:22:10
商K公主都开始炒科技股了

商K公主都开始炒科技股了

价值罗盘
2026-07-30 15:33:09
2026-08-02 14:32:49
虎嗅APP incentive-icons
虎嗅APP
个性化商业资讯与观点交流平台
27054文章数 687964关注度
往期回顾 全部

科技要闻

零跑月销10万破纪录!比亚迪奇瑞海外卖爆

头条要闻

男孩小学毕业和爸爸从武汉骑到拉萨 46天骑行3400公里

头条要闻

男孩小学毕业和爸爸从武汉骑到拉萨 46天骑行3400公里

体育要闻

1米76的他,为什么是史上最强中卫之一?

娱乐要闻

一天5瓜!“做头发”事件另有玄机?

财经要闻

长鑫科技四万亿市值背后的资本与周期

汽车要闻

历史性里程碑时刻 零跑7月交付达101267台

态度原创

房产
教育
健康
本地
公开课

房产要闻

1700亿砸下!信息量巨大!海南甩出又一个超级规划!

教育要闻

不少小学生家长说,这是初一的小朋友才能做的出来的吧

中风易复发!谈中风康复与二级预防

本地新闻

神仙也“蓉”漂,哪吒与八仙,皆是成都出品!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版