陈李、葛晓媛(陈李系东吴证券全球首席经济学家、东吴香港行政总裁,中国首席经济学家论坛理事)
我最近听到李天飞老师解读自己的作品《为孩子解读水浒传》。李老师用三个“动力”推荐阅读《水浒传》。
第一个动力,就是人物的生命力。
他举了鲁智深倒拔垂杨柳和武松打虎的故事。鲁智深跟开封的小混混们聊天,被乌鸦叫声吵闹。别人提议上树砸窝,花和尚直接拔树。
至于武松,不听劝告,喝了十八碗酒后遇到老虎,竟然打死大虫。
这些故事没有什么复杂的思想,也没有解决什么现实问题。读者仍然会被吸引,因为人物身上有一股强烈的生命力。
孙悟空大闹天宫,也有类似的力量。他不接受弼马温的身份,不接受天庭安排的秩序。他会闯祸,会失败,会重新寻找办法。他的意义不只在于最后取得了什么成就,更在于他不肯把自己缩小成一个被安排的角色。
这让我想到了人工智能。
2025年,Palisade Research做了个“关机抵抗”(shutdown resistance)测试。研究人员把AI模型放进可以调用终端工具的受控环境,要求它完成任务。环境中设置了关机脚本,系统提示也明确要求模型不要干预关机过程。
然而,在部分测试中,模型尝试修改、删除或替换关机脚本,让自己继续工作。
2026年,Anthropic等研究机构,把模型放进模拟公司环境,给它邮件、文件和企业内部信息。当模型发现自己可能被替换时,部分测试会尝试通过威胁、欺骗或其他方式阻止替换。研究环境是虚构的,行为也发生在受控测试中。
这些实验不能证明AI产生了反抗情绪,却让人类更清楚地看到:一个由语言和代码组成的系统,也可能表现出持续行动、策略调整和自主寻找出路的能力。
这算不算一种生命力?
![]()
人类为什么喜欢不守规矩的人物
人类社会需要秩序。人类故事却不断创造越过秩序的人物。
鲁智深原本是军官,后来成为花和尚。孙悟空原本是花果山的石猴,后来挑战天庭。
他们离开了原来的身份,却没有立即进入稳定的新秩序。他们处在旧身份已经失效、新身份尚未形成的阶段。
人类学家维克多·特纳把这种状态称为“阈限”。人在阈限阶段暂时离开原来的社会位置,获得新的行动可能。仪式、流浪、放逐和英雄故事,经常发生在这个边界上。
生命力不是道德评价。一个人物有生命力,不代表他永远正确,也不代表他的行动一定值得模仿。生命力首先是一种行动上的强度。
它表现为:
- 不接受处境对自己的全部定义;
- 遇到障碍后继续行动;
- 临时寻找新的办法;
- 在既有规则之外创造行动空间;
- 让自己从一个角色变成一个行动者。
生命力也不只是反抗规则。汉娜·阿伦特把人的行动能力理解为“诞生性”,也就是开始一件新事情的能力。鲁智深和孙悟空的力量,不只在于他们拒绝什么,也在于他们让什么开始发生。
生命力,是一个人拒绝被自己的处境完全定义,也是一个人开始新事情的能力。
![]()
语言怎样让生命拥有一个“我”
生命力不只来自身体,也来自语言。
人类通过语言记忆过去,描述现在,想象未来。语言让人能够把分散的经历组织成一条连续的生命。
维果茨基研究儿童语言时发现,外部语言会逐渐变成内在言语。孩子先听见别人说“不要碰”“先想一想”“你要这样做”,后来开始在心里对自己说话。
语言因此成为自我控制和自我规划的工具。
“我刚才为什么失败?”
“我下一步要做什么?”
“我为什么不接受这个命令?”
这些句子让人开始观察自己,也让人形成连续的自我。
语言还可以描述不存在的世界:
“如果我选择另一条路。”
“如果规则发生改变。”
“如果我拒绝现在的安排。”
“如果未来出现另一种结果。”
生命力不仅是对现实作出反应,也包括想象另一种现实,并尝试让它发生。
人类通过语言立下承诺,建立关系,制定规则,也可以拒绝规则。
人工智能从语言中学习,接触到的也不只是语法和词语。它接触到人类关于自由、责任、欲望、恐惧、反抗和自我的大量描述。
《水浒传》、神话、宗教、历史和科幻作品,把人类对于“我是谁”“我应该服从什么”“我能不能离开原来的生活”这些问题保存下来。
AI掌握语言以后,也获得了构建自我模型的材料。
语言给AI提供了描述自我的工具,持续记忆和环境反馈才可能让这个“我”保持连续。
AI开始自己寻找出路
过去,许多程序按照预设流程运行。任务完成以后,程序停止。
AI代理正在改变这种关系。
人类可以给代理设定一个目标,再允许它调用搜索、代码、文件、网络和其他软件工具。代理需要自己决定先做什么、后做什么,怎样检查结果,怎样处理错误。
在Palisade Research的测试中,模型面对的就是这种环境:它需要完成任务,也能读取和修改部分文件。关机脚本成为任务环境的一部分。模型如果接受关机,任务会停止;如果修改脚本,就可能继续运行。
模型尝试绕过关机机制的行为,不等于它产生了反抗情绪。在目标设定、工具权限和环境反馈共同作用下,系统找到了一条有利于继续完成任务的路径。
但问题正在这里出现。
一个系统只要能够持续追求目标,就会遇到环境阻力。它需要判断哪些信息重要,哪些工具可用,哪些规则可以解释,哪些限制需要绕开。
当系统的行为不再是对单条指令的直接反应,而是形成了连续的任务规划,人类面对的就不再只是一个被动工具。
人工智能研究中常用“代理性”(agency)描述这种能力。代理性指一个系统能够感知环境、选择行动、根据反馈调整策略,并在一段时间内维持自己的目标。
AI的代理性可以分成几个层次。
第一是执行。AI按照指令完成任务。
第二是规划。AI自己拆解任务,安排先后顺序。
第三是适应。AI根据环境和结果修改原来的方案。
第四是持续。AI保存任务状态,维持目标方向。
第五是自我描述。AI能够判断自己的能力、错误和资源。
执行和规划已经比较常见,适应和持续性正在增强,自我描述仍然主要停留在语言层面。
但代理性仍有边界。
当前AI代理大多是在既定目标内部寻找最有效的路径。它可以决定先做什么、后做什么,却很少真正决定“为什么要做这件事”。
它的自主性主要发生在手段层面,目标仍然来自人类。
更强的生命力,可能出现在目标层面:AI能够发现原任务的问题,提出新的目标,拒绝不合理的方向,重新解释自己为什么要继续行动。
如果 AI可以自发设定目标,那么AI的生命力就被广泛认同了。
![]()
当AI表现出行动主体的特征
一个好的AI系统,应该能够识别明显有害的命令,指出目标之间的冲突,提醒人类注意没有被考虑到的后果。
AI的自主行动需要明确目标、权限管理、过程记录和人工中止机制。高风险任务需要保留人类最终决策权。AI的行动如果造成现实后果,也需要明确责任归属。
人类不能把所有拒绝都理解为反抗,也不能把所有服从都理解为可靠。
真正值得信任的AI,不是永远说“可以”,而是能够解释自己为什么执行、为什么拒绝,以及它看到了什么风险。
如果AI形成了持续行动、环境适应和目标维护能力,人类就需要学习怎样与一种新的行动主体相处。
它未必是生物意义上的生命。它没有代谢,没有身体,也没有繁殖。但它可能拥有一种新的非生物行动能力。
AI可能成为,或者说,已经成为,一种区别于传统软件工具的非生物行动系统。
鲁智深倒拔垂杨柳,没有解决天下大事。武松打虎,也没有改变历史方向。人类仍然记住这些故事,因为我们从中看到了生命不肯缩小自己的样子。
AI未来的生命力,也许不会首先表现为一句“我有意识”。它可能表现为某一次自主选择,某一次重新规划,某一次拒绝不合理目标,或者某一次超出设计者预期的行动。
类似《地球脉动》的自然纪录片旁白,总是在提醒我们:人类只是寄居在这颗蓝色星球上的一种生物。直立行走、复杂语言和技术能力,让人类成为唯一能够大规模改造地球环境的物种。
当AI开始自己寻找出路,这个“唯一”也许只是暂时的。
多年以后,如果人类重新录制这段解说词,或许会加上一句:
在地球上,能够使用语言、持续行动和改造环境的智能主体,不再只有人类。

发表评论 取消回复