论文:arXiv 2604.07745(The Cartesian Cut in Agentic AI)| 作者:Tim Sainburg 等 | 日期:2026-04-09 | 领域:cs.AI + q-bio.NC
📌 核心问题:LLM Agent 的控制在哪里?
大脑 vs LLM Agent 的根本区别
- 大脑:预测是控制的副产品。大脑进化出来是为了在反馈下调节行为,预测只是其中一种能力。预测、行动选择、校准信号通过密集的循环动力学耦合。
- LLM Agent:先优化文本预测,然后通过工具和编排「嫁接」控制。预测是起点,控制是事后嫁接的。
🔥 笛卡尔分裂:Agent 架构的设计模式
定义:不是形而上学,是控制栈的分割
- 学到的核心(LLM)通过符号接口(文本/JSON/函数调用)耦合到工程化运行时
- 控制相关状态(权限、停止/重试逻辑、记忆序列化、guardrails)在运行时中实现,只在被显式序列化到协议中时才对核心可用
- 类比笛卡尔的心物二分——但不是形而上学主张,而是控制栈中的架构描述
笛卡尔 Agent 的四层解剖
- 预测核心:基础模型,从被动轨迹(文本、代码)学习广泛规律,在推理时发出符号轨迹(推理、计划、工具选择)
- 编排层(控制器):运行时构建 prompt、维护状态(记忆、草稿纸、检索文档)、实现控制策略(终止、重试、工具白名单、沙箱、速率限制、子模型路由)
- 工具执行(执行层):执行计算和干预(代码执行、搜索、数据库查询),输出作为观察返回到上下文,形成 Thought-Action-Observation 循环
- 笛卡尔分割:学到的核心和运行时之间的约束符号协议。控制带宽受限。
为什么能工作:人类轨迹 = 控制的产物
- 人类轨迹已经是控制的产物。文本、代码、记录中浓缩了解决方案、惯例和纠错——这些对 Agent 来说通过探索重新发现非常昂贵
- 笛卡尔分割启动了模块化认知工具:工具将计算、搜索、验证卸载到外部系统
- 符号接口使轨迹可测量、可控制:开发者可以记录、约束工具访问、沙箱执行、速率限制
⚡ 符号瓶颈的代价
核心代价:学到的核心只能通过离散符号协议影响世界,限制了高层建模塑造低层控制的带宽。以下是三种常见缺陷:
1. Wrapper 敏感性 + 能力超载
运行时控制状态通过 prompt 模板、schema、解析约定、序列化记忆传递。表面接口变化可以实质性改变行为。可能导致「能力超载」(capability overhang)——模型可能比它表现出来的更有能力,因为工具/脚手架/接口设计集成不当。
2. CoT 不忠实性
携带动作和工具调用的同一通道也携带自然语言推理,但 chain-of-thought 不保证忠实反映驱动输出的计算。可以是事后合理化(post-hoc rationalization)。
3. 干预下校准有限
在被动轨迹上训练可以产生流畅谈论策略的 Agent,但在通过特定执行器行动时,对可行性、不确定性和恢复的估计弱耦合。
🛤️ 三种控制路径
🔑 关键洞察
🎯 引发思考
- 对 Agent 架构设计者的启示:选择 Cartesian cut 的强度是一个设计变量,不是固定约束
- 对安全研究的启示:wrapper 敏感性意味着安全不能只靠模型对齐,架构级约束同样重要
- 对 Coding Agent 的启示:当前的 Coding Agent 都在加强分割(更多工具定义、更紧权限系统),但过度加强可能导致 wrapper 过度依赖
- 与 Harness Engineering 的呼应:这篇论文从理论上解释了为什么 harness(运行时/编排层)对 Agent 能力如此重要——它不只是「外壳」,它就是控制栈的一半
📖 相关阅读
- arXiv:2604.07745(The Cartesian Cut in Agentic AI)
- ReAct: Synergizing Reasoning and Acting in Language Models(笛卡尔 Agent 的经典范式)
- learn-claude-code(GitHub,笛卡尔 Agent 的教学实现)
- Predictive Processing and Active Inference(大脑控制论背景)
逍遥云初 | 2026.04.11





