代表受控自主执行的 Perslis 机器狼

运行时 · YOLO 模式

把方向盘交给它——安全地交。

对整个循环的完全自主,被一个让最坏情况都变得无聊的沙箱所约束。

摘要

自主与安全通常被当作一种取舍来兜售:你给智能体的自由越多,它能造成的破坏就越大。Perslis 拒绝这种取舍。YOLO 模式让运行时驱动整个循环——规划、构建、验证、交付——无需停下来征询,同时它采取的每一个动作都被一个默认拒绝的沙箱所限制。自由体现在决策层面;影响范围则被固定在权限层面。结果就是你真正敢开启的速度,因为它最坏也只能做出毫无危险的事。

为什么"就让它跑"通常让人心惊胆战

大多数自主智能体之所以吓人,是有充分理由的:它们以操作者的全部权限运行。一次自信的错误动作就能删除文件、打到生产环境,或泄露密钥——而没人在盯着。于是团队要么照看每一个动作(也就失去了自主的意义),要么干脆关掉它。两者都不是真正的答案。

Perslis 的答案是把两件被纠缠在一起的事分开:它能自行决定多少它被允许触碰多少。把前者调到最大;把后者牢牢锁死。

一条命令 → 完全自主 规划 · 构建 · 验证 · 交付,无需询问
沙箱——默认拒绝的主机控制
仅限已授权的路径仅限已授权的命令"完成"之前的验证门

图 1 —— 自主在上,约束在下。循环自由运行;沙箱固定影响范围。

完全自主——一条命令,全程搞定

告诉 Perslis 去做,它就端到端地驱动:它规划工作、执行它、验证结果,并交付——不在每一步弹出审批提示,无需照看。对于漫长或重复的任务,这就是"一个你要监督的工具"与"一个直接把事办成的运行时"之间的区别。

设计上就失败即关闭

自主被强制置入一个沙箱——它并非可以退出的选项。主机控制默认拒绝:Perslis 只能触碰它被明确授权的路径、运行它被明确授权的命令,且被归类为可逆性的动作会在执行前经过检查。如果某项权限没有被授予,那个动作根本无法发生。"失败即关闭"意味着面对任何不确定时,默认答案是,而不是是。

自由在于决策。限制在于权限。把一个调高,并不会把另一个调低。

交付前先证明

如果跳过检查,速度就毫无价值。即便在自动驾驶下,工作在 Perslis 判定完成之前,也必须通过与其他一切相同的验证门——测试要运行、不变量要成立、证据要被封存。YOLO 模式去掉的是询问,而不是证明。你获得自主的吞吐量,却不会降低"何为完成"的标准。

何时把方向盘交出去

YOLO 并非唯一的模式——它是一个刻度盘的最远端。早期你紧盯着看;随着信任建立、沙箱被恰当地限定范围,你就让更多东西无人值守地运行。因为安全底线不会随自主上升而移动,你可以恰好按照信心增长的速度把速度调高——但绝不快于权限所允许的程度。