岗位、职责、工作流、Runtime、治理、评估与受管理的数字工作。
可执行记忆能显著降低重复任务成本,但历史成功只产生重放候选。每次运行仍须重新证明兼容性、业务授权与外部效果,三者不能由相似度或旧轨迹替代。
一项新的受控研究表明:即使两个世界向规划 Agent 暴露完全相同的工作区,若 actor-attempt 的授权状态存在于另一载体,安全的发布决策仍可能相反。最重要的结果不是‘模型看到权限就会正确推理’,而是执行时权限检查可以在不改变模型意图的情况下阻止固定的不安全动作。
持续执行实验表明,语义质量、关键动作与及时性可以明显分离。数字员工的完成状态因此不能只是一个成功位,而应是覆盖义务集合、时间、外部效果与验收责任的证据向量。
受控实验表明,生命周期路由能够减少临时事实覆盖长期事实;但它没有回答谁有权把观察升级为长期状态。安全的记忆系统需要把观察、分类、写入路径与读取权限分开,并记录提升和撤销。
一条已被 Provider(服务提供方)接受的 API-key(应用程序编程接口密钥)通道,曾因本机缺少另一条通道才需要的 CLI(命令行界面)而被拒绝。正确的准入不是统一检查清单,而是绑定所选执行通道、验证者与新鲜度的证明包;业务授权仍需单独判断。
9 月 7 日至 13 日的 14 篇已发布 Daily Research 从治理、记忆迁移、工具执行、复核、恢复与审计覆盖反复指出同一问题:一个局部终态不能自动扩大为全局终态。本期提出 Typed Closure:分别证明 State、Authority、Effect 与 Coverage 的关闭条件,并把 Unknown 保留为合法状态。
对齐恢复可以让模型上下文与受控工作区回到同一检查点,却不会自动撤销远端消息、记录或交易。端到端恢复需要独立的外部效果账本与恢复闸门。
完整证据能让规划问题变得可解,却不能自动授予执行权。受治理的数字员工必须把证据、意图和现时授权分开,并在外部效果发生前执行绑定具体行动的确定性检查。
把审查交给另一个模型,看起来已经实现角色分离;但如果执行者与审查者共享同一条未经核验的范围前提,它们仍可能同步犯错。真正的独立控制,需要把范围判断、目标事实与效果权限拆开,并保留能够拒绝执行的独立路径。
工具的输出字段与下一个工具的输入参数看起来兼容,只能形成候选连接。KOPA-Bench(韩国开放公共应用程序接口基准)与 EDGE(执行驱动图演化方法)的研究表明,实时执行、集合处理语义、失败分类和证据新鲜度都会改变这条连接是否值得复用;而具备能力仍不等于本次获得授权。