外观
第二轮专家复核:冻结版 v0.2
审阅对象:吸收第一轮 R1—R14 后的全部文档与新增
05-validation.md
结果:控制论BLOCKED;游戏设计、人类学、心理学均CONDITIONAL
已被四方确认的实质改善
- Safety、认识空间 Test、权威世界 Test、串行决策、LLM 版本/TTL 已进入运行链;
- v0 删除通用并发、左右手与通用 GOAP,第一轮资源死锁不再可构造;
- Queue 有版本、预约、提交、部分 Outcome、幂等、watchdog 和唯一对象父级;
- 承诺有生命周期、prospective cues 与跨意图失败预算;
- Utility 有 Tier、切换滞回、pending effect 和预期学习;
- 记忆有 event ID、容量、来源、反证和幂等压缩;
- RelationalContext、SituatedScript、ObjectSocialState、SocialActFrame 已进入候选、Appraisal、Outcome 和记忆;
- 逐 Tick 不变量、长期运行、故障注入、反事实和玩家盲测让文档跨过了“架构愿望”阶段。
第二轮残留合并项
S2-1 · 最坏情况可调度
Safety 不能只在致害前把动作入队,而要在致害前进入安全集合或完成有效保护。每个阶段需最坏执行时间、最坏中断延迟、清理时长;非 Safety 阶段开始前检查 Safety 与身体服务截止期是否容得下。
S2-2 · 受保护 Failure Recovery
V19 只有测试,没有确定取得控制权的恢复模式。需 FAILURE_RECOVERY,有触发、受保护候选、最大驻留、成功/不可控/终止出口,恢复失败不能递归恢复。
S2-3 · 冻结 v0-reference-profile
所有“有限、少量、上界、更可能、长期”需绑定数值。先用 calibration seeds 调参,冻结配置与种子生成 hash,再用不可更改 holdout seeds 和最坏轨迹验收。
S2-4 · LLM 权限与 Gate 一致
选择保留 LLM 在枚举的合法 Appraisal/Intent IDs 中提案。不同模型可产生不同合法高层轨迹;必须相同的是事实、证据、Tier、Tests、Safety、权限、允许转换与确定性 Reducer。V04 分成无模型延迟 stub 与真实模型复核。
S2-5 · 因果 episode 与总增益预算
event ID 不代表独立证据。增加 causal_episode_id / evidence_cluster_id;慢状态更新按独立证据 cluster 聚合,事件拆成 1/20 个动画片段不能放大。冻结 Event → State 因果 DAG、允许的 Utility 入口和 episode 总增益预算。
S2-6 · pending effect 的保守下界
pending effect 保存成功置信度、预计完成、版本和失效条件;服务控制只计保守恢复下界。若预计完成晚于截止期,提前取消/替代/判不可控。
S2-7 · 失败预算不能随时间自动重新武装
时间窗只归并事件;重新尝试必须有对象/前提版本变化、独立新证据或显式重议。V10 延长七日。
S2-8 · 承诺集合联合可调度
准入检查整个 accepted set 的最坏剩余成本、截止窗口、不可抢占段和 Safety/身体保留预算;不能逐项可行却整体必然失约。
S2-9 · Agent Memory 与 Audit Log 分离
外部审计日志可完整重放但不可被 Agent 检索。Agent 的 pin 有上限/TTL;长期摘要保存有界证据凭证,原事件淘汰时迁移、降置信或失效,不能悬空也不能无界 pin。
S2-10 · Safety 感知权限与 UI 来源
可感知危险由 Agent 信念触发;产品 Safety 可读权威风险,但 decision_owner=Safety,只保护身体,不把原因写入 Agent 认识。UI 字段标来源:Agent belief、公开世界、Lab-only overlay。盲测分 behavior-only 与 minimal-UI。
S2-11 · Coexistence 与 Lab 分会话
正常共处模式关闭 Operator Lease,只允许有限紧急辅助;Lab 可无限直控但不进入核心体验/人格盲测。Tier 1 拥有受保护身体服务窗口。
S2-12 · 十分钟黄金会话与有意义 Beat
新增关闭直控的 V00,固定项目意图、非恶意不确定阻碍、三种合理干预与十分钟内持久后果;用发现、推进、改变、调节、协商或有代价放弃定义 beat,不以 Idle 稀释分母。
S2-13 · v0 心理范围
保留两个固定参考 Trait/Value 身份与最小 Affect;SDT Experience 和 impulse 推迟到黄金切片后,不作为 v0 Gate。补人格效应量与 Appraisal 时序;Skill、Self-efficacy、Competence Experience 分开。
S2-14 · Trust / Relationship 所有权
Trust 只含领域化信息可靠性、承诺兑现、善意/安全预期;温暖只属于 Relationship。Trust Context/领域使用冻结词表和层级回退,V13 从中性状态经事件历史学出并测试反转。
S2-15 · 脚本冲突、社会框架与权威生命周期
- 脚本匹配返回全部有序证据集合,冲突生成
NormConflict; - SocialActFrame 使用
PROPOSED → ACKNOWLEDGED → ACCEPTED/REJECTED/COUNTERFRAMED/CONTESTED → SETTLED/REVOKED; - 权利执行状态、各方 rights claims 与 Agent belief 分开;
- Authority 保存主张者、依据、承认者、范围、期限/撤销和争议;Consent 区分 endorsed、assented、pressure compliance、refused、unknown。
S2-16 · 边界与社会争议长期保留
v0 实现 material 与 informational BoundaryState,空间/身体隐私明确推迟。未决权利/义务/框架保存有上限的 dispute receipt,经过环形账本与压缩仍不被擅自解决。
S2-17 · Appraisal、注意、Habit 与能力的可分测试
- Appraisal 有 onset、last evidence、active/resolved、decay、sustaining condition;
- 注意负荷由 Interaction、缓冲、语言和切换成本派生,不直接写
high;impulse 推迟; - Habit 用 cue 稳定 × Habit on/off 因子实验,排除预期学习;
- Objective Skill 只因练习/学习 Outcome 改变,表现失败只改证据与 Self-efficacy;
- 承诺错过的社会后效读取 control、controllability、notice、renegotiation 与 agency。
第三轮目标
完成 S2-1—S2-17 后,四位必须重新运行自己的所有第一、二轮反例。只有四方均 APPROVE_AND_EXCITED 才结束审阅;CONDITIONAL 仍视为未完成。