外观
04. 大模型与短长期决策
本章回答什么
大模型负责理解意义、比较接近的选择、提出粗计划和生成语言;它不控制 Tick,不修改世界真值,也不把“打算做”变成“已经做到”。
一句话边界:
大模型提出带依据的建议;主控制循环检查、提交;身体与世界给出结果。
一、什么时候值得调用大模型
| 情境 | 是否需要大模型 |
|---|---|
| 走路、看向、伸手、抓取、等待推进 | 不需要 |
| 硬安全、暂停、技能超时 | 不需要,规则直接处理 |
| 明确身体缺口且只有一个可用调节行为 | 通常不需要 |
| 多个合法候选之间存在角色、关系或情境冲突 | 需要 |
| 新奇社会事件的意义 | 需要 |
| 把阶段意图拆成少量任务 | 需要 |
| 对话措辞与协商 | 需要 |
| 反思和长期目标更新 | 需要,但低频 |
| 重复普通事件 | 不需要 |
二、一次决策能看到什么
每次只提供与这个问题有关的八类信息:
- 稳定身份:角色、性格倾向、价值、能力和长期承诺;
- 当前状态摘要:明显身体缺口、愉快度/唤醒度、当前注意;
- 当前承诺:意图、进度、最短承诺、恢复点和已失败方法;
- 本轮观察:Agent 真正看到、听到或触到的事件及其来源;
- 相关经历:少量原始证据、当前认识、反思假设和至少一条反证;
- 主观候选集:来自固定七类来源、带编号的行为候选;
- 表达情境:当前受众、双方角色、所在区域、公开/私密场合,以及已激活的情境规则编号;
- 决策契约:本次只回答的问题、可用输出类型、相关对象/目标版本和截止时间。
大模型看不到 Agent 未感知的世界真值,也不能因为后台知道内心声音来源就让 Agent 知道。
三、候选与大模型怎样分工
候选系统先提供:
- 继续当前承诺;
- 调节身体;
- 推进长期目标/承诺/义务;
- 实行生活实践;
- 处理当前观察;
- 回应或拒绝人类;
- 探索、恢复或等待。
系统先计算身体缺口、时间成本、风险、切换代价和明显目标进展。大模型只处理较难计算的部分:
- 这个候选是否符合角色与当前场合;
- 某个物品或关系是否有特殊意义;
- 两个承诺冲突时哪个更应优先;
- 某句话是请求、威胁、玩笑还是含糊主张;
- 某次失败是否值得换方法或调整阶段目标。
稳定系统直接选择吸引力明显领先的候选。大模型只会收到差距小于 0.15 的近似并列组,也只能在该组中选择,不能越权改选明显落后的候选。
大模型可以在每轮最多提出一个“新用途/新组合”,但只能引用已知对象和已有技能,由行为系统尝试编译;不能直接创造未注册动作。
四、一次大模型输出必须是什么
输出不是散文,而是受限建议:
| 决策类型 | 允许输出 |
|---|---|
| 候选选择 | 近似并列组中的一个候选编号,或明确等待/拒绝/无可行项 |
| 意图处理 | 继续、暂停、恢复、替换、放弃 |
| 近期计划 | 最多五个已有任务模板及目标对象 |
| 事件评价 | 目标影响、原因归属、可控性、确定性、威胁的结构化建议 |
| 对话 | 已选态度、话语、继续或结束互动,并引用适用的受众/场合规则 |
| 反思 | 假设、原始证据编号、反证编号、置信度与未来影响 |
| 新组合 | 目标结果、已知对象、已有技能和需验证条件 |
解释文字只用于人类阅读,不具有修改状态的权力。对象、行为、目标和完成条件必须引用系统已经注册的编号。
表达类请求若没有匹配的场合或关系规则,采用中性、简短表达,不允许模型自行补出国族、阶层或性别刻板风格。
五、输出怎样被接受
text
主循环冻结相关状态
→ 发出一个决策请求
→ 大模型返回受限建议
→ 检查格式、引用和候选是否合法
→ 检查它依赖的目标、对象和认识是否仍是同一版本
→ 重新检查安全与当前主观条件
→ 在 Tick 边界一次性提交
→ 身体执行并等待世界结果1
2
3
4
5
6
7
8
2
3
4
5
6
7
8
格式错误只允许修复一次;仍然错误、超时或引用不存在对象,就采用确定性回退。
同一个请求最多提交一次。停止、重置或紧急抢占会取消旧请求。无关状态变化不会让答案永久过期,只有它真正依赖的关键内容变化才作废。
六、短期决策
短期决策处理现在到未来几分钟,发生在认知轮。
固定问题顺序
- 当前技能还能否安全继续;
- 新事件是否值得打断当前承诺;
- 若打断,是简短回应、暂停还是彻底替换;
- 当前任务完成后下一任务是什么;
- 信息不足时是否先观察;
- 哪个结果点需要再次认知。
合法结果
- 继续;
- 回应后恢复;
- 暂停并保存进度;
- 换方法或换任务;
- 放弃;
- 观察/等待;
- 求助;
- 接受、拒绝、协商、延后或结束人类互动。
短期决策不能更新核心人格,也不能发明新的世界事实。
七、长期决策
长期决策发生在慢整合循环或重大人生事件之后,处理数天以上的方向。
可以改变
- 增加、暂停或结束一个长期承诺;
- 调整目标的投入程度;
- 形成新的阶段意图;
- 更新对物、人、区域和实践的认识;
- 改变下一阶段的粗时间分配。
不应轻易改变
- 核心身份、身体能力和已确认经历;
- 因一天心情重写价值;
- 因一次对话把人永久视为绝对可信或敌对;
- 没有世界结果就宣称目标完成。
证据门槛
- 普通长期更新默认需要至少三段相互独立的经历;
- 一次重大事件可以建立低置信假设,但不能独自重写核心人格;
- 每次反思必须保存支持和反对证据;
- 没有新证据时重复反思,不继续放大结论;
- 每次慢整合只调整少量目标,已有承诺具有惯性。
长期目标如果长期无法产生近期任务,应被暂停、重新解释或结束,而不是只保留一段漂亮文字。
八、记忆怎样进入决策
经历
记录真正观察和行动结果,带来源、时间和事件编号。
当前认识
记录 Agent 暂时相信什么,并链接支持与反对证据。
反思
只是带置信度的假设,不能成为自己的证据,也不能把同源摘要当成多次独立经历。
检索时只取与当前人物、对象、目标和事件有关的少量材料。长期关系或人格更新必须主动寻找反证,避免记忆回声。
九、事件评价和学习怎样避免重复计算
一个结果可以有多个有证据的贡献因素,例如技能、物品状态、布局、人类动作与未知原因。防止重复的规则是“同一事件对同一学习领域只更新一次”,不是强迫事件只有一个原因:
- 抓取动作本身失败,才更新对应抓取情境的技能信心;
- 抽屉卡住,更新对象/工具认识,不降低全局自信;
- 人类强行拿走物体,更新外部行为与关系边界,不把它当成 Agent 主动放弃;
- 对方承诺被验证,才更新相应领域的可靠程度;
- 重复同一句未验证主张不增加信任。
例如“有裂纹的杯柄 + 人类碰撞 + 抓握动作”可以同时更新杯子状态认识、人的外部行为记录和抓取技能信心;但技能信心只有在观察到技能本身确有贡献时才改变。
事件评价、情绪变化、信心、对象认识和关系学习都使用同一事件编号,在各自领域最多应用一次。
十、人类干预契约
四种通道不仅来源不同,权力也不同。
本项目是受控研究沙盒。每个试次在开始前声明:开放哪些通道、允许操作哪些对象、每种干预的次数/速率、试次时长和观察指标。物理无限拖动只属于独立调试模式,不能进入正式试次结果。
物理干预
- 人可以移动或拿取允许交互的房间对象;
- 正式试次只允许操作协议声明的对象与次数,每次移动都有事件编号;
- Agent 只有在可见、可听或操作失败后才知道;
- 若能看见来源,记录为这个人的外部行为;否则保持未知归因;
- 物理强制不会被写成 Agent 自愿合作。
房内对话
- 一次输入被标记为主张、请求、建议或普通表达;
- 请求形成一个有编号的待处理事项;
- Agent 可以接受、拒绝、协商、延后或结束;
- 已拒绝的同一请求不会因重复措辞而自动更有吸引力;
- 接受后形成的承诺会被保存,直到完成、协商取消或明确放弃。
内心声音
- Agent 感知到的是一种想法或声音,不自动知道后台来源;
- 它最多提高一个候选的显著性,不能直接写入事实、核心身份或长期目标;
- MVP 默认同一未解决主题每
10模拟分钟最多进入一次普通认知轮; - Agent 可把这个声音/主题设为需要每次确认、静音或阻止;
- 反复越界首先更新“对此声音/通道”的边界;只有 Agent 获得可感知的归因证据后,才更新它与真实人类的关系;
- 因此后台来源不会通过关系变化泄漏给 Agent,内心声音也不是精神控制捷径。
系统控制
- 白名单只有暂停、安全停止、保存与恢复等管理能力;
- 安全冻结不改变 Agent 记忆和关系;
- 重置、回滚和记忆修改必须先快照并写审计日志;
- 管理行为不被伪装成 Agent 自己的选择。
给人类的反馈
界面明确显示:
- Agent 是否感知到了;
- 正在考虑、接受、拒绝、协商还是延后;
- 决定的简短原因;
- 行为是否真正成功;
- 当前通道是否被静音或限流。
干预不保证服从,但保证可看到它进入了哪条因果链。
十一、确定性回退
大模型不可用时:
- 安全则继续当前行为到可暂停点;
- 紧迫身体缺口选择最高紧迫且主观可用的调节行为;
- 有已承诺任务则恢复其下一任务;
- 其他情况进入观察或短暂等待;
- 多次失败后转入降级状态,不持续请求模型。
十二、决策反馈闭环
text
候选与模型建议
→ 主循环验证并提交
→ 身体执行
→ 世界返回进度、成功或失败
→ 更新身体、认识、目标、关系和记忆
→ 新结果影响下一次短期选择
→ 多轮证据影响长期反思1
2
3
4
5
6
7
2
3
4
5
6
7
正反馈必须有上限:成功只小幅提高具体方法的信心;疲劳、边际收益和其他承诺会制衡持续投入。
负反馈负责纠偏:失败降低当前方法吸引力,触发重新观察、换方法、求助、降级或放弃。
十三、AI 小镇提供了什么,单房间怎样调整
AI 小镇让大模型参考身份、计划、观察和相关记忆,输出日程、任务分解、地点、对话和反思。
单房间项目继承“有限背景回答有限问题”,并增加:
- 候选来自固定来源,而不是大模型自由发明;
- 主观候选与物理结果分开;
- 短期意图与长期承诺正式区分;
- 模型建议有版本、截止时间和唯一提交;
- 人类请求始终保留拒绝和协商;
- 反思保留原始证据与反证;
- 所有成功和失败都回到下一次选择。
本章的设计检查
每次大模型调用都应能回答:
- 为什么现在必须调用;
- 它能看到什么、不能看到什么;
- 本次只回答哪个问题;
- 候选和对象编号来自哪里;
- 输出是选择、计划、话语、评价还是反思;
- 哪些相关变化会让答案过期;
- 谁检查并一次性提交;
- 谁确认行动完成;
- 出错、超时和重复回答时采用什么回退;
- 结果如何影响下一次短期或长期决策。