外观
《模拟人生 4》单体角色决策:高阶设计拆解
目标读者:游戏设计师、交互设计师、叙事设计师
最终用途:为“2D 单房间 + 一个有眼睛、有手、会思考且可被人干预的 Agent”提炼一个能持续运行的最小设计骨架
研究对象:以《模拟人生 4》为主;《模拟人生 3》与开源项目只用于解释谱系或补足公开资料缺口
资料截止:2026-08-27
当前版本:v1.0,四轮专家终审通过
先说结论
《模拟人生 4》的单体角色不是先规划一天,再把计划逐步执行。
更接近事实的高阶模型是:
text
身体需要、性格、情绪、关系、场景规则
+
物体此刻提供的可用交互
↓
过滤不能做的候选行为
↓
给可做的行为计算吸引力
↓
从高分候选中带随机地选一个
↓
放入队列,解决位置、姿态、手持与路径
↓
执行并改变角色与世界
↓
下一轮重新评估1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
2
3
4
5
6
7
8
9
10
11
12
13
14
15
因此,本研究不会把行为树、状态机、效用系统和目标规划器混成一个“大脑”。它们回答的是不同问题:
| 设计问题 | 《模拟人生 4》的主要答案 |
|---|---|
| 下一件想做什么? | 效用评分 + 高分候选中的加权随机 |
| 这件事现在能不能做? | 交互测试、场景规则、物体状态与身体约束 |
| 玩家命令和自主行为谁优先? | 有优先级的交互队列;玩家指令通常高于自主行为 |
| 怎样走过去、坐下、腾出手再执行? | 约束驱动的转场图搜索 |
| 行为内部怎样推进? | 多状态交互及其子行为,可与兼容交互并行 |
| 今天和未来要做什么? | 角色自身几乎不做长期计划;日程、场景和宏观故事系统从外部施加结构 |
最值得继承的不是某一种算法,而是五层之间的边界:
text
状态 → 候选 → 选择 → 执行 → 反馈1
只要其中任何一层缺失,Agent 就可能“想得合理但做不到”、做完却不改变自己,或者每轮都重新发明目标。
文档目录
本拆解只保留用户要求的三块主体,再增加研究地图、落地收束和验证矩阵。验证矩阵不是新的心智模块,只负责证明前三块真的闭环。
00. 研究地图与证据边界
- 开发者演讲、官方资料、Wiki/模组资料、源码与复刻项目分别能证明什么;
- 哪些结论是《模拟人生 4》的已知设计,哪些只是反向工程,哪些是本项目建议;
- 《模拟人生 3》资料为什么只能作为谱系证据;
- 术语与可信度分级。
01. Agent 依赖的参数
- 初始或慢变参数:身份、生命阶段、性格、偏好、能力、社会位置;
- 动态参数:需要、情绪、Buff、关系、短期语境、当前交互、承诺与冷却;
- 观察到的参数:物体所提供的交互、事件广播、空间/身体可行性、他人和玩家输入;
- 记忆为何不是一个数据库,而是分散在多种状态中的“行为后效”;
- 需求、情绪、目标与文化规则如何避免相互重复。
02. Tick、决策轮与一天
- 快速模拟 Tick:时间、身体数值、动作阶段与事件如何继续推进;
- 自主决策轮:何时重新选择,如何从候选到入队;
- 交互完成轮:预期收益与真实结果怎样反馈;
- 一天:为什么《模拟人生 4》没有真正的“每日计划”,日程从哪里来;
- 低精度角色与社区宏观变化;
- 主要正反馈、负反馈、延迟与失控方式。
03. 行为、颗粒度与执行结构
- 物体、交互、子行为与身体动作四个颗粒度;
- 效用系统、队列、层级状态机、约束图和场景规则各自负责什么;
- 多任务怎样通过“约束是否有交集”而不是自由并行来成立;
- 行为的开始条件、资源占用、持续、打断、失败、结果与冷却;
- 为什么“想拿杯子”不能等于“杯子已被拿起”。
04. 转译为最小单房间 Agent
- 哪些机制直接继承,哪些必须补上,哪些应暂时舍弃;
- 三层时间循环、三层记忆、四层行为颗粒度;
- 眼睛、手、人类干预与大模型的明确边界;
- 一个最小闭环如何从“看到杯子”运行到“实际拿起或明确失败”;
- 验收 Agent 是否真的“活起来”的观察指标。
05. 运行契约与验证矩阵
- Safety、Needs、控制权、Interaction、承诺、记忆与慢推理的进入 / 退出契约;
- 世界真值 Tests 与认识空间 Tests 的边界;
- 可重复的故障注入、反事实、长期运行与玩家可读性测试;
- v0 垂直切片的明确复杂度上限。
专家审阅记录
- 游戏设计、控制论、人类学、心理学四种视角的独立严苛审阅;
- 每轮问题、修改与复核结论;
- 只记录会改变系统可运行性或设计含义的意见。
第一轮记录:reviews/round-01.md
为什么最终这样拆
最初可以按“需求、情绪、记忆、规划、行为树”等名词分别写章,但那样很容易得到一堆相互独立的功能清单,看不见系统怎样闭环。
资料核验后,目录改为三个连续问题:
- 角色拿什么信息作决定?
- 这些信息在什么时间点被更新和使用?
- 一个决定怎样变成可执行、可失败的行为?
目标、记忆、情绪和心理学模型不再各自成为孤岛,而是被放回它们真正影响循环的位置。最后一章再把《模拟人生 4》的已知边界转译到单房间研究项目。
第一轮专家审阅后只新增一份验证矩阵。原因不是继续扩张模块,而是四种视角一致指出:如果没有可判定的不变量、状态转换和故障场景,“循环闭合”仍只能靠作者自我感觉。
阅读时必须保留的三个边界
事实、反向工程与建议不是一回事
正文使用三种标签:
- 已证实:官方演讲、官方文档或开发者直接说明;
- 高可信重建:模组文档、公开 Tuning、调用栈与多个来源互相印证;
- 本项目建议:为了单房间 Agent 补上的设计,不声称《模拟人生 4》已经这样做。
涉及心理学、人类学和待调参数时,再使用四个机制标签:
- 研究支持的约束:资料足以说明不能忽略的边界;
- 理论启发:借用一个解释视角,不声称理论给出具体算法;
- 游戏实现假设:为了可玩与可调而主动规定的机制;
- 待实验调参:数值、阈值和容量只是假设起点,必须通过验证矩阵调整。
“规划”有三种含义
- 选下一件事;
- 为已选行为生成身体转场步骤;
- 安排未来多个目标。
《模拟人生 4》强在前两种,对第三种有意保持克制。若不分开,就会错误地把转场图搜索称为“人生规划”。
这不是人类心智的科学复刻
需求、情绪、性格与文化规则都是为了产生可读、可调、可玩的行为。心理学与人类学理论在这里是设计透镜,不是对所有人的普遍诊断。尤其不能把马斯洛金字塔当作不可违背的固定优先级,也不能把少数情绪标签当作跨文化的人类本质。
一句话设计原则
让角色在有限信息下选择一个可解释的短期意图,让身体系统诚实地执行或失败,再让真实结果改变下一次选择。