外观
01. Agent 依赖的参数
本章回答什么
一个角色在决定“下一件做什么”时,到底依赖哪些信息?
为了避免把所有东西都叫作“记忆”或“人格”,本章只分三类:
- 初始或慢变参数:角色长期是谁;
- 动态参数:角色此刻怎样;
- 观察到的参数:角色现在面对什么机会与限制。
三者的关系是:
text
同一个房间、同一组物体
+
不同的角色倾向与能力
+
不同的当下需要、情绪与社会语境
↓
得到不同的候选、分数与行为结果1
2
3
4
5
6
7
2
3
4
5
6
7
《模拟人生 4》的“个性”不是一段人物小传直接控制动作,而是许多小参数在候选生成、测试、评分、表现和结果等位置共同施加影响。S03 S09
一、先分清三种数据形态
不是所有参数都适合做成数值条。
| 数据形态 | 适合表达 | 例子 | 不适合表达 |
|---|---|---|---|
| 连续数值 | 会逐渐变化、需要比较程度的量 | 精力、饥饿、关系强度、技能熟练度 | “正在拜访别人家” |
| 标签 / 状态 | 有或没有、处于哪一种上下文 | 素食、访客、正在生气、右手被占用 | 一段经历的来龙去脉 |
| 记录 | 有对象、来源、时间和因果的事实 | 对谁有负面 Sentiment、谁发出了请求、动作为何失败 | 每 Tick 都要快速衰减的身体量 |
一个常见的设计错误,是为了统一而把所有信息都做成 0—100 数值。结果是“访客身份 73”“正在拿杯子 42”这类没有清楚含义的参数,既难调也难解释。
《模拟人生 4》混合使用统计值、Traits、Buffs、关系记录、物体状态、交互实例与 Situation Role。高阶上,这种异质性是优点:不同信息在不同环节发挥作用。S12
同一事件只能由一个“状态归约器”写入
第一轮专家审阅指出,仅仅把变量分开还不够。同一次“人类兑现承诺”如果分别由 Connection、Relatedness、Trust、Valence、关系温暖和承诺系统各自监听并加分,随后这些派生量又同时进入 Utility,就会被重复计算六次。
游戏实现假设:所有可改变心理与社会状态的事件先进入一个唯一归约入口:
text
真实 Outcome / 合法观察
→ 事件分类与因果归属
→ 只更新预先声明的直接状态
→ 派生显示量只读取,不再次回写1
2
3
4
2
3
4
event_id 只表示一条记录,不表示独立证据。一次履约可能包含接近、递物、松手、对方接收和一句“完成了”。它们共享同一个 causal_episode_id;同一 Outcome 的重复采样或转述共享 evidence_cluster_id。慢状态的单次增益上限按独立证据 cluster 计算,把同一动画拆成 1 条或 20 条事件不会放大 Trust、Habit、Self-efficacy 或关系变化。
v0 还冻结一张 Event → State 因果 DAG:每类 episode 声明哪些字段是直接更新、哪些是派生、哪些可以进入哪类候选。祖先与后代不能同时以满额再次贡献;一个 episode 若确实影响多个维度,也受 episode-level 总增益预算约束。
第一版使用下面的数据字典:
| 状态 | 表达什么 | 不表达什么 |
|---|---|---|
| Fast Regulator | 当前身体或环境调节缺口 | 人格、关系好坏 |
| Core Affect | 短时愉快度与激活度 | 事件原因、道德判断 |
| Appraisal Episode | 此事件对目标、控制、责任和规范的意义 | 世界真相本身 |
| Skill | 世界支持的实际能力 | “我觉得自己行不行” |
| Self-efficacy | 对特定行动成功率的认识 | 全局自尊、Trait |
| SDT Experience | 一段时间内自主、胜任、关系体验的概括 | 每分钟必须补满的 Need |
| Trust Belief | 对特定人、特定领域未来行为的预测 | 好感、合法权威、服从 |
| Relationship Record | 温暖、角色、依赖、边界、互惠与未清义务 | 单一总好感 |
| Trait / Value | 稳定偏置与规范性重视 | 近期成功率、Habit |
| Habit | 稳定情境线索触发的低成本行为偏置 | “真正的性格”或不可改变本能 |
这张表是游戏实现假设,不是心理学分类定论。它的目的,是让一个事件的影响路径可追踪、可消融。
二、初始或慢变参数:角色长期是谁
慢变不等于永不改变。它只表示普通的一次吃饭、聊天或失败,不会立刻重写它。
1. 身体与身份事实
包括:
- 年龄 / 生命阶段;
- 人类、宠物或特殊生命形态;
- 家庭成员和谱系;
- 职业、学校或其他社会位置;
- 所属家庭、资金、物品所有权;
- 身体当前具备的交互能力。
这些参数主要回答“可以做什么”和“别人怎样对待我”,而不是直接回答“我喜欢做什么”。年龄可以禁止某些交互;所有权与关系可以阻止角色自主使用别人的床;职业与学校可以提供外部日程。S03 S04
设计上应把资格事实与人格倾向分开。一个角色不会做某事,可能是不能、不会、不被允许,也可能只是不想;四者的玩家含义完全不同。
2. Traits:少量长期偏置
Traits 可以在至少四个位置影响行为:
| 影响位置 | 设计作用 | 例子 |
|---|---|---|
| 候选 | 解锁或隐藏某些行为 | 某种性格获得独有社交或破坏行为 |
| 测试 | 允许、禁止或放宽条件 | 特定 Trait 绕过技能门槛或自主限制 |
| 评分 | 让某类行为更有或更无吸引力 | Music Lover 更愿意弹乐器 |
| 表现 / 后果 | 同一行为有不同动画、情绪或结果 | 对同一事件更容易紧张、开心或尴尬 |
2026 年官方自主性更新直接展示了这种组合:某些行为只允许特定 Traits 自主考虑;偏好改变手机、电脑、乐器等物体的自主使用;冷却又会对特定 Traits 或场景豁免。S09
这说明一个好 Trait 不应只是简历上的形容词。它至少要在行为循环的一个可观察位置产生差异,而且最好不靠“每隔几小时强制播放一次性格动画”来证明角色有个性。
3. Likes / Dislikes:针对内容域的偏好
偏好比宏大性格更具体:喜欢电脑、讨厌小提琴、喜欢园艺。它适合改变某类交互的可选性、吸引力、情绪后果或冷却例外。
具体偏好的优势是可验证:把两个角色放在同样的房间,玩家能直接观察他们是否更常接近不同对象。缺点是内容量会迅速膨胀,因此偏好应绑定行为标签,而不是逐个绑定每件物品。
4. Skills 与能力
Skills 不是欲望,而是“做得怎样”的长期积累。它们可以影响:
- 某个交互是否出现;
- 成功率、时长、品质和资源消耗;
- 可用的高阶做法;
- 角色对自己能力的预期;
- 行为结果带来的奖励与风险。
不要让高技能自动等于高欲望。一个会弹琴但讨厌弹琴的人,与一个技术一般却热爱音乐的人,应该有不同的“想做”与“做得好”。
单房间项目进一步规定:Objective Skill 只因实际练习量/质量或明确学习 Outcome 缓慢改变;普通表现失败不降低真实 Skill,只更新相关能力证据和任务级 Self-efficacy。Competence Experience 是另一层体验摘要;v0 Trait 完全冻结。近似任务可以按冻结映射有限迁移,远任务不迁移。
5. Aspirations:玩家可见的长期方向
《模拟人生 4》的 Aspirations 有阶段目标、追踪条件与奖励 Trait。官方把这类目标描述成带玩家探索内容的“面包屑路径”。它更像玩家的结构化挑战与角色主题,而不是角色自己承诺并生成计划的未来目标。S04 S07
原版首席 AI 程序员明确说明,即使 Sim 有“成为电影明星”的宏大抱负,也很少会因此自主规划职业路径;最多可能通过偏好让相关内容更有吸引力。S02
因此:
- Aspiration 可以塑造候选与奖励;
- 它不应被误读为“角色已经形成了一套多日行动计划”;
- 对单房间项目而言,长期方向若要真正驱动行为,还必须有承诺、进度、下一步和放弃条件。
6. 社会身份与文化脚本
《模拟人生 4》大量使用 Situation、Role、Buff 和交互测试表示“访客、店员、客人、聚会参与者此刻该做什么”。这比给角色增加一个抽象的“礼貌值”更具体:社会位置会改变可进入的空间、允许的行为和对他人的义务。S03 S12
这是人类学上很重要的一点。角色不是只有脱离关系的个人欲望;“我是客人、照护者、朋友、下属”也会形成行动理由。不同文化又会改变角色义务、边界与表达方式,不能只把文化做成服装或口音。S25 S26
文化不做成一个 Trait,而做成四种情境记录
理论启发 + 游戏实现假设:单房间原型不声称模拟“某国文化”,只让 Agent 对有来源、有限范围、可争议的情境脚本敏感。
| 记录 | 最小内容 | 它改变什么 |
|---|---|---|
RelationalContext | 当前活动、参与者、各自主张/被承认的角色、共同目标、权利、义务、边界、例外 | 候选来源、权限、责任 |
SituatedScript | 适用地点/活动/角色组合、规范、例外、来源、置信度、争议、版本 | Appraisal、规范候选与后果 |
ObjectSocialState | 当前持有者、所有者/群体、保管者、查看/使用/修改/转让权、隐私、交易史、特殊意义 | 物体行为的社会资格与义务 |
SocialActFrame | 身体动作、提议意义、参与者/受众、依据、预期互惠、同意、对方是否认可、争议解释 | 社会 Outcome 与关系记忆 |
同一 GiveCup 可以被提议为赠与、借用、归还、待客或赔礼。杯子物理上换手,只能确认 physical_outcome;是否形成所有权转移、返还义务或关系修复,要看双方是否认可同一个社会框架。S28 S30
所有权也不是一个布尔值。进入、使用、修改、排除他人和转让可以分属于不同角色;当前拿在手里不等于可以查看、损坏或赠送。S29
规范不是另一种物理墙
地方性规范使用五种状态:
required:角色认为自己有义务做;permitted:可以做;discouraged:可做但可能有社会代价;forbidden:角色相信不可做,但可出现询问、援引例外或有意违反候选;contested:参与者对规则或当前框架有争议。
每条规范保存来源、范围、置信度、制裁、例外和反证。一次“别开这个抽屉”只形成“此人—此抽屉—此情境”的低范围规则,不能自动上升为一种文化。
SituatedScript.source 明确标为 authored_fixture / in_world_claim / observed_practice / research_case。没有具体地方性材料时,项目只能声称“对情境脚本敏感”,不能输出国别或群体文化结论。
三、动态参数:角色此刻怎样
1. Needs / Motives:维持生活的误差信号
基础游戏公开给玩家六项 Needs:Hunger、Bladder、Hygiene、Social、Fun、Energy。S05
高阶上,每项 Need 都可以看作一个控制回路:
text
数值随时间偏离舒适区
→ 相关行为的吸引力上升
→ 角色执行行为
→ Need 被真实结果补充
→ 行为的吸引力下降1
2
3
4
5
2
3
4
5
社区 Tuning 文档把这类随时间趋向某个值的统计称为 Commodity。Commodity 不只表示生理需要,也可以表达性格欲望、情境欲望或其他会累积和消退的行动压力。S12
单房间项目必须把 Safety 从 Need 中拆出
游戏实现假设:危险不参与普通 Utility 加权,也不能被“很舒服”“很有趣”抵消。它由独立 Safety Supervisor 处理,详见第 02、05 章。
普通调节量可以在 UI 中保持少量分组,但内部不可互相抵消:
| UI 分组 | 内部误差来源 | 聚合规则 |
|---|---|---|
| Energy | 清醒储备、短时耗竭 | 取最紧迫来源,不做平均掩盖 |
| Nourishment | Hydration、Calories | 两个独立误差,共享界面但各自选择行为 |
| Comfort | ThermalComfort、PainComfort=1-pain、PostureComfort | UI 取最低来源;高痛苦不能被软椅抵消 |
| Engagement | 期望刺激与当前负荷的差 | 双向舒适带:无聊和过载都可能偏离 |
| Social Contact(可选) | 接触需求、社交负荷、伙伴是否可用 | 伙伴不可用时进入不可控/退避,不无限求助 |
Stimulation 不是 Arousal:角色可以生理上高度激活却仍缺少有意义的活动,也可以低激活但不无聊。Social Contact 也不是 SDT Relatedness:前者是当前接触调节,后者是跨事件的关系体验概括。
每个调节量必须另有一份运行合同:状态域、舒适带、警告/危险带、进入/退出迟滞、自然变化率、行为效果向量、作用延迟、资源来源、不可满足时的退化。第 05 章集中列出 v0 合同。
“宣称收益”与“真实收益”必须分开
物体交互会提供用于选择的预期收益,同时执行结果才真正改变 Need。设计师可以把它理解成:
text
广告:角色认为睡这张床能恢复多少精力
实际:躺下并持续睡眠后,精力究竟恢复了多少1
2
2
两者分开有三个价值:
- 角色可以基于预期作决定;
- 世界能诚实地让行为失败或效果打折;
- 预期与实际不符时,可以形成学习、失望或重新观察。
但差值不会自动变成正确学习。单房间项目还需为 Interaction × Object × 关键情境 保存预期效果、成功概率、预计时长、证据数和不确定度;只有能归因的 Outcome 才做小幅、有界、可逆更新。坏掉的饮水器连续失败会逐渐失去吸引力,一次偶然失败不会让角色永久回避它。
“关键情境”不能自由拼接任意标签,否则每个夜晚、天气或人类在场都会重新开一个未学习的新键。v0 使用冻结词表与层级回退:对象 ID → 对象类别 → Interaction 家族;只纳入能改变可行性或结果的功能状态。无关背景标签不建新键,近情境部分迁移,远情境不迁移。
《模拟人生 4》的公开说明足以证明物体携带供中央算法消费的 AI 数据,以及算法按 Motive 寻找、评分相关交互;但完整现代评分公式并未公开。S03
2. Buffs / Moodlets:带来源和期限的状态片段
Buff 可以被理解成“此刻成立的一条带后效事实”:刚受辱、正在拜访、喝了咖啡、附近很脏、刚完成某件事。它可以:
- 有可见名称、说明、来源与时长;
- 给某种情绪增加权重;
- 隐藏在界面下,只充当测试标签;
- 临时提供或限制交互;
- 修改自主评分、需要变化或其他结果。
这让 Buff 同时承担“短期记忆痕迹”“情境标签”“情绪原因”和“规则开关”的作用。S03 S12
优点是数据驱动、可组合;风险是 Buff 过多后,设计师难以知道某个行为到底被哪一层隐藏状态推高或禁止。
3. Emotion:多个原因竞争出的占优模式
官方手册的高阶描述是:Moodlets 为不同情绪增加点数,分数占优的情绪成为当前 Mood;强度继续上升时可进入更强状态。情绪会改变动作、对话、技能表现、职业表现和角色外显。S05
可把它简化成:
text
事件 / 环境 / Need / Trait
↓ 产生带权 Moodlets
各情绪权重竞争
↓
当前 Emotion
↓
解锁、修正和演出行为1
2
3
4
5
6
7
2
3
4
5
6
7
情绪不是命令。“Angry”不应等于必定攻击;它只是让对抗性候选更容易出现或得分更高,同时改变动画和语言。关系、场景规则、风险、玩家命令和其他需要仍可压过它。
《模拟人生 4》的离散占优情绪非常易读,但也会产生赢家通吃:一个很小却高权重的 Moodlet 可能盖过其他感受。对单房间项目,更适合让底层保持少量连续维度,再生成一个当前可读标签,详见第 04 章。S23
4. 当前身体和交互状态
一次选择必须知道角色已经在做什么:
- 位置、朝向和姿态;
- 手里拿着什么,哪些身体资源被占用;
- 当前有哪些活动交互;
- 队列里等待着什么;
- 每个交互的来源、优先级、进度和可打断性;
- 正在与谁交谈或共同使用什么对象。
这不是实现细节,而是决策输入。若系统不知道“右手拿杯、正在坐着看电视”,它就无法判断“读书”是可以并行、需要先放下杯子,还是应该取消电视。S01
注意与认知负荷必须真正造成限制
只保存一个 focus_object 还不算有限认知。游戏实现假设:
- 感知事件先进入容量有限的显著性队列;
- 每个活动声明注意占用;
- 高负荷会延迟或漏掉低显著事件、减慢语言解析并增加任务切换成本;
- 危险信号有独立通路,不因普通专注永久漏检;
- 被打断任务保存一个恢复线索,而不是依赖 LLM 重新猜;
- 短时 impulse 是后续扩展;v0 不实现自由冲动候选,避免没有内容载体的心理字段膨胀。
因此,Agent 专注抓取时可以晚一点回应长句,也可能没注意到视野边缘的微小移动;它不能事后叙述自己从未注意到的事件。
5. 关系与短期社交语境
把关系只做成一条好感度,会丢掉三个不同时间尺度:
| 时间尺度 | 表达什么 | 例子 |
|---|---|---|
| 长期关系轨 | 持续的熟悉、友谊、浪漫或敌意 | 两人长期是好友 |
| Sentiment / 关系后效 | 某段共同经历留下的定向感受 | A 对 B 心怀感激,B 未必同样感激 A |
| 短期谈话语境 | 当前互动正在变有趣、尴尬、冲突或无聊 | 好友今天正在吵架 |
社交子行为的权重可同时受 Traits、Buffs、长期关系和短期语境影响。S03 Sentiments 又把“某人出现时触发怎样的状态”保存得更久。S10
关系必须允许不对称。A 信任 B,不代表 B 同样信任 A;A 记得被帮助,B 可能只把它当成小事。
单房间项目不用一个 Trust 总分
理论启发 + 游戏实现假设:Trust 只保留三个预测性判断:S31
- 信息可靠性:此人在物体位置、危险、操作方法等具体领域说得准不准;
- 承诺兑现:答应的事是否按约完成或及时重议;
- 善意 / 安全预期:是否倾向保护、利用或伤害 Agent;
关系温暖只存于 Relationship Record。合法权威、依赖、制裁能力、角色义务和未清互惠另存于 Relationship / RelationalContext,不能由 Trust 或好感推导。一个人可以可靠但冷淡、友好却常说错、善意但能力不足,也可以有权提出某类要求却不被喜欢。
v0 Trust 领域使用冻结词表:object_location / hazard_warning / action_instruction。位置陈述错误不会降低危险警告可靠性;无关背景标签不创建新领域。没有足够领域证据时退回“未知”,而不是自动用关系温暖或全局 Trust 填补。
6. Cooldown、重复和近期历史
效用系统很容易被一个收益高、距离近、随时可用的行为垄断。当前官方更新大量使用自主冷却来阻止手机、电脑、游泳、乐器、棋类等行为马上再次当选,同时让相关 Traits、偏好或活动场景获得豁免。S09
Cooldown 不是人格,也不是记忆故事;它是一个短期控制器,表达:
“这件事刚做过,除非它对当前角色或场景特别重要,否则先给其他行为机会。”
它是让行为丰富度能跑起来的关键参数。
Cooldown 只能防止刚做完的动作马上重来,不能替代 Habit,也不能单独阻止整个行为族垄断。稳定情境中反复成功的低风险行为可以形成轻量 cue/context → Interaction 习惯偏置,降低决策成本;环境改变、结果贬值或长期未强化会让它衰减。Habit 不得绕过 Safety、硬 Tests、饱和或明确承诺。S32
反重复需要同时观察:动作实例、目标对象、行为族和它服务的调节量。否则 Agent 会在 LookAt → Scan → Inspect 三个名字之间循环,统计上不重复,体验上仍被观察行为垄断。
7. 当前目标与承诺:原作较弱的一层
Wants 可以按长期、短期和情境反应等尺度提示玩家;Fears 会在经历后形成并带来负面后效。S06 但公开资料没有显示角色会围绕一个 Want 自主维护完整的“我为何做、做到哪、下一步是什么”承诺对象。
这正是《模拟人生 4》局部反应强、未来连贯性弱的根本边界:
- 有偏好和欲望,不等于有承诺;
- 有队列,不等于有计划;
- 目标界面有进度,不等于角色会自主推进;
- 当前动作被打断后,没有强证据表明角色会为了原目标系统性恢复多步链。
单房间项目若希望 Agent 看起来“有自己的事”,必须补一个很小的承诺状态,而不是只增加更多 Needs。
承诺还需要时间、事件或活动结束等 retrieval cue 才能在适当时刻重新进入注意;完成后必须去活,避免同一线索造成重复执行。S33 这些是对设计的理论启发,具体状态机见第 02、05 章。
四、观察到的参数:角色此刻面对什么
先纠正一个容易产生的误会
《模拟人生 4》的角色并不是先用眼睛看见像素,再识别出电视和杯子。
公开架构更接近:
- 世界由结构化 GameObjects 构成;
- GameObjects 提供可用 Interactions / Affordances;
- 中央自主系统收集与当前欲望相关的物体交互;
- 测试、空间约束、视线、路径和角色状态决定能否及怎样执行。S01 S03
所以“视线”主要是某些交互的可行性条件,不等于角色拥有一套持续更新、可能出错的视觉信念。
《模拟人生 4》高阶上使用的输入模态
这里的“模态”指决策信息的来源,不只指人类感官。
| 输入模态 | 何时使用 | 影响哪一层 |
|---|---|---|
| 物体 Affordance | 寻找能满足某种 Motive 的行为时 | 产生候选 |
| 交互 Tests | 候选出现前后 | 禁止或放行 |
| 位置 / 路径 / 距离 | 评分与准备执行时 | 成本与可达性 |
| 姿态 / 朝向 / 手持 / 表面 | 判断多任务和生成转场时 | 身体可行性 |
| Line of Sight | 看电视、社交等需要互见时 | 约束与社交布局 |
| Proximity / Broadcaster / 事件 | 火灾、噪声、脏乱、附近状态等发生时 | 反应、Buff 或临时候选 |
| 对方状态与关系 | 社交选择和回应时 | 测试、权重与结果 |
| Situation / Role / 日程 | 进入场所、工作、聚会或访问时 | 限定行为域 |
| 玩家输入 | 玩家点击或安排队列时 | 高优先级意图 |
| 行为结果 | 完成、失败、取消或被打断时 | 更新 Need、Buff、关系、物体与后续选择 |
这张表说明:观察不是在选择前一次性完成的。不同信息在候选、评分、转场和结果阶段分别被查询。
反应系统不等于理解
附近火灾、噪声或死亡可以触发反应;物体状态可以新增 Buff;社交目标可以回应。但这些事件被结构化规则直接送入循环,不代表角色形成了“我看见某物、推断原因、保留不确定记忆”的认知链。
对单房间 Agent 来说,这是必须补上的边界:有眼睛就意味着有可能没看见、看错、忘记位置、需要再次确认。
五、《模拟人生 4》的“记忆”其实分散在许多地方
如果把记忆定义为“过去对未来仍有影响”,原作至少有以下几种记忆痕迹:
| 记忆尺度 | 载体 | 对未来的作用 |
|---|---|---|
| 几秒到几分钟 | 活动交互、队列、姿态、手持、短期谈话语境 | 保持动作连续与当前社交气氛 |
| 几小时到几天 | Buff / Moodlet、Cooldown、临时 Commodity | 改变情绪、候选、评分与重复概率 |
| 长期 | Skills、Traits、Fears、关系轨、Sentiments | 改变能力、关系与持续偏置 |
| 生涯触点 | Milestones、职业与 Aspiration 进度 | 展示或触发长期变化 |
| 玩家策展 | 截图 Memory | 玩家主动回忆后得到情绪 Moodlet |
这不是一个统一的自传式记忆库。角色不会像 Generative Agents 那样,把大量自然语言经历按相关性检索、反思、概括,再据此规划。S10 S20
最准确的说法是:
《模拟人生 4》拥有大量“过去留下的可调状态”,但没有证据表明它拥有统一的情节记忆—检索—反思—规划循环。
这反而是很实用的设计启示。很多过去根本不需要存成完整故事:
- 刚用过手机,只需 Cooldown;
- 正在做客,只需 Role / Buff;
- 长期不信任某人,需要定向关系记录;
- 杯子最后在哪里,需要带时间和置信度的世界认识;
- 一次真正改变角色的重要失败,才值得形成情节摘要。
单房间记忆必须把四类内容分开
text
不可变事件:曾收到什么合法观察或 Outcome
当前信念:Agent 现在认为杯子在哪里
因果假设:为什么杯子移动,谁可能负责
长期摘要:哪些模式值得影响未来1
2
3
4
2
3
4
- 每个事件有唯一 ID,同一事件在多次压缩中只能消费一次;
- 当前信念引用支持证据与反证,来源、时间、状态版本和置信区间都保留;
- “相关”不能自动升级成“造成”;未知原因不更新人格或 Trust;
- 长期摘要必须引用事件 ID,并允许新反证降低、替换或恢复旧假设;
- 遗忘先降低可访问性、细节和置信度,不是无条件删除重要结果;
- Trait、Value 与长期方向不能被普通 LLM 摘要静默改写。
相似物体和相似事件可以产生干扰,这是一种可选的有限性;但来源混淆、无证据事实和重复计数不是“像人”,而是数据错误。
六、必须分开的四个“世界”
《模拟人生 4》本体并不严格模拟下面所有边界,但有眼睛和手的研究 Agent 必须这样分:
1. 世界事实
杯子实际上在桌上,门实际上锁着,灯实际上亮着。只有房间模拟可以写这些事实。
2. 身体事实
Agent 在哪里、朝向哪里、哪只手拿着什么、动作推进到哪一步。只有动作与物理系统可以确认。
3. Agent 的当前认识
Agent 上次看见杯子在桌上,置信度较高;但人类可能在它背后把杯子移走。
4. Agent 的记忆与解释
Agent 记得“人类昨天也移走过我的杯子”,并可能解释为捉弄、帮助或偶然。解释可以错,来源必须保留。
核心规则是:
text
语言模型可以写解释
感知系统可以更新认识
动作系统可以确认身体结果
只有世界系统可以改变世界事实1
2
3
4
2
3
4
任何一层越权,闭环都会失真。
七、心理学概念怎样进入参数,而不变成伪科学
马斯洛:用危险阈值,不用刚性金字塔
系列设计谱系曾明确使用 Maslow 的需要层级来调效用。S11 但后续综述对固定层级只找到有限支持。S21
适合游戏的简化是:
- 饥饿、窒息、失温等进入危险区时,获得强制优先级;
- 未进入危险区时,多种需要并行竞争;
- 角色可以为了关系、责任、创作或信念暂时忍受不适;
- 每种需要有不同阈值、恢复方式和文化表达。
这比“上一层没满,下一层永远为零”更像可玩的生命系统。
自我决定理论:补足慢速心理需要
Autonomy、Competence、Relatedness 可作为三种慢速设计信号:S22
- 自主:我是否感觉自己的选择被承认;
- 胜任:我是否能学习、完成并看到进步;
- 关系:我是否与重要对象保持被理解和互相回应的联系。
这是理论启发,不是 SDT 给出的数值算法。它们不必做成 UI 数值条,而作为跨事件的体验概括影响目标生成与事件评价。自主体验还必须区分选择来源、自我认可、强迫/依赖和权威合法性;履行自我认可的角色义务不自动等于“自主受损”。胜任体验、客观 Skill 和特定任务 Self-efficacy 也必须分开。Relatedness 不直接写 Trust:人类兑现承诺先更新承诺可靠性,是否同时改善关系体验要由一次事件归约器明确定义。
情绪:分开感受、表达与行动
同一事件可以因为目标、责任、关系和文化不同而获得不同意义。Appraisal 理论提醒我们先问“这件事与我有什么关系、是帮助还是阻碍、我能否应对、是否违反规范”,再更新情绪。S24
项目中的 Appraisal 不是单一“威胁/机会”标签,而是一条结构化 episode:
| 字段 | 设计问题 |
|---|---|
| goal relevance / conduciveness | 影响哪个 Need、承诺、角色义务或价值,是帮助还是阻碍? |
| expectedness | 与预期差多少? |
| controllability / coping | Agent 有什么可行应对,代价多大? |
| causal candidates | 自己、环境、人类、其他对象或未知,分别有什么证据? |
| responsibility confidence | 责任归属有多确定? |
| norm relevance | 触及哪条有来源的规范,是否存在争议或例外? |
| conclusion confidence | 当前解释确定到什么程度? |
“受阻、威胁、损失、机会”只是便于显示的派生标签。杯子消失可以同样令人挫败,但只有在有证据指向人类时,才允许更新相应的人类 Trust。
每个 Appraisal Episode 还有 onset / last_evidence / active-or-resolved / decay / sustaining_condition。一次性事件只注入一次冲击;持续条件可以有界维持;新独立证据才重新激活。显示标签另有迟滞,避免每 Tick 闪烁。
文化研究又提醒:
因此,参数层至少要允许:
text
事件意义 → 内部感受 → 行动倾向 → 社会表达1
四者相关,但不是同一个变量。
Valence / Arousal 在本项目中只是理论启发的引擎坐标,不声称两个维度足以构成人类情绪。个人基线、事件冲击、不同回落时常、饱和与显示迟滞都是待实验调参。安全且重复的微小刺激可以习惯化;逐步升级的危险允许敏化,不能机械套“边际下降”。
八、参数怎样共同影响一次选择
| 参数 | 产生候选 | 淘汰候选 | 改变分数 | 改变执行 | 改变结果 |
|---|---|---|---|---|---|
| Trait / Preference | ✓ | ✓ | ✓ | ✓ | ✓ |
| Skill / Ability | ✓ | ✓ | ✓ | ✓ | ✓ |
| Need / Commodity | ✓ | ✓ | |||
| Buff / Emotion | ✓ | ✓ | ✓ | ✓ | ✓ |
| Relationship / Sentiment | ✓ | ✓ | ✓ | ✓ | |
| Situation / Role | ✓ | ✓ | ✓ | ✓ | ✓ |
| Position / Posture / Hands | ✓ | ✓ | ✓ | ✓ | |
| Cooldown / Recent history | ✓ | ✓ | |||
| Player command | ✓ | 优先级覆盖 | ✓ | ||
| World / Object state | ✓ | ✓ | ✓ | ✓ | ✓ |
| RelationalContext / SituatedScript | ✓ | 规范分级而非全硬删 | ✓ | 社会 Outcome | |
| ObjectSocialState / SocialActFrame | ✓ | ✓ | ✓ | ✓ | 物权、互惠、认可/争议 |
| Habit | ✓ | ✓ | 小幅偏置 | 降低启动成本 | 衰减或强化 |
这张表不是精确源码矩阵,而是设计层重建。它的价值在于检查某个参数有没有真正接入循环。
如果一个“勇敢”Trait 既不改变候选、测试、分数、表现,也不改变结果,它就只是一行人物简介。
九、面向单房间项目的最小参数集
第一版不需要复刻《模拟人生 4》的全部系统。建议只保留:
初始或慢变
- 3—5 条具体身份事实;
- 2—3 个行为倾向,而不是大段性格形容;
- 1—2 个重视的价值或关系义务;
- 1—2 个长期方向;
- 一份能力 / 不会做清单;
- 少量物体与房间常识。
动态
- 独立 Safety Mode,不放进普通 Need 分数;
- Energy、Nourishment、Comfort、Engagement 四个 UI 分组,内部保留不可抵消的来源;Social Contact 只有在实验确实提供可控路径时启用;
- Valence 与 Arousal 两个显示底层量,加一个可同时含多个面向的 Appraisal Episode;
- 一个当前意图及其生命周期、进度、恢复线索、期限和失败预算;
- 当前身体资源:位置、朝向、一只抽象手、一个活动身体 Interaction 与短 Queue;
- 少量 Cooldowns、族级饱和与 Habit;
- 对人类的三类领域化 Trust;关系温暖、依赖、权威范围、角色义务与未清互惠只在 Relationship / RelationalContext;
- 一个活动
RelationalContext,少量SituatedScripts与必要对象的ObjectSocialState。
观察
- 当前真正可见并被注意的对象;
- 可听事件;
- 触觉 / 手部反馈;
- 内部需要变化;
- 行为成功、部分成功或失败;
- 人类干预的明确来源和权限。
三层记忆
- 工作记忆:当前意图与刚发生的关键事实;
- 近期事件:有容量的不可变事件账本,带 ID、来源、时间、状态版本、置信度和 Outcome;
- 长期层:当前信念、因果假设与有证据引用的摘要分开保存;稳定关系、Habit 与承诺由确定性规则更新。
第 04 章会把这些参数接入一个完整可运行循环。
本章设计检查
每增加一个参数,都问六个问题:
- 它是连续量、标签,还是记录?
- 它在候选、测试、评分、执行或结果的哪一处生效?
- 玩家能通过行为看出它的存在吗?
- 行为结果能反过来改变它吗?
- 它有衰减、饱和、冷却或被新证据修正的方式吗?
- 它是在表达角色,还是在把某一文化的常识误写成全人类规则?
答不出其中至少四项的参数,通常不值得进入第一版。