可以对话的 AI 游戏:三种架构和它们的区别
发布于 2026年8月14日 · 约 9 分钟阅读
三十年来,和游戏角色说话就意味着从列表里挑一个。三个选项出现,你点一个,角色说出绑在上面的那句话。你能进行的每一场对话,都是提前写好的。
"你想说什么就打什么,角色会回答"的游戏现在是一个真实的品类。它同时也是好作品和演示 demo 之间差距极大的品类——而差别不在模型,在于模型被接到了什么上面。
三种架构
几乎所有"可以对话的 AI 游戏"都是下面三种之一。前五分钟它们感觉相似,一小时后完全不同。
一、开放式陪伴对话
一个有人设的角色、一个输入框、没有目标。Character.AI 是国外的代表,国内的星野、猫箱这类角色对话产品属于同一形态。
**它擅长什么:**无限的宽度。角色愿意就任何话题、朝任何方向聊下去,永远聊下去。
**它不是什么:**游戏。没有胜利条件、没有失败状态,世界上也不存在"事实"这回事。你问上周二花园里发生了什么,答案是被生成得合理,而且下次可能是另一个答案。
这不是批评——它是陪伴产品,而且做得很好。之所以要说,是因为它的宣传语和真正的游戏高度重合,想要游戏的人常常在这里失望。
二、模拟世界里的大模型 NPC
一个常规游戏——村庄、生活模拟、策略层——其中角色的对话是生成的,而他们说的话连着真实的底层状态。
《Suck Up!》是小体量的清晰例子:你扮演吸血鬼,要说服 AI 住户请你进门,而他请不请你取决于你实际说了什么。有真实的胜利条件,对话就是机制本身。大体量方向上,生活模拟和 RPG 开始搭载端侧或云端的 NPC 模型。
它擅长什么:把对话变成一个真正的动词。说服、欺骗、虚张声势、谈判变成你做的事,而不是菜单项。
**要检查什么:**对话是改变了模拟状态,还是只是描述它。如果 NPC 什么都能被说动,但世界状态从不移动,那你面对的是一个画在游戏上的聊天框。
三、有作者的故事 + AI 表演层
一个提前写好的固定故事,AI 的职责是扮演角色而不是编造情节。世界的真相在你到场之前就定了;模型负责的是每个角色在此刻会怎么回答。
这是 AI 推理游戏的架构,也包括本站的案件。凶手、时间线和证据是写好的,AI 扮演嫌疑人——这意味着你可以问任何问题,包括没有作者预料到的问题,并且得到一个与这个角色"知道什么、愿意承认什么"一致的回答。
**它擅长什么:**那个原本不可能的组合——表达的自由,加上最后确实有一个答案。 你可以随便怎么审问,而仍然存在"对"和"错"。
**它放弃了什么:**剧情不会跟着你走。如果你想要故事根据你的选择分叉,这个架构不提供。
像 AI Dungeon 这样的文字冒险系统在另一个极端:模型连世界一起即兴,产生无限自由和零固定真相。想清楚你要哪一种,是挑 AI 游戏时最重要的问题。
"记忆"到底指什么
这个赛道里每个产品都宣传记忆。它至少指四种不同的东西,按工作量递增:
一、上下文窗口。 模型能看到最近 N 千字的对话。便宜、普遍,而且会悄无声息地忘掉开头。多数"我们的角色会记得你"指的就是这个。
二、摘要化历史。 旧对话被压缩成摘要保留在上下文里。好一些——能撑住长会话——但有损,而且保留什么是由另一个模型决定的。
三、对事实的检索。 对话被存储和检索,相关的过去片段在需要时被调回来。这能产生那种"角色提起三次会话之前的事"的诡异瞬间。
四、结构化世界状态。 重要的东西根本不在文本里,而在数据库里。角色 X 知道事实 Y。物品 Z 在房间 W。关系值是 3。模型是读取这个状态,而不是记住它。
第四种是唯一能让角色可靠自洽的,也是唯一需要真正工程而不只是更长提示词的。这也是为什么有作者的游戏在一致性上能胜过开放式产品,尽管它灵活性低得多:它的状态小、显式、而且正确。
四分钟测出你面对的是哪一种:
- 告诉角色一件有辨识度的事。岔开话题十轮。再拐弯回来提。
- 问两个角色关于世界的同一个事实性问题。他们的答案一致吗?
- 问一个他应该拒绝回答的问题。他是拒绝,还是热心地编?
第三个测试最有揭示性。没有世界状态的模型不会说"我不知道"——它会给出一个合理的东西,因为那就是它的功能。 在推理里,一个 AI 嫌疑人对自己毫无信息的问题即兴编造答案,谜题就已经被毁了。
花时间之前的五个检查
一、有没有固定真相? 游戏能判定你错吗?如果没有任何说法比别的更真,就没有可解的东西,也没有理由认真听。
二、有没有完成状态? 不一定要有输赢,但要有一个"算做完了"的状态。没有的话,会话在你腻了的时候结束,而不是在你完成的时候。
三、角色有没有边界? 好的 AI 角色会拒绝、回避、生气、撒谎、以及不知道。一个对任何问题都完整而愉快地回答的角色,是穿着戏服的助手。
四、你说的话改变了什么吗? 试着无礼。试着撒谎。试着告诉一个角色另一个人说了什么。如果之后世界完全一样,对话就是装饰。
五、撑得过一小时吗? 这个领域几乎所有东西在十分钟内都很惊艳。失败模式——重复、遗忘、语气漂移、模型附和你最后说的话——都出现在第二十到第六十分钟之间。按后半段来判断。
为什么推理格外适合这项技术
多数游戏类型从对话式 AI 里得到的比预期少。射击游戏里说话不是动词,策略游戏里对话是调味,开放世界 RPG 里无限对话反而对抗设计者需要你跟随的剧情。
推理是例外,有三个结构性原因。
审问本来就是玩法。 每一部推理作品的核心循环都是问人问题、比对答案。这在过去无法很好地建模——对话树无法预料你真正想问的那个问题,而好问题永远是关于 9:33 到 9:47 之间那十四分钟的那个具体问题。
固定解答是特性而不是限制。 这个类型要求一个作者写定的真相。所以生成式系统最大的弱点——它会编造任何合理的东西——被推理本来就需要的东西修好了。AI 表演,它不决定。
撒谎是合法的角色行为。 在多数游戏里,NPC 说假话是 bug。在推理里那正是重点,也是唯一一个"模型擅长生成有说服力但不真实的陈述"恰好是期望输出的地方——只要撒什么谎是被写定的。
这个组合很罕见,也是为什么推理游戏是最早真正可玩的 AI 对话游戏之一,而不是技术演示。更多见AI 剧本杀怎么玩。
第一次玩会遇到的两件事
你会问得不够。 多年的对话菜单训练让所有人期待三个选项,于是第一反应是打一句泛泛的——"跟我说说死者"——然后得到一句泛泛的回答。这个形式对具体性的奖励是残酷的。 "你说你九点走的,门禁记录显示门在 9:41 开过,那四十一分钟你在做什么?"会有收获;"你有什么想法吗?"不会。
你会过度信任。 流畅的文字读起来有权威感,而推理里的角色是故意在骗你。记下别人声称了什么,而不是你觉得自己知道了什么,并且拿说法互相检验而不是拿它对你的印象。
第一个问题见盘问嫌疑人的 40 个问题,第二个见如何破解剧本杀。
常见问题
AI 游戏和"带人设的聊天机器人"有什么区别?
游戏有一个你可能弄错的固定状态,以及一个算作完成的条件。聊天机器人有一个人设和一个输入框。两者都可以很享受,但只有一个可以被"解开"。最快的测试是问:这个系统能不能告诉你你错了?
AI 游戏会记住我说过的话吗?
有些会,但仅限于"最近的对话还在上下文里"这个有限意义。真正维护"每个角色知道什么、你已经确立了什么"的结构化记录的要少得多。用上面那个四分钟测试跑一遍。
AI 游戏免费吗?
很多有免费档,定价变化很快。浏览器类通常不用安装,有些还能不注册就开始。我们的免费在线推理游戏一文把"免费""免下载""免注册"分开讲——这是三件常被混为一谈的事。
AI 会不会在我其实错了的时候判我对?
在有作者的游戏里不会——解答独立于对话存在,指控是拿去和它比对的。在即兴系统里会,而且这是这个形式用于解谜时的核心弱点:一个被问"我的推论对不对"的模型,倾向于认为你是对的。在投入几小时之前,这是最该确认的一件事。
喜欢推理的话从哪个 AI 游戏开始?
从有作者的案件开始,而不是开放式角色扮演,这样第一次尝试就有真实可解的东西。觉醒约 65 分钟,是最温和的入口;雪夜追凶适合当第二个。看看全部——第一个案件浏览器直接开,不用注册。