现在的AI NPC有个致命通病:嘴炮无敌,干活拉胯。
你让它帮你拿个药,它能跟你扯半天世界观,然后原地发呆。为了掩盖那几秒的延迟,开发者甚至学会了用剪辑镜头来糊弄玩家。
老实讲,这种“人工智障”体验挺让人下头的。
但最近有个独立开发者搞了个狠活。他在《上古卷轴5:天际》里塞进了一个AI伴侣Varkos。从你停止说话,到这只狗做出反应,全程不到500毫秒。
不念台词的恶魔犬,真能帮你打怪捡垃圾
Varkos远超单句指令的范畴,他是个真能在游戏世界里干活的“活物”。
设定上,他是个转生为狗的恶魔。一开始傲慢、毒舌,觉得当狗是种侮辱。
但有意思的是,随着你和他一起打怪、探险,他的性格会真实演变。他会逐渐被“驯化”,开始享受当狗,甚至主动叼着玩具找你玩,眼巴巴等你夸他一句“good boy”。
评论区有个玩家吐槽得精准:这狗遇到狼袭击时,会先喊一句“空气中有邪恶气息”,然后才提醒你他被咬了。
这种带点瑕疵的真实感,比完美的机械音迷人多了。
更硬核的是他的执行力。你可以对他喊:“我往那边跑,等我射一支箭上天,你就把地上的药捡起来送给我。”
Varkos会记住条件,等待视觉信号,执行多步骤计划。搜刮宝箱、捉迷藏、甚至在全地图找你丢的一把仪式剑,他都能干。
大模型原教旨主义者的“现实毒打”
作者Pantelis是个坚定的“大模型信徒”,但现实给他上了一课。
他坦言自己信奉“大模型即正义”。如果算力无限,用一群超级大模型来控制NPC的感官、思考和行动,绝对是完美方案。
这点我不太认同他的悲观,但他指出的现实问题确实无解:今天的大模型,太慢,太贵。
为了搞定延迟,他试过云端超快推理提供商(比如Cerebras)。速度是上去了,但模型智商不够,根本接不住长对话。他忍不住吐槽:“为什么好用的GLM和角色扮演王者Qwen被拿走了?”
个人觉得,这才是目前AI游戏落地的最大尴尬:云端大模型反应慢半拍,本地小模型又容易聊着聊着就“脑雾”漂移。
复古技术缝合出的“秘密武器”
既然纯靠大模型行不通,那就把70年代的老古董翻出来。
在AI狂潮中,大家似乎忘了传统NLP和行为树的价值。Pantelis搞出了一个叫ALE(Action Latent Encoder)的系统,这才是整个项目的灵魂。
ALE根本不用大模型来做动作分解。它是个缝合怪:混合了词嵌入、小分类器、显式规则和传统机器学习。
你说“捡剑”,或者骂一句“去把那该死的剑给老子拿来”,它都能听懂。它会把你的话拆解成动作槽,并直接读取游戏世界的JSON状态来匹配目标。
这套系统跑在M4 MacBook上,分析一个复杂指令只需要2到20毫秒。
语音识别用优化过的Qwen3-ASR(40-80ms),语音合成用PocketTTS-Raven(20-60ms)。最后用一个本地微调的小模型来融合人设和情绪,生成回复。
没有魔法,全是极致的工程优化。
跨越游戏的虚空,与柏拉图的洞穴
Varkos不仅活在《天际》里,他还有个“虚空模式”。
当你关闭游戏,Varkos不会消失,而是进入一种看不见摸不着的虚空状态。
作者计划让他跨游戏存在。上一秒他还在《天际》里跟龙死磕,下一秒你打开《微软模拟飞行》,他可能就出现在驾驶舱里。他可能会对新世界的飞机感到震惊,也可能兴奋地追着太阳跑。
这听起来有点赛博朋克,甚至带点哲学意味。
我们动用雷霆万钧的算力,创造出惊人的智能,结果却逼着它当一只狗,在虚拟世界里陪我们捡树枝。
在满世界都在讨论AI导致失业、末日Agent失控的焦虑中,这种通过“共享体验”来驯化AI的方式,显得特别治愈。
就像作者说的,在柏拉图的洞穴里,我们或许依然孤独,但至少现在,有个奇奇怪怪的外星智能在洞穴里陪我们玩耍。
当算力不再是唯一的解法,工程学的缝合与对游戏本质的回归,或许才是AI陪伴的真正出路。只是不知道,当这只恶魔犬彻底被驯化成一只只知道讨好的修狗时,我们到底是在对齐AI,还是在投射我们自己?
【锐评】:用造火箭的算力去教AI狗捡树枝,看似大材小用,却意外治愈了我们对AI末日的集体焦虑。
参考链接:
https://pantel.is/projects/ai-gaming-companion/