Guide · 模型评测

我用 Kimi K3 创造了无限 Bungo Stray Dogs 视觉小说——模型深度评测

我输入了一句话,得到了 64 个角色、一个可玩游戏、以及无限的 LLM 对话。这是我用 Kimi K3 vs Claude Opus 5 vs Grok 4.5 做 AI 世界构建的实测报告。

一句话。64 个原子。一个可玩游戏。

我在 Neta Studio 里输入了"Bungo Stray Dogs 世界"。六分钟后,我得到了 23 个有背景故事的角色、13 个地点、16 个事件、完整的势力体系——以及一个可以在浏览器中直接玩的视觉小说游戏,带分支对话。无需编程,无需美术功底,只需一句话和正确的 AI 模型。

这是我用 Kimi K3(月之暗面)作为 Neta Studio 世界构建引擎的实测报告——以及它与 Claude Opus 5、Grok 4.5 在生成同一个 Bungo Stray Dogs 世界时的对比。

角色中岛敦
中岛敦
孤儿出身的侦探社社员,白虎异能迫使他选择力量会让自己成为什么样的人。
角色太宰治
太宰治
微笑的侦探社社员,前黑手党干部。接触即可消除任何异能,寻找无痛的死亡。
角色国木田独步
国木田独步
侦探社的理想主义者,试图将混乱束缚于计划、日程和理想笔记本中。
角色芥川龙之介
芥川龙之介
黑手党的黑色风衣执行者,以活体织物异能为武器,以绝对力量衡量自身价值。
角色中原中也
中原中也
黑手党干部,重力操控者。愤怒与忠诚使他成为横滨最危险的资产之一。
角色森鸥外
森鸥外
黑手党首领,外科医生型战略家,将地下世界当作需要维持生命的患者。
角色菲茨杰拉德
菲茨杰拉德
The Guild 领袖,财富驱动的异能和美国野心,目标是买下横滨的异能未来。
角色江户川乱步
江户川乱步
侦探社最强侦探,非异能天才,以纯粹推理解决不可能案件。
角色陀思妥耶夫斯基
陀思妥耶夫斯基
轻声细语的幕后黑手,通过罪恶、策略和圣洁般的残忍清洗异能者。

我得到的游戏:ADA Mission — Harbor Ghost

在聊模型之前,先看看实际产出了什么。ADA Mission: Harbor Ghost 是一款在浏览器中运行的视觉小说。一个夜晚,三个场景,雾气弥漫的码头,昏暗酒吧的对峙。

每个选择改变三个计量表——Agency Trust、Underworld Heat、Case Progress。对话?不是预写的。一个实时 LLM 以角色声音即兴生成每一句。每次游玩都不同。

为什么我选了 Kimi K3 而不是 Claude 和 Grok

Neta Studio 允许在三款 LLM 之间自由切换做世界构建。我用相同的输入测试了三款模型,以下是我的发现:

测试维度Kimi K3Claude Opus 5Grok 4.5
角色背景故事丰富、有层次文笔最佳扎实但平淡
原子间交叉引用最佳——从不遗忘良好有偏移
中文 IP 理解★★★★★★★★★★★★
英文 IP 理解★★★★★★★★★★★★★★
生成速度(64 原子)~3 分钟~5 分钟~2 分钟
JSON schema 遵循完美完美小修

Kimi K3 在 BSD 上胜出,关键在于 128K 上下文窗口。生成第 60 个原子时,它还记得第 5 个的能力体系。Claude 的文笔更美但偶尔重复角色特征。Grok 最快但丢失了港口黑手党和荒神事件之间的交叉引用。

对于一个以中文译本为源文本的日本 IP,Kimi K3 的中文原生理解是决定性因素。它捕捉到了 Claude 过于直译、Grok 完全忽略的细微差别。

64 个原子长什么样

Kimi K3 不只是生成了名字。每个原子都有描述、封面画 prompt、以及与其他原子的隐含关联。这是完整拆解:

类型数量最佳示例
角色23太宰治——"微笑的侦探社社员,前黑手党干部..."
地点13横滨港——"城市的生命动脉..."
事件16三方战争——"侦探社、黑手党与 Guild 激突..."
势力4港口黑手党——"森以必要之暗统治..."
异能5人间失格——"接触即可消除任何异能"
规则2文学命名——"每个异能以文学作品命名"

BSD 世界页面 可以看到这些原子卡片——每张都由 Kimi K3 生成,然后由 GPT Image 2 配图。点击任意卡片查看完整描述。

美术呢?(GPT Image 2 评测)

Kimi K3 写了世界。但视觉小说需要立绘和背景。这就轮到 GPT Image 2 了。

GPT Image 2 根据 Kimi K3 的角色描述生成了 透明 PNG 立绘——自动去背景。每个角色有中性表情,可以直接叠加在场景背景上。23 个角色的美术风格完全一致,这对视觉小说至关重要。

我也试了 Gemini 3.1 做场景背景。它的光影和氛围比 GPT Image 2 更好,但 GPT Image 2 在角色一致性上更胜一筹。我的建议:GPT Image 2 做立绘,Gemini 3.1 做背景

真正的魔法:无限 LLM 对话(DeepSeek V3 评测)

这里才是最疯狂的部分。游戏引擎在运行时调用实时 LLM。不是预设的分支脚本——是真正的实时生成,以每个角色的声音。

我测试了两款模型做游戏内对话:

  • DeepSeek V3——更快、更便宜,动作场景出色。情感时刻略欠细腻。
  • Kimi K3——长上下文记忆更好(记得 20 回合前发生了什么),情感深度更强。但更慢。

我的选择:第一遍用 DeepSeek V3(速度重要),然后切换到 Kimi K3 增加重玩价值(角色刻画更深)。Neta Studio 支持游戏中切换。

我 Fork 了世界,改变了一切

生成 BSD 世界后,我 Fork 了它。Neta Studio 的 World Fork 让你继承全部 64 个原子,然后改写任何你想要的部分:

  • 去掉了太宰治,加入了我的 OC"黑"——一个时间旅行侦探
  • 把横滨换成了东京
  • 保留了全部 13 个地点、16 个事件和势力体系

Kimi K3 生成的新角色匹配了已有世界的基调——黑的背景故事提到了港口黑手党和文学命名法则。世界保持了一致性。这就是 128K 上下文的力量。

我使用的完整链路

步骤 1 · 世界构建(Kimi K3)Kimi K3Claude Opus 5Grok 4.5
一句话 → 64 个原子。Kimi K3 生成了角色、地点、事件、势力、异能、规则——每个都有描述和封面 prompt。
步骤 2 · 美术生成(GPT Image 2)GPT Image 2Gemini 3.1
角色立绘自动生成并去背景。场景背景 16:9 高清。所有素材风格一致。
步骤 3 · 游戏构建(Grok 4.5)Grok 4.5
故事逻辑、计量表系统、里程碑——全部自动编写。发布为浏览器可玩的 构建。
步骤 4 · 实时对话(DeepSeek V3)DeepSeek V3Kimi K3
实时 LLM 生成每句对话。可在 DeepSeek V3(快)和 Kimi K3(深)之间切换。

我的结论:该用 Kimi K3 吗?

在走完整个 BSD 视觉小说链路后,这是我的真实评价:

  • 用 Kimi K3 如果——你在构建中文或日本 IP 世界,需要交叉引用的原子,或需要最连贯的 60+ 原子输出
  • 用 Claude Opus 5 如果——你在构建英文 IP,重视文笔质量超过速度,或世界少于 30 个原子
  • 用 Grok 4.5 如果——你在快速原型,世界少于 40 个原子,之后会精修

对于 Bungo Stray Dogs,Kimi K3 是正确的选择。128K 上下文保持了 64 个原子的一致性,中文理解捕捉到了其他模型遗漏的细微差别,结构化输出完美无瑕。

为什么选择 Neta Studio

Neta Studio 不仅仅是一个游戏生成器——它是一个完整的 AI 世界构建平台。在走完整个 BSD 链路后,这就是我一直回来的原因:

专业性——云端 harness 系统支撑从世界构建到游戏发布全流程,全程在云端运行,无需本地环境。稳定的最新模型接入: Kimi K3 Claude Opus 5 Grok 4.5 DeepSeek V3 GPT Image 2 Gemini 3.1 Seedance Kling 2.5

一键生成——官方调教的 skill 系统驱动每一步:世界构建、角色设计、美术生成、游戏打包。基于 world fork 的资源共享机制,你可以 fork 任何公开世界——继承全部角色、地点、事件,然后改写你想要的部分。

社区优先——用户自建无限世界,所有公开世界都可以被 fork、remix、再创作。Discord 学习社区提供教程、案例和实时支持,从第一个世界到第一个游戏,都有社区陪你走完。

建造你自己的世界

我输入了一句话,得到了一个可玩游戏。你也可以——Bungo Stray Dogs、鬼灭之刃、或你自己的原创概念。免费开始,无需编程。

测试模型: Kimi K3 · Claude Opus 5 · Grok 4.5 · GPT Image 2 · DeepSeek V3IP: Bungo Stray Dogs生成原子数: 64出游戏时间: ~6 分钟
×