我用 Kimi K3 创造了无限 Bungo Stray Dogs 视觉小说——模型深度评测
我输入了一句话,得到了 64 个角色、一个可玩游戏、以及无限的 LLM 对话。这是我用 Kimi K3 vs Claude Opus 5 vs Grok 4.5 做 AI 世界构建的实测报告。
一句话。64 个原子。一个可玩游戏。
我在 Neta Studio 里输入了"Bungo Stray Dogs 世界"。六分钟后,我得到了 23 个有背景故事的角色、13 个地点、16 个事件、完整的势力体系——以及一个可以在浏览器中直接玩的视觉小说游戏,带分支对话。无需编程,无需美术功底,只需一句话和正确的 AI 模型。
这是我用 Kimi K3(月之暗面)作为 Neta Studio 世界构建引擎的实测报告——以及它与 Claude Opus 5、Grok 4.5 在生成同一个 Bungo Stray Dogs 世界时的对比。









我得到的游戏:ADA Mission — Harbor Ghost
在聊模型之前,先看看实际产出了什么。ADA Mission: Harbor Ghost 是一款在浏览器中运行的视觉小说。一个夜晚,三个场景,雾气弥漫的码头,昏暗酒吧的对峙。


每个选择改变三个计量表——Agency Trust、Underworld Heat、Case Progress。对话?不是预写的。一个实时 LLM 以角色声音即兴生成每一句。每次游玩都不同。
你可以 直接在浏览器中玩 →
为什么我选了 Kimi K3 而不是 Claude 和 Grok
Neta Studio 允许在三款 LLM 之间自由切换做世界构建。我用相同的输入测试了三款模型,以下是我的发现:
| 测试维度 | Kimi K3 | Claude Opus 5 | Grok 4.5 |
|---|---|---|---|
| 角色背景故事 | 丰富、有层次 | 文笔最佳 | 扎实但平淡 |
| 原子间交叉引用 | 最佳——从不遗忘 | 良好 | 有偏移 |
| 中文 IP 理解 | ★★★★★ | ★★★★ | ★★★ |
| 英文 IP 理解 | ★★★★ | ★★★★★ | ★★★★★ |
| 生成速度(64 原子) | ~3 分钟 | ~5 分钟 | ~2 分钟 |
| JSON schema 遵循 | 完美 | 完美 | 小修 |
Kimi K3 在 BSD 上胜出,关键在于 128K 上下文窗口。生成第 60 个原子时,它还记得第 5 个的能力体系。Claude 的文笔更美但偶尔重复角色特征。Grok 最快但丢失了港口黑手党和荒神事件之间的交叉引用。
对于一个以中文译本为源文本的日本 IP,Kimi K3 的中文原生理解是决定性因素。它捕捉到了 Claude 过于直译、Grok 完全忽略的细微差别。
64 个原子长什么样
Kimi K3 不只是生成了名字。每个原子都有描述、封面画 prompt、以及与其他原子的隐含关联。这是完整拆解:
| 类型 | 数量 | 最佳示例 |
|---|---|---|
| 角色 | 23 | 太宰治——"微笑的侦探社社员,前黑手党干部..." |
| 地点 | 13 | 横滨港——"城市的生命动脉..." |
| 事件 | 16 | 三方战争——"侦探社、黑手党与 Guild 激突..." |
| 势力 | 4 | 港口黑手党——"森以必要之暗统治..." |
| 异能 | 5 | 人间失格——"接触即可消除任何异能" |
| 规则 | 2 | 文学命名——"每个异能以文学作品命名" |
在 BSD 世界页面 可以看到这些原子卡片——每张都由 Kimi K3 生成,然后由 GPT Image 2 配图。点击任意卡片查看完整描述。


美术呢?(GPT Image 2 评测)
Kimi K3 写了世界。但视觉小说需要立绘和背景。这就轮到 GPT Image 2 了。



GPT Image 2 根据 Kimi K3 的角色描述生成了 透明 PNG 立绘——自动去背景。每个角色有中性表情,可以直接叠加在场景背景上。23 个角色的美术风格完全一致,这对视觉小说至关重要。



我也试了 Gemini 3.1 做场景背景。它的光影和氛围比 GPT Image 2 更好,但 GPT Image 2 在角色一致性上更胜一筹。我的建议:GPT Image 2 做立绘,Gemini 3.1 做背景。
真正的魔法:无限 LLM 对话(DeepSeek V3 评测)
这里才是最疯狂的部分。游戏引擎在运行时调用实时 LLM。不是预设的分支脚本——是真正的实时生成,以每个角色的声音。
我测试了两款模型做游戏内对话:
- DeepSeek V3——更快、更便宜,动作场景出色。情感时刻略欠细腻。
- Kimi K3——长上下文记忆更好(记得 20 回合前发生了什么),情感深度更强。但更慢。
我的选择:第一遍用 DeepSeek V3(速度重要),然后切换到 Kimi K3 增加重玩价值(角色刻画更深)。Neta Studio 支持游戏中切换。

我 Fork 了世界,改变了一切
生成 BSD 世界后,我 Fork 了它。Neta Studio 的 World Fork 让你继承全部 64 个原子,然后改写任何你想要的部分:
- 去掉了太宰治,加入了我的 OC"黑"——一个时间旅行侦探
- 把横滨换成了东京
- 保留了全部 13 个地点、16 个事件和势力体系
Kimi K3 生成的新角色匹配了已有世界的基调——黑的背景故事提到了港口黑手党和文学命名法则。世界保持了一致性。这就是 128K 上下文的力量。
我使用的完整链路
一句话 → 64 个原子。Kimi K3 生成了角色、地点、事件、势力、异能、规则——每个都有描述和封面 prompt。
角色立绘自动生成并去背景。场景背景 16:9 高清。所有素材风格一致。
故事逻辑、计量表系统、里程碑——全部自动编写。发布为浏览器可玩的 构建。
实时 LLM 生成每句对话。可在 DeepSeek V3(快)和 Kimi K3(深)之间切换。
我的结论:该用 Kimi K3 吗?
在走完整个 BSD 视觉小说链路后,这是我的真实评价:
- 用 Kimi K3 如果——你在构建中文或日本 IP 世界,需要交叉引用的原子,或需要最连贯的 60+ 原子输出
- 用 Claude Opus 5 如果——你在构建英文 IP,重视文笔质量超过速度,或世界少于 30 个原子
- 用 Grok 4.5 如果——你在快速原型,世界少于 40 个原子,之后会精修
对于 Bungo Stray Dogs,Kimi K3 是正确的选择。128K 上下文保持了 64 个原子的一致性,中文理解捕捉到了其他模型遗漏的细微差别,结构化输出完美无瑕。
为什么选择 Neta Studio
Neta Studio 不仅仅是一个游戏生成器——它是一个完整的 AI 世界构建平台。在走完整个 BSD 链路后,这就是我一直回来的原因:
专业性——云端 harness 系统支撑从世界构建到游戏发布全流程,全程在云端运行,无需本地环境。稳定的最新模型接入: Kimi K3 Claude Opus 5 Grok 4.5 DeepSeek V3 GPT Image 2 Gemini 3.1 Seedance Kling 2.5
一键生成——官方调教的 skill 系统驱动每一步:世界构建、角色设计、美术生成、游戏打包。基于 world fork 的资源共享机制,你可以 fork 任何公开世界——继承全部角色、地点、事件,然后改写你想要的部分。
社区优先——用户自建无限世界,所有公开世界都可以被 fork、remix、再创作。Discord 学习社区提供教程、案例和实时支持,从第一个世界到第一个游戏,都有社区陪你走完。
建造你自己的世界
我输入了一句话,得到了一个可玩游戏。你也可以——Bungo Stray Dogs、鬼灭之刃、或你自己的原创概念。免费开始,无需编程。