Labs · 世界书合并

攒了五本半成品世界书?
合成一本,重复的当场对质。

玩得久的世界都会攒书:卡里带的、自己写的、朋友导出的。全拖进来——重复条目按「内容相似 + 触发词重叠」分组,两个版本摆在一起选谁留下;合并后共享同一触发词的条目先亮牌,别等运行时才发现两条抢一个词、token 白花两份。最后出一份干净的酒馆格式 JSON,酒馆系条目原样透传不重写。

免费浏览器本地运行不上传

把要合并的世界书都拖进来(可一次多本)

酒馆 / Chub / Risu / Agnai / JanitorAI / 角色卡内嵌 book 都认 · 在浏览器里解析,不上传

解析、查重、导出全部发生在你的浏览器里——世界书不上传、不留存,刷新即清空。

这个工具怎么来的

解析层与「世界书迁移体检器」共用同一套五平台方言引擎——格式探测与逐平台字段映射按各平台开源实现逐行核实(2026-07 读取)。查重用字符三元组 Jaccard 相似度 + 触发词重叠系数双判据,阈值由 74 条断言的金标自测锁定,其中包括真实的数百条社区世界书、以及「同一本书两个版本」模拟(350 条真书 + 20 条扰动副本,350 组全部配对成功、扰动条走模糊判据抓回)。

导出走往返验证:合并产物用与本站触发模拟器同一套「对齐酒馆 1.18」的解析器重新读回,每个语义字段都必须原样归位。酒馆系来源更进一步——原始条目对象整体透传、只重排 uid/displayIndex,自测按字段锁定(depth、role、automationId、外来 extensions 都不许动)。

它做不到什么

相似度是文本层面的,不是语义层面的:同一个设定用完全不同的话写两遍,不会被归成重复组——这类漏网之鱼通常会以「同触发词」的形态出现在撞车清单里,记得扫一眼。阈值(90% 单判 / 55% + key 重叠)刻意保守:宁可漏掉一对疑似,也不把两条只是长得像的条目悄悄并掉。

合并会把非酒馆来源归一到酒馆条目模板。Risu 的 @@decorator 因为写在正文里会保留,但 Risu 专属字段(mode、activationPercent)、Agnai 的 priority、Janitor 的 min_messages 会按「迁移体检器」文档化的规则转换或丢弃——想要逐条清单,先把源书丢给它跑一遍。书级设置(扫描深度、token 预算、递归开关)不做合并,到目标平台上自己设。

常见问题

它怎么判定两条条目是重复的?

双判据。内容几乎一样(字符三元组相似度 ≥ 90%)直接归为一组,不管触发词写什么——「同一本书攒了两个版本」就是这种。内容中等相似(≥ 55%)时要触发词也重叠(较小 key 集的一半以上被覆盖)才归组,防止两条只是提到相同名词的不同条目被硬并。刻意不做的:同触发词但内容不相干的条目不算重复——它们进「触发词撞车」清单,由你来裁决。

导出的时候条目会被改写吗?

来自酒馆或 Chub 导出的条目原样透传——depth、role、自动化 ID、inclusion group、甚至平台自带的 extensions 全部原封不动,只重排 uid 和 displayIndex。来自 Risu / Agnai / JanitorAI / NovelAI / 卡内嵌 book 的条目,按解析出的统一语义在酒馆条目模板上重建(卡内嵌 book 会从 extensions 里捞回 depth/role/automation_id)。导出卡片会告诉你两条路各走了多少条。

触发词撞车为什么只提示、不帮我改?

因为共享触发词不一定是错。同一个词激活两条条目,可能是有意的分层(一条写城市、一条写政局),也可能是两本书各写了一份同样的设定——后者白花双倍 token 还可能自相矛盾。哪种情况只有你知道。工具把每个被共享的触发词和涉及条目都列出来;想让同 key 条目「一次只出一条」,在酒馆里给它们设同一个 inclusion group 即可。

支持哪些格式?

酒馆世界书导出、Chub 世界书(WI+V2 双写)、RisuAI 导出({ type: 'risu' })、Agnai 记忆书({ kind: 'memory' })、JanitorAI JSON 编辑器条目数组、V3 lorebook、带内嵌 book 的角色卡、NovelAI lorebook——和「世界书迁移体检器」同一套解析层。合并产物统一是酒馆 World Info 格式:这个圈子事实上的通用语。

我的世界书会被上传吗?

不会。解析、查重、撞车检查、导出全部发生在你的浏览器里,页面加载后断网也能用;刷新就什么都不剩了。

相关工具与阅读

← 全部免费工具

世界书合并去重器 — 多本世界书合成一本,重复条目逐组对照,触发词撞车先亮牌 · Foreverse · 新梦