Labs · 聊天考古
聊了五百多楼,
你其实一次都没数过。
把酒馆导出的聊天记录拖进来,开挖:聊了多少天多少楼、多少发生在深夜、你在哪一楼重摇了七次、 这段对话按今天的牌价值多少钱、机器味从第几楼漫上来。最后给你一张年报卡——上面只有数字, 没有你们说过的任何一个字。全程在你的浏览器里,记录不上传。
一段原创演示:深夜便利店的温叙,约 90 天 300 多楼。人设剧情都是我们自己写的,数据形状是刻意造的——空窗、深夜漂移、越聊越机,全有。
这类文件很私密,所以说清楚:本页没有上传接口,解析、统计、出图全部发生在你的浏览器里;刷新即清空,我们连一个字节都收不到。
这个工具怎么来的
这是把工具矩阵里四个引擎叠进一份报告:.jsonl 解析沿用酒馆导出形态(第一行元数据、is_system 行计数但不进统计、mes 取当前选中的重摇版本),并且保留了别的工具会丢掉的东西——每一个重摇候选、生成时间戳、新版导出逐条记录的模型名。AI 味曲线跑的是 AI 味体检器同一套 v10.7 规则,从整段打分改成逐楼打分;成本按 2026-07-24 的牌价快照对七个常见档位重演,装填算术和上下文透视镜同源。这套逻辑有 101 条 Node 断言锁着,其中一组金标是 12MB、三万行的合成导出,解析耗时约半秒。
统计口径摊开写:「字数」按 CJK 逐字、英文连续串按词;「深夜」是本地时间 23:00–05:59;token 按中文 1.6 字/token、其它 4 字符/token 粗估;「重摇一次」等于第一版之外的一个候选。时间戳认 ISO 字符串、epoch 数字和酒馆的人话格式——解析不动的宁可不算也不编造;有时间戳的消息不足一半时,作息卷会说明情况然后让位。
它做不到什么
编辑痕迹考不出来——酒馆导出不记录消息被编辑前的样子,报告也就不假装知道。
成本卷是重演估算不是账单:不含卡面、系统提示和世界书(实际用量更高),不算缓存折扣(真实花费可能低得多——DeepSeek 缓存命中价约为牌价 1/50),分词是近似。两个方向的误差都印在数字旁边。
AI 味规则只在中文语料上校准过。英文为主的记录会得到一行诚实的说明而不是一个分数——英文的校准工作我们还没做,就不假装做了。
群聊导出能解析,但报告把「不是你」的都算成一个 TA——按成员拆分还没做。
常见问题
我的聊天记录会被上传吗?
不会。本页没有上传接口——解析、统计、出图全部在你的浏览器里完成,刷新即清空。聊天导出是 RP 玩家手里最私密的文件之一,这正是这个工具做成纯本地的原因。年报卡在数据结构层就装不下聊天原文:它的字段只有数字和站方文案。
成本那个数字是我真实花掉的钱吗?
不是,页面在数字旁边也这么写。它是重演估算:每条 AI 回复(包括你重摇划走的每一版)按一次请求计价,用 2026-07-24 的牌价快照,每一楼把全部历史重新装填、封顶在你选的上下文窗口。它不含角色卡、系统提示和世界书(实际用量比这个高),也不算缓存折扣(DeepSeek 缓存命中价约是牌价的 1/50,真实花费可能低一个数量级),token 是粗估不是各家真实分词器。如果导出里逐条记了模型名(新版酒馆会记),报告按那个档位精确计价;没记就给低价档到中高价档的区间。
支持什么文件?
SillyTavern「导出聊天」产出的 .jsonl(每行一个 JSON,第一行是可选的元数据);Foreverse 导出的是同一格式。字段缺了会优雅降级——没有时间戳就收起作息卷,损坏的行跳过并计数。一次最多拖 8 个文件,多文件会多出一张跨角色对比表。单文件最大 48MB,分片解析,页面不卡。
AI 味曲线是怎么算出来的?
每条 AI 回复用我们 AI 味体检器同一套规则(v10.7 浏览器轻量版)打 0-5 分:套话词表低权重、句式模具高权重,规则在中文角色卡语料上做过零误杀校准。曲线画的是逐楼分数,并标出持续下滑开始的位置——「越聊越机」这个酒馆玩家都懂的体感,第一次被画成图。它是文案 lint 不是检测器;只支持中文,非中文为主的记录会如实给「不硬下结论」的说明。