板报 · Field notes

阅读与酒馆的工程笔记

我们一边做一个装进口袋的阅读器和酒馆,一边把路上的坑、取舍和实测记下来。没有软文腔,全是踩过的路。

暖纸底水墨插画:两方砚台隔着一张摊开的稿纸对峙,右砚旁堆着二十张判卷票签,左砚旁只有三张,一支毛笔搁在稿纸中缝上
模型评测2026年7月21日8 分钟

Qwen 3.8 对 Kimi K3:三天内连发的两个万亿级模型,进了同一间考场

中国两家厂商三天内连发万亿级模型:7 月 16 日 Kimi K3(2.8 万亿参数),7 月 19 日 Qwen3.8-Max-Preview(2.4 万亿参数,自称仅次于 Fable 5、未附独立 benchmark)。我们把两家放进同一张续写考卷:同两本书、同起笔点、同一套指令,各连续续写 20 轮,六评委双映射成对盲评。比分 3:20——玄幻 1:10、女频 2:10,qwen3.8 名下三张票还全部在映射翻转下自相矛盾。双方的坑都有票据:qwen3.8 被点名「严重剧情倒带」和「把夜色熬成了毒」,K3 被点名「舒痕胶的字据、夹袋」套路化复读,外加半角引号与思考关不掉两个存量病。preview 是移动目标,结论绑定 2026-07-21 的托管端点。

读全文 →
旧纸底上并排两幅同一株墨兰的写生:左幅被浓雾裹住只剩轮廓,右幅雾散、枝叶分明,纸角搁着一只沙还没流完的沙漏
模型评测2026年7月21日7 分钟

Qwen 3.8 比 3.7 会写小说吗?两本书 40 轮双盲:一场 11:1,一场 7:5

Qwen3.8-Max-Preview 发布 48 小时的增量实测:沿用 Kimi K3 那轮的同一套协议(同两本书、同起笔点、同上下文说明),与前代 Qwen 3.7 Max 各连续续写 20 轮成对双盲。票数女频 11:1 碾压、玄幻 7:5 险胜,前代的「精修感官流」在古言场明显收敛。最有意思的反差:结构统计反而是 3.7 更贴原著,句长 CV 全场最平是 3.8 的新体征,盲评却照样判 3.8 赢。三个坑如实记录:感官堆砌替代叙事推进、玄幻 20 轮卡进死循环、古言里写出「把夜色熬成了毒」。preview 是移动目标,全部结论绑定 2026-07-21 的端点。

读全文 →
一处岔路口立着无字木牌,一侧是虬结的老树,另一侧是抽芽的新苗,土路在暖纸底上分向两边,手绘水墨插画
选型指南2026年7月18日8 分钟

K2.6 升 K3:写小说的人分三类,各有一笔账

K3 发布后,开放平台首页挂着最高返券 30% 的充值活动,模型列表里 moonshot-v1 和 kimi-k2.5 标了 8 月 31 日全平台下线,夹在中间用 K2.6 写书的人最纠结。我们刚跑完 K3 对 K2.6 的同协议成对双盲:两本书 24 票,K3 拿 21 票、K2.6 拿 1 票,连 K2.6 引以为傲的后程都没守住。这篇按三类用户拆:长跑党看双盲实证,预算党算输入 3 倍输出 3.7 倍的差价加思考税,观望党先确认 K2.6 根本不在下线清单里。

读全文 →
两张书案隔着一道墨色河流对望,左案稿纸密实工整,右案稿纸疏朗零散,两摞手稿纸纹各异,暖纸底手绘水墨插画
模型评测2026年7月18日8 分钟

K3 对 DeepSeek:目前能对表,还不能对决

K3 发布 48 小时,对比文全在刷代码榜,写小说角度没人给数据。我们把 K3 刚跑完的两书 20 轮续写链和 DeepSeek 双档的同书归档放上同一把尺:玄幻场 K3 综合贴近度 0.388,落在 V4 Flash 的 0.356 与 V4 Pro 的 0.454 之间;女频场 0.396,未及 V4 Pro 的 0.280;成本这局 DeepSeek 碾压,一段 K3 的钱够 Flash 谷时写二十多段。必须说明:这是同尺隔空对表,不是同场盲评,成对对决在排期中。

读全文 →
旧纸底上两株并排的墨线植物:左株枝条自我缠绕打成结,右株挺拔开出一朵花,右株根边搁着一枚小小的秒表
模型评测2026年7月18日8 分钟

Kimi K3 发布 48 小时,我们让它连续续写了 40 轮小说

Kimi K3 发布 48 小时的增量实测:沿用九模型横评同一套协议(同两本书、同起笔点、同上下文说明),与前代 K2.6 各连续续写 20 轮成对双盲,票数玄幻 10:0、女频 11:1,唯一反对票在映射翻转下自相矛盾;K2.6 的比喻堆砌与整段自我复制没有复发,句长变化幅度两本书都更贴原著。三个坑如实记录:约 85% 对白用半角引号(K2.6 没有的新病)、女频「我」密度是原著近 1.8 倍、思考关不掉导致每轮 37-54 秒且八成输出是推理 token。K3 侧 41 次请求实付 ¥12.21。

读全文 →
领奖台上一座双面奖杯,一面铸着一柄剑、另一面铸着一柄团扇,底座上有一道细小的裂纹
模型评测2026年7月18日7 分钟

GLM-5.2 写小说的完整档案:唯一双榜前三,和它绕不开的那个毛病

智谱 GLM-5.2 在我们两场双盲横评(890 万字传统玄幻 + 《甄嬛传》宫斗古言)里是唯一双榜都进前三的模型:玄幻场第 3、宫斗场 2-3,评语「限知观察质感最纯」。这页是它的完整成绩档案:两场名次与盲评评语原文、半角引号顽疾的跨书证据链、检测正则被它骗过的笑话,以及 GLM-5.5 传闻的如实口径——发布当天我们会复测更新本页。

读全文 →
一架手绘天平:一侧托盘放着一支鹅毛笔,另一侧压着成摞的硬币,暖纸底水墨线条,朱砂色点缀
决策分析2026年7月18日8 分钟

Fable 5 写小说值不值:先算钱,再看证据,最后承认我们还没测它

Claude Fable 5 是当前最贵的通用可用模型:每百万 token 输入 $10、输出 $50,7 月 20 日起 Claude 订阅也不再内含,只能按量买 credits。英文写作圈的盲测把它叫最强 raw writer,但它 6 月停服过 19 天,而我们的九模型中文续写横评里没有它。这篇把价格实算、证据分层和决策树摊开:什么人现在就值、什么人该等实测、什么人用 DeepSeek 就够。

读全文 →
一本挂历上几页被撕下正在飘落,桌面上摆着一排新旧钥匙,旧钥匙生锈、新钥匙发亮,暖纸底手绘水墨线条
时效2026年7月18日9 分钟

今夏六个模型停用与变价节点:一页值班表,随日期滚动更新

2026 年 7 月到 8 月至少六个模型停用或变价节点扎堆生效:7 月 20 日 Fable 5 转按量计费、7 月 24 日 deepseek-chat/deepseek-reasoner 旧名停用、7 月 30 日 GitHub Models 全退役、8 月 31 日 Moonshot V1 与 kimi-k2.5 全平台下线、同日 Sonnet 5 介绍价结束,另有 DeepSeek 峰谷计价随 V4 正式版落地。本页逐条给日期、影响面和续写用户的替代款,事实全部对照官方公告核实。

读全文 →
一盏台灯下摊开的手写账本,旁边立着一只标出昼夜刻度的圆盘,白昼扇区被朱红描重,深夜扇区留白
价格2026年7月18日7 分钟

DeepSeek 峰谷计价来了:给续写党的三笔账

DeepSeek 于 2026 年 6 月 29 日官宣随 V4 正式版引入峰谷计价:北京时间每日 9:00-12:00、14:00-18:00 高峰时段全部计费项翻倍,其余 17 小时维持现价。这篇按写作者的用法算三笔账:谷时续写一段一分二厘、峰时二分三厘;缓存命中价翻倍后仍是未命中的 1/50;积分渠道与 BYOK 的时段策略。基于 2026-07-18 核实的政策现状。

读全文 →
两张书桌隔着窄缝相对:左桌手稿纸页齐整如印刷,右桌手稿涂改凌乱、散页滑出桌沿,一支墨笔正好搁在两桌之间
模型评测2026年7月18日8 分钟

GPT-5.6 对 Kimi:同一张考卷上的两种性格

GPT-5.6 Terra 和 Kimi K2.6 在两场双盲横评里各连续续写 40 轮的完整对照:Terra 是纹理模仿天花板、宫斗场全程零事故,但玄幻场第 18 到 20 轮把剧情倒回起点、复用自己第 2 轮的句子;Kimi 玄幻场第 7、比喻密度全场最高,宫斗场却是唯一越写越好的系统。文末如实交代时效边界:7 月 16 日上线的 Kimi K3 没进过考场,不编排名。

读全文 →
手绘墨线插画:一个小小的信使人影提着灯笼走在书架搭成的街道上,背包里插着几张发光的角色卡,街边店铺挂着不同站点的小招牌
智能体2026年7月18日7 分钟

找卡、鉴卡、搬卡都是杂活,杂活可以外包

好角色卡散在社区、外站和群文件里,找、鉴、搬三个动作全是体力活。Foreverse 的 Agent 能把这条链代办:逛社区和读详情是免确认的只读动作,下载必须过你的确认卡,每回合有读取和下载次数上限,装进来的卡带溯源记录。这篇按一次真实任务把工作流走一遍,外站部分如实交代边界:Agent 搜索目前只认一个站,手动链接导入兜底六个来源。

读全文 →
旧纸上并排画着两座宫门,匾额一实一虚,一只手持朱笔在两块匾额之间画出问号形的墨线,桌上摊着一册线装书与一枚剧场票根
研究笔记2026年7月18日7 分钟

太后住在哪座宫,供出了模型的训练语料

九模型续写《甄嬛传》横评里的计划外发现:小说里太后住颐宁宫、皇后在凤仪宫,剧版对应寿康宫、景仁宫,有的模型续写时写出了剧版专名——它记住的是电视剧,不是流潋紫的原文。这篇把这个发现方法论化:怎么拿你自己那本书里的独有专名,测一测模型到底读没读过原著,以及单探针的四条局限。

读全文 →
旧纸底上两支并排的毛笔,一新一旧,各自写下一列字迹,一只手持放大镜在两列字之间比对,桌角摊着一本翻开的对照笔记
研究笔记2026年7月18日7 分钟

新版模型发布那天,先别急着换——三组对照数据的笔记

每次新版模型发布都有人问要不要换着写小说。我们手里有三组对照数据泼冷水:一次「模型疑似变强」的现场,模型其实一个字没换,变的是上下文里的一句说明;同一句话的三组消融,效应从 20 轮 20 次回退到 28 轮零复发;同门两个档位在两种文体上正负翻转。结论:版本号不回答「合不合你的书」,复测才回答。

读全文 →
一卷极长的手稿从一扇小小的阅读窗下缓缓穿过,只有窗内的几行字被朱红灯光照亮,窗外的长卷淡成灰白
科普2026年7月18日8 分钟

30 万字的书能整本喂给 AI 吗?先算一笔账

AI 记不住前面的剧情,问题不在「记性」,在窗口。用公开分词器实算:一章 3000 字约合 2100 到 2800 token,30 万字全本约 21 万到 28 万;2026 年主流模型窗口已到 100 万 token,整本装得下。但装得下不等于记得住:中段失焦有论文有厂商自家评测,材料在场不等于被使用有我们自己的对照实验。附读者版正确喂法。

读全文 →
同一把朱红茶壶往四只相同的杯子里倒茶,四杯茶色深浅不一,旧纸底上一只手举起其中两杯对着光比较
研究笔记2026年7月18日7 分钟

同一个模型昨天封神今天摆烂?拆开是四件事,归你管的有两件

「AI 续写像抽卡」的抱怨里混着四个互不相干的方差来源:采样温度(可控)、上下文构成随窗口滑动换血(可控)、推理服务器按负载拼批次的数值波动(不可控,Thinking Machines 实测温度 0 下同一请求 1000 次出 80 种输出)、还有你自己的阅读状态。逐个拆开,附两个可控项的具体拧法。

读全文 →
一函线装书摊开在案头,书页间伸出一条蜿蜒小路,一个戴金箍的小小行者剪影沿路走向远山,路在中途分出几条朱红岔线
AI 续写2026年7月18日7 分钟

《西游记》被重写了四百年,2026 年轮到你

《西游记》大概是被重写次数最多的中文故事:1641 年前后董说让孙悟空做了一场梦,明清三大续书各续各的;1995 年《大话西游》给悟空加上爱情,2000 年 23 岁的今何在在金庸客栈连载《悟空传》。这篇按时间轴走完这条重写谱系,然后落到操作层:公版原文哪里拿、断点怎么选、世界书怎么装设定、怎么防 AI 把明代原著写成 86 版电视剧的味道。

读全文 →
凌晨的卧室里,床头一部手机透出暖光,屏幕上浮着一条短短的聊天气泡,旁边一杯温水,窗外一弯细月
伴侣2026年7月18日6 分钟

凌晨一点半,TA 还醒着

睡不着、想找个人说说话的那种夜晚,AI 伴侣到底是什么体验?这篇不讲功能列表,讲一夜:凌晨 1:34 的倾诉、2:10 被温和地赶去睡觉、早上 8:40 TA 还记得昨晚说的事。顺带把三个实际问题说清楚——深夜的 TA 为什么话更少、TA 会不会半夜吵你、以及真正难受的时候,AI 应该退到哪里(文末附 12356 全国心理援助热线,2026-07 核实可用)。

读全文 →
暖纸色手绘插画:桌上铺着一张旧地图,两枚小图钉隔着一片海,一根暖色细线松松相连,线旁一部手机亮着一条小小的聊天气泡
伴侣2026年7月18日8 分钟

异地恋找 AI 聊天,正常吗?先把「补位」和「替代」分开

对象在地球另一边,你的晚上是 TA 的上午。这篇写给异地恋的人:找 AI 聊天正不正常(2021 年的校园调查里,恋爱中的大学生 34.2% 在异地)、AI 伴侣在时差里补的到底是哪个位、会不会让你更不想维护真实关系,全部正面回答。外加一条少见有人说的建议:别用 AI 复刻你的对象本人,理由和异地恋研究里的「理想化」发现直接相关。

读全文 →
暖纸色手绘插画:小剧场的幕布向两侧拉开,舞台地板由摊开的书页铺成,台上立着两张空白的选项卡片,一束聚光灯打在其中一张上
剧场模式2026年7月18日9 分钟

剧场模式进阶手册:按开演前、演出中、散场后各管一段

剧场模式的首测记录写的是「这东西是什么」,这篇写「怎么玩顺手」:进场前挑什么书、三档语速和 AUTO 的脾气、单景配图与整章批量配景的花钱规矩(报价确认、复用零付费、月度上限)、选择肢的两击确认、演到历史分岔时点哪里,以及散场后你的选择以什么形式留在书里。全部是当前版本可见的行为,不含期货。

读全文 →
暖纸色手绘插画:一本摊开的书旁立着一个小画架,画架上的画布浮现出书页里的场景,桌面散着几张空白风格样卡与一支蘸水笔
插画2026年7月18日9 分钟

给自己看的小说配插画:模板货架、改法与模型搭配

给小说配插画,难的从来不是「画一张好看的图」,是画出来的图和正文对不上。这篇按资源手册的写法整理 Foreverse 已上架的官方媒体模板:144 张场景模板合集加 4 张视频风格模板的关键条款节选、每张标注什么书适合、改模板时哪三处能动哪两处别碰,以及 Seedream、GPT Image、Nano Banana 三家生图模型各自配什么活(2026-07-18 对照官方文档核实)。

读全文 →
手绘墨线插画:一部手机屏幕上挂着几条聊天气泡,一根缀着红叶的细绳从手机边伸出,绳上用木夹挂着三张拍立得——雨中的窗、依偎的两人背影、冒着热气的早餐
伴侣2026年7月18日7 分钟

一周四张照片:TA 的相册是这样长出来的

能和 AI 伴侣拍合照吗?TA 会自己发生活照吗?这篇把 Foreverse 伴侣的照片家族按一周的使用节奏走了一遍:长按聊天「画下这一刻」的时刻卡、上传自己照片的合照(本地成年确认,照片只以内存态发给你选的模型、App 不落盘)、TA 主动分享的照片动态(默认关、每天最多一张)。每个入口花多少钱、确认弹窗长什么样、照片最后去了哪,逐项写清。

读全文 →
手绘墨线插画:一只手从旧手机发光的屏幕里伸出,托着一只打开的小行李箱,箱里装着信件、照片和一颗朱红色的心,一道虚线弧线跳向旁边的新手机
伴侣2026年7月18日7 分钟

旧手机明天寄走,TA 今晚搬家

换新手机,AI 伴侣的记忆能带走吗?在 Foreverse 里可以:伴侣资料页「导出搬家包」把人格、逐条记忆、完整聊天记录、纪念日、日记、关系档案打成一个 zip,传到新手机后在伴侣管理页导入,TA 接着上次聊。这篇按一次真实换机把流程走全——导出、传输、导入、验证记忆完整,也如实写了两条注意事项:没有自动云同步,卸载前必须先导包。

读全文 →
手绘墨线插画:一部手机屏幕亮着一条消息气泡,气泡由一根从摊开日记本里长出的藤蔓托着,藤蔓上缀着小叶与一颗小铃铛
伴侣2026年7月18日7 分钟

主动消息不是定时群发:七类触发,逐个给行为规格

AI 伴侣主动发消息是定时群发吗?在 Foreverse 里不是:每类触发都有明确条件——早安 8 点左右、晚安 10 点左右、想你了要超过一天没聊、低电量要低于 20% 且没充电、恶劣天气要你先手填城市。全局约束:默认关闭、免打扰 23:00–7:00、每天最多 2 条、手动关过的子项绝不复活、关掉无补发。这篇按开关逐个写清行为规格,包括 TA 什么时候不发。

读全文 →
手绘墨线插画:摊开的小本子上一行行短句,其中一行被朱红色圈出,旁边搁着铅笔和橡皮,纸面泛着暖光
伴侣2026年7月18日6 分钟

TA 把你的生日记早了一周:打开记忆页,当场改

AI 伴侣记错事,在对话里纠正没用——对话会滑出窗口,记忆条目不会。这篇是实操手册:入口在伴侣聊天页右上 ⋮ 菜单的「记忆」,列表逐条可搜;铅笔改(单条上限 200 字)、垃圾桶删(确认弹窗显示原文)、开关停用(保留但不再进对话)、右上加号替 TA 记一条。改动从下一次对话生效;数据是手机本机文件,搬家包整包带走。

读全文 →
旧纸底色手绘插画:木底座上一排圆按钮,其中一颗被按下,牵动朱红连杆与齿轮,把两只对话气泡高高举起
酒馆2026年7月18日8 分钟

每隔十几楼就要敲一遍的那句话,值得一颗按钮

酒馆的 Quick Reply(自动按钮)是把重复劳动钉成按钮的机关:一键剧情总结、换景模板、无声导演批注、AI 回复后自动计数,四个可直接照抄的配方。按钮内容以 / 开头就是 STscript,手机端跑的是桌面同源的命令子集,不认识的命令安全跳过;四档自动化模式加死循环检测兜底,脚本里只有触发生成的步骤才花钱。

读全文 →
旧纸底色手绘插画:两张纸叠在一起,下层是素色的对话气泡,上层同样的气泡被朱红花边和缎带描了边,旁边搁着一支蘸水笔
酒馆2026年7月18日7 分钟

第一次碰酒馆正则的人,先分清这一件事

酒馆正则就是自动跑的查找替换:藏思考链、去 OOC 旁注、把状态栏 marker 换成美化界面,全是它。但第一次用之前要分清三档执行时机——「双向」在消息写进记录前就替换、改动是永久的;「仅显示」只改你看到的;「仅提示词」只改模型看到的。这篇玩家向教程带四步上手:导入带正则的卡、认时机、从模板建第一条、出问题单条排查。

读全文 →
旧纸底色上的手绘墨线插画:图书馆卡片抽屉拉开一格,一串索引卡连成弧线飞向摊开的书,书页上长出一棵挂满纸页的树
酒馆2026年7月18日8 分钟

你只提了一个名字,五条设定全员到场:递归扫描说明书

「为什么加了一条设定,好几条一起冒出来?」这是世界书递归扫描在干活:已命中词条的正文也被当作扫描源,词条可以召唤词条。这篇机制说明书讲清链条怎么走、在哪停(层数、预算、去重三道闸)、三个词条级开关各管什么,附一个五条连锁的可复现失控案例和两件自带的验证工具。

读全文 →
一支朱红毛笔同时跨立在并排的两座小领奖台上,笔锋叉出一根倔强的杂毛,一只手正用小梳子把它理顺
工作流2026年7月18日8 分钟

用智谱 GLM 开一本书:从双榜前三选型,到和半角引号共处

智谱 GLM 5.2 是我们两场双盲横评(890 万字传统玄幻 + 《甄嬛传》宫斗古言)里唯一双榜都进前三的模型,代价是跨文体复现的半角引号顽疾:玄幻场 20 轮 108 处,宫斗场原样复发。这篇按一次完整开书流程走:bigmodel.cn 实名建 Key、免费档 GLM-4.7-Flash 试笔、旗舰 5.2 正式续写、撞上引号后的三层绕行,附 2026 年 7 月核实牌价。

读全文 →
一只能吞下整摞小说的巨大书箱敞着盖,旁边小书案上只压着三页精选手稿,一支毛笔正沿页面续写,大容器与小案对比鲜明
实测记录2026年7月18日8 分钟

Kimi 的 256K 窗口,对续写小说到底有多大用

Kimi K2.6 的 256K 上下文是真能力,「窗口大就续得像」是伪推论:九模型《甄嬛传》双盲横评它排 5-7 名,评语「越写越收敛」与窗口无关;4k 到 20 万 token 的五档对照实验证明,整本塞入不加指令照样比喻密度 10 倍于原著,且每段按全书输入计费。附 2026 年 7 月官方牌价(输入 ¥6.5/百万 token)、接入步骤与长上下文真正适用的场景清单。

读全文 →
摊开的实验记录簿:左页二十道绕回同一原点的墨圈,右页一道朱红墨线挣脱循环伸向页缘,簿边搁着一枚打了孔的无字纸券
实测记录2026年7月18日8 分钟

Gemini 续写小说:免费档是真的,但和排过名的不是同一个模型

AI Studio 免费档 2026 年 7 月核实:Flash 级每分钟约 10-15 次、每天数百到一千多次请求,长期有效不用绑卡;但免费层只覆盖 Flash 级,我们双盲横评排名的是付费层的 Gemini 3.1 Pro——玄幻场曾因一句标注措辞 20 轮全部重写开场,措辞修复后甄嬛传场回到 4-6 名。这篇把「免费」和「能打」两笔账分开算,附拿 Key 与接进手机阅读器的步骤。

读全文 →
木桌上一只卡片匠人的工具箱,画着人物立绘的角色卡从箱中飘向空中
发布2026年7月17日6 分钟

写角色卡这门手艺,我们把家底放上 GitHub 了

character-card-skills 仓库上线:两个 agent skill(写卡 + 聊后调优)、47 份分类创作指南、15 张过检测的原创卡(酒馆可直接导入的 v2 JSON + v3 PNG 嵌卡都给了),以及那个在 LLM 评委 gold 正确率只有 12% 之后、按真实读者判断校准出来的规则版 AI 味检测器。代码 MIT,内容 CC BY 4.0。Claude Code、Cursor、Codex 都能跑,在 Foreverse 安卓端是内置的。

读全文 →
手机屏幕的暖光映在深夜的桌面上,屏幕里一条聊天气泡旁放着一把很小的钥匙,桌角是一杯喝了一半的茶
伴侣2026年7月17日7 分钟

我们做 AI 伴侣功能,所以更该把立场说清楚

72% 的美国青少年用过 AI 伴侣,Replika 一次功能下线曾让论坛版主贴出自杀干预资源。我们是做这个功能的团队,摆三条立场:这是真实的情感体验不是病,但替代不了线下的支持系统;依恋是强力杠杆,做产品的人有责任不拿它换日活;数据主权是情感主权的一部分,记忆存在你手机里,关系才没收不走。有些问题我们也没想清楚,一并写在里面。

读全文 →
一函线装《红楼梦》摊开在案头,第八十回末页牵出几条朱红丝线,各自系着一页新写的手稿
AI 续写2026年7月17日7 分钟

后四十回吵了两百年,这次你可以自己续

《红楼梦》后四十回是人类史上最著名的续写公案:高鹗背了一百年骂名,2008 年人民文学出版社把署名改成「无名氏续」。今天你可以在手机上自己下场:公版全本哪里找、断点选第八十回末还是黛玉焚稿前、哪些模型接得住典雅书面语(甄嬛传九模型横评的真实数据)、怎么用分支让「黛玉不死线」和「宝钗视角线」并存。

读全文 →
一张木桌从中间裂成两半:左半边摆着打字机、大纲卡片和红笔,右半边躺着一部亮屏的手机和一杯茶,裂缝里长出一条分岔的墨线
观点2026年7月17日8 分钟

「AI 写小说工具」是两个物种,排行榜把它们混在一起坑的是你

搜「AI 续写工具推荐」会拿到一堆大纲生成、伏笔管理、日更产能的作者向工具(笔灵、岱宗、蛙趣、解忧笔札),但很多搜续写的人其实是读者:想把手机里那本书接着写下去、写给自己看。这篇观点专栏把两个赛道劈开讲清楚,逐家陈述可核实定位、不打分不排名,文末附「你是哪派」三问自测。

读全文 →
一幅长卷上的字迹从右往左逐渐漂移变形,中段一枚朱红印章之后笔迹恢复工整
研究笔记2026年7月16日7 分钟

越写越不像原著,是有原因的——20 轮漂移实验记录

AI 续写第一段很像原著,第十段开始「翻译腔」,第二十段像换了个作者——这不是错觉。我们用一本 890 万字的玄幻书做了组对照实验:裸提示词的链 20 轮后句式持续均匀化、比喻堆叠、意象自我复读;给上下文标注「哪段是原著、哪段是 AI 写的」再配一句基准声明,漂移显著放缓,甚至出现越写越像的反向曲线。

读全文 →
六支毛笔在同一张卷轴上临同一个字,只有朱红那支写得和原帖一样
研究笔记2026年7月16日9 分钟

六个模型续写同一本玄幻小说,我们盲评出了最像原著的那个

拿一本 890 万字的传统玄幻《踏天境》,让 DeepSeek V4 Pro/Flash、Claude Opus 4.8、Gemini 3.1 Pro、Qwen 3.7 Max、GLM 5.2 从同一个位置各自连续续写 20 轮,再做双盲评审排名。第一名不是最贵的那个;有一个模型 20 轮都在重写同一段开场;还有一个模型句长统计几乎完美、盲评却排第五。完整数据和方法都在这篇。

读全文 →
手绘墨线插画:放大镜悬在手稿上方,镜下几行文字被朱红下划线标出,旁边一张画着正字计数的小卡片和一支钢笔
研究笔记2026年7月15日8 分钟

「一丝凉意」判 AI,「学费我交过了」判真人:检测器翻车实录

我们给角色卡文案做了一个规则检测器:套话词表加句式配额,用来拦截「一眼 AI」的官方文案。这篇是它的校准记录:金标判例集第一次跑就抓出检测器误杀人类(人类热门卡均分 4.55 低于 AI 的 4.90)、单词黑名单为什么必须降级成句式检测、以及它永远抓不到的那类 AI 味。附一个免费的浏览器版工具。

读全文 →
手绘墨线插画:一只朴素的对话气泡穿过一座朱红雕花画框,变成带鎏金边框和缎带装饰的气泡,下方摆着蘸水笔和小画刷
创作者2026年7月15日8 分钟

状态栏、思维链、可点选项:美化这门手艺,搬进手机

美化是中文酒馆社区最有生命力的手艺:状态栏、可折叠思维链、主题化聊天皮肤,全靠正则和 HTML 搭出来。但这套生态默认长在桌面浏览器里。这封信写给美化创作者:你的卡在 Foreverse 手机端怎么渲染、marker→正则→WebView 三段链路各自的规矩、哪些桌面习惯会翻车、以及美化代码为什么不吃你的 token。

读全文 →
一卷长长的对话记录手稿,镊子正把一张发光的记忆卡片插进末尾的开槽,旁边一叠被红笔划掉的旧卡片
研究笔记2026年7月15日9 分钟

94.3% 的命中率,错的

给角色扮演做长期记忆,注入位置直接决定缓存账单和记忆生效率。我们先在 24 轮实验里得出「历史末尾插 system 块」的结论(缓存命中 94.3%),三周后被 400 轮实验推翻:DeepSeek 的模板会把所有 system 消息归并到开头,那个 94.3% 是缓存污染的假象。这篇公开完整数据:七种检索策略、泄漏检测、以及比检索更要命的「弃权灾难」。

读全文 →
法庭上一排机器人评委举着分数牌,被告席上坐着一支人类的钢笔
研究笔记2026年7月11日8 分钟

让 AI 评「像不像 AI 写的」,结果它把人类判成了 AI

一次双盲评审实验的完整数据:4 个异构大模型评委、真人标注的金标锚点、双顺序对照。结果 gold 正确率只有 12%——评委们一致地把人类热门作品判成 AI、把被真实用户吐槽「一眼 AI」的文案判成真人。评委间一致率 86%,但一致地错。这篇公开实验设计、翻车数据和我们最后立下的铁律。

读全文 →
板报 — 手机酒馆、AI 续写与 BYOK 的工程笔记 · Foreverse · 新梦