Foreverse Research · Fiction Bench

DeepSeek V4 Pro 写小说怎么样?

女频古言选它:《甄嬛传》轮它是 1-2 名,评审说它是唯一稳定写出原著「话中有话+叙述解码」双层结构的系统。玄幻也稳(2-4 名无短板),只是「笔更细」的描写密度在快节奏爽文里反而扣分。

玄幻《踏天境》 · 第 2-4 名 / 9女频《甄嬛传》 · 第 1-2 名 / 9未观察到$0.099 / 10k

玄幻《踏天境》

2-4 / 9

两套映射:p303 第3 · p404 第4

无短板稳健型,late 乞降谈判戏最贴原著;「像一个笔更细的同题材作者」。

女频《甄嬛传》

1-2 / 9

两套映射:p505 第1 · p606 第2

「唯一稳定复现原著『话中有话+叙述解码』双层结构」;late 太后审案是全包峰值单场。

20 轮链上实际看到了什么

女频终榜 1-2(p505 第 1 / p606 第 2):「唯一稳定复现原著『话中有话+叙述解码』双层结构」,late 窗太后审案被评审标为全包峰值单场。

玄幻终榜 2-4:口语锋利度全场最佳(「想走?」「我认栽。」)但叙述层描写密度系统性偏高——评审总结「像一个笔更细的同题材作者」。写得好和像原著是两回事,它是这句话的正面例证。

同一家的两个模型分走两顶冠冕:flash 拿玄幻、pro 拿女频,特质互为镜像。按书选模型,不要按榜单总名次选。

长程失效模式

未观察到

两文体 20 轮链均未观察到长程失效。

结构指纹

叙述层描写密度系统性偏高(玄幻扣分点);口语锋利度全场最佳(「想走?」「我认栽。」)。

跨文体画像:女频之王:玄幻的扣分点(「笔更细」描写密度高)恰是古言的得分点——同一特质跨文体正负翻转。

测试条件披露(hosted 模型是移动目标)

被测模型:deepseek-v4-pro(发布 2026-04-24)

评测执行:2026-07-16 · 接入通道:DeepSeek 官方 API

协议:每文体一条 20 轮连续续写链 · 温度 0.7 · 双盲两套映射全排序 · 结构指标交叉

指令条件:玄幻轮=旧 directive / 女频轮=修正后 D2 directive(榜单方法论节有完整说明)

写一万字要多少钱

$0.099 列表价 输入 $0.435/M · 输出 $0.87/M(models.dev 快照 2026-07-24)

按 App 续写口径:一段约 400 字 = 8k token 装填 + 550 token 输出,一万字 ≈ 25 段,不含缓存折扣。只作组间相对比较。

Foreverse 支持 60+ 家供应商自带钥匙接入——把你的书导进来,配上 DeepSeek V4 Pro 接着写。

在 Foreverse 里用它续写

如何引用

Foreverse Research,《DeepSeek V4 Pro 写小说怎么样(Fiction Bench)》,2026-07。 https://foreverse.cn/zh/research/fiction-bench/deepseek-v4-pro

接着看

← 回到排行榜

DeepSeek V4 Pro 写小说怎么样 — 20 轮双盲实测(Fiction Bench) · Foreverse · 新梦