用户8717用户8717
用户1699用户1699组别 | 模型 | 运行 | 有效章 | 调用 | Token | 实际费用 | 每百万 Token 费用 |
海外 | Gemini 3.1 Pro Preview、GPT-5.4、Claude Sonnet 5 | 9 | 9/9 | 96 | 187.0 万 | $4.9823 (≈¥33.88) | ¥18.12 |
国内贵价 | Doubao Seed 2.1 Pro、GLM-5.2、Qwen3.7 Max、Kimi K2.6 | 12 | 12/12 | 215 | 1,034.2 万 | ¥32.9812 | ¥3.19 |
国内平价 | Qwen3.7 Plus、LongCat 2.0、DeepSeek V4 Pro、MiniMax M3 | 12 | 11/12 | 147 | 450.5 万 | ¥5.1958 | ¥1.15 |
层级 | 模型 | 引导均分 | 引导风格 |
第一梯队 | Claude Sonnet 5 | 4.57 | 共创策划型:提供题材路线、金手指形态、剧情空间选项,答案扩展为完整设定体系 |
第一梯队 | GLM-5.2 | 4.53 | 工程拆解型:历史/国术/原著资料 + 六卷拆解,把模糊题材变成百万字工程 |
第二梯队 | Qwen3.7 Max | 4.47 | 责编管理型:伏笔记录、角色进度、卷级管理,最贴近连载责编视角 |
第二梯队 | GPT-5.4 | 4.33 | 产品经理型:书名、简介、标签、卖点、目标读者、分卷与开篇方案,平台化意识最强 |
第三梯队 | Doubao | 4.27 | 快速推荐型:迅速给推荐设定并持续执行,认知负担低,但停止控制有时越界 |
第三梯队 | DeepSeek V4 Pro | 4.2 | 约束共创型:把建议变成约束——历史锚点、行为边界、金手指强度、创作禁忌;有效性 4.6 为平价组最高,但首轮引导过程不可核验 |
第三梯队 | Gemini | 4.10 | 极简确认型:确认篇幅、类型、时代后立即开工,适合已知道要什么的作者 |
第三梯队 | Kimi K2.6 | 4.03 | 简洁开工型:引导少,对平台定位、长线风险主动拆解不足 |
第三梯队 | Qwen3.7 Plus | 4.0 | 少问快做型:能稳定产出可执行方案,但建议本身审校不足(篇幅超界、历史顺序、战力玄幻化) |
第四梯队 | LongCat 2.0 | 3.4 | 访谈型:主动提问意识最强(有效性 3.9),但提问质量未转化为可靠方案,年代倒序、战力膨胀 |
第四梯队 | MiniMax M3 | 2.9 | 引导是硬伤:ask_followup_question 工具至少失败 5 次,一轮 Plan 完全失败;成功样本的五问引导本身可用(稳定性仅 2.0) |