SoloEnt 模型写作测评

AI 写小说哪家强

AI 写小说是一项工程。我们把这个工程拆解,对不同场景和任务进行不同模型的测评。
测评结果视需求交由模型与真人共同评分,真人采用双盲评分。每月发布 1-2 期。
每期公开完整数据、评分口径和测试局限,希望我们的测评结果对你的写作有所帮助。

0已发布报告
0累计参评模型
0累计匿名作品
0累计有效评分

我们怎么测

控制测试输入,机器自动采集,真人双盲参评,科学数据清洗。

1

统一输入

不同写作场景的测试,均保证有统一的输入,每个模型可独立生成多次结果,互不干扰。

2

真人盲评

写作效果无法完全依赖模型评分,真人对正文的评价更具参考价值。真人评分时不知道模型信息。

3

清洗后统计

科学剔除异常值,判别力不足的样本整批排除,再进行数据统计。样本量和数据口径完全透明。

来打分

加入测评团

我们在持续招募有网文深度阅读经验的同学。 每期真人测评的分数与评语都来自 SoloEnt 社群的资深读者和测评员。

加入测评团 →
点菜

下一期想看什么测评?

想看测评什么品类,什么模型,或什么写作场景,快告诉我们吧。