最近在titiai.cn上对比了几个模型的创作能力,做了一个有意思的实验:给了同一个故事大纲,让 GPT-5.6、Claude 4.8 Opus、Gemini 3.5 分别写 5000 字的短篇小说。三个主要人物、两条故事线、一个反转结局,悬疑风格。

结果出来之后我愣了一下——同一个大纲,三个模型写出了三种完全不同的"文学性"。
GPT-5.6:流畅但安全
GPT 写出来的东西读起来最顺,句子流畅,节奏感好,不会出现让你卡壳的段落。但问题是它太"安全"了。悲伤的场景用"眼眶泛红",紧张的场景用"心跳加速",都是模板句式。你看完觉得"写得挺好的",但不会被打动。
它的长文本一致性最强,5000 字写完人物性格没有偏差,伏笔都回收了。但人物偏扁平,你能记住角色做了什么,但记不住角色是什么样的人。
Claude 4.8 Opus:细腻且有深度
Claude 写出来的东西最让我意外。它不堆形容词,场景描写有层次感——不是"房间很暗",而是"窗帘拉着,只有门缝透进来一线光,照在桌角那杯凉了的咖啡上"。
最厉害的是人物塑造。一个外表强硬的角色,它通过一个微小的动作暗示内心的脆弱——"她把信封翻过来,指尖在封口处停了两秒,最终没有拆开"。这种细节暗示比直接写"她内心很纠结"高级太多。
但偶尔会在细节上出现微小矛盾,比如第三章说角色穿蓝色外套,第五章变成了灰色。
Gemini 3.5:简洁但单薄
Gemini 写出来的东西最简洁,没有废话,节奏快。但场景描写偏平,对话风格趋同——你能分清谁在说话,但说不出谁说话有什么特点。
超过 3000 字后问题开始暴露,人物性格容易偏离,伏笔偶尔遗忘。它更适合写短篇或者做润色,不适合撑长文本。
三种文学性的本质区别
GPT 像一个熟练的写手,什么都能写,但缺少个人风格。Claude 像一个有天赋的作家,能通过细节打动人,但偶尔粗心。Gemini 像一个高效的编辑,删减能力强,但原创深度不够。
如果要写长篇小说,我选 Claude 写正文,GPT 写大纲,Gemini 做润色。三个搭配用,比单用一个效果好。
同一个故事,三种文学性。AI 写作已经不是"能不能写"的问题了,而是你想要什么样的"写"。