Opus 5.5 偏爱“这很重要”:揭秘最新 AI 写作特征
随着大语言模型生成的文本无处不在,人们迫切地希望能辨认出它们的踪迹。虽然早期标志(如破折号和“delve”一词)早已消失,但研究人员表示,AI 模型在写作时仍会保留许多习惯性的特征。
营销公司 Graphite 一项新研究考察了前沿模型的写作习惯,挖掘出各模型偏爱的词汇和短语。尽管破折号等旧有标志已被剔除,模型仍倾向于使用对比强烈的句式,且不同版本的模型展现出各自独特的怪癖。最让人意外的是,这些标志的特征范围之广。Graphite 发现了 13,000 个短语,它们在 AI 内容中的出现频率至少是人类内容的两倍——这就是他们定义的“标志”。
“事实证明,Claude 模型的词汇分布正在逐渐接近人类分布,”Graphite 首席 AI 官 Greg Druck 告诉 TechCrunch,“而 GPT 模型的分布则离人类越来越远。”
大规模研究 AI 生成写作需要精心设计实验。Graphite 首先以 10,000 篇在 ChatGPT 发布前出版的文章作为语料库,作为人类生成的对照组。随后,研究人员让不同的 AI 模型根据摘要重写这些文章,尽可能消除源材料的偏差。拥有来自人类和各个模型的对等样本后,他们就能比较特定词汇和短语在 AI 写作中出现的频率,以及更宏观的句式结构模式。
根据 Graphite 的研究结果,Claude Opus 5.5 最显著的特征是单词“dependable”(可靠),其出现频率比人类样本高出 23 倍。虽然 Opus 5.5 现在避免了“它不是 X,它是 Y”的句式,但它仍然倾向于说某物“不仅仅是 X,而是 Y”。
最重要的是,Opus 喜欢告诉你事物为何重要。它在文中使用“this matters”(这很重要)的频率比人类写作高出 116 倍,而“why X matters”(X 为何重要)的出现频率也高出 92 倍。
OpenAI 的 Astra 则有另一套破绽。这个模型喜欢描述话题的“另一个维度”,还常用“可能带来”“能够带来”这类说法来给论断留余地。它最大的特征是 Graphite 所说的“纠正式表述”——把一个话题定义为“不只是 X”,或作为一种替代方案提出,“而不是依赖 X”。根据 Graphite 的研究,这类句式在 Astra 生成的文字中出现的频率是真人写作的 100 多倍。
值得注意的是,各家前沿实验室似乎都对“模型过度使用破折号”这一说法做出了回应。在 Graphite 的样本中,Opus 5.5 使用破折号的频率比 Opus 5 降低了 99%。Astra 现在的使用频率比人类样本低 88%,而 Gemini 3.1 Pro 几乎已经完全不再使用破折号。
不过 Graphite 指出,虽然具体的破绽在变,但破绽的总量基本没变。“并不是这些破绽在减少,”Druck 告诉 TechCrunch,“实验室确实去掉了最广为人知的那几个,但新的又会冒出来,而且每个版本的模型都有自己的破绽。”
考虑到各家实验室如此注重让模型写出像人一样的文字,这些破绽如此顽固着实令人意外。在 Opus 5.5 的发布说明中,Anthropic 吹嘘这个模型“比之前的模型表达更自然”,早期用户“觉得它的文字更清晰、更易读”。
OpenAI 在发布 GPT-6 的 Sol 和 Luna 版本时也说过类似的话,称用户可以“期待看到更清晰的表达、更少的行话、更少的别扭措辞”。
但 Druck 对实验室能否彻底消除这些特征性措辞持怀疑态度。
“我有一个大致的猜测:实验室对这些东西的控制能力,可能没有你想象的那么强,”Druck 说,“这些是拥有数十亿参数的巨型模型,而他们能跑的测试数量是有限的,总会有漏网之鱼。”