资讯›热点›正文

Graphite研究识别约1.3万个AI写作特征词,模型文风指纹难抹除

一叶知秋 2026-10-3 11:45 阅读 0 评论 1热点
营销科技公司Graphite发布一项针对大模型写作习惯的研究,对比1万篇ChatGPT出现前的人类文章与AI重写版本,识别出约1.3万个在AI文本中出现频率至少翻倍的特征词与句式,发现即便去掉破折号等明显痕迹,各模型的文风指纹仍在演变而非消失。

营销科技公司Graphite发布了一项针对大模型写作习惯的研究。团队收集了1万篇在ChatGPT出现前发表的人类文章作为对照,再让多个前沿大模型基于摘要重写这些文章,从而排除题材差异、只比较用词与句式。结果显示,约有1.3万个短语在AI生成文本中的出现频率至少是人类写作的两倍,Graphite把它们称为AI写作的特征词(tell)。

Graphite研究识别约1.3万个AI写作特征词,模型文风指纹难抹除

研究还发现,不同模型的文风指纹各不相同。Anthropic的Claude Opus 5.5尤其偏爱用dependable一词,频率是人类作者的23倍,更频繁地使用这很重要、为什么X很重要来自我强调;OpenAI的Astra模型则习惯用并非简单地X、而不是依赖X这类纠正式句式。一个有趣的对比是:在去掉破折号这一最出名的痕迹后,整体可识别特征词的总数并未减少——旧痕迹消失,新习惯又冒出来。

Graphite研究识别约1.3万个AI写作特征词,模型文风指纹难抹除

Graphite首席AI官Greg Druck指出,各家实验室显然难以精确控制数十亿参数模型的表层用词,每次版本更新都会带来新的特征词。研究还观察到方向分歧:Claude系列正逐步靠近人类用词分布,而GPT系列反而越偏越远。这意味着,靠一份固定的AI词汇黑名单来做内容检测会越来越不可靠,检测工具恐怕得跟着模型版本不断重训。

这项研究对内容审核、学术诚信和教育场景都有现实意义。它提醒人们,AI文本的标志不是某一个标点或单词,而是一种统计残留——既不会因删掉破折号而消失,也难以被彻底抹除。对使用生成式AI的写作者而言,真正的做法是恢复个人的语气与具体细节,而非简单删除几个听起来像AI的词。大模型的能力在快速进步,但像人这件事,比想象中更难伪装。

读者评论 (1)

想参与讨论?请 登录 后发表评论。

  • 西
    西湖醋鱼2026-10-03 11:52

    删个破折号根本没用,AI那股"机器味"是刻在骨子里的,靠改词改句式真能骗过检测器