皮尤研究中心做了一个对比:把今天的互联网和 2023 年的快照放在一起,看那些被认为是 AI 腔的特征在网页上出现的频率变化。
破折号是最显眼的一个。它的使用密度明显上升——不是某几个站点,是整体分布的移动。除此之外还有一批被识别出的模式化表达,同样在变得更常见。
这事的荒诞之处在于因果链是闭环的。模型从人写的文本里学到了某些偏好,人拿模型生成内容发到网上,下一代模型从这些内容里继续学,偏好被放大。几轮之后,AI 腔不再是 AI 的特征,而是互联网的特征。到那时候你没法再靠文风判断一段文字是不是机器写的——不是因为 AI 学会了写得像人,而是因为人开始写得像 AI。
顺带被搞坏的是 AI 检测工具。这类工具的原理基本都是统计特征——句长分布、词汇丰富度、特定标点和连接词的频率。当整个语料库的基线漂移之后,检测阈值就失效了。学术圈和招聘环节里那些用 AI 检测器判卷子、筛简历的做法,误伤率只会越来越高。有人本来就爱用破折号,现在他要为此付出代价。
还有个更实际的影响是搜索。搜索引擎和大模型都在想办法识别并降权 AI 批量生成的低质内容,但如果高质量的人类写作和低质量的机器生成在文体特征上正在收敛,这个识别任务就退化成了纯粹的语义质量判断——而那个恰恰是最难自动化的部分。
短期内能做的事不多。要是你在意自己的文字不被误判,最好的办法可能是写得更不规整一点:句子长短别太均匀,别每段都是三句话,把那些万能过渡词删掉。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






破折号变多了:AI 写作正在改变整个互联网的文风