当互联网开始由AI书写:2026企业级AI合成数据污染、递归自噬、幻影共识与来源断链治理实战
2026年9月,当AI生成内容从"辅助写作"全面迈入"生态主体"的信息环境——互联网新增内容中超过六成全流程由模型生成、企业内部知识库中近八成文档由AI起草或摘要、分析师报告的第一稿与最后一稿都出自同一个模型家族、客服工单的处理记录由AI撰写并由AI再次检索——一种比数据投毒更"自愿"、比模型退化更"渐进"、比信息茧房更"彻底"的系统性风险正在瓦解"语料是现实的记录"这一根本假设:AI的输出流回互联网,互联网流入下一轮训练与检索,下一轮的输出再次流回——循环闭合的那一刻,语料不再是现实的采样,而是模型对自己上一句话的转述。这就是递归自噬(recursive self-consumption)。...