< Back to articles
ARTICLE.SYS
PROJECT NOTES

humanize-chinese:给中文 AI 文本去痕迹

检测加改写一步到位的中文去 AI 味工具箱。做它的过程中我们发现:主流 AI 检测器对 2026 年的模型已经接近失效。

AI 写的中文有一股味儿:「值得注意的是」「总而言之」、排比句、每段三句话。humanize-chinese 做两件事:把这股味儿检测出来,然后改写掉。纯本地运行,不需要 API Key。

v6 重构学到的东西

今年 8 月我把它整个重构了一遍,用 2026 年的主流模型重新建了基准语料。两个发现值得说:

改写质量能量化。 v5 的改写产物拿去盲评,通顺度中位数只有 2.0 分(5 分制),还有病句;v6 之后中位数拉到 4.0 以上,病句清零。去 AI 味不能以牺牲通顺为代价,否则只是换了一种难读。

检测这条路快走死了。 我们的检测器对 2026 年模型的分辨能力(AUC)只有 0.645,接近瞎猜;在博客语料上甚至是反的。这不是我们检测器弱——是新一代模型的文本分布和人类写作重叠得越来越狠。所以这个项目的重心从「检测」转向了「改写」:与其判断是不是 AI 写的,不如直接把它改得像人写的。