惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recent Announcements
Recent Announcements
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog
T
The Blog of Author Tim Ferriss
J
Java Code Geeks
腾讯CDC
D
Docker
G
Google Developers Blog
D
DataBreaches.Net
雷峰网
雷峰网
Blog — PlanetScale
Blog — PlanetScale
S
SegmentFault 最新的问题
The Cloudflare Blog
有赞技术团队
有赞技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Stack Overflow Blog
Stack Overflow Blog
大猫的无限游戏
大猫的无限游戏
量子位
美团技术团队
aimingoo的专栏
aimingoo的专栏
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Engineering at Meta
Engineering at Meta
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More

暗无天日

读:AI Agent 安全日志——从可见性与隐私的两难说起 - 暗无天日 读:AI Agent 生产化——一份从原型到上线的速查清单 - 暗无天日 读:50 条 Claude Code 技巧——一个工程经理的六个月使用心得 读:AI 辅助开发为什么让 E2E 测试更有价值 - 暗无天日 读:在Emacs中使用Claude Code(Spacemacs适配版) - 暗无天日 Claude Code 背后的工程哲学——读 Agent Harness Engineering 读:Agent Harness Engineering——AI 智能体不只是模型,还有套件 - 暗无天日 browser-harness:让 AI 直接接管你的浏览器 - 暗无天日 读:Security-First CI/CD —— DevSecOps 自动化实践指南 TIL: 数字小键盘的小数点陷阱与行内算术求值 - 暗无天日 读:Immutability 不是万能药,它是一种权衡 - 暗无天日 Conducty:给 Claude Code 加上项目记忆和并行执行能力 - 暗无天日 读 — GitHub Trending 里的 Claude Code 技能包 读 — Prompt Caching 省钱指南 TIL: Emacs 中那些跟鼠标配合的冷门快捷键 - 暗无天日 读:Anvil——把 Emacs 变成 AI 的工具服务器 读:Emacs 代码折叠终极指南 - 暗无天日 读:Clojure 搭车客指南 - 暗无天日 git推送失败后恢复仓库损坏的完整记录 - 暗无天日 多智能体系统的两个有效模式——以及对 Claude Code 用户的启示 - 暗无天日 用 Org Babel 写 Literate 博文:扩展执行 + 定制导出 proced:Emacs 内置的进程查看器 - 暗无天日 从 proced 定制中学到的 Elisp 模式 读:让 Emacs proced 在 macOS 上显示 CPU 和内存 异步编程的函数着色税 - 暗无天日 链式调用的代价:JavaScript 和 Clojure 的共同教训 - 暗无天日 hyperfine:命令行基准测试工具 - 暗无天日 管道中的变量去哪了?——子 shell 作用域陷阱 - 暗无天日 开源包装器的信任陷阱:四个危险信号 - 暗无天日 程序员愿意为 AI 写文档,却不愿为同事写 - 暗无天日
AI写作的语言指纹——如何让文字不那么像机器 - 暗无天日
2026-04-30 · via 暗无天日

Reddit 用户在 r/ChatGPT 版块贴出了一张数据图:美国大公司文档中"不是 A,而是 B"这个句式的使用量,在 2024 年和 2025 年分别翻了一番。评论区迅速从震惊变成集体恐慌,因为大家发现自己写的东西也在不知不觉中被这种句式殖民了。

原文链接

这篇文章整理了 AI 写作中最容易被识别的语言特征,解释了 AI 为什么会形成这些特征,并给出去除 AI 感的实操方法。

AI 写作的六个语言标记

1. "不是 A,而是 B"句式

先否定一个常见认知,再抛出修正说法。这个修辞手法本身没问题,但 AI 在几乎所有回答中都使用它。Reddit 用户把它叫做"否定平行结构"。当它从"偶尔用来强调"变成"每次都用来组织观点"时,就变成了识别 AI 的金标准。

2. 长破折号(em dash)

AI 极度偏爱长破折号,经常在一个段落里出现多次。人类写作者也用长破折号,但频率远低于 AI。一位 Reddit 用户说他每次把 ChatGPT 的回答粘贴到邮件里,都会手动把长破折号换成普通连字符,就像"狐狸掩盖自己的踪迹"。

3. "重要的是注意到"等过渡词

AI 喜欢用"重要的是注意到""值得指出的是""事情是这样的"这类过渡词来为观点建框架。人类在自然对话中会直接说事,不会先宣布"接下来我要说一个重要的事情"。

4. "悄悄地做某事"

"X 在悄悄地做 Y",这个表达在 AI 生成的商业写作中出现频率极高。本来用于描述低调但重要的趋势,现在已经被用成了一种万能修辞。

5. 三段式结构

AI 的典型段落结构是:先声明观点,然后用三个论据支撑,最后总结。Reddit 用户吐槽说:"事情是这样的,后面跟着一个结构完美的三段式解释,根本没有人会真的这样打字。"

6. 单句成段

为了强调,AI 经常把每句话写成独立段落。这种格式在营销文案中本有效果,但 AI 把它当成了默认输出模式,导致到处都是这种碎片化排版。

AI 为什么会形成这些特征

理解原因有助于有针对性地修改。AI 的语言风格来自四个层面的叠加:

  1. *概率安全优先*:AI 优化的是"大概率正确",并非"风格多样"。训练过程中,那些在各种上下文中都安全的表达方式会得到更高的概率权重。结果是,模型的输出风格是所有训练数据的统计平均值,技术上来自很多源头,感觉上非常重复。
  2. *RLHF 的风格滤镜*:RLHF(基于人类反馈的强化学习)是一种训练方法,先让人类标注员给 AI 的多个回答打分排序,再用这些评分数据调整 AI 的行为,让输出更符合人类偏好。效果是让 AI 更礼貌、更安全、更易读,但副作用是把风格推向一个"安全的中间值",过滤掉有个性的表达。这相当于给 AI 套了一件灰色制服,过滤掉有趣但可能出格的表达,把输出推向可预测的短到中等长度句子、明确的过渡词、最低限度的歧义。
  3. *逐词生成的惯性*:AI 每次只预测下一个最可能的词。一旦句子以一种结构开头,后续的词会倾向于维持这个结构。人类可以在句子中间突然转折,AI 很少这样做,因为它被训练成追求语法完美和逻辑连贯。
  4. *没有持久的个人记忆*:每个会话都是全新的,AI 不会像人类那样在多年写作中积累独特的习惯和风格。所以你反复使用 AI 时,感受到的只是统计模型在重复它最擅长的模式,根本谈不上有个性的写作者在进化。

去除 AI 感的实操方法

写完后搜索这些关键词

Reddit 用户 rafio77 的做法很实用:"我现在每稿都用 Ctrl+F 搜索,不是...而是、长破折号、以及'事实上'开头的句子。"这是一个标准的三件套检查清单。建议扩展为以下搜索项:

  • 不是...而是
  • 长破折号
  • 重要的是 / 值得注意的是 / 事情是这样的
  • 悄悄地
  • 事实上

用简单的替代方案替换

长破折号通常可以用逗号、冒号或分号替代。"不是 A,而是 B"可以改为直接陈述 B,或者用"但"字连接。"重要的是"这类过渡词直接删除,不会影响语义。

故意制造不完美

AI 最大的破绽是过于完美。去除 AI 感最有效的方法是引入人类写作中常见的"不完美":

  • 变化句子长度:用很短的句子打断长句的节奏
  • 允许口语化表达:偶尔用一些不够正式但更自然的说法
  • 不要每个观点都建立框架:直接说,不要先预告"我要说一个重要的观点"
  • 允许段落之间有不那么完美的过渡

要求 AI 模仿特定风格

如果你用 AI 辅助写作,可以在提示词中加入风格要求:使用碎片化句子、故意变化句子长度、模仿某种特定口吻。AI 能做到这些,只是默认不做,因为这些风格不够"普遍安全"。

总结

AI 的语言指纹是一整套表达模式的同质化,远不止某一个词或某一种句式。你堵住了"不是...而是"这个句式,还有长破折号;改掉了长破折号,还有过渡词;改掉了过渡词,还有三段式结构。所以去除 AI 感只改掉一两个特征是不够的,得让自己的写作回归到人类写作的本质特征:不完美但自然,多变但连贯。

就像一位 Reddit 用户说的:"'什么让写作看起来像人'这个问题以前是一个文学理论辩论。现在它只是一个星期二。"