Files
admin 777f7fe5d0 重开仓库内容:改推五个技能(browser-harness / humanizer / humanizer-zh / product-planning / session-mechanism)
按授权清空原有内容后重新提交(原 oil-ui-pro 一并移出,可从历史恢复)。
browser-harness 剔除 .venv 等运行环境;根 .gitignore 补记 .venv/ 与 node_modules/。
2026-10-07 16:06:02 +08:00

131 lines
14 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 中文原生 AI 痕迹模式(实验性附录)
# Native Chinese AI-Writing Patterns (Provisional Appendix)
> ## ⚠️ 实验性 · PROVISIONAL — 请先读这里
>
> **中文:** 本附录(ZH1–ZH15)是作者的**临时草稿**,**尚未经过中文母语写手校验**。它与英文正式目录(P1–P53)**不在同一成熟度**,不应被当作已验证的规则使用。此外,英文用的 **burstiness(句长波动)/ perplexity(用词可预测性)指标不能直接迁移到以字为单位、不用空格的中文** —— 中文里四字成语的密度、句读节奏往往比词长方差更能反映 AI 痕迹。
>
> **English:** This appendix (ZH1–ZH15) is the author's **provisional draft**. It has **NOT been validated by a zh-fluent writer**, is **not at parity** with the English catalog (P1–P53), and should not be treated as a proven ruleset. Also: **burstiness and perplexity do not port cleanly to character-based, space-free Chinese** — in Chinese, four-character-idiom density and clause rhythm are usually stronger tells than sentence-length variance.
>
> **两个未验证的假设 / Two UNVERIFIED hypotheses:** ZH13(「的/了」虚词过度使用)和 ZH14(翻译腔)是**推测**,**目前没有任何竞品会显式检测它们**(翻译腔仅通过外来语黑名单被间接触及)。列在这里是为了记录假设,不是因为它们已被解决。ZH13 (的/了 particle overuse) and ZH14 (translationese) are **speculative — no competitor detects them explicitly**; kept here as flagged hypotheses, not solved patterns.
---
## 目录 · Contents
- [怎么用这份附录 · How to use](#怎么用这份附录--how-to-use)
- [核心原生模式 · Core native tells (ZH1-ZH7)](#核心原生模式--core-native-tells-zh1zh7)
- [英文模式的中文对应 · Analogs of English patterns (ZH8-ZH12)](#英文模式的中文对应--analogs-of-english-patterns-zh8zh12)
- [未验证假设 · Unverified hypotheses (ZH13-ZH14)](#未验证假设--unverified-hypotheses-zh13zh14)
- [最深层痕迹 · The deepest tell (ZH15)](#最深层痕迹--the-deepest-tell-zh15)
- [来源与致谢 · Sources](#来源与致谢--sources)
---
## 怎么用这份附录 · How to use
跑中文改写时,除了英文的 P1–P53,再扫描下面这些原生中文模式。格式和 SKILL.md 一致:**名称(中/英)· 触发信号 · 修正 · 一组前后对比**。中文改写里**可以**使用破折号(——),这份文件不受仓库禁破折号 CI 的约束;但仍应避免像 ZH5 描述的那样滥用。
分类:ZH1–ZH7 是原生中文核心痕迹(来自竞品研究,证据较扎实);ZH8–ZH12 是英文模式的中文对应(对应关系已标注);ZH13–ZH14 是未验证假设;ZH15 结合了「立场缺失」这一最深层痕迹。
---
## 核心原生模式 · Core native tells (ZH1–ZH7)
**ZH1:四字词语堆砌 / 空心金句 · Four-character idiom stacking / hollow slogans.** 用一连串四字成语、对仗短语堆出「文学感」,或写一句听起来很像可以摘抄、实则什么都没说的口号。**修正:** 删掉空心金句和堆砌的四字词,只保留「带场景、带代价、带判断」的压缩句 —— 有具体画面、有代价权衡、有明确态度的那种。**触发信号:** 连续多个四字成语(如「日新月异、方兴未艾、蓬勃发展、势不可挡」)、对仗排比、「不禁让人感叹」、听起来能裱起来但没有信息量的句子。
> **AI:** 在这个日新月异、瞬息万变的时代,技术的浪潮波澜壮阔、势不可挡,深刻地改变着我们的生活方式。
> **人:** 过去三年,我们把部署时间从两小时压到了九分钟。代价是每次发布都得盯着监控,怕它崩。
**ZH2:首先/其次/最后 罗列 · Enumeration scaffolding.** 机械地用「首先……其次……再次……最后……」搭骨架,是英文 `first, second, finally` 脚手架的中文指纹。**修正:** 删掉这些连接词。让内容本身的逻辑决定顺序,或者干脆分点但不加套话式序词。**触发信号:** 首先、其次、再次、最后、一方面……另一方面、综上所述、总而言之。
> **AI:** 首先,它提升了效率。其次,它降低了成本。最后,它改善了体验。
> **人:** 它快了三倍,服务器账单少了一半。用户没抱怨,这是头一回。
**ZH3:套话开头 · Cliché openers.** 用万能空话开场,句子换个主语就能套到任何文章上。**修正:** 直接从最具体的那句话开始 —— 一个数字、一个场景、一个判断。**触发信号:** 在当今……的时代、随着……的飞速发展、在数字化浪潮下、众所周知、随着科技的不断进步。
> **AI:** 随着人工智能的飞速发展,各行各业正在经历前所未有的深刻变革。
> **人:** 上周我用 AI 重写了一份 API 文档,母语审稿人五秒就退回来了,说「一股机翻味」。
**ZH4:AI 高频词黑名单 · AI-vocabulary blacklist.** 中文 AI 文本反复使用的一批「书面腔 + 外来语翻译腔 + 企业黑话」高频词。**修正:** 换成日常说法,或直接删。**触发信号(致命黑名单):** 此外、值得注意的是、至关重要、深入探讨、赋能、抓手、闭环、底层逻辑、颗粒度、打法、格局、生态、织锦、挂毯、相互作用、凸显、彰显、标志着、令人叹为观止、坐落于、不可或缺、保驾护航、量身打造。(「织锦/挂毯」是英文 tapestry 的翻译腔,「格局/生态」是 landscape/ecosystem 的对译。)
> **AI:** 此外,构建数据闭环、打通底层逻辑,对于赋能业务增长至关重要。
> **人:** 我们把三个系统的数据接到了一起,这样退款不用再手动对账了。
**ZH5:破折号(——)滥用 + 全角/半角标点混用 · Em-dash overuse + full/half-width punctuation mixing.** 破折号当万能连接符到处用(英文 P13 的中文对应),外加中文里混进英文的逗号、括号、引号,或全角半角乱套。**修正:** 破折号只在真正需要「解释/转折/停顿」时用一次;标点统一用中文全角(「」『』,。),别让英文标点(, . " " ())漏进中文正文。**触发信号:** 一段里多个 ——、中文里出现 English-style 逗号或引号、`(半角括号)` 混在中文里、句号用「.」。
> **AI:** 这个方案——非常创新——它将——从根本上——改变行业(尤其是效率方面).
> **人:** 这个方案能省一半时间。代价是前期要重写数据层,大概两周。
**ZH6:设问-回答套路 · Rhetorical question-answer over-patterning.** 反复用「为什么……?因为……」「是什么让它与众不同?答案是……」这种自问自答的机械节奏(区别于英文 P27 的疑问句标题)。**修正:** 偶尔一次是修辞,通篇就是套路。把问句改成直接陈述。**触发信号:** 为什么……?因为、是什么造就了……、答案是、你可能会问、那么,如何做到呢?
> **AI:** 为什么它如此高效?因为它采用了先进的架构。那么,它安全吗?答案是肯定的。
> **人:** 它高效,是因为绕过了那一层缓存。安全性我还没压测过,别在生产上用。
**ZH7:口号式乐观结尾 · Slogan-style optimistic endings.** 结尾一律拉高到空洞的乐观(英文 P24 的中文对应,触发词不同)。**修正:** 用一个具体的下一步、一个待解问题、或一句真实的判断收尾,别喊口号。**触发信号:** 让我们拭目以待、未来一片光明、必将产生深远影响、前景无限、值得期待、共同书写新篇章。
> **AI:** 我们有理由相信,在各方的共同努力下,未来必将一片光明,让我们拭目以待。
> **人:** 下一步要解决冷启动那 800 毫秒的延迟。搞不定的话这套方案就得推倒重来。
---
## 英文模式的中文对应 · Analogs of English patterns (ZH8–ZH12)
**ZH8:意义拔高 / 象征化 · Significance inflation & symbolic gloss.**(对应 P1 / P40)给平常的事实硬安上「时代意义」,用「标志着、彰显了、体现了、象征着、折射出」把小事说成大势。**修正:** 直接说这东西是什么、做了什么,删掉「代表了什么」的评论。**触发信号:** 标志着、彰显、体现了、象征着、折射出、具有里程碑意义、开启了新篇章、树立了标杆。
> **AI:** 这次更新彰显了团队精益求精的工匠精神,标志着产品迈入了全新的时代。
> **人:** 这次更新修了那个登录会掉线的 bug,另外把加载调快了一点。
**ZH9:书面语套话 / 冗余虚词 · Formal filler.**(对应 P18 / P22)用一堆书面腔的填充短语撑场面,删掉不影响意思。**修正:** 直接删。**触发信号:** 值得注意的是、需要指出的是、不难发现、在一定程度上、从某种意义上说、总的来说、换言之、众所周知、显而易见。
> **AI:** 值得注意的是,在一定程度上,这个功能从某种意义上说提升了用户体验。
> **人:** 这个功能让结账少点一次。转化率涨了 4%。
**ZH10:排比堆砌 / 强凑三段 · Forced parallelism (rule of three).**(对应 P10)中文里滥用排比和「不仅……而且……」的三连对仗,凑气势而非讲内容。**修正:** 保留一个最有信息量的分句,砍掉为对仗而对仗的部分。**触发信号:** 三个结构相同的短句连排、不仅……而且……更、既……又……还、A 是……,B 是……,C 是……(三项工整)。
> **AI:** 它不仅高效,而且稳定,更兼具优雅、简洁与可扩展性。
> **人:** 它够快,也够稳。优不优雅我不好说,反正没再半夜被叫起来过。
**ZH11:车轱辘话 / 同义反复 · Restating the same point (treadmill).**(对应 P43)用「换句话说、也就是说、简而言之」把同一个意思原地绕好几圈。**修正:** 保留最清楚的一版,删掉重复。**触发信号:** 换句话说、也就是说、简而言之、说白了、归根结底(后面跟的其实是前面刚说过的话)。
> **AI:** 它能提升效率。换句话说,它让工作更快。也就是说,它节省了时间。
> **人:** 它把导出报表的时间从十分钟压到了一分钟。
**ZH12:加粗滥用 / emoji 小标题 · Boldface & emoji-header overuse.**(对应 P14 / P28)几乎每个名词都加粗,每个小标题前挂 emoji,Markdown 记号漏进本该是纯文本的地方(微信、邮件)。**修正:** 加粗只留给真正的关键词,删掉装饰性 emoji;发到不支持 Markdown 的地方就把 `**` 去掉。**触发信号:** 一段里多处 **加粗**、🚀✨🔥 开头的小标题、纯文本渠道里出现 `**` `##`。
> **AI:** 🚀 **核心优势**:我们的**产品**拥有**强大**的**性能**和**卓越**的**体验**!
> **人:** 核心优势就一条:冷启动比上一版快了三倍。
---
## 未验证假设 · Unverified hypotheses (ZH13–ZH14)
> ⚠️ 以下两条是推测,**没有任何竞品显式检测它们**。请当作待验证的方向,不要当规则用。These two are speculative; no competitor detects them. Treat as open hypotheses, not rules.
**ZH13:「的/了」虚词堆叠 · Overuse of 的/了 particles.**(未验证 · UNVERIFIED)假设:AI 中文倾向堆叠「的」字定语、句末机械加「了」,读起来黏、拖。**修正(暂拟):** 拆掉多层「的……的……的」定语,改成短句;删掉不必要的「了」。**触发信号(暂拟):** 一个名词前挂三层以上「的」、每句都以「……了」收尾。**注意:这条尚无证据支撑,可能是伪模式。**
> **AI(假设):** 这是一个基于最新技术的、经过精心设计的、能够满足用户需求的解决方案了。
> **人:** 这方案用了新的检索层,专门解决搜索慢的问题。
**ZH14:翻译腔 / 英式长句 · Translationese / calqued English syntax.**(未验证 · 仅间接触及 · UNVERIFIED)假设:AI 中文常带英文语法的影子 —— 被动句过多、从句套从句的长句、「一个……」滥用(英文 "a/an" 直译)、「进行 + 动词」("make a decision" → 「进行决策」)。现有工具只通过外来语词黑名单(见 ZH4)间接碰到它,没人专门检测句法层面的翻译腔。**修正(暂拟):** 拆长句为短句,把被动改主动,删掉冗余的「一个」和「进行」。**触发信号(暂拟):** 「被……所……」、过长的定语从句、「一个 + 名词」高频出现、「进行/给予/作出 + 抽象名词」。
> **AI(假设):** 一个能够被用户所信赖的、对数据进行有效处理的系统被我们所构建了出来。
> **人:** 我们做了个处理数据的系统,用户反馈还挺信得过。
---
## 最深层痕迹 · The deepest tell (ZH15)
**ZH15:立场缺失 / 温吞表达 · No stance / lukewarm hedging.**(对应 P38 段落可打乱性 + 英文版 North Star)最深的 AI 痕迹不是某个词,而是**通篇没有一个能被反驳的观点** —— 面面俱到、两边都对、段落顺序打乱也不影响论证。一句话概括:不能被反驳的观点就不叫观点,叫温吞的空气。**修正:** 逼出一个站得住但足够鲜明的立场,点名一个具体对象或反方,让读者知道作者到底站哪边、要付什么代价。**触发信号:** 全文没有一句可争论的判断、每个观点后面都跟「当然,也有另一种看法」、段落调换顺序读起来一样通顺、结论谁都不得罪。
> **AI:** 关于是否采用微服务,业界看法不一。它既有优势,也有挑战,需要根据具体情况权衡,没有绝对的对错。
> **人:** 团队少于十个人就别上微服务。我们试过,光维护那套服务发现就吃掉了两个人。等你真被单体拖垮了再拆也不迟。
---
## 来源与致谢 · Sources
- **英文正式目录** —— 见 [`../SKILL.md`](../SKILL.md)(P1–P53)。本附录是作者实验性的中文补充草稿,**不是**替代。
给 integrator 的提醒:ZH13、ZH14 无证据支撑,公开前建议找中文母语写手校验整份附录;burstiness/perplexity 相关表述在中文语境下需保留「不能直接迁移」的说明。