AI Tone 术语(英文) — 参考
本文档列出了与以下内容最相关的英语词汇模式: AI 生成的学术散文,以及推荐的每个文档出现次数 预算。配套文件 tone-thresholds.yaml 是权威的 deai_check.py 消耗的源。
如何执行阈值
deai_check.py读tone-thresholds.yaml在启动时。- 中的每个词
term_thresholds:触发一个[Script] LOW追踪一次 每个文档的计数超过列出的值。 - 计数不区分大小写,并且字边界与可见散文相匹配 (引文、参考文献、数学、评论首先被删除)。
- 通过编辑 YAML 进行覆盖;此 MD 文件仅是文档。
维护节奏(此列表是快照,而不是最终状态)
这个单词列表捕捉的是_当前_AI 语气的说法,而不是永久的事实。正如言语 例如delve和pivotal被广泛命名,细心的作者对其进行过滤, 它们的频率下降,而人工智能偏爱的新词不断出现。重新检查一下这个 大约每 6 个月列出一次,针对过多的词汇进行研究并修剪或添加 因此,不要将其视为冻结的。
- 上次审核时间:2026 年 6 月
- 资料来源:Kobak 等人,_Sci。高级_2025;耿与特罗塔 2025
AI高频词汇
这些词并没有被禁止。谨慎使用时它们很有用。这 阈值是审稿人可能标记写作的点 作为模板。
| 单词 | 临界点 | 为什么这很重要 |
|---|---|---|
| 重要的 | 5 | 通常隐藏缺失的效应大小或 p 值 |
| 综合的 | 3 | 营销语言;单项研究很少能赚到钱 |
| 有效的 | 5 | 没有基线比较的廉价声明 |
| 小说 | 4 | 除非新颖性被命名,否则审稿人会对这个词打折扣 |
| 强壮的 | 4 | 需要证明该主张合理的扰动/噪音水平 |
| 重要的 | 5 | 替换为有风险的东西 |
| 各种各样的 | 5 | 模糊量词;通常可以用一个数字来修复 |
| 一些 | 5 | 模糊量词 |
| 很多的 | 3 | 模糊量词;几乎总是可以用计数代替 |
| 此外 | 3 | 衬垫连接器;通常标志着无内容添加 |
| 而且 | 3 | 衬垫连接器 |
| 尤其 | 3 | 当内容确实值得注意时,很少需要“值得注意” |
| 卓越 | 3 | 编辑语言;让数据承载主张 |
| 引人注目地 | 3 | 与上面相同 |
| 明显的 | 3 | 过度自信的对冲 |
| 明显地 | 3 | 过度自信的对冲 |
| 清楚地 | 4 | 过度自信的对冲 |
突发性(段落开头重复)
当三个或更多连续段落以相同的两个开头开始时 令牌后,脚本会发出 burstiness 跟踪。典型违法者:
- “我们建议……”/“我们建议……”/“我们建议……”
- “在这个……”/“在这个……”/“在这个……”
- “此外,……”/“此外,……”/“此外,……”
补救措施是用不同的语法重写至少一个开场白 形状(从句、介词短语、对比连接词)。
清嗓子的短语
占据段落第一句但不表达的短语 信息。默认模式集涵盖:
In order to better ...In this section, we ...It is worth noting that ...It should be noted that ...As mentioned earlier ...- 领先的话语标记:
Notably,,Furthermore,,Moreover,,In summary,,To summarize,
每个触发器都是指向违规行的单个 [Script] LOW 跟踪。
标点符号模式
- 多于
max_em_dashes_per_doc长破折号 (---或者—)跨越 文档 → 第一次出现时的聚合跟踪。 - 身体部分中的任何
!(摘要到结论)→ 每个痕迹 发生。内联代码、数学和注释被排除在外。
超出范围
此处有意不强制执行以下内容:
- 句子级语法(由
analyze_grammar.py处理)。 - 引用密度(由
verify_bib.py处理)。 - 截面结构(由
check_format.py处理)。 - 领域特定术语,位于
forbidden-terms.md中。