im-not-ai 韩语 AI 味分类候补池解析:taxonomy-candidates.md 的候补登记、实证门槛与升级机制
【免费下载链接】im-not-aiAI가 쓴 한글을 사람 글처럼 윤문하는 Claude 스킬 — Korean AI-text humanizer: detects and rewrites translationese, mechanical parallelism, and 71 other AI tells项目地址https://gitcode.com/gh_mirrors/im/im-not-ai点击查看免费下载本指南以 taxonomy-candidates.md 为主体讲解 im-not-ai 项目中korean-ai-tell-taxonomist维护的AI 味模式候补池候补如何登记、为什么必须用 2 件以上实证才能升级、pending/hold/promoted/rejected四状态如何流转以及候补最终如何进入分类体系本阵SSOT并驱动下游诊断与快速规则。读完你将理解该仓库从实盘发现新模式 → 候补积累 → 验证升级 → 生成规则文件的完整闭环并能自行阅读和评估候补表中的每一项。一、文件定位为什么候补池必须是一份可追踪的文件taxonomy-candidates.md是korean-ai-tell-taxonomist这一维护型 Agent 的待办清单与升级输入。它既不是分类体系本身也不是运行时规则而是介于实盘观察到的疑似新模式与正式纳入分类体系之间的缓冲区。这份文件之所以存在源于一次真实的工程教训。候补池最初放在_workspace/taxonomy_changelog.md但_workspace/目录是.gitignore目标——该文件虽然自称本阵变更的单一追踪源头却从未被提交于是每一轮记录只留在执行过任务的那台机器上。追踪文件必须随仓库版本化因此候补池被迁移到现在的 taxonomy-candidates.md。文档还澄清了一段历史v1.3 版本记录中提到的references/pattern-candidates.md、promotion-checklist.md、sample-collection.md三个文件实际并不存在仅存于分类体系变更历史中本文件就是它们的替代者。在 korean-ai-tell-taxonomist 的 Agent 定义中同样明确规定候补池与升级历史以references/taxonomy-candidates.md为正本追踪文件_workspace/taxonomy_changelog.md若存在仅供参考新的升级与驳回一律写入本文件的历史小节。与分类体系本阵的关系本文件是输入真正的输出是 ai-tell-taxonomy.md——10 大分类 × 85 个 AI 味模式活跃 84 A-17 hold的单一事实源SSOT。二者的关系可以用一条流水线概括实盘输入 → 观察疑似新模式 → taxonomy-candidates.md候补池 → 实证满足升级门槛 → ai-tell-taxonomy.md本阵 SSOT → build_quick_rules.py / build_diagnosis_rules.py 生成下游规则二、升级规则候补进入本阵的四道门槛文档在승격 규칙升级规则一节给出了候补晋升本阵的完整约束这些规则是理解整个候补池状态的前提1. 实证数量门槛2 件以上不同输入候补必须有至少 2 件来自不同输入的实证才能升级。同一模型、同一作者连续产出的结果只算 1 件——这是 v1.3.1 Gate 1.3 的分布保护机制防止单一来源的噪声污染本阵。README 的 v1.3 记录印证了这一机制회차 2外部媒体真数据中결국 文头断言 9 次X은 A가 아니라 B 否定-肯定对偶 7 次等 3 个强候选正是因为同一模型 同一记者系列而被 hold等待其他模型、其他作者的数据中复现后才可升级。2. ID 分配append-only禁止新增大分类候补的临时 ID如K-1、C-8-X在升级时改为现有大分类A~J下的子编号采取 append-only 方式追加严禁新建大分类。文档特别说明表中所有K-*都是临时 ID升级时须领取现有大分类的子编号。之所以禁止插入、只允许追加是为了保护模式 ID 的引用稳定性——ID 是诊断diagnostician与润色monolith调用之间传递的契约任意插入会造成 ID 漂移。这一点在 korean-ai-tell-taxonomist 定义中写得更明确保持既有 SSOT 的条目 IDA-1、A-2…新条目以最低位编号 append禁止插入——保护诊断、润色调用的 ID 交接契约稳定性。3. 严重度调整需要 3 件以上反证一旦某个模式的严重度S1 决定性 / S2 强 / S3 弱被设定调整它是非常保守的——需要3 件以上反证。学术锚点academic anchor的判定依据见 scholarship.md。4. quick 编排是独立标准升级 ≠ quick: true这是最容易误解的一条规则。候补即使升级进入本阵也不自动获得quick: true——新条目的默认值是false。能否进入 fastlight路径的快速规则册取决于 ai-tell-taxonomy.md 前言中定义的两条独立标准任务匹配校准中 AI 密度 人类密度依据tests/baselines/2026-08-29-task-matched-calibration.json优于 24 对的2026-08-23校准触发可能性——超过文档阈值的文档真实存在无法触发的规则每次调用都只会徒增成本。正因为quick判定独立于升级taxonomy-candidates.md中hold状态的C-8-META等条目即使未来升级仍需单独评估 quick 编排资格。状态机四态流转状态含义pending已有 1 件实证等待第 2 件及以上实证hold实证不足或判定保留分布未达标、反证存在、待重评条件触发promoted已反映进 taxonomy 本阵并记录版本rejected被驳回并入现有模式、实证反证等三、候补清单逐项解读13 个在册候补截至文件最新记录候补池共 13 项promoted 0 项。以下保留原表核心信息并逐项展开说明其技术内涵临时 ID模式实证来源状态下一步K-1列举分隔符过度替换——把多语节短语列举整体替换为间隔号·导致条目边界崩塌지역 안과 내원·정밀검사 결과·재검·추적afternoon-platform2026-09-22-001/02_detection.json、04_fidelity_audit.json· Claude strictpending升级时领取 C 或 J 的子编号。处方候选间隔号仅用于单词·短名词列举2 语节以上短语保持逗号C-11-XC-11连接语尾后逗号的例外条件——主语切换的从句边界、朗读无停顿 60 字 时保留逗号或句号切分上述 run公开发言、朗读区pending探讨在 playbook 的 C-11 配方中补充例外条件C-11-RLC-11 run-length 回归——删除逗号导致无停顿区间 41→56 字未达 60 字阈值而未被检测到增幅本身即信号z-beyond 冷读 2026-09-22naturalness-reviewerpendingmetric 候选run_delta润色前后最长无停顿区间增长率30% WARNC-8-XA가 아니라 B 否定-肯定对偶重复14 次——C-8 变种afternoon 2026-09-22-001GPT-优势签名hold与 v1.3.1 轮 2 hold 3 件同族。C-8 已吸收 2 次 阈值与 C-14需 gap 分析后判定是否重复J-3/C-6-X加粗标签— 说明 破折号定义公式6 次afternoon 2026-09-22-001pending位于 J-3破折号与 C-6 之间——gap 分析后领取子编号C-1-R列举凝聚崩塌反效果——移除 C-1 后若在预告句中新增修辞性数词세 가지数字承诺保留但履行标识消失z-beyond 冷读 2026-09-22fast → fidelity 移交 → naturalness S2pending处方候选修辞数词放入预告句时至少保留 1 个条目标识도·역시D-X-meta元话语开头·结算이 글에서는 …알아보겠습니다——普适性未判定z-beyond PRODUCTION_SPEC_v2 §2 T1010 篇 实测pending还需其他项目的 1 件实证当前只是本项目规则E-2-X言说动词终结偏重봅니다/살핍니다/설명합니다 100% 终结——E-2 变种z-beyond YTR-0037/38 2026-08-25pending与 E-2 是否合并的 gap 分析H-X-head移除 T10 后文头关键词偏重——元话语开头移除后主题词开头句比例 36→50%z-beyond 冷读 2026-09-22holdmetric 候选head_repeat_ratio——仅 WARN、禁止自动修改动摇文头会引回 H-1/A-16C-8-METAC-8 共现例外——否定对偶若与 ①对立隐喻点/线、工具/武器等把比喻词架在 A·B 轴上或 ②汉字·英文并记同句重叠则未达 2 次阈值也触发。处方分两阶段先移除并记再把比喻词替换为所指对象以解构隐喻轴#56eungwonkim2026-07 精读模式实战遭遇점(點)/선(線)实事故pending不触碰阈值v2.6.1 n532 附注勿降至 1 次只加条件性子句。还需 1 件实证D-COLLOC不存在的说法——搭配混杂造词混搭不搭配的搭配创造的表达#60nhleeclaw提交[S1 · estimated]无实测hold与主 D-8分裂句公式编号冲突需分配 D-15。赋予严重度前必须做对照语料实测——S1 是决定性信号的主张F-TAUTO同义反复并列叙述把相同含义并排两次#60nhleeclaw提交[S2 · estimated]无实测holdF-6 被 #141 预定为「实务未用汉字造词」→ 需分配 F-9。需实测A-17-들 复数后缀过度NMT 原文轮次v2.0 轮次学术依据强我方数据阳性 0hold重评条件在 NMT 原文轮次获得阳性。已登记本阵但处于 hold——在全 85 模式中位于活跃 84 之外值得注意的细节K-1 是过度修复的典型间隔号·本适用于单词或短名词列举把它套用到多语节短语会让条目边界模糊这个候补反过来约束润色行为不要制造新的 AI 味。C-11-RL 提出的是增量即信号思想run_delta指标衡量润色前后最长无停顿区间的增长率——即使增幅未跨过 60 字阈值未被检出越改越长这个方向本身就是值得 WARN 的信号。H-X-head 明确禁止自动修复移除元话语开头后主题词开头句比例上升但若去动摇文头会把 H-1文头连接词和 A-16代词的问题引回来因此该指标只用于告警。C-8-META 的阈值不可动原则v2.6.1 基于 n532 的人语料实测发现 2 次 阈值是保护确实有多用修辞的真人作者的防线因此候补只允许以条件性子句方式补充不能为迁就新现象降低阈值。D-COLLOC 与 F-TAUTO 的estimated警示两者均无实测数据严重度只是估算文档明确要求赋予严重度前必须做对照语料实测这正是实证驱动原则在候补管理中的体现。A-17 是本阵内 hold的特殊案例它已经登记在 ai-tell-taxonomy.md学术锚点强、但外部轮次与 v1.6 输入均为 0 阳性所以它位于活跃 84 之外。其验证用指标deul_overuse_rate-들 滥用率在 prepare_monolith_input.py 中作为 v2.0 计数型指标持续测量_V2_COUNT_METRICS中标注A-17 hold等待 NMT 原文轮次提供阳性证据后由 v2.1 起重新评估。四、升级与驳回历史追踪文件的诞生记文档승격·기각 이력升级·驳回历史记录了文件的两次关键写入2026-09-24首次文件作为追踪文件新设首批登记 10 件候补promoted 0。这批候补由原提案 #149snubhretina提出——该 PR 因面向已被废弃的.claude/skills/布局而无法合并但其中的想法本身值得保留于是迁入现行路径。2026-09-24第二次从已关闭的 PR 中抢救 3 个候选C-8-META#56、D-COLLOC、F-TAUTO#60。三个 PR 都因面向废弃的.claude/skills/布局而无法合并但想法本身有保留价值于是转移至此。至此候补池累计 13 件promoted 0。从下一轮起taxonomist 将读取这份表格而非_workspace/taxonomy_changelog.md继续工作。这段历史揭示了这个仓库的一个独特实践即使 PR 因技术债旧目录布局无法合并其中的模式发现也不会被丢弃而是被降级保存为候补——这保证了从实盘观察中获得的知识不因工程重构而流失。五、源码级佐证候补如何驱动下游产物候补升级进入本阵后会产生一系列连锁反应这些都可以在仓库源码中找到确凿证据1. taxonomist 的产出协议korean-ai-tell-taxonomist.md 规定taxonomySSOT更新后必须同时重新生成两个下游产物——python3 scripts/build_quick_rules.py与python3 scripts/build_diagnosis_rules.py。只跑一个会被 CI 的--check拦截两者都是漂移检查对象。这正是候补升级写进本阵 ≠ 任务完成的工程含义。2. 规则文件是生成物不是手写物build_quick_rules.py读取 ai-tell-taxonomy.md 中每个模式条目末尾的_quick: true · quick_pattern: … · quick_fix: …_元数据只抽取quick: true表层信号可检测的 S1/S2模式与固定的 header/footer 模板拼装成 quick-rules.md。文件头注释明确记载了动机手写同步曾造成 3 处 ID 漂移D-3·G-1/G-2·J-3 指向了错误的模式而 ID 是诊断→润色调用间的契约漂移即运行时 bug。此外它还内置fast 令牌预算守卫目标 50 条 ±20%上限 60--check会阻止超限提交——这解释了为什么候补的新条目默认quick: false快速规则册有硬性规模上限新增必须靠先降级旧条目来腾出预算。build_diagnosis_rules.py同样从 SSOT 生成但全模式收录包括quick: false的文档级模式产出诊断专用精简索引 diagnosis-rules.md把诊断调用的输入从 74.8KB 的 taxonomy 全文压缩到约 13KB约 83% 削减并自校验全 ID 收录、零空签名。3. 测试层的守护tests/test_agent_inventory.py 会校验 SKILL.md 声明的 Agent 数量与agents/目录实物一致并确认被点名的运行时 Agenthumanize-monolith、humanize-diagnostician、humanize-finalizer与维护型 Agentkorean-ai-tell-taxonomist确实存在——如果候补管理流程中有人改动了 Agent 清单而忘记同步文档CI 会直接失败。六、实操要点如何阅读与维护这份文件如果你要为仓库贡献新的模式候选或想评估现有候选遵循以下流程登记新观察到的疑似模式以临时 IDK-*或{大分类}-{序号}-X等追加到 taxonomy-candidates.md 的候选表格如实填写实证来源run ID / 文件路径 / 模型状态记为pending1 件实证。补证在同一模型同一作者的连续产出中复现只算 1 件——必须在不同输入中获得第 2 件实证才能讨论升级。gap 分析与现有模式做差异分析文档中反复出现gap 分析后判断重复性/领取子编号若与既有模式同族则建议合并如 C-8-X 与 C-8 的关系而非新增条目。升级满足 2 件实证 → 领取现有大分类的 append-only 子编号 → 写入 ai-tell-taxonomy.md → 更新本文件历史小节promoted 版本记录。重新生成下游运行python3 scripts/build_quick_rules.py与python3 scripts/build_diagnosis_rules.py或依赖 CI--check提示并确认quick: true条数仍在预算上限60内。严重度慎动已有严重度需要调整时必须积累 3 件以上反证estimated标记的候补如 D-COLLOC、F-TAUTO在实测对照语料之前不得正式定级。结语一份追踪文件背后的工程哲学taxonomy-candidates.md表面上只是一张候选表和两行历史记录但它承载着 im-not-ai 项目分类体系可持续运转的三条支柱实证驱动无实证不升级、estimated 须实测、ID 稳定性append-only、禁新大分类、下游规则自动生成防漂移、防过度修复新候选约束的不只是去掉 AI 味还包括润色行为本身不得制造新的 AI 味如 K-1 的间隔号滥用、C-11-RL 的无声停顿增长。理解这份文件也就理解了为什么这个仓库的 85 模式分类体系能在真实使用中不断自我演进而不失控。赞分享【免费下载链接】im-not-aiAI가 쓴 한글을 사람 글처럼 윤문하는 Claude 스킬 — Korean AI-text humanizer: detects and rewrites translationese, mechanical parallelism, and 71 other AI tells项目地址https://gitcode.com/gh_mirrors/im/im-not-ai点击查看免费下载相关推荐im-not-ai 的 commit-ko 替换表把韩语提交信息里的五类 AI 腔按 taxonomy 溯源替换im not ai 的 commit ko 替换表把韩语提交信息里的五类 AI 腔按 taxonomy 溯源替换 commit ko 是 im not aiim-not-ai 实证验证笔记基于韩语对照语料库的 AI 文本模式判别力测量im not ai 实证验证笔记基于韩语对照语料库的 AI 文本模式判别力测量 本文是开源仓库 im not ai 中 empirical validatioim-not-ai Korean AI-Tell Taxonomist:AI 生成韩文AI 痕迹分类体系(SSOT)的维护、升级与双生成管线协议im not ai Korean AI Tell Taxonomist:AI 生成韩文AI 痕迹分类体系 SSOT 的维护、升级与双生成管线协议 agent上一篇redux-form reducer 完全指南在 Redux Store 中挂载与扩展表单状态下一篇swagger-codegen 生成 C .NET Core 客户端模型解析以 Swagger Petstore 的 Pet 模型为例创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考