Skip to content

fix(readme): 同步 34 个译本 README 停留在旧章号的实验编号 - #958

Merged
bojieli merged 1 commit into
fix/broken-relative-linksfrom
fix/translated-experiment-numbering
Aug 22, 2026
Merged

fix(readme): 同步 34 个译本 README 停留在旧章号的实验编号#958
bojieli merged 1 commit into
fix/broken-relative-linksfrom
fix/translated-experiment-numbering

Conversation

@bojieli

@bojieli bojieli commented Aug 22, 2026

Copy link
Copy Markdown
Owner

承接 #956 里报告的那个问题。各章译本 README 的实验编号整体停留在重排前的章号:chapter7 用 6-K、chapter8 用 7-K、chapter9 用 8-K,中文母版均已正确。共 520 处,覆盖第一列的编号单元格和正文里的「实验 X-Y」引用。

校验方式不是「章号加一」

以各章中文 README 为基准,按项目名逐行比对。这一点很重要——第 9 章有一批译本的表格本身就与中文版不同步,盲目加一会出错。

chapter7 / chapter8:逐项目核对后确认是干净的「章号加一、序号不变」映射(6-K→7-K7-K→8-K),统一替换。chapter8 部分译本把 8-3、8-4 合并成一个单元格 8-3, 8-4,属表格形态差异不是编号错误,保持原样。

chapter9 分两种:

  • enzh-TW 行序与中文版完全一致(含中文版 9-4 的正文对照实验行),按 8-K→9-K 统一替换。

  • ar es hu id ja ko ru ta vi tr 十个译本缺少中文版 9-4 那一行,且 harness-safety-gate 与 hermes-self-evolution、self-evolution-eval 的先后顺序也不同。按章号加一会得到「看起来是新编号、实际对错项目」的结果——例如 browser-use-rpa 会变成 9-4,正确是 9-5。所以改为按项目名取中文母版编号:

    项目 加一会得到 中文版实际是
    browser-use-rpa 9-4 ❌ 9-5
    self-modifying-agent 9-5 ❌ 9-6
    hermes-self-evolution 9-6 ❌ 9-8
    self-evolution-eval 9-7 ❌ 9-9
    harness-safety-gate 9-8 ❌ 9-7

    tr 的编号只出现在正文(Deney 8-6(8-8)),按同一规则处理。

两处刻意保留或改写

  • chapter9「补充案例」表里的 prompt-distillation 行是跨章项目,中文版就写作 8-8,不参与替换。
  • ai-style-skill 在中文版和 en/zh-TW 里是不编号的补充案例(),九个译本仍把它当编号实验 8-9。改为 ,没有凭空指派新编号。

误伤防护

替换式用 (?<!exp) 前瞻,避免动到 expN-M- 形式的验收产物目录名(那是 #956 在修的)。

对全部替换做了逐条审计(列出 diff 两侧每个 \d+-\d+ 的前后对照),共 46 种替换。其中 发现并修正了一处误伤chapter9/README.tr.md 里 browser-use-rpa 的描述「3-5 kat hız artışı」(3-5 倍加速)是速度倍数、不是实验编号,被按行替换误改成了「9-5 kat」,已还原为 3-5

其余经确认无误:45-69%Qwen2.5-32B 这类正文数字在 diff 两侧完全相同,只是所在行的行首编号变了。重新审计后无可疑替换。

遗留(本 PR 未处理)

上述十个 chapter9 译本仍缺少中文版 9-4 的正文对照实验一行,行序也与中文版不同;ai-style-skill 在它们那里仍位于配套实验表而非补充案例表。这属于表格内容同步,不是编号问题,需要另行处理——性质和 #955 的 LEARNING.md 类似。

校验

  • 按项目名比对,译本与中文母版的编号不一致数 0
  • 除刻意保留的跨章 8-8 外,无残留旧章号
  • 失效相对链接数未变化(仍是 fix(ch7): 删除指向不存在验收产物的 6 处死链接 #957 处理的那 6 处)
  • pytest tests/test_chapter_numbering_consistency.py tests/test_site_i18n.py tests/test_docs_experiment_status_links.py tests/test_build_site_assets.py — 13 passed

合并顺序

本分支基于 #956,PR base 也设为 #956 的分支。两者会改到同一批文件的同一些行(行首编号与 expN-M- 路径常在同一行),分别基于 main 会冲突。请先合 #956,GitHub 会自动把这个 PR 的 base 切到 main。

🤖 Generated with Claude Code

https://claude.ai/code/session_012a9XZi352t2qxfPHQN8f7n

各章译本 README 的实验编号整体停留在重排前的章号:chapter7 用 6-K、
chapter8 用 7-K、chapter9 用 8-K,中文母版均已是正确编号。共 520 处,
覆盖第一列的编号单元格与正文里的「实验 X-Y」引用。

以各章中文 README 为基准。校验方式不是按章号加一,而是按项目名逐行比对
中文母版的编号,因为第 9 章有一批译本的表格本身与中文版不同步。

chapter7、chapter8:逐项目核对后确认是干净的「章号加一、序号不变」映射
(6-K→7-K、7-K→8-K),统一替换。chapter8 部分译本把 8-3、8-4 合并为一个
单元格「8-3, 8-4」,属于表格形态差异,不是编号错误,保持原样。

chapter9 分两种情况处理:

- en、zh-TW 的行序与中文版完全一致(含中文版 9-4 的正文对照实验行),
  按 8-K→9-K 统一替换。
- ar、es、hu、id、ja、ko、ru、ta、vi、tr 十个译本的表格缺少中文版 9-4 那
  一行,且 harness-safety-gate 与 hermes-self-evolution、self-evolution-eval
  的先后顺序也不同。若按章号加一,会得到「看起来是新编号、实际对错项目」的
  结果,例如 browser-use-rpa 会变成 9-4(正确为 9-5)。因此改为按项目名取
  中文母版编号:browser-use-rpa→9-5、self-modifying-agent→9-6、
  harness-safety-gate→9-7、hermes-self-evolution→9-8、self-evolution-eval→9-9。
  tr 的编号只出现在正文(「Deney 8-6」「(8-8)」),按同一规则处理。

两处刻意保留或改写:

- chapter9 各译本「补充案例」表中的 prompt-distillation 行是跨章项目,中文版
  就写作 8-8,不参与替换。
- ai-style-skill 在中文版与 en、zh-TW 中是不编号的补充案例(`—`),九个译本
  仍把它当作编号实验 8-9。改为 `—`,未凭空指派新编号。

替换式用了 `(?<!exp)` 前瞻,避免误伤 `expN-M-` 形式的验收产物目录名;另已
确认 `45-69%`、`Qwen2.5-32B` 这类正文数字未被波及(仅所在行的行首编号变化)。

校验:按项目名比对,译本与中文母版的编号不一致数为 0;除刻意保留的跨章 8-8
外无残留旧章号;失效相对链接数未变化;pytest test_chapter_numbering_consistency /
test_site_i18n / test_docs_experiment_status_links / test_build_site_assets 通过。

遗留(未在本 PR 处理):上述十个 chapter9 译本仍缺少中文版 9-4 的正文对照实验
一行,行序也与中文版不同;ai-style-skill 在它们那里仍位于配套实验表而非补充
案例表。这属于表格内容同步,需要另行处理。

本分支基于 #956。两者会改到同一批文件的同一些行(编号与 expN-M- 路径常在同
一行),故叠加提交,合并时请先合 #956。

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_012a9XZi352t2qxfPHQN8f7n
@bojieli
bojieli force-pushed the fix/translated-experiment-numbering branch from c65a7d4 to 1e475bf Compare August 22, 2026 05:05
@bojieli
bojieli merged commit 1d931e3 into fix/broken-relative-links Aug 22, 2026
2 checks passed
bojieli added a commit that referenced this pull request Aug 22, 2026
#958 只统一了实验编号,遗留三点结构分歧:译本缺少中文版 9-4 那一行、行序
与中文版不同、ai-style-skill 被放在配套实验表而非补充案例表。本次以中文
母版为准补齐,en 与 zh-TW 早已一致,未改动。

配套实验表:补入 9-4「正文对照实验」(🚧,无项目链接,各语言新译),并把
行序调整为 9-1 至 9-9。原有译文描述全部保留,只做重排,未重译。

ai-style-skill:中文版与 en、zh-TW 都把它列为补充案例(编号 `—`),十个
译本仍将其作为配套实验。移入补充案例表,沿用各译本已有的描述文字,由四列
格式转为三列(去掉类型列)。

hu、id 原本没有补充案例小节,新建该小节,并补上中文版已有而它们缺失的
prompt-distillation(跨章 8-8)与 self-evolving-tools 两行。

tr 的分歧最大:整张表没有编号列,且缺 trajectory-verifier 与
self-modifying-agent 两个项目,prompt-distillation、self-evolving-tools
混在配套实验表里。按中文版重建为「配套实验(带编号列)+ 补充案例」两张表,
新译 9-1、9-6 两行说明与离线入口段落,其余描述沿用原译文。harness-safety-gate
描述末尾的「(9-7)」在补上编号列后已冗余,一并去掉。

顺带修正 #958 引入的一处误伤:tr 版 browser-use-rpa 描述中的
「3-5 kat hız artışı」(3-5 倍加速)是速度倍数而非实验编号,被按行替换误改
为「9-5 kat」,已还原。该修正已 amend 进 #958 分支。

校验:13 个 chapter9 README(中文母版加 12 个译本)的配套实验表编号与项目
顺序、补充案例表三行内容全部一致;chapter9 无失效相对链接;pytest
test_chapter_numbering_consistency / test_site_i18n /
test_docs_experiment_status_links / test_build_site_assets 通过。

遗留:中文版主表后的「证据完整性边界」一段(9-6/9-9 的 SHA-256 sidecar、
9-1/9-2/9-3 可审计强度较低等说明)在全部 12 个译本中都缺失,包括 en 与
zh-TW。属于正文内容翻译,不在本次结构同步范围内。

本分支基于 #958。


Claude-Session: https://claude.ai/code/session_012a9XZi352t2qxfPHQN8f7n

Co-authored-by: Claude Opus 5 (1M context) <noreply@anthropic.com>
bojieli added a commit that referenced this pull request Aug 22, 2026
* fix(readme): 同步 34 个译本 README 停留在旧章号的实验编号

各章译本 README 的实验编号整体停留在重排前的章号:chapter7 用 6-K、
chapter8 用 7-K、chapter9 用 8-K,中文母版均已是正确编号。共 520 处,
覆盖第一列的编号单元格与正文里的「实验 X-Y」引用。

以各章中文 README 为基准。校验方式不是按章号加一,而是按项目名逐行比对
中文母版的编号,因为第 9 章有一批译本的表格本身与中文版不同步。

chapter7、chapter8:逐项目核对后确认是干净的「章号加一、序号不变」映射
(6-K→7-K、7-K→8-K),统一替换。chapter8 部分译本把 8-3、8-4 合并为一个
单元格「8-3, 8-4」,属于表格形态差异,不是编号错误,保持原样。

chapter9 分两种情况处理:

- en、zh-TW 的行序与中文版完全一致(含中文版 9-4 的正文对照实验行),
  按 8-K→9-K 统一替换。
- ar、es、hu、id、ja、ko、ru、ta、vi、tr 十个译本的表格缺少中文版 9-4 那
  一行,且 harness-safety-gate 与 hermes-self-evolution、self-evolution-eval
  的先后顺序也不同。若按章号加一,会得到「看起来是新编号、实际对错项目」的
  结果,例如 browser-use-rpa 会变成 9-4(正确为 9-5)。因此改为按项目名取
  中文母版编号:browser-use-rpa→9-5、self-modifying-agent→9-6、
  harness-safety-gate→9-7、hermes-self-evolution→9-8、self-evolution-eval→9-9。
  tr 的编号只出现在正文(「Deney 8-6」「(8-8)」),按同一规则处理。

两处刻意保留或改写:

- chapter9 各译本「补充案例」表中的 prompt-distillation 行是跨章项目,中文版
  就写作 8-8,不参与替换。
- ai-style-skill 在中文版与 en、zh-TW 中是不编号的补充案例(`—`),九个译本
  仍把它当作编号实验 8-9。改为 `—`,未凭空指派新编号。

替换式用了 `(?<!exp)` 前瞻,避免误伤 `expN-M-` 形式的验收产物目录名;另已
确认 `45-69%`、`Qwen2.5-32B` 这类正文数字未被波及(仅所在行的行首编号变化)。

校验:按项目名比对,译本与中文母版的编号不一致数为 0;除刻意保留的跨章 8-8
外无残留旧章号;失效相对链接数未变化;pytest test_chapter_numbering_consistency /
test_site_i18n / test_docs_experiment_status_links / test_build_site_assets 通过。

遗留(未在本 PR 处理):上述十个 chapter9 译本仍缺少中文版 9-4 的正文对照实验
一行,行序也与中文版不同;ai-style-skill 在它们那里仍位于配套实验表而非补充
案例表。这属于表格内容同步,需要另行处理。

本分支基于 #956。两者会改到同一批文件的同一些行(编号与 expN-M- 路径常在同
一行),故叠加提交,合并时请先合 #956。

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_012a9XZi352t2qxfPHQN8f7n
(cherry picked from commit 1e475bf)

* fix(ch9): 同步 10 个译本 README 与中文版的表格结构分歧

#958 只统一了实验编号,遗留三点结构分歧:译本缺少中文版 9-4 那一行、行序
与中文版不同、ai-style-skill 被放在配套实验表而非补充案例表。本次以中文
母版为准补齐,en 与 zh-TW 早已一致,未改动。

配套实验表:补入 9-4「正文对照实验」(🚧,无项目链接,各语言新译),并把
行序调整为 9-1 至 9-9。原有译文描述全部保留,只做重排,未重译。

ai-style-skill:中文版与 en、zh-TW 都把它列为补充案例(编号 `—`),十个
译本仍将其作为配套实验。移入补充案例表,沿用各译本已有的描述文字,由四列
格式转为三列(去掉类型列)。

hu、id 原本没有补充案例小节,新建该小节,并补上中文版已有而它们缺失的
prompt-distillation(跨章 8-8)与 self-evolving-tools 两行。

tr 的分歧最大:整张表没有编号列,且缺 trajectory-verifier 与
self-modifying-agent 两个项目,prompt-distillation、self-evolving-tools
混在配套实验表里。按中文版重建为「配套实验(带编号列)+ 补充案例」两张表,
新译 9-1、9-6 两行说明与离线入口段落,其余描述沿用原译文。harness-safety-gate
描述末尾的「(9-7)」在补上编号列后已冗余,一并去掉。

顺带修正 #958 引入的一处误伤:tr 版 browser-use-rpa 描述中的
「3-5 kat hız artışı」(3-5 倍加速)是速度倍数而非实验编号,被按行替换误改
为「9-5 kat」,已还原。该修正已 amend 进 #958 分支。

校验:13 个 chapter9 README(中文母版加 12 个译本)的配套实验表编号与项目
顺序、补充案例表三行内容全部一致;chapter9 无失效相对链接;pytest
test_chapter_numbering_consistency / test_site_i18n /
test_docs_experiment_status_links / test_build_site_assets 通过。

遗留:中文版主表后的「证据完整性边界」一段(9-6/9-9 的 SHA-256 sidecar、
9-1/9-2/9-3 可审计强度较低等说明)在全部 12 个译本中都缺失,包括 en 与
zh-TW。属于正文内容翻译,不在本次结构同步范围内。

本分支基于 #958。

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_012a9XZi352t2qxfPHQN8f7n
(cherry picked from commit 06a5057)

* docs(ch9): 从章节 README 移除证据审计强度的细节表述

第 9 章 README 主表之后有两段中文独有、12 个译本均无的内容,属于实验证据
的审计强度细节,不适合放在章节索引层面的 README。按作者要求删除,而不是
翻译到 12 个语言。

删除「证据完整性边界」整段:9-6/9-9 的 canonical evidence 与 latest.json
各有独立 SHA-256 sidecar、9-5 对三个浏览器产物核对 hash、9-1/9-2/9-3 缺少
顶层 evidence/source hash manifest 因而可审计强度较低、不能把提交时存在的
JSON 等同于运行时源码已被固定。

第一段精简为「带项目链接的实验都保留无需 API Key 的离线入口和单元测试用于
预检。」,去掉两处审计表述:「表中 ✅ 来自各目录保存的真实模型、真实轨迹或
真实浏览器规范证据,不由离线机制演示代替」与「历史数值或定性主张未复现时,
证据按负结果如实记录」。原句「除仍处于设计阶段的实验 9-4 外」一并去掉——
9-4 本就没有项目链接,新表述已自然排除它。

这些内容并未从仓库消失:SHA-256 快照比对、证据 manifest、可审计性说明都保留
在对应项目自己的 README(self-modifying-agent、harness-safety-gate、
browser-use-rpa、prompt-auto-optimization),那里才是记录证据强度的位置。
逐行的负结果也仍写在表内,例如 9-2 的说明保留了「知识文档组仅 25%、两控制组
均 50% 的负结果」。

改动后中文母版与 11 个译本在该位置都只有一段说明。es 版原本就没有这段,属
既有缺口,未在此处补。

校验:chapter9 无失效相对链接;pytest test_chapter_numbering_consistency /
test_site_i18n / test_docs_experiment_status_links / test_build_site_assets 通过。

本分支基于 #959。

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_012a9XZi352t2qxfPHQN8f7n
(cherry picked from commit b95061a)

---------

Co-authored-by: Claude Opus 5 (1M context) <noreply@anthropic.com>
@bojieli
bojieli deleted the fix/translated-experiment-numbering branch August 22, 2026 06:21
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant