标签: Protected Token
-
A Tour of Go 简体中文第一阶段 103 个课程页面已经全部进入 ready 状态。在现有版本已经具备较高翻译质量和完整发布能力后,我重新评估此前暂时搁置的 minimal-protect 翻译模式。当前 zh-CN 译文工程性估计约为 94 分,而成熟的 minimal-protect 目标希望达到 96~97 分。通过 methods/24 的真实实验可以看到,raw-input 会错误修改 .play 指令,而 minimal-protect 只保护完整 .play 后成功消除了这一问题,同时让 validator 继续发现 link inline-code 和 font span 等下一层结构差异。同页对比中,默认 protected-token 使用 15 个保护 token,而 minimal-protect 仅使用 1 个,更多原始上下文可以直接交给 GLM-5.2。后续将继续使用原有 7 个代表页验证翻译质量、结构稳定性、重试成本和跨语言保护规则的复用程度,再决定是否正式切换默认模式。
-
在 WordPress 后台使用 SlyTranslate + GLM-5.2 翻译技术文章时,一次看似普通的尾部 STRUCT Token 缺失,最终定位为两个 INLINE Token 为适应自然英文语序发生了合法换位。主校验允许这种变化,但 Tail Repair 仍要求完整 raw Token 序列保持原始前缀,导致安全的尾部结构修复被错误阻断。本文记录从 first_mismatch_index=814 定位真实差异、修正 Tail Repair 为 fixed Token 前缀判断、补充回归测试,到生产部署并验证同一文章最终翻译成功的完整过程。
-
A Tour of Go 多语言翻译项目完成简体中文课程正文的全量翻译:基于官方 upstream master@e11dacba76c5aae474746e9eedee19693f492803,重新确认 101 个普通顶层 Section 加 2 个 #appengine 条件顶层 Section,共计 103 个课程页面。批量翻译过程中进一步修复了行内代码完整结构换位导致的恢复边界问题,以及完整链接按中文自然语序换位导致的校验误判,并直接利用已有 GLM-5.2 历史响应重新校验恢复。最终状态达到 ready=103、pending=0、blocked=0,课程正文翻译阶段正式完成,下一步进入 zh-CN 发布前全局验收。
-
A Tour of Go 多语言翻译项目继续推进第三批普通页面。本批最初 10 页中有 8 页直接进入 ready,flowcontrol/10 与 moretypes/1 因静态预格式化代码块、行内结构和教学注释 Go 标识符等问题进入 blocked。排查过程中进一步确认:Protected Token 不仅需要保护 payload,还需要向模型明确其结构角色;同时 static preformatted block 的 token 化还曾吞掉原有块级换行边界,导致模型输入本身误导结构判断。完成首次 Prompt、protected input 边界和教学注释标识符角色校准后,两页均在干净首次请求中通过全部自动校验;同时修复了 retry feedback 因 diagnostic suffix 中包含 directive 而导致的字符串误分类。第三批最终实现 10/10 ready,全局状态更新为 ready=45、pending=58、blocked=0。
-
在 A Tour of Go 多语言翻译项目中,随着 protected token 保护规则不断增加,我开始重新思考输入端是否有必要做如此多的结构处理。本文记录一次围绕 –raw-input、–minimal-protect 和 –dev-attempts 的真实架构实验:flowcontrol/6 证明原始输入能够直接通过统一校验,而结构更复杂的 methods/24 又暴露出 .play directive、链接标签行内代码以及 font span 等结构风险。最终没有贸然替换当前成熟方案,而是保存实验能力和真实审计,继续使用默认 protected-token 流程推进课程翻译,并将“原始页面优先、少量高风险机器结构保护、严格统一校验、针对性重试反馈”作为后续值得继续研究的简化方向。
-
继续推进 go-tour-i18n 项目的第二批 10 个普通页面翻译。flowcontrol/6 在连续 3 次翻译后因 inline code sentinel 5 opening marker missing 进入 blocked,排查后发现 GLM-5.2 并未丢失 Token,而是将英文中的 v → return 按自然中文语序调整为 return → v,暴露出 Restore 层错误要求不同 Inline Code Pair 保持源码顺序的问题。修复后允许完整 Pair 随自然语序整体换位,并新增 translate revalidate-response,可直接复用历史成功模型响应重新执行当前 Restore 与 Validator,无需再次调用 GLM。最终 flowcontrol/6 使用原 attempt-003 成功恢复为 ready,第二批 10 页实现 10/10 Ready;同时修正了已经过时的 TestCommittedStatus Ready 页面白名单测试。当前项目状态为 ready=35、pending=68、blocked=0。
-
在 A Tour of Go 多语言翻译项目继续校准 methods/20 时,GLM-5.2 第一次翻译因多处 Protected Token 顺序变化被自动校验拒绝。进一步分析发现,16 个受保护标记全部完整保留,所谓“换序”实际上来自英语与中文正常的语序差异。本文记录如何重新划分结构校验与跨语言语义的职责,取消过严的全局 Token 顺序限制,加强 present、链接、代码块、directive 与 Section 结构校验,并使用同一份历史失败响应完成确定性回放,最终证明第一次翻译本身已经正确通过。
-
在 WordPress 历史文章英文覆盖翻译过程中,文章 ID 4652 持续触发 GLM-5.2 HTTP 400 安全检测错误。通过执行 Trace、模型真实 Payload 与 Plaintext Region 分析,最终发现多个不含中文的服务器日志、文件列表等 Plaintext 区块没有翻译必要,却仍被完整发送给模型。本文记录如何调整 Code Block Pro Plaintext 保护策略,将纯机器文本改为 SWQBLOCK 整体保护,使正文 Payload 从 49938 字符降至 8876 字符,并继续处理 Ctrl+C 遗留状态、recovery_generation 重试计数、counter_drift 与 WordPress REST Nonce 过期问题,最终成功完成 GLM-5.2 整篇翻译。
-
本文记录 go-tour-i18n 项目进入正式翻译阶段后的最新进展:完成 Welcome 全章及 Basics 前 3 页,共有 8 个简体中文页面进入 ready;确认正式发布采用 103 页投影,并区分本地执行与远程 Playground 语义;发现并修复 legacy present 语法中带空格行内代码的 Protected Token 保护问题。文章还回顾了此前针对 WordPress 技术博客整篇翻译进行的 DeepSeek V4 Pro 与 GLM-5.2 对比,并说明由于本轮实际更新的是 V4 Flash、V4 Pro 尚未更新,暂时搁置新的模型对比。后续将先校准跨章节代表页面,再试跑 10 页,稳定后才进入剩余页面的批量自动翻译。
-
记录一次 SlyTranslate + GLM-5.2 整篇翻译中的 Protected Token 校验失败排查过程。问题最初表现为文章尾部连续丢失 Gutenberg STRUCT Token,在增加 Tail STRUCT Repair、强化 Prompt 和 Tail Guard 后仍未解决。进一步分析发现,真正原因是中文文章中存在 Paragraph → Plaintext → Paragraph 的跨块自然语言结构,GLM 为生成更自然的英文主动重组内容,导致 Protected Token 顺序漂移。最终通过清理不必要的 Plaintext、让 Gutenberg 区块边界与自然语言语义边界保持一致,在不放宽严格 Token 验证的情况下成功完成 GLM-5.2 整篇翻译。
