系列: WordPress AI 翻译工程实战
-
本文整理了一套每天批量处理 20 篇 WordPress 历史文章的完整流程,包括 SyntaxHighlighter 向 Code Block Pro 迁移、代码语言核对、生产只读验证、中文摘要生成、英文覆盖翻译、有限重试和失败恢复。本次实操还修复了 Plaintext 行数校验过严,以及 Ctrl + S 被误判为 Markdown 列表的问题,最终完成整个批次,并形成可长期复用的操作规范。
-
在完成 Gutenberg + SyntaxHighlighter 历史文章迁移后,我继续处理 Mixed Gutenberg / Classic + SyntaxHighlighter 文章,并整理出每天固定处理 20 篇的完整 SOP。流程包括 Classic 内容规范化为 Gutenberg、SyntaxHighlighter 转 Code Block Pro、代码语言核对、生产只读验证、中文摘要生成和英文覆盖翻译。经过连续两批共 40 篇真实文章验证,流程同时覆盖了 SSH 超时有限重试、翻译失败单篇 resume,以及 selected_count=0 但批次仍未完成等异常情况,最终形成一套可以长期重复执行的历史文章迁移方案。
-
记录一次 SlyTranslate + GLM-5.2 整篇翻译中的 Protected Token 校验失败排查过程。问题最初表现为文章尾部连续丢失 Gutenberg STRUCT Token,在增加 Tail STRUCT Repair、强化 Prompt 和 Tail Guard 后仍未解决。进一步分析发现,真正原因是中文文章中存在 Paragraph → Plaintext → Paragraph 的跨块自然语言结构,GLM 为生成更自然的英文主动重组内容,导致 Protected Token 顺序漂移。最终通过清理不必要的 Plaintext、让 Gutenberg 区块边界与自然语言语义边界保持一致,在不放宽严格 Token 验证的情况下成功完成 GLM-5.2 整篇翻译。
-
在 WordPress 历史文章英文覆盖翻译过程中,文章 ID 4652 持续触发 GLM-5.2 HTTP 400 安全检测错误。通过执行 Trace、模型真实 Payload 与 Plaintext Region 分析,最终发现多个不含中文的服务器日志、文件列表等 Plaintext 区块没有翻译必要,却仍被完整发送给模型。本文记录如何调整 Code Block Pro Plaintext 保护策略,将纯机器文本改为 SWQBLOCK 整体保护,使正文 Payload 从 49938 字符降至 8876 字符,并继续处理 Ctrl+C 遗留状态、recovery_generation 重试计数、counter_drift 与 WordPress REST Nonce 过期问题,最终成功完成 GLM-5.2 整篇翻译。
-
本文记录了一次 WordPress 历史文章英文覆盖翻译过程中遇到的 HTTP 400 内容安全拦截问题。排查最初从网络访问相关技术术语入手,但连续进行中文名称和中性表达改写后仍然失败。随后转向文章中的国家和地区流量统计内容,通过逐步概括相关表达并重新建立当前中文源基线,最终成功完成 GLM-5.2 英文覆盖翻译。文章同时总结了内容安全错误的定位思路、WordPress 图片 ALT 对翻译输入的影响,以及历史文章处理中优先采用等义改写而非直接删除内容的实践原则。
-
本文记录 WordPress 历史文章批处理过程中,一篇文章在中文摘要生成阶段持续触发 GLM HTTP 400,并进一步确认错误码为 1301、属于内容安全过滤的完整处理过程。经过排除输入长度和普通网络波动后,没有为了迎合模型审核而修改历史正文,而是改由 ChatGPT 人工生成中文摘要、英文标题、摘要和完整译文,再通过扩展后的 mark-manual-completed 对 excerpt_failed 进行生产只读验收和人工完成确认。最终既保留了原始 excerpt_generation_failed 与 HTTP 400 evidence,又将 workflow 安全收敛到 completed,整批 20 篇全部完成。
-
在 WordPress 后台使用 SlyTranslate + GLM-5.2 翻译技术文章时,一次看似普通的尾部 STRUCT Token 缺失,最终定位为两个 INLINE Token 为适应自然英文语序发生了合法换位。主校验允许这种变化,但 Tail Repair 仍要求完整 raw Token 序列保持原始前缀,导致安全的尾部结构修复被错误阻断。本文记录从 first_mismatch_index=814 定位真实差异、修正 Tail Repair 为 fixed Token 前缀判断、补充回归测试,到生产部署并验证同一文章最终翻译成功的完整过程。
-
在一篇包含大量 Gutenberg 段落、引用、列表、图片和 90 个 Code Block Pro 区块的超长文章中,我继续验证 WordPress 中文到英文整篇 AI 翻译流程。排查过程中先后发现受保护标记过多、普通段落边界过度保护、Plaintext Code Block Pro 内容字段被误判为结构变化,以及空白 freeform 导致 PARAGRAPH_RUN 结构签名漂移等问题。通过引入普通段落区域、区分内容字段与结构配置、修正最终 Gutenberg 结构签名后,受保护标记降至 506 个,最终仍以一次完整 GLM-5.2 请求成功生成英文译文,并通过 Gutenberg 编辑器实际验证。
-
在持续处理 WordPress 历史文章摘要、旧代码格式、SyntaxHighlighter 短代码及中英文覆盖翻译之后,这一轮历史迁移终于正式收尾。最终 67 个固定批次、1281 篇历史文章全部完成,remaining=0、integrity=ok。为准备退役 SyntaxHighlighter Evolved,又重新同步并审计了 1438 篇中文已发布文章,最终只有 14 篇进入人工检查,真正需要迁移到 Code Pro 的文章不到 5 篇。审计工具、配置、测试和历史迁移状态也已完成 Git 收口,503 项测试通过。发布本文前,SyntaxHighlighter Evolved 已正式停用,插件文件暂时保留约 5 天,等待旧页面缓存自然退出后再彻底删除。
