WordPress AI 翻译工程实战 系列归档 - 永夜 https://www.shuijingwanwq.com/series/wordpress-ai-translation-engineering-in-practice/ 没有不值得去解决的问题,也没有不值得去学习的技术! Wed, 19 Aug 2026 02:55:03 +0000 zh-Hans hourly 1 https://wordpress.org/?v=7.1 https://media.shuijingwanwq.com/2026/05/logo-150x150.png WordPress AI 翻译工程实战 系列归档 - 永夜 https://www.shuijingwanwq.com/series/wordpress-ai-translation-engineering-in-practice/ 32 32 WordPress 历史文章迁移终于收尾:全量审计 1438 篇中文文章,并停用 SyntaxHighlighter Evolved https://www.shuijingwanwq.com/2026/08/19/26935/ Wed, 19 Aug 2026 02:49:46 +0000 https://www.shuijingwanwq.com/?p=26935 在持续处理 WordPress 历史文章摘要、旧代码格式、SyntaxHighlighter 短代码及中英文覆盖翻译之后,这一轮历史迁移终于正式收尾。最终 67 个固定批次、1281 篇历史文章全部完成,remaining=0、integrity=ok。为准备退役 SyntaxHighlighter Evolved,又重新同步并审计了 1438 篇中文已发布文章,最终只有 14 篇进入人工检查,真正需要迁移到 Code Pro 的文章不到 5 篇。审计工具、配置、测试和历史迁移状态也已完成 Git 收口,503 项测试通过。发布本文前,SyntaxHighlighter Evolved 已正式停用,插件文件暂时保留约 5 天,等待旧页面缓存自然退出后再彻底删除。

WordPress 历史文章迁移终于收尾:全量审计 1438 篇中文文章,并停用 SyntaxHighlighter Evolved最先出现在永夜

]]>
WordPress 超长 Gutenberg 文章整篇 AI 翻译踩坑:从 1000+ 受保护标记到完整翻译成功 https://www.shuijingwanwq.com/2026/08/15/25917/ Sat, 15 Aug 2026 11:33:52 +0000 https://www.shuijingwanwq.com/?p=25917 在一篇包含大量 Gutenberg 段落、引用、列表、图片和 90 个 Code Block Pro 区块的超长文章中,我继续验证 WordPress 中文到英文整篇 AI 翻译流程。排查过程中先后发现受保护标记过多、普通段落边界过度保护、Plaintext Code Block Pro 内容字段被误判为结构变化,以及空白 freeform 导致 PARAGRAPH_RUN 结构签名漂移等问题。通过引入普通段落区域、区分内容字段与结构配置、修正最终 Gutenberg 结构签名后,受保护标记降至 506 个,最终仍以一次完整 GLM-5.2 请求成功生成英文译文,并通过 Gutenberg 编辑器实际验证。

WordPress 超长 Gutenberg 文章整篇 AI 翻译踩坑:从 1000+ 受保护标记到完整翻译成功最先出现在永夜

]]>
WordPress AI 翻译排错实战:一次合法的行内代码换序,为什么会阻断尾部结构自动修复? https://www.shuijingwanwq.com/2026/08/15/25909/ Sat, 15 Aug 2026 11:09:10 +0000 https://www.shuijingwanwq.com/?p=25909 在 WordPress 后台使用 SlyTranslate + GLM-5.2 翻译技术文章时,一次看似普通的尾部 STRUCT Token 缺失,最终定位为两个 INLINE Token 为适应自然英文语序发生了合法换位。主校验允许这种变化,但 Tail Repair 仍要求完整 raw Token 序列保持原始前缀,导致安全的尾部结构修复被错误阻断。本文记录从 first_mismatch_index=814 定位真实差异、修正 Tail Repair 为 fixed Token 前缀判断、补充回归测试,到生产部署并验证同一文章最终翻译成功的完整过程。

WordPress AI 翻译排错实战:一次合法的行内代码换序,为什么会阻断尾部结构自动修复?最先出现在永夜

]]>
WordPress 历史文章自动化遇到 GLM 1301:从 HTTP 400 到 ChatGPT 人工兜底完成 https://www.shuijingwanwq.com/2026/08/15/25898/ Sat, 15 Aug 2026 10:52:42 +0000 https://www.shuijingwanwq.com/?p=25898 本文记录 WordPress 历史文章批处理过程中,一篇文章在中文摘要生成阶段持续触发 GLM HTTP 400,并进一步确认错误码为 1301、属于内容安全过滤的完整处理过程。经过排除输入长度和普通网络波动后,没有为了迎合模型审核而修改历史正文,而是改由 ChatGPT 人工生成中文摘要、英文标题、摘要和完整译文,再通过扩展后的 mark-manual-completed 对 excerpt_failed 进行生产只读验收和人工完成确认。最终既保留了原始 excerpt_generation_failed 与 HTTP 400 evidence,又将 workflow 安全收敛到 completed,整批 20 篇全部完成。

WordPress 历史文章自动化遇到 GLM 1301:从 HTTP 400 到 ChatGPT 人工兜底完成最先出现在永夜

]]>
GLM-5.2 整篇翻译返回 400:一次内容安全误拦截的逐步定位与恢复记录 https://www.shuijingwanwq.com/2026/08/15/25773/ Sat, 15 Aug 2026 09:30:30 +0000 https://www.shuijingwanwq.com/?p=25773 本文记录了一次 WordPress 历史文章英文覆盖翻译过程中遇到的 HTTP 400 内容安全拦截问题。排查最初从网络访问相关技术术语入手,但连续进行中文名称和中性表达改写后仍然失败。随后转向文章中的国家和地区流量统计内容,通过逐步概括相关表达并重新建立当前中文源基线,最终成功完成 GLM-5.2 英文覆盖翻译。文章同时总结了内容安全错误的定位思路、WordPress 图片 ALT 对翻译输入的影响,以及历史文章处理中优先采用等义改写而非直接删除内容的实践原则。

GLM-5.2 整篇翻译返回 400:一次内容安全误拦截的逐步定位与恢复记录最先出现在永夜

]]>
GLM-5.2 整篇翻译持续返回 HTTP 400:从安全检测拦截到 Plaintext 载荷缩减的完整排查与修复 https://www.shuijingwanwq.com/2026/08/08/23700/ Sat, 08 Aug 2026 09:55:37 +0000 https://www.shuijingwanwq.com/?p=23700 在 WordPress 历史文章英文覆盖翻译过程中,文章 ID 4652 持续触发 GLM-5.2 HTTP 400 安全检测错误。通过执行 Trace、模型真实 Payload 与 Plaintext Region 分析,最终发现多个不含中文的服务器日志、文件列表等 Plaintext 区块没有翻译必要,却仍被完整发送给模型。本文记录如何调整 Code Block Pro Plaintext 保护策略,将纯机器文本改为 SWQBLOCK 整体保护,使正文 Payload 从 49938 字符降至 8876 字符,并继续处理 Ctrl+C 遗留状态、recovery_generation 重试计数、counter_drift 与 WordPress REST Nonce 过期问题,最终成功完成 GLM-5.2 整篇翻译。

GLM-5.2 整篇翻译持续返回 HTTP 400:从安全检测拦截到 Plaintext 载荷缩减的完整排查与修复最先出现在永夜

]]>
GLM-5.2 整篇翻译再次出现 Protected Token 校验失败:从尾部 Token 丢失到 Plaintext 结构重排的完整排查记录 https://www.shuijingwanwq.com/2026/07/30/20906/ https://www.shuijingwanwq.com/2026/07/30/20906/#comments Thu, 30 Jul 2026 13:34:38 +0000 https://www.shuijingwanwq.com/?p=20906 记录一次 SlyTranslate + GLM-5.2 整篇翻译中的 Protected Token 校验失败排查过程。问题最初表现为文章尾部连续丢失 Gutenberg STRUCT Token,在增加 Tail STRUCT Repair、强化 Prompt 和 Tail Guard 后仍未解决。进一步分析发现,真正原因是中文文章中存在 Paragraph → Plaintext → Paragraph 的跨块自然语言结构,GLM 为生成更自然的英文主动重组内容,导致 Protected Token 顺序漂移。最终通过清理不必要的 Plaintext、让 Gutenberg 区块边界与自然语言语义边界保持一致,在不放宽严格 Token 验证的情况下成功完成 GLM-5.2 整篇翻译。

GLM-5.2 整篇翻译再次出现 Protected Token 校验失败:从尾部 Token 丢失到 Plaintext 结构重排的完整排查记录最先出现在永夜

]]>
https://www.shuijingwanwq.com/2026/07/30/20906/feed/ 1
每天批量处理 20 篇 Mixed WordPress 历史文章:Classic 转 Gutenberg、SyntaxHighlighter 迁移、摘要补全与英文覆盖翻译完整 SOP https://www.shuijingwanwq.com/2026/07/30/20862/ Thu, 30 Jul 2026 06:05:24 +0000 https://www.shuijingwanwq.com/?p=20862 在完成 Gutenberg + SyntaxHighlighter 历史文章迁移后,我继续处理 Mixed Gutenberg / Classic + SyntaxHighlighter 文章,并整理出每天固定处理 20 篇的完整 SOP。流程包括 Classic 内容规范化为 Gutenberg、SyntaxHighlighter 转 Code Block Pro、代码语言核对、生产只读验证、中文摘要生成和英文覆盖翻译。经过连续两批共 40 篇真实文章验证,流程同时覆盖了 SSH 超时有限重试、翻译失败单篇 resume,以及 selected_count=0 但批次仍未完成等异常情况,最终形成一套可以长期重复执行的历史文章迁移方案。

每天批量处理 20 篇 Mixed WordPress 历史文章:Classic 转 Gutenberg、SyntaxHighlighter 迁移、摘要补全与英文覆盖翻译完整 SOP最先出现在永夜

]]>
每天批量处理 20 篇 WordPress 历史文章:代码块迁移、摘要补全与英文覆盖翻译完整 SOP https://www.shuijingwanwq.com/2026/07/24/20084/ https://www.shuijingwanwq.com/2026/07/24/20084/#comments Fri, 24 Jul 2026 11:48:59 +0000 https://www.shuijingwanwq.com/?p=20084 本文整理了一套每天批量处理 20 篇 WordPress 历史文章的完整流程,包括 SyntaxHighlighter 向 Code Block Pro 迁移、代码语言核对、生产只读验证、中文摘要生成、英文覆盖翻译、有限重试和失败恢复。本次实操还修复了 Plaintext 行数校验过严,以及 Ctrl + S 被误判为 Markdown 列表的问题,最终完成整个批次,并形成可长期复用的操作规范。

每天批量处理 20 篇 WordPress 历史文章:代码块迁移、摘要补全与英文覆盖翻译完整 SOP最先出现在永夜

]]>
https://www.shuijingwanwq.com/2026/07/24/20084/feed/ 1
将 WordPress AI 翻译优化仓库从私有切换为公共:从敏感信息审计到最小改动发布 https://www.shuijingwanwq.com/2026/07/23/19936/ Thu, 23 Jul 2026 09:03:30 +0000 https://www.shuijingwanwq.com/?p=19936 记录将 wordpress-ai-translation-pipeline 从私有 GitHub 仓库切换为公共仓库的完整过程,包括敏感信息审计、生产环境信息与认证凭证的风险区分、双仓库方案取舍、MIT License 与第三方许可证说明补充、自动化测试、代码提交以及仓库可见性切换。最终在未重写 Git 历史、未删除标签、未强制推送的前提下,以最小改动完成公开发布。

将 WordPress AI 翻译优化仓库从私有切换为公共:从敏感信息审计到最小改动发布最先出现在永夜

]]>