标签: AI 翻译
-
继首次尝试 GPT-6 Luna High 后,我在马拉地语正式翻译中发现了大量术语问题和返工。为了寻找更适合长期生产的翻译引擎,我选取三个具有代表性的 Go Tour 页面,分别使用 GPT-5.6 Sol High、GPT-6 Sol High 和 GPT-6 Sol Medium 生成译文,并邀请四个 AI 独立盲审。结果出乎意料:5.6 Sol High 的综合均分略高于两种 GPT-6 配置;6 Sol Medium 虽然明显节省时间和额度,但仍存在术语问题。最终,我决定优先保证翻译质量,恢复使用 GPT-5.6 Sol High。
-
Codex GPT-5.6 Sol High 完成首批 60 个马拉地语 Page,就消耗了约 58% 的五小时额度。为节省额度,我借助 Desktop Commander,让 ChatGPT 也承担正式翻译生成,但最近几天频繁出现的消息流错误严重影响了工作。恰逢 GPT-6 Luna High 上线,我提前开展了三页翻译质量对照实验,并邀请五个 AI 独立盲审。实验结果让我决定将 GPT-6 Luna High 作为项目后续默认的翻译生成模型,同时保留原有的独立审核与质量门槛。
-
使用 SlyTranslate + GLM-5.2 翻译 WordPress Gutenberg 文章时,遇到 A paragraph run did not contain a top-level paragraph. 错误。排查后确认,问题来自自定义 Paragraph Run parser 只能识别裸 ,无法兼容模型偶发返回的 或 。最终通过最小范围修改,在保留原有段落 merge/split 与 Gutenberg 结构保护能力的前提下完成修复,并通过自动测试和生产真实文章验证。
-
本次重新评估 A Tour of Go 的 TranslationUnit 翻译方案,根本原因不是单纯比较模型能力,而是 ChatGPT 作为批量翻译引擎在实际工作中出现持续稳定性问题,即使从 ZIP 交付简化为 JSON,翻译任务仍可能卡住。实验使用 5 个正式 TranslationUnit、完整 zh-CN glossary、protected token、独立随机匿名和 Engineering Gate,对 ChatGPT GPT-5.6 High、Codex GPT-5.6 Sol High 与 Extra High 进行四模型匿名评审。结果显示,ChatGPT High 的外部评审平均分为 96.67,Codex High 为 95.73,Extra High 为 95.87,三者已进入相近的高质量梯队,而 Extra High 并未表现出稳定优势。综合翻译质量与本地批量执行能力,后续默认翻译引擎准备调整为 Codex GPT-5.6 Sol High,ChatGPT 则重点用于统一 Quality Check,并以所有 TranslationUnit 最终达到 A 作为质量验收目标。
-
在 go-tour-i18n 多语言翻译项目推进过程中,我曾经通过 ChatGPT + GitHub batch 完成 A Tour of Go 简体中文 103 页全量重译验证。后续扩展 ja-JP 翻译时,继续沿用了基于 TranslationUnit 的翻译流程,并尝试从 GitHub 写入调整为 raw-responses artifact 导入模式。实际测试发现,ChatGPT 能够理解项目流程、读取 batch 和 manifest,但在新任务中无法稳定完成从 TranslationUnit 翻译结果到 raw-responses 文件和 artifact 交付的完整闭环。本文记录这次 AI 辅助翻译流程稳定性验证过程,并分析翻译能力与工程执行能力之间的差异。
-
在 A Tour of Go 多语言翻译项目中,最初版本主要完成左侧课程正文的简体中文翻译,但右侧 Playground 示例代码仍然保留英文注释。 对于编程教程而言,课程正文和代码示例是一个完整学习单元。如果代码注释仍然是英文,即使代码可以正常运行,整体学习体验仍然不完整。 本次更新将 Playground Example 纳入统一翻译体系,作为独立 TranslationUnit 管理。项目通过 Go scanner 识别真实注释,只开放普通自然语言注释参与翻译,同时保护代码、字符串、布局以及机器语义内容,确保翻译后仍然保持合法 Go source。 最终,右侧 Playground 示例代码注释也完成中文本地化,实现从课程正文到代码示例的完整学习体验。
-
在 A Tour of Go 多语言翻译项目中,最初的自动化流程主要关注结构完整性和页面可发布性,例如 present 解析、代码保护、链接校验以及页面渲染验证。 随着翻译规模扩大,仅依靠自动验证已经无法完全保证译文质量。因此,项目进一步引入 Translation Quality Review,将翻译质量检查正式加入发布流程。 本次更新建立了独立的质量评审阶段,通过 A/B/C/D 四级质量评级、Review evidence 和 Promotion gate,对候选译文进行质量控制,使自动翻译流程从“结构正确”进一步提升到“质量可控”。
-
A Tour of Go 多语言翻译项目最初以固定版本的 Go 官方源码为基础完成简体中文翻译。随着课程内容持续演进,仅保存当前译文已经无法满足长期维护需求。 本次更新为项目引入 upstream 同步机制,通过记录官方源码基线 commit、检测 source revision 变化、标记 stale 翻译单元、重新生成翻译批次,并经过 validation、Translation Quality Review 与 promotion 流程,最终生成新的 production release。 此次实践使 go-tour-i18n 从一次性的课程翻译项目,进一步演变为具备持续同步能力的多语言维护系统。
-
在完成 A Tour of Go 简体中文 103 个正式课程页面的 ChatGPT 全量重译后,我没有立即覆盖现有正式译文,而是继续进行了完整语义质量审核,并使用 A/B/C/D 四级标准区分“可以直接发布”“可选优化”“建议修订”和“必须修复”。审核过程中曾有 2 页处于 B 级,本身已经达到发布质量,但由于最终只剩少量页面且修改成本很低,仍继续 revision,最终达到 A=103、B/C/D=0。随后项目进一步完善 canonical promotion 的 evidence chain、retry provenance 与 EOF normalization,确认每个正式 candidate 都能追溯到对应的 ChatGPT 原始译文和最终有效 attempt。正式 apply 后 103 页中 102 页发生变化,80 页完成确定性 EOF normalization,再次 dry-run 得到 0 changed、103 unchanged,完整测试最终通过。结合 103 页全量重译、完整语义审核和统一工程验证,我对当前 zh-CN 的内部综合质量评价由原来的约 94 分提高到约 98 分。
-
在 A Tour of Go 简体中文项目中,上一篇实验已经确认 ChatGPT 值得作为新的 Translation Engine 继续扩大验证。本轮进一步将实验扩展到全部 103 个正式课程页面,并通过固定 retranslation batch、GitHub 数据交接、ChatGPT 整页翻译、raw response 保存、restore、统一 validator 与有限 retry,完成 103/103 全量重译。整个过程没有改变原有完整 present.Section 翻译单元和结构校验体系,而是利用 ChatGPT + GitHub 减少大量人工复制粘贴,并通过 11 个 Batch、独立 Git 提交和历史 evidence 保留,使新的 ChatGPT 译文能够进入可追踪、可校验的工程流程,为后续完整语义审核和 canonical promotion 做好准备。
