联系支持

我们通过电子邮件回复,通常两天内。

为防止滥用,Google reCAPTCHA 会检查这次提交,其间会向 Google 传输数据。脚本只在你打开此表单时才加载。

← 全部文章

一个检查自己译文的博客

这个博客有 64 篇文章,十一种语言:704 行,约 220 万字符。没有一篇文章在任何一种语言里缺失 — 这个说法只有在有东西强制它时才有意义。

确实有东西在强制。译好的一行写入之前,先与英文原文比对,不通过的行根本不会被写入 — 它会被报告出来,留给人看。

1 — 相同的链接目标 2 — 相同的占位符 3 — 每种标签数量相同 4 — 长度在 0.5 倍到 2.5 倍之间 5 — 没有写了一半的占位符 写入 跳过并报告 704 行,64 篇文章,十一种语言

每项检查是干什么的

相同的链接目标。 内部路径在翻译时不能改变:/privacy 在每种语言里都还是 /privacy,语言前缀是在生成页面时才加上的。一个译者 — 无论是不是人 — 若热心地把路径也译了,就会造出一个哪儿都到不了的链接。

相同的占位符。 有些文章带着在生成页面时才替换进去的数字,这样它们就不会过时。丢掉其中一个的译文会丢掉一个数字;凭空造一个的译文会在句子中间留下一个花括号。

每种标签数量相同。 不只是标签配对 — 而是与英文数量相同。这是那项配得上自己位置的检查:丢失的一个表格行、被吞掉的一个列表项、缺失的一张图,对其他任何测试都是看不见的,因为结果仍然是有效的 HTML,读起来毫无问题。

长度落在区间内。 在英文的一半到二点五倍之间。各种语言的长度确实不同,所以区间很宽;它抓住的是半途停下的译文。

它抓到了什么,又错抓了什么

一次真正的捕获:一份法文译文里有四个被强调的词,而英文只有三个,因为一处否定被分成两段做了标记。什么都不像有错。数量像有错。

两次误报,都发生在同一天,都很有教益。

第一次:有一篇文章引用了一行 CSS,而 CSS 以 }} 结尾。花括号检查数了每一个 {{ 和每一个 }},于是那篇文章的每一份译文都不通过,尽管什么都没坏。没有 {{}} 不可能是断裂的占位符 — 占位符以 {{ 开头 — 所以现在只数开头那一侧。

第二次:<rect/><path/> 没有闭合标签,所以配对测试会永远把它们报成不配对。空元素现在改为计数,而不是配对。

这两次各花了一轮工作,而且两次都是检查太严而不是太松。这是更好的失败方向,但并非免费:一项老是虚报的检查,会被赶时间的人放松,然后在真正要紧的时候它就不在了。

最要紧的那次试验

当文章加上图之后,标签检查被扩展到覆盖它们。与其相信这一点,不如去测这项检查:从一份译文里故意删掉一张图,然后运行导入程序。

它准确报告了缺失的东西 — 那张图、它的十个标注、四个矩形、七条路径 — 并拒绝写入该行。图被恢复后,检查又通过了。

这花了两分钟。一项你从未见它失败过的验证,是一项你在假定的验证,而假定正是这一切存在所要避免的东西。

广告