前两天王虹拿菲尔兹奖的新闻满屏都是。大家都在说她攻克了百年的挂谷猜想,数学界最高荣誉第一次给到中国籍女性。
我没太看懂那个猜想,但我被另一条细节卡住了——报道里提了一嘴,她在法国读的硕博,啃的是法文文献。
搞技术的其实都逃不开这个。论文、RFC、各家厂商的白皮书,英文还算好的,德文法文日文的经常冷不丁砸过来。我们组以前有个不成文规矩,谁先刷到外文资料谁负责翻译,于是大家都假装没看到。
因为我刚经历一模一样的崩溃。
上周导师甩给我一篇德文的技术白皮书,说这块你顺手看看。我点开,满屏花体字母配一堆矩阵公式。谷歌翻译复制进去,出来一坨东西,公式全飞了,图表丢得干干净净,我连它在讲哪个变量都看不出来。
那一刻我有点恍惚:我写代码十年了,读个外文资料的方式居然还这么原始。
说起来有点丢人。遇到英文或者小语种的 PDF,我以前的标准操作是截图、丢 OCR、一段段复制到翻译器、再手动把公式图表对着原文理一遍。一篇二三十页的论文,一个下午就这么没了。最坑的是翻译器只给纯文字,表格、图片、标题层级全没了,你以为读完了,其实读的是一堆脱离语境的碎片。
更惨的是有回一份德文的 API 规范,机翻把矩阵维度的下标弄丢了两个。我以为参数顺序没问题,照着写了段解析,跑出来结果死活对不上。查了两天 bug,最后发现是文献本身看错了。从那以后我对外文资料的处理方式就有点 PTSD。
后来有次组会,另一个同事同样一篇论文,二十分钟就甩给我一份带标注的 notes。我问他你怎么这么快,他说他现在不自己一段段翻了,整篇 PDF 直接传上去,连公式带图表一起出一份中文对照版,他对着看就行。
我当时脸上一定写满了 ignorant。
回去我试了下他说的那个法子。其实就是把整篇文档传进去,它保留原来的排版——表格还在原位,图片没丢,公式照原样排——输出一份中文对照。你读中文的同时,眼睛一扫就能对回原文的符号。我用的那个叫 PDFTranslator,浏览器里直接传,不用装软件,整篇导出来对照看,比我自己折腾那套省力太多。
第一次用的时候我其实挺怀疑,专门挑了篇自己读过的英文论文对照,确认公式图表没乱跑,才敢用在没读过的德文文档上。后来顺手发现它也能处理德文、法文、西文这些,我之前还得先判断这到底是德语还是荷兰语再去找对应工具,现在不用操这个心了。扒各国论文、看不同语言的技术标准时,这点确实省事。
我后来想明白一件事:纯文字翻译最坑的不是翻错,是把上下文打碎。你看到一句"令 x 如上式",往回翻原文找"上式"是哪个,公式早飞了。对照版真正的意义,是让你眼睛能随时扫回原符号,而不是把整篇拆成一堆脱离语境的碎片。
把这套跑顺之后,我大概估了一下。以前一篇二十页的外文论文,纯处理加重排得折腾三四个小时;现在整篇对照生成加自己精读,二十分钟出头。一周看几篇,省下来的时间我终于能花在"理解"而不是"搬运"上了。工具换了之后我读文献的心态都变了,以前是"又来外文了头疼",现在是"传上去先看对照版,难的再啃原文"。
当然它也不是万能的。关键公式我到现在还是会瞄一眼原文,学术、技术内容别全信机器,重要的地方对着原版看一眼更踏实。有次一份带手写批注的扫描件它也确实翻不了,我还是得先 OCR。但它解决的其实不是"翻得准不准",是"翻完之后还能不能对照原版读"——这一点,比准不准重要得多。
王虹那篇论文的致谢里,有一句特别朴素的话,大意是谢谢这一年给她做晚饭的人。一个拿了数学界最高奖的人,最后写的是这种生活里的琐事。
我读着读着觉得,搞技术的人其实都一个样。表面在跟公式、代码、文档较劲,底层都是在跟"看不懂、搞不定"的焦虑较劲。工具能把文档翻过来,但熬过那段看不懂的日子,还是得自己多撑一下。
你组里看英文、德文、法文资料多吗?现在都怎么对付的?评论区聊一聊。