上个月陪朋友过一场线上发布会。观众名单里有日本人、德国人、新加坡的华人,而他只有一个人、一份中文 deck、四十分钟。
按以前的办法,这活得拆成三件:会前找人把 deck 翻译一遍,当天请个同传,或者干脆英语讲一遍、中文再讲一遍。那天他一件都没做。讲的时候屏幕底下挂着英文字幕,观众自己扫码进页面,选自己想看的语言。
翻译从「会前」挪到了「讲的同一秒」
三年前这事得靠会议平台的功能堆。现在它已经是演示本身的一部分。
PowerPoint 放映模式里有「一律使用字幕」,打开之后口语语言和字幕语言分开设,中文讲、英文显示。Teams 的实时翻译字幕会把讲者的话直接翻成观众最熟悉的那种语言。DeepL Voice 接进 Teams、Zoom、Google Meet 做实时翻译字幕,Zoom 和 Google Meet 自己也带。
差别在时间点。以前翻译发生在你讲完之后(翻 deck),或者会场里另一个人嘴里(同传),现在它发生在你说话的同一秒。这是量变,但它改掉的是成本结构:一场会要不要为七个人准备翻译,以前是预算问题,现在是勾选项问题。
真正会卡住你的是「可翻译性」
字幕开起来太容易了,所以很多人以为问题解决了。
我见过翻出去最难看的 deck 是什么样的:图表里全是中文标签,翻页时字幕在底下滚,观众对不上哪根柱子是哪项;一页上写着「我们这行有句话」,翻过去什么都不是;还有一堆缩写,内部人一看就懂,外人看得一脸问号。
所以跨语言演示的第一课不是开字幕,是把内容写成能翻译的。短句优先,双关和梗删掉,图表自己会说话(标签写全称、单位写清楚),术语第一次出现给个英文原文。
第二课是词汇表。做国际活动的 Wordly 这类工具都带术语表功能,你可以把公司名、产品名、关键术语喂进去,别让它把品牌名翻成一段谁也认不出的字。备这个表五分钟,不备,代价是一场会。
三条断点已经接上
第一条是识别和翻译够用了。不是完美,是「能听懂」这条线过去了。口音重、专业词密的场合仍会翻车,所以 KUDO 那种做法是 AI 语音翻译和真人同传并存,重要的场子不用 AI 单打。选工具时先问一句:翻错了谁兜底。
第二条是观众侧的入口变成了二维码和链接。Wordly 让听众扫码进页面,自己选字幕还是翻译音频;国内一些同传工具直接给双屏输出加悬浮字幕。这一步把实时翻译从会场的设备搬到了观众自己的手机上。一份 deck,各看各的语言,讲者这边什么都不用换。
第三条是演示开始多语言分发。录播加自动配音已经在走了,YouTube 的自动配音开放了 27 种语言。你讲一遍,第二天这条内容自己会说好几国话。以前一套内容出海要重录,现在只要讲得够清楚。
对做演示的人来说
不用等公司配同传,今天下午就能试最小的一步:在 PowerPoint 里打开放映,勾上「一律使用字幕」,口语语言设中文、字幕语言设英文,随便念两页,感受一下延迟和错译。知道自己讲的话被翻成什么样,再决定哪场会敢用。
会丢掉机会的不是不做翻译的团队,是内容写得根本翻不出去的那种。同一份 deck 讲给三种语言的人听,门槛已经降到「你愿不愿意把话说短」。