交替传译把会议时长翻倍,实时翻译则转头就忘:2026 年泰国团队真正要在两者之间做的选择
曼谷的翻译公司公开报价:交替传译每小时 3,000 泰铢起,同声传译 5,000 泰铢起,而交替传译大致会把会议时长翻一倍。Google 翻译的 Live translate 覆盖 74 种语言,泰语在列;Google Meet 的翻译字幕覆盖 69 种,泰语也在列——但 Meet 的 Transcripts 与 Gemini 记录助手各自只支持 8 种语言,泰语一个都没进。Deepgram 的 Nova-3 能把泰语转写为 th 和 th-TH,却把它排除在 10 种语言的语码转换模式之外,而那恰恰是你会议里最常见的泰英混说句。本文为泰国团队把会议翻译的所有选项算一遍账。
通过曼谷的翻译公司预约一位交替传译译员,公开的起步价是每小时 3,000 泰铢;同声传译从 5,000 泰铢起。这是 Sawadee Translations 自己挂出来的数字,检索于 2026 年 9 月 1 日。但真正贵的地方不是这个小时单价。
真正贵的是时钟。在交替传译中,说话人先讲完一段——Acolad 在 2026 年 4 月 24 日的解释文章里把典型段落长度定为一到五分钟——然后停下,由译员用另一种语言把这段话再讲一遍。Acolad 写道:「一场交替传译的时长大致会翻倍,因为每一句话都要被讲两次。」于是你那场九十分钟的季度回顾变成了三小时的季度回顾,而这三小时你都要付译员的钱。
与此同时,Google 现在就能在你泰国同事的手机上,免费地,把这件事的某个版本做完。
TL;DR
- 泰语能通过每一项「听」的测试,却在每一项「写」的测试上落榜。 Google 翻译的 Live translate 列出 74 种语言,泰语在内;Google Meet 的翻译字幕列出 69 种,泰语也在内。而 Google Meet 的 Transcripts 和它的「Take notes for me」记录助手各自只支持 8 种语言——而且是同样的 8 种——泰语两边都没有。
- 具体的失效点,是那句泰英混说的话。 Deepgram 的 Nova-3 能把泰语转写为
th和th-TH,但它的multi语码转换模式恰好只覆盖 10 种语言,泰语不在其中。Meet 的记录助手更是直说:它「一次只支持一种语言」。 - 有些会议依然应该请真人译员,本文会写清楚边界在哪里。同时给出一套七步流程,让泰英会议真正留下记录,并把公开的泰语口译价格和公开的泰语语音识别错误率并排摆出来。
这是本系列的泰国篇。昨天我们对越南算了同一笔账,结果形状几乎一样——Google 会实时翻译你的越南语会议,却一个字都不会替你记下来;这个论点的通用版本,则在翻译很出色、但一顿晚饭之后就消失了那一篇里。泰国有一处重要的不同,就在下面的语码转换那一节。
三个选项并排摆开。价格取自 2026 年 9 月 1 日检索的曼谷翻译公司公开报价表。
แปลต่อเนื่อง 和 แปลพร้อม 是两种产品,而泰国人搜的是前一种
先从词汇开始,因为泰国的搜索数据在这件事上精确得不寻常。泰国人需要处理一场会议时,不会在 Google 里打「翻译」。他们打的是 การประชุมแปลต่อเนื่อง——字面意思是「交替传译的会议」——这是在点名要一种特定的专业模式,而不是一句笼统的愿望。
交替传译(แปลต่อเนื่อง)意味着译员要等。说话人讲完一段,停下来,译员再把它译出。按 Acolad 的说法,这种方式不需要同传箱、不需要接收机、不需要发射机,全部技术要求就是一本记事本。因此它成了双边会谈、法律取证、医疗问诊、现场走访和工厂参观的默认选项。Sawadee Translations 指出,大多数法律程序和使馆预约都采用交替传译,理由是「准确性比速度更重要,而这种形式允许停顿」。
同声传译(แปลพร้อม)意味着译员不等。说话人还在讲的时候,译文就已经送出,只滞后几秒。它更贵是有结构性原因的:Elite Asia 列出的标准装备包括隔音同传箱、便携接收机、耳机、中央控制单元、多通道发射机,以及带麦克风的译员台;而且同传译员按惯例两人一组,每 20 到 30 分钟轮换一次,因为那种认知负荷撑不完一个人的整场班次。
下面这一点是大多数对比文章会埋掉的:两种模式真正的成本差别,不在价格上。交替传译按小时算更便宜,按会议算更贵,因为它消耗的是唯一一样没人标价的资源——日程表。我们把它叫作被口译的一小时:议程上的六十分钟,占掉每个人一天里的一百二十分钟。
一位泰语译员到底要花多少钱,公开报价表上写着
泰语口译的报价表是真的公开,这在这个行业里比它应该有的样子更罕见。曼谷有两家服务商挂出了可以直接引用的数字。
| 服务商 | 模式 | 公开起步价 | 计费单位 |
|---|---|---|---|
| Sawadee Translations | 交替传译 | 3,000 泰铢起 | 每小时 |
| Sawadee Translations | 同声传译 | 5,000 泰铢起 | 每小时 |
| Y LINK (Personnel Consultant) | 交替传译,线上 | 2,000 泰铢起 | 每 60 分钟 |
| Y LINK (Personnel Consultant) | 同声传译,线上 | 3,000 泰铢起 | 每 60 分钟 |
| Y LINK (Personnel Consultant) | 会议 / 商务洽谈,现场 Class A | 6,000 泰铢起 | 半天(4 小时) |
| Y LINK (Personnel Consultant) | 会议 / 商务洽谈,现场 Class A | 9,600 泰铢起 | 全天(8 小时) |
| Y LINK (Personnel Consultant) | 同声传译或耳语传译,现场 Class A | 14,400 泰铢起 | 半天(4 小时) |
| Y LINK (Personnel Consultant) | 同声传译或耳语传译,现场 Class A | 21,600 泰铢起 | 全天(8 小时) |
两份报价表均检索于 2026 年 9 月 1 日。Y LINK 的日语—泰语—英语派遣页面还写明,日语、泰语与英语之间的口译「每天 14,400 泰铢起」。
请读小字,因为「被口译的一小时」正是在那里变成钱的。Y LINK 把半天定义为「不跨过 12:00」的 4 小时,把全天定义为扣除译员一小时午休后的 8 小时。加班按泰国劳动法计算:日合同金额除以 8,再乘以 1.5,按十五分钟为单位计费。取消费的阶梯也很陡:两个工作日以内取消收 100%,三到七天收 80%,八到十四天收 50%,十五到三十天收 20%。
所以,一场因为交替传译而翻倍、最终超时九十分钟的会议,代价并不是九十分钟。它是在你已经买下的一整天之上,再加上按小时折算后 1.5 倍的加班费,外加房间里每个人各损失一个下午的下游成本。
这些账并不说明译员不值。它说明译员是一笔需要斟酌的采购——而本文余下的部分,正是这样对待他们的。
现在每个免费工具都会说泰语,而且比它们的名声要好
市场的另一半也值得被公平地听一次,因为实时翻译里的泰语覆盖,从零零散散变成基本齐全的速度,比大多数团队意识到的要快。
Google 翻译的 Live translate 列出 74 种语言,泰语是其中之一。它在 Android 和 iOS 上戴不戴耳机都能用,提供 Listening、Conversation、Text-only 和自定义模式,还有一个面对面模式:屏幕一分为二,两位说话者各读自己那一半,麦克风自动判断当下说的是哪种语言。Google 的文档写明,翻译会「在你切换应用、最小化程序或屏幕锁定时无缝继续」。泰语还可以下载离线包——去罗勇府出差,或做一场网络状况没人敢保证的供应商审核时,这一点很要紧。
Google Meet 的翻译字幕 覆盖 69 种语言,泰语在内。这是付费档位的功能,适用于 Business Standard、Business Plus、Enterprise Standard、Enterprise Plus、Enterprise Starter(提供至 2025 年 6 月 30 日)以及 Google AI Pro for Education。
三星的 Live translate 与 Interpreter 在 Galaxy 设备上支持泰语,它是三星支持页面所列 20 种基础语言之一,与越南语、印尼语和印地语并列。同一个页面上还有一句值得读两遍的注意事项:「一次只应有一个人使用 Live Translate,否则会出现翻译错误。如果所选语言与实际所说的语言不一致,对话可能会被误译。」
作为大量会议工具底层的引擎层,Deepgram 的 Nova-3 把泰语列为 th 和 th-TH。2026 年 9 月 1 日在 Deepgram 的 Models & Languages Overview 上清点不同的基础语言代码,得到 58 个,泰语在 Nova-3 和更早的 Nova-2 两张表里都在。
这是一层真实存在、有钱投入、确实能跑的泰语实时翻译能力。如果你的问题是工厂车间上的一段供应商对话,那它基本已经解决,而且不花钱。我们的实话是:两个人一来一回、只求听懂的场合,用免费工具,跳过那张发票。
泰语通过了每一份「听」的名单,落在每一份「写」的名单之外
现在讲这种不对称——它正是本文存在的理由。
数据取自 2026 年 9 月 1 日检索的各厂商文档。只负责「听」的功能带着泰语;负责「写」的功能,或者要把泰语和英语混在一起的功能,都没有。
Google Meet 的 Transcripts 功能——就是那个能生成一份可长期保存的 Google 文档的功能——恰好只支持八种语言:英语、法语、德语、意大利语、日语、韩语、葡萄牙语和西班牙语。Google Meet 的「Take notes for me」 这个把笔记归档进 Google 文档、并给组织者发一封会议回顾邮件的 Gemini 记录助手,支持的也恰好是同样这八种。泰语两份名单都不在,一共缺席两次。
| 功能 | 是否支持泰语 | 语言数 | 通话结束后是否留下产物 |
|---|---|---|---|
| Google 翻译 — Live translate | 是 | 74 | 否 |
| Google Meet — 翻译字幕 | 是 | 69 | 仅在屏幕上;若录制字幕则烧进视频 |
| Deepgram Nova-3 — 转写 | 是(th、th-TH) | 58 个基础代码 | 是,前提是基于它的产品会保存 |
Deepgram Nova-3 — multi 语码转换 | 否 | 10 | 不适用 |
| Google Meet — Transcripts | 否 | 8 | 是,一份 Google 文档 |
| Google Meet — 「Take notes for me」 | 否 | 8,一次一种 | 是,文档笔记加一封回顾邮件 |
所有行均出自 2026 年 9 月 1 日检索的厂商文档。
Meet 的翻译字幕确实有一条持久化路径,这一点应当承认:如果你录制会议并勾选 Record captions ,字幕会被嵌入视频文件。但烧进画面的字幕,在任何有用的意义上都不算记录。你搜不了像素,改不了里面被听错的供应商名字,也没法从中生成摘要。它是一张关于转写稿的照片。
工具具体是在泰英混说的那句话上崩掉的
这里就是泰国与越南案例不同的地方,而且值得像文档本身那样直说。
Deepgram 的 multi 语码转换模式——那个允许同一条音频流的同一句话里出现两种语言的设置——恰好覆盖十种语言:英语、西班牙语、法语、德语、印地语、俄语、葡萄牙语、日语、意大利语和荷兰语。泰语不在其中,尽管泰语作为单语是被完整支持的。所以 Nova-3 会转写一场泰语会议,也会转写一场英语会议,但它并不是为了转写这样一句话而造的:你的运营负责人用泰语说「因为 QC 报告标出了一个批次问题,我们把发货推到了 15 号」,其中 QC report、batch 和日期都是英文。
这句话在泰国不是边缘情况。它是一家有外资母公司的泰国办公室里,最中位的那种句子。
Google 的记录助手用更直白的话记录了同一个限制。它的帮助页面写着,该功能「一次只支持一种语言」,而且「目前不支持同一场会议中出现多种语言」。于是一通在泰语和英语之间来回切换的曼谷—东京通话被判定出局两次:一次是因为泰语不在那八种里,另一次是因为哪怕在受支持的语言之间,切换本身也不被支持。
DeepL 提供了同一问题的第三种变体。DeepL Voice 把语言支持拆成口语语言(识别器能接受的)和翻译语言(字幕能显示的)。DeepL 自家模型转写 18 种口语语言,泰语不在其中。泰语落在第二层——由第三方厂商 Speechmatics 转写的 20 种语言——并附带三个条件,全部记载于 2026 年 9 月 1 日检索的 DeepL 帮助页面:
- 团队管理员必须先在组织的管理账户中启用第三方数据处理,这些语言才会开始工作。
- 自动检测不可用。 DeepL 的原话是:「第三方语言无法与自动检测语言配合使用——必须手动将其选为口语语言。」
- 若要让参会者自行选择口语语言,主持人必须启用访问码,这是在把会议接入 DeepL Voice 时设置的。
DeepL 对这套安排是坦率的——Speechmatics 在零留存协议下运作,转写数据一经处理便从其服务器删除——三个条件单独看也都不算过分。但叠在一起,就产生了一个具体的结果:一位加入了配有 DeepL 的会议的泰语说话者,距离「完全不被转写」只差一个没勾的管理员开关,而且不能指望系统自动注意到他。
没有厂商公布泰语会议的准确率。是泰国的一个实验室公布了原始数字。
我们去找过厂商公布的泰语会议语音词错误率。没有。真正存在的东西反而更好,因为它是在真实的泰语商务音频上测的,而不是在某个人照稿朗读的录音上测的。
Amity 的 AI 研究团队在 2025 年 8 月 14 日发布了一份白皮书,记录了在两份自有数据集上做泰语语音转文字微调的过程:一份 615 个片段的呼叫中心数据集,一份 422 个片段的保险数据集。他们在这两份数据上对四套系统做了基准测试。
词错误率出自 Amity 2025 年 8 月 14 日的白皮书。在真实的泰语商务音频上,现成系统落在 0.29 到 0.90 之间。
数字本身就是论证。Typhoon 2 在呼叫中心数据集上的 WER 为 0.90,保险数据集上为 0.65。本身就是 Whisper 泰语专用微调版的 Thonburian Whisper,成绩是 0.53 和 0.33。一家商用本地云语音转文字服务是 0.47 和 0.29。Amity 自己的全量微调达到 0.41 和 0.21。
0.47 的词错误率意味着大约每两个词就有一个需要修改。这就是一套通用系统面对带背景噪音、经过电话带宽压缩、且未经排练的泰语商务口语时的表现。把一个宣称「泰语准确率 99%」的营销页面放在这张表旁边读,你会对那个营销页面产生一些新认识。
说话人分离讲的是同一个故事。Amity 报告称,把标准的 pyannote.audio 流程直接用在他们的保险音频上、不做任何泰语适配时,说话人分离错误率(DER)为 31.3%,主要错误出现在「区分重叠说话人与发生语码转换的说话人」上。对前端做了适配之后,同一评测集上的 DER 降到 8.13%。语码转换再一次出现,这次表现为说话人归属问题——说话人在一句话中途换了语言,机器就跟丢了是谁在说。
泰语有两个结构性特点,让这个问题比英语里的对应问题更难。第一,泰文不用空格标记词边界。因此,用 Chormai、Prasertsom 与 Rutherford 在 2019 年 11 月 16 日 AttaCut 论文里的话说,分词是「泰语自然语言处理的一个基础预处理步骤」——识别器必须先判断一个词在哪里结束,才能判断这个词是什么,而这种歧义真实到泰语 NLP 养出了一整片互相对标的分词器文献。第二,泰语是声调语言。意义骑在音高曲线上,所以一套听错声调的系统返回的不是一个略有偏差的词,而是一个毫不相干的词。
由此得出的操作结论不是「别用 ASR」,而是:默认第一遍的泰语转写稿里就有错,并且去买一套人能看见、也能改正它们的工作流。 而这首先要求转写稿存在、可编辑,并且明天还在。
怎样开一场泰英会议,才能让记录活下来
七个步骤,按它们实际发生的顺序排列。每一步都对应上文记录过的一个具体失效点。
- 先定风险,再定工具。 如果一句译错会带来法律、医疗或合同层面的暴露,就请一位真人译员——然后继续往下读,因为下面关于记录的步骤同样适用于那场会议。译员负责的是这个房间;请译员这件事本身,不会在会后生出一份文档。
- 把「听懂」这件事和「留下记录」这件事分开,并接受它们是两种不同的工具。 今天,泰语的理解由 Google 翻译或 Meet 字幕来解决,而它们都不产生一份可长期保存的泰语记录。想用一个工具同时干这两件事,正是团队最后两样都没得到的原因。
- 老老实实为「被口译的一小时」做预算。 如果你要订交替传译,就按议程时长的两倍去订,并把真实的结束时间告诉参会者。一个 6,000 泰铢的四小时半天,能装下的是两小时的议程,不是四小时的议程。
- 把泰语显式设为口语语言,永远不要依赖自动检测。 在 DeepL Voice 上这是强制的——泰语属于第三方语言,自动检测对它不生效。在其他地方,这依然是更好的选择,因为自动检测是在整场会议里最缺上下文的头几秒里,把一个猜测钉死。
- 去查那个真正负责「写」的功能的语言列表,而不是查平台的。 这正是本文从头到尾要描述的陷阱。Google Meet 支持泰语;Google Meet 的转写稿不支持。69 对 8,就是这两句话之间的距离。
- 在开会之前,把语码转换的问题明说出来。 如果你的团队会把英文产品名、工单号和料号丢进泰语句子里——而每一个有外资母公司的泰国团队都会这么干——那就先确认你的记录工具能不能在一场会议里容纳两种语言。Nova-3 的
multi模式不含泰语;Meet 的记录助手则干脆拒绝混合语言的会议。 - 在头五分钟里当场修正人名和数字。 泰语专有名词和英文产品代号是转写最稳定翻车的两个地方,也恰好是一行错误对后续任何摘要伤害最大的两个地方。会议进行中改,成本是几秒钟;下周去改一份摘要,成本是一场争执。
如果你想要的是第 7 步的工作流版本而不是市场分析,我们六月的那篇指南完整走了一遍如何把一场泰语会议变成可复核的行动项,而实时会议翻译解决方案页面讲的是实时层与记录层如何衔接。
什么时候你仍然该请真人,直说
我们不打算假装工具能赢下每一个房间,所以下面是我们实际划下的边界。
当一句译错会带来无法通过更正挽回的后果时,请专业译员:法庭与仲裁程序、移民与使馆预约、医疗问诊、董事会层级的并购谈判、监管审计,以及任何对方日后会引用你原话的对话。当房间大到一块手机屏幕根本不构成传递手段时,请译员。当文化调停与词面准确同样重要时,也请译员——泰语的商务语体承载着等级与面子,而直译会把它们压平,一位好译员正是在实时地处理这些。
用工具的场合是:会议是内部的、重复发生的、偏运营的,而且如果它需要提前三周预约、外加一张五位数泰铢的账单,它根本就不会发生。这类会议占了绝大多数,而且恰恰是记录最重要的那一段,因为本来就没有人打算做会议纪要。
译员和记录不是互相竞争的两笔采购
写到这里的大多数文章会把它呈现成一道二选一,而这个框架是错的。更锐利的立场是译员加记录助手:在那些你绝对该请专业译员的高风险会议里,机器依然值它那个位置——它在旁边安静地跑,做三件译员并不是来做的事。
其一,一份可回查的记录。 译员的输出是说出来的,说完就没了。转写层把源语言音频保存成文字,旁边放上它的机器翻译,于是三周后出现争议时,你能对照的是泰语里当时究竟说了什么,而不是某个人对英文版本的记忆。这一点最有价值的场合,恰恰就是那些值得请译员的场合,因为那正是日后会有人拿这场会议来引用你的场合。
其二,一位给房间里所有人(包括译员)的助手。 交替传译在时间压力下会被压缩,而最先被牺牲的,正是那些不承担语法重量、却承担全部操作重量的细节:料号、日期、百分比、公司名、不熟悉的技术术语。这不是在批评译员,这是这项任务被记录下来的形状。有一份可复核的滚动转写稿,就意味着那个数字在包含它的句子过去之后仍然留在屏幕上,一位怀疑自己听错了「15 号」的参会者可以自己去看,而不必打断。
其三,会后那一层。 译员不写会议纪要。那不是他们的工作,你也不该要求他们做。摘要、行动项、可搜索的决策记录,都是译员离开之后才发生的工作;而今天,这些要么由房间里资历最浅的人手工完成,要么根本没人做。
不过要把这个层级关系说老实,因为它确实只朝一个方向流动。机器的输出是辅助与归档,它不能推翻房间里的专业人士。在法律或医疗场景中,当转写稿与译员相左时,权威在译员,转写稿是你去核对的那样东西。把记录当作可供查证的证据,而不是一份地位对等的第二意见。
最后再补一层背景,它解释了为什么这个品类在泰国会存在。在 EF 的 2025 年英语熟练度指标中,泰国得分 402,全球平均为 488,排名第 116 位,口语分项为 377。无论你怎么看这套方法论,方向本身没有争议:泰国与外方对手方之间的大量商务会议,是在一门至少有一方在吃力的语言里进行的。房间里的每一个人,都需要在肾上腺素退去之后,用自己的语言重读一遍究竟谈定了什么。
结论:泰国解决了「听懂」,跳过了「记住」
有十年之久,国际商务里对泰语的抱怨是技术听不懂它。到了 2026 年,这条抱怨基本已经过期。泰语在 Live translate 的 74 种里,在 Meet 的 69 种里,在 Nova-3 的 58 种里,在三星的 Interpreter 里,也在 DeepL 的字幕语言里。理解这件事已经被解决,而且大多免费。
没有动的是记录。两个能产出可长期保存产物的 Google 功能,加起来支持八种语言——还是同样的八种——泰语两边都不在。唯一那个为「一句话里混两种语言」而造的模式覆盖十种,泰语也不在。在真实商务音频上公开的泰语词错误率从 0.21 到 0.90 不等,差别完全取决于有没有人愿意为泰语去适配模型。而那位在「听懂」这件事上胜过它们所有人的真人译员,会把整场会议装在脑子里走出房间。
所以,该向厂商提的问题不是「你们支持泰语吗」。现在几乎所有厂商都会说支持,而几乎所有厂商指的都是「听」的那一半。真正的问题是:在通话结束之后,你们哪些功能仍然支持泰语?哪些功能能扛住一句中间夹着英文的泰语?以及,你能把这些具体功能的语言列表拿给我看吗?
Telli.sh 的位置:记录层正是我们在造的那一层。Telli.sh 用会议实际被说出的语言来转写,翻译成包括泰语在内的 44 种目标语言,并把三种产物保存在同一份笔记里——泰语原文、与之对齐的译文,以及在此之上生成的摘要,而且当某个名字被记错时,三者都可以编辑。界面本身提供 15 种语言,泰语在列,因此曼谷的团队和大阪的客户可以各用自己的语言读同一场会议,同时共享同一份可修正的记录。
参考来源
- Sawadee Translations,Interpreting Services,检索于 2026 年 9 月 1 日——交替传译每小时 3,000 泰铢起、同声传译每小时 5,000 泰铢起,以及大多数法律程序和使馆预约采用交替传译的说明。
- Y LINK / Personnel Consultant,Interpretation (Japanese, English, Thai, Chinese),检索于 2026 年 9 月 1 日——现场半天与全天报价表、线上同声传译每 60 分钟 3,000 泰铢与交替传译每 60 分钟 2,000 泰铢、半天/全天的定义、泰国劳动法的加班算式,以及取消费阶梯。
- Acolad,"Simultaneous vs Consecutive Interpreting: Which One Do You Need?",2026 年 4 月 24 日——一到五分钟的段落长度,以及「一场交替传译的时长大致会翻倍,因为每一句话都要被讲两次」。
- Elite Asia,"Simultaneous vs. Consecutive Interpretation: How to Choose for Your Event",检索于 2026 年 9 月 1 日——两种模式各自的设备清单。
- Google 翻译帮助中心,"Hear live speech to speech translations with Live translate",检索于 2026 年 9 月 1 日——包含泰语在内的 74 种语言列表、四种模式、面对面模式,以及后台持续运行。
- Google Meet 帮助中心,"Use translated captions in Google Meet",检索于 2026 年 9 月 1 日——包含泰语在内的 69 种语言列表、付费 Workspace 版本,以及 Record captions。
- Google Meet 帮助中心,"Use Transcripts with Google Meet",检索于 2026 年 9 月 1 日——受支持的八种转写语言。
- Google Meet 帮助中心,"'Take notes for me' in Google Meet",检索于 2026 年 9 月 1 日——同样的八种语言,以及「一次只支持一种语言」。
- 三星,Call assist: Live translate calls on your Galaxy phone,检索于 2026 年 9 月 1 日——受支持语言列表中的泰语,以及一次只能一人使用的注意事项。
- Deepgram,Models & Languages Overview,检索于 2026 年 9 月 1 日——Nova-3 与 Nova-2 表中作为
th和th-TH的泰语、58 个不同的基础语言代码,以及 10 种语言的multi语码转换列表。 - DeepL 帮助中心,"DeepL Voice languages",检索于 2026 年 9 月 1 日——由 DeepL 转写的 18 种口语语言、包含泰语在内的 20 种第三方口语语言、管理员开关、自动检测限制、访问码要求,以及 Speechmatics 的零留存协议。
- Amity AI Labs,"Advancing Thai Speech-to-Text with Thonburian Whisper",2025 年 8 月 14 日——615 个片段的呼叫中心数据集与 422 个片段的保险数据集、WER 表格,以及说话人分离错误率从 31.3% 降到 8.13% 的结果。
- Chormai、Prasertsom 与 Rutherford,"AttaCut: A Fast and Accurate Neural Thai Word Segmenter",2019 年 11 月 16 日提交——分词作为泰语 NLP 的基础预处理步骤。
- EF Education First,EF English Proficiency Index — Thailand,2025 年版,检索于 2026 年 9 月 1 日——全球排名第 116 位、得分 402(全球平均 488),口语分项 377。