Deepgram STT 更新对 Telli.sh 实时笔记意味着什么
Deepgram 发布了实时 Listen 配置更新、韩语空格改进、多语言数字格式化和批量说话人分离 v2。Telli.sh 默认使用 Deepgram 作为语音引擎,因此这些更新会影响实时 AI 笔记体验。
Deepgram 最近发布了多项与实时会议笔记相关的语音识别更新。我们在 2026 年 6 月 28 日查看了官方 changelog,方向很清楚:STT 正在变得更可调、更适合多语言,也更适合长时间对话记录。
这对 Telli.sh 很重要,因为 Telli.sh 在生产环境中默认使用 Deepgram 作为语音引擎。当引擎变好,实时笔记、上传音频转写、摘要和多语言会议记录的基础质量也会变好。

Image: Dejan Krsmanovic, Wikimedia Commons, CC BY 2.0.
Deepgram 发布了什么
最新项目是 2026 年 6 月 15 日发布的 UpdateListen。它允许实时语音会话在不中断和不重启的情况下更新 Listen 配置。可调整字段包括发言结束阈值、积极结束阈值、超时、关键词和语言提示。
对用户来说,这意味着会议主题、术语或语言组合变化时,系统未来可以更好地适应,而不是要求重新开始录音。
5 月还有几项重要 STT 更新:
ko和ko-KR韩语转写的词间空格得到改善,韩语笔记更容易阅读和复核。- 使用
language=multi的 Nova-2、Nova-3 和 Flux 多语言模型现在支持 profanity filtering。 - Nova-3 多语言模型可以在许多语言中把口语数字格式化为数字,适合预算、日期、数量和行动项。
- 批量说话人分离 v2 可通过
diarize_model使用;Deepgram 表示,在人工对比评估中 v2 相比上一代生产 diarizer 获得了 3.3 倍偏好。
一个限制也很重要:Deepgram 说明 diarize_model 用于批量请求,不适用于流式请求。Telli.sh 会明确区分这一点,并在验证后逐步应用。
对 Telli.sh 用户的意义
最直接的收益是转写质量。韩语用户会得到更易读的原始转写。多语言会议会受益于更好的数字格式化和内容过滤,从而减少会后整理负担。
下一层是实时会话控制。UpdateListen 对实时 AI 笔记特别重要。技术会议可能需要强调产品术语,双语会议可能需要语言提示,快速对话可能需要不同的发言结束时机。这个能力让我们可以在不中断录音的情况下优化会话质量。
对于上传录音和较长的批量处理,diarization v2 可能提升按说话人整理笔记的质量。我们会先用真实会议音频验证,再决定生产流量的切换方式。
好的 STT 还需要产品层
Deepgram 改善转写。Telli.sh 把转写变成工作流:实时录音状态、源语言选择、可复核文本、AI 精修、摘要、决策、行动项和可再次查找的会议记录。
用户不应该管理更多底层参数。我们的目标是更少错误、更清晰的笔记,以及更少的会后整理工作。