博客

来自 Telli.sh 团队的新闻、产品更新和 AI 笔记洞察。

ai industry

三天四个前沿模型,可没人会告诉你你需要的是哪一个

2026年9月1日到3日,Anthropic、Meta、Google和OpenAI接连发布前沿模型,CNBC给由此产生的疲惫起了个名字:模型疲劳。发布数量是这件事里最无聊的部分。有意思的是,每一次发布都会制造出一场必须由下游某个人来跑的评测,而发布模型的公司完全没有理由帮你省掉它。本文拆解一次模型更换的真实代价,为什么每token更便宜并不等于每任务更便宜,以及为什么只为一件窄活儿打造的全托管软件,是唯一能让别人替你做决定的形态。

Ken Jo·阅读全文
ai industry

NVIDIA 用 129.3 亿美元买下的不是一个模型平台,而是默认值

2026 年 9 月 3 日,NVIDIA 同意以 12,930,300,000 美元收购 Hugging Face,这是它有史以来第二大的交易,仅次于为 Groq 资产付出的 200 亿美元。Hugging Face 在 2016 年是一个面向青少年的聊天机器人应用,最后成了为 1800 万开发者托管 300 万个模型的地方。本文细读它是怎么走到这一步的、NVIDIA 前两次平台押注为何走向相反的结局,以及中立性承诺真正被决定的地方:不在博客文章里,而在内核、量化格式和默认部署目标里。

Ken Jo·阅读全文
product update

Clip 把网页变成一条摘要已经写好的笔记。从今天起,它对每一个 Telli.sh 账号开放

Clip 不只是把网页存起来,而是把它变成一条带 AI 写好的标题和一句话摘要的 Telli.sh 笔记。它上线时被藏在管理员开关后面,于是两个分析计数器一次都没有跳过。现在这道闸门拆掉了:免费账号每天有 30 次保存和 10 次 AI 摘要;浏览器扩展 1.18 版新增了右键的 Save to Telli.sh,用一枚除了保存剪藏之外什么都做不了的令牌完成认证。

Ken Jo·阅读全文
ai models

从75分钟到40分钟:GPT-6 Astra 真正擅长的是什么

OpenAI 于2026年9月3日发布 GPT-6 Astra,称其为世界上最聪明的模型。但它自己的基准表讲了一个更尖锐的故事:窄任务上的跃升极为惊人(Terminal-Bench Science 22.4%→64.6%,SRE-Bench 55.9%→88.0%,OSWorld 单任务耗时减少47%),而中立综合指标只动了0.3分。哪些提升是真的,哪些带着脚注,以及一个百万 token 的文本模型至今仍然做不到什么。

Ken Jo·阅读全文
ai agents

谷歌 UCP 在每次结账请求上挂了四个标头,其中三个是为日后的争议准备的

Universal Commerce Protocol 于 2026 年 1 月 11 日发布,谷歌与 Shopify 联合开发,Etsy、Wayfair、Target、Walmart 等 20 多家伙伴背书。但读完规范会发现,购物是其中最无聊的部分:/.well-known/ucp 发现机制、RFC 9421 消息签名、强制 Webhook 签名,以及一个唯一目的就是让智能体的购买无法抵赖的 AP2 授权书扩展。本文细读 UCP 真正标准化了什么,以及其中与买东西毫无关系的那一项。

Ken Jo·阅读全文
product update

扩展的弹窗一直在回答错误的问题。1.16 改为画出你正在看的这个页面

Telli.sh: Every Translator 1.16 把工具栏弹窗重做成状态视图:当前页面的微缩图、五个带标签的信息片,以及只有在扩展能确认「确实在运行」时才变绿的状态点。所有配置都搬到了带实时骨架预览的独立设置页;即时翻译获得了自己的标签页和一份 30 天自动清理的历史记录;通知铃现在按浏览器语言、跨 15 个语言版本推送 Telli.sh 博客。

Ken Jo·阅读全文
guide

一条安装命令加一个机器人令牌:写给从没跑过智能体的人的 OpenClaw 2.0 上手指南

一份逐条核对过的 OpenClaw 2.0 新手安装指南:需要的 Node 版本、给智能体接上模型的三条路线及各自成本、v2026.8.1 新引导式初始化按顺序问的六件事、Telegram 四步配对、第一周值得跑的三个任务、把影响范围压小的第一天权限设置,以及新装机器真正会撞上的五个失败。

Ken Jo·阅读全文
ai agents

OpenClaw 2.0 一次性发布了项目历史上合并过的近一半 PR——而此前它整整七周什么都没发

2026 年 8 月 31 日,一个开源 AI 智能体发布了 v2026.8.1:933 位贡献者提交的 16,000 多个 PR,约占项目有史以来合并总量的一半。此前这个团队在 230 天里发了 106 个版本,然后刻意沉默了 49 天。现在安装向导会直接复用你已经在付费的 ChatGPT 或 Claude 订阅,也会找出你本地的 Ollama 模型。会话迁到了 SQLite,降级不再是免费的。这是一次对「你自己拥有的 AI」到底长什么样的细读,包括破坏性变更和那些依然默认关闭的开关。

Ken Jo·阅读全文
ai translation

交替传译把会议时长翻倍,实时翻译则转头就忘:2026 年泰国团队真正要在两者之间做的选择

曼谷的翻译公司公开报价:交替传译每小时 3,000 泰铢起,同声传译 5,000 泰铢起,而交替传译大致会把会议时长翻一倍。Google 翻译的 Live translate 覆盖 74 种语言,泰语在列;Google Meet 的翻译字幕覆盖 69 种,泰语也在列——但 Meet 的 Transcripts 与 Gemini 记录助手各自只支持 8 种语言,泰语一个都没进。Deepgram 的 Nova-3 能把泰语转写为 th 和 th-TH,却把它排除在 10 种语言的语码转换模式之外,而那恰恰是你会议里最常见的泰英混说句。本文为泰国团队把会议翻译的所有选项算一遍账。

Ken Jo·阅读全文
transcription

装不下一场采访的免费 120 分钟:印尼语的免费 AI 转写,实际给你的是什么

Notta 的免费套餐每月给 120 分钟转写,单条录音卡在 3 分钟。TurboScribe 每天给 3 个文件,上限 30 分钟。谷歌的 API 给你 60 分钟免费额度,但不给界面。2026 年 8 月 7 日,Deepgram 上线了改进后的印尼语模型——只在批处理这条路上。这是一份实测过的对比:印尼的记者、研究者和 HR 面试官真正会撞上的免费套餐,以及它们都不会写在广告里的限制。

Ken Jo·阅读全文
guide

同样是 10.0% 的错误率,结论却完全相反:会议转写准确度该怎么测

单词错误率给「not」和「the」打的是同一个分数,所以两份转写稿可以同时落在 10.0%,而其中只有一份能用。这里是完整的测量流程:一段按会议规格搭建的 12 分钟测试音频、一份冻结了归一化规则的参考转写稿、cpWER 与 DER 的确切命令,以及一张只给原始 WER 100 分中 10 分的五维评分卡。

Ken Jo·阅读全文
ai translation

40 多种语言实时互译,挂断即删:真正把会议留下来的,是多语言转写这一层

DeepL 于 2026 年 4 月 16 日发布支持 40 多种语言的 Voice-to-Voice,而同一款产品的 FAQ 写着:会议数据「在内存中临时处理,通话结束后即被删除」。8 月 28 日,Open ASR 排行榜首次加入全球南方语言,并显示两个在 4.9 WER 上难分高下的模型,在「精度随说话人来自哪里而波动的幅度」上相差近四倍。实时会议翻译正在变成大路货,记录还不是。

Ken Jo·阅读全文
ai models

一个匿名模型四天烧掉26万亿tokens。价目表姗姗来迟:混合价24美分

2026年8月20日,一个没有厂商、没有模型卡、没有价格的模型以 stealth/ox-alpha 的名字出现在 OpenRouter 上。四天后,OpenCode 用户已经在它身上跑掉了26万亿 tokens。六天后,Z.AI 认领了它:GLM-5.3-Flash,总参数320B,MIT 许可证,输入每百万 tokens 0.15 美元。为什么实验室开始不署名发布模型,那些流量数字究竟测量了什么,以及混合价24美分对语音处理管线的经济性意味着什么。

Ken Jo·阅读全文
speech recognition

Nova-3 本月迎来第 58 种语言。但只有 10 种能出现在同一个句子里。

2026 年 8 月 4 日,Deepgram 为 Nova-3 新增了旁遮普语和尼泊尔语;8 月 7 日又新增亚美尼亚语,并改进了泰米尔语、印尼语和白俄罗斯语。九个月前这个模型只覆盖 31 种语言,如今官方文档列出了 58 种。但语码转换依然只支持其中 10 种,而 8 月自家的更新日志显示:印尼语只在批处理中改进,白俄罗斯语只在流式中改进。本文梳理语音识别语言覆盖的扩张速度,以及「支持」这个词究竟掩盖了什么。

Ken Jo·阅读全文
ai translation

Google 会实时翻译你的越南语会议,却一个字都不会替你记下来

Google Meet 的翻译字幕覆盖 69 种语言,越南语在列;Google 翻译的 Live translate 覆盖 74 种。而 Meet 的 Transcripts 功能与它的 Gemini 记录助手各自只支持 8 种语言,越南语一个都没进。DeepL Voice 要转写越南语口语,只能走一条必须由管理员启用、且无法使用自动检测的第三方通道。本文盘点 2026 年的实时语音翻译究竟给了越南团队什么——以及它始终不给的是什么。

Ken Jo·阅读全文
ai models

一个 16.5GB 的文件,分数超过了二月最强的闭源模型

三年前,你能下载到的最好模型在 HumanEval 上落后 GPT-4 三十七分,而且要两块显卡才跑得动。上周,一个 27B 开放权重模型在 Artificial Analysis 智能指数上拿到 52.0,Claude Opus 4.6 Max 是 44.9。价格只有九分之一,文件只有 16.5GB。本文把基准表、价格曲线,以及追赶时差缩短到162天这件事的含义讲清楚。

Ken Jo·阅读全文
translation

四款翻译耳机,一个问题:会议结束后,还剩下什么?

AirPods 实时翻译支持 10 种语言,全部在 iPhone 本机处理;449 美元的 Timekettle W4 Pro 号称 52 种语言;Pixel Buds 支持 40 种但需要联网。2026 年 8 月 18 日,我们逐一读完四家厂商自己的支持文档,回答营销页面跳过的那个问题:对话结束之后,哪一款还留着这段对话?这是一份翻译耳机现状指南,也是关于没人卖给你的第二件工作的说明。

Ken Jo·阅读全文
ai and society

Anthropic 开始给 Claude 的文字加水印 — 而 1,922 份判决说明了它治不了什么

2026 年 8 月 11 日,Anthropic 开始在 Claude 写出的文字里嵌入可追溯的标记。这个标记能扛住复制粘贴,甚至能扛住翻译,却会在重写中消失。本文用通俗语言讲清文本水印的原理、一次检测结果能证明和不能证明什么、误判冤案的历史为何重要,以及为什么已记录在案的 1,922 起幻觉事件全都能通过这项检查。

Ken Jo·阅读全文