从Google的RSI传闻看AGI:AI领袖为何呼吁调整开发节奏
从零理解AGI与递归式自我改进,追溯Google传闻的X原帖,核对阿莫迪、奥特曼、马斯克的表态与特朗普的对华竞争论,探讨加速发展的希望及其必要条件。
来自 Telli.sh 团队的新闻、产品更新和 AI 笔记洞察。
从零理解AGI与递归式自我改进,追溯Google传闻的X原帖,核对阿莫迪、奥特曼、马斯克的表态与特朗普的对华竞争论,探讨加速发展的希望及其必要条件。
记忆、项目规则和你今天输入的提示词,都会影响 AI 助手。随着模型越来越忠实地遵循指令,过时的补救措施和含糊的授权也可能变成长期问题。这份实用指南教你审查助手记住了什么、界定有用的自主权,以及编写真正可以验证的指令,并提供两份可修改使用的模板。
一次训练已经无法说明模型能力的全部。从 Reflexion、Voyager 到 AlphaEvolve、测试时训练,再到 2026 年的持续学习实验,研究正在展示 AI 系统如何保留有用的经验。究竟什么发生了变化,哪些证据足够扎实,以及为什么可靠的改进比无休止的循环更重要。
继 Google 推出覆盖 70 种语言的实时语音翻译三个月后,GPT-Live-1 以每分钟语音 $0.05 的价格开放 API。本文梳理已公布的价格和基准测试衡量了什么、没有衡量什么,以及为什么对话越容易,会议记录、想法分享和收藏的资料就越重要。
2026年9月1日到3日,Anthropic、Meta、Google和OpenAI接连发布前沿模型,CNBC给由此产生的疲惫起了个名字:模型疲劳。发布数量是这件事里最无聊的部分。有意思的是,每一次发布都会制造出一场必须由下游某个人来跑的评测,而发布模型的公司完全没有理由帮你省掉它。本文拆解一次模型更换的真实代价,为什么每token更便宜并不等于每任务更便宜,以及为什么只为一件窄活儿打造的全托管软件,是唯一能让别人替你做决定的形态。
2026 年 9 月 3 日,NVIDIA 同意以 12,930,300,000 美元收购 Hugging Face,这是它有史以来第二大的交易,仅次于为 Groq 资产付出的 200 亿美元。Hugging Face 在 2016 年是一个面向青少年的聊天机器人应用,最后成了为 1800 万开发者托管 300 万个模型的地方。本文细读它是怎么走到这一步的、NVIDIA 前两次平台押注为何走向相反的结局,以及中立性承诺真正被决定的地方:不在博客文章里,而在内核、量化格式和默认部署目标里。
Clip 不只是把网页存起来,而是把它变成一条带 AI 写好的标题和一句话摘要的 Telli.sh 笔记。它上线时被藏在管理员开关后面,于是两个分析计数器一次都没有跳过。现在这道闸门拆掉了:免费账号每天有 30 次保存和 10 次 AI 摘要;浏览器扩展 1.18 版新增了右键的 Save to Telli.sh,用一枚除了保存剪藏之外什么都做不了的令牌完成认证。
OpenAI 于2026年9月3日发布 GPT-6 Astra,称其为世界上最聪明的模型。但它自己的基准表讲了一个更尖锐的故事:窄任务上的跃升极为惊人(Terminal-Bench Science 22.4%→64.6%,SRE-Bench 55.9%→88.0%,OSWorld 单任务耗时减少47%),而中立综合指标只动了0.3分。哪些提升是真的,哪些带着脚注,以及一个百万 token 的文本模型至今仍然做不到什么。
Universal Commerce Protocol 于 2026 年 1 月 11 日发布,谷歌与 Shopify 联合开发,Etsy、Wayfair、Target、Walmart 等 20 多家伙伴背书。但读完规范会发现,购物是其中最无聊的部分:/.well-known/ucp 发现机制、RFC 9421 消息签名、强制 Webhook 签名,以及一个唯一目的就是让智能体的购买无法抵赖的 AP2 授权书扩展。本文细读 UCP 真正标准化了什么,以及其中与买东西毫无关系的那一项。
Telli.sh: Every Translator 1.16 把工具栏弹窗重做成状态视图:当前页面的微缩图、五个带标签的信息片,以及只有在扩展能确认「确实在运行」时才变绿的状态点。所有配置都搬到了带实时骨架预览的独立设置页;即时翻译获得了自己的标签页和一份 30 天自动清理的历史记录;通知铃现在按浏览器语言、跨 15 个语言版本推送 Telli.sh 博客。
一份逐条核对过的 OpenClaw 2.0 新手安装指南:需要的 Node 版本、给智能体接上模型的三条路线及各自成本、v2026.8.1 新引导式初始化按顺序问的六件事、Telegram 四步配对、第一周值得跑的三个任务、把影响范围压小的第一天权限设置,以及新装机器真正会撞上的五个失败。
2026 年 8 月 31 日,一个开源 AI 智能体发布了 v2026.8.1:933 位贡献者提交的 16,000 多个 PR,约占项目有史以来合并总量的一半。此前这个团队在 230 天里发了 106 个版本,然后刻意沉默了 49 天。现在安装向导会直接复用你已经在付费的 ChatGPT 或 Claude 订阅,也会找出你本地的 Ollama 模型。会话迁到了 SQLite,降级不再是免费的。这是一次对「你自己拥有的 AI」到底长什么样的细读,包括破坏性变更和那些依然默认关闭的开关。
曼谷的翻译公司公开报价:交替传译每小时 3,000 泰铢起,同声传译 5,000 泰铢起,而交替传译大致会把会议时长翻一倍。Google 翻译的 Live translate 覆盖 74 种语言,泰语在列;Google Meet 的翻译字幕覆盖 69 种,泰语也在列——但 Meet 的 Transcripts 与 Gemini 记录助手各自只支持 8 种语言,泰语一个都没进。Deepgram 的 Nova-3 能把泰语转写为 th 和 th-TH,却把它排除在 10 种语言的语码转换模式之外,而那恰恰是你会议里最常见的泰英混说句。本文为泰国团队把会议翻译的所有选项算一遍账。
Notta 的免费套餐每月给 120 分钟转写,单条录音卡在 3 分钟。TurboScribe 每天给 3 个文件,上限 30 分钟。谷歌的 API 给你 60 分钟免费额度,但不给界面。2026 年 8 月 7 日,Deepgram 上线了改进后的印尼语模型——只在批处理这条路上。这是一份实测过的对比:印尼的记者、研究者和 HR 面试官真正会撞上的免费套餐,以及它们都不会写在广告里的限制。
单词错误率给「not」和「the」打的是同一个分数,所以两份转写稿可以同时落在 10.0%,而其中只有一份能用。这里是完整的测量流程:一段按会议规格搭建的 12 分钟测试音频、一份冻结了归一化规则的参考转写稿、cpWER 与 DER 的确切命令,以及一张只给原始 WER 100 分中 10 分的五维评分卡。
DeepL 于 2026 年 4 月 16 日发布支持 40 多种语言的 Voice-to-Voice,而同一款产品的 FAQ 写着:会议数据「在内存中临时处理,通话结束后即被删除」。8 月 28 日,Open ASR 排行榜首次加入全球南方语言,并显示两个在 4.9 WER 上难分高下的模型,在「精度随说话人来自哪里而波动的幅度」上相差近四倍。实时会议翻译正在变成大路货,记录还不是。
2026年8月20日,一个没有厂商、没有模型卡、没有价格的模型以 stealth/ox-alpha 的名字出现在 OpenRouter 上。四天后,OpenCode 用户已经在它身上跑掉了26万亿 tokens。六天后,Z.AI 认领了它:GLM-5.3-Flash,总参数320B,MIT 许可证,输入每百万 tokens 0.15 美元。为什么实验室开始不署名发布模型,那些流量数字究竟测量了什么,以及混合价24美分对语音处理管线的经济性意味着什么。
2026 年 8 月 4 日,Deepgram 为 Nova-3 新增了旁遮普语和尼泊尔语;8 月 7 日又新增亚美尼亚语,并改进了泰米尔语、印尼语和白俄罗斯语。九个月前这个模型只覆盖 31 种语言,如今官方文档列出了 58 种。但语码转换依然只支持其中 10 种,而 8 月自家的更新日志显示:印尼语只在批处理中改进,白俄罗斯语只在流式中改进。本文梳理语音识别语言覆盖的扩张速度,以及「支持」这个词究竟掩盖了什么。
Google Meet 的翻译字幕覆盖 69 种语言,越南语在列;Google 翻译的 Live translate 覆盖 74 种。而 Meet 的 Transcripts 功能与它的 Gemini 记录助手各自只支持 8 种语言,越南语一个都没进。DeepL Voice 要转写越南语口语,只能走一条必须由管理员启用、且无法使用自动检测的第三方通道。本文盘点 2026 年的实时语音翻译究竟给了越南团队什么——以及它始终不给的是什么。
三年前,你能下载到的最好模型在 HumanEval 上落后 GPT-4 三十七分,而且要两块显卡才跑得动。上周,一个 27B 开放权重模型在 Artificial Analysis 智能指数上拿到 52.0,Claude Opus 4.6 Max 是 44.9。价格只有九分之一,文件只有 16.5GB。本文把基准表、价格曲线,以及追赶时差缩短到162天这件事的含义讲清楚。
逐段拆解 Telli.sh 的完整流水线:实时录音与音频上传、带说话人识别的 AI 会议转写、覆盖 44 种目标语言的实时会议翻译、10 种格式的 AI 摘要,以及可分享的笔记。同时给出诚实的边界、准确的价格,以及会议转写准确率真正需要什么。
关于会议转录摘要的研究发现,市议会会议转录稿的生成摘要中有 30.4% 至少含一处事实错误,背后是七种可命名的错误类型。这是一份把 AI 会议纪要与转录稿对照复核的实用指南:先查什么、按什么顺序查,以及在会议室里说哪几句话,能让复核只花九分钟而不是三十分钟。
AirPods 实时翻译支持 10 种语言,全部在 iPhone 本机处理;449 美元的 Timekettle W4 Pro 号称 52 种语言;Pixel Buds 支持 40 种但需要联网。2026 年 8 月 18 日,我们逐一读完四家厂商自己的支持文档,回答营销页面跳过的那个问题:对话结束之后,哪一款还留着这段对话?这是一份翻译耳机现状指南,也是关于没人卖给你的第二件工作的说明。
2026 年 8 月 11 日,Anthropic 开始在 Claude 写出的文字里嵌入可追溯的标记。这个标记能扛住复制粘贴,甚至能扛住翻译,却会在重写中消失。本文用通俗语言讲清文本水印的原理、一次检测结果能证明和不能证明什么、误判冤案的历史为何重要,以及为什么已记录在案的 1,922 起幻觉事件全都能通过这项检查。
Qwen3.8-27B 采用 Apache 2.0 许可。Q4_K_M 的 GGUF 为 17.1 GB,32 GB 笔记本即可运行;FP8 为 30.9 GB。实测 RTX 4090 每秒 48 个 token,Mac mini M4 Pro 为 12.75。
阿里巴巴的 Qwen3-ASR 采用 Apache 2.0 许可,覆盖 52 种语言和方言,下载体积不到两个 GB。这是一份关于开放权重转写层的通俗指南:现在有哪些模型,在自己的笔记本上跑起来到底能得到什么,以及闭源 API 依然占优的地方在哪里。
7月20日,Telli.sh 付费套餐价格再次下调:Pro 每月 $8,Pro+ 每月 $10,年付继续享受 15% 折扣。本文给出新旧对照表,并说明我们为什么把价格抹成整数。
短短三周,中国头部AI实验室接连发布或预告了前沿级开放权重模型——Kimi K3、Qwen3.8-Max,以及已进入正式可用的DeepSeek V4。用大白话讲清每个模型是什么、哪些真正落地、哪些仍是承诺,以及北京为何如今要监管自己催生的这波浪潮。
OpenAI 2026 年 7 月的研究发现,职业特定的 ChatGPT 消息中有 43.5% 属于用户本职之外的工作。这类工作靠上下文驱动,而组织的大部分上下文都在会议里蒸发了。本文是一份把会议变成可搜索工作知识的实操指南:留下什么、如何命名、哪些会议值得留存记录,以及搜索如何改变入职与交接。
瓶颈很少是会议本身,而是第二天:决定失去棱角,负责人变得模糊,后续动作消失在私聊里。本文完整拆解真正能落地的团队所跑的笔记闭环——在会议进行中写下决定、负责人与截止日期,几分钟内同步出去,并用这份笔记开启下一次会议。
微软 MAI-Transcribe-1.5 拿下 2.4% 的词错误率,而它自己的官方文档写着「不支持说话人分离」。本文用大白话讲清楚:WER 到底测的是什么,为什么排行榜已经挤在地板上,以及把转写变成一份能用的会议纪要,真正起作用的是语音识别之上的哪几层。
Granola 把 AI 记事本搬上了手表,VOMO 用户突破 40 万,开源替代品几周内就出现了。但这些都没有改变「什么才算一份好会议记录」。这里是仍然必须写进去的六件事,以及一套 60 秒自查法。
Kimi K3 是 2026 年开放权重浪潮的主角,但真正现在就能下载使用的模型是 GLM-5.2。本文坦诚梳理这两款模型,并说明宽松许可的开放模型为何对会议记录如此重要。
OpenAI 将 gpt-5.6 别名指向 Sol,Terra 兼顾成本,Luna 面向高并发。推理强度从 none 到 max,默认 medium——从 GPT-5.5 迁移时这些都会变。
Anthropic Fable 5 的访问暂停说明,即使是更安全的 AI 模型,也需要清晰的安全措施、来源记录和用户可理解的控制机制。
Deepgram 的说话人分离 v2 在人工评测中比原有生产版本多被选择 3.3 倍,但 diarize_model 仅支持批处理,不支持流式。此外还有韩语分词和多语言数字格式的更新。
一份带日期的快照:2026 年 6 月 28 日,OpenAI 的最新模型指南仍指向 GPT-5.5 而非 GPT-5.6。文档当时如何描述推理、工具调用与长上下文执行。
我们下调了 Telli.sh 付费方案价格,让更多用户可以使用实时 AI 笔记、转录、摘要和多语言会议工作流。
Google 正在把实时语音翻译带入 Meet 和 Translate。Telli.sh 关注的是翻译之后仍要保留下来的可复查会议记录。
South Australia Police 正准备在访谈中试用 AI speech-to-text。对严肃的会议和访谈来说,速度必须和可复核的原文记录一起出现。
Telli.sh: Every Translator 已在 Chrome 网上应用店发布,支持免费的 Google 翻译模式、Chrome 内置端侧 AI,以及原文旁显示译文。