GoogleのRSIの噂から考えるAGI:AI開発のペースを巡る議論
AGIと再帰的自己改善を基礎から解説。Googleの噂をXの原文までたどり、アモデイ、アルトマン、マスクの提案とトランプの対中競争論を検証し、加速する未来の可能性と条件を考えます。
Telli.shチームからのニュース、製品アップデート、AIノートの知見をお届けします。
AGIと再帰的自己改善を基礎から解説。Googleの噂をXの原文までたどり、アモデイ、アルトマン、マスクの提案とトランプの対中競争論を検証し、加速する未来の可能性と条件を考えます。
メモリ、プロジェクトのルール、今日入力するプロンプトは、いずれもAIの行動を左右します。指示への忠実さが増すほど、古い応急処置や曖昧な権限が繰り返し問題を起こすこともあります。AIが覚えている内容を点検し、自律的に進めてよい範囲を定め、実際に検証できる指示を書く方法を、2つのテンプレートとともに紹介します。
モデルの訓練だけでは、その能力のすべてを説明できなくなっています。ReflexionやVoyagerからAlphaEvolve、推論時学習、2026年の継続学習実験まで、AIが有用な経験を残す方法の研究が進んでいます。実際に何が変わるのか、どこまで証拠があるのか、そして終わりのないループより信頼できる改善がなぜ重要なのかを考えます。
Google が 70 言語のリアルタイム音声翻訳を発表してから 3 か月、GPT-Live-1 が音声 1 分あたり $0.05 で API に登場しました。公開された価格とベンチマークが何を測り、何を測っていないのか。そして会話が容易になるほど議事録・アイデア共有・保存した出典が重要になる理由を考えます。
2026年9月1日から3日にかけて、Anthropic、Meta、Google、OpenAIがそろってフロンティアモデルを出荷し、CNBCはそこで生じた疲弊に名前を与えた。モデル疲れである。リリース本数は退屈な部分にすぎない。興味深いのは、リリースのひとつひとつが下流の誰かに必ず走らせる評価を生むこと、そしてモデルを出す企業にはその評価を省かせる理由が一切ないことだ。モデル差し替えが実際にいくらかかるのか、なぜトークン単価の安さがタスク単価の安さにならないのか、そしてなぜ狭い仕事ひとつのために作られたフルマネージドのソフトウェアだけが、他人に判断を代わってもらえる形式なのかを検討する。
2026年9月3日、NVIDIAがHugging Faceを12,930,300,000ドルで買収することに合意しました。Groqの資産に投じた200億ドルに次ぐ、同社史上2番目の規模です。Hugging Faceは2016年にティーンエイジャー向けチャットボットアプリとして始まり、最終的に1,800万人の開発者に300万のモデルを届ける場所になりました。そこに至る道のり、NVIDIAの過去2度のプラットフォーム買収が正反対の結末を迎えた理由、そして中立性の約束が実際に決まる場所を読み解きます。ブログ記事ではなく、カーネル、量子化フォーマット、デプロイ先のデフォルトで決まります。
Clip は、ウェブページを保存するだけでなく、AI が書いたタイトルと一行要約が付いた Telli.sh のノートに変えます。この機能は管理者フラグの裏で出荷されたため、2 つの分析カウンターは一度も動きませんでした。そのゲートを取り払いました。無料アカウントでも 1 日あたり 30 件の保存と 10 件の AI 要約が使えます。ブラウザー拡張機能のバージョン 1.18 は、クリップの保存以外は何もできないトークンで認証する右クリックの Save to Telli.sh を追加します。
OpenAI は2026年9月3日に GPT-6 Astra を公開し、世界で最も知的なモデルと呼びました。しかし自社のベンチマーク表はもっと鋭い話をしています。狭い課題での飛躍は巨大(Terminal-Bench Science 22.4%→64.6%、SRE-Bench 55.9%→88.0%、OSWorld は課題あたり47%の時短)である一方、中立的な総合指標は0.3ポイントしか動きませんでした。どこが本物でどこに脚注が付くのか、そして100万トークンのテキストモデルが依然としてできないことを整理します。
Universal Commerce Protocolが2026年1月11日、Google、Shopify、Etsy、Wayfair、Target、Walmartと20社超のパートナーの支持とともに公開されました。しかし仕様を読むと、買い物は最も退屈な部分です。/.well-known/ucp によるディスカバリー、RFC 9421のメッセージ署名、必須のWebhook署名、そしてエージェントの購入を否認できなくすることだけを目的とするAP2マンデート拡張。UCPが実際に標準化したもの、そしてそのうち購入とは何の関係もない一つを精読します。
Telli.sh: Every Translator 1.16 は、ツールバーのポップアップを状態表示画面として作り直しました。いま開いているページのミニチュア、5つのラベル付きチップ、そして拡張機能が「実際に動いている」と確認できたときだけ緑になるドット。設定はすべて、動くスケルトンのプレビューを備えた専用の設定ページへ移りました。インスタント翻訳は独立したタブと、30日で自動的に片づく履歴を得ました。通知ベルは、ブラウザーの言語に合わせて15ロケールの Telli.sh ブログを運びます。
初心者向けに検証済みの OpenClaw 2.0 セットアップ手順をまとめました。必要な Node のバージョン、エージェントにモデルを与える3つの方法とそれぞれのコスト、v2026.8.1 で入った6ステップのガイド付きオンボーディングが尋ねる順序、Telegram の4ステップのペアリング、最初の1週間に回すべき3つのタスク、影響範囲を小さく保つ初日の権限設定、そして新規インストールが実際にぶつかる5つの失敗まで。
2026年8月31日、オープンソースの AI エージェントが v2026.8.1 を公開しました。933人による16,000件超の PR、プロジェクト史上マージされた全 PR のおよそ半分。230日で106回リリースしてきたチームが、49日間あえて沈黙した結果です。セットアップウィザードは既に支払っている ChatGPT や Claude のサブスクリプションをそのまま取り込み、ローカルの Ollama モデルも見つけます。セッションは SQLite へ移り、ダウングレードはもう無料ではありません。「自分が所有する AI」が実際にどんな形をしているのか、破壊的変更とオフのままの既定値まで含めて読み解きます。
バンコクの通訳会社は逐次通訳を1時間3,000バーツから、同時通訳を5,000バーツから公開しており、逐次通訳は会議の所要時間をおよそ倍にします。Google TranslateのLive translateはタイ語を含む74言語、Google Meetの翻訳字幕はタイ語を含む69言語に対応する一方、MeetのTranscriptsとGeminiのメモ作成機能はいずれも8言語のみで、タイ語はどちらにもありません。DeepgramのNova-3はタイ語をthおよびth-THとして文字起こししますが、10言語のコードスイッチングモードからは除外しています。そしてそれこそ、あなたの会議を構成しているタイ語と英語の混ざった文です。タイのチームに向けた会議翻訳の選択肢を、余さず会計します。
Nottaの無料プランは月120分の文字起こしを与え、録音1件あたりを3分で打ち切ります。TurboScribeは1日3ファイル、上限30分。GoogleのAPIは無料60分をくれますが、インターフェイスはくれません。2026年8月7日、Deepgramは改善されたインドネシア語モデルを出荷しましたが、バッチ経路だけです。インドネシアの記者、研究者、採用面接官が実際にぶつかる無料枠を検証して比較し、どこも広告しない限界まで書きました。
単語誤り率は「not」という語と「the」という冠詞をまったく同じ重みで採点します。だからこそ、2本の文字起こしがそろって10.0%になり、そのうち片方しか使い物にならないという事態が起きます。会議の仕様に合わせた12分のテスト音声、正規化ルールを固定した参照文字起こし、cpWERとDERの具体的なコマンド、そして生のWERに100点中10点しか与えない5項目のスコアカード。測定手順のすべてをまとめました。
DeepLは2026年4月16日、40言語以上に対応するVoice-to-Voiceを発表しました。同じ製品のFAQには、会議データは「メモリ上で一時的に処理され、通話が終わると削除される」と書かれています。8月28日にはOpen ASRリーダーボードが初めてグローバルサウスの言語を追加し、WER 4.9で並ぶ2つのモデルが、話者の出身地域によって精度が揺れる幅では4倍近く違うことを示しました。リアルタイム会議翻訳はコモディティになりつつあります。記録はまだです。
2026年8月20日、開発元もモデルカードも価格もないモデルが stealth/ox-alpha として OpenRouter に現れました。4日後、OpenCode のユーザーはそこに26兆トークンを流し込んでいました。6日後、Z.AI が名前を明かします。GLM-5.3-Flash、総パラメータ320B、MITライセンス、入力100万トークンあたり0.15ドル。なぜ研究所は自社名を伏せてモデルを出すのか、あのトラフィック数値が実際に測っているものは何か、そしてブレンド24セントが音声パイプラインの経済性に何をもたらすのかを整理します。
2026年8月4日、DeepgramはNova-3にパンジャブ語とネパール語を追加し、8月7日にはアルメニア語を追加してタミル語、インドネシア語、ベラルーシ語のモデルを改善しました。9か月前は31言語だったものが、今日のドキュメントでは58言語になっています。しかしコードスイッチングが機能するのは正確に10言語だけで、8月のチェンジログ自体が、インドネシア語はバッチのみ、ベラルーシ語はストリーミングのみの改善だったと記しています。音声認識の言語カバレッジが広がる速度と、「対応」という言葉が実際に隠しているものを見ていきます。
Google Meetの翻訳字幕はベトナム語を含む69言語、Google TranslateのLive translateは74言語に対応しています。一方、MeetのTranscripts機能とGeminiによるメモ作成機能はいずれもちょうど8言語のみで、ベトナム語はどちらにも入っていません。DeepL Voiceがベトナム語の発話を文字起こしできるのは、管理者による有効化が必要で自動検出も使えないサードパーティ経由の経路だけです。2026年のリアルタイム音声翻訳がベトナム語チームに実際にもたらすもの、そして最後までもたらさないものを整理します。
3年前、ダウンロードできる最良のモデルは HumanEval で GPT-4 に37ポイント差で敗れ、動かすにはグラフィックカードが2枚必要でした。先週、27B のオープンウェイトモデルが Artificial Analysis の Intelligence Index で 52.0 を記録。Claude Opus 4.6 Max は 44.9 です。価格は9分の1、ファイルは 16.5GB。ベンチマーク表、価格曲線、そして追随ラグが162日まで縮んだことの意味をまとめます。
Telli.sh のパイプライン全体を段階ごとに解説します。ライブ録音と音声アップロード、話者識別を伴う AI 会議文字起こし、44 言語を対象としたリアルタイム会議翻訳、10 種類のフォーマットによる AI 要約、そして共有可能なノートまで。正直な限界と正確な価格、そして会議文字起こしの精度が本当に必要とするものも取り上げます。
議事録要約の研究では、実際の市議会の書き起こしを要約した結果の30.4%に少なくとも1つの事実誤りが含まれ、その背後には7つの誤りの型がありました。AIが書いた議事録を書き起こしと突き合わせて確認する実践ガイド。何をどの順で確認するか、そしてレビューを30分ではなく9分で終えるために会議中に何を言うべきか。
AirPodsのライブ翻訳は10言語をiPhone上だけで処理します。449ドルのTimekettle W4 Proは52言語を掲げ、Pixel Budsは40言語ですが接続が必要です。2026年8月18日、4社の公式サポートページを読み込み、マーケティングが飛ばす問いに答えました。会話が終わったあと、その会話をまだ持っているのはどれか。翻訳イヤホン市場のガイドと、誰も売っていない「もうひとつの仕事」の話です。
2026年8月11日、Anthropic は Claude が書いた文章に、後から追跡できる印を入れ始めました。この印はコピー&ペーストどころか翻訳にも耐えますが、書き直せば消えます。テキスト電子透かしの仕組み、検出結果が証明できること・できないこと、誤検知による冤罪の歴史、そしてこれまでに記録された 1,922 件のハルシネーション事例がすべてこの検査を通過していたであろう理由を、平易な言葉で整理しました。
Qwen3.8-27B は Apache 2.0。Q4_K_M の GGUF は 17.1 GB で 32 GB のノートPCに収まり、FP8 は 30.9 GB。実測は RTX 4090 で毎秒 48 トークン、Mac mini M4 Pro で 12.75 トークン。
アリババのQwen3-ASRはApache 2.0ライセンスで52の言語と方言に対応し、ダウンロードサイズは2ギガバイト未満です。オープンウェイトの文字起こし層をやさしく整理しました。いま何があるのか、自分のノートPCで動かすと実際に何が手に入るのか、そしてクローズドなAPIがいまだに勝っている場所はどこか。
7月20日、Telli.sh の有料プラン価格が再び下がりました。Pro は月 $8、Pro+ は月 $10、年額プランは 15% 割引を維持します。変更前後の比較表と、価格を切りのよい数字にそろえた理由をまとめます。
この3週間で、中国の主要AIラボがフロンティア級のオープンウェイトモデルを公開、あるいは予告しました——Kimi K3、Qwen3.8-Max、そして正式提供に達したDeepSeek V4。それぞれが何なのか、何が実際に出て何がまだ約束なのか、そしてなぜ北京がいま自ら育てた波を規制しようとしているのかを、平易な言葉で読み解きます。
OpenAIの2026年7月の調査では、職種固有のChatGPTメッセージの43.5%が本人の職務外の仕事に関するものでした。そうした仕事は文脈に支えられていますが、組織の文脈の大半は会議のなかで消えていきます。会議を検索可能な業務知識に変える実践ガイド — 何を残し、どう名前を付け、どの会議を記録として保存し、検索がオンボーディングと引き継ぎをどう変えるのか。
ボトルネックは会議ではなく、その翌日です。決定は輪郭を失い、担当者は曖昧になり、フォローアップはDMの中で消えていきます。実行する組織が実際に回しているノートのループ——決定・担当者・期限を会議中に書き、数分以内に共有し、次の会議をそのノートで開く——を具体的にたどります。
MicrosoftのMAI-Transcribe-1.5は単語誤り率2.4%を記録しました。そして同じモデルの公式ドキュメントには「話者分離はサポートされていません」と書かれています。WERが何を測っているのか、なぜリーダーボードが下限に密集しているのか、そして文字起こしを実用的な議事録に変えるのは音声認識の上のどの層なのかを、平易に整理します。
GranolaはAIメモを手首に載せ、VOMOは40万ユーザーを突破し、オープンソースの代替も数週間で登場しました。しかし「よい議事録」の条件は何ひとつ変わっていません。今も必ず残すべき6項目と、60秒でできる自己点検法をまとめます。
Kimi K3は2026年のオープンウェイトの主役ですが、いま実際にダウンロードして使えるのはGLM-5.2です。両モデルを率直に整理し、寛容なライセンスのオープンモデルが会議ノートになぜ重要なのかを解説します。
OpenAI は gpt-5.6 のエイリアスを Sol に割り当て、バランス重視は Terra、大量処理は Luna としました。推論エフォートは none から max まで、既定は medium。GPT-5.5 からの移行で何が変わるか。
Anthropic Fable 5のアクセス一時停止は、より安全なAIモデルであっても、明確な安全策、出典記録、ユーザーに説明できる制御が必要であることを示しています。
Deepgram の話者分離 v2 は従来の本番ダイアライザーより 3.3 倍好まれました。ただし diarize_model はバッチ専用で、ストリーミングには使えません。韓国語の分かち書きと多言語の数字表記も更新。
日付つきのスナップショットです。2026年6月28日、OpenAI の最新モデル案内はまだ GPT-5.6 ではなく GPT-5.5 を指していました。推論、ツール利用、ロングコンテキストについて何が書かれていたか。
より多くのユーザーがライブAIノート、文字起こし、要約、多言語ミーティングワークフローを使えるように、Telli.shの有料プラン価格を引き下げました。
GoogleはMeetとTranslateにライブ音声翻訳を広げています。Telli.shは、その場の翻訳だけでなく、あとで確認できる会議記録に注目します。
South Australia Policeはインタビュー向けAI音声文字起こしの実証を準備しています。重要なのは速さだけでなく、確認できる原文記録です。
無料の Google 翻訳モード、Chrome 内蔵のオンデバイス AI、原文の横に訳文を表示する体験を備えた Telli.sh: Every Translator を公開しました。