Googles RSI-Gerücht und AGI: Warum KI-Chefs über das Tempo sprechen
AGI und rekursive Selbstverbesserung verständlich erklärt: die X-Quellen zum Google-Gerücht, die Positionen der KI-Chefs und Trumps Einwand zur Konkurrenz mit China.
Neuigkeiten, Produktupdates und Einblicke vom Telli.sh-Team.
AGI und rekursive Selbstverbesserung verständlich erklärt: die X-Quellen zum Google-Gerücht, die Positionen der KI-Chefs und Trumps Einwand zur Konkurrenz mit China.
Erinnerungen, Projektregeln und die heutige Eingabe beeinflussen gemeinsam einen KI-Assistenten. Wenn Modelle Anweisungen genauer befolgen, können alte Behelfslösungen und unklare Berechtigungen zu dauerhaften Problemen werden. Ein praktischer Leitfaden, um gespeicherte Informationen zu prüfen, sinnvolle Autonomie festzulegen und überprüfbare Anweisungen zu schreiben – mit zwei anpassbaren Vorlagen.
Der Trainingslauf erklärt längst nicht mehr die gesamten Fähigkeiten eines KI-Systems. Forschung von Reflexion und Voyager über AlphaEvolve und Test-Time Training bis zu Experimenten zum kontinuierlichen Lernen aus dem Jahr 2026 zeigt, wie nutzbare Erfahrung erhalten bleiben kann. Was sich tatsächlich verändert, wo die Belege belastbar sind und warum überprüfbare Verbesserung wichtiger ist als eine endlose Schleife.
GPT-Live-1 ist für 0,05 US-Dollar pro Sprachminute per API verfügbar, drei Monate nach Googles Live-Sprachübersetzung für 70 Sprachen. Was die veröffentlichten Preise und Benchmarks messen, was nicht, und warum Gesprächsprotokolle, geteilte Ideen und gespeicherte Quellen wichtiger werden, je leichter Gespräche fallen.
Zwischen dem 1. und 3. September 2026 haben Anthropic, Meta, Google und OpenAI allesamt Frontier-Modelle ausgeliefert, und CNBC hat der daraus folgenden Erschöpfung einen Namen gegeben: Modellmüdigkeit. Die Zahl der Releases ist der langweilige Teil. Interessant ist, dass jedes Release eine Evaluation erzeugt, die weiter unten jemand durchführen muss – und dass die Anbieter keinerlei Grund haben, Ihnen diese Arbeit zu ersparen. Ein Blick darauf, was ein Modellwechsel tatsächlich kostet, warum günstiger pro Token nicht günstiger pro Aufgabe bedeutet, und warum vollständig verwaltete Software für genau eine Aufgabe die einzige Konstellation ist, in der jemand anderes die Entscheidung für Sie treffen kann.
Am 3. September 2026 hat NVIDIA zugestimmt, Hugging Face für 12.930.300.000 Dollar zu übernehmen. Es ist die zweitgrößte Transaktion der Firmengeschichte, nach 20 Milliarden Dollar für die Vermögenswerte von Groq. Hugging Face startete 2016 als Chatbot-App für Jugendliche und hostet heute 3 Millionen Modelle für 18 Millionen Entwickler. Eine genaue Lektüre: wie es dahin kam, warum NVIDIAs zwei frühere Plattformwetten gegensätzlich endeten und wo über das Neutralitätsversprechen tatsächlich entschieden wird. Nicht in einem Blogbeitrag, sondern in Kerneln, Quantisierungsformaten und Standard-Deploy-Zielen.
Clip speichert eine Webseite nicht nur, sondern macht daraus eine Telli.sh-Notiz mit einem von der KI geschriebenen Titel und einer einzeiligen Zusammenfassung. Es wurde hinter einem Admin-Flag ausgeliefert, weshalb zwei Analytics-Zähler kein einziges Mal ausgelöst haben. Diese Sperre ist weg: Kostenlose Konten bekommen 30 Speicherungen und 10 KI-Zusammenfassungen pro Tag, und Version 1.18 der Browser-Erweiterung ergänzt ein „In Telli.sh speichern“ im Rechtsklickmenü, das sich mit einem Token authentifiziert, das nichts anderes kann als Clips speichern.
OpenAI hat GPT-6 Astra am 3. September 2026 veröffentlicht und es das intelligenteste Modell der Welt genannt. Die eigenen Benchmark-Tabellen erzählen eine präzisere Geschichte: enorme Sprünge bei engen Aufgaben — Terminal-Bench Science von 22,4 % auf 64,6 %, SRE-Bench von 55,9 % auf 88,0 %, OSWorld mit 47 % weniger Zeit pro Aufgabe — auf einem neutralen Gesamtindex, der sich um drei Zehntel bewegt hat. Wo die Gewinne real sind, wo die Fußnoten stehen, und was ein Textmodell mit einer Million Token weiterhin nicht kann.
Das Universal Commerce Protocol erschien am 11. Januar 2026 – entwickelt von Google und Shopify, unterstützt von Etsy, Wayfair, Target, Walmart und über 20 weiteren Partnern. Liest man die Spezifikation, ist das Einkaufen der langweiligste Teil: Discovery über /.well-known/ucp, Message Signatures nach RFC 9421, verpflichtend signierte Webhooks und eine AP2-Mandate-Erweiterung, deren einzige Aufgabe darin besteht, den Einkauf eines Agenten unbestreitbar zu machen. Eine genaue Lektüre dessen, was UCP tatsächlich standardisiert – und der einen Sache darin, die mit Einkaufen nichts zu tun hat.
Telli.sh: Every Translator 1.16 baut das Symbolleisten-Popup als Statusansicht neu: eine Miniatur der Seite, auf der Sie gerade sind, fünf beschriftete Chips und Punkte, die nur dann grün werden, wenn die Erweiterung bestätigen kann, dass sie läuft. Sämtliche Konfiguration ist auf eine eigene Einstellungsseite mit lebenden Skelett-Vorschauen umgezogen, die Sofortübersetzung hat einen eigenen Tab samt selbstaufräumendem 30-Tage-Verlauf bekommen, und eine Benachrichtigungsglocke bringt den Telli.sh-Blog in der Sprache Ihres Browsers – über 15 Sprachversionen hinweg.
Eine geprüfte Schritt-für-Schritt-Anleitung zur Einrichtung von OpenClaw 2.0 für Einsteiger: die benötigte Node-Version, die drei Wege, dem Agenten ein Modell zu geben, und was jeder kostet, das neue sechsstufige geführte Onboarding aus v2026.8.1, die vierstufige Telegram-Kopplung, drei erste Aufgaben, die Berechtigungen für den ersten Tag, die den Radius klein halten, und die fünf Fehler, an denen neue Installationen tatsächlich scheitern.
Am 31. August 2026 veröffentlichte ein Open-Source-KI-Agent v2026.8.1: über 16.000 Pull Requests von 933 Mitwirkenden, rund die Hälfte aller je gemergten PRs des Projekts, nach 49 Tagen bewusster Stille auf 106 Releases in 230 Tagen. Der Einrichtungsassistent übernimmt jetzt das ChatGPT- oder Claude-Abo, für das Sie ohnehin zahlen, oder findet Ihre lokalen Ollama-Modelle. Sessions liegen in SQLite, und Downgrades sind nicht mehr gratis. Eine genaue Lektüre dessen, wie „KI, die Ihnen gehört“ tatsächlich aussieht — inklusive Breaking Changes und der Voreinstellungen, die weiterhin aus sind.
Bangkoker Agenturen veröffentlichen Konsekutivdolmetschen ab 3.000 THB pro Stunde und Simultandolmetschen ab 5.000 — und konsekutiv verdoppelt die Dauer des Meetings ungefähr. Live translate in Google Translate deckt 74 Sprachen ab, Thailändisch eingeschlossen, die übersetzten Untertitel von Google Meet 69, ebenfalls mit Thailändisch. Meets Transcripts und der Gemini-Protokollant unterstützen jeweils 8 Sprachen, und Thailändisch ist in keiner der beiden Listen. Deepgrams Nova-3 transkribiert Thailändisch als `th` und `th-TH`, schließt es aber aus dem 10-sprachigen Code-Switching-Modus aus — also genau aus dem thailändisch-englischen Satz, aus dem Ihr Meeting besteht. Eine vollständige Bestandsaufnahme der Meeting-Übersetzung für thailändische Teams.
Nottas Gratis-Tarif gewährt 120 Transkriptionsminuten im Monat und begrenzt eine einzelne Aufnahme auf 3 Minuten. TurboScribe gibt 3 Dateien pro Tag mit einer Obergrenze von 30 Minuten. Googles API liefert 60 Freiminuten und keine Oberfläche. Am 7. August 2026 hat Deepgram ein verbessertes Indonesisch-Modell ausgeliefert — nur auf dem Batch-Pfad. Ein geprüfter Vergleich der Gratis-Tarife, auf die Journalistinnen, Forschende und HR-Interviewer in Indonesien tatsächlich stoßen, und der Grenzen, die keiner davon bewirbt.
Die Wortfehlerrate bewertet das Wort „nicht“ und das Wort „der“ exakt gleich. Genau deshalb können zwei Transkripte beide bei 10,0 % landen, und nur eines davon ist brauchbar. Hier steht das vollständige Messverfahren: ein 12-minütiger Testausschnitt nach Meeting-Spezifikation, ein Referenztranskript mit eingefrorenen Normalisierungsregeln, die exakten cpWER- und DER-Befehle und eine Bewertungskarte über fünf Dimensionen, die der reinen WER 10 von 100 Punkten gibt.
DeepL hat am 16. April 2026 Voice-to-Voice für über 40 Sprachen gestartet, und die FAQ desselben Produkts sagt, Meeting-Daten würden 'temporär im Arbeitsspeicher verarbeitet und nach Ende des Anrufs gelöscht'. Am 28. August nahm das Open ASR Leaderboard seine erste Sprache des Globalen Südens auf und zeigte, dass zwei bei 4,9 WER gleichauf liegende Modelle sich um fast das Vierfache darin unterscheiden, wie stark ihre Genauigkeit von der Herkunft der Sprechenden abhängt. Echtzeit-Meetingübersetzung wird zur Massenware. Das Protokoll nicht.
Am 20. August 2026 erschien auf OpenRouter ein Modell ohne Labor, ohne Model Card und ohne Preis unter dem Namen stealth/ox-alpha. Vier Tage später hatten OpenCode-Nutzer 26 Billionen Tokens hindurchgeschickt. Sechs Tage später bekannte sich Z.AI dazu: GLM-5.3-Flash, 320 Milliarden Parameter, MIT-Lizenz, 0,15 Dollar pro Million Eingabe-Tokens. Warum Labore Modelle inzwischen ohne eigenen Namen veröffentlichen, was die Traffic-Zahlen wirklich messen und was ein Mischpreis von 24 Cent für Sprachpipelines bedeutet.
Am 4. August 2026 hat Deepgram Punjabi und Nepali zu Nova-3 hinzugefügt, am 7. August folgten Armenisch sowie Verbesserungen für Tamil, Indonesisch und Belarussisch. Vor neun Monaten deckte das Modell 31 Sprachen ab — heute listet die Dokumentation 58. Code-Switching funktioniert aber in genau 10 davon, und das Changelog vom August zeigt: Indonesisch wurde nur im Batch-Betrieb besser, Belarussisch nur im Streaming. Eine Bestandsaufnahme zum Tempo der Sprachabdeckung in der Spracherkennung — und dazu, was das Wort „unterstützt“ tatsächlich verdeckt.
Die übersetzten Untertitel von Google Meet decken 69 Sprachen ab, darunter Vietnamesisch, Live translate in Google Translate sogar 74. Die Transcripts-Funktion von Meet und der Gemini-Protokollant unterstützen jeweils exakt 8 Sprachen — Vietnamesisch ist in keiner der beiden Listen. DeepL Voice kann gesprochenes Vietnamesisch nur über einen Drittanbieter transkribieren, der von einer Administratorin freigeschaltet werden muss und keine automatische Spracherkennung erlaubt. Eine Bestandsaufnahme, was Live-Sprachübersetzung vietnamesischen Teams 2026 tatsächlich bringt — und was sie ihnen nie bringt.
Vor drei Jahren lag das beste herunterladbare Modell bei HumanEval 37 Punkte hinter GPT-4 und brauchte zwei Grafikkarten. Letzte Woche erreichte ein offenes 27B-Modell 52,0 im Intelligence Index von Artificial Analysis, Claude Opus 4.6 Max liegt bei 44,9 — zu einem Neuntel des Preises, aus einer Datei von 16,5 GB. Eine Vorher-Nachher-Analyse mit Benchmark-Tabellen, Preiskurve und der Bedeutung einer auf 162 Tage geschrumpften Aufholzeit.
Ein Produkt-Walkthrough der gesamten Telli.sh-Pipeline — Live-Aufnahme oder Audio-Upload, KI-Meeting-Transkription mit Sprechererkennung, Echtzeit-Meetingübersetzung in 44 Zielsprachen, KI-Zusammenfassungen in 10 Formaten und eine teilbare Notiz. Mit den ehrlichen Grenzen, den exakten Preisen und dem, was Transkriptionsgenauigkeit wirklich erfordert.
Forschung zur Zusammenfassung von Meeting-Transkripten zeigt: 30,4 % der generierten Zusammenfassungen echter Stadtratssitzungen enthielten mindestens einen Sachfehler — und dahinter stehen sieben benannte Fehlertypen. Ein praktischer Leitfaden, wie Sie eine KI-Mitschrift gegen ihr eigenes Transkript prüfen: was Sie in welcher Reihenfolge kontrollieren und was Sie im Meeting sagen sollten, damit die Prüfung neun statt dreißig Minuten dauert.
Apples Live-Übersetzung läuft mit 10 Sprachen vollständig auf dem iPhone. Timekettles W4 Pro für 449 Dollar nennt 52. Die Pixel Buds schaffen 40, brauchen aber eine Verbindung. Wir haben am 18. August 2026 die Support-Seiten aller vier Hersteller gelesen, um die Frage zu beantworten, die das Marketing überspringt: Wenn das Gespräch endet, wer hat es dann noch? Ein Überblick über den Markt und über die zweite Aufgabe, die niemand verkauft.
Am 11. August 2026 begann Anthropic, Claudes Ausgaben so zu markieren, dass sie sich später zurückverfolgen lassen. Die Markierung übersteht Kopieren und sogar Übersetzung, verschwindet aber beim Umschreiben. Eine verständliche Einführung: wie Text-Wasserzeichen funktionieren, was ein Treffer beweist und was nicht, warum die Geschichte der Falschbeschuldigungen zählt und warum alle 1.922 dokumentierten Halluzinationsfälle die Prüfung bestanden hätten.
Qwen3.8-27B steht unter Apache 2.0. Das Q4_K_M-GGUF ist 17,1 GB groß und passt auf einen 32-GB-Laptop; FP8 sind 30,9 GB. Gemessen: 48 Token/s auf einer RTX 4090, 12,75 auf einem Mac mini M4 Pro.
Alibabas Qwen3-ASR-Modelle stehen unter Apache 2.0, decken 52 Sprachen und Dialekte ab und sind kleiner als zwei Gigabyte. Ein verständlicher Überblick über die Open-Weight-Transkriptionsschicht: was es gibt, was ein Modell auf dem eigenen Laptop wirklich bringt und wo die geschlossenen APIs weiterhin gewinnen.
Am 20. Juli sind die Preise der Telli.sh-Bezahlpläne erneut gesunken: Pro kostet 8 $ pro Monat, Pro+ 10 $, und die Jahrespläne behalten den Rabatt von 15 %. Hier der Vergleich vorher/nachher und die Begründung für die runden Zahlen.
In drei Wochen haben Chinas größte KI-Labore Open-Weight-Modelle der Spitzenklasse veröffentlicht oder angekündigt – Kimi K3, Qwen3.8-Max und DeepSeek V4 in allgemeiner Verfügbarkeit. Ein Leitfaden in einfacher Sprache: was jedes Modell ist, was wirklich erschienen ist und was noch Versprechen bleibt, und warum Peking die selbst ausgelöste Welle nun regulieren könnte.
Eine OpenAI-Studie vom Juli 2026 zeigt: 43,5 % der berufsspezifischen ChatGPT-Nachrichten betreffen Arbeit außerhalb des eigenen Berufs. Solche Arbeit lebt von Kontext – und der größte Teil des Kontexts einer Organisation verdunstet in Meetings. Ein praktischer Leitfaden, wie aus Besprechungen durchsuchbares Arbeitswissen wird: was festgehalten gehört, wie man es benennt, welche Meetings einen dauerhaften Eintrag verdienen und was Suche für Onboarding und Übergaben verändert.
Der Engpass ist selten das Meeting, sondern der Tag danach: Entscheidungen verlieren ihre Kanten, Zuständigkeiten verwischen, Folgeaufgaben versanden in Direktnachrichten. Eine konkrete Anleitung für die Notizschleife, die umsetzungsstarke Teams tatsächlich fahren — Entscheidung, Verantwortliche und Termin live festhalten, binnen Minuten verteilen und das nächste Meeting mit dieser Notiz eröffnen.
Microsofts MAI-Transcribe-1.5 erreicht eine Wortfehlerrate von 2,4 Prozent – und in der eigenen Dokumentation steht: Sprecherdiarisierung wird nicht unterstützt. Eine verständliche Einordnung, was WER misst, warum sich das Leaderboard am unteren Ende staut und welche Schichten oberhalb der Spracherkennung darüber entscheiden, ob aus einem Transkript eine brauchbare Besprechungsnotiz wird.
Granola bringt den KI-Notizblock aufs Handgelenk, VOMO meldet über 400.000 Nutzer, Open-Source-Klone kamen binnen Wochen. Nichts davon hat verändert, was ein Meeting-Protokoll brauchbar macht. Die sechs Punkte, die drinstehen müssen — plus ein 60-Sekunden-Test.
Kimi K3 ist die Schlagzeile des Open-Weight-Schubs 2026, doch das Modell, das man heute wirklich herunterladen kann, ist GLM-5.2. Eine ehrliche Einordnung beider Modelle und warum offene Modelle mit freizügiger Lizenz für Meeting-Notizen zählen.
OpenAI leitet den Alias gpt-5.6 auf Sol; Terra steht für die Balance, Luna für hohes Volumen. Reasoning Effort reicht jetzt von none bis max, Standard ist medium — was das bei der Migration von GPT-5.5 ändert.
Die kurze Zugriffspause bei Anthropic Fable 5 zeigt, warum auch sicherere KI-Modelle klare Schutzmechanismen, nachvollziehbare Quellen und erklärbare Produktkontrollen brauchen.
Deepgrams Diarisierung v2 wurde 3,3-mal häufiger bevorzugt als der bisherige Produktions-Diarizer — aber diarize_model gilt nur für Batch, nicht für Streaming. Dazu koreanische Wortabstände und mehrsprachige Zahlen.
Eine datierte Momentaufnahme: Am 28. Juni 2026 verwies OpenAIs Leitfaden zum neuesten Modell noch auf GPT-5.5, nicht auf GPT-5.6. Was dort zu Reasoning, Tool-Nutzung und langem Kontext stand.
Wir haben die Preise der Telli.sh Paid-Pläne gesenkt, damit mehr Menschen Live-AI-Notizen, Transkripte, Zusammenfassungen und mehrsprachige Meeting-Workflows nutzen können.
Google bringt Live-Sprachübersetzung in Meet und Translate. Telli.sh konzentriert sich auf den überprüfbaren Gesprächsverlauf, der nach der Übersetzung bleibt.
South Australia Police bereitet einen KI-Speech-to-Text-Test für Befragungen vor. Für ernsthafte Gesprächsabläufe gilt: Geschwindigkeit reicht nur mit überprüfbarer Quelle.
Telli.sh: Every Translator ist im Chrome Web Store gestartet, mit kostenlosem Google-Translate-Modus, Chrome Built-in AI und Übersetzungen direkt neben dem Originaltext.