Слух о RSI в Google: что спор о темпе ИИ говорит об AGI
Простое объяснение AGI и рекурсивного самоулучшения, исходные посты в X, позиции лидеров ИИ и возражение Трампа о конкуренции с Китаем.
Новости, обновления продукта и аналитика команды Telli.sh.
Простое объяснение AGI и рекурсивного самоулучшения, исходные посты в X, позиции лидеров ИИ и возражение Трампа о конкуренции с Китаем.
Память, правила проекта и сегодняшний запрос влияют на работу ИИ-ассистента. Чем точнее модели следуют инструкциям, тем устойчивее могут становиться старые обходные решения и расплывчатые разрешения. Практическое руководство по проверке памяти ассистента, определению полезной самостоятельности и написанию проверяемых инструкций — с двумя шаблонами для адаптации.
Обучение модели уже не описывает все её возможности. Исследования от Reflexion и Voyager до AlphaEvolve, обучения во время применения и экспериментов по непрерывному обучению 2026 года показывают, как ИИ-системы могут сохранять полезный опыт. Что именно меняется, где убедительны свидетельства и почему надёжное улучшение важнее бесконечного цикла.
Модель GPT-Live-1 стала доступна через API по цене $0,05 за минуту голоса, через три месяца после запуска перевода речи Google на 70 языков. Что измеряют опубликованные цены и бенчмарки, чего они не показывают и почему протоколы встреч, общие идеи и сохранённые источники становятся важнее по мере того, как разговаривать становится проще.
С 1 по 3 сентября 2026 года Anthropic, Meta, Google и OpenAI выпустили фронтирные модели, а CNBC дала возникшему истощению имя: модельная усталость. Число релизов — скучная часть. Интересная в том, что каждый релиз создаёт оценку, которую кто-то ниже по цепочке обязан провести, и у компаний, выпускающих модели, нет ни одной причины помогать вам её пропустить. Разбираем, во что на самом деле обходится смена модели, почему дешевле за токен не значит дешевле за задачу и почему полностью управляемое ПО, созданное под одну узкую работу, — единственная схема, в которой решение может принять кто-то другой.
3 сентября 2026 года NVIDIA договорилась о покупке Hugging Face за 12 930 300 000 долларов. Это вторая по величине сделка в истории компании после 20 миллиардов за активы Groq. Hugging Face начиналась в 2016 году как приложение-чатбот для подростков, а закончила тем, что хранит 3 миллиона моделей для 18 миллионов разработчиков. Разбираем, как она к этому пришла, почему две прежние платформенные ставки NVIDIA закончились противоположным образом и где на самом деле решится обещание нейтральности: не в блоге, а в ядрах, форматах квантизации и целях развёртывания по умолчанию.
Clip не просто сохраняет веб-страницу: он превращает её в заметку Telli.sh с заголовком и однострочной сводкой, написанными ИИ. Он вышел под админским флагом, поэтому два счётчика аналитики не сработали ни разу. Этого барьера больше нет: бесплатные аккаунты получают 30 сохранений и 10 сводок ИИ в день, а версия 1.18 браузерного расширения добавляет пункт «Сохранить в Telli.sh» в контекстное меню, который авторизуется токеном, не умеющим ничего, кроме сохранения клипов.
OpenAI выпустила GPT-6 Astra 3 сентября 2026 года и назвала его самой умной моделью в мире. Её собственные таблицы бенчмарков рассказывают более резкую историю: колоссальные скачки на узких задачах — Terminal-Bench Science с 22,4% до 64,6%, SRE-Bench с 55,9% до 88,0%, OSWorld на 47% меньше времени на задачу — поверх нейтрального сводного индекса, сдвинувшегося на три десятых. Где прирост реален, где стоят сноски и чего текстовая модель с миллионом токенов по-прежнему не умеет.
Universal Commerce Protocol вышел 11 января 2026 года: разработан Google и Shopify, поддержан Etsy, Wayfair, Target, Walmart и более чем 20 партнёрами. Но если прочитать спецификацию, покупки окажутся самой скучной её частью: обнаружение через /.well-known/ucp, подписи сообщений по RFC 9421, обязательная подпись вебхуков и расширение мандатов AP2, единственная задача которого — сделать покупку агента неоспоримой. Разбор того, что UCP стандартизирует на самом деле, и той единственной вещи, которая к покупкам отношения не имеет.
Telli.sh: Every Translator 1.16 перестраивает всплывающее окно на панели инструментов в экран состояния: миниатюра страницы, на которой вы находитесь, пять подписанных чипов и точки, которые загораются зелёным только тогда, когда расширение может подтвердить, что оно действительно работает. Вся настройка переехала на отдельную страницу параметров с живыми скелетными превью, мгновенный перевод получил собственную вкладку и историю, которая сама очищается через 30 дней, а колокольчик уведомлений приносит блог Telli.sh на языке вашего браузера — в 15 языковых версиях.
Проверенное пошаговое руководство по установке OpenClaw 2.0 для новичков: нужная версия Node, три способа дать агенту модель и стоимость каждого, шестишаговый управляемый онбординг из v2026.8.1, привязка Telegram в четыре шага, три первые задачи подходящего размера, настройки прав первого дня, удерживающие радиус поражения небольшим, и пять сбоев, на которые действительно натыкаются новые установки.
31 августа 2026 года открытый ИИ-агент опубликовал v2026.8.1: более 16 000 пул-реквестов от 933 участников, около половины всего, что проект когда-либо влил, после 49 дней намеренной тишины, пришедших на смену 106 релизам за 230 дней. Мастер установки теперь подхватывает подписку на ChatGPT или Claude, за которую вы и так платите, либо находит ваши локальные модели Ollama. Сессии переехали в SQLite, и откат больше не бесплатный. Внимательное чтение того, как на самом деле выглядит «ИИ, который принадлежит вам», — вместе с ломающими изменениями и настройками, которые по-прежнему выключены.
Агентства Бангкока публикуют последовательный перевод от 3000 бат в час и синхронный от 5000, а последовательный примерно удваивает длительность встречи. Live translate в Google Переводчике покрывает 74 языка, включая тайский, переводимые субтитры Google Meet — 69, тоже с тайским, а вот Transcripts в Meet и заметочник на Gemini — по 8 языков, и тайского нет ни там, ни там. Nova-3 от Deepgram расшифровывает тайский как `th` и `th-TH`, но исключает его из режима code-switching на 10 языков — то есть ровно из той тайско-английской фразы, из которой состоит ваша встреча. Полный подсчёт вариантов перевода встреч для тайских команд.
Бесплатный план Notta даёт 120 минут транскрипции в месяц и ограничивает одну запись 3 минутами. TurboScribe даёт 3 файла в день с потолком в 30 минут. API Google выдаёт 60 бесплатных минут и никакого интерфейса. 7 августа 2026 года Deepgram выпустила улучшенную индонезийскую модель — только на пакетном пути. Проверенное сравнение бесплатных тарифов, на которые реально натыкается журналист, исследователь или HR-интервьюер в Индонезии, и ограничения, о которых ни один из них не пишет.
Word error rate оценивает слово «не» ровно так же, как слово «этот», и именно поэтому две расшифровки могут показать одинаковые 10,0 %, а пригодной окажется только одна. Здесь — полная процедура измерения: 12-минутный тестовый фрагмент, собранный по спецификации, эталонная расшифровка с замороженными правилами нормализации, точные команды cpWER и DER и оценочная карта из пяти измерений, где сырому WER отведено 10 баллов из 100.
16 апреля 2026 года DeepL выпустила Voice-to-Voice более чем для 40 языков, а в FAQ того же продукта сказано, что данные встречи «обрабатываются временно в памяти и удаляются после завершения звонка». 28 августа Open ASR Leaderboard добавил первый язык Глобального Юга и показал, что две модели, идущие вровень на 4,9 WER, различаются почти вчетверо в том, насколько их точность зависит от того, откуда родом говорящий. Перевод встреч в реальном времени становится массовым товаром. Запись — нет.
20 августа 2026 года на OpenRouter появилась модель без лаборатории, без карточки и без цены — под именем stealth/ox-alpha. Через четыре дня пользователи OpenCode прогнали через неё 26 триллионов токенов. Через шесть дней Z.AI признала её своей: GLM-5.3-Flash, 320 миллиардов параметров, лицензия MIT, 0,15 доллара за миллион входных токенов. Почему лаборатории теперь выпускают модели без собственного имени, что на самом деле измеряют эти цифры трафика и что смешанная цена в 24 цента делает с экономикой речевых конвейеров.
4 августа 2026 года Deepgram добавил в Nova-3 панджаби и непальский, 7 августа — армянский, а также улучшил тамильский, индонезийский и белорусский. Девять месяцев назад модель покрывала 31 язык — сегодня в документации их 58. Но переключение языков внутри фразы по-прежнему работает ровно для 10, а августовский чейнджлог показывает: индонезийский улучшили в пакетном режиме, а белорусский — только в потоковом. Разбираем темп роста языкового покрытия в распознавании речи и то, что на самом деле прячется за словом «поддерживается».
Переводимые субтитры Google Meet покрывают 69 языков, включая вьетнамский, а Live translate в Google Переводчике — 74. Функция Transcripts в Meet и её заметочник на Gemini поддерживают ровно по 8 языков, и вьетнамского нет ни в одном из списков. DeepL Voice может расшифровать устный вьетнамский только через стороннего поставщика, которого должен включить администратор и который не работает с автоопределением. Разбираем, что живой голосовой перевод реально даёт вьетнамским командам в 2026 году — и чего он не даёт никогда.
Три года назад лучшая модель, которую можно было скачать, уступала GPT-4 37 баллов на HumanEval и требовала двух видеокарт. На прошлой неделе открытая модель на 27 млрд параметров набрала 52,0 в индексе интеллекта Artificial Analysis против 44,9 у Claude Opus 4.6 Max — за одну девятую цены и из файла в 16,5 ГБ. Сравнение «до и после» с таблицами бенчмарков, кривой цен и разбором того, что значит отставание догоняющих, сократившееся до 162 дней.
Подробный разбор всего конвейера Telli.sh: живая запись или загрузка аудио, ИИ-транскрибация встреч с определением говорящих, перевод встреч в реальном времени на 44 целевых языка, ИИ-резюме в 10 форматах и заметка, которой можно поделиться. С честными ограничениями, точными ценами и разбором того, чего на самом деле требует точность транскрибации.
Исследования суммаризации стенограмм встреч показали: 30,4 % сгенерированных резюме заседаний городских советов содержали хотя бы одну фактическую ошибку, а за ними стоят семь названных типов ошибок. Практическое руководство по сверке ИИ-протокола с его же стенограммой: что проверять, в каком порядке и что говорить на самой встрече, чтобы проверка занимала девять минут, а не тридцать.
«Живой перевод» Apple работает с 10 языками полностью на iPhone. Timekettle W4 Pro за 449 долларов заявляет 52. Pixel Buds дают 40, но требуют интернет. 18 августа 2026 года мы прочитали страницы поддержки всех четырёх производителей, чтобы ответить на вопрос, который маркетинг обходит стороной: когда разговор закончился, у кого он всё ещё есть? Гид по рынку и по второй задаче, которую вам никто не продаёт.
11 августа 2026 года Anthropic начала помечать написанное Claude так, чтобы происхождение можно было отследить. Метка переживает копирование и даже перевод, но исчезает при переписывании. Понятное объяснение: как работает текстовый водяной знак, что доказывает и чего не доказывает результат проверки, почему важна история ложных обвинений и почему все 1922 зафиксированных случая галлюцинаций прошли бы эту проверку.
Qwen3.8-27B выходит под Apache 2.0. GGUF Q4_K_M весит 17,1 ГБ и помещается в ноутбук с 32 ГБ; FP8 — 30,9 ГБ. Замеры: 48 токенов/с на RTX 4090 и 12,75 на Mac mini M4 Pro.
Модели Qwen3-ASR от Alibaba выпущены под Apache 2.0, покрывают 52 языка и диалекта и весят меньше двух гигабайт. Понятный разбор слоя открытых моделей транскрибации: что уже есть, что реально даёт запуск модели на своём ноутбуке и где закрытые API по-прежнему выигрывают.
20 июля цены платных тарифов Telli.sh снова снизились: Pro — $8 в месяц, Pro+ — $10, годовая оплата сохраняет скидку 15 %. Таблица «было/стало» и объяснение, зачем мы округлили суммы вниз.
За три недели крупнейшие AI-лаборатории Китая выпустили или анонсировали открытые модели фронтирного уровня — Kimi K3, Qwen3.8-Max и DeepSeek V4 в общем доступе. Понятный разбор простыми словами: что представляет собой каждая модель, что действительно вышло, а что пока лишь обещание, и почему Пекин может теперь ограничить волну, которую сам же и запустил.
Исследование OpenAI за июль 2026 года показало: 43,5% профильных сообщений в ChatGPT касаются работы за пределами собственной профессии автора. Такая работа держится на контексте — а большая часть контекста организации испаряется на встречах. Практическое руководство о том, как превратить встречи в доступное поиску рабочее знание: что сохранять, как называть, какие встречи заслуживают долговременной записи и что поиск меняет в онбординге и передаче дел.
Узкое место почти никогда не сама встреча, а следующий день: решения теряют чёткость, ответственные размываются, follow-up умирает в личных сообщениях. Разбираем цикл ведения заметок, который на самом деле используют команды, доводящие дела до конца: решение, ответственный и срок фиксируются прямо на встрече, рассылаются за считанные минуты и открываются заново в начале следующей встречи.
MAI-Transcribe-1.5 от Microsoft показывает 2,4% ошибок на словах, а в собственной документации модели написано, что диаризация не поддерживается. Понятное объяснение того, что измеряет WER, почему рейтинг сбился в плотную группу у нижней границы и какие слои над распознаванием речи на самом деле решают, станет ли расшифровка пригодной рабочей записью встречи.
Granola перенесла ИИ-блокнот на запястье, VOMO перешагнула 400 000 пользователей, открытые клоны появились за считанные недели. Ничто из этого не изменило, что делает протокол полезным. Шесть обязательных элементов и 60-секундная проверка.
Kimi K3 — главный заголовок волны открытых весов 2026 года, но модель, которую действительно можно скачать уже сегодня, — это GLM-5.2. Честный разбор обеих и объяснение, почему открытые модели со свободной лицензией важны для заметок со встреч.
OpenAI направляет алиас gpt-5.6 на Sol; Terra — баланс цены, Luna — большие объёмы. Reasoning effort теперь от none до max, по умолчанию medium — что это меняет при переходе с GPT-5.5.
Пауза доступа к Anthropic Fable 5 показывает, почему даже более безопасным моделям ИИ нужны понятные защитные меры, записи источников и объяснимые для пользователей элементы управления.
Диаризацию v2 от Deepgram выбирали в 3,3 раза чаще прежней, но diarize_model работает только в пакетном режиме, а не в стриминге. Плюс корейские пробелы и многоязычные числа.
Снимок с датой: 28 июня 2026 года гайд OpenAI по актуальным моделям всё ещё указывал на GPT-5.5, а не на GPT-5.6. Что там говорилось о рассуждении, работе с инструментами и длинном контексте.
Мы снизили цены на платные планы Telli.sh, чтобы больше людей могли пользоваться живыми AI-заметками, транскриптами, резюме и многоязычными рабочими процессами встреч.
Google продвигает живой голосовой перевод в Meet и Translate. Telli.sh фокусируется на проверяемой записи, которая остается после разговора.
South Australia Police готовит тест AI speech-to-text для интервью. Для серьезных разговоров скорость полезна только тогда, когда запись можно проверить.
Telli.sh: Every Translator вышел в Chrome Web Store с бесплатным режимом Google Translate, Chrome Built-in AI и переводом рядом с исходным текстом.