O rumor de RSI no Google: AGI e o debate sobre o ritmo da IA
Entenda AGI e autoaperfeiçoamento recursivo, confira as fontes originais no X e examine as propostas de moderação e o argumento de Trump sobre competir com a China.
Noticias, atualizacoes de produto e insights da equipe Telli.sh.
Entenda AGI e autoaperfeiçoamento recursivo, confira as fontes originais no X e examine as propostas de moderação e o argumento de Trump sobre competir com a China.
A memória, as regras do projeto e o prompt que você escreve hoje influenciam um assistente de IA. Conforme os modelos seguem instruções com mais precisão, soluções antigas e permissões vagas podem virar problemas persistentes. Um guia prático para revisar o que seu assistente lembra, definir uma autonomia útil e escrever instruções que você consiga testar, com dois modelos para adaptar.
O treinamento de um modelo já não explica sozinho todas as suas capacidades. Pesquisas sobre Reflexion, Voyager, AlphaEvolve, treinamento durante a inferência e aprendizado contínuo em 2026 mostram como sistemas de IA podem preservar experiências úteis. O que realmente muda, onde as evidências são fortes e por que melhorar com confiabilidade importa mais do que repetir um ciclo sem fim.
O GPT-Live-1 chega à API por US$ 0,05 o minuto de voz, três meses depois da tradução de fala ao vivo do Google em 70 idiomas. O que os preços e benchmarks publicados medem, o que deixam de fora e por que atas, ideias compartilhadas e fontes salvas ganham importância à medida que conversar fica mais fácil.
Entre 1º e 3 de setembro de 2026, Anthropic, Meta, Google e OpenAI lançaram modelos de fronteira, e a CNBC deu um nome ao esgotamento resultante: fadiga de modelos. O número de lançamentos é a parte chata. A parte interessante é que cada lançamento cria uma avaliação que alguém, lá embaixo, terá de rodar, e as empresas que os publicam não têm motivo algum para ajudar você a pular essa etapa. Quanto custa de fato trocar de modelo, por que mais barato por token não é mais barato por tarefa, e por que um software totalmente gerenciado, feito para um único trabalho específico, é o único arranjo em que outra pessoa pode decidir por você.
Em 3 de setembro de 2026, a NVIDIA concordou em adquirir a Hugging Face por US$ 12.930.300.000, a segunda maior operação de sua história, atrás dos US$ 20 bilhões pagos pelos ativos da Groq. A Hugging Face começou em 2016 como um app de chatbot para adolescentes e terminou hospedando 3 milhões de modelos para 18 milhões de desenvolvedores. Uma leitura atenta de como ela chegou até aqui, por que as duas apostas anteriores da NVIDIA em plataformas terminaram de formas opostas, e onde a promessa de neutralidade será de fato decidida: não em um post de blog, mas em kernels, formatos de quantização e destinos de deploy padrão.
O Clip não apenas salva uma página da web: ele a transforma em uma nota do Telli.sh com título e resumo de uma linha escritos por IA. Ele foi lançado atrás de uma trava de administrador, e por isso dois contadores de analytics nunca dispararam uma única vez. Essa trava acabou: contas gratuitas ganham 30 salvamentos e 10 resumos de IA por dia, e a versão 1.18 da extensão de navegador acrescenta um Salvar no Telli.sh no menu de contexto, autenticado por um token que não sabe fazer mais nada além disso.
A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 e o chamou de modelo mais inteligente do mundo. As próprias tabelas de benchmark contam uma história mais afiada: saltos enormes em tarefas estreitas — Terminal-Bench Science de 22,4% para 64,6%, SRE-Bench de 55,9% para 88,0%, OSWorld com 47% menos tempo por tarefa — apoiados sobre um índice geral neutro que se moveu três décimos. Onde os ganhos são reais, onde estão os asteriscos e o que um modelo de texto de um milhão de tokens ainda não consegue fazer.
O Universal Commerce Protocol foi publicado em 11 de janeiro de 2026, desenvolvido por Google e Shopify e apoiado por Etsy, Wayfair, Target, Walmart e mais de 20 parceiros. Mas ao ler a especificação, comprar é a parte mais entediante: descoberta em /.well-known/ucp, assinaturas de mensagem RFC 9421, webhooks de assinatura obrigatória e uma extensão de mandatos AP2 cuja única função é tornar a compra de um agente irrefutável. Uma leitura atenta do que o UCP padroniza de fato — e da única coisa ali que nada tem a ver com comprar.
O Telli.sh: Every Translator 1.16 refaz o pop-up da barra de ferramentas como uma visão de status: uma miniatura da página em que você está, cinco fichas identificadas e pontos que só ficam verdes quando a extensão consegue confirmar que está funcionando. Toda a configuração migrou para uma página de ajustes própria, com prévias esqueléticas ao vivo; a tradução instantânea ganhou aba própria e um histórico que se limpa sozinho em 30 dias; e um sino de notificações traz o blog do Telli.sh no idioma do seu navegador, em 15 versões linguísticas.
Um guia de instalação do OpenClaw 2.0 para iniciantes, verificado passo a passo: a versão de Node necessária, os três jeitos de dar um modelo ao agente e quanto custa cada um, o onboarding guiado de seis etapas que chegou na v2026.8.1, o pareamento do Telegram em quatro passos, três primeiras tarefas do tamanho certo, as permissões do primeiro dia que mantêm pequeno o raio de ação e as cinco falhas em que as instalações novas realmente tropeçam.
Em 31 de agosto de 2026 um agente de IA de código aberto publicou a v2026.8.1: mais de 16.000 pull requests de 933 colaboradores, cerca de metade de tudo o que o projeto já fundiu, depois de 49 dias de silêncio deliberado após 106 versões em 230 dias. O assistente de instalação agora importa a assinatura do ChatGPT ou do Claude que você já paga, ou encontra seus modelos Ollama locais. As sessões foram para o SQLite e voltar atrás deixou de ser de graça. Uma leitura atenta de como realmente se parece «a IA que é sua» — incluindo as quebras de compatibilidade e os padrões que continuam desligados.
Agências de Bangkok publicam interpretação consecutiva a partir de 3.000 THB por hora e simultânea a partir de 5.000, e a consecutiva praticamente dobra a duração da reunião. O Live translate do Google Tradutor cobre 74 idiomas, incluindo o tailandês, e as legendas traduzidas do Google Meet cobrem 69, também com tailandês — mas o Transcripts do Meet e o anotador do Gemini cobrem 8 cada, e o tailandês não está em nenhum dos dois. O Nova-3 da Deepgram transcreve tailandês como `th` e `th-TH`, mas o exclui do modo de code-switching de 10 idiomas, que é exatamente a frase tailandês-inglês de que a sua reunião é feita. A contabilidade completa das opções de tradução de reunião para equipes tailandesas.
O plano gratuito da Notta concede 120 minutos de transcrição por mês e limita cada gravação a 3 minutos. O TurboScribe dá 3 arquivos por dia com teto de 30 minutos. A API do Google entrega 60 minutos gratuitos e nenhuma interface. Em 7 de agosto de 2026, a Deepgram lançou um modelo indonésio melhorado — só no caminho em lote. Uma comparação testada dos planos gratuitos em que um jornalista, um pesquisador ou um entrevistador de RH na Indonésia realmente esbarra, e os limites que nenhum deles anuncia.
A taxa de erro de palavras pesa a palavra «não» exatamente como pesa a palavra «o», e é por isso que duas transcrições podem parar nos mesmos 10,0 % e só uma delas ser aproveitável. Aqui está o procedimento de medição completo: um clipe de teste de 12 minutos construído sob especificação, uma transcrição de referência com regras de normalização congeladas, os comandos exatos de cpWER e DER, e um placar de cinco dimensões que dá ao WER bruto 10 pontos de 100.
A DeepL lançou o Voice-to-Voice em 16 de abril de 2026 em mais de 40 idiomas, e o FAQ do próprio produto diz que os dados da reunião são «processados temporariamente na memória e excluídos quando a chamada termina». Em 28 de agosto, o Open ASR Leaderboard incluiu seu primeiro idioma do Sul Global e mostrou que dois modelos empatados em 4,9 de WER diferem em quase quatro vezes no quanto sua precisão depende de onde vem quem fala. A tradução de reuniões em tempo real está virando commodity. O registro, não.
Em 20 de agosto de 2026, um modelo sem laboratório, sem ficha técnica e sem preço apareceu no OpenRouter como stealth/ox-alpha. Quatro dias depois, os usuários do OpenCode já tinham empurrado 26 trilhões de tokens por ele. Seis dias depois, a Z.AI assumiu a autoria: GLM-5.3-Flash, 320 bilhões de parâmetros, licença MIT, 0,15 dólar por milhão de tokens de entrada. Por que os laboratórios agora publicam modelos sem o próprio nome, o que aqueles números de tráfego realmente medem e o que um preço combinado de 24 centavos faz com a economia de pipelines de voz.
Em 4 de agosto de 2026 a Deepgram adicionou punjabi e nepali ao Nova-3; em 7 de agosto acrescentou armênio e melhorou tâmil, indonésio e bielorrusso. Nove meses atrás o modelo cobria 31 idiomas — hoje a documentação lista 58. Mas a alternância de idiomas dentro da frase ainda funciona em exatamente 10, e o próprio changelog de agosto mostra o indonésio melhorando em lote enquanto o bielorrusso melhorou só em streaming. Um olhar sobre o ritmo da cobertura de idiomas no reconhecimento de fala — e sobre o que a palavra “suportado” está escondendo.
As legendas traduzidas do Google Meet cobrem 69 idiomas, incluindo o vietnamita, e o Live translate do Google Tradutor cobre 74. O recurso Transcripts do Meet e seu anotador do Gemini suportam exatamente 8 idiomas cada, e o vietnamita não está em nenhum dos dois. O DeepL Voice só consegue transcrever vietnamita falado por meio de um provedor terceirizado que precisa ser habilitado por um administrador e não funciona com detecção automática. Uma análise do que a tradução de voz ao vivo realmente entrega às equipes vietnamitas em 2026 — e do que ela nunca entrega.
Há três anos, o melhor modelo que dava para baixar perdia por 37 pontos para o GPT-4 no HumanEval e exigia duas placas de vídeo. Na semana passada, um modelo aberto de 27B marcou 52,0 no índice de inteligência da Artificial Analysis, contra 44,9 do Claude Opus 4.6 Max — por um nono do preço, a partir de um arquivo de 16,5 GB. Um antes e depois com as tabelas de benchmarks, a curva de preços e o que significa a defasagem de alcance ter caído para 162 dias.
Um passeio pelo pipeline completo do Telli.sh: gravação ao vivo ou upload de áudio, transcrição de reuniões com IA e identificação de quem falou, tradução de reuniões em tempo real para 44 idiomas de destino, resumos por IA em 10 formatos e uma nota compartilhável. Com os limites honestos, os preços exatos e o que a precisão de transcrição realmente exige.
Pesquisas sobre sumarização de transcrições de reunião encontraram 30,4% de resumos gerados a partir de sessões de câmaras municipais com pelo menos um erro factual — e sete tipos de erro nomeados por trás disso. Um guia prático para revisar uma ata escrita por IA contra a própria transcrição: o que conferir, em que ordem, e o que dizer na reunião para que a revisão leve nove minutos em vez de trinta.
A Tradução ao Vivo da Apple roda 10 idiomas inteiramente no iPhone. O W4 Pro da Timekettle, de 449 dólares, anuncia 52. Os Pixel Buds chegam a 40, mas exigem conexão. Em 18 de agosto de 2026 lemos as páginas de suporte dos quatro fabricantes para responder à pergunta que o marketing pula: terminada a conversa, qual deles ainda a tem? Um guia do mercado e da segunda tarefa que ninguém vende.
Em 11 de agosto de 2026, a Anthropic passou a marcar o que o Claude escreve para que a origem possa ser rastreada depois. A marca sobrevive a copiar e colar e até à tradução, mas some se você reescrever. Um guia em linguagem simples: como funciona a marca d'água em texto, o que um resultado de detecção prova e o que não prova, por que o histórico de acusações falsas importa e por que os 1.922 casos de alucinação já registrados teriam passado no teste.
O Qwen3.8-27B sai sob licença Apache 2.0. O GGUF Q4_K_M tem 17,1 GB e cabe num notebook de 32 GB; o FP8 tem 30,9 GB. Medido: 48 tokens/s numa RTX 4090 e 12,75 num Mac mini M4 Pro.
Os modelos Qwen3-ASR da Alibaba são Apache 2.0, cobrem 52 idiomas e dialetos e ocupam menos de dois gigabytes. Um guia em linguagem simples da camada de transcrição open weight: o que existe, o que rodar um modelo no seu próprio notebook realmente entrega e onde as APIs fechadas continuam vencendo.
Em 20 de julho os planos pagos da Telli.sh caíram de novo: Pro por US$ 8 ao mês, Pro+ por US$ 10, e o anual mantém os 15 % de desconto. Veja a tabela antes/depois e por que arredondamos os valores para baixo.
Em três semanas, os maiores laboratórios de IA da China lançaram ou anteciparam modelos de pesos abertos de fronteira — Kimi K3, Qwen3.8-Max e o DeepSeek V4 em disponibilidade geral. Um guia em linguagem simples: o que é cada modelo, o que de fato saiu e o que ainda é promessa, e por que Pequim pode agora restringir a onda que ele mesmo provocou.
A pesquisa da OpenAI de julho de 2026 mostrou que 43,5% das mensagens do ChatGPT específicas de uma ocupação tratam de trabalho fora do cargo de quem escreve. Esse tipo de trabalho depende de contexto — e a maior parte do contexto de uma organização evapora nas reuniões. Um guia prático para transformar reuniões em conhecimento de trabalho pesquisável: o que guardar, como nomear, quais reuniões merecem um registro duradouro e o que a busca muda na integração e nas passagens de bastão.
O gargalo quase nunca é a reunião, e sim o dia seguinte: as decisões perdem o contorno, os responsáveis se diluem e os follow-ups morrem em mensagens privadas. Um passo a passo do ciclo de anotações que os times que executam de fato usam — decisão, responsável e prazo escritos durante a reunião, distribuídos em minutos e reabertos no início do próximo encontro.
O MAI-Transcribe-1.5 da Microsoft registra 2,4% de taxa de erro de palavra, e a documentação oficial do próprio modelo diz que a diarização não é suportada. Uma explicação em linguagem simples sobre o que o WER mede, por que o ranking se amontoou perto do piso e quais camadas acima do reconhecimento de fala realmente decidem se uma transcrição vira uma ata útil.
A Granola levou o bloco de notas com IA para o pulso, a VOMO passou de 400 mil usuários e clones open source apareceram em semanas. Nada disso mudou o que torna uma ata útil. Aqui estão as seis coisas que ainda precisam estar lá, e um teste de 60 segundos.
O Kimi K3 é o destaque da onda open-weight de 2026, mas o modelo que você realmente pode baixar hoje é o GLM-5.2. Uma leitura honesta dos dois e por que modelos abertos com licença permissiva importam para as notas de reunião.
A OpenAI roteia o alias gpt-5.6 para o Sol; o Terra equilibra custo e o Luna atende alto volume. O esforço de raciocínio vai de none a max, com medium por padrão — o que muda ao migrar do GPT-5.5.
A pausa no acesso ao Anthropic Fable 5 mostra por que até modelos de IA mais seguros precisam de salvaguardas claras, registos de origem e controlos explicáveis ao utilizador.
A diarização v2 da Deepgram foi preferida 3,3 vezes mais que o diarizador anterior, mas o diarize_model é só para batch, não para streaming. Além disso: espaçamento coreano e numerais multilíngues.
Um retrato datado: em 28 de junho de 2026, o guia de modelos mais recentes da OpenAI ainda apontava para o GPT-5.5, não para o GPT-5.6. O que ele dizia sobre raciocínio, ferramentas e contexto longo.
Reduzimos os preços dos planos pagos da Telli.sh para que mais pessoas possam usar notas de IA ao vivo, transcrições, resumos e fluxos de reunião multilíngues.
O Google está levando tradução de voz ao vivo ao Meet e ao Translate. O Telli.sh foca no registro revisável que continua útil depois da conversa.
South Australia Police prepara um teste de speech-to-text com IA para entrevistas. Em fluxos sérios, velocidade só funciona quando o registro continua verificável.
Telli.sh: Every Translator chegou à Chrome Web Store com modo gratuito do Google Tradutor, Chrome Built-in AI e tradução ao lado do texto original.