El rumor de RSI en Google: AGI y el debate sobre el ritmo de la IA
Qué son la AGI y la automejora recursiva: los mensajes originales en X, la propuesta de moderar el desarrollo y el argumento de Trump sobre competir con China.
Noticias, actualizaciones de producto e ideas del equipo de Telli.sh.
Qué son la AGI y la automejora recursiva: los mensajes originales en X, la propuesta de moderar el desarrollo y el argumento de Trump sobre competir con China.
La memoria, las reglas del proyecto y el prompt que escribes hoy influyen en un asistente de IA. A medida que los modelos siguen mejor las instrucciones, las soluciones antiguas y los permisos imprecisos pueden convertirse en problemas persistentes. Una guía práctica para revisar qué recuerda tu asistente, definir una autonomía útil y escribir instrucciones que puedas comprobar, con dos plantillas adaptables.
El entrenamiento de un modelo ya no explica por sí solo todas sus capacidades. Las investigaciones sobre Reflexion, Voyager, AlphaEvolve, el entrenamiento durante la inferencia y el aprendizaje continuo en 2026 muestran cómo conservar experiencias útiles. Qué cambia realmente, dónde hay pruebas sólidas y por qué mejorar de forma fiable importa más que repetir un ciclo sin fin.
GPT-Live-1 llega a la API a 0,05 $ por minuto de voz, tres meses después de la traducción de voz en directo de Google en 70 idiomas. Qué miden los precios y benchmarks publicados, qué no miden y por qué las actas, las ideas compartidas y las fuentes guardadas importan más a medida que conversar resulta más fácil.
Entre el 1 y el 3 de septiembre de 2026, Anthropic, Meta, Google y OpenAI lanzaron modelos de frontera, y la CNBC le puso nombre al agotamiento resultante: fatiga de modelos. El número de lanzamientos es la parte aburrida. La parte interesante es que cada lanzamiento crea una evaluación que alguien, aguas abajo, tiene que ejecutar, y las empresas que los publican no tienen ningún motivo para ayudarte a saltártela. Un repaso a lo que cuesta de verdad cambiar de modelo, por qué más barato por token no significa más barato por tarea, y por qué el software totalmente gestionado y creado para un único trabajo concreto es la única disposición en la que otro puede decidir por ti.
El 3 de septiembre de 2026, NVIDIA acordó adquirir Hugging Face por 12.930.300.000 dólares, la segunda operación más grande de su historia después de los 20.000 millones pagados por los activos de Groq. Hugging Face empezó en 2016 como una app de chatbot para adolescentes y acabó alojando 3 millones de modelos para 18 millones de desarrolladores. Una lectura detenida de cómo llegó hasta ahí, por qué las dos apuestas anteriores de NVIDIA por plataformas terminaron de forma opuesta, y dónde se decidirá realmente la promesa de neutralidad: no en una entrada de blog, sino en kernels, formatos de cuantización y destinos de despliegue por defecto.
Clip no solo guarda una página web: la convierte en una nota de Telli.sh con un título y un resumen de una línea escritos por IA. Se publicó detrás de una marca de administrador, así que dos contadores de analítica no se dispararon ni una sola vez. Esa barrera ya no está: las cuentas gratuitas tienen 30 guardados y 10 resúmenes de IA al día, y la versión 1.18 de la extensión del navegador añade un «Guardar en Telli.sh» en el menú del clic derecho que se autentica con un token que no sabe hacer nada más que guardar clips.
OpenAI lanzó GPT-6 Astra el 3 de septiembre de 2026 y lo llamó el modelo más inteligente del mundo. Sus propias tablas de benchmarks cuentan una historia más afilada: saltos enormes en tareas estrechas — Terminal-Bench Science del 22,4 % al 64,6 %, SRE-Bench del 55,9 % al 88,0 %, OSWorld con un 47 % menos de tiempo por tarea — apoyados sobre un índice general neutral que se movió tres décimas. Dónde las mejoras son reales, dónde están los asteriscos y qué sigue sin poder hacer un modelo de texto de un millón de tokens.
El Universal Commerce Protocol se publicó el 11 de enero de 2026, desarrollado por Google y Shopify y respaldado por Etsy, Wayfair, Target, Walmart y más de 20 socios. Pero al leer la especificación, comprar resulta ser la parte más aburrida: descubrimiento en /.well-known/ucp, firmas de mensaje RFC 9421, webhooks de firma obligatoria y una extensión de mandatos AP2 cuya única función es hacer que la compra de un agente no se pueda repudiar. Una lectura atenta de lo que el UCP normaliza de verdad, y de lo único que no tiene nada que ver con comprar.
Telli.sh: Every Translator 1.16 reconstruye la ventana emergente de la barra de herramientas como una vista de estado: una miniatura de la página en la que estás, cinco fichas etiquetadas y puntos que solo se ponen en verde cuando la extensión puede confirmar que está funcionando. Toda la configuración se ha mudado a una página de ajustes propia con vistas previas esqueléticas en vivo, la traducción instantánea ha ganado su propia pestaña y un historial que se limpia solo a los 30 días, y una campana de notificaciones trae el blog de Telli.sh en el idioma de tu navegador, en 15 versiones lingüísticas.
Guía de instalación de OpenClaw 2.0 para principiantes, verificada paso a paso: la versión de Node necesaria, las tres formas de darle un modelo al agente y lo que cuesta cada una, el onboarding guiado de seis pasos que llegó en v2026.8.1, el emparejamiento de Telegram en cuatro pasos, tres primeras tareas del tamaño adecuado, los permisos del primer día que mantienen pequeño el radio de acción y los cinco fallos con los que tropiezan de verdad las instalaciones nuevas.
El 31 de agosto de 2026 un agente de IA de código abierto publicó la v2026.8.1: más de 16.000 pull requests de 933 colaboradores, alrededor de la mitad de todo lo fusionado en la historia del proyecto, tras 49 días de silencio deliberado que siguieron a 106 versiones en 230 días. El asistente de instalación ahora importa la suscripción de ChatGPT o Claude que ya pagas, o encuentra tus modelos locales de Ollama. Las sesiones se mudaron a SQLite y volver atrás ya no es gratis. Una lectura atenta de cómo se ve realmente «la IA que es tuya», incluidos los cambios que rompen cosas y los ajustes que siguen desactivados.
Las agencias de Bangkok publican interpretación consecutiva desde 3.000 THB la hora y simultánea desde 5.000, y la consecutiva duplica aproximadamente lo que dura la reunión. La función Live translate de Google Translate cubre 74 idiomas con el tailandés incluido, y los subtítulos traducidos de Google Meet cubren 69, también con tailandés. Transcripts de Meet y el tomador de notas con Gemini admiten 8 idiomas cada uno, y el tailandés no está en ninguno. Nova-3 de Deepgram transcribe tailandés como `th` y `th-TH`, pero lo excluye del modo de alternancia de códigos de 10 idiomas, que es justo la frase tailandés-inglés de la que está hecha tu reunión. Un repaso completo de las opciones de traducción de reuniones para equipos tailandeses.
El plan gratuito de Notta concede 120 minutos de transcripción al mes y limita cada grabación a 3 minutos. TurboScribe da 3 archivos al día con un techo de 30 minutos. La API de Google entrega 60 minutos gratis y ninguna interfaz. El 7 de agosto de 2026, Deepgram lanzó un modelo indonesio mejorado, solo en la vía batch. Una comparación probada de los planes gratuitos con los que se topan de verdad periodistas, investigadores y entrevistadores de RR. HH. en Indonesia, y de los límites que ninguno de ellos anuncia.
La tasa de error de palabra puntúa igual la palabra « no » que la palabra « el ». Por eso dos transcripciones pueden quedarse ambas en el 10,0 % y solo una de ellas servir para algo. Aquí está el procedimiento de medición completo: un fragmento de prueba de 12 minutos construido según un pliego de reunión, una transcripción de referencia con reglas de normalización congeladas, los comandos exactos de cpWER y DER, y una tarjeta de cinco dimensiones que le concede al WER bruto 10 puntos sobre 100.
DeepL lanzó Voice-to-Voice el 16 de abril de 2026 en más de 40 idiomas, y las preguntas frecuentes del mismo producto dicen que los datos de la reunión se «procesan temporalmente en memoria y se eliminan cuando termina la llamada». El 28 de agosto, el Open ASR Leaderboard incorporó su primer idioma del Sur Global y mostró que dos modelos empatados en 4,9 de WER se diferencian casi cuatro veces en cuánto depende su precisión de la procedencia de quien habla. La traducción de reuniones en tiempo real se está volviendo un producto básico. El registro no.
El 20 de agosto de 2026 apareció en OpenRouter un modelo sin laboratorio, sin ficha técnica y sin precio, bajo el nombre stealth/ox-alpha. Cuatro días después, los usuarios de OpenCode habían empujado 26 billones de tokens a través de él. Seis días después, Z.AI lo reclamó como suyo: GLM-5.3-Flash, 320.000 millones de parámetros, licencia MIT, 0,15 dólares por millón de tokens de entrada. Por qué los laboratorios publican ya modelos sin su propio nombre, qué miden realmente esas cifras de tráfico y qué supone un precio mezclado de 24 centavos para la economía de las canalizaciones de voz.
El 4 de agosto de 2026 Deepgram añadió punyabí y nepalí a Nova-3; el 7 de agosto sumó armenio y mejoró tamil, indonesio y bielorruso. Hace nueve meses el modelo cubría 31 idiomas — hoy la documentación lista 58. Pero el cambio de código sigue funcionando en exactamente 10, y el propio changelog de agosto muestra el indonesio mejorando en batch mientras el bielorruso mejoraba solo en streaming. Un repaso al ritmo de la cobertura lingüística en reconocimiento de voz, y a lo que la palabra «compatible» está escondiendo en realidad.
Los subtítulos traducidos de Google Meet cubren 69 idiomas, el vietnamita incluido, y la función Live translate de Google Translate cubre 74. La función Transcripts de Meet y su tomador de notas con Gemini admiten exactamente 8 idiomas cada uno, y el vietnamita no está en ninguno de los dos. DeepL Voice solo puede transcribir vietnamita hablado a través de un proveedor externo que un administrador tiene que habilitar y que no admite la detección automática. Un repaso de lo que la traducción de voz en directo le da realmente a los equipos vietnamitas en 2026, y de lo que nunca les da.
Hace tres años, el mejor modelo descargable perdía por 37 puntos frente a GPT-4 en HumanEval y necesitaba dos tarjetas gráficas. La semana pasada un modelo abierto de 27B obtuvo 52,0 en el índice de inteligencia de Artificial Analysis frente a los 44,9 de Claude Opus 4.6 Max, a una novena parte del precio y desde un archivo de 16,5 GB. Un antes y después con las tablas de benchmarks, la curva de precios y qué significa que el desfase de alcance haya bajado a 162 días.
Un recorrido por toda la tubería de Telli.sh: grabación en vivo o subida de audio, transcripción de reuniones con IA e identificación de hablantes, traducción de reuniones en tiempo real a 44 idiomas de destino, resúmenes con IA en 10 formatos y una nota que se puede compartir. Con los límites honestos, los precios exactos y lo que de verdad exige la precisión de transcripción.
La investigación sobre resumen de transcripciones de reuniones halló que el 30,4 % de los resúmenes generados a partir de sesiones de concejos municipales contenía al menos un error factual, y detrás hay siete tipos de error con nombre propio. Una guía práctica para revisar una acta escrita por IA contra su propia transcripción: qué comprobar, en qué orden, y qué decir en la reunión para que la revisión dure nueve minutos y no treinta.
La Traducción en Vivo de Apple funciona con 10 idiomas íntegramente en el iPhone. El W4 Pro de Timekettle, de 449 dólares, declara 52. Los Pixel Buds llegan a 40, pero necesitan conexión. El 18 de agosto de 2026 leímos las páginas de soporte de los cuatro fabricantes para responder a la pregunta que el marketing esquiva: cuando la conversación acaba, ¿cuál la conserva todavía? Una guía del mercado y del segundo trabajo que nadie te vende.
El 11 de agosto de 2026 Anthropic empezó a marcar lo que escribe Claude para poder rastrearlo después. La marca sobrevive al copiar y pegar e incluso a la traducción, pero desaparece si reescribes. Guía en lenguaje claro: cómo funciona la marca de agua textual, qué prueba y qué no prueba una detección, por qué importa el historial de falsas acusaciones, y por qué los 1.922 casos de alucinación registrados habrían pasado la prueba.
Qwen3.8-27B se publica con licencia Apache 2.0. El GGUF Q4_K_M ocupa 17,1 GB y cabe en un portátil de 32 GB; FP8 son 30,9 GB. Medido: 48 tokens/s en una RTX 4090 y 12,75 en un Mac mini M4 Pro.
Los modelos Qwen3-ASR de Alibaba son Apache 2.0, cubren 52 idiomas y dialectos y pesan menos de dos gigabytes. Una guía en lenguaje llano de la capa de transcripción open weight: qué existe, qué te da realmente ejecutar un modelo en tu propio portátil y dónde siguen ganando las API cerradas.
El 20 de julio los planes de pago de Telli.sh volvieron a bajar: Pro a 8 $ al mes, Pro+ a 10 $, y el anual mantiene el 15 % de descuento. Aquí está la tabla antes/después y por qué redondeamos los importes hacia abajo.
En tres semanas, los mayores laboratorios de IA de China han publicado o anticipado modelos de pesos abiertos de frontera — Kimi K3, Qwen3.8-Max y DeepSeek V4 en disponibilidad general. Una guía en lenguaje claro: qué es cada modelo, qué salió de verdad y qué sigue siendo una promesa, y por qué Pekín podría ahora restringir la ola que él mismo desató.
La investigación de OpenAI de julio de 2026 encontró que el 43,5 % de los mensajes de ChatGPT específicos de una ocupación tratan sobre trabajo ajeno al puesto de quien los escribe. Ese trabajo se alimenta de contexto, y la mayor parte del contexto de una organización se evapora en las reuniones. Guía práctica para convertir las reuniones en conocimiento de trabajo buscable: qué conservar, cómo nombrarlo, qué reuniones merecen un registro duradero y qué cambia la búsqueda en la incorporación y los traspasos.
El cuello de botella casi nunca es la reunión, sino el día después: las decisiones pierden filo, los responsables se difuminan y los seguimientos mueren en mensajes privados. Un recorrido práctico por el bucle de notas que usan los equipos que sí ejecutan: anotar decisión, responsable y fecha durante la reunión, distribuir en minutos y abrir la siguiente reunión con esa nota.
MAI-Transcribe-1.5 de Microsoft marca un 2,4 % de tasa de error de palabra, y su propia documentación dice que la diarización no está soportada. Una explicación en lenguaje llano de qué mide el WER, por qué el ranking se ha amontonado cerca del suelo y qué capas por encima del reconocimiento de voz deciden de verdad si una transcripción se convierte en un acta útil.
Granola llevó su bloc de notas con IA a la muñeca, VOMO superó los 400.000 usuarios y los clones open source llegaron en semanas. Nada de eso cambió lo que hace útil un acta. Estas son las seis cosas que deben seguir estando, más un test de 60 segundos.
Kimi K3 es el titular de la ola open-weight de 2026, pero el modelo que de verdad puedes descargar hoy es GLM-5.2. Una lectura honesta de ambos y por qué los modelos abiertos con licencia permisiva importan para las notas de reunión.
OpenAI dirige el alias gpt-5.6 a Sol; Terra equilibra coste y Luna cubre el alto volumen. El esfuerzo de razonamiento va de none a max, con medium por defecto: esto es lo que cambia al migrar desde GPT-5.5.
La pausa de acceso a Anthropic Fable 5 muestra por qué incluso los modelos de IA más seguros necesitan salvaguardas claras, registros de origen y controles comprensibles para el usuario.
La diarización v2 de Deepgram se prefirió 3,3 veces más que el diarizador anterior, pero diarize_model solo funciona en batch, no en streaming. Además: espaciado coreano y numerales multilingües.
Una instantánea fechada: el 28 de junio de 2026, la guía de modelos de OpenAI seguía apuntando a GPT-5.5, no a GPT-5.6. Qué decía sobre razonamiento, uso de herramientas y contexto largo.
Reducimos los precios de los planes de pago de Telli.sh para que más personas puedan usar notas de IA en vivo, transcripciones, resúmenes y flujos de reuniones multilingües.
Google lleva la traducción de voz en vivo a Meet y Translate. Telli.sh se centra en el registro revisable que queda después de la conversación.
South Australia Police prepara una prueba de speech-to-text con IA para entrevistas. En conversaciones importantes, la velocidad solo sirve si el registro se puede revisar.
Telli.sh: Every Translator se lanzó en Chrome Web Store con modo gratuito de Google Translate, Chrome Built-in AI y traducción junto al texto original.