ai models

El sprint de pesos abiertos de China en tres semanas: Kimi K3, Qwen3.8-Max y el giro que podría acabar con todo

En tres semanas, los mayores laboratorios de IA de China han publicado o anticipado modelos de pesos abiertos de frontera — Kimi K3, Qwen3.8-Max y DeepSeek V4 en disponibilidad general. Una lectura honesta: qué salió de verdad, qué sigue siendo una promesa y por qué Pekín podría ahora restringir la ola que él mismo desató.

T
Telli.sh Team
#open-llm#kimi-k3#qwen#deepseek#open-weight#china-ai#ai-models#meeting-notes

Entre el 16 y el 26 de julio, tres de los mayores laboratorios de IA de China pusieron sobre la mesa modelos abiertos de nivel frontera. Moonshot AI anunció Kimi K3 el 16 de julio y publicó los pesos el 26 de julio. Alibaba presentó Qwen3.8-Max el 19 de julio en la WAIC de Shanghái. La línea V4 de DeepSeek alcanzó la disponibilidad general (GA) en torno al 20 de julio. Tres laboratorios, unas tres semanas.

El patrón es difícil de pasar por alto, y no es aquel con el que la escena china de modelos abiertos se labró su reputación. Estos laboratorios eran conocidos por modelos pequeños, rápidos y baratos que golpeaban por encima de su categoría. Esta ola es la apuesta contraria: sistemas de billones de parámetros publicados, o prometidos, como pesos abiertos.

Esta es una lectura honesta de esa ola: qué salió de verdad, qué sigue siendo una vista previa o una promesa, y el giro que llegó con ella — el mismo gobierno que hizo posibles estos lanzamientos está sopesando ahora si restringirlos. Si leíste nuestro repaso de julio, esto es la secuela, y uno de sus cabos sueltos se ha resuelto.

Filas de armarios en una gran instalación de supercomputación

Image: OLCF at ORNL, Wikimedia Commons, CC BY 2.0.

Kimi K3 es el que realmente salió

Cuando escribimos sobre Kimi K3 en julio, los pesos eran solo una promesa — Moonshot AI había dicho «antes del 27 de julio». Llegaron el 26 de julio: 1,56 terabytes repartidos en 96 fragmentos en Hugging Face, bajo moonshotai/Kimi-K3. Esa es la noticia. Un anuncio es una nota de prensa; unos pesos descargables son un hecho sobre el que se puede construir.

La arquitectura es un gran modelo mixture-of-experts — 2,8 billones de parámetros en total, unos 104.000 millones activos por token, que enruta alrededor de 16 de 896 expertos mediante un mecanismo que Moonshot llama Kimi Delta Attention, con una ventana de contexto de un millón de tokens y una mejora de eficiencia de escalado reportada de cerca del 2,5x frente a K2. En el ranking independiente de Artificial Analysis quedó 4º de 189 modelos — por detrás de Claude Fable 5 y de dos configuraciones GPT-5.6 «Sol», por delante de Opus 4.8 y GPT-5.5. Para un modelo abierto que puedes descargar, estar en esa compañía ya es la historia.

Lee la licencia antes de planificar un negocio a su alrededor. Kimi K3 no es MIT. Se distribuye bajo una licencia propia, la «Kimi K3 License», no aprobada por la OSI y con una cláusula de umbral de ingresos: ejecutar K3 como motor de un gran negocio de Model-as-a-Service exige un acuerdo aparte con Moonshot. Para la mayoría de los equipos eso no cambia nada; para quien construya un producto alojado a gran escala, «pesos abiertos» y «licencia abierta» son dos preguntas distintas — y aquí solo la primera es un sí inequívoco.

Qwen3.8-Max es una vista previa, no una descarga

El Qwen3.8-Max de Alibaba es el titular más grande de la ola y también el más blando. Presentado el 19 de julio en la WAIC, es un MoE disperso de 2,4 billones de parámetros — parámetros activos sin revelar — y el primer Qwen por encima del billón de parámetros que es multimodal, capaz de procesar texto, imagen, vídeo y documentos. Y ahora mismo es solo una vista previa alojada: qwen3.8-max-preview, ofrecida a alrededor del 10 % del precio estándar a través del Token Plan y Qoder de Alibaba.

Esto es lo que no ha llegado: una fecha para los pesos abiertos, una licencia, una tarjeta de modelo o una tabla de benchmarks independiente. Alibaba dice que los pesos llegan «pronto», pero la organización de Qwen en Hugging Face no recibe nada nuevo desde junio. La afirmación de la empresa de que el modelo es «solo superado por Fable 5» es exactamente eso — un dato propio, sin cifras de terceros que lo respalden todavía. Trátalo como el eslogan de marketing de un proveedor hasta que alguien fuera de Alibaba lo mida.

Una cosa más conviene decirla con precisión, porque ya circula como un hecho: la historia de que un «Qwen3.8 27B» saldrá la semana que viene es un rumor de la comunidad. Se remonta a un comentario en Hacker News y a un agregador que lo repitió. Alibaba no ha dado fecha, ni tamaño, ni licencia. Dado el historial de lanzamientos de la empresa, es una expectativa razonable — y nada más que una expectativa.

DeepSeek V4 alcanzó la disponibilidad general en silencio

DeepSeek fue el que menos anunció y entregó lo más utilizable. La línea V4, publicada ya el 24 de abril, viene en dos tamaños con licencia abierta: V4-Pro, con 1,6 billones en total y 49.000 millones de parámetros activos, y V4-Flash, con 284.000 millones en total y 13.000 millones activos. Ambos son MIT. Ambos ofrecen una ventana de contexto de un millón de tokens y ventanas de salida de hasta 384K tokens. En torno al 20 de julio, V4 alcanzó la disponibilidad general con precios por tiempo, lo que lo metió en el mismo marco de tres semanas que K3 y Qwen. No hay R2, ni V5, ni V4.1 — solo la familia V4 madurando hasta convertirse en algo en lo que los equipos pueden confiar.

La brecha se cierra más rápido de lo que admiten las clasificaciones

Si damos un paso atrás, la pendiente importa más que los lanzamientos individuales. La lectura de Nathan Lambert es que la distancia entre los mejores modelos abiertos y los mejores cerrados se ha comprimido de unos seis a nueve meses a tres a cinco — «lo más cerca que han estado los modelos abiertos de la frontera desde DeepSeek R1». Los datos de uso apuntan en la misma dirección. En OpenRouter, la cuota de tokens de los modelos de origen estadounidense cayó de cerca del 70 % en junio de 2025 a alrededor del 30 % un año después, mientras que los modelos de origen chino superan ya con regularidad el 30 %. El precio explica buena parte: los modelos abiertos chinos suelen costar entre un 60 y un 90 % menos por token, y el alojamiento apareció de inmediato — Together AI y Modal levantaron endpoints de Kimi K3 el día cero.

El cambio más silencioso tiene que ver con la escala. La marca del modelo abierto chino era pequeño, rápido y barato. K3 con 2,8 billones de parámetros y Qwen3.8-Max con 2,4 billones son justo lo contrario — una apuesta a que ir a lo grande en abierto ya merece la pena. GLM-5.2 de Z.ai, publicado el 16 de junio bajo MIT y en cabeza de la categoría de pesos abiertos del Artificial Analysis Index con 51, es el mismo mensaje desde un cuarto laboratorio.

El giro: el gobierno que lo hizo posible podría restringirlo

Entonces cambió el rumbo. En torno al 22 al 25 de julio, el Financial Times y Reuters informaron de que el Ministerio de Comercio de China está sopesando controles de exportación sobre los modelos de IA — incluidos los LLM de pesos abiertos —, con Alibaba, ByteDance y Z.ai supuestamente en la conversación. El marco que se baraja es escalonado: una obligación de declaración para los modelos más débiles, una revisión de seguridad para los más fuertes y una posible prohibición de publicar abiertamente los más capaces. Nada es todavía ley. Pero la dirección es llamativa: la ola quizá esté alcanzando su cima justo cuando su propio gobierno empieza a tratar estos modelos como exportaciones estratégicas y no como contribuciones abiertas.

En resumen: cuando lo abierto se vuelve un activo estratégico

El relato cómodo dice «China alcanzó al resto». El más preciso dice que los pesos abiertos se volvieron un activo estratégico tan rápido que un gobierno quiere ahora la mano sobre el grifo. En tres semanas, los modelos abiertos pasaron de ir dos o tres trimestres por detrás de la frontera a ir solo uno — y de ser pequeños y baratos a estar entre los mayores modelos jamás publicados en cualquier forma. La frontera abierta no solo se movió. Se movió a un lugar desde el que sus creadores quizá no sean libres de seguir enviando.

Para los equipos que construyen sobre estos modelos, la conclusión práctica no cambia y se afina un poco. Telli.sh ya ejecuta un modelo abierto, Qwen3, en su capa de resumen, de modo que cada avance en calidad y precio de los modelos abiertos fluye directo a la transcripción, la traducción y los resúmenes de reuniones. La nueva partida es el suministro: si las reglas de exportación de China cuajan como sugieren las informaciones, qué modelos abiertos seguirán siendo de libre descarga es algo que vigilar más que presuponer. Que mejoren los modelos que alimentan esa capa es la tendencia; de dónde se les permite venir es lo que hay que no perder de vista.

Empezar una nota de IA en vivo

Fuentes


Volver al blog