Radar China · EDICIÓN 03

Qwen abre Flash-Next y anticipa la arquitectura de Qwen4

Diagrama oficial de la arquitectura de Qwen3.8-Flash-Next
Imagen: Alibaba / Qwen

Qué cambia

Alibaba ha publicado los pesos de Qwen3.8-Flash-Next, un modelo multimodal de mezcla de expertos que utiliza 125.000 millones de parámetros totales y activa 6.000 millones por token. Admite texto, imagen y vídeo, ofrece una ventana nativa de 262.144 tokens y puede ampliarse experimentalmente hasta un millón mediante YaRN.

El contexto y los límites

Qwen describe Flash-Next como una vista previa arquitectónica de la futura familia Qwen4 y ofrece Qwen3.8-Flash como servicio comercial en QwenCloud. Las comparaciones de rendimiento y ahorro siguen siendo afirmaciones del fabricante: Reuters confirma el lanzamiento, la apertura de pesos y las especificaciones principales, pero no valida de forma independiente sus benchmarks ni su ventaja de costes.

Cómo llevarlo a la práctica

Quien crea aplicaciones debería comparar el modelo con tareas propias: comprensión de documentos, calidad del código y latencia. Un contexto largo permite introducir más información, pero no garantiza que el modelo la utilice bien. Abrir pesos también exige evaluar infraestructura y condiciones de uso.

Comprueba las fuentes

El anuncio y su contraste están enlazados para que puedas consultar el alcance original. Las valoraciones pertenecen a la síntesis editorial.

Fuente original · QwenSegunda referencia · Reuters

Sigue leyendo

K2 Horizon abre modelos, código y parte del proceso de entrenamiento

← Volver a la edición · Archivo · Cómo seleccionamos las noticias