<script type="application/ld+json">{"@context":"https://schema.org","@graph":[{"@type":"Article","headline":"QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos","description":"Qwen ya no espera a Qwen4: Alibaba libera HOY la arquitectura que la va a sustentar en abierto, de la mano de Qwen3.8-Flash-Next. 125B parámetros con solo 6B ac","datePublished":"2026-08-26T00:00:00.000Z","dateModified":"2026-08-26T00:00:00.000Z","author":{"@type":"Person","name":"Nicolás Ramos","url":"https://nramos.dev"},"publisher":{"@type":"Organization","name":"NRamosDev","logo":{"type":"ImageObject","url":"https://nramos.dev/favicon.svg"}},"mainEntityOfPage":"https://nramos.dev/blog/qwen-3-8-flash-next-preview-de-qwen4-que-alibaba-suelta-ante/","keywords":"youtube, nramosdev, ia, análisis","inLanguage":"es"},{"@type":"VideoObject","name":"QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos","description":"Qwen ya no espera a Qwen4: Alibaba libera HOY la arquitectura que la va a sustentar en abierto, de la mano de Qwen3.8-Flash-Next. 125B parámetros con solo 6B ac","thumbnailUrl":"https://i.ytimg.com/vi/6k1Cinrbspo/hqdefault.jpg","uploadDate":"2026-08-26T00:00:00.000Z","embedUrl":"https://www.youtube.com/embed/6k1Cinrbspo","contentUrl":"https://www.youtube.com/watch?v=6k1Cinrbspo"}]}</script>
NRamosDev · Blog

QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos

#youtube#nramosdev#ia#análisis

TL;DR

QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos

Qwen ya no espera a Qwen4: Alibaba libera HOY la arquitectura que la va a sustentar en abierto, de la mano de Qwen3.8-Flash-Next. 125B parámetros con solo 6B activos por token, un preview multimodal que trae dos novedades de cabecera: la atención lineal GDN y la nueva Qwen Sparse Attention. ¿Se podrá correr en local? Te cuento lo confirmado, lo filtrado y lo que falta por saber.

Capítulos del vídeo

  • 0:00 — Introducción — Qwen libera el preview de la arquitectura Qwen4
  • 0:31 — Lo confirmado — ficha de lanzamiento del modelo
  • 1:04 — Arquitectura — los cambios GDN y Qwen Sparse Attention
  • 1:40 — Los specs filtrados — 125B totales, 6B activos y 51B de embeddings N-gram
  • 2:16 — Debate local — 6B activo no significa que corra como un 6B
  • 2:51 — Incógnitas — benchmarks, licencia y precio sin publicar
  • 3:12 — Cadencia de Alibaba — Max, 27B y Flash-Next en el mismo mes
  • 3:43 — Cierre — qué esperamos de la liberación de hoy

El contexto

DATOS CLAVE

Análisis

  • Modelo multimodal MoE open-weight sobre la arquitectura Qwen4 de próxima generación

  • Release anunciado para hoy 26 de agosto a las 15:00 UTC en ModelScope, variantes estándar y FP8

  • Dos cambios de cabecera confirmados: Gated Delta Network (GDN) y Qwen Sparse Attention (QSA)

Puntos clave

Fuentes

Conclusión

  • Specs filtrados (no oficiales): 125B parámetros totales, 6B activos por token, 51B de embeddings N-gram

Artículo generado automáticamente desde el vídeo publicado en nramosdev. Cada número citado proviene de la investigación verificada del pipeline.

([nr])

¿Te ha gustado? Suscríbete al canal para más análisis de IA en español.

Ver en YouTube

Artículos relacionados