Alibaba lance Qwen 3.8 Flash Next, MoE de 125 B et 51 B d'embeddings N-gram en aperçu de Qwen 4
Résumé
Qwen publie sur Hugging Face et ModelScope l'aperçu de Qwen 3.8 Flash Next, présenté comme un premier avant-goût de l'architecture Qwen 4. Le modèle MoE combine 125 milliards de paramètres, 51 milliards d'embeddings N-gram servant de mémoire trainable et 6 milliards de paramètres actifs par token. La release officielle est calée sur le 26 août, plus de 660 utilisateurs sont déjà en liste d'attente.
Shared on Bluesky by 1 AI expert
Article original publié par huggingface.co
Lire l'article original →Titre original : Alibaba lance Qwen 3.8 Flash Next, MoE de 125 B et 51 B d'embeddings N-gram en aperçu de Qwen 4