Les poids promis sont disponibles. Leur téléchargement ne reproduit cependant pas toutes les fonctions du service hébergé Qwen3.8-Max.

Lire la fiche du modèle exact
La fiche Qwen3.8-2.4T-A95B décrit 2 400 milliards de paramètres, dont 95 milliards actifs. Les poids sont textuels avec raisonnement obligatoire, contexte natif de 262 144 tokens et extension possible. Max hébergé ajoute des fonctions. Le 27B est dense, multimodal, avec mode sans raisonnement et licence Apache 2.0.
Le grand modèle possède une licence Qwen3.8-Max spécifique : obligations d’affichage à certains seuils et licence séparée pour certaines grandes activités de service de modèles ou d’assistants, avec exception interne. Celle du 27B ne s’y substitue pas.
Paramètres actifs et stockage ne se confondent pas
L’illustration calcule seulement des poids nominaux, avant surcoût d’exécution. À deux octets par paramètre, 2 400 milliards représentent 4,8 To ; à quatre bits idéaux, 1,2 To. Ne compter que les 95 milliards actifs donnerait 190 Go à deux octets, sans représenter l’ensemble des experts.
Ces calculs décimaux ne sont ni des exigences de déploiement, ni les tailles des archives publiées. Métadonnées de quantification, tenseurs gardés dans d’autres précisions, buffers, état du contexte et répartition changent l’empreinte réelle. Le déport des poids modifie leur emplacement et leur circulation ; il ne fait pas disparaître les autres experts.
Séparer parité d’API et qualité des tâches
Avant de remplacer un service, essayez les entrées et contrôles dont l’application dépend : texte, image, vidéo, raisonnement et outils. Vérifiez le checkpoint et le moteur précis. Le nom de famille commun ne démontre pas une égalité de fonctions.
Évaluez ensuite des tâches terminées sous les mêmes limites. Les tableaux du fournisseur décrivent modèles, environnements et réglages particuliers. Ils ne certifient pas une quantification locale utilisant d’autres outils. Conservez qualité, durée et coût complet d’exécution ensemble.
Pour un essai local, 27B et le mélange d’experts de 2 400 milliards représentent des choix de capacité très différents. Commencez par modalités nécessaires, licence et budget mémoire, puis choisissez le fichier à évaluer. Un nom de produit hébergé ne constitue pas une spécification complète de ses poids téléchargeables.
Revue du 8 septembre : poids désormais publiés, modèle Max textuel distingué de l’API et du 27B multimodal ; licence spécifique et calcul mémoire vérifiés.