Ant Group a officiellement ouvert les poids de Ling-3.0-flash, offrant une version originale BF16 et une version quantifiée FP8, toutes deux sous licence MIT. Elles sont désormais disponibles sur Hugging Face et ModelScope, et peuvent être déployées par SGLang ou vLLM. La version BF16 fait environ 255 Go, tandis que la version FP8 fait environ 128 Go, ce qui représente presque une réduction de moitié. FP8 conserve les paramètres avec une précision plus faible, réduisant ainsi les exigences de stockage et de mémoire vidéo. Les tests officiels montrent que la différence maximale entre FP8 et BF16 est de 1,57 point. Ling-3.0-flash a un total de 124 milliards de paramètres, n'activant que 5,1 milliards à chaque génération, et prend en charge un contexte de 256 000 tokens, principalement destiné aux tâches d'agent telles que la programmation, la recherche, la recherche approfondie et l'appel d'outils. Les évaluations officielles montrent que ce modèle atteint ou dépasse les performances des modèles précédents de plus d'un trillion de paramètres, Ring-2.6-1T, sur la plupart des benchmarks.
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.





























