Ant Group a ouvert les poids de Ling-3.0-tiny, offrant trois versions : BF16, FP8 et INT4, sous licence MIT. Ce modèle comprend 7,9 milliards de paramètres, avec seulement 1,3 milliard activés par Token, principalement destiné au déploiement local et aux scénarios d'Agent. Ling-3.0-tiny est équipé de 128 experts en routage, chaque Token en choisissant 8 parmi eux, plus 1 expert partagé. La partie attention utilise une architecture mixte KDA et MLA au ratio de 3:1, avec 3 couches de Kimi Delta Attention suivies d'une couche MLA. Selon les déclarations officielles, la version FP8 peut atteindre environ 86-90 Token/s sur MacBook M4 Pro et environ 100-105 Token/s sur DGX Spark.
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.




























