Le Qwen 3.8-Max d'Alibaba a montré une compétitivité en termes de coûts lors des tests de détection de vulnérabilités, mais les résultats de ce modèle n'ont pas été inclus dans le rapport d'Aikido. Le Qwen 3.8-Max a obtenu des performances similaires à celles des modèles concurrents avec un coût de 821 dollars lors de trois tests. Aikido a testé 13 modèles d'IA sur 26 vulnérabilités CVE dans un benchmark publié le 16 juillet. GPT-5.6 a détecté 23 des 26 vulnérabilités, enregistrant un taux de rappel de 88,5 %, ce qui en fait le modèle le plus performant. Les modèles de la série Claude Oupus ont détecté entre 15 et 18 vulnérabilités, tandis que le Grok-4.5 en a détecté 20. Le modèle Kimi K3, récemment ajouté, a également détecté 23 vulnérabilités, atteignant les mêmes performances que GPT-5.6. Ce test a été réalisé dans un cadre d'analyse de code conçu pour permettre à l'IA d'explorer de véritables dépôts de code, et a été évalué selon la méthode 'pass@3'. Aikido a présenté le nombre total de paramètres du Qwen 3.8-Max à 2,4 billions, mais le nombre de paramètres actifs n'a pas été divulgué. Le benchmark d'Aikido a ciblé les CVE des logiciels courants, ce qui rend difficile son interprétation en tant que performance d'audit de sécurité blockchain.
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.





























