DeepSeek V4.1 Flash obtient 81,2, coût de 1,4 % pour GPT-6 Astra
OpenDesign a testé 13 modèles d'IA sur des tâches de conception, avec le GPT-6 Astra d'OpenAI obtenant le meilleur score de 82,7 points. Le modèle V4.1 Flash de DeepSeek a atteint 81,2 points, complétant les tâches en 5,3 minutes à un coût de 0,023 USD. Le GPT-6 Astra a pris 11,1 minutes et coûté 1,61 USD. D'autres modèles comme Claude Fable 5.1 ont obtenu 80,3 points, prenant 12,8 minutes et coûtant 3,66 USD. Le modèle de DeepSeek utilise 552 milliards de paramètres mais n'active que 8 milliards pour les invites et 16 milliards pour les réponses, améliorant ainsi l'efficacité. Ce n'est pas le premier modèle rentable de DeepSeek ; son V4 Pro avait précédemment obtenu un score dans les 5 % de Claude Fable 5 tout en étant moins cher. Les tests d'OpenDesign se concentrent sur la fiabilité des résultats de conception, et non sur le raisonnement général. Le GPT-6 Astra, lancé le 3 septembre, est reconnu pour sa polyvalence mais est plus lent et plus coûteux que le modèle de DeepSeek. Les taux de livraison étaient de 57,7 % pour le V4.1 Flash, 60 % pour le GPT-6 Astra et 56,7 % pour le Claude Fable 5.1.
Prix de --
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

The Block lance officiellement The Raytant, un média spécialisé en IA

Jev explose soudainement : ne sait pas discuter, ne code pas, se contente de juger

Le directeur mondial de la macroéconomie chez Fidelity affirme que le marché haussier du Bitcoin sur un cycle de quatre ans pourrait avoir commencé

La loi CLARITY nécessite 3 sénateurs supplémentaires et une course contre la montre pour un renouveau en 2026

Shanghai promeut l'amélioration de la qualité et de l'efficacité des finances technologiques, en appliquant des technologies telles que la blockchain et l'informatique quantique

Google DeepMind lance la base de données génétique AI AlphaGenome Atlas

Apple lance une nouvelle application de santé "Readiness"

Probabilité de victoire de BLG contre AL en playoffs LPL est de 77%

KakaoBank réorganise l'écran d'accueil de son application avec l'ajout de cartes et d'informations sur les investissements

Seulement 12 % des actifs tokenisés répondent aux critères DeFi

AIP2-1.0 en tête des tests, le coût de Claude est près de 9 fois plus élevé

L'équipe Baidu Wenxin recrute des chercheurs nord-américains et l'auteur principal de DeepSeek

La nouvelle version de Grok 4.7 sera publiée dans les 10 prochains jours

CoinGecko déplace son score de sécurité vers CORE3, près de la moitié des échanges sans preuve de sécurité

L'indice de sentiment Bitcoin tombe à 70, restant dans la zone d'extrême avidité

Le PDG de Coinbase : La réputation sur la chaîne remplacera le score de crédit FICO

Better Mortgage et Coinbase proposent des prêts hypothécaires garantis par Bitcoin allant jusqu'à 250 000 dollars

L'agent de sécurité AI de GCSA enregistre 91,3 % dans CyberGym

La part des altcoins atteint 65 %, une tendance opposée à celle du marché des futures

Standard ERC-8196 finalisé, supporte l'exécution des stratégies de portefeuille AI Agent

L'indice de peur et de cupidité à 72, maintient la zone de cupidité

TermiX lance une infrastructure de paiement AI Agent avec un volume de transactions d'environ 220K

Lancement des puces Xuanjie O3, O100 et D100 par Lei Jun

Microsoft corrige la vulnérabilité CVE-2026-69836 dans Entra ID

DeepSeek V4 Flash, réduit l'écart de performance avec Claude

Le modèle de vision DeepSeek enregistre un score de 2 victoires et 2 défaites contre l'Opus 4.8

Talent Protocol acquis par IPTS, Builder Score devient un produit public

Ajout d'un ordinateur quantique IonQ à KoreaQuantum de Korea Advanced Materials

Lyon maintient la note « surperformer » pour Zhizhu GLM-5.3, avec un objectif de prix de 2061 HKD


