OpenAI a lancé deux modèles de transcription vocale : GPT Transcribe et GPT Live Transcribe. GPT Transcribe est conçu pour traiter des fichiers audio et des tâches en lot, tandis que GPT Live Transcribe est adapté aux sous-titres en direct et aux scénarios en temps réel tels que les appels téléphoniques. Ces deux modèles peuvent combiner le sujet de l'enregistrement, des mots-clés et des indications linguistiques pour améliorer la reconnaissance des phrases courtes, des chiffres, des termes techniques, des accents variés et dans des environnements bruyants. Selon une évaluation d'Artificial Analysis, le taux d'erreur de mots de GPT Transcribe est de 3,31 %, soit 0,7 point de pourcentage de moins que la génération précédente, GPT-4o Transcribe. Le prix du nouveau modèle a également été réduit de 25 %, facturant 4,5 dollars pour 1000 minutes d'audio.
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.





























