Le modèle linguistique audio Qwen2-Audio d'Open Source d'Alitongyi, dont l'article correspondant a été sélectionné pour la conférence de haut niveau ACL 2024

Golden Ten Data a rapporté le 13 août que le grand modèle d’Ali Tongyi continuait d’être open-source, et que la série Qwen2 de familles open-source ajoutait le modèle de langage audio Qwen2-Audio. Qwen2-Audio peut répondre directement aux questions et réponses sans saisie de texte, comprendre et analyser les signaux audio entrants par les utilisateurs, y compris les voix humaines, les sons naturels, la musique, etc. Le modèle a nettement surpassé les meilleurs modèles précédents dans plusieurs revues faisant autorité. Dans le même temps, l’équipe de Tongyi a également lancé un nouvel ensemble de benchmarks d’évaluation du modèle de compréhension audio, et des articles connexes ont été sélectionnés pour la ACL2024 de la conférence internationale au sommet qui se tient cette semaine.

Voir l'original
Le contenu est fourni à titre de référence uniquement, il ne s'agit pas d'une sollicitation ou d'une offre. Aucun conseil en investissement, fiscalité ou juridique n'est fourni. Consultez l'Avertissement pour plus de détails sur les risques.
  • Récompense
  • 3
  • Partager
Commentaire
0/400
Aucun commentaire
  • Épingler
Trader les cryptos partout et à tout moment
qrCode
Scan pour télécharger Gate.io app
Communauté
Français (Afrique)
  • 简体中文
  • English
  • Tiếng Việt
  • 繁體中文
  • Español
  • Русский
  • Français (Afrique)
  • Português (Portugal)
  • ไทย
  • Indonesia
  • 日本語
  • بالعربية
  • Українська
  • Português (Brasil)