Qianwen publie un modèle de synthèse vocale à partir de l’audio, Qwen-Audio-3.0-TTS

Jinse Finance rapporte que le 20 juillet, Qianwen a officiellement lancé le modèle de synthèse vocale Qwen-Audio-3.0-TTS, prenant en charge le contrôle par instructions en langage naturel de style libre, et comprenant une version Flash pour l’interaction en temps réel (latence du premier paquet à l’échelle de 300 ms) ainsi qu’une version Plus pour la génération de haute qualité.
Voir l'original
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Commentaire
Ajouter un commentaire
Ajouter un commentaire
Aucun commentaire
  • Épinglé