Microsoft hat auf der Ignite-Konferenz ein KI-Tool namens „Azure AI Speech Text to Speech (TTS) Avatar“ veröffentlicht, das angeblich realistische virtuelle Charaktere generieren kann. Dieses Tool ist jetzt zur Vorschau für die Öffentlichkeit zugänglich
Microsoft sagte, dass Benutzer mithilfe des TTS-Avatars (Text-to-Speech) von Azure AI Speech einen virtuellen Avatar erstellen können, der auf „Texteingabe und Sprachinhalt“ basiert, und ihn mit Fototraining von realen Personen kombinieren können, um einen „auf realen interaktiven Chat-Robotern basierenden“ zu erstellen Menschen“ „, die in Unternehmensmarketing-, Geschäfts- oder Kundendienstszenarien eingesetzt werden können.
Es wird berichtet, dass der Text-to-Speech (TTS)-Avatar von Azure AI Speech hauptsächlich aus drei Modulen besteht, nämlich Textanalysator, TTS-Sprachsynthesizer und TTS-Virtual-Avatar-Synthesizer
Der Textanalysator analysiert zunächst den vom Benutzer eingegebenen Textinhalt und generiert eine Phonemsequenz. Anschließend wird das TTS-Sprachmodell im TTS-Soundsynthesizer die akustischen Eigenschaften des vom Benutzer eingegebenen Texts vorhersagen und dann den Sound synthetisieren. Schließlich wird das Klangsynthesemodell Avatar des neuronalen Netzwerks das Bild der Lippenform des Charakters basierend auf den oben genannten akustischen Eigenschaften vorhersagen und so letztendlich das Bild des virtuellen Avatars bilden
Microsoft erklärte, dass die herkömmliche Avatar-Produktion zeitaufwändig und arbeitsintensiv sei, die Einrichtung einer speziellen Aufnahmeumgebung erfordere und der Postproduktionsprozess der Aufnahme und Bearbeitung ebenfalls recht kostspielig sei. Derzeit wird der neueste Avatar-Dienst Azure AI Speech (TTS) von Microsoft verwendet. Nach der erstmaligen Einrichtung des Modells können Benutzer verschiedene Produkteinführungen, interaktive Videos usw. erstellen, indem sie einfach Text eingeben. Zusammen mit dem Microsoft Azure OpenAI Service und den TTS-Funktionen des neuronalen Netzwerks kann es auch ein natürlicheres interaktives Erlebnis bieten.
IT House berichtete, dass Microsoft ein Beispiel dafür gegeben hat, dass Benutzer den Azure AI Speech TTS-Avatar verwenden können, um verschiedene Videoinhalte stapelweise zu produzieren, wie zum Beispiel Videos zur Unternehmenskultur, Produkteinführungen oder den digitalen Avatar des CEO auf einer Konferenz. Darüber hinaus können Sie auch virtuelle Live-Übertragungen digitaler Menschen, Chat-Roboter, Geschäftsroboter und KI-Lehrer für den Online-Unterricht usw. erstellen.
Microsoft gab bekannt, dass Azure AI Speech Synthesis (TTS)-Avatare jetzt für Azure-Abonnenten verfügbar sind und mehrere Sprachen unterstützen. Benutzer können ihren gewünschten Charakter aus voreingestellten Avatar-Optionen auswählen oder ihren Avatar anpassen
Wenn Benutzer ihren eigenen virtuellen Avatar anpassen möchten, müssen sie eine Reihe von Charaktervideoclips hochladen. Die Azure-Plattform verarbeitet diese Videos dann online, um einen virtuellen Avatar zu generieren. Der Charakter selbst ist von der Tonquelle getrennt. Benutzer können die offizielle Standard-Tonquelle auswählen oder ihre eigene Trainings-Tonquelle hochladen.
Das obige ist der detaillierte Inhalt vonMicrosoft kündigt das Text-to-Speech-Avatar-KI-Tool an, mit dem virtuelle digitale 3D-Menschen erstellt werden können. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!