VALL-E imitiert Aussprache: Microsoft baut KI-Modell für Stimmensynthese
Ein kurzes Audio-File reicht VALL-E als Input, um die Stimme einer bestimmten Person nachzuahmen. Microsofts KI-Modell kann Menschen Dinge sagen lassen, die diese nie gesagt haben.
Weiterlesen »