iLounge | Newsy | Microsoft wprowadził narzędzie deepfake, które każdy może stworzyć
Newsy
3396
Sophia Stark

Sophia Stark · 11/16/23

Microsoft wprowadził narzędzie deepfake, które każdy może stworzyć

Firma Microsoft udostępniła publicznie swoje narzędzie do deepfake’u oparte na sztucznej inteligencji, Azure AI Speech Text-to-Speech Avatar, ale budzi to wątpliwości etyczne.



Microsoft wprowadził narzędzie deepfake, które każdy może stworzyć

Podczas wydarzenia Microsoft Ignite 2023 firma udostępniła awatar głosowy Azure AI Speech Text-to-Speech Avatar. Usługa umożliwia tworzenie realistycznych awatarów, które mogą przekazywać głos pisanym treściom.

Avatar zamiany tekstu na mowę w usłudze Azure AI umożliwia użytkownikom tworzenie filmów wideo z mówiącymi awatarami poprzez przesłanie obrazu człowieka i udostępnienie skryptu. Narzędzie Microsoft następnie uczy model animacji awatara, podczas gdy oddzielny model zamiany tekstu na mowę odczytuje skrypt na głos. Według Microsoftu zastosowania obejmują zarówno tworzenie filmów edukacyjnych, jak i tworzenie wirtualnych asystentów i chatbotów.

Microsoft wprowadził narzędzie deepfake, które każdy może stworzyć

Pomimo potencjalnych korzyści Microsoft zdaje sobie sprawę, że narzędzie może być niewłaściwie wykorzystywane. Aby temu zapobiec, większość użytkowników platformy Azure będzie początkowo miała dostęp tylko do gotowych awatarów, a osobiste dostosowania będą dostępne w ramach procesu rejestracji z „ograniczonym dostępem” dla określonych przypadków użycia.

Firma Microsoft uruchomiła także powiązaną funkcję o nazwie Personal Voice, która jest częścią usługi Neural Voice. Funkcja Personal Voice odtwarza głos użytkownika w ciągu kilku sekund na podstawie jednominutowej próbki mowy, umożliwiając tworzenie spersonalizowanych asystentów głosowych i niestandardowych spikerów.

Firma Microsoft podejmuje jednak środki ostrożności w przypadku usługi Personal Voice, wymagając od użytkowników przedstawienia „wyraźnej zgody” w formie nagranego oświadczenia przed użyciem tej funkcji. Dostęp do tej funkcji jest obecnie ograniczony do formularza rejestracyjnego, a użytkownicy muszą wyrazić zgodę na ograniczenie korzystania z usługi Personal Voice do aplikacji, w których głos nie odczytuje treści generowanych przez użytkowników ani treści publicznych.

Wdrożenie tego narzędzia rodzi pytania etyczne, zwłaszcza w świetle niedawnych dyskusji podczas strajku związków zawodowych SAG-AFTRA na temat rekompensat za wykorzystanie obrazów generowanych przez sztuczną inteligencję. Microsoft nie wyjaśnił jeszcze swojego stanowiska w tej sprawie.

Źródło: Microsoft