Tehisintellekti genereeritud inimnäod, -hääled ja liigutused petavad nüüd enamiku inimesi igapäevastes olukordades, nagu videokõnedes ja sotsiaalmeedia klippides, üsna hõlpsalt ära, kirjutab USA Buffalo ülikooli arvutiteadlane ja süvavõltsingute (deepfake) uurija Siwei Lyu veebiväljaandes The Conversation. Tema hinnangul arenevad süvavõltsingud tuleval aastal edasi aina peenemaks ja tabamatumaks.
2026. aastal muutub tehisarupettus veel raskemini tabatavaks
  • Foto: Tero Vesalainen
Tavavaataja jaoks ja isegi mõne institutsiooni silmis on nn sünteetiline meedia muutunud ehtsatest salvestistest eristamatuks. Küberturbeettevõtte DeepStrike hinnangul kasvas internetis leiduvate süvavõltsingute arv umbes 500 000-lt 2023. aastal ligi 8 miljonini 2025. aastal. See tähendab ligi 900protsendilist aastast kasvu.
Hüppelise kasvu põhjustasid kolm tehnilist muutust. Esiteks õppisid videote genereerimise mudelid säilitama ajalist järjepidevust. Videod ei vilgu enam ja tehisaru genereeritud nägude silmade ja lõuajoonte ümbrus ei muutu või deformeeru. Uued mudelid eraldavad identiteediinfo liikumisandmetest, nii et sama liikumist saab veenvalt rakendada erinevatele nägudele või siis võib ühe inimese nägu sooritada mitmeid tegevusi.
Teiseks ületas hääle sünteesimine ja kloonimine selle, mida Lyu nimetab eristamatuse läveks. Vaid mõni sekund helimaterjali võimaldab nüüd luua veenva klooni. Genereeritud häälel on loomulik intonatsioon, rütm, pausid ja selles on isegi hingamishäälitsused. Mõned suured jaemüüjad on teatanud, et saavad päevas üle 1000 tehisintellekti loodud petukõne. Tajutavad vihjed, mis varem sünteetilised hääled reetsid, on nüüd kadunud.

Tehnoloogia

Ajalugu

Loomariik

Taimed

Füüsika

Sinu keha

Suured teadlased

Tagasi Imeline Teadus esilehele