Audio die is gemaakt met het AI Lyria-model van Google DeepMind, zoals nummers die zijn gemaakt met de nieuwe audiogeneratiefunctie van YouTube, krijgt een watermerk met een SynthID zodat mensen hun door AI gegenereerde bron achteraf kunnen identificeren.
Het watermerk is niet waarneembaar voor het menselijk oor en "heeft geen invloed op de luisterervaring", zei DeepMind in een blogpost, eraan toevoegend dat het watermerk nog steeds kan worden herkend, zelfs als het nummer is gecomprimeerd, versneld of vertraagd, of als er extra ruis is toegevoegd.
Watermerktools zoals SynthID worden beschouwd als een belangrijke waarborg tegen bepaalde schade veroorzaakt door generatieve kunstmatige intelligentie. Het uitvoeringsbesluit van de Amerikaanse president Joe Biden over kunstmatige intelligentie roept bijvoorbeeld op tot de ontwikkeling van een nieuwe, door de overheid geleide standaard voor het watermerken van door AI gegenereerde inhoud. Dit is een veelbelovend gebied, maar de huidige technologie is verre van een wondermiddel tegen AI-inhoudsfraude.
Volgens DeepMind zet de audio-implementatie van SynthID "audiogolven om in een tweedimensionale visualisatie die laat zien hoe het frequentiespectrum in het geluid in de loop van de tijd evolueert." Het bedrijf beweert dat deze aanpak "anders is dan alles wat momenteel bestaat."
Het nieuws over de mogelijkheid van Google om watermerken in door AI gegenereerde audio in te sluiten komt slechts een paar maanden nadat het bedrijf een bètaversie van SynthID heeft uitgebracht voor afbeeldingen gemaakt door Imagen op de Apex AI van Google Cloud. Dit watermerk is bestand tegen bewerkingen zoals bijsnijden of vergroten/verkleinen, maar DeepMind waarschuwt dat het niet bestand is tegen 'extreme fotoretouchering'.