AI-voiceover for YouTube-videoer
Hvis du lager videoer av og til heller enn daglig, er det vanskelige med AI-fortelling ikke lenger kvaliteten — det er å få ut en ren fil fra et verktøy laget for folk som fortellerarbeid til daglig. Dette er hva et YouTube-voiceover-spor faktisk må være, de to tingene som stille ødelegger gratisversjoner, og hvordan du velger en stemme som ikke kolliderer med bildene dine.
Hva sporet faktisk må være
Tre ting. En ukomprimert eller lett komprimert fil, slik at lyden overlever å bli re-enkodet av redigeringsprogrammet ditt og deretter på nytt av YouTube — en WAV er ideelt, en MP3 med høy bitrate går fint, og alt et gratisnivå gir deg på 64 kbps gjør det ikke. Jevnt lydnivå, slik at fortellingen ligger over musikken uten at du må justere fadern hele tiden. Og ingen artefakter på slutten, som er det folk overser helt til de er inne i tidslinjen. Utover det er fortellingen den enkle delen av redigeringen: det er én mono- eller stereofil du legger på et spor og klipper til.
Vannmerker og talte tagger
To ting ødelegger gratis voiceover-filer, og ingen av dem er åpenbare før du har lyden foran deg. Den første er et hørbart vannmerke — en tone eller et støtutbrudd lagt over talen, noen ganger bare hvert tredevte sekund, som er grunnen til at det overlever en kort test men dukker opp i den ferdige videoen. Den andre er en talt tag: en stemme som leser opp navnet på tjenesten på slutten av klippet. Begge er legitime måter å få et gratisnivå til å fungere på, og begge betyr at du må sjekke hele filen i stedet for bare de første ti sekundene. Klippene her har ingen av delene, og gratisprøven er ekte 200 rene tegn i stedet for en forringet forhåndsvisning.
Å velge en stemme som passer bildene
Instinktet er å velge den mest imponerende stemmen. Det bedre instinktet er å velge den minst distraherende. En lys, rask opplesning fungerer for en kort reklame og blir slitsom over åtte minutter. En dyp trailer-stemme er fantastisk til femten sekunder med tittelsekvens og absurd over en matlagingsguide. For forklarings- og veiledningsinnhold varer de klare, neutrale stemmene lengst, og for alt som ligger under musikk skjærer en mykere, nærmikrofonert opplesning bedre gjennom enn en høylytt en. Det er åtte stemmer her, fire kvinnelige og fire mannlige, alle amerikanske fortellerstemmer, hver beskrevet etter hva den er god til — og du kan høre hvilken som helst av dem lese din egen åpning før du bestemmer deg.
En arbeidsflyt for én video
Skriv manuset først, i redigeringsprogrammet ditt eller en tekstfil, og les det høyt én gang — dette avdekker setningene som fungerer på papiret men ikke i munnen. Lim det inn og følg med på tegntallet: ved 1000 tegn er du på rundt 72 sekunder, så en lengre fortelling blir to eller tre klipp delt ved naturlige avsnittsskift. Hør gratisprøven på din faktiske åpningslinje, ikke på en demosetning, fordi åpningen er der en stemme enten passer videoen din eller ikke. Lag deretter klippene, last ned WAV-filene, og legg dem på tidslinjen i riktig rekkefølge. Å dele ved avsnittsskift betyr at sammenføyningene lander på pauser du ville hatt likevel.
Ofte stilte spørsmål
Må jeg fortelle seerne at stemmen er AI?
YouTube ber opplastere om å opplyse om realistiske syntetiske medier som kan forveksles med virkelige personer eller hendelser. En tydelig syntetisk forteller over dine egne opptak er ikke målet for denne regelen, men opplysningsvalget finnes i opplastingsflyten, og å bruke det ærlig kostet ingenting.
Kan jeg fortelle en hel ti-minutters video på denne måten?
Ja, som en serie klipp. Ett klipp dekker rundt 72 sekunder, så en ti-minutters fortelling er en stabel av dem delt ved avsnittsskift og satt sammen i redigeringsprogrammet ditt. Ingenting stopper deg fra å gjøre det — det er bare flere klipp.
Vil en AI-stemme gjøre videoen min demonetisert?
Ikke på egen hånd. Det som trekker til seg reglene for masseprodusert innhold er repetitivt, lavinnsats-video uten original kommentar. Ditt eget manus over dine egne opptak er en annen sak, uansett hvem eller hva som leser det.
Flere guider
Andre ting vi har laget
Også på engelsk, laget av oss.
Også på engelsk, laget av oss.
Også på engelsk, laget av oss.
Også på engelsk, laget av oss.