- Adobe har lansert tre nye AI-verktøy for lyd i Firefly
- Skapere kan nå bruke Generate Music, Generate Speech og Generate Sound Effects
- Vi testet dem for å se hvor godt de fungerer for videoproduksjon
Etter å ha vært i beta en stund, har Adobe Firefly nå gjort tre nye AI-verktøy for lyd tilgjengelig for alle innholdsskapere, og lover «lyd i studiokvalitet». Vi testet hvert av dem for å se om resultatene levde opp til løftet, og totalt sett gjorde de det, selv om vi møtte på noen særegenheter.
Generate Music, Generate Sound Effects og Generate Speech er de nyeste lydfunksjonene som er lagt til Adobes nettleserbaserte AI-plattform, og navnene avslører stort sett hva de gjør.
Etter å ha eksperimentert med alle tre, er Generer musikk den som imponerer oss mest. Det er betydelig bedre enn vi forventet, og vi kan definitivt se hvordan både markedsførere og innholdsskapere kan dra nytte av verktøyet i stor grad. Du kan prøve ut funksjonene selv via Adobe Firefly.
Latest Videos FromTechRadar
Hva er nytt?
Tre nye AI-verktøy er nå tilgjengelige for alle. De er ganske selvforklarende, men her er det viktigste du trenger å vite:
- Generate Music lar deg lage lisensiert musikk som tilpasser seg videoens lengde og stemning.
- Generate Speech konverterer skrevne manus til AI-genererte voiceovers.
- Generate Sound Effects lager – akkurat som navnet antyder – lydeffekter som matcher handlingen og timingen i en video.
Men er de faktisk bra?
Vi har tidligere skrevet om vår ganske forsiktige tilnærming til AI generelt og problemene som oppstår når teknologien brukes til kreativt arbeid. Resultatet kan lett føles mer som en etterligning av kunst enn ekte kreasjon.
Samtidig har flere av Adobes AI-verktøy klart å imponere selv de største AI-skeptikerne i teamet vårt – ikke minst funksjoner som Generative Extend i selskapets videoredigeringsprogramvare. Vi er også åpne for å bli overbevist, så vi bestemte oss for å teste de nye lydverktøyene selv for å se hva de egentlig handler om.
I hvert fall foreløpig er fokuset først og fremst på å få fart på kreative arbeidsflyt for markedsførere og innholdsskapere.
Skap AI-musikk
Vi startet med Generate Music, hvor du enten kan skrive din egen prompt eller laste opp en video og la AI-en prøve å finne ut hva slags musikk som ville fungere. Vi brukte et kort 27-sekunders klipp filmet til vår anmeldelse av reMarkable Paper Pure – hovedsakelig fordi den tilfeldigvis ble liggende i nedlastingsmappen.
Basert på videoen foreslo Firefly prompten som «en rolig, tankefull ambient elektronisk sang for en produktdemo».
Vi trykket på Generate, og etter bare noen få sekunder – det er faktisk imponerende raskt – ble vi presentert med fire forskjellige sanger å velge mellom, alle med omtrent samme følelse. De var… greie. Litt generiske, men definitivt nyttige hvis du har dårlig tid eller trenger å få et prosjekt raskt unnagjort.
Vi bestemte oss deretter for å legge til flere instruksjoner i prompten, som «jazz» og «cinematic», samt å bruke musikken i en «vlog» og «trailer». Vi endret også energinivået fra «lavt» til «middels». Resultatene var betydelig bedre.
Som med mange andre AI-verktøy, jo mer detaljerte instruksjonene du gir, desto bedre blir resultatene. Du kan også beskrive følelsen, stilen og bruken du ønsker hvis du allerede har en klar idé.
Når du er fornøyd, kan du laste ned både videoen og musikken sammen, eller bare musikksporet.
Lag AI-voiceovers
Da vi gikk videre til Generate Speech, måtte vi først velge hvilken AI-modell vi skulle bruke via sidemenyen. I skrivende stund finnes Adobes kommersielt sikre Firefly-modell og partnermodellen ElevenLabs Multilingual V2.
Deretter valgte vi en stemme fra en liste med 45 alternativer. Stemmene er kategorisert etter mann, kvinne eller ikke-binær, samt ung voksen, middelaldrende og senior.
Til slutt limte vi inn teksten i tekstfeltet. Firefly kan automatisk identifisere hvilket språk du bruker, men du kan også velge språk manuelt. Til testen brukte vi diktet Ozymandias.
Noe vi likte var muligheten til å legge til ekstra instruksjoner i selve teksten og fortelle AI-en hvor den skulle pause.
Men for å faktisk forhåndsvise måtte vi markere hele tekstavsnittet og bruke kontekstmenyen. Det er også her du kan korrigere uttalen og justere tonen i stemmen.
Med tanke på hvor mye Adobe snakker om raskere arbeidsflyt, føles dette som et unødvendig komplisert oppsett. En enkel avspillingsknapp nederst på skjermen ville gjort jobben mye enklere.
Vi måtte også justere pausene for å gi fortellingen litt mer luft. Når de var lagt til, kunne vi finjustere lengden ved å klikke på hver pause i forhåndsvisningen. Av en eller annen grunn var ordet «land» ordet AI-en hadde mest problemer med, og uttalte det som «lan».
Lag AI-lydeffekter
For å teste Generate Sound Effects brukte vi igjen et klipp fra vår reMarkable-anmeldelse, denne gangen en 12-sekunders video som sammenlignet reMarkable 2 med Paper Pure.
Her er prosessen mye mer manuell, ettersom AI-en ikke prøver å finne ut hvilke lydeffekter som ville passe til videoen. Vi måtte beskrive hva vi ønsket og deretter klikke på «Forbedre melding», som automatisk la til flere detaljer.
Den resulterende meldingen var «en glidende plystring som forsiktig faller i tonehøyde, med en metallisk klang og en mild resonans». Etter at vi klikket på Generer, opprettet tjenesten raskt fire øredøvende varianter. Vi sparer deg for disse resultatene.
I stedet endret vi meldingen til den mye mer behagelige «gresshopper i et jorde» og satte lengden til 12 sekunder for å fylle hele videoklippet.
En fin ting med lydeffekter er at du kan legge til flere lydspor og bruke glidebryterne til å bestemme nøyaktig hvor du skal plassere dem.
Med en tidslinje nederst på skjermen begynner grensesnittet faktisk å ligne et ekte lydredigeringsprogram, i hvert fall til en viss grad. Ved å dra i håndtaket på lydsporet kan du også justere volumet eller slette sporet.
Er de verdt på bruke?
Alt i alt er det et par ting med grensesnittet vi gjerne skulle sett Adobe finjustere for å øke hastigheten på produksjonsarbeidsflyten.
Vi tror ikke verktøyene vil erstatte profesjonelle lyddesignere, komponister eller musikere i nær fremtid. Men for markedsførere og enkel, hverdagslig videoproduksjon kan vi definitivt se for oss at de tjener et formål.
Generate Speech er langt fra den tiden da AI-stemmer hørtes ut som den gamle Microsoft Sam, men når det gjelder nyansert og troverdig levering, er det fortsatt vanskelig å slå en ekte person foran en mikrofon.
Generate Sound Effects føles betydelig mer brukervennlig. Etter å ha generert en rekke forskjellige lyder, hadde vi problemer med å høre noen større forskjell mellom AI-effektene og lydene på en gammel lydeffekt-CD vi hadde for hånden.
Den store vinneren er imidlertid Generate Music. Den aller første, automatisk genererte, promptproduserte musikken som lett kunne vært brukt i en produktdemo, anmeldelse, bedriftsvideo eller lignende. Dessuten ble resultatene bedre med hver nye generering vi gjorde.
For alle som trenger å produsere videoinnhold raskt, er dette en oppdatering som absolutt er verdt å utforske.


