Tekoälyäänien editointi: Kuinka saada tekoälyäänet kuulostamaan luonnollisemmilta miksauksessa
Tekoälyäänen muokkaaminen tarkoittaa tekoälyäänen – Sunon, Udion tai ElevenLabsin laulaman tekoälyn – muokkaamista siten, että Sekoitaettä se kuulostaa luonnolliselta ja eloisalta. Tyypillisiä ongelmia ovat kovat diskantit, metallinen sihiseminen, hengästyneisyys ja pahamaineinen "tekoälyn heiluminen". EQDe-esserillä, pakkauksella, saturaatiolla ja manuaalisella editoinnilla saat tekoälyäänestä miksausvalmiin, ammattimaisen äänen.
Tämän artikkelin sisältö
- Miksi tekoälyn laulu tekee vaikutuksen – ja silti kuulostaa keinotekoiselta
- Formantit, vibrato ja transientit
- Vaihe 1: Taajuuskorjaus kovia diskantti- ja resonanssiääniä vastaan
- Vaihe 2: De-esser keinotekoisia sibilantteja vastaan
- Vaihe 3: Pakkaus luonnollisen mikrodynamiikan saavuttamiseksi
- Vaihe 4: Saturaatio steriiliä tekoälykylmää vastaan
- Vaihe 5: Jälkikaiku ja viive upotusta varten
- Vaihe 6: Manuaalinen muokkaus tekoälyn heilumista vastaan
- Oikea järjestys: Tekoälyäänien ääniketju
- Usein kysytyt kysymykset
Miksi tekoälyn laulu tekee vaikutuksen – ja silti kuulostaa keinotekoiselta
Sunon, Udion tai ElevenLabin kaltaisten työkalujen tekoälyäänet ovat kehittyneet hämmästyttävän hyviksi lyhyessä ajassa. Ne osuvat sävelkorkeuksiin puhtaasti, kuulostavat tyylillisesti sopivilta ja tuottavat kokonaisen lauluraidan sekunneissa. Useimmat kuuntelijat kuitenkin aistivat vaistomaisesti, että jokin on vialla. Ääni kuulostaa sekä täydelliseltä että elottomalta.
Tämä ei johdu yhdestä virheestä, vaan pikemminkin useiden pienten puutteiden yhdistelmästä. Tekoälylaulussa on tyypillisiä "merkkiaineita": digitaalinen heiluminen pitkillä, jatkuvilla nuoteilla (usein kutsutaan "tekoälyheilumiseksi"), jäykkä, hengästynyt fraseeraus ja metallinen, lähes kristallinkirkas terävyys s- ja t-äänissä. Tähän lisätään keinotekoiselta kuulostava vibrato, luonnottomat transientit ja ennen kaikkea mikrodynamiikan puute.
Aito sibilanssi vaihtelee sanasta sanaan. Tekoälyn luoma sibilanssi taas kuulostaa usein siltä kuin se olisi kopioitu ja liitetty – aina samalla karheudella. Juuri tämän tasaisuuden korvamme tunnistavat "synteettiseksi". Hyvä uutinen on se, että lähes kaikkia näitä ongelmia voidaan lieventää klassisilla miksaustyökaluilla. Tekoälylaulun muokkaaminen on siis vähemmän taikuutta ja enemmän taitavaa tekniikkaa. Jos erotat kappaleesi myös Sunosta, oppaamme auttaa sinua tässä. Kuinka sekoittaa Suno-varret oikein Voit, järkevänä ensimmäisenä askeleena.
Formantit, vibrato ja transientit: hienovaraiset tekoälyn artefaktit
Ennen kuin pääsemme työkaluihin, kannattaa ymmärtää kolme hienovaraisinta tekoälyn artefaktia – sillä niiden tunnistaminen on puolet työstä.
Ensimmäiset ovat formantitFormantit ovat äänen sävyn kiinteitä resonanssialueita, jotka tekevät vokaalista tunnistettavan "A":ksi tai "I":ksi ja muokkaavat sen sävyä. Tekoälygeneraattorit joskus siirtävät näitä formantteja luonnottomasti – ääni kuulostaa tällöin ontolta tai oudon jännittyneeltä. Hienovarainen formantinsiirrin tai dynaaminen taajuuskorjain 800 Hz - 3 kHz:n alueella voi kompensoida tätä. Liika korjaus johtaa nopeasti "Mikki Hiiri" -ääneen.
Toinen on keinotekoinen vibratoOikea laulaja moduloi sävelkorkeuttaan hieman epäsäännöllisesti; tekoälyn vibrato taas on usein mekaanisesti tasainen. Sitä voidaan heikentää tai siirtää tietyissä kohdissa sävelkorkeustyökalulla.
Kolmannet ovat luonnottomat ohimenevät — lyhyt hyökkäysvaihe äänen alussa. Tekoälylaululla sanojen alku kuulostaa joskus liian karulta tai liian epäselvältä, erityisesti kovien konsonanttien, kuten "T", "K" ja "P", kanssa. Äänen sointivärin suunnittelija tasoittaa näitä hyökkäysvaiheita tarkoituksella. Yhdessä mikrodynamiikan puutteen kanssa nämä yksityiskohdat ratkaisevat juuri sen, kuulostaako se "ihmiseltä" vai "koneelta".
Vaihe 1: Taajuuskorjaus kovia diskantti- ja resonanssiääniä vastaan
Kun muokkaat tekoälylaulua, aloitat ensin EQEnnen kuin teet mitään "kauniimpaa", sinun on siivottava asioita. Tekoälylaululla on usein ylikorostettu korkea taajuusalue, josta tulee nopeasti karhea ja väsyttävä täydessä miksauksessa. Kirurginen taajuuskorjain on tässä tärkein työkalusi. Lue lisää tutoriaalissamme: Säädä taajuuskorjain oikein.
Aloita ylipäästösuodattimella: Voit suodattaa pois kaiken alle noin 80–100 Hz:n taajuudet useimmilla tekoälyäänillä ilman, että ääni kuulostaa ohuelta. Käytä sitten kapeaa kellosuodatinta etsiäksesi ei-toivottuja resonansseja. Tyypillisiä ongelma-alueita ovat noin 2–4 kHz (nasaalinen, karhea) ja noin 6–9 kHz (lasinen, terävä). Tehosta kapeaa aluetta hetkellisesti jyrkästi, pyyhkäise taajuus läpi, kunnes se kuulostaa epämiellyttävimmältä – ja leikkaa sitä sitten 2–5 dB:llä siinä kohdassa.
Ole varovainen laajojen diskanttiäänten korostusten kanssa: Se, mikä lisää "ilmaa" oikeaan ääneen, usein korostaa tekoälyäänen artefakteja. Pysyvä Resonanssit, jotka ovat päällekkäisiä muiden jälkien kanssa, ovat tapaus Taajuusmaskaus — tässä kannattaa vertailla laulutaajuuksia instrumentaaliääniin sen sijaan, että tarkastellaan ääntä erikseen.
Vaihe 2: De-esser keinotekoisia sibilantteja vastaan
Tekoälylaulua prosessoitaessa de-esser on lähes aina välttämätön – ja sitä käytetään paljon aggressiivisemmin kuin ihmisen tekemän äänityksen kanssa. Pohjimmiltaan de-esser on taajuusselektiivinen... Kompressori, joka puuttuu asiaan vain, kun terävät S-, Z-, T- ja Sh-äänteet tulevat liian koviksi.
Lähtökohtana: Kirkkaille tai naispuolisille tekoälyäänille kohdealue on yleensä 6–8 kHz, kun taas mies- tai syvemmille äänille se on todennäköisemmin 5–7 kHz. Aseta noin 4–7 dB:n vähennys ja kuuntele tarkkaan: Sibilanttiäänet Niiden pitäisi pehmentyä ilman, että ääni muuttuu käheäksi.
Yksi de-esser on kuitenkin usein riittämätön. Todistettu tekniikka on käyttää kahta kohtuullisilla asetuksilla varustettua de-esseriä yhden aggressiivisen sijaan. Kiinnitä huomiota sijoitteluun: De-esser tulisi sijoittaa ennen saturaatioprosesseja, muuten saturaatio vahvistaa sibilanssia; ja ennen kaiku-/viivelähtöjä, jotta sibilanssi ei katoa efektin häntiin.
Vaihe 3: Pakkaus luonnollisen mikrodynamiikan saavuttamiseksi
Kompressio on myös tärkeä vaihe tekoälylaulua muokatessa. Tekoälyäänet tulevat usein generaattorista jo vahvasti normalisoituina – äänenvoimakkuus on tasainen, mutta juuri tämä vie ääneltä sen eloisuuden. Temppu piilee kompressiossa.
Yhden tehokkaan kompressorin sijaan suositellaan sarjakompressiota: kaksi kompressoria sarjassa, joista kumpikin vähentää vain 2–4 dB:n vahvistusta. Ensimmäinen tallentaa terävät piikit, toinen muokkaa sointikarakteeria. Tämä pitää äänen tasaisena kuulostamatta elottomalta kompressiolta.
Kadonneen mikrodynamiikan palauttamiseksi rinnakkaisprosessointi auttaa: ääni lähetetään erilliselle väylälle, sitä pakataan voimakkaasti ja se sekoitetaan hienovaraisesti alkuperäiseen. Tämä lisää energiaa ja "konkreettisuutta" tasoittamatta luonnollisia vaihteluita.
Etkö ole varma, onko tekoälyäänesi valmis miksaukseen? Lähetä se meille – kuuntelemme tarkasti miksausanalyysin aikana.
Vaihe 4: Saturaatio steriiliä tekoälykylmää vastaan
Tekoälylaulua prosessoitaessa saturaatio on kenties tärkein vaihe, jotta tekoälyäänet kuulostavat "inhimillisiltä". Tekoälylaulu kuulostaa usein steriililtä ja kylmältä, koska siitä puuttuu hienovaraisia harmonisia vääristymiä, joita esiintyy oikeissa äänityksissä mikrofonien, esivahvistimien ja analogisten prosessien kautta. Saturaatio lisää nämä yläsävelet takaisin.
Käytä saturaatiota säästeliäästi: Jo pieni määrä muuttaa huomattavasti soundin luonnetta. Nauha pyöristää diskanttia ja lisää hienovaraista kompressiota, kun taas putki korostaa tasaisia harmonisia yliaaltoja ja kuulostaa "täyteläisemmältä". Koska saturaatio vahvistaa korkeita taajuuksia, se tulisi lisätä de-esserin jälkeen. Kokeiltu ja testattu temppu on monikaistainen saturaatio: Lämmitä alempia keskitaajuuksia (noin 200–800 Hz) rungon saamiseksi ja pidä diskantti puhtaana.
Tarkista A/B-vertailu käsittelemättömään signaaliin – saturaatio houkuttelee lisäämään aina "hieman enemmän", kunnes miksaus muuttuu sameaksi.
Vaihe 5: Jälkikaiku ja viive upotusta varten
Kuiva tekoälyn ääni leijuu irrallaan miksauksen yläpuolella. Vain tilalliset tehosteet asettavat sen uskottavaan ympäristöön. Aloita lyhyellä väliajalla tai tasannevaiheella...Reverb Intiimimmän vaikutelman luomiseksi käytä taustalla pidempää, hienovaraisempaa kaikua syvyyden aikaansaamiseksi. Lisätietoja kaiun asianmukaisesta säätämisestä löydät artikkelista. Säädä kaikua 10 askeleessa.
Suodata myös kaiku a:lla Syvään uurrettu (noin 300 Hz:stä alkaen) ja ylipäästösuodatin (noin 8 kHz:stä alkaen) epäselvän äänen estämiseksi. 20–40 millisekunnin esiviive pitää äänen selkeänä ja edessä ja keskellä. Kappaleen tempoon synkronoitu viive, jota on hieman ulospäin panoroitu ja alennettu, lisää liikettä – hienovaraisesti käytettynä tekoälyääni kuulostaa siltä kuin se olisi aina ollut osa kappaletta.
Vaihe 6: Manuaalinen muokkaus tekoälyn heilumisen ja hengityksen puutteen korjaamiseksi
Joitakin ongelmia ei voida ratkaista pluginilla, vaan ainoastaan manuaalisesti. "Tekoälyheilunta" – digitaalinen heiluminen pitkillä nuoteilla – on yksi tällainen tapaus. Tässä auttaa leikkaamalla pois kyseinen osa, lyhentämällä sitä tai tasoittamalla sitä hienovaraisella sävelkorkeuden/ajoituksen säätötyökalulla. Usein riittää, että pelkkä heiluvan nuotin viimeisen sekunnin häivytys vaimenee.
Lisäksi hengityksen puute on toiseksi suurin ongelma. Oikeat laulajat hengittävät fraasien välillä – tämä ääni puuttuu lähes kokonaan tekoälyäänistä. Jopa muutama, hiljaa sijoitettu oikea hengitysääni fraasien alussa voi huijata korvaa luulemaan, että kyseessä on ihmisen esitys. Jos haluat mieluummin korvata laulun kokonaan, näytämme sinulle, miten se tehdään. Korvaa Sunon laulu omalla äänelläsi Voit. Ja niille, jotka mieluummin kloonaavat oman tekoälyäänensä (äänen kloonaus): kloonattu ääni vaatii myös täsmälleen saman prosessoinnin jälkikäteen, muuten se kuulostaa nopeasti synteettiseltä ilman de-essentiä ja saturaatiota.
Oikea järjestys: tekoälyäänien ääniketju
- 1. Manuaalinen muokkaus — Korjaa ensin tekoälyn horjuminen, nielemät tavut ja hengitys.
- 2. Subtraktiivinen taajuuskorjain — Poista alipäästösuodattimet, resonanssit ja kovat diskanttiäänet.
- 3. De-Esser — Kesytä keinotekoiset sibilantit (ennen kyllästymistä!).
- 4. Puristus — sarja- tai rinnakkaiskytkentä johdonmukaisuuden ja mikrodynamiikan takaamiseksi.
- 5. Kylläisyys — Lämpöä ja vivahteita steriiliä kylmyyttä vastaan.
- 6. Additiivinen taajuuskorjain — valinnainen kevyt kiillotus.
- 7. Kaiku ja viive (lähetysten kautta) — Upottaminen tilaan.
Tekoälyn luoma laulu ei ole rakettitiedettä – se on vankkaa laulumiksausta muutamalla kohdennetulla tarkennuksella. Ne, jotka haluavat jättää viimeisen silauksen ammattilaisille, voivat teettää koko projektinsa tekoälyn luomalla versiolla. Miksaa kappale — Saamme kaiken irti tekoälyraidoistasi. Ja kun miksaus on valmis, siirrymme seuraavaan vaiheeseen: tekoälymusiikkiin Sunon mukaan. olla hallinnut.
YHTEYSTIEDOT PEAK-STUDIOSSA
Lähetä meille tekoälylauluosuutesi tai koko tekoälykappaleesi – annamme sinulle rehellisen arvion siitä, mitä miksauksella voidaan saavuttaa. Vastaamme sinulle yleensä kolmen tunnin kuluessa.
- Yhteyshenkilö
- Noin 20 vuoden kokemus
- Korkein laatustandardi
Tavoitat meidät puhelimitse maanantaista perjantaihin klo 09-20
Usein kysyttyjä kysymyksiä tekoälylaulusta ja tekoälymiksauksesta
Miksi tekoälyn ääni kuulostaa usein luonnottomalta?
Useiden pienten poikkeavuuksien vuoksi: digitaalinen heiluminen pitkitetyillä nuoteilla (tekoälyn heiluminen), hengästyttävä fraseeraus, metalliset, toistuvat sihisevät äänet ja mikrodynamiikan puute. Korvamme havaitsevat tämän yhdenmukaisuuden synteettisenä.
Minkä de-esser-arvon minun pitäisi asettaa tekoälyäänille?
Lähtökohtana: 6–8 kHz kirkkaille tai naisäänille, 5–7 kHz tummemmille tai miesäänille, 4–7 dB:n vaimennuksella. Tekoälylaululla voit olla aggressiivisempi kuin oikeilla äänitteillä, koska sibilanssi on tasaisempi.
Onko mahdollista saada tekoälyn avulla tehty laulu kuulostamaan täysin luonnolliselta?
Tekoälyn alkuperää voidaan harvoin peittää täysin, mutta taajuuskorjaimella, de-esserillä, kompressiolla, saturaatiolla, huonetehosteilla ja pienellä manuaalisella editoinnilla pääset hyvin lähelle uskottavaa, miksausvalmista laulua.
Pitääkö minun miksata tekoälylaulu eri tavalla kuin oikea laulu?
Perusperiaate on sama, mutta joitakin työkaluja – erityisesti de-esseria ja saturaatiota – käytetään johdonmukaisemmin ja manuaaliseen editointiin investoidaan enemmän tekoälyn heilumisen ja hengityksen puutteen torjumiseksi.
Missä järjestyksessä tekoälyäänien ääniketjun tulisi olla?
Editointi → subtraktiivinen taajuuskorjain → de-esser → kompressio → saturaatio → valinnainen taajuuskorjain → kaiku/viive lähdöillä. On tärkeää, että de-esser sijoitetaan ennen saturaatiota.