Oletko koskaan puhunut tärkeää työpuhelua tuulisella kadulla tai täydessä kahvilassa ja ihmetellyt, miksi vastapuoli kuulee silti vain sinun äänesi? Nykyaikaiset langattomat napit eivät enää luota pelkkään mekaaniseen tai passiiviseen suodatukseen. Tilalle on tullut laitteessa paikallisesti pyörivä koneoppiminen. Tämä uudenaikainen tekoäly taustamelun vaimennuksessa analysoi äänisignaalia reaaliajassa ja kuorii ympäristön hälyn pois mikrosekunneissa. Mutta miten pieni kuuloke tietää, mikä osa ääniaallosta on puhettasi ja mikä tuulen huminaa?
Laitteiden taustamelun vaimennus on pitkään perustunut vastavaihetoimintoon. Kun ulkoinen mikrofoni havaitsee tasaisen huminan, kuten lentokoneen moottorin jytinän, kuuloke luo vastakkaisen ääniaallon, joka kumoaa melun. Tämä mekaaninen menetelmä on erinomainen staattisen melun suodatuksessa, mutta se kohtaa seinän heti, kun ympäristö muuttuu kaaoottiseksi.
Astioiden kilinä, ohi ajava auto tai toisten ihmisten puhe ovat taajuudeltaan ja rytmiltään arvaamattomia. Tätä haastetta ratkomaan on kehitetty tekoäly taustamelun vaimennuksessa. Tekoälypohjainen puheen eristys ei yritä vain vaimentaa tiettyjä taajuuksia, vaan se oppii tunnistamaan ihmisäänen akustiset tunnusmerkit ja erottamaan ne kaikesta muusta äänisignaalista.
Puheen eristämisen taustalla toimivat syvät neuroverkot, joita on koulutettu sadoilla tuhansilla tunneilla erilaisia ääninäytteitä. Algoritmeille on opetettu miltä ihmisen puhe kuulostaa eri kielillä, eri äänenpainoilla ja mitä eroa sillä on vaikkapa koiran haukuntaan tai tuulen puuskiin.
Kun puhut kuulokkeet korvissasi, laitteen mikrofonit vastaanottavat useita signaaleja samanaikaisesti:
Tekoäly vertailee näitä signaaleja ja luo äänestä reaaliaikaisen spektrogrammin. Koneoppimismalli arvioi jokaisen taajuuskaistan kohdalla, millä todennäköisyydellä signaali sisältää ihmisääntä. Jos taajuus tunnistetaan meluksi, sen voimakkuutta nollataan digitaalisesti samalla kun puhetaajuuksia vahvistetaan.
Älyn ansiosta kuulokkeet eivät enää vain leikkaa ääniä pois, vaan ne uudelleenkirjoittavat äänisignaalin reaaliajassa kirkkaaksi puheeksi.
Suurin teknologinen läpimurto ei ole pelkkä algoritmi, vaan se, että monimutkainen tekoäly taustamelun vaimennuksessa saadaan mahtumaan parin gramman painoiseen nappikuulokkeeseen. Älypuhelimet ja kuulokkeet käyttävät tätä varten erikoistuneita NPU-yksiköitä (Neural Processing Unit), jotka suorittavat miljardeja matemaattisia laskutoimituksia sekunnissa kuluttamatta akkua tyhjiin hetkessä.
Koska laskenta tapahtuu kokonaan laitteessa ilman viivettä aiheuttavia pilvipalveluita, puhe pysyy luonnollisena ja keskustelu sujuvana. Tulevaisuudessa algoritmit pystyvät jopa oppimaan yksilöllisen äänenvärisi niin tarkasti, ettei vieressä seisovan henkilön puhe pääse enää koskaan sotkemaan puheluasi.
Millaisia kokemuksia sinulla on älykkäästä melunvaimennuksesta tuulisessa säässä tai meluisissa tiloissa? Jaa omat havaintosi kommenttikentässä!









