📣 Lähetä tiedotteenne meille
Sivusto päivittyy 15 minuutin välein
Teknologia

Miten tietokoneet oppivat puhumaan kuin ihmiset

Tietokoneinsinööri selittää, miten tekstistä puheeksi -teknologia kehittyi luonnollisemmaksi ja ihmisäänien kaltaiseksi tekoälyn avulla.

12. elokuuta 2026
Miten tietokoneet oppivat puhumaan kuin ihmiset

Tietokoneinsinööri Tam Nguyen selvittää, miten digitaaliset avustajat kuten Siri ja Alexa ovat oppineet kuulostamaan ihmismäisiltä. Kehitys tekstistä puheeksi -teknologiassa, joka simuloi ihmisen puheen tuottamista, on mahdollistanut yhä luonnollisemman kuuloisen digitaalisen puheen.

Teknologia perustuu ääniaaltojen muokkaamiseen. Tietokoneen ohjelmistot muuntavat tekstin foneemeiksi, jotka ovat puheen pienimpiä ääniosia. Nämä yhdistetään sanoiksi ja lauseiksi. Varhaiset yritykset koneiden puheen tuottamiseksi alkoivat jo 1700-luvulla mekaanisilla laitteilla, mutta ne kuulostivat karkeilta. Ensimmäiset elektroniset puhesyntetisaattorit ilmestyivät 1930-luvulla, mutta tietokoneiden yhdistelemä puhe kuulosti jäykältä ja robottimaiselta.

Nykyaikaiset järjestelmät hyödyntävät koneoppimista, erästä tekoälyn muotoa. Ohjelmia koulutetaan analysoimalla tuhansia tunteja ihmisten puhetta, mukaan lukien hengityksen, tunteiden ja äänenkorkeuden vaihtelut. Tämä mahdollistaa puhutun kielen vivahteiden ja inhimillisten piirteiden jäljittelyn.

Kehittynyt tekoäly voi jopa oppia jäljittelemään yksilön omaa puhetyyliä lyhyen ääninäytteen perusteella. Vaikka tekstistä puheeksi -teknologia tarjoaa merkittäviä etuja, kuten apua näkövammaisille tai niille, jotka eivät voi puhua, se avaa myös mahdollisuuksia väärinkäytölle, kuten todentuntuisille ääniväärennöksille (audio deepfakes). Tutkijat kehittävät keinoja tunnistaa näitä väärennettyjä ääniä.

Alkuperäinen lähde: fastcompany.com