Szóból ért nemcsak az ember, már a gép is (2. rész)

MTI Sajtóadatbank, 2012. május 6. 08:42

A hangfelismerő szoftver úgy működik, hogy a beszédet olyan processzorokhoz továbbítja, amelyek a kimondott szavakat hanghullámokra bontják le, és speciális algoritmusokkal azonosítják a hangokból összeállítható legvalószínűbb szót. A rendszer rögzíti és tárolja a beszédet, úgyhogy képes tanítani magát, hogy az idő múlásával egyre pontosabbá váljon.

A Nuance által adott biztosítékok ellenére a hangfelismerő szoftver elegendő kockázatot jelent az emberek magánszférájára számára ahhoz, hogy a használatának szabályozásáért felelősök odafigyeljenek rá. "Ahogy az arcfelismerés alkalmazási lehetőségei miatt aggódunk, úgy más biometrikus azonosításokról, köztük a hangfelismerésről is az a véleményünk, hogy problémákat vet fel" - szögezte le David C. Vladeck, a Szövetségi Kereskedelmi Hivatal (FTC) Fogyasztóvédelmi Irodájának vezetője általában a hangtechnológiáról, nem kifejezetten a Nuance által alkalmazott megoldásról.
   
A felhasználók gyorsabban jutnak célba
   

    "Dragon Go! - szól bele iPhone-jába Sejnoha. - Három személyre akarok helyet foglalni holnap estére a Craigie-ben, a Mainen."
    A Dragon Go a Nuance saját virtuális asszisztense, az az alkalmazás, amelyet bevezetése óta több milliószor töltöttek le.
     A Siritől eltérően azonban a Dragon Go nem válaszol. Sejnoha azt közölte vele, hogy helyet akar foglalni a massachusettsi Cambridge egyik éttermébe: az alkalmazás azonnal felvette a kapcsolatot az OpenTable-lel, és megjelenítette a lehetőségeket.
    A legegyszerűbb keresések esetén a Dragon Go rendszerint megkerüli a keresőmotorokat, és egyenesen olyan vállalatok internetes oldalára irányítja a felhasználókat, mint a Nuance partnerei, az Emazon, az Expedia és az OpenTable. Ha ott nem találják meg azt, amit keresnek, akkor a Dragon Go felajánlja a hagyományos internetes keresés lehetőségét.
    A felhasználók így kevesebb lépésben, gyorsabban jutnak célhoz. Sok esetben, ha például éttermi helyfoglalásról vagy vásárlásról van szó, a Nuance mérsékelt díjat számít fel a partneroldalaknak. Az alkalmazás kihívást jelent a Google-nak és a Microsoftnak, amelyeknek van saját hangtermékük - a Google Voice Actions és a Microsoft Tellme -, valamint a keresőmotoroknak is.
    Christopher Katsaros, a Google szóvivője nem volt hajlandó nyilatkozni erről a kérdésről. A cég nemrég korszerűsítette az Android telefonoknál használatos hangutasítási rendszert, a Google Voice Actionst: képessé tette arra, hogy az emberi beszédet folyamatosan írott szöveggé alakítsa át, és ezzel gyorsabbá és egyszerűbbé vált a szöveges üzenetek diktálása és küldése, a Google hangos keresése vagy útbaigazítások kérése.
    Lezli Goheen, a Microfost szóvivője elmondta, hogy cége a fogyasztók elvárásának megfelelően többféle módon is könnyített az információk megszerzésén. A minden Windows-termékben szereplő Tellme programon kívül, amely lehetővé teszi üzenetek diktálását és alkalmazások hangvezérlését, bevezették a Bing Voice Search programot is a keresések beszéddel történő irányítására.
   
Illúziókeltő, de könnyű a használata

   
    A US Airways törzsutasprogramjának azokat a résztvevőit, akik regisztrálták mobiltelefonjukat, név szerint üdvözli a Wally, a Nuance által a légitársaságnak kifejlesztett interaktív hangrendszer.
    A Wallyt tavaly nyáron vezették be annak az átalakításnak a részeként, amelynek során a US Airway telefonos ügyfélszolgálatát külföldről visszatelepítik az Egyesült Államokba. A rendszer képes például megmondani a törzsutasoknak, hogy milyen helyre szól a jegyük, egyszersmind jelenteni, ha magasabb szintre kerültek a programban. Az emberi beszédet írott szöveggé alakítja át, úgyhogy ha egy ügyfél úgy dönt, hogy élő személlyel kíván tovább tárgyalni, az eredeti kérdést nem kell megismételnie.
    A hangrendszer - amelyhez Wally Wingert, a Jay Leno vezette népszerű televíziós showműsor bemondója kölcsönözte a hangját - nemcsak azoknak a számát csökkentette, akik ragaszkodnak az élő munkatárshoz, hanem az ügyfélhívások átlagos hosszát is. Kerry Hester, a légitársaság alelnöke szerint ha nincs a rendszer, több száz új ügyfélszolgálati munkatársat kellett volna felvenniük.
    A Wally - amely nem árulja el, hogy automatizált rendszer - annyira élőnek tűnik, hogy sok ügyfél "Köszönöm"-mel köszön el tőle, mielőtt lerakja a kagylót.
    Ez az anonimitás azonban nem mindenkinek tetszik. Sherry Turkle, az MIT professzora szerint ahogy a hangfelismerő rendszerek kifinomultabbá válnak, megteremtik annak az illúzióját, hogy nem gépekkel, hanem más emberekkel kommunikálunk. Szerinte hosszú távon a rendszerek illúziókeltő volta és könnyű használata miatt háttérbe szorulnak a lassúbb, rendezetlenebb, valódi emberi kapcsolatokat. Ha emlékeztetik a felhasználókat, hogy egy géppel beszélnek, akkor talán jobban tudatosodik bennük, hogy mennyire felszínes a kapcsolat.
    "Kultúránkat érintő döntést kell hoznunk. El kell határoznunk, megmondjuk-e az embereknek, hogy géppel beszélnek vagy sem" - húzta alá a professzor.

Kulcsszavak: tudomány hangfelismerés

E-világ ROVAT TOVÁBBI HÍREI

Ilyen volt a magyar rádiók zenei repertoárja 2023-ban

Összesen 103 év és kilenc hónapnyi adást sugároztak a magyarországi rádiók 2023. január 1-jétől december 31-ig – derült ki a Nemzeti Média- és Hírközlési Hatóság (NMHH) legfrissebb kutatásából, amely a magyar rádiók 2023-as zenei repertoárját vizsgálta. A teljes kínálatban a legtöbbet játszott előadó Rúzsa Magdolna volt. Az énekesnőt több mint két és félszer annyiszor hallhattuk, mint a huszadik helyezett Azahriah-t. A tavalyi év legsikeresebb hazai slágere a ValMartól az Úristen, a külföldiek közül Miley Cyrus Flowers című dala volt.

2024. május 3. 18:05

Az akadálymentesség elengedhetetlen szempont az épületek tervezése során

Az akadálymentesség szempontjának egyre fontosabb szerepe van az építészetben, világszerte egyre több vállalat törekszik arra, hogy inkluzív környezetet alakítson ki. A Skanska a befogadás és a fenntarthatóság iránti elkötelezettségével összhangban szintén jelentős hangsúlyt fektet erre. A vállalat az átgondolt tervezés és megvalósítás érdekében együttműködik az Access4you-val azzal a céllal, hogy épületeiben a legmagasabb szintű access4you tanúsító védjegyet szerezze meg. 

2024. május 3. 16:17

Szűkülő piacon bővül a Pepita.hu

A Pepita Group Zrt. hazai bruttó forgalma 30, külfölddel együtt 44 százalékos növekedést mutat az első negyedév eredményei alapján. Kinőtte magát: levetkőzte a csupán baba-mama jelleget, a hazai műszaki és elektronikai területen lévő erős piaci verseny ellenére is e termékkategóriákban Magyarországon 57 százalékos bruttó forgalomnövekedést ért el.

2024. május 3. 14:41

A Xiaomi publikálta a legújabb ESG jelentését

A Xiaomi a napokban közzétette a hatodik ESG (környezetvédelem, társadalmi felelősségvállalás és vállalatirányítás) jelentését. A több mint 80 oldalas dokumentum, amelyet kínai és angol nyelven adtak ki azt az előrehaladást mutatja be, amelyet a Xiaomi és leányvállalatai megtettek az ESG stratégia megvalósítása terén 2023-ban. 

2024. május 3. 13:04

Továbbra is az InfoRádió szólhat a Budapest 88,1 MHz-es frekvencián

Egyedüli pályázóként az InfoRádió Kft. nyerte meg a Nemzeti Média- és Hírközlési Hatóság Médiatanácsa által a Budapest 88,1 MHz-es frekvencia használatára kiírt rádiós pályázatot, így a médiaszolgáltató szeptember 1-je után is folytathatja működését. A testület legutóbbi ülésén azt is megállapította, hogy a Balázsék című műsorszám ismét törvényt sértett, amikor a rasszizmusból táplálkozó humorizálásra építette a január 15-i műsor.

2024. május 3. 11:39

Kövess minket a Facebookon!

Cikkgyűjtő

További fontos híreink

Magyar siker: Nemzetközi díjat nyert a TIME magazintól a nyelvtanuló-applikáció

2024. május 3. 19:59

Megvannak 2024 legvonzóbb hazai munkaadói

2024. április 29. 11:38

Ingyenes digitális platform segít a tanároknak és diákoknak az érettségire való felkészülésben

2024. április 20. 11:36

Itt a világ első, Swarovski kristályba ágyazott autós kijelzője

2024. április 10. 14:55