Szóból ért nemcsak az ember, már a gép is (2. rész)

MTI Sajtóadatbank, 2012. május 6. 08:42

A hangfelismerő szoftver úgy működik, hogy a beszédet olyan processzorokhoz továbbítja, amelyek a kimondott szavakat hanghullámokra bontják le, és speciális algoritmusokkal azonosítják a hangokból összeállítható legvalószínűbb szót. A rendszer rögzíti és tárolja a beszédet, úgyhogy képes tanítani magát, hogy az idő múlásával egyre pontosabbá váljon.

A Nuance által adott biztosítékok ellenére a hangfelismerő szoftver elegendő kockázatot jelent az emberek magánszférájára számára ahhoz, hogy a használatának szabályozásáért felelősök odafigyeljenek rá. "Ahogy az arcfelismerés alkalmazási lehetőségei miatt aggódunk, úgy más biometrikus azonosításokról, köztük a hangfelismerésről is az a véleményünk, hogy problémákat vet fel" - szögezte le David C. Vladeck, a Szövetségi Kereskedelmi Hivatal (FTC) Fogyasztóvédelmi Irodájának vezetője általában a hangtechnológiáról, nem kifejezetten a Nuance által alkalmazott megoldásról.
   
A felhasználók gyorsabban jutnak célba
   

    "Dragon Go! - szól bele iPhone-jába Sejnoha. - Három személyre akarok helyet foglalni holnap estére a Craigie-ben, a Mainen."
    A Dragon Go a Nuance saját virtuális asszisztense, az az alkalmazás, amelyet bevezetése óta több milliószor töltöttek le.
     A Siritől eltérően azonban a Dragon Go nem válaszol. Sejnoha azt közölte vele, hogy helyet akar foglalni a massachusettsi Cambridge egyik éttermébe: az alkalmazás azonnal felvette a kapcsolatot az OpenTable-lel, és megjelenítette a lehetőségeket.
    A legegyszerűbb keresések esetén a Dragon Go rendszerint megkerüli a keresőmotorokat, és egyenesen olyan vállalatok internetes oldalára irányítja a felhasználókat, mint a Nuance partnerei, az Emazon, az Expedia és az OpenTable. Ha ott nem találják meg azt, amit keresnek, akkor a Dragon Go felajánlja a hagyományos internetes keresés lehetőségét.
    A felhasználók így kevesebb lépésben, gyorsabban jutnak célhoz. Sok esetben, ha például éttermi helyfoglalásról vagy vásárlásról van szó, a Nuance mérsékelt díjat számít fel a partneroldalaknak. Az alkalmazás kihívást jelent a Google-nak és a Microsoftnak, amelyeknek van saját hangtermékük - a Google Voice Actions és a Microsoft Tellme -, valamint a keresőmotoroknak is.
    Christopher Katsaros, a Google szóvivője nem volt hajlandó nyilatkozni erről a kérdésről. A cég nemrég korszerűsítette az Android telefonoknál használatos hangutasítási rendszert, a Google Voice Actionst: képessé tette arra, hogy az emberi beszédet folyamatosan írott szöveggé alakítsa át, és ezzel gyorsabbá és egyszerűbbé vált a szöveges üzenetek diktálása és küldése, a Google hangos keresése vagy útbaigazítások kérése.
    Lezli Goheen, a Microfost szóvivője elmondta, hogy cége a fogyasztók elvárásának megfelelően többféle módon is könnyített az információk megszerzésén. A minden Windows-termékben szereplő Tellme programon kívül, amely lehetővé teszi üzenetek diktálását és alkalmazások hangvezérlését, bevezették a Bing Voice Search programot is a keresések beszéddel történő irányítására.
   
Illúziókeltő, de könnyű a használata

   
    A US Airways törzsutasprogramjának azokat a résztvevőit, akik regisztrálták mobiltelefonjukat, név szerint üdvözli a Wally, a Nuance által a légitársaságnak kifejlesztett interaktív hangrendszer.
    A Wallyt tavaly nyáron vezették be annak az átalakításnak a részeként, amelynek során a US Airway telefonos ügyfélszolgálatát külföldről visszatelepítik az Egyesült Államokba. A rendszer képes például megmondani a törzsutasoknak, hogy milyen helyre szól a jegyük, egyszersmind jelenteni, ha magasabb szintre kerültek a programban. Az emberi beszédet írott szöveggé alakítja át, úgyhogy ha egy ügyfél úgy dönt, hogy élő személlyel kíván tovább tárgyalni, az eredeti kérdést nem kell megismételnie.
    A hangrendszer - amelyhez Wally Wingert, a Jay Leno vezette népszerű televíziós showműsor bemondója kölcsönözte a hangját - nemcsak azoknak a számát csökkentette, akik ragaszkodnak az élő munkatárshoz, hanem az ügyfélhívások átlagos hosszát is. Kerry Hester, a légitársaság alelnöke szerint ha nincs a rendszer, több száz új ügyfélszolgálati munkatársat kellett volna felvenniük.
    A Wally - amely nem árulja el, hogy automatizált rendszer - annyira élőnek tűnik, hogy sok ügyfél "Köszönöm"-mel köszön el tőle, mielőtt lerakja a kagylót.
    Ez az anonimitás azonban nem mindenkinek tetszik. Sherry Turkle, az MIT professzora szerint ahogy a hangfelismerő rendszerek kifinomultabbá válnak, megteremtik annak az illúzióját, hogy nem gépekkel, hanem más emberekkel kommunikálunk. Szerinte hosszú távon a rendszerek illúziókeltő volta és könnyű használata miatt háttérbe szorulnak a lassúbb, rendezetlenebb, valódi emberi kapcsolatokat. Ha emlékeztetik a felhasználókat, hogy egy géppel beszélnek, akkor talán jobban tudatosodik bennük, hogy mennyire felszínes a kapcsolat.
    "Kultúránkat érintő döntést kell hoznunk. El kell határoznunk, megmondjuk-e az embereknek, hogy géppel beszélnek vagy sem" - húzta alá a professzor.

Kulcsszavak: tudomány hangfelismerés

E-világ ROVAT TOVÁBBI HÍREI

Az SAP AI-alapú fejlesztéseivel a gyáripar is átalakul

A termelékenység, a hatékonyság és a precizitás újabb szintje érhető el azokkal az AI-alapú fejlesztésekkel, melyeket az SAP mutatott be az ellátási láncokhoz kapcsolódó megoldásaiban a Hannover Messe kiállításon. A valós idejű adatokból származó, mesterséges intelligencia által felfejtett következtetések abban segítenek a vállalatoknak, hogy jobb döntéseket hozzanak az ellátási láncok egészében, racionalizálják a termékfejlesztést és javítsák a gyártás hatékonyságát.

2024. április 25. 16:31

Az LG OLED evo televíziók már a negyedik egymást követő évben kapják meg a környezetbarát minősítést

Az LG 2024-es OLED evo televíziói megkapták a Carbon Trust*  szén-dioxid-kibocsátás csökkentéséről**  és szén-dioxid méréséről***  szóló tanúsítványait, valamint a Société Générale de Surveillance (SGS) környezetvédelmi védjegyét****, amellyel az LG folyamatos ESG-kezdeményezéseit immár negyedik egymást követő évben ismerték el. Az LG legújabb OLED tévéi továbbá kiérdemelték az Intertek újrahasznosítási tanúsítványát*****, amely immár második éve bizonyítja ezen a téren is az LG környezetvédelmi felelősségvállalását.

2024. április 25. 14:53

Megjelentek az első HMD okostelefonok

A Human Mobile Devices (HMD) bemutatta első saját gyártású okostelefonjait: megérkezett a HMD Pulse Pro, HMD Pulse+ és HMD Pulse. A Pulse kollekció már most lefekteti a HMD designalapjait: merész vonalvezetés, egyedi tónusok, modern és letisztult esztétika, elegáns kialakítás, előkelő formatervezés – és mindez elérhető áron.

2024. április 25. 13:15

A Samsung legújabb képernyői az AI TV-k új korszakát hozzák el

A Samsung az Unbox & Discover eseményen mutatta be 2024-es Neo QLED 8K és 4K, valamint OLED televíziókból és hangprojektorokból álló portfólióját. A világ egyik élvonalbeli televíziógyártójaként elismert Samsung idén bevezetett készülékei olyan hatékony, mesterségesintelligencia (AI)-alapú funkciókkal rendelkeznek, amelyek minőségibb otthoni szórakozást kínálhatnak.

2024. április 25. 11:38

Kiderült, hogy állnak a magyarok a robotokhoz

Idén is kitárta kapuit a HVG Állásbörze, ahol több mint száz munkaadóval személyesen és hibrid formában is találkozhattak azok az álláskeresők, akik ellátogattak április 17-19-e között a Papp László Budapest Sportarénába. Mindenki kedvence, a Bastion Group robotkutyája is jelen volt az eseményen, ahol hatalmas volt az érdeklődés a robotika iránt.

2024. április 25. 09:56

Kövess minket a Facebookon!

Cikkgyűjtő

További fontos híreink

Ingyenes digitális platform segít a tanároknak és diákoknak az érettségire való felkészülésben

2024. április 20. 11:36

Itt a világ első, Swarovski kristályba ágyazott autós kijelzője

2024. április 10. 14:55

A csevegőprogramokat vizsgálta az NMHH

2024. április 2. 13:14

Megvannak az IAB 2023-as Legjobb szakdolgozat pályázatának nyertesei

2024. március 25. 15:50