Virtuális asszisztens: Tájékoztatás
Publio – Az Európai Unió Kiadóhivatala portáljának intelligens asszisztense
Legutóbbi frissítés dátuma: 2026. március 11.
Az oldal tartalma
- A mesterséges intelligenciával (MI) kapcsolatos átláthatóság – általános elvek
- Megbízható, megmagyarázható mesterséges intelligencia
- A mesterséges intelligencia és a felelősség
- A Publióról
- Kifejezések és fogalommeghatározások
- Mi az a Publio?
- Milyen típusú adatokat használ fel a Publio?
- Hogyan működik a Publio?
- Hogyan elemzi a Publio a kérdést és javasol találatokat?
- Felhasználói visszajelzések
- Személyes adatok kezelése
- Jelenlegi hiányosságok
Az Európai Unió Kiadóhivatala portáljának virtuális asszisztense, a Publio a mesterséges intelligencia olyan eszköze, amely interaktív kapcsolatban áll természetes személyekkel, és a Kiadóhivatali portálon nyilvánosan elérhető információk alapján, kulcsszavakkal végez keresést.
E dokumentum tájékoztatást nyújt a felhasználóknak a mesterséges intelligenciára vonatkozó szabályozási keretről és ebben az összefüggésben a Publio működésére vonatkozó elvekről. Az Európai Unió Kiadóhivatala elkötelezett az átláthatóság, valamint a megbízható és megmagyarázható mesterséges intelligencia iránt.
A mesterséges intelligenciával kapcsolatos átláthatóság – általános elvek
Az uniós intézmények tevékenységének átláthatósága és nyitottsága központi jelentőséggel bír a jó kormányzás és a civil társadalom részvétele tekintetében, ahogy azt az Európai Unió működéséről szóló szerződés (EUMSZ) 15. cikke rögzíti. E cikk az alábbiakról rendelkezik:
„1. A jó kormányzás előmozdítása és a civil társadalom részvételének biztosítása céljából az Unió intézményei, szervei és hivatalai munkájuk során a nyitottság elvének lehető legnagyobb mértékű tiszteletben tartásával járnak el.”
Az Európai Unió Alapjogi Chartájának 41. cikke (a megfelelő ügyintézéshez való jog) kimondja, hogy a közigazgatási szervek kötelesek megindokolni döntéseiket.
Az Európai Bizottság által létrehozott, mesterséges intelligenciával foglalkozó magas szintű szakértői csoport által 2019-ben készített, „A megbízható mesterséges intelligenciára vonatkozó etikai iránymutatások” című dokumentum (1. függelék) az átláthatóságot azon hét követelmény egyikeként sorolja fel (2. függelék), amelyeknek az MI-rendszereknek meg kell felelniük. Ezen iránymutatások rögzítik továbbá, hogy az átláthatóság a megmagyarázhatóság elvének egyik eleme, amely megköveteli az érintett adatkészletek és technikai folyamatok átláthatóságát, valamint az MI-rendszerek képességeire és céljaira vonatkozó nyílt tájékoztatást. Ezért az adatkészleteknek és a technikai folyamatoknak dokumentálhatónak, nyomon követhetőnek, megmagyarázhatónak és értelmezhetőnek kell lenniük.
A fent felsorolt elveket a mesterséges intelligencián alapuló megoldások és eszközök uniós intézmények, hivatalok, szervek és ügynökségek általi fejlesztésére, bevezetésére és használatára kell alkalmazni.
Ezen általános elvek alapján amikor a felhasználók interaktív kapcsolatba kerülnek MI-rendszerekkel, erről a kapcsolatról előzetesen tájékoztatni kell őket. Ez lehetővé teszi a felhasználók számára, hogy megalapozott döntést hozzanak az interaktív kapcsolat folytatásáról, vagy az eszköz használatának mellőzéséről.
Az átláthatóságra vonatkozó szabályokkal összhangban a felhasználók számára biztosítani kell továbbá a szükséges információkat, hogy segítséget kapjanak a rendszer eredményeinek értelmezésében és azok megfelelő felhasználásában.
Megbízható, megmagyarázható mesterséges intelligencia
A megbízható és megmagyarázható mesterséges intelligencia az EU egyik kulcsfontosságú célkitűzése. E célkitűzés elősegítésére az EU létrehozott egy szabályozási keretet a mesterséges intelligenciára vonatkozóan. A 2024. június 13-i (EU) 2024/1689 rendelet (a mesterséges intelligenciáról szóló rendelet) (3. függelék) két fő kötelezettségvállalást vezet be a mesterséges intelligencián alapuló megoldások és eszközök szolgáltatói részére: az átláthatóságot és az információszolgáltatást.
Az MI-rendszerek felhasználóinak joguk van információkhoz jutni. Ez a jog együtt jár a megfelelő kötelezettségekkel, például azzal a kötelezettséggel, hogy a rendszert az utasításoknak megfelelően kell használni és ellenőrizni kell az érintett MI-eszköz teljesítményét. E szabályok betartása valamennyi érintett szereplő elszámoltathatóságát eredményezi.
A mesterséges intelligenciáról szóló rendelet 50. cikke (Bizonyos MI-rendszerek szolgáltatóira és alkalmazóira vonatkozó átláthatósági kötelezettségek) rögzíti, hogy: „1. A szolgáltatóknak biztosítaniuk kell, hogy a természetes személyekkel való interakcióra szánt MI-rendszereket úgy tervezzék meg és fejlesszék ki, hogy az érintett természetes személyek tájékoztatást kapjanak arról, hogy egy MI-rendszerrel állnak interakcióban, kivéve, ha ez a körülményekre és a felhasználási kontextusra figyelemmel, egy észszerűen jól tájékozott, figyelmes és körültekintő természetes személy szempontjából nyilvánvaló tény. ”
A mesterséges intelligenciáról szóló rendelet kockázatalapú megközelítést követ, és különbséget tesz a nagy kockázatú és az egyéb MI-rendszerek között.
A Publio, a Kiadóhivatal portáljának virtuális asszisztense interaktív kapcsolatban áll természetes személyekkel, és a Kiadóhivatal portálján nyilvánosan elérhető információk alapján, kulcsszavakkal végez keresést. Ezek az információk a valamennyi uniós szakpolitika és jogszabály alapjául szolgáló átláthatóság elve alapján kerülnek közzétételre. A virtuális asszisztens nem hoz létre új tartalmakat és nem manipulálja, illetve nem befolyásolja a felhasználók döntéseit azon túl, hogy lehetséges szűrési lehetőségeket javasol a felhasználói keresésekhez. A mesterséges intelligenciáról szóló rendelet alapján tehát a Publio nem tekinthető nagy kockázatú rendszernek.
A mesterséges intelligenciáról szóló rendelet rögzíti, hogy az MI-rendszerek tervezése és működése során figyelembe kell venni azokat a konkrét veszélyeket, amelyek abból fakadhatnak, hogy a rendszerek 1) szubliminális technikákkal, azaz a felhasználók tudatán kívüli technikákkal manipulálhatják az embereket, illetve 2) kihasználhatják a kiszolgáltatott csoportokat, ami pszichológiai vagy testi sérelmet okozhat számukra. Szigorúbb átláthatósági kötelezettségek vonatkoznak azokra a rendszerekre, amelyek i. emberekkel állnak interaktív kapcsolatban, ii. biometrikus adatok alapján az érzelmek felismerésére vagy a (társadalmi) kategóriákkal való összefüggések meghatározására kerülnek felhasználásra, vagy iii. tartalmakat generálnak vagy manipulálnak („mélykamuk”). Bár a Publio interaktív kapcsolatban áll természetes személyekkel, a virtuális asszisztenst nem arra tervezték, hogy manipuláció céljából felismerje az érzelmeket, és az eszköz nem tartalmaz olyan elemeket sem, amelyek véletlenül ilyen eredményhez vezethetnek. Ezért a Publio nem esik bele a fent említett kategóriákba.
A Publióról
Kifejezések és fogalommeghatározások
| Kifejezés | Fogalommeghatározás |
|---|---|
| Egységes besorolási jegyzékek | A különböző környezetben (webplatformok, rendszerek és alkalmazások) használt kódok és kapcsolódó címkék harmonizálására és szabványosítására, valamint az uniós intézmények közötti adatcsere megkönnyítésére – például a döntéshozatali folyamatok keretében – az egységes besorolási jegyzékek (más néven Named Authority Lists vagy NAL) szolgálnak. Ilyen egységes besorolási jegyzékek például a nyelvek, országok, szervezeti egységek kodifikált jegyzékei stb. |
| Csevegőrobot | A csevegőrobot olyan mesterségesintelligencia-rendszer, amelyet arra terveztek, hogy szimulálja az emberi beszélgetést, és szöveg vagy beszéd útján kommunikáljon a felhasználókkal. Természetes nyelvfeldolgozási (NLP) módszereket alkalmaz a felhasználói bevitel megértésére és az azokra való reagálásra, automatizált segítségnyújtásra, tájékoztatásra, illetve előre meghatározott szabályok, illetve algoritmusok alapján meghatározott feladatok elvégzésére. A csevegőrobotokat gyakran használják különböző alkalmazásokban, például ügyféltámogatáshoz, virtuális asszisztensekhez és online üzenetküldő platformokon, hogy megkönnyítsék a kommunikációt és azonnali választ adjanak a felhasználói érdeklődésre. |
| Beszélgetésen alapuló (társalgási) mesterséges intelligencia | A beszélgetésen alapuló MI a mesterséges intelligencia olyan formája, amely megkönnyíti az ember és a számítógép közötti valós idejű, emberi kommunikációhoz hasonló beszélgetést. |
| Beszélgetésfolyam | A „beszélgetésfolyam” kifejezés a csevegőrobot és a felhasználó közötti beszélgetés (felhasználói út) zökkenőmentes és logikus előrehaladását jelenti. A kifejezés arra utal, ahogyan a csevegőrobot értelmezi a felhasználó szándékát, megfelelő válaszokat ad és a beszélgetést a felhasználó kinyilvánított céljainak, illetve szándékának eléréséhez, illetve végrehajtásához vezeti. |
| Adategyed | Ebben az összefüggésben az „adategyed” kifejezés olyan információra utal, amely kinyerhető a felhasználó által bevitt, a felhasználó célja szempontjából releváns információból, azaz lehetővé teszi annak megértését, hogy mi a felhasználó célja. Ezeket az információkat azonosítják és tárolják, hogy pontosan kinyerjék a felhasználó által keresett információkat. Az adategyedre példa lehet egy adott cikk szerzője. |
| EU Vocabularies vagy EuroVoc | Az EuroVoc (EU Vocabularies) a Kiadóhivatal által kezelt, az EU tevékenységeit lefedő többnyelvű, multidiszciplináris egységes besorolási jegyzékek egyedi állománya. Az EU 24 hivatalos nyelvén, valamint az EU tagjelölt országainak három nyelvén tartalmaz kifejezéseket: albán, macedón és szerb. |
| Szándék | Ebben az összefüggésben a „szándék” kifejezés arra a célra utal, amelyre a felhasználó gondol, amikor egy kérdést vagy megjegyzést ír le, illetve mond be (érdeklődés). A szándék olyan elképzelést, illetve koncepciót jelent, amelyet a felhasználó által küldött üzenet (kijelentés) tartalmazhat. Szándék például az, ha egy felhasználó egy adott témára, egy adott kiadványra vagy személyre kíván keresni. |
| Nyelvi modell | A nyelvi modell a mesterséges intelligencia olyan típusú programja, amelynek célja a természetes nyelv elemzése és megértése. A modell statisztikai és valószínűségszámítási módszereket használ, hogy előre jelezze egy adott mondatban vagy szövegsorban a valószínűleg következő szavakat, illetve mondatokat. Más szóval a nyelvi modell olyan eszköz, amely a bevitel szövegkörnyezetén és tartalmán alapuló teljes mondatok generálására, illetve kiegészítésére használható. |
| Language Understanding (beszélgetésalapú nyelvértés) (CLU) | Felhőalapú társalgási MI-szolgáltatás, amely fejlett természetes nyelvértést használ a felhasználók szándékainak azonosítására, az általános jelentés elővetítésére és strukturált információk párbeszédes szövegből történő kinyerésére. |
| Nagy nyelvi modell (LLM) | A nagy nyelvi modell (LLM) a mesterséges intelligencia egy fejlett típusa, amelyet nagy nyelvi korpuszon tanítanak be, hogy megértse az emberi nyelvet és maga is generáljon szöveget. Az LLM-ek mélytanulási technikák segítségével elemzik a kontextust, értelmezik a különféle jelentésárnyalatokat és azonosítják be a nyelvi mintákat. Ennek segítségével összetett kifejezéseket dolgoznak fel, és koherens, kontextuálisan megfelelő válaszokat adnak. |
| Gépi tanulás (ML) | A gépi tanulás (ML) a mesterséges intelligencia egyik típusa, amely lehetővé teszi a szoftveralkalmazások számára, hogy „tanuljanak” a múltbeli gyakorlatból és visszajelzésekből, és ezáltal pontosabbak legyenek az eredmények előrejelzésében anélkül, hogy erre konkrétan programoznák őket. |
| Természetes nyelvi feldolgozás (NLP) | A természetes nyelvi feldolgozás (NLP) a mesterséges intelligencia egyik területe, amely lehetővé teszi, hogy a számítógépek elemezzék és megértsék az írott és a beszélt emberi nyelvet. |
| Keresési út | A „keresési út” kifejezés azon interaktív kapcsolatok sorozatára utal, amelyen a felhasználó konkrét információk keresésekor végighalad. Folyamat, amelynek során a felhasználó kérdések és válaszok sorozatán keresztül pontosítja keresési szándékát, és találja meg a keresett információt. A csevegőrobottal végzett keresés magában foglalja a felhasználó kérdésének megértését, a releváns információk adatbázisból vagy tudásbázisból való lekérését, valamint az információknak a felhasználó számára könnyen érthető és a felhasználó igényei szempontjából releváns módon történő bemutatását. |
| Felhasználói út | Egy adott személynek egy weboldal vagy alkalmazás használata során szerzett tapasztalata, amely az adott weboldalon vagy alkalmazásban egy adott cél elérése érdekében végrehajtott cselekvéssorozatból áll. |
| Kijelentés | Felhasználó általi bevitel, amely lehet beszélgetés során gépelt vagy mondott bármely üzenet. Egy kijelentés állhat egyetlen szóból vagy több szóból, például egy kérdésből vagy egy mondatból. |
Mi az a Publio?
A Publio, a Kiadóhivatal portáljának virtuális asszisztense olyan MI-eszköz, amely természetes személyekkel áll interaktív kapcsolatban, és a Kiadóhivatali portálon nyilvánosan elérhető információk alapján, kulcsszavakkal végez keresést. A Publio interaktív hangfelismerő és hagyományos keresőrendszerekkel ötvözi a mesterséges intelligencia beszélgetésen alapuló módszereit, például a természetes nyelvi feldolgozást és a gépi tanulást annak érdekében, hogy segítse a felhasználókat, hogy megtalálják az uniós kiadványokat, az uniós jogszabályokat és az európai intézmények kapcsolattartóit.
A virtuális asszisztens konkrétan lehetővé teszi a végfelhasználók és a Kiadóhivatali portál közötti beszélgetést szóban, illetve írásban. A virtuális asszisztens jelenleg angol, francia és spanyol nyelven áll rendelkezésre. Bár a virtuális asszisztens mindenki által használható, az olvasási nehézségekkel küzdők számára külön megoldást is kínál, ezáltal növelve az akadálymentességet. Lehetővé teszi továbbá a keresés új módjának számító, beszélgetésen alapuló keresést, amellyel a felhasználók a szokásos beszélgetéshez hasonlóan teljes mondatokat mondanak egy mesterséges intelligencián alapuló hangasszisztensnek, amely visszaküldi a válaszokat, így a felhasználó és a virtuális asszisztens közötti információcsere beszélgetés formájában valósul meg.
Milyen típusú adatokat használ fel a Publio?
A Publio a Kiadóhivatal portálján nyilvánosan elérhető információkat használja fel. Ezen információk az összes uniós szakpolitikára és jogszabályra alkalmazandó átláthatóság elve alapján kerülnek közzétételre. E korpusz alapján a Publio a Kiadóhivatal portálján elérhető osztályozásokat és kategóriákat – például EuroVoc tantárgyakat, szerzőket, illetve formátumot – használ a beszélgetés irányítására és finomítására annak érdekében, hogy segítse a felhasználót a Kiadóhivatali portál három fő gyűjteményében való keresésben: uniós kiadványok, uniós jogszabályok és az EU hivatalos név- és címjegyzéke (EU Whoiswho).
A Publio egy meglévő nyelvi modellt használ a felhasználók által feltett kérdések megértésére és arra, hogy a felhasználókat végig eligazítsa a keresési útjuk során. A felhasználók visszajelzései alapján a Publio nyelvi modellt folyamatosan javítják és tanítják, hogy megfeleljen a felhasználói elvárásoknak és képes legyen kezelni a felhasználói bevitel sokféleségét a három támogatott nyelven.
E tanítás a Publio mögöttes rendszerének több alkotóelemére terjed ki:
- A szándék különböző lehetséges formáihoz kapcsolódó kijelentések előre meghatározott sorozata, amely lehetővé teszi a Publio számára, hogy először is megértse a felhasználó végcélját, másodszor pedig lépésről lépésre eligazítsa a felhasználót e cél elérése felé.
- Előre meghatározott kérdések sorozata, amelyeket a Publio „megért” és amelyekre előre meghatározott választ adhat a felhasználóknak. Példa: Hogyan rendelhetek kiadványokat?
- Gépi tanulási adategyedek, amelyeket a Publio azonosítani tud és háttérfolyamataiban fel tud használni arra, hogy észlelje a keresési paramétereket, pontosabb találatokat adjon vagy szűkítse a keresést. Ezek az adategyedek az adatok meglévő osztályozásán és adatkategóriáin alapulnak, mint például az EuroVoc-tezauruszok vagy az EuroVoc által kezelt egyéb egységes besorolási jegyzékek: szerzők, formátumok, nyelvek, uniós szervek (szervezetek), funkcionális szerepkörök az uniós közszolgáltatásban stb. Ennek alapján a Publio például a felhasználó érdeklődésére támaszkodva felismeri, hogy a felhasználó milyen kiadványt (téma, szerző) keres.
Hogyan működik a Publio?
A Publio a beszélgetésalapú nyelvértési (CLU) szolgáltatást használja (4. függelék), amelyet egy adategyed-kinyerő rendszeren alapuló nagy nyelvi modellel ötvöz, hogy pontosan és hatékonyan dolgozza fel a felhasználói inputot (írásbeli vagy szóbeli közlést).
A CLU először is felméri a felhasználó szándékát és a rendelkezésre bocsátott adategyedeket. Az összetettebb lekérdezések esetében az LLM-összetevő finomhangolja az információk felismerését, ami az árnyalt kifejezések vagy összetett kérések esetében jobb találatokat nyújt. A felismert szándék és adategyedek alapján a Publio személyre szabott beszélgetésfolyamot kezdeményez, hogy a felhasználók néhány egyszerű lépésben választ kapjanak kérdésükre.
A Publio jelenleg 4 fő beszélgetésfolyamot hajt végre:
- Dokumentumkeresés, amellyel a felhasználók uniós kiadványokra vagy uniós jogi dokumentumokra kereshetnek rá.
- Személykeresés, amellyel a felhasználók az uniós intézményeknél dolgozó köztisztviselőkre kereshetnek rá.
- Intézménykeresés, amellyel a felhasználók az uniós szervekre (szervezetekre) kereshetnek rá.
- Kérdések és válaszok, amelyekkel a felhasználók előre meghatározott válaszokat kapnak a gyakori kérdésekre.
A „keresési” folyam felismerése esetén a virtuális asszisztens eligazítja a felhasználót a releváns dokumentumok, személyek vagy szervezetek keresése során azáltal, hogy egyszerű kérdéseket tesz fel a felhasználónak és a felhasználó válasza alapján szűrési lehetőségeket javasol.
A kérdések és válaszok folyamához a Kiadóhivatal listát vezet a gyakran feltett kérdések és az azokhoz rendelt válaszokról. Amennyiben a Publio felismeri a „Kérdések és válaszok” tartalomra irányuló szándékot, és nagy mértékű hasonlóság áll fenn a felhasználó által feltett konkrét kérdés és a rendszerben tárolt valamely kérdés között, a megfelelő választ közvetlenül visszaküldi a felhasználónak. Például:
– ha a Publio a „Kérdések és válaszok” tartalmat a „Le szeretnék tölteni egy fájlt” mondathoz hasonló lekérdezéssel ismeri fel, akkor a következő választ adja: „Dokumentum letöltéséhez kérjük, ugorjon a kiadványok részletes információit ismertető oldalra, majd kattintson a »Letöltés és nyelvek« gombra.”
– ha a Publio a „Kérdések és válaszok” tartalmat a „Hol találhatok gyerekeknek szóló dokumentumokat?” mondathoz hasonló lekérdezéssel ismeri fel, akkor a következő választ adja: „A gyerekeknek szóló kiadványok a Gyereksarok oldalon találhatók.”
A felhasználók írásban vagy szóban tehetnek fel kérdéseket. A csevegőrobot rögzíti a hangbevitelt (a felhasználó szóbeli kérdéseit) és elküldi azt egy beszédfelismerő motornak, amely a beszédet szövegre alakítja át. A hangbevitelt a Microsoft Azure beszédfelismerő szolgáltatása dolgozza fel (5. függelék). A Publio ezután a beszédfelismerő motorral értelmezi és megjeleníti a kapott hangüzenetet, majd írásban és szóban (szintetizált hangon) válaszol rá. Ez az információcsere azonnali (azonnal megtörténik) és ideiglenes (nem hagy semmilyen nyomot).
Hogyan elemzi a Publio a kérdést és javasol találatokat?
A Publio nem használ LLM-et vagy más generatív MI-technológiát arra, hogy választ generáljon a felhasználóknak. Minden Publio-üzenet egy előre elkészített sablonon alapul. A Publio olyan gépi tanulást alkalmazó nyelvi modellt használ, amelyet arra tanítanak (betanított nyelvi modell), hogy felismerje a felhasználói bevitelt és arra reagáljon. E modell feladata a felhasználó üzenetének vagy kérdésének feldolgozása, az üzenet szándékának felismerése és a megfelelő válasz nyújtása. A Publio tanítási folyamata magában foglalja a gépi tanulási modell nagy mennyiségű, címkézett tanítási adattal való ellátását, amely példákat tartalmaz a felhasználói bevitelre és az ahhoz kapcsolódó szándékra, valamint a valószerű válaszokra.
A Publio a természetes nyelvi feldolgozást, a betanított nyelvi modellt és az LLM-et a felhasználói szándék megértésére és arra használja, hogy a felhasználó kérdéséből kinyerje a felismert adategyedeket (keresőkifejezés, tárgy, szerző, dokumentum dátuma, dokumentumformátum stb.). A Publio ezeket az adategyedeket használja a keresés elvégzéséhez és a találatok megjelenítéséhez.
Ha a keresés eredménye túlságosan általános, a Publio folytatja a beszélgetést azáltal, hogy további kérdéseket tesz fel a felhasználónak, majd leszűkíti a keresési találatot más adategyedekre való szűréssel.
A Publio által megfogalmazott kérdések a felhasználó szándékának felismerésére, a céljának meghatározására és a Kiadóhivatal portálján közzétett tartalom szövegére vonatkozó megfelelő keresési lekérdezés megfogalmazására korlátozódnak. A Publio által javasolt találatok teljes egészében ebből a korpuszból származnak.
Felhasználói visszajelzések
A végfelhasználó a beszélgetés során bármikor pozitív, semleges vagy negatív visszajelzést adhat a Publio használatával kapcsolatos tapasztalatairól. Ez lehet a felhasználó által bármikor adott manuális visszajelzés, vagy a néhány másodpercnyi inaktivitás után megjelenő, a felhasználótól visszajelzést kérő, automatikus felugró ablakra adott válasz. Ezenfelül a Publio által pontatlanul „értelmezett” kérdéseket a Kiadóhivatal munkatársai automatikusan naplózzák és időszakosan feldolgozzák. Mind a felhasználói visszajelzések, mind a Publio által pontatlanul „értelmezett” kérdések elemzése a nyelvi modell újra történő betanítására szolgál azzal a céllal, hogy folyamatosan javuljanak a végfelhasználóknak nyújtott szolgáltatások.
Személyes adatok kezelése
A Kiadóhivatal portálján elérhető adatok kezelése az EU általános adatvédelmi rendeletével (GDPR) és a személyes adatok uniós intézmények, ügynökségek és szervek által történő feldolgozásáról szóló rendelettel összhangban történik (6. függelék).
A Publio nem tárol, őriz meg, illetve nem archivál semmilyen elemet, sem a felhasználó által bevitt, sem pedig a Publio válaszaiban megadott adatokat.
Az összegyűjtött visszajelzések anonimizálása nem teszi lehetővé a visszajelzés összekapcsolását azon felhasználóval, akitől az származik.
A személyes adatok semmilyen módon nem kerülnek felhasználásra automatizált döntéshozatalhoz, nyomon követéshez vagy profilalkotáshoz. Amikor az információk kinyerésére nagy nyelvi modelleket (LLM) használ, a Publio csak a felhasználó kérdését és a CLU által generált előzetes adatkinyerés eredményét közli az LLM-mel. Személyes felhasználói adatokat nem oszt meg és nem továbbít.
A Publio által használt valamennyi szolgáltatást az európai adatközpontok tárolják, és minden adatkezelés megfelel az uniós adatvédelmi szabályoknak.
Jelenlegi hiányosságok
- Nevek leírása hang alapján: bár a legtöbb név „felismerése” sikeres és azok helyesen kerülnek leírásra, a nevek kinyerése gépi tanuláson alapul és nem 100%-ban pontos. A CLU korlátai miatt egyes nevek kinyerése még a modellnek az adatkészletből származó konkrét példákkal való betanítását követően sem történik megfelelően.
- Dátumok francia és spanyol nyelven: összetettebb szövegkörnyezetben a dátumok „értelmezése” spanyol és francia nyelven kevésbé pontos. Például spanyolul az év az „entre 2016 y 2017” használatával felismerhető további szövegkörnyezet nélkül, míg az „entre el año 2019 y 2020” használatával nem ismerhető fel.
- A beszédfelismerés egyszerre csak egy nyelven működik.
- A beszédfelismerésnek nincs helyesíráson alapuló működési módja, ami azt jelenti, hogy nem rendelkezik olyan funkcióval, amely lehetővé tenné a felhasználók számára, hogy a pontos leirat biztosítása érdekében betűzzék a szavakat.
- A név mint adategyed felismerése a „Mrs / Miss” kifejezésekkel kombinálva nem működik jól a hosszabb mondatokban.
Az Európai Unió Kiadóhivatala, 2023. május 16.
1. Elérhető a következő internetcímen: https://digital-strategy.ec.europa.eu/en/library/ethics-guidelines-trustworthy-ai
2. A megbízható mesterséges intelligenciának a következő hét követelménynek kell megfelelnie: 1) emberi cselekvőképesség és felügyelet; 2) műszaki stabilitás és biztonság; 3) adatvédelem és jó adatkormányzás; 4) átláthatóság; 5) sokszínűség, megkülönböztetésmentesség és méltányosság; 6) társadalmi és környezeti jólét; 7) elszámoltathatóság.
Az Európai Parlament és a Tanács rendelete a mesterséges intelligenciára vonatkozó harmonizált szabályok megállapításáról, valamint egyes uniós jogalkotási aktusok módosításáról (a mesterséges intelligenciáról szóló rendelet). Az elfogadott és aláírt jogszabály itt található.
4. https://language.cognitive.azure.com/clu/projects//
5. https://query.prod.cms.rt.microsoft.com/cms/api/am/binary/RE5cCGB
6. Az (EU) 2016/679 rendelet (HL L 119., 2016.5.4., 1–88. o.) és az (EU) 2018/1725 rendelet (HL L 295., 2018.11.21., 39–98. o.).