Virtuálny asistent: Oznámenie o vysvetliteľnosti
Publio – inteligentný asistent na portáli Úradu pre vydávanie publikácií Európskej únie (portál OP)
Posledná aktualizácia: 11. 3. 2026
Obsah stránky
- Transparentnosť s ohľadom na umelú inteligenciu (AI) – všeobecné zásady
- Dôveryhodná a vysvetliteľná umelá inteligencia
- Umelá inteligencia a zodpovednosť
- O asistentovi Publio
- Pojmy a ich vymedzenia
- Čo je asistent Publio?
- Aký typ údajov používa asistent Publio?
- Ako funguje asistent Publio?
- Ako asistent Publio analyzuje otázku a navrhuje výsledky?
- Spätná väzba od používateľov
- Spracúvanie osobných údajov
- Aktuálne obmedzenia
Asistent Publio je virtuálny asistent na portáli Úradu pre vydávanie publikácií Európskej únie (portál OP), pričom ide o nástroj umelej inteligencie, ktorý komunikuje s fyzickými osobami a vyhľadáva pomocou kľúčových slov na základe informácií, ktoré sú verejne dostupné na portáli OP.
V tomto oznámení o vysvetliteľnosti sa uvádzajú informácie určené používateľom týkajúce sa regulačného rámca pre umelú inteligenciu a zásad, ktorými sa v tomto kontexte riadi fungovanie asistenta Publio. Úrad pre vydávanie publikácií Európskej únie sa zaviazal k transparentnosti a dôveryhodnej a vysvetliteľnej umelej inteligencii.
Transparentnosť s ohľadom na umelú inteligenciu (AI) – všeobecné zásady
Transparentnosť a otvorenosť v rámci činností inštitúcií Únie je základom dobrej správy vecí verejných a účasti občianskej spoločnosti, ako sa uvádza v článku 15 Zmluvy o fungovaní Európskej únie (ZFEÚ), v ktorom sa stanovuje, že:
„1. S cieľom podporovať dobrú správu vecí verejných a zabezpečiť účasť občianskej spoločnosti dodržiavajú inštitúcie, orgány, úrady a agentúry Únie v čo najväčšej možnej miere zásadu otvorenosti.“
V Charte základných práv EÚ sa v článku 41 (Právo na dobrú správu vecí verejných) stanovuje povinnosť administratívy odôvodniť svoje rozhodnutia.
V dokumente Etické usmernenia pre dôveryhodnú umelú inteligenciu (dodatok 1), čo je séria usmernení, ktoré v roku 2019 vypracovala expertná skupina na vysokej úrovni pre umelú inteligenciu zriadená Európskou komisiou, sa transparentnosť uvádza ako jedna zo siedmich požiadaviek (dodatok 2), ktoré by systémy umelej inteligencie mali spĺňať. V týchto usmerneniach sa ďalej stanovuje, že transparentnosť je súčasťou zásady vysvetliteľnosti, na základe ktorej sa vyžaduje, aby súbory údajov a príslušné technické procesy boli transparentné a aby sa otvorene informovalo o schopnostiach a účele systémov umelej inteligencie. Súbory údajov a technické procesy musia byť preto zdokumentované, sledovateľné, vysvetliteľné a interpretovateľné.
Uvedené zásady sa majú uplatňovať pri vývoji, zavádzaní a používaní riešení a nástrojov založených na umelej inteligencii inštitúciami, úradmi, orgánmi a agentúrami EÚ.
Na základe týchto všeobecných zásad musia byť ľudia vopred informovaní, že komunikujú s umelou inteligenciou. To umožňuje používateľom urobiť informované rozhodnutie, či pokračovať v komunikácii, alebo prestať s používaním nástroja.
V súlade s pravidlami v oblasti transparentnosti musia byť používateľom poskytnuté aj potrebné informácie, ktoré im pomôžu porozumieť výstupu systému a primerane ho použiť.
Dôveryhodná a vysvetliteľná umelá inteligencia
Dôveryhodná a vysvetliteľná umelá inteligencia je kľúčovým cieľom EÚ. Na tento účel EÚ stanovila regulačný rámec pre umelú inteligenciu. V nariadení (EÚ) 2024/1689 z 13. júna 2024 (ďalej len „akt o umelej inteligencii“) (dodatok 3) sa zavádzajú dva hlavné typy záväzkov na strane poskytovateľov riešení a nástrojov založených na umelej inteligencii, ktorými sú transparentnosť a poskytovanie informácií.
Používatelia systémov umelej inteligencie majú právo na informácie. Toto právo je spojené s príslušnými povinnosťami, ako je povinnosť používať systém v súlade s pokynmi a monitorovať výkon príslušného nástroja umelej inteligencie. Dodržiavanie týchto pravidiel vedie k zodpovednosti všetkých zúčastnených aktérov.
V akte o umelej inteligencii sa v článku 50 (Povinnosti v oblasti transparentnosti pre určité systémy AI) stanovuje: „1. Poskytovatelia zabezpečia, aby systémy AI určené na priamu interakciu s fyzickými osobami boli dizajnované a vyvinuté tak, aby boli dotknuté fyzické osoby informované o tom, že interagujú so systémom AI, pokiaľ to nie je zrejmé z hľadiska fyzickej osoby, ktorá je primerane informovaná, pozorná a obozretná, pričom sa prihliada na okolnosti a kontext používania. “
V akte o umelej inteligencii sa uplatňuje prístup založený na riziku a rozlišuje sa medzi vysokorizikovými a inými systémami umelej inteligencie.
Asistent Publio je virtuálny asistent na portáli OP, ktorý komunikuje s fyzickými osobami a vykonáva vyhľadávania pomocou kľúčových slov na základe informácií, ktoré sú verejne dostupné na portáli OP. Tieto informácie sa zverejňujú na základe zásady transparentnosti, ktorá je základom všetkých politík a právnych predpisov EÚ. Virtuálny asistent nevytvára nový obsah a nemanipuluje ani neovplyvňuje voľby používateľov. Ponúka len možnosti filtrovania, ktoré môžu používatelia pri svojich vyhľadávania použiť. Asistenta Publio preto nemožno považovať za vysokorizikový systém v zmysle vymedzenia v akte o umelej inteligencii.
V akte o umelej inteligencii sa stanovuje, že pri navrhovaní a fungovaní systémov umelej inteligencie je potrebné brať do úvahy konkrétne riziká, ktoré môžu predstavovať, a to pokiaľ ide o 1. manipuláciu prostredníctvom podprahových techník, t. j. techník mimo vedomia používateľov, alebo o 2. zneužívanie zraniteľných skupín, ktoré môže spôsobiť psychickú alebo fyzickú ujmu. Prísnejšie povinnosti transparentnosti sa vzťahujú na systémy, ktoré i) komunikujú s ľuďmi, ii) sa používajú na zisťovanie emócií alebo určovanie asociácie so (sociálnymi) kategóriami na základe biometrických údajov alebo iii) vytvárajú obsah alebo s ním manipulujú (tzv. deepfakes). Aj keď asistent Publio komunikuje s fyzickými osobami, tento virtuálny asistent nie je navrhnutý tak, aby zisťoval emócie s cieľom manipulovať, ani neobsahuje žiadne prvky, ktoré by mohli neúmyselne viesť k takémuto výsledku. Asistent Publio preto nespĺňa uvedené kritériá.
O asistentovi Publio
Pojmy a ich vymedzenia
| Pojem | Vymedzenie pojmu |
|---|---|
| Tabuľky autorít | Tabuľky autorít (známe aj ako zoznamy názvových autorít alebo NAL) sa používajú na harmonizáciu a štandardizáciu kódov a súvisiacich označení používaných v rôznych prostrediach (webové platformy, systémy a aplikácie) a na uľahčenie výmeny údajov medzi inštitúciami EÚ napríklad v kontexte rozhodovacích procesov. Príkladmi takýchto tabuliek autorít sú kodifikované zoznamy jazykov, krajín, právnických osôb atď. |
| Chatbot | Chatbot je systém umelej inteligencie navrhnutý tak, aby simuloval ľudskú konverzáciu a komunikoval s používateľmi prostredníctvom textu alebo reči. Využíva techniky na spracovanie prirodzeného jazyka s cieľom pochopiť vstupy používateľov a reagovať na ne, pričom poskytuje automatizovanú pomoc, informácie alebo vykonáva špecifické úlohy na základe vopred stanovených pravidiel alebo algoritmov. Chatboty sa bežne používajú na rôzne účely, ako je zákaznícka podpora, virtuálni asistenti či online platformy na odosielanie správ, aby uľahčili komunikáciu a poskytli okamžité odpovede na otázky používateľov. |
| Konverzačná umelá inteligencia | Konverzačná umelá inteligencia je forma umelej inteligencie, ktorá umožňuje konverzáciu medzi človekom a počítačom v reálnom čase, ktorá je podobná ľudskej konverzácii. |
| Tok konverzácie | Pojem „tok konverzácie“ sa vzťahuje na hladký a logický priebeh konverzácie (cesty používateľa) medzi chatbotom a používateľom. Vzťahuje sa na spôsob, akým chatbot pochopí zámer používateľa, poskytne vhodné odpovede a vedie konverzáciu s cieľom dosiahnuť ciele alebo účel stanovené používateľom. |
| Entita | Pojem „entita“ používaný v tomto kontexte znamená informáciu, ktorú možno získať zo vstupu používateľa relevantného z hľadiska účelu stanoveného používateľom, t. j. umožňuje pochopiť účel stanovený používateľom. Tieto informácie sa identifikujú a uložia s cieľom získať presne tú informáciu, ktorú používateľ hľadá. Príkladom entity môže byť autor konkrétneho článku. |
| Slovníky EÚ alebo EuroVoc | Eurovoc (Slovníky EÚ) je špecifický súbor viacjazyčných, multidisciplinárnych tabuliek autorít spravovaných Úradom pre publikácie, ktoré sa týkajú činností EÚ. Obsahuje výrazy v 24 úradných jazykoch EÚ a v troch jazykoch kandidátskych krajín na pristúpenie k EÚ: v albánčine, macedónčine a srbčine. |
| Zámer | V tomto kontexte sa pojem „zámer“ vzťahuje na cieľ, ktorý má používateľ na mysli, keď zadáva alebo nahlas vyslovuje otázku alebo poznámku (dopyt). Zámer predstavuje myšlienku alebo koncepciu, ktoré môžu byť obsiahnutý v správe (vo výroku) od používateľa. Príkladom zámeru je skutočnosť, že používateľ chce vyhľadať konkrétnu tému, publikáciu alebo osobu. |
| Jazykový model | Jazykový model je typ programu umelej inteligencie, ktorý je navrhnutý s cieľom analyzovať a chápať prirodzený jazyk. Používa štatistické a pravdepodobnostné techniky, aby predpovedal, ktoré slová alebo frázy budú pravdepodobne nasledovať v danej vete alebo v rámci postupnosti textu. Inými slovami, jazykový model je nástroj, ktorý možno použiť na vytváranie alebo dokončenie viet na základe kontextu a obsahu vstupu. |
| Porozumenie jazyku (CLU) | Cloudová konverzačná služba umelej inteligencie, ktorá využíva pokročilé porozumenie prirodzenému jazyku na identifikáciu zámerov používateľov, predpovedanie celkového významu a získavanie štruktúrovaných informácií z konverzačného textu. |
| Veľký jazykový model (LLM) | Veľký jazykový model (LLM – z angl.: large language model) je pokročilý druh umelej inteligencie, ktorá sa trénuje na základe rozsiahlych textových údajov, aby porozumela ľudskému jazyku a vedela ho generovať. Veľké jazykové modely používajú techniky hĺbkového učenia na analýzu kontextu, zachytávanie diferencovaných významov a identifikáciu vzorcov v jazyku, čo im umožňuje spracovať zložité vety a poskytnúť koherentné a kontextovo vhodné reakcie. |
| Strojové učenie | Strojové učenie je typ umelej inteligencie, ktorý umožňuje softvérovým aplikáciám „učiť sa“ z minulej praxe a spätnej väzby, a tak sa stať presnejšími pri predpovedaní výsledkov bez toho, aby na to boli výslovne naprogramované. |
| Spracovanie prirodzeného jazyka | Spracovanie prirodzeného jazyka (NLP – z angl.: natural language processing) je oblasť umelej inteligencie, ktorá umožňuje počítačom analyzovať ľudský jazyk v písanej aj hovorenej podobe a rozumieť mu. |
| Cesta vyhľadávania | Pojem „cesta vyhľadávania“ sa vzťahuje na postupnosť interakcií, prostredníctvom ktorých používateľ hľadá konkrétne informácie. Ide o proces, ktorého cieľom je na základe série otázok a odpovedí používateľa na ne identifikovať zámer vyhľadávania používateľa a splniť ho. Cesta vyhľadávania v rámci chatbotu zahŕňa pochopenie dopytu používateľa, získanie relevantných informácií z databázy alebo vedomostnej základne a prezentovanie informácií používateľovi spôsobom, ktorý je pre používateľa ľahko pochopiteľný a relevantný. |
| Cesta používateľa | Skúsenosť osoby počas jednej návštevy webového sídla alebo jedného použitia aplikácie, ktoré pozostávajú zo série činností vykonaných na dosiahnutie konkrétneho cieľa na danom webovom sídle alebo v danej aplikácii. |
| Výrok | Vstup od používateľa, ktorým môže byť akákoľvek napísaná alebo vyslovená správa v konverzácii. Výrok môže obsahovať jedno slovo alebo viacero slov vo forme otázky alebo frázy. |
Čo je asistent Publio?
Publio je virtuálny asistent na portáli Úradu pre publikácie (portál OP), pričom ide o nástroj umelej inteligencie, ktorý komunikuje s fyzickými osobami a vykonáva vyhľadávania pomocou kľúčových slov na základe informácií, ktoré sú verejne dostupné na portáli OP. Asistent Publio kombinuje techniky konverzačnej umelej inteligencie, medzi ktoré patrí spracovanie prirodzeného jazyka a strojové učenie, s interaktívnym rozpoznávaním hlasu a tradičnými systémami vyhľadávania a používateľom pomáha pri vyhľadávaní publikácií EÚ, právnych predpisov EÚ a kontaktných osôb v európskych inštitúciách.
Tento virtuálny asistent umožňuje konkrétne hovorené alebo písané konverzácie medzi koncovými používateľmi a portálom OP. Momentálne je dostupný v angličtine, vo francúzštine a v španielčine. Virtuálneho asistenta môže používať každý. Je zároveň prispôsobený aj potrebám ľudí s poruchami čítania, čím sa zvyšuje prístupnosť. Umožňuje aj konverzačné vyhľadávanie, čo je nový spôsob vyhľadávania, ktorý používateľom umožňuje hovoriť s hlasovým asistentom umelej inteligencie v celých vetách – rovnako ako v bežnej konverzácii – pričom asistent im odpovedá. Interakcia medzi používateľom a inteligentným asistentom má formu rozhovoru.
Aký typ údajov používa asistent Publio?
Asistent Publio používa informácie verejne dostupné na portáli OP. Tieto informácie sa zverejňujú na základe zásady transparentnosti, ktorá sa týka všetkých politík a právnych predpisov EÚ. Na základe tohto korpusu používa asistent Publio klasifikácie a kategórie dostupné na portáli OP, ako napríklad témy, autorov alebo formát zo slovníka Eurovoc, aby sa usmernila a spresnila konverzácia, a to v záujme pomoci pri vyhľadávaní v troch hlavných zbierkach portálu OP používateľom: publikácie EÚ, právo EÚ a oficiálny adresár EÚ (EÚ Whoiswho).
Asistent Publio používa existujúci jazykový model na pochopenie otázok používateľov a na ich usmerňovanie v súvislosti s cestou vyhľadávania. Na základe spätnej väzby od používateľov sa jazykový model asistenta Publio neustále zdokonaľuje a učí, aby spĺňal očakávania používateľov a zvládal rôznorodosť vstupov používateľov v troch podporovaných jazykoch.
Toto učenie pokrýva viacero komponentov základného systému asistenta Publio:
- vopred stanovenú sériu výrokov spojených s rôznymi možnými formami zámeru, ktoré umožnia asistentovi Publio najprv pochopiť konečný cieľ používateľa a potom ho krok za krokom usmerňovať k dosiahnutiu tohto cieľa,
- vopred stanovenú sériu nemenných otázok, ktorým asistent Publio „rozumie“ a na ktoré dokáže používateľom poskytnúť vopred stanovenú odpoveď. Príklad: Ako si môžem objednať publikácie?
- Entity, ktoré využívajú strojové učenie, pričom ich asistent Publio dokáže identifikovať a použiť v rámci svojich procesov na pozadí, a tým zistiť parametre vyhľadávania, poskytnúť presnejšie výsledky vyhľadávania alebo možnosti na ďalšie spresnenie vyhľadávania. Tieto entity sú založené na existujúcej klasifikácii a kategóriách údajov, ako sú synonymické slovníky Eurovoc alebo iné tabuľky autorít spravované prostredníctvom slovníka Eurovoc: autori, formáty, jazyky, orgány (organizácie) EÚ, funkčné úlohy vo verejnej službe EÚ a pod. Na základe toho môže asistent Publio napríklad z dopytu používateľa pochopiť, že používateľ hľadá publikáciu s konkrétnou témou alebo od konkrétneho autora.
Ako funguje asistent Publio?
Asistent Publio používa porozumenie konverzačnému jazyku (CLU – z angl.: conversational language understanding) (dodatok 4) v kombinácii so systémom extrakcie entít založeným na veľkom jazykovom modeli (LLM) na presné a efektívne spracovanie vstupov používateľov (písomné alebo hovorené výroky).
CLU poskytuje základné informácie o zámere a entitách používateľa a v prípade zložitejších dopytov komponent LLM spresňuje rozpoznanie entít, čím sa zabezpečujú lepšie výsledky v prípade fráz, kde sú dôležité významové odtienky, alebo zložitých žiadostí. Na základe rozpoznaného zámeru a entít spustí asistent Publio prispôsobený tok konverzácie, ktorého cieľom je podporovať používateľov, aby dosiahli požadovaný výsledok v niekoľkých jednoduchých krokoch.
V súčasnosti asistent Publio realizuje štyri hlavné toky konverzácie:
- vyhľadávanie dokumentov, ktorého cieľom je pomôcť používateľom pri vyhľadávaní publikácií EÚ alebo právnych dokumentov EÚ,
- vyhľadávanie osôb, ktorého cieľom je pomôcť používateľom pri vyhľadávaní verejných činiteľov zamestnaných v inštitúciách EÚ,
- vyhľadávanie organizácií, ktorého cieľom je pomôcť používateľom pri vyhľadávaní orgánov (organizácií) EÚ,
- otázky a odpovede (QnA), ktorých cieľom je poskytnúť vopred vymedzenú odpoveď na časté otázky.
Ak virtuálny asistent rozpozná tok vyhľadávania, usmerní používateľa pri hľadaní relevantného dokumentu, osoby alebo organizácie tak, že používateľovi položí jednoduché otázky a na základe jeho odpovedí navrhne možnosti filtrovania.
V prípade toku týkajúceho sa otázok a odpovedí zostavujú pracovníci Úradu pre publikácie zoznam párov s často kladenými otázkami a ich vopred stanovenými odpoveďami. Ak sa rozpozná zámer týkajúci sa otázok a odpovedí a existuje vysoká miera podobnosti medzi konkrétnou otázkou používateľa a jednou z otázok uložených v systéme, používateľ priamo dostane vhodnú odpoveď. Napríklad:
– Ak sa rozpozná zámer týkajúci sa otázok a odpovedí napríklad pri dopyte „Chcem si stiahnuť súbor“, asistent odpovie „Ak chcete stiahnuť dokument, prejdite na stránku s podrobnosťami o publikácii a kliknite na tlačidlo ,Stiahnutie a jazykové verzie‘.“
– Ak sa rozpozná zámer týkajúci sa otázok a odpovedí napríklad pri dopyte „Kde nájdem dokumenty pre deti?“, asistent odpovie „Publikácie pre deti sú dostupné v detskom kútiku“.
Používatelia môžu klásť otázky písomne alebo hovoreným slovom. Chatbot zaznamená zvukový vstup (hovorené otázky používateľa) a pošle ho do zariadenia na rozpoznávanie reči, ktoré reč konvertuje na text. Zvukový vstup je spracovaný službou prevodu reči na text Microsoft Azure (dodatok 5). Asistent Publio potom zobrazí zvukový vstup ako slová interpretované zariadením na rozpoznávanie reči. Následne sa zobrazí odpoveď v písomnej forme, ako aj hovoreným slovom pomocou syntetizovaného hlasu. Táto výmena je okamžitá (prebehne okamžite) a krátkodobá (nezanecháva žiadne stopy).
Ako asistent Publio analyzuje otázku a navrhuje výsledky?
Asistent Publio nepoužíva veľký jazykový model ani žiadnu inú technológiu generatívnej umelej inteligencie na generovanie odpovedí poskytovaných používateľom. Všetky správy asistenta Publio sú založené na vopred určených vzoroch. Asistent Publio používa jazykový model strojového učenia, ktorý sa učí (učený jazykový model), aby získal schopnosť rozpoznávať vstupy používateľov a reagovať na ne. Tento model je zodpovedný za spracovanie správy alebo dopytu používateľa, identifikáciu zámeru správy a poskytnutie vhodnej odpovede. Proces trénovania asistenta Publio zahŕňa poskytovanie veľkého množstva označených trénovacích údajov pre model strojového učenia, ktoré zahŕňajú príklady vstupov používateľov a ich príslušné zámery, ako aj prijateľné odpovede.
Asistent Publio používa spracovanie prirodzeného jazyka, trénovaný jazykový model a veľký jazykový model na pochopenie zámeru používateľa a na extrahovanie rozpoznaných entít z otázok používateľov (napríklad hľadaný pojem, autor, dátum dokumentu, formát dokumentu či hľadaná téma). Asistent Publio používa tieto entity na vyhľadávanie a zobrazenie výsledku vyhľadávania.
Ak je výsledok vyhľadávania príliš všeobecný, asistent Publio pokračuje v konverzácii a položí používateľovi dodatočné otázky, aby spresnil výsledok vyhľadávania filtrovaním podľa iných entít.
Otázky formulované asistentom Publio sa obmedzujú na identifikáciu zámeru používateľa, na vystihnutie ním stanoveného účelu a na sformulovanie správneho dopytu v súvislosti s vyhľadávaním, pokiaľ ide o korpus obsahu zverejnený na portáli OP. Výsledky navrhované asistentom Publio pochádzajú výlučne z tohto korpusu.
Spätná väzba od používateľov
Kedykoľvek počas rozhovoru môže koncový používateľ poskytnúť pozitívnu, neutrálnu alebo negatívnu spätnú väzbu týkajúcu sa svojich skúseností s používaním asistenta Publio. Môže ísť o manuálnu spätnú väzbu iniciovanú používateľom kedykoľvek alebo o odpoveď na automatickú kontextovú ponuku zobrazenú po niekoľkých sekundách nečinnosti, v rámci ktorej sa používateľ vyzve, aby poskytol spätnú väzbu. Otázky, ktorým asistent Publio správne „neporozumie“, sú navyše automaticky zaznamenávané a pravidelne spracovávané tímom zamestnancov Úradu pre publikácie. Spätná väzba od používateľov aj analýza otázok, ktorým asistent Publio správne „neporozumel“, sa používajú na opakované učenie jazykového modelu s cieľom neustáleho ďalšieho zlepšovania služieb poskytovaných koncovým používateľom.
Spracúvanie osobných údajov
Údaje dostupné na portáli OP sú spracúvané v súlade so všeobecným nariadením EÚ o ochrane údajov a s nariadením o spracúvaní osobných údajov inštitúciami, agentúrami a orgánmi EÚ (dodatok 6).
Asistent Publio neukladá, neuchováva ani nearchivuje žiadne prvky, ani vstup používateľa, ani vstup poskytnutý prostredníctvom odpovedí asistenta Publio.
Zhromaždená spätná väzba je anonymizovaná tak, že ju nemožno spätne prepojiť s používateľom, od ktorého bola získaná.
Žiadne osobné údaje sa nijakým spôsobom nepoužijú na automatizované rozhodovanie, sledovanie ani profilovanie. Pri používaní veľkých jazykových modelov na extrakciu entít sú jedinými údajmi vymieňanými medzi asistentom Publio a veľkým jazykovým modelom otázka používateľa a predbežný výsledok extrakcie entít vygenerovaný systémom CLU. Nezdieľajú a neprenášajú sa žiadne osobné údaje používateľov.
Všetky služby využívané asistentom Publio sú umiestnené v európskych dátových centrách a všetky údaje sa spracúvajú v súlade s predpismi EÚ o ochrane osobných údajov.
Aktuálne obmedzenia
- Prepis mena pomocou hlasu: zatiaľ čo väčšine mien je možné „porozumieť“ a je možné ich správne prepísať, extrakcia mien je založená na strojovom učení a nie je presná na 100 %. V dôsledku obmedzení systému CLU nie je možné niektoré mená správne extrahovať ani po natrénovaní modelu pomocou konkrétnych príkladov zo súboru údajov.
- Dátumy vo francúzštine a v španielčine: v zložitejších kontextoch je „porozumenie“ dátumu v španielčine a vo francúzštine menej presné. Napríklad v španielskej fráze „entre 2016 y 2017“ je možné rozpoznať rok bez ďalšieho kontextu, zatiaľ čo vo fráze „entre el año 2019 y 2020“ ho nie je možné rozpoznať.
- Rozpoznávanie reči funguje súčasne iba v jednom jazyku.
- V rámci rozpoznávania reči nie je režim pravopisu, čo znamená, že nemá funkciu, ktorá by používateľom umožňovala hláskovať slová znak po znaku, aby sa zabezpečil presný prepis.
- Rozpoznávanie pomenovaných entít v dlhších frázach v kombinácii s osloveniami pani/slečna nefunguje dobre.
Úrad pre vydávanie publikácií Európskej únie, 16. mája 2023
1. Dostupné na adrese https://digital-strategy.ec.europa.eu/en/library/ethics-guidelines-trustworthy-ai
2. Dôveryhodná umelá inteligencia by mala spĺňať týchto sedem požiadaviek: i) ľudské riadenie a dohľad, ii) technická spoľahlivosť a bezpečnosť, iii) ochrana súkromia a dobrá správa údajov, iv) transparentnosť, v) rozmanitosť, nediskriminácia a spravodlivosť, vi) spoločenský a environmentálny blahobyt, vii) zodpovednosť.
Nariadenie Európskeho parlamentu a Rady, ktorým sa stanovujú harmonizované pravidlá v oblasti umelej inteligencie (akt o umelej inteligencii) a menia niektoré legislatívne akty Únie. Prijatý a podpísaný akt možno nájsť tu.
4. https://language.cognitive.azure.com/clu/projects/.
5. https://query.prod.cms.rt.microsoft.com/cms/api/am/binary/RE5cCGB.
6. Nariadenie (EÚ) 2016/679, Ú. v. EÚ L 119, 4.5.2016, s. 1 – 88 a nariadenie (EÚ) 2018/1725, Ú. v. EÚ L 295, 21.11.2018, s. 39 – 98.