{"id":124119,"date":"2026-03-08T19:52:06","date_gmt":"2026-03-08T19:52:06","guid":{"rendered":"https:\/\/www.europesays.com\/ee\/124119\/"},"modified":"2026-03-08T19:52:06","modified_gmt":"2026-03-08T19:52:06","slug":"ak-nadal-uuris-mida-moistab-tehisaru-eesti-keelest-ja-kultuurist-eesti","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/ee\/124119\/","title":{"rendered":"&#8220;AK. N\u00e4dal&#8221; uuris, mida m\u00f5istab tehisaru eesti keelest ja kultuurist | Eesti"},"content":{"rendered":"<p>&#8220;Kui Arno isaga koolimajja j\u00f5udis, oli koolimaja juba maha p\u00f5lenud.&#8221; Just sellise vastuse v\u00f5ib anda t\u00e4na keelemudel, kui k\u00fcsida selle k\u00e4est \u00fche eesti kirjanduse kuulsaima lause kohta.\u00a0\u00a0<\/p>\n<p>Novaatori toiimetus tegi minieksperimendi, et testida mudelite keele- ja kultuuritundlikkust.\u00a0\u00a0<\/p>\n<p>Toimetus testis\u00a0viie enamlevinud keelemudeli tasuta versioonide teadmisi ning koostas selle\u00a0tarvis Eesti keelele ja kultuurile spetsiifilise k\u00fcsimustiku.\u00a0Novaator k\u00fcsis\u00a0n\u00e4iteks Lennart Meri teose &#8220;H\u00f5bevalge&#8221; sisu kohta v\u00f5i seda, mitu t\u00e4ish\u00e4\u00e4likut on s\u00f5nas &#8220;j\u00e4\u00e4\u00e4\u00e4r&#8221;.\u00a0<\/p>\n<p>K\u00f5ige paremini vastas k\u00fcsimustele Groki keelemudel, millele j\u00e4rgnesid tihedalt Claude\u00a0Sonnet,\u00a0Gemini\u00a0ja\u00a0ChatGPT. Suurtest keelemudelitest tegi k\u00f5ige kesisema tulemuse Mistral, mis p\u00f5rus t\u00e4ielikult keelek\u00fcsimustes.<\/p>\n<p>Tartu \u00dclikooli teadlase Kairit Sirtsu s\u00f5nul tekitavad juturobotite vastused palju k\u00fcsimusi. Ka n\u00e4iteks see sama, &#8220;Kevade&#8221; romaani avalause valesti t\u00f5lgendamine.\u00a0\u00a0<\/p>\n<p>&#8220;Kui seda ikkagi treeningandmetes ei ole olnud, siis seda ei ole v\u00f5imalik ka mudelil teada. Seal on v\u00f5ib-olla see k\u00fcsimus, et kas me soovime, et mingid mudelid neid asju teaksid ja teisest k\u00fcljest, kui kommertsmudelid neid juba teavad, siis see viitab, et kuskilt see info on sinna ikkagi tulnud. Me ei tea kust, me ei tea kuidas,&#8221; r\u00e4\u00e4kis Tartu \u00dclikooli arvutiteaduse instituudi keeletehnoloogia kaasprofessor Kairit Sirts.\u00a0<\/p>\n<p>Teadlase s\u00f5nul teame me t\u00e4na v\u00e4ga v\u00e4he sellest, mis materjalidel \u00fcldse suuri keelemudeleid treenitakse. Selge on aga see, et eesti kultuuriruumis orienteerumiseks sellest ei piisa.<\/p>\n<p>&#8220;Kui me vaatame, mida suurkorporatsioonid t\u00e4na teevad, kas see on siis\u00a0OpenAI, Google oma\u00a0Gemini\u00a0mudelitega, siis neil on v\u00e4ga hea\u00a0\u00fcldv\u00f5imekus, aga kui me paneme selle eesti keele ja kultuuri konteksti, siis kahjuks need lahendused v\u00e4ga tihti eksivad,\u00a0hallutsineerivad. Nad ei taju eesti keele ja kultuuri konteksti, meie \u00fchiskondlikke v\u00e4\u00e4rtusi, ei peegelda meie ajalugu nii nagu me ise seda n\u00e4eme,&#8221; \u00fctles justiits- ja digiministeeriumi tehisintellekti ja andmete talituse juhataja Ott\u00a0Velsberg.<\/p>\n<p>Kuid et Eesti ei j\u00e4\u00e4ks \u00fclikiires tehnoloogia arengus lootusetult maha ning ei muutuks ise\u00a0museaaliks, treenivad teadlased \u00fcht avatud andmetega keelemudelit just eestikeelsel materjalil. Oluliselt v\u00e4iksema andmehulgaga mudel j\u00e4\u00e4b aga t\u00e4na suurtele ametivendadele alla.<\/p>\n<p>&#8220;\u00dcks p\u00f5hjus on see, et praegune\u00a0EstLLM-i\u00a0variant on h\u00e4sti v\u00e4ikene mudel, mis t\u00e4hendab, et tema k\u00e4ivitamiseks on vaja natuke v\u00e4hem protsessoreid. Aga \u00fcldiselt on probleem selles, et meil ei ole kohapeal piisavalt andmeid, piisavalt arvutusv\u00f5imsust, et luua midagi v\u00f5rdv\u00e4\u00e4rset,&#8221; selgitas Eesti Keele Instituudi tehisaru hindamise programmijuht\u00a0Krister\u00a0Kruusmaa.<\/p>\n<p>Nii j\u00f5uame kriitilise k\u00fcsimuseni: mis andmeid ja kellele jagada? Rahvusvaheliste suurkorporatsioonide infot\u00f6\u00f6tlusest teame me v\u00e4he, kuid andmeid on vaja ka Eesti teadlastel, kelle teadust\u00f6\u00f6 on \u00fchele digiriigile h\u00e4davajalik.<\/p>\n<p>Kairit Sirts m\u00e4rkis, et selles vallas on v\u00e4ga palju juriidilist segadust.\u00a0\u00a0<\/p>\n<p>&#8220;See hall ala on v\u00e4ga suur, et kellel on \u00f5igus, mis tingimustel, mis andmeid kasutada. Selge on see, et kui mudeli arendaja teenib selle pealt raha, et ta on kellegi teise andmeid kasutanud mudeli treenimiseks, siis on loogiline, et seal tekib vastumeelsus v\u00f5i t\u00f5rge,&#8221; lausus Sirts.\u00a0<\/p>\n<p>Kui aga tahta, et mudel tunneks n\u00e4iteks kultuurilugu ja kirjandusklassikat, peaks olema selle treeningandmetes ka autori\u00f5igustega kaitstud materjale. Kuid kas sellisel juhul tekib oht, et juturobot esitleb kellegi teise teoseid enda loominguna?<\/p>\n<p>Kruusmaa\u00a0s\u00f5nul\u00a0on v\u00f5imalus, et mudel reprodutseeriks mingi teose, mis on tema treeningandmetes, sisuliselt v\u00f5imatu.<\/p>\n<p>&#8220;Keelemudel ei ole nagu raamatukoguhoidja, kes l\u00e4heb riiuli juurde ja v\u00f5tab sealt mingisuguse asja. Tal ei ole enda andmebaasi, vaid ta genereerib t\u00f5en\u00e4osuste tulemusel s\u00f5nu, arvestades seda teksti, mida ta on n\u00e4inud,&#8221; r\u00e4\u00e4kis ta.<\/p>\n<p>Kruusmaa m\u00e4rkis, et k\u00fcsimus on laiemalt selles, et keelemudelid toetaksid eestikeelset ja -meelset m\u00f5ttet\u00f6\u00f6d.<\/p>\n<p>&#8220;Varem \u00f6eldi, et kui sind pole Google&#8217;is siis sind pole olemas. T\u00e4nap\u00e4eva noored k\u00fcsivad juturoboti k\u00e4est enda k\u00fcsimusi ja kui eesti keelt ja kultuuri n\u00e4iteks\u00a0ChatGPT-s ei ole, siis inimesed oma teed selleni ka ei leia,&#8221; \u00fctles Kruusmaa.<\/p>\n<p>Teisalt on k\u00fcsimus riigi suver\u00e4\u00e4nsuses, mille puhul ei saa taas m\u00f6\u00f6da kohalikust arendust\u00f6\u00f6st.<\/p>\n<p>&#8220;Me peame tagama, et kui midagi l\u00e4heb halvasti, siis meil on olemas \u00fchelt poolt see alternatiiv,&#8221; lausus\u00a0Velsberg.\u00a0<\/p>\n<p>&#8220;Teisalt me ei taha k\u00f5ike t\u00f6\u00f6delda avalikus pilves.\u00a0V\u00f5tame n\u00e4iteks terviseandmed v\u00f5i siis riigisaladusega kaitstud teave ehk siis meil peab olema v\u00f5imalus jooksutada neid samu keelemudeleid kohapeal,&#8221; lisas ta.<\/p>\n<p>Kuigi eesti keelel treenitud mudeli tulemused ei konkureeri kommertsmudelitega ning suure t\u00f5en\u00e4osusega ei hakkagi kunagi konkureerima, tuleb Kairit Sirtsu s\u00f5nul arendust\u00f6\u00f6ga j\u00e4tkata.<\/p>\n<p>&#8220;Kas need tulemused on sellised, et neid keegi reaalselt kasutama hakkab? Aga kui me ei tee seda t\u00f6\u00f6d, siis \u00fchel hetkel me avastame, et oleks pidanud tegema ning siis on v\u00e4ga raske sellele rongile peale h\u00fcpata,&#8221; \u00fctles ta.\u00a0<\/p>\n<p>\n\t\t\t\t\tAllikas:<br \/>\n\t\t\t\t\t&#8220;AK. N\u00e4dal&#8221;<\/p>\n","protected":false},"excerpt":{"rendered":"&#8220;Kui Arno isaga koolimajja j\u00f5udis, oli koolimaja juba maha p\u00f5lenud.&#8221; Just sellise vastuse v\u00f5ib anda t\u00e4na keelemudel, kui&hellip;\n","protected":false},"author":2,"featured_media":124120,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[14],"tags":[131,130,2206,57242,37,33,35,57243,34,36,18674,9311,57241,10232,31991,2358,57240,814],"class_list":["post-124119","post","type-post","status-publish","format-standard","has-post-thumbnail","category-ari","tag-ari","tag-business","tag-chatgpt","tag-claude-sonnet","tag-ee","tag-eesti","tag-eesti-keel","tag-estllm","tag-estonia","tag-estonian","tag-gemini","tag-grok","tag-kairit-sirts","tag-krister-kruusmaa","tag-mistral","tag-openai","tag-ott-velsberg","tag-tehisaru"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@ee\/116195304712359994","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts\/124119","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/comments?post=124119"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts\/124119\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/media\/124120"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/media?parent=124119"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/categories?post=124119"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/tags?post=124119"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}