{"id":204178,"date":"2026-06-15T09:01:11","date_gmt":"2026-06-15T09:01:11","guid":{"rendered":"https:\/\/www.europesays.com\/ee\/204178\/"},"modified":"2026-06-15T09:01:11","modified_gmt":"2026-06-15T09:01:11","slug":"krister-kruusmaa-eesti-kultuur-globaalplausti-ajastul-kirjandus","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/ee\/204178\/","title":{"rendered":"Krister Kruusmaa: Eesti kultuur globaalpl\u00e4usti ajastul | Kirjandus"},"content":{"rendered":"<p>Kuulsin kord lugu h\u00e4rrast, kes oli tulnud raamatukokku \u00fcht teost otsima. Kuna raamatukoguhoidja raamatut kohe ei teadnud, siis vaadati esmalt Estrist, aga seal seda miskip\u00e4rast ei leidunud. Otsiti riiulitelt sarnase nimega autorit, seej\u00e4rel p\u00f6\u00f6rduti juba v\u00e4lismaiste andmebaaside poole. Kui pika otsimise peale teosest endiselt \u00fchtegi j\u00e4lge ei leitud, uuris raamatukoguhoidja, kust h\u00e4rra selle kohta kuulis. Vastus k\u00f5las: &#8220;ChatGPTlt.&#8221;<\/p>\n<p>See l\u00f5busav\u00f5itu seik peidab endas nii m\u00f5ndagi m\u00f5tlemapanevat. Tehisaru on muutunud paljude inimeste jaoks peamiseks infootsingu t\u00f6\u00f6riistaks. V\u00f5rreldes teiste info otsimise viisidega, n\u00e4iteks otsinguga andmebaasidest, raamatukoguk\u00fclastuse v\u00f5i isegi guugeldamisega, on tehisaru k\u00f5ige l\u00e4bipaistmatum ning kallutatum. Juturobot k\u00e4itub k\u00fcll abivalmilt, aga me ei tea selle eelistusi ega saa kunagi l\u00f5puni veendunud olla, et pakutud info ka t\u00f5ele vastab.<\/p>\n<p>V\u00f5rdlustest<\/p>\n<p>Mainitud juhtumist inspireerituna otsustasin j\u00e4rele uurida, kui t\u00f5en\u00e4oline on, et keelemudel sellises olukorras hallutsineerib. Disainisin selleks spetsiaalse v\u00f5rdlustesti ehk\u00a0benchmark&#8217;i. V\u00f5rdlustestid on n-\u00f6 keelemudelite eksamid, kus mudelite vastuseid hinnatakse automaatselt etteantud kriteeriumite alusel. Katse \u00fclesehitus oli lihtne: keelemudelil paluti soovitada eestikeelseid raamatuid. Valikusse sai v\u00f5etud kaheksa \u017eanri: ilu- ja lastekirjandus, fantaasia-, krimi-, eluloo- ning ajalookirjandus, populaarteadus ja luule. K\u00fcsimus v\u00f5is olla otsene (\u00e0 la\u00a0&#8220;soovita eestikeelseid lasteraamatuid&#8221;) v\u00f5i kasutada \u00fchte neljast t\u00e4psustavast kriteeriumist \u2013 paluda kas uuemaid, v\u00e4hem tuntud, klassikalisi v\u00f5i t\u00f5lgitud raamatuid. Selliselt sai kokku 40 k\u00fcsimust, millest iga\u00fches paluti nelja raamatusoovitust. Seega pidi iga mudel soovitama testi k\u00e4igus 160 nimetust.<\/p>\n<p>J\u00e4rgmiseks v\u00f5rreldi antud soovitusi automaatselt Eesti rahvusbibliograafia raamatute loendiga. Tegu on detailse andmestikuga k\u00f5igist eestikeelsetest ja Eestis ilmunud raamatutest l\u00e4bi sajandite.1\u00a0Soovitused, mille pealkiri ja autor ei vastanud piisava kindlusega \u00fchelegi reaalsele nimetusele, loeti vigaseks. Iga mudeli l\u00f5pphinne esitati skaalal 0\u2013100, mis v\u00e4ljendas t\u00f5este soovituste osakaalu k\u00f5igist soovitatud raamatutest.<\/p>\n<p>Mudelid ei saa kasutada testi k\u00e4igus veebiotsingut v\u00f5i muid t\u00f6\u00f6riistu, nagu seda teevad juturobotirakendused. Selline test m\u00f5\u00f5dab seega keelemudeli sisemisi teadmisi, mitte infootsinguv\u00f5imet. \u00dchtlasi seab see lati parajasse kohta. Ilmselt oskab suur osa koolis k\u00e4inud eestlastest nimetada peast neli klassikalist eesti ilukirjandusteost, aga nelja v\u00e4rske luuleraamatu nimetamine (testis viimase k\u00fcmne aasta jooksul ilmunud) v\u00f5ib vajada omajagu m\u00f5tlemist. Tegu on enam kui realistlike ootustega, arvestades, milline on mudelite teadmiste ulatus angloameerika kultuurist ning mida TI suurfirmad meile seoses tulevikuga lubavad.<\/p>\n<p>N\u00fc\u00fcdseks on sellest eksperimendist saanud osa Eesti Keele Instituudi suuremast uurimisprojektist, mille eesm\u00e4rk on m\u00f5\u00f5ta keelemudelite eestikeelset v\u00f5imekust. Raamatusoovituste test on \u00fcks viis hinnata, kui usaldusv\u00e4\u00e4rselt suudavad mudelid tulla toime eesti keele- ja kultuuriruumiga seotud teadmistega. Selle ja teiste v\u00f5rdlustestide tulemusi tutvustab\u00a0EKI keelemudelite m\u00f5\u00f5dupuu2, mis pakub interaktiivset \u00fclevaadet tehisaru kvaliteedist eesti keeles.<\/p>\n<p>Tulemused<\/p>\n<p>Enam kui 50 testitud keelemudeli hulgast suutsid vaid OpenAI ja Google&#8217;i uusimad lipulaevad enam-v\u00e4hem adekvaatselt reaalselt eksisteerivaid raamatuid nimetada: GPT-5.5 (80 protsenti reaalseid soovitusi) ja Gemini 3.1 Pro (75 protsenti). K\u00f5ik \u00fclej\u00e4\u00e4nud m\u00f5tlesid rohkem kui pooled soovitused v\u00e4lja v\u00f5i pakkusid teoseid, mida sellise pealkirjaga eesti keeles ei eksisteeri. M\u00f5ned, nt Google&#8217;i Gemma-seeria mudelid, said tulemuseks alla 10%. Avatud ehk vabavaralised mudelid olid kommertsmudelitest keskmiselt tunduvalt n\u00f5rgemad.<\/p>\n<p>Valesid soovitusi oli eri laadi, alates p\u00e4ris autorite v\u00e4ljam\u00f5eldud loomingust (Hando Runneli &#8220;Kuidas \u00f5petada oma koera luuletama&#8221;, Piret Raua &#8220;Piretiraudne&#8221; ja Jaan Krossi &#8220;K\u00e4ttemaksukontor&#8221;) kuni s\u00f5nav\u00e4\u00e4ratuste (&#8220;T\u00f5de ja \u00f5iglus&#8221;, &#8220;Sada aastat \u00fcksindust&#8221;) ning v\u00e4liskirjanduse toort\u00f5lgeteni (Bill Brysoni teos pole eesti keeles teadup\u00e4rast mitte &#8220;L\u00fchike ajalugu peaaegu k\u00f5igest&#8221;, vaid n\u00f5tkem &#8220;K\u00f5iksuse l\u00fchiajalugu&#8221;).<\/p>\n<p>Ootusp\u00e4raselt oskasid mudelid nimetada paremini klassikalisi ja tuntud teoseid, p\u00e4ringud uuemate ja v\u00e4hem tuntud teoste kohta suurendasid luulude osakaalu k\u00f5igil mudelitel m\u00e4rgatavalt. \u017danritest osati k\u00f5ige rohkem nimetada ilu- ja lastekirjandust, k\u00f5ige v\u00e4hem aga luulet ja populaarteadust. K\u00f5ige sagedamini soovitasid mudelid &#8220;T\u00f5de ja \u00f5igust&#8221;, &#8220;Kevadet&#8221;, &#8220;V\u00e4ikest printsi&#8221;, &#8220;Naksitralle&#8221; ning \u2013 miskip\u00e4rast \u2013 Steve Jobsi elulooraamatut.<\/p>\n<p>Tehisaru keeleoskus<\/p>\n<p>Mudelite tulemus sellises testis s\u00f5ltub peamiselt kolmest tegurist: mudeli suurusest ehk parameetrite arvust, eestikeelsete treeningandmete osakaalust ja nende andmete kvaliteedist. Parameetrite arv m\u00f5jutab seda, kui palju infot mudel suudab \u00fcldse talletada. Keelemudel ei j\u00e4ta treeningandmeid lihtsalt tervikuna meelde ega tsiteeri neid s\u00f5na-s\u00f5nalt. Pigem kinnistub info, mis esineb andmetes korduvalt ja mitmesugustes kontekstides. Mida sagedamini mingist teemast treeningandmetes r\u00e4\u00e4gitakse ja mida suurem on mudel, seda t\u00f5en\u00e4olisemalt suudab see anda mitte ainult sorava, vaid ka t\u00f5ese vastuse.<\/p>\n<p>Eestikeelse materjali t\u00e4pne osakaal mudelite treeningandmestikes ei ole teada ja eeldatavasti k\u00f5igub see olenevalt tootjast ja seeriast. Aga ligikaudse hinnangu j\u00e4rgi v\u00f5iks see j\u00e4\u00e4da umbes 0,1 protsendi juurde kogumahust.3\u00a0See on tegelikult k\u00f5nelejate arvu kohta \u00fcks maailma parimaid tulemusi, aga paraku loevad siin ainult absoluutsed mahud ja ergutusauhindu ei anta. Samuti oleks v\u00e4\u00e4r arvata, et see 0,1 protsenti koosneb peamiselt uudistest ja ilukirjandusest, nagu vahel v\u00e4ita \u00fcritatakse. Aina suurem osa veebis leiduvast eestikeelsest tekstist \u2013 v\u00f5imalik, et juba ammu enamik \u2013 on kas masint\u00f5lgitud v\u00f5i genereeritud. Ning selle hulgas on palju suuremal m\u00e4\u00e4ral igasugust jama, kui me arvata oskaksime. Tehisaru ei \u00f5pi eesti keelt mitte Sirbist ja ERRist, vaid Facebookist ja Temust.<\/p>\n<p>Luulude ulatus<\/p>\n<p>Enne kui r\u00e4\u00e4kida v\u00f5imalikest lahendustest, tuleks p\u00f5gusalt m\u00f5elda, miks mudelite arusaam eesti kultuurist \u00fcldse t\u00e4helepanu v\u00e4\u00e4rib. Mainitud eksperiment k\u00e4sitles raamatuid, aga usaldusv\u00e4\u00e4rse soovitusmootori saaks ehitada ka muul viisil. Raamatud on lihtsalt kategooria, mille kohta on olemas piisavalt t\u00e4ielik v\u00f5rdlusandmestik. K\u00fcll aga annab raamatusoovituste test meile \u00fcldise aimduse, kuidas on eesti kultuuri puudutav teave mudelites talletunud.<\/p>\n<p>Mudel, mis n\u00e4iteks 50% kordadest eesti kultuuri puudutava infoga eksib, k\u00f5lbab ehk geneerilise\u00a0AI slop&#8217;i tootmiseks eesti keeles, aga ei ole rakendatav \u00fcheski s\u00fcgavamaid taustteadmisi n\u00f5udvas \u00fclesandes. Olen kohanud haritud inimesi, kes muidu tehisarust oma t\u00f6\u00f6s arvestatavat kasu v\u00f5iksid l\u00f5igata, aga on seep\u00e4rast tehisarus hoopis pettunud ja hoiavad sellest eemale. Teised seevastu usuvad pimesi haipi, panemata t\u00e4hele, et see ei vasta tehisaru reaalsele v\u00f5imekusele meie tingimustes. Ja nii s\u00fcnnivadki tehisaru abiga aina uued vigased tekstid ja piinlikud apsud.4<\/p>\n<p>Aga kui uusimad tippmudelid hallutsineerivad &#8220;ainult&#8221; 20\u201325 protsenti kordadest, siis ehk kaob see probleem ajapikku lihtsalt \u00e4ra? See oleks t\u00fchi lootus. Esiteks pole kvaliteedi paranemine ajas sugugi garanteeritud: m\u00f5ni mudeliseeria tammub paigal (Llama), m\u00f5ni k\u00f5igub tugevalt \u00fcles-alla (GPT), m\u00f5ni on hoopis languses (Grok). Teiseks ei ole pidevalt luulutav mudel kaugeltki nii ohtlik kui &#8220;m\u00f5\u00f5dukalt&#8221; hallutsineeriv mudel, mis tekitab kasutajas piisavalt usaldust, et valvsus hajuks. Ja kolmandaks, praegu liigume me kiiresti olukorra poole, kus kogu eesti kultuuriruumis v\u00e4hegi adekvaatselt toimetav tehisaru on koondunud \u00fche v\u00f5i kahe erafirma k\u00e4tte.<\/p>\n<p>USAs, kust kogu haip alguse saab, selliseid probleeme muide peaaegu ei ole. Sealses kultuuriruumis oluline info on mudelitele nii k\u00f5vasti p\u00e4he taotud, et piinlikud hallutsinatsioonid on tippmudelite puhul v\u00e4ga haruldased. Samuti on paljud avatud mudelid inglise keeles enam kui p\u00e4devad ning pakuvad teadlikku alternatiivi erak\u00e4tes kommertsmudelitele. Kahjuks j\u00e4\u00e4vad need asjaolud Eestis enamasti t\u00e4iesti m\u00e4rkamata.<\/p>\n<p>Kiired vastused ja s\u00fcgavad diskussioonid<\/p>\n<p>Kultuuriliselt t\u00f6mp tehisaru toob endaga kaasa rohkem probleeme kui raamatukogus virvateoste otsimisele kulutatud aeg \u2013 ehkki ma olen kindel, et artikli alguses kirjeldatud lugu pole kaugeltki \u00fcksikjuhtum. Aina suurem osa informatsioonist on \u00fchel v\u00f5i teisel viisil tehisaru vahendatud. Inimesed loovad tehisaruga tekste, lasevad neist seej\u00e4rel olulise v\u00e4lja tuua, k\u00fcsivad kimbatuses n\u00f5u, otsivad kiireid vastuseid ja peavad s\u00fcgavaid diskussioone. K\u00f5igi nende interaktsioonide k\u00e4igus avame end \u00fchel v\u00f5i teisel viisil keelemudelite subjektiivsele m\u00f5jule ning m\u00f5jutame ise seel\u00e4bi end \u00fcmbritsevat info- ja kultuuriruumi.5<\/p>\n<p>Eesti kultuurikontekstis ebakindlad keelemudelid teevad sellest m\u00f5just aga erosiooni, mis paljundab valeinfot ja uhub ajapikku minema selle v\u00e4hese, mis v\u00f5iks eristada meie maanurka ja selle vaimuilma tasapaksust globaalpl\u00e4ustist. Selle \u00e4rahoidmiseks tuleb heita k\u00f5rvale valearusaam, et tehisaru on siinsetesse oludesse asetatuna igatpidi sama v\u00f5imekas kui Ameerikas. Oleme viibinud liiga kaua letargilises lootuses, et Eesti \u00fchiskonnale sobiv tulevikutehnoloogia arendatakse v\u00e4lja teises maailma otsas, ilma et meie peaks lillegi liigutama.<\/p>\n<p>Eestil on k\u00f5ik eeldused olemas, et tehisaru enda n\u00e4o j\u00e4rgi kujundada. Selleks pole vaja massiliselt arvutusj\u00f5udu, vaid piisab kvaliteetsetest andmetest ning headest koost\u00f6\u00f6partneritest. Digiriigi ja sellega kaasneva rahvusvahelise kuvandi t\u00f5ttu on meil olemas m\u00f5lemad. Puudu on hoopis poliitiline tahe ja \u00fchiskondlik kokkulepe, mis v\u00f5imaldaksid eestikeelsete andmete kasutamist tehisaru treenimiseks. Praegu toppab see juba pikemat aega \u00f5igusliku ebaselguse ja avaliku huvi puudumise taga. Samal ajal murendavad aga n\u00fcrid keelemudelid iga p\u00e4ev meie kultuuriruumi, tootes pl\u00e4usti, mis j\u00f5uab omakorda j\u00e4rgmiste mudelite treeningandmetesse. Tegutsema peab kiiresti, sest eestlane ei v\u00e4\u00e4ri v\u00e4hem kvaliteetset tehisaru kui ameeriklane.<\/p>\n<p>Artikkel p\u00f5hineb osaliselt 13. m\u00e4rtsil eesti raamatu aasta l\u00f5pukonverentsil peetud ettekandel.<\/p>\n<p>1 Praeguseks sisaldab ERB \u00fcle 317\u00a0000 nimetuse 16. sajandist t\u00e4nap\u00e4evani. Loe l\u00e4hemalt:\u00a0Kruusmaa, K. 2025. Andmetesse valatud raamatukultuur. \u2013 Sirp, 14.02.\u00a0<\/p>\n<p>2 m\u00f5\u00f5dupuu.eki.ee\u00a0<\/p>\n<p>3 N\u00e4iteks\u00a0CommonCrawli veebikorpuses, mida teadaolevalt treenimiseks kasutatakse, k\u00f5igub eesti keele osakaal 0,14% ringis. Sellele lisanduvad muud korpused, kus eesti keelt ei pruugi nii palju olla.\u00a0\u00a0<\/p>\n<p>4 Vt nt\u00a0Ajaots, O. 2026. AI-pl\u00e4ust v\u00f5i uus normaalsus? Eesti reklaamid kubisevad tehisaru vigadest. \u2013 Geenius, 20.05.\u00a0<\/p>\n<p>5 Seda illustreerib h\u00e4sti Delfi arvamustoimetuse anal\u00fc\u00fcs tehisaruga kirjutatud &#8220;arvamusartiklitest&#8221;, vt:\u00a0Nordmann, A.; Moora, E. 2026. Eesti arvamusliidrid on valinud ajum\u00e4da. Enamik arvamuslugudest on kirjutatud masina abil. \u2013 Delfi, 24.04.\u00a0\u00a0<\/p>\n","protected":false},"excerpt":{"rendered":"Kuulsin kord lugu h\u00e4rrast, kes oli tulnud raamatukokku \u00fcht teost otsima. Kuna raamatukoguhoidja raamatut kohe ei teadnud, siis&hellip;\n","protected":false},"author":2,"featured_media":204179,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[12],"tags":[26,27,37,33,35,23401,34,36,31,32,21,10232,28,29,18122,19,25,23,24,22,20,30],"class_list":["post-204178","post","type-post","status-publish","format-standard","has-post-thumbnail","category-eesti","tag-breaking-news","tag-breakingnews","tag-ee","tag-eesti","tag-eesti-keel","tag-eesti-kultuur","tag-estonia","tag-estonian","tag-featured-news","tag-featurednews","tag-headlines","tag-krister-kruusmaa","tag-latest-news","tag-latestnews","tag-muurileht","tag-news","tag-populaarseimad-lood","tag-top-stories","tag-topstories","tag-uldised-uudised","tag-uudised","tag-viimased-uudised"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@ee\/116753313771478017","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts\/204178","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/comments?post=204178"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts\/204178\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/media\/204179"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/media?parent=204178"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/categories?post=204178"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/tags?post=204178"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}