Lühidalt: Tehisintellektifirmad ostavad sihipäraselt kokku vanemaid raamatuid, et kasutada neid treeninguandmetena, ning hävitavad need digiteerimise käigus.
Tehisintellektiettevõtted soetavad suurtes kogustes otsas olevaid või antikvaarseid raamatuid, mille trükikuupäev jääb enne 2022. aastat, et kasutada nende sisu tehisintellektist puutumata treeninguandmetena. Raamatud hävitatakse skaneerimise käigus.
Tehisintellekti arendajad kasutavad õiguslikult turvaliste treeninguandmete hankimiseks üha enam üht kindlat strateegiat: nad ostavad massiliselt kokku enne 2022. aastat ilmunud raamatuid. Selliseid vanemaid trükiseid peetakse tehisintellekti treeningmaterjalist vabaks, mis võimaldab selget eristust andmetest, mida generatiivsed tehisintellektisüsteemid on juba võinud mõjutada.
Ostuprotsess on sageli suunatud otsas olevatele, antikvaarsetele või raskesti kättesaadavatele teostele, mida on võimalik soetada soodsa hinnaga. Raamatute skaneerimisel need tavaliselt hävitatakse — see on nii odav kui ka pöördumatu praktika, mis tõstatab küsimusi ressursitõhususe kohta.
See tegevusviis peegeldab regulatiivseid ja mainega seotud väljakutseid, millega tehisintellekti arendajad andmete hankimisel silmitsi seisavad. Kuna arutelu autoriõiguse, treeningu läbipaistvuse ja andmete päritolu üle tehisintellektisüsteemides üha kasvab, pakuvad selge päritoluga digieelsed allikad võimalust leevendada võimalikke vastavusriske.
Allikas: www.golem.de · Avaldatud 22. juuli 2026
Lumi AI News — tehisintellekti abil kureeritud vastavalt tehisintellektimääruse artiklile 50. Parafraseerimine ja klassifitseerimine Lumi News Pipeline v1.7.3 abil.