Skip to content

Miks keelemudelid salvestavad uusi teadmisi, kuid ei suuda neid kasutada

Lühidalt: "Knowing-Using Gap" ehk teadmise-kasutamise lõhe kirjeldab nähtust, mille puhul suured keelemudelid jätavad uued faktid meelde, kuid nende sisemisi esitusi ei suunata edasi arutluse eest vastutavatesse kihtidesse.

Teadlased on uurinud, miks suured keelemudelid õpivad küll uued faktid pähe, kuid ei suuda neid arutlusülesannete lahendamisel kasutada. Nad tuvastasid probleemi tuumaks vastuolu teadmiste esituste salvestamise ja nende kasutamise vahel mudelis.

Suurte keelemudelite peenhäälestamisel uue teadmisega ilmneb süstemaatiline probleem: mudelid jätavad uued faktid kiiresti meelde, kuid ei suuda neid rakendada järgnevates arutlusülesannetes. Teadlased vormistavad selle nähtuse mõistena „knowing-using gap” ehk teadmise-kasutamise lõhe, mida iseloomustab täpsuse lõhe ja ajaline viivitus meeldejätmise ja üldistamise vahel.

Selle mehhanismi mõistmiseks töötasid autorid välja tehnika nimega „self-patching”, mis kaardistab uue teadmise ruumilise levimise dünaamika mudeli sees. Self-patching tuvastab aktiveerimiskohad, kus esituste ümberpaigutamine parandab oluliselt ebaõnnestunud üldistusjuhtumeid. Tulemused toetavad „teadmisahela mittevastavuse” (knowledge-circuit misalignment) hüpoteesi: meelde jäetud esitused eksisteerivad mudelis küll sisemiselt, kuid neid ei suunata edasi arvutuslikult tõhusatesse kihtidesse – tegemist on pigem suunamis- kui salvestusprobleemiga.

Selle diagnoosi põhjal töötasid teadlased välja lihtsa heuristilise strateegia, mis taastab 58–75 protsenti teoreetiliselt saavutatavast paranemisest ebaõnnestunud üldistusjuhtumite puhul. Katsed viidi läbi eri valdkondades, et tagada tulemuste töökindlus.

Tehnoloogiajuhtidele (CTO) tähendab see, et peenhäälestusstrateegiaid ei tohiks optimeerida üksnes meeldejätmise, vaid ka selle põhjal, et uued teadmiste esitused jõuaksid kihtidesse, mis tegelikult vastutavad arutluse ja probleemide lahendamise eest.


Allikas: arxiv.org · Avaldatud 9. juuli 2026
Lumi AI News — tehisintellekti abil kureeritud vastavalt tehisintellektimääruse artiklile 50. Parafraseerimine ja klassifitseerimine Lumi News Pipeline v1.7.3 abil.

Share on: