Objavljeno: 24.7.2026 09:00

Stare tiskane knjige so postale najdragocenejši vir za učenje umetne inteligence

Podjetja, ki razvijajo modele umetne inteligence, se soočajo z nenavadnim problemom lastne proizvodnje.

Odprti splet je vse bolj preplavljen z besedili, generiranimi s pomočjo umetne inteligence, zaradi česar umetno inteligentnim modelom grozi zlom, pri katerem algoritmi ob učni prehrani na lastnih izmetih postajajo vse slabši in bolj nagnjeni k napakam. Podatkovni posrednik ISBNdb zato podjetjem ponuja nepričakovano rešitev - masovni odkup fizičnih tiskanih knjig, izdanih pred letom 2022, ki veljajo za zadnji velik in preverjen vir izključno človeškega znanja. Dodaten razlog so spletna besedila, ki so s tako imenovanim zastrupljanjem podatkov (ang. data poisoning) s posebnimi orodji zaščitena pred nepooblaščenim dostopom umetne inteligence. Stare tiskane knjige so pred takšnimi zaščitnimi mehanizmi povsem varne, pri čemer ISBNdb podjetjem ponuja stroge pogodbe o zaupnosti, saj je masovno uničevanje knjig za potrebe tehnoloških gigantov izjemno občutljivo področje. Hitra digitalizacija namreč pogosto zahteva rezanje hrbtišč in uničenje fizičnih izvodov, kar je v ZDA sodišče v odmevni tožbi proti podjetju Anthropic sicer že opredelilo kot dopustno uporabo (ang. fair use).

Paradoksalno je industrija, ki je obljubljala digitalizacijo in lahek dostop do vsega človeškega znanja, ustvarila trg, na katerem se stare tiskane knjige kupujejo na tone in masovno uničujejo le zato, da bi stroji prišli do zadnjih »čistih« besedil, ki jih ni napisal noben drug algoritem.

Stare tiskane knjige so postale najdragocenejši vir za učenje umetne inteligence

Več novic

Naroči se na redna tedenska ali mesečna obvestila o novih prispevkih na naši spletni strani!

Komentirajo lahko le prijavljeni uporabniki

Najbolj brano

 
  • Polja označena z * je potrebno obvezno izpolniti
  • Pošlji