TRAJNO OŠTEĆENJE KNJIGA
Dok tehnološke kompanije ulažu milijarde dolara u razvoj veštačke inteligencije, sve više pažnje privlači način na koji dolaze do materijala za obuku svojih modela. Prema navodima objavljenim u više američkih medija, pojedine AI kompanije navodno kupuju ogromne količine knjiga. To ukljućuje i retka izdanja, kako bi ih brzo digitalizovale i koristile kao podatke za treniranje modela.
U tim izveštajima navodi se da se kod dela kupljenih primeraka uklanja hrbat knjige kako bi stranice mogle da prođu kroz industrijske skenere velikom brzinom. Takav postupak trajno oštećuje fizički primerak. Međutim, postupak omogućava znatno jeftiniju obradu velikog broja knjiga nego što je to slučaj sa sporijim, neinvazivnim metodama digitalizacije.
Brzina protiv očuvanja kulturne baštine
Stručnjaci za digitalizaciju ističu da postoje i neinvazivni skeneri koji mogu da snime i veoma osetljive knjige bez ikakvog fizičkog oštećenja. Takva oprema se već godinama koristi u bibliotekama, arhivima i muzejima širom sveta. Ipak, proces je sporiji i skuplji kada se primenjuje na milione naslova.
Zbog toga je u industrijskim uslovima destruktivno skeniranje i dalje finansijski privlačnije. Ta razlika između očuvanja kulturne baštine i potrebe za ogromnim količinama podataka postala je jedna od glavnih tema u raspravi o razvoju AI.
Milionske porudžbine i rast cena starijih izdanja
Posebnu pažnju izazvali su navodi da su anonimni kupci naručivali i do milion knjiga odjednom. Takve informacije pojavile su se u izveštajima koji prate tržište polovnih i antikvarnih knjiga. Prodavci tvrde da je potražnja za određenim naslovima naglo porasla.
Istovremeno, knjige objavljene pre 2022. godine postale su traženije jer potiču iz perioda pre masovne pojave sadržaja generisanog veštačkom inteligencijom. Istraživači koji proučavaju kvalitet podataka za obuku modela smatraju da takvi tekstovi imaju veću vrednost upravo zato što predstavljaju ljudski napisanu građu. Bez uticaja AI sistema koji su poslednjih godina preplavili internet.