Otpečaćeni sudski podnesci otkrivaju da je Anthropic kupovao milione fizičkih knjiga, uklanjao im korice i skenirao svaku stranicu u okviru internog "Project Panama". Kompanija je, prema podnescima, potrošila desetine miliona dolara na nabavku polovnih knjiga, a neke interne beleške su navodile da aktivnosti treba da ostanu nepoznate javnosti. Otkrića su deo tužbe zbog autorskih prava i otvaraju ozbiljna pravna i etička pitanja koja sudovi u SAD još uvek razmatraju.
Otkriveno: Anthropic kupio i skenirao milione knjiga u tajnom 'Project Panama'

Novi, otpečaćeni sudski podnesci otkrivaju da je startap za veštačku inteligenciju Anthropic kupovao milione fizičkih knjiga, uklanjao im korice, skenirao svaku stranicu i reciklirao ostatke kako bi napravio podatke za obuku svojih Claude modela.
Projekat, interno nazvan "Project Panama", u dokumentima je opisan kao nastojanje da se "destructively scan all the books in the world" (u slobodnom prevodu: „destruktivno skenirati sve knjige na svetu“). Prema podnescima, kompanija je potrošila desetine miliona dolara na kupovinu knjiga od prodavaca polovnih primeraka pre nego što ih je rastavljala i digitalizovala.
Šta ta otkrića znače
Otkriveni materijali ističu intenzivnu konkurenciju među kompanijama koje razvijaju AI, koje pokušavaju da pribave visokokvalitetne i uredne izvore podataka za obuku. Anthropic je, kako se navodi, smatrao da su knjige posebno vredne zato što pomažu modelima da nauče da formuliraju koherentniji i stilizovaniji tekst u odnosu na podatke skupljene sa otvorenog interneta.
Pravni i etički izazovi
Ove informacije su izašle na videlo kroz tužbu zbog autorskih prava, što dodatno podgrejava raspravu o tome da li i kako zaštićeni sadržaji mogu da se koriste za obuku AI sistema. Ključna pitanja — uključujući pitanje pravedne upotrebe (fair use), prava autora i obaveze kompanija — još uvek rešavaju sudovi u SAD, a mogu imati široke posledice za industriju i zakonodavstvo.
Interni planovi kompanije navodno su sadržali i opasku: "We don't want it to be known that we are working on this."
Dok se slučaj razvija, ovo otkriće podstiče širu debatu o transparentnosti u prikupljanju podataka, zaštiti intelektualne svojine i standardima koji će regulisati buduću upotrebu pisane građe u treniranju AI modela.
Za sada nema potvrde o konačnim pravnim posledicama, ali bi presude u ovom i sličnim slučajevima mogle znatno ograničiti ili redefinisati načine na koje se zaštićeni sadržaji koriste u industriji veštačke inteligencije.
Pomozite nam da budemo bolji.




























