Svet Vesti
Tehnologija

Otkriveno: Anthropic kupio i skenirao milione knjiga u tajnom 'Project Panama'

Otkriveno: Anthropic kupio i skenirao milione knjiga u tajnom 'Project Panama'
Anthropic spent tens of millions of dollars buying books from used-book sellers before dismantling and digitizing them, according to court filings. Internal planning materials also reportedly noted, "We don't want it to be known that we are working on this." Martin Schutt/dpa

Otpečaćeni sudski podnesci otkrivaju da je Anthropic kupovao milione fizičkih knjiga, uklanjao im korice i skenirao svaku stranicu u okviru internog "Project Panama". Kompanija je, prema podnescima, potrošila desetine miliona dolara na nabavku polovnih knjiga, a neke interne beleške su navodile da aktivnosti treba da ostanu nepoznate javnosti. Otkrića su deo tužbe zbog autorskih prava i otvaraju ozbiljna pravna i etička pitanja koja sudovi u SAD još uvek razmatraju.

Novi, otpečaćeni sudski podnesci otkrivaju da je startap za veštačku inteligenciju Anthropic kupovao milione fizičkih knjiga, uklanjao im korice, skenirao svaku stranicu i reciklirao ostatke kako bi napravio podatke za obuku svojih Claude modela.

Projekat, interno nazvan "Project Panama", u dokumentima je opisan kao nastojanje da se "destructively scan all the books in the world" (u slobodnom prevodu: „destruktivno skenirati sve knjige na svetu“). Prema podnescima, kompanija je potrošila desetine miliona dolara na kupovinu knjiga od prodavaca polovnih primeraka pre nego što ih je rastavljala i digitalizovala.

Šta ta otkrića znače

Otkriveni materijali ističu intenzivnu konkurenciju među kompanijama koje razvijaju AI, koje pokušavaju da pribave visokokvalitetne i uredne izvore podataka za obuku. Anthropic je, kako se navodi, smatrao da su knjige posebno vredne zato što pomažu modelima da nauče da formuliraju koherentniji i stilizovaniji tekst u odnosu na podatke skupljene sa otvorenog interneta.

Pravni i etički izazovi

Ove informacije su izašle na videlo kroz tužbu zbog autorskih prava, što dodatno podgrejava raspravu o tome da li i kako zaštićeni sadržaji mogu da se koriste za obuku AI sistema. Ključna pitanja — uključujući pitanje pravedne upotrebe (fair use), prava autora i obaveze kompanija — još uvek rešavaju sudovi u SAD, a mogu imati široke posledice za industriju i zakonodavstvo.

Interni planovi kompanije navodno su sadržali i opasku: "We don't want it to be known that we are working on this."

Dok se slučaj razvija, ovo otkriće podstiče širu debatu o transparentnosti u prikupljanju podataka, zaštiti intelektualne svojine i standardima koji će regulisati buduću upotrebu pisane građe u treniranju AI modela.

Za sada nema potvrde o konačnim pravnim posledicama, ali bi presude u ovom i sličnim slučajevima mogle znatno ograničiti ili redefinisati načine na koje se zaštićeni sadržaji koriste u industriji veštačke inteligencije.

Pomozite nam da budemo bolji.

Povezani članci

Popularno