Škandál jednej z najväčších tech firiem sveta. Revolučnú AI trénuje cez torrenty

Autor: Peter Čítanie na 3 min.

Zuckerberg o tom vedel

Spoločnosť Meta, materská firma Facebooku, sa ocitla uprostred rozsiahleho súdneho sporu kvôli používaniu pirátskych kníh pri trénovaní svojich modelov umelej inteligencie. Autori spoločnosť obviňujú z masívneho porušovania autorských práv, čo otvára diskusiu o etike a legálnosti využívania dát v technologickom sektore.

Podľa súdnych dokumentov získala Meta cez torrenty minimálne 81,7 terabajtu textov, vrátane známych pirátskych knižníc Z-Library a LibGen. Viac ako 35,7 terabajtu pochádzalo z pirátskych zdrojov. Navyše, už v minulosti získala Meta z LibGen viac ako 80 terabajtov dát. Spoločnosť tvrdí, že ide o legálnu prax spadajúcu pod „fair use,“ no žalobcovia upozorňujú, že aj malé množstvo takto získaných dát môže viesť k trestnému vyšetrovaniu.

Aj interné e-maily odhalili, že niektorí zamestnanci Mety mali vážne etické pochybnosti. Nikolay Bashlykov, výskumný inžinier spoločnosti, označil torrentovanie pirátskych kníh za neetické a právne rizikové. Meta sa údajne tieto aktivity snažila zakryť. Spoločnosť nepoužívala servery Facebooku, aby zabránila spätnému vystopovaniu. Torrentovací klienti boli nastavení tak, aby minimalizovali zdieľanie dát do výmenných sietí.

Meta AI
Zdroj: ChatGPT

Dokumenty tiež naznačujú, že o používaní pirátskych dát vedel aj samotný šéf spoločnostiMark Zuckerberg. To však protirečí jeho predchádzajúcim tvrdeniam, že s tými nemal nič spoločné. Táto skutočnosť vrhá tiež na obranu Mety v súdnom procese, kde autori rozšírili teóriu distribúcie o tvrdenie, že Meta nelegálne „seedovala“ pirátske knihy.

Meta nie je jediná, má to širší súvis

Meta však nie je vôbec jediná firma, ktorá čelí podobným obvineniam. Autori a autorky (napríklad Paula Tremblaye či Sarah Silverman) žalujú aj spoločnosti OpenAI, Nvidia a Databricks za používanie pirátskych kníh na trénovanie svojich modelov umelej inteligencie. Tento spor odhaľuje širší problém v technologickom sektore, kde firmy čerpajú dáta z neoverených zdrojov. Paradoxom je tiež to, že OpenAI nedávno obvinila čínsky DeepSeek z toho, že trénovala svoju AI na jej výstupoch, čím porušila pravidlá používania.

Slováci môžu dnes zo spomínaných nástrojov umelej inteligencie využívať ChatGPT aj DeepSeek, populárny je aj nástroj Gemini od Googlu. Meta AI na Slovensku a v krajinách Európskej únie zatiaľ dostupná nie je, dôvodom sú regulačné nejasnosti týkajúce sa práve používania dát na trénovanie AI modelov.

 

✅ Odporúčané pre teba

🔥 Najnovšie príspevky zo skriptu

Posledná časť 3. série bude neuveriteľná. Finále Rod draka prekvapí príbehom

Autor: Erik Košťany

Finále 3. série Rod draka Pondelky patria posledné týždne hlavne jednému seriálu. Ním je Rod draka, ktorý po dvoch rokoch…

Toto je zlý sen. Státisíce Slovákov prišli o obľúbené TV kanály

Autor: Kristína Sudorová

Telekom vypol obľúbené detské aj hudobné kanály Zákazníkov Telekomu a DIGI TV čakajú ďalšie zmeny v televíznej ponuke. Operátor totiž…

Klienti slovenskej banky majú dôvod na radosť: Banka im nechá viac peňazí vo vrecku

Autor: Kristína Sudorová

Za túto službu už nezaplatíte ani cent Slovenská sporiteľňa upravila svoj sadzobník a priniesla zmenu, ktorá môže klientom ušetriť nemalé…

Na obľúbenej službe Slovákov zavedú úplne novú kontrolu

Autor: Slavomír Dzuričko

Spotify pritvrdzuje. Niektorí používatelia budú musieť overiť svoj vek Spotify zavádza nové opatrenia, ktoré majú lepšie chrániť deti a mladistvých…

Vlaky na Slovensku spomalia na „slimačiu“ rýchlosť. Horúčavy sú kritické

Autor: Slavomír Dzuričko

Meškania budú nevyhnutné Extrémne horúčavy zasiahli v utorok 4. augusta železničnú dopravu na Slovensku. Železnice Slovenskej republiky (ŽSR) zavádzajú na…

Harry Potter je späť v kinách s unikátnym filmom. Slováci si ho pozrú len jeden týždeň

Autor: Kristína Sudorová

Magický návrat, na ktorý fanúšikovia čakali Pre fanúšikov čarodejníckeho sveta je rok 2026 mimoriadne bohatý na novinky. Zatiaľ čo koncom…