A mesterséges intelligencia (MI) fejlesztésével foglalkozó vállalatok új stratégiát alkalmaznak a modelljeik betanítására: régi, gyakran ritka könyveket vásárolnak fel milliós nagyságrendben, amelyeket feldolgozás után megsemmisítenek. Ez a gyakorlat a 404 Media cikke alapján, a Futurism jelentése szerint, arra vezethető vissza, hogy a 2022 után, az MI-chatbotok széleskörű elterjedése óta íródott könyvek és egyéb digitális tartalmak jelentős része már mesterséges intelligencia által generált anyagnak minősül, és így kevésbé alkalmas a tiszta, emberi alkotású adatokra épülő MI-tréningre.
A könyvek felhasználása az MI-rendszerek betanítására nem új keletű jelenség. Korábban is ismert volt, hogy olyan nagyvállalatok, mint a Meta vagy az Anthropic, hasonló módszerekkel gyűjtöttek adatokat. Az Anthropic például nagy mennyiségben szerzett be használt könyveket, amelyeknek levágták a gerincét, majd beszkennelték az oldalait.
Ezt követően a fizikai könyveket, miután tartalmukat digitális formában rögzítették, jellemzően kidobták.
A cégek jogi szempontból is megalapozottnak látják ezt az eljárást. Egy bírói döntés értelmében ugyanis a megvásárolt könyvek tartalmát nem továbbértékesítik, hanem csupán feldolgozzák, ami a vásárló jogaival összhangban áll. Ez a jogi értelmezés további bátorítást adott a könyvbeszerzőknek, akik korábban könyvtárakat és könyvesboltokat segítettek, most pedig igyekeznek kihasználni az MI-iparágban rejlő profitálási lehetőségeket.
Az ISBNdb nevű szolgáltató például nyíltan hirdeti, hogy a régi könyvek sokkal hatékonyabb tananyagot biztosítanak a mesterséges intelligencia számára, mint a modern internet vagy az újonnan megjelent könyvek. A vállalat tisztában van azzal, hogy a könyvek bezúzása negatív PR-t jelenthetne a fejlesztő cégek számára, ezért titoktartási szerződéseket is kínál szolgáltatásaihoz. A 404 Media információi szerint a nagyobb MI-fejlesztő vállalatok egyszerre több ezer, sőt akár egymillió könyvet is rendelhetnek az ISBNdb-től, ezzel is jelezve a régi, analóg tartalmak iránti hatalmas keresletet az MI-modellek finomhangolásához.
Ez a tendencia rávilágít arra, hogy a mesterséges intelligencia fejlődésével párhuzamosan milyen új kihívások és etikai kérdések merülnek fel az adatgyűjtés és a kulturális örökség megőrzése terén. Miközben az MI-rendszerek egyre kifinomultabbá válnak, az emberi alkotások eredetisége és a hiteles adatokhoz való hozzáférés kulcsfontosságú marad a technológia felelős fejlesztéséhez.
📰 Forrás: Telex — Eredeti cikk elolvasása