Ifølge en forbandende rapport fra 404 Mediaunderstøttet af interne Slack-chats, e-mails og dokumenter indhentet af forretningen, hjalp Nvidia sig selv til “en menneskelig livstidsvisuel oplevelse værd af træningsdata pr. dag,” Ming-Yu Liu, vicepræsident for forskning hos Nvidia og en Cosmos-projektleder , indrømmet i en e-mail fra maj.
Unavngivne tidligere Nvidia-medarbejdere fortalte 404, at de var blevet bedt om at skrabe videoindhold fra Netflix, YouTube og andre onlinekilder for at få træningsdata til brug med virksomhedens forskellige AI-produkter. Disse inkluderer Nvidias Omniverse 3D-verdensgenerator, selvkørende bilsystemer og “digitalt menneske.”
Da disse medarbejdere spurgte om lovligheden af projektet, internt ved navn Cosmos, blev de forsikret af ledelsen om, at de havde fået tilladelse fra de højeste niveauer i virksomheden til at bruge dette indhold.

Få din ugentlige nedtagning af teknologien bag pc-spil
Projektet søgte at bygge en fundamentmodel, der ligner Gemini 1.5, GPT-4 eller Llama 3.1, “der indkapsler simulering af lystransport, fysik og intelligens på ét sted for at låse op for forskellige downstream-applikationer, der er vigtige for Nvidia.”
For at gøre dette brugte Project Cosmos angiveligt en open source-videodownloader og brugte maskinlæring til IP-hop, og undgik derved YouTubes forsøg på at blokere det. Ifølge e-mails set af 404 diskuterede projektledere at bruge så mange som 30 virtuelle maskiner, der kører på Amazon Web Services til at downloade 80 års værdi af videoer i fuld længde og kliplængde hver dag.
På sin side hævder Nvidia ingen fejl. “Vi respekterer rettighederne for alle indholdsskabere og er overbeviste om, at vores modeller og vores forskningsindsats er i fuld overensstemmelse med bogstavet og ånden i ophavsretsloven,” sagde en talsmand for Nvidia til 404 Media via e-mail. “Ophavsretsloven beskytter bestemte udtryk, men ikke fakta, ideer, data eller information. Enhver er fri til at lære fakta, ideer, data eller information fra en anden kilde og bruge den til at give deres egne udtryk. Fair use beskytter også evnen til at bruge et værk til et transformativt formål, såsom modeltræning.”
Det er langt fra første gang, at Nvidia (for ikke at nævne det store flertal af resten af AI-feltet) har taget en “skrabe først og måske bede om tilgivelse senere” tilgang til sin AI-træningsindsats. I juli blev Nvidia navngivet i en anden rapport om ulovlig skrabning af ophavsretligt beskyttede videoer sammen med Anthropic og Salesforce.
Ved CES 2024 satte virksomheden gang i en internetbrandstorm med sine tvetydige svar på, hvordan dens nye generative AI til spilmotor blev trænet. Som svar gentog Nvidia, at dets værktøjer var “kommercielt sikre.”
Støt vores arbejde ❤️
Hvis du kunne lide denne artikel, kan du overveje at give drikkepenge for at hjælpe os med fortsat at udgive kvalitetsindhold.



















