En føderal domstol har afvist Google og Reddits forsøg på at stoppe en web-scraper med henvisning til DMCA (Digital Millennium Copyright Act). Sagen, som Ars Technica beskriver, handler om, hvorvidt tech-giganter kan bruge ophavsretslovens anti-omgåelsesregler til at forhindre scraping af offentligt tilgængeligt indhold — en praksis, der er central for træning af AI-modeller.
Domstolen afgjorde, at DMCA’s bestemmelser om beskyttelse af adgangskontrol ikke gælder for almindelig web scraping, medmindre der er tale om egentlig hacking. Google og Reddit havde argumenteret for, at scraping af deres sider krænkede deres rettigheder, men retten fandt, at offentligt tilgængelige data ikke er omfattet. En juridisk ekspert citeret af Ars Technica kalder sagen "bizarre" og påpeger, at DMCA er designet til at beskytte ophavsret, ikke til at give platforme ejendomsret over data.
Hvorfor dette er vigtigt: Afgørelsen er principielt vigtig for AI-branchen, fordi den slår fast, at offentligt tilgængeligt indhold kan anvendes til træning, medmindre der er tekniske adgangsbarrierer. Samtidig understreger den, at platforme ikke kan monopolisere data gennem juridisk kreativitet. Google har dog indikeret, at de vil fortsætte kampen, hvilket skaber usikkerhed om fremtidige retningslinjer.
