Microsoft säger att en analys av 8,2 miljoner Copilot-chattloggar visade få tecken på att chatboten återgav omfattande delar av nyhetsartiklar eller böcker.
Loggarna lämnades till en expert som anlitats av nyhetsutgivare under bevisinsamlingen i en upphovsrättstvist där Microsoft, OpenAI, The New York Times, Center for Investigative Reporting och bokförfattare ingår. Microsoft säger att samtalen valdes eftersom de matchade nyckelord kopplade till utgivarnas webbplatser och därför hade större sannolikhet att innehålla deras material.
Enligt Microsoft innehöll 59 545 samtal minst 16 ord gemensamma med nyhetsinnehåll som användes för att förankra AI-modellen. En expert för Center for Investigative Reporting identifierade 51 fall av ”betydande överlappning” med CIR:s material. I författarnas mål säger Microsoft att endast 24 av de 8,2 miljoner samtalen innehöll svar med minst 30 matchande ord. Bara 10 av 212 utvärderade böcker hade några matchningar, hävdar företaget.
Microsoft hävdar att resultaten stöder företagets ståndpunkt att användning av upphovsrättsskyddat material i dataset för AI-träning kan omfattas av fair use. Företaget säger att Copilot används för andra ändamål än originalverken och att enstaka textåtergivning inte undergräver det omvandlande syftet med träning av stora språkmodeller.
Microsoft lämnade in sin skrivelse på fredagen och begärde summary judgment. Om domaren avslår begäran fortsätter målet i domstol.
Kommentarer
0Inga kommentarer ännu. Skriv den första.