یک پرونده حقوقی جدید در دعوای نقض حق تکثیر نیویورک تایمز علیه خدمات بلیط قطار اوپنایآی و مایکروسافت، شواهد نگرانکنندهای را فاش کرده است. به بیان ساده، مدیران هر دو شرکت میدانستند که در حال سرقت و نقض قانون هستند، اما با این وجود برای آموزش مدلهای هوش مصنوعی خود با محتوای باکیفیت، به کار خود ادامه دادند.
در ابتدای این پرونده آمده است: «این پرونده، همانطور که مدیر علوم کاربردی مایکروسافت بیان کرده، درباره ‘سرقت حیرتانگیز در ابعادی بیسابقه’ و شاید ‘بزرگترین سرقت نیروی کار در تاریخ بشر’ است. [اوپنایآی و مایکروسافت] میلیونها مقاله دارای حق تکثیر [نیویورک تایمز] را به طور کامل و بدون اجازه کپی کردهاند تا محصولات تجاری هوش مصنوعی جایگزین تولید کنند.»
اوپنایآی و مایکروسافت به طور واقعی به غیرقانونی بودن دور زدن دیوار پرداخت (paywall) که نیویورک تایمز و سایر ناشران برای محتوای خود دارند، نپرداختهاند. اما این شرکتها علناً ادعا کردهاند که سرقت محتوا از نیویورک تایمز و سایر تولیدکنندگان محتوا، استفاده منصفانه (fair use) محسوب میشود؛ زیرا مدلهای هوش مصنوعی آنها محتوای اصلی را به نوع جدیدی از محتوا تبدیل میکنند که مستقیماً با منبع اصلی رقابت نمیکند. اما این ادعا بیاساسترین استدلالی است که میتوان تصور کرد، و اکنون میدانیم که حتی اوپنایآی و مایکروسافت نیز به آن اعتقادی ندارند.
از جمله نکات موجود در این پرونده، که هر یک در طول کشف شواهد یافت شدهاند، این است که رئیس ChatGPT در اوپنایآی به صورت داخلی نوشته بود که مدلهای هوش مصنوعی آنها یک «تهدید وجودی» برای ناشران خبری هستند؛ زیرا آنها «عمدتاً جایگزین هستند، و نه صرفاً تحولآفرین». بدتر اینکه، «با پیشرفت بیشتر، بیشتر و بیشتر جایگزین خواهند شد.» نیویورک تایمز در این پرونده مینویسد که این دیدگاه جدی درباره سرقت محتوا، دفاعیه استفاده منصفانه را «از بین میبرد»، زیرا «جایگزینی، ‘دشمن حق تکثیر’ است». یعنی «هدف حق تکثیر، ایجاد انگیزه اقتصادی برای خلق آثار اصلی است.»
وکلای نماینده این نشریه همچنین دریافتند که گرگ براکمن، همبنیانگذار و رئیس اوپنایآی، به صورت داخلی در موارد جداگانه نوشته بود که مدلهای هوش مصنوعی آنها «در اخبار عالی» و «در هر کار خبری بسیار خوب» هستند. و ساتیا نادلا، مدیرعامل مایکروسافت، با اشاره به اینکه چتباتهای هوش مصنوعی آنها منابع اصلی را با «ارائه اطلاعات مستقیماً در پلتفرم هوش مصنوعی به جای نیاز به مراجعه به منبع اصلی» «جایگزین» میکنند، دفاعیه استفاده منصفانه را تضعیف کرد.
یک سند داخلی مایکروسافت اشاره میکند: «استراتژی محتوای هوش مصنوعی ما یک ‘حلقه نابودی’ را آغاز کرده است که به عملکرد مدلهای ما و کل وب به طور همزمان آسیب میرساند. بسیار غیرمعمول است که یک محصول نهایی، بنیانهای اقتصادی تامینکنندگان ضروری خود را تهدید کند، اما این وضعیتی است که ما برای کسبوکار LLM خود در رابطه با ‘زنجیره تامین محتوا’ ایجاد کردهایم.»
این پرونده در ادامه به مستندسازی کاهش شدید ترافیک در نیویورک تایمز، ZDNet و سایر تولیدکنندگان محتوا به دلیل ارائه اطلاعات مورد نیاز کاربران توسط هوش مصنوعی و عدم نیاز به کلیک برای مراجعه به منابع اصلی میپردازد.
نیویورک تایمز درخواست یک حکم فوری مسئولیت برای سرقت محتوای خود را دارد که بیشتر آن پشت دیوار پرداخت قرار دارد، آموزش مدل هوش مصنوعی حاصله که برای «پیشبینی محتوای ژورنالیستی بیانی مقالات کپی شده» طراحی شده است، استفاده از پاسخهای چتبات هوش مصنوعی بلادرنگ ساخته شده از محتوای سرقت شده، و «معامله پنهانی» که اوپنایآی و مایکروسافت محتوای سرقت شده را با یکدیگر به اشتراک گذاشتهاند.
این پرونده اضافه میکند: «هیچ اختلافی وجود ندارد که [اوپنایآی و مایکروسافت] در هر نوع کپیبرداری شرکت داشتهاند. و آنها نمیتوانند بار اثبات دفاعیه استفاده منصفانه خود را برای هیچ یک از آنها به دوش بکشند.»