پرونده حقوقی جدید: اوپن‌ای‌آی و مایکروسافت از سرقت محتوا آگاه بودند

یک پرونده حقوقی جدید در دعوای نقض حق تکثیر نیویورک تایمز علیه خدمات بلیط قطار اوپن‌ای‌آی و مایکروسافت، شواهد نگران‌کننده‌ای را فاش کرده است. به بیان ساده، مدیران هر دو شرکت می‌دانستند که در حال سرقت و نقض قانون هستند، اما با این وجود برای آموزش مدل‌های هوش مصنوعی خود با محتوای باکیفیت، به کار خود ادامه دادند.

در ابتدای این پرونده آمده است: «این پرونده، همانطور که مدیر علوم کاربردی مایکروسافت بیان کرده، درباره ‘سرقت حیرت‌انگیز در ابعادی بی‌سابقه’ و شاید ‘بزرگترین سرقت نیروی کار در تاریخ بشر’ است. [اوپن‌ای‌آی و مایکروسافت] میلیون‌ها مقاله دارای حق تکثیر [نیویورک تایمز] را به طور کامل و بدون اجازه کپی کرده‌اند تا محصولات تجاری هوش مصنوعی جایگزین تولید کنند.»

اوپن‌ای‌آی و مایکروسافت به طور واقعی به غیرقانونی بودن دور زدن دیوار پرداخت (paywall) که نیویورک تایمز و سایر ناشران برای محتوای خود دارند، نپرداخته‌اند. اما این شرکت‌ها علناً ادعا کرده‌اند که سرقت محتوا از نیویورک تایمز و سایر تولیدکنندگان محتوا، استفاده منصفانه (fair use) محسوب می‌شود؛ زیرا مدل‌های هوش مصنوعی آن‌ها محتوای اصلی را به نوع جدیدی از محتوا تبدیل می‌کنند که مستقیماً با منبع اصلی رقابت نمی‌کند. اما این ادعا بی‌اساس‌ترین استدلالی است که می‌توان تصور کرد، و اکنون می‌دانیم که حتی اوپن‌ای‌آی و مایکروسافت نیز به آن اعتقادی ندارند.

از جمله نکات موجود در این پرونده، که هر یک در طول کشف شواهد یافت شده‌اند، این است که رئیس ChatGPT در اوپن‌ای‌آی به صورت داخلی نوشته بود که مدل‌های هوش مصنوعی آن‌ها یک «تهدید وجودی» برای ناشران خبری هستند؛ زیرا آن‌ها «عمدتاً جایگزین هستند، و نه صرفاً تحول‌آفرین». بدتر اینکه، «با پیشرفت بیشتر، بیشتر و بیشتر جایگزین خواهند شد.» نیویورک تایمز در این پرونده می‌نویسد که این دیدگاه جدی درباره سرقت محتوا، دفاعیه استفاده منصفانه را «از بین می‌برد»، زیرا «جایگزینی، ‘دشمن حق تکثیر’ است». یعنی «هدف حق تکثیر، ایجاد انگیزه اقتصادی برای خلق آثار اصلی است.»

وکلای نماینده این نشریه همچنین دریافتند که گرگ براکمن، هم‌بنیانگذار و رئیس اوپن‌ای‌آی، به صورت داخلی در موارد جداگانه نوشته بود که مدل‌های هوش مصنوعی آن‌ها «در اخبار عالی» و «در هر کار خبری بسیار خوب» هستند. و ساتیا نادلا، مدیرعامل مایکروسافت، با اشاره به اینکه چت‌بات‌های هوش مصنوعی آن‌ها منابع اصلی را با «ارائه اطلاعات مستقیماً در پلتفرم هوش مصنوعی به جای نیاز به مراجعه به منبع اصلی» «جایگزین» می‌کنند، دفاعیه استفاده منصفانه را تضعیف کرد.

یک سند داخلی مایکروسافت اشاره می‌کند: «استراتژی محتوای هوش مصنوعی ما یک ‘حلقه نابودی’ را آغاز کرده است که به عملکرد مدل‌های ما و کل وب به طور همزمان آسیب می‌رساند. بسیار غیرمعمول است که یک محصول نهایی، بنیان‌های اقتصادی تامین‌کنندگان ضروری خود را تهدید کند، اما این وضعیتی است که ما برای کسب‌وکار LLM خود در رابطه با ‘زنجیره تامین محتوا’ ایجاد کرده‌ایم.»

این پرونده در ادامه به مستندسازی کاهش شدید ترافیک در نیویورک تایمز، ZDNet و سایر تولیدکنندگان محتوا به دلیل ارائه اطلاعات مورد نیاز کاربران توسط هوش مصنوعی و عدم نیاز به کلیک برای مراجعه به منابع اصلی می‌پردازد.

نیویورک تایمز درخواست یک حکم فوری مسئولیت برای سرقت محتوای خود را دارد که بیشتر آن پشت دیوار پرداخت قرار دارد، آموزش مدل هوش مصنوعی حاصله که برای «پیش‌بینی محتوای ژورنالیستی بیانی مقالات کپی شده» طراحی شده است، استفاده از پاسخ‌های چت‌بات هوش مصنوعی بلادرنگ ساخته شده از محتوای سرقت شده، و «معامله پنهانی» که اوپن‌ای‌آی و مایکروسافت محتوای سرقت شده را با یکدیگر به اشتراک گذاشته‌اند.

این پرونده اضافه می‌کند: «هیچ اختلافی وجود ندارد که [اوپن‌ای‌آی و مایکروسافت] در هر نوع کپی‌برداری شرکت داشته‌اند. و آن‌ها نمی‌توانند بار اثبات دفاعیه استفاده منصفانه خود را برای هیچ یک از آن‌ها به دوش بکشند.»