یکی از مدیران مایکروسافت استفاده OpenAI از مطالب ناشران را «بزرگترین سرقت نیروی کار در تاریخ بشر» نامید.
به گزارش ارتباط امروز، براساس اظهارات سردبیران رسانه ها در پروندهای که این هفته بدون حذفیات منتشر شد(۱)، شرکتهای هوش مصنوعی از گنجینههای عظیمی از متون منتشر شده برای آموزش مدلهای زبانی بزرگ خود استفاده میکردند و مدیران این شرکتها میدانستند که انجام این کار سرقت مطالب دارای حق چاپ است.
این دادخواست در ابتدا در اوایل این ماه در یک دادرسی ثبت شد که چندین پرونده نقض حق چاپ مرتبط علیه OpenAI، سازنده ChatGPT، و شریک آن مایکروسافت، از جمله دعاوی مطرح شده توسط نیویورک تایمز و Ziff Davis، مالک CNET، را گرد هم میآورد.
برنت هخت(۲)، مدیر علوم کاربردی مایکروسافت، طبق پرونده ناشران، آن را «سرقتی شگفتانگیز با ابعاد بیسابقه» و شاید «بزرگترین سرقت نیروی کار در تاریخ بشر» نامید. تمام مدارکی که زمینه نقل قولهای موجود در پرونده را نشان میدهند، همچنان مهر و موم شده هستند.
به نظر میرسد اظهارات مورد استناد ناشران، استدلال شرکتهای هوش مصنوعی را مبنی بر اینکه استفاده از مطالب دارای حق نشر تحت عنوان «استفاده منصفانه» (Fair Use) از حمایت قانونی برخوردار است، تضعیف میکند. بر اساس این دکترین حقوقی، استفاده از مطالب دارای حق نشر بسته به نحوه استفاده، ماهیت اثر، میزان بخشِ مورد استفاده و تأثیر آن استفاده بر بازارِ آن اثر، مشمول حمایت قانونی میشود.
به موجب محتویات قابل انتشار این پرونده، ساتیا نادلا، مدیرعامل مایکروسافت می گوید: مکالمات با چتباتها اطلاعات را «همانجا در وبسایت پلتفرم هوش مصنوعی ارائه میدهند، در حالی که نیازی به مراجعه به منبع اصلی» مانند وبسایت ناشری که اطلاعات را گزارش کرده است، نیست. به طور مشابه، یکی از مدیران OpenAI نوشت که ناشران با «تهدید وجودی» از سوی محصولاتی مانند چتبات این شرکت مواجه هستند.
در عین حال، در این پرونده آمده است که نادلا شهادت داده است که هر چیزی که پشت دیوار پرداخت است «باید توسط هر کسی که میخواهد از آن برای توسعه هوش مصنوعی استفاده کند، مجوز داشته باشد» و اگر او میدانست که OpenAI بر اساس محتوای دارای دیوار پرداخت آموزش دیده است، از OpenAI میخواست که مدلهای خود را دوباره آموزش دهد.
این در حالیست که سخنگوی مایکروسافت اعلام کرد نظرات هِخت بیان کننده دیدگاههای رسمی مایکروسافت نیست(۳). ساتیا نادلا(۴) گفت: که نظرات نادلا به تغییرات در نحوه مصرف اطلاعات توسط مردم پرداخته و «کاملاً با موضع قانونی شرکت سازگار» است.) «این مشاهدات نباید با نتیجهگیریها در مورد سوالات مربوط به حق نشر در دادگاه، که مایکروسافت در پروندههای خود به آنها میپردازد، اشتباه گرفته شود.»
مایکروسافت در گزارش خود در این پرونده گفت که استفاده از محتوای منتشر شده برای آموزش LLM ها به طور قابل توجهی دگرگونکننده است. این شرکت استدلال کرد: «قانون حق نشر به دارندگان حق نشر اجازه نمیدهد که فناوریهای دگرگونکنندهای مانند LLM ها را مسدود کنند. این قانون چنین کاربردهایی را با این انتظار که دارندگان حق نشر خود را وفق دهند و عموم مردم از آن بهتر شوند، تشویق میکند.»
LLM ها در مورد هر چه بیشتر محتوای منتشر شده که توسعه دهندگان بتوانند به آن دسترسی پیدا کنند، آموزش میبینند و دعاوی مربوط به حق چاپ – از جمله پروندههای مرتبط با نویسندگان کتاب – میتواند تأثیر قابل توجهی بر شرکتهای هوش مصنوعی و رسانههای مختلف داشته باشد. ناشران استدلال میکنند که شرکتهای هوش مصنوعی باید برای صدور مجوز محتوایی که استفاده میکنند، هزینه بپردازند، در حالی که شرکتهای فناوری میگویند انجام این کار برای توسعه هوش مصنوعی توانمندتر، غیرضروری و سنگین است. دولت ترامپ اوایل این ماه با بیانیهای در این مورد اظهار نظر کرد که الزام صدور مجوز، مانع توسعه هوش مصنوعی آمریکا در رقابت با چین میشود.
روزنامه نگاران استدلال میکنند که کارمندان OpenAI و مایکروسافت نیز میدانستند که توانایی چتباتهای آنها در یافتن، کپی کردن، خلاصه کردن و گاهی اوقات برگرداندن محتوا از ناشران، خوانندگان را از بازدید از سایتهای سازمانهای خبری باز میدارد.
۱-https://www.cnet.com/tech/services-and-software/ai-firms-knew-chatbots-were-an-existential-threat-to-journalists-court-docs-show
۲-Brent Hecht
۳-https://www.cnet.com/tech/services-and-software/anthropics-ai-training-on-books-is-fair-use-judge-rules-authors-are-more-worried-than-ever
۴-Satya Nadella
انتهای پیام/منبع: ارتباط تک
فرهنگ پذیری پایگاه خبری اجتماعی – فرهنگی
