خانه / آموزش و پژوهش / فناوری / علامت گذاری محتوای تولید شده توسط مدل‌های جدید هوش مصنوعی

علامت گذاری محتوای تولید شده توسط مدل‌های جدید هوش مصنوعی

محمد حسن اسدی طاری

کلاود اکنون یک علامت گذاری نامرئی را برای علامت گذاری درون کلمات معمولی پنهان می‌کند. کلاود شروع به علامت گذاری کردن هر چیزی که می‌نویسد خواهد کرد.

شرکت آنتروپیک اعلام کرده است که «مدل‌های جدید از همان روز اول محتوای تولید شده توسط هوش مصنوعی را علامت‌گذاری خواهند کرد»(۱).

این یک گام قابل توجه برای کلاود است، زیرا نه تنها در مورد هر تصویری که تولید می‌کند، که علامت گذاری کردن آنها نسبتاً آسان است، بلکه در مورد هر متنی که تولید می‌کند نیز صدق می‌کند.

آنتروپیک می‌گوید که مدل‌های کلاود یک «علامت گذاری نامحسوس» خواهند داشت که مستقیماً در متن تولید شده در سطح مدل جاسازی می‌شود. این شرکت می‌گوید که این علامت باید از کپی/پیست کردن و ویرایش‌های جزئی جان سالم به در ببرد.

خطر از دست دادن مشتریان

بررسیها نشان می دهدبه این ترتیب کلاود در شرف از دست دادن مشتریان خواهد بود، مگر اینکه دور زدن علامت‌گذاری نسبتاً آسان باشد، یا همه بازیگران اصلی هوش مصنوعی بلافاصله از این الگو پیروی کنند.

اگر قرار باشد هر متنی که کلاود تولید می‌کند به‌راحتی به‌عنوان متنِ هوش مصنوعی شناسایی شود، آنگاه این ابزار برای بسیاری از کسانی که اکنون از آن برای تولید متن استفاده می‌کنند.

مسئله دیگر، استفاده از کلاود برای بازخوانی و ویرایش متون خود نویسندگان است. سوال مهم این است که:

آیا اگر توصیه‌های ویرایشی کلاود را بپذیرید، متن شما هم به‌عنوان متنِ هوش مصنوعی علامت‌گذاری خواهد شد؟

شاید واکنش اولیه این باشد که: «عالی است! باید افراد را ملزم کرد که اعلام کنند چه زمانی هوش مصنوعی مطلبی را نوشته است؛ وقت آن رسیده که مردم دوباره خودشان دست‌به‌قلم شوند!».

اما تا زمانی که کلاود تنها مورد از میان سه هوش مصنوعی بزرگ باشد که چنین کاری انجام می‌دهد، احتمالا بسیاری از کاربران به سراغ «چت‌جی‌پی‌تی» یا «جمینای» خواهند رفت، زیرا نمی‌خواهند مشخص شود که در کارشان از هوش مصنوعی استفاده کرده‌اند.

معمولاً انتخاب کلمات بر اساس توزیع احتمالات مدل انجام می‌شود. یک سیستم علامت گذاری می‌تواند با استفاده از یک کلید، توکن‌های (واحدهای متنی) ممکن را به‌صورت پنهانی به دو گروه «مطلوب» و «نامطلوب» تقسیم کند. سپس کلاود، گرایش آماری بسیار جزئی‌ای به سمت گروه مطلوب ایجاد می‌کند.

یک کلمه به‌تنهایی چیزی را مشخص نمی‌کند؛ اما در متنی شامل ۵۰۰ یا ۱۰۰۰ کلمه، ابزار تشخیص (که کلید را در اختیار دارد) می‌تواند بررسی کند که آیا متن، توکن‌های مطلوب را به‌مراتب بیشتر از حدِ احتمالیِ تصادفی انتخاب کرده است یا خیر؟ اگر پاسخ مثبت باشد، شواهد آماری نشان می‌دهد که متن توسط آن مدلِ دارای علامت گذاری تولید شده است.

بنابراین، این علامت گذاری بیشتر شبیه به یک اثر انگشت آماریِ محو است که در میان صدها انتخاب توزیع شده؛ همین ویژگی توضیح می‌دهد که چرا این نشان‌گذاری حتی پس از کپی و پیست کردن متن نیز باقی می‌ماند. در واقع، شما همراه با کلمات، آن اثر انگشت را هم کپی می‌کنید.

اما آیا می‌توانید این قابلیت را شکست؟

از آنجا که شرکت آنتروپیک هنوز ابزاری برای تشخیص متن‌های تولیدشده توسط هوش مصنوعی منتشر نکرده است، نمی‌توان گفت که شکستن این کد صرفاً با تغییر چند کلمه چقدر آسان خواهد بود. برای مثال، اگر مقاله ۱۰۰۰ کلمه‌ای خود را که توسط کلاود نوشته شده به یک مدل زبانی بزرگ (LLM) دیگر بدهید و از آن بخواهید «این متن را با حفظ معنا، کاملاً با کلماتی متفاوت بازنویسی کند»، آیا آن متن دیگر توسط ابزارهای تشخیص هوش مصنوعی قابل شناسایی نخواهد بود؟

شاید مسئله مهم‌تر این باشد که کلاود این اقدام را برای رعایت «ماده ۵۰، بند ۲» از قانون هوش مصنوعی اتحادیه اروپا انجام داده است. از تاریخ ۲ اوت ۲۰۲۶، ارائه‌دهندگان سیستم‌های هوش مصنوعی مولد(۲) که متن، تصویر، صوت یا ویدئو تولید می‌کنند، ملزم هستند خروجی‌های خود را به‌گونه‌ای آماده کنند که برای ماشین قابل‌خواندن بوده و امکان تشخیص مصنوعی بودن یا دستکاری‌شده بودن آن‌ها وجود داشته باشد (البته تا حدی که از نظر فنی امکان‌پذیر باشد). سیستم‌های موجود برای رعایت این الزام خاص، یک دوره گذار محدود تا ۲ دسامبر ۲۰۲۶ در اختیار خواهند داشت.

نکته‌ای در بیانیه آنتروپیک تأیید می‌کند که افزودن این علامت گذاری‌ها (نشان‌های دیجیتال) شامل تمام مدل‌های فعلی کلاود نیز می‌شود و تنها به مدل‌های جدیدی که در آینده تولید می‌شوند، محدود نخواهد بود.

سیستم جدید آنتروپیک صراحتاً پاسخی به آن قوانین است و این شرکت اعلام کرده که علامت گذاری مذکور در سطح جهانی اعمال خواهد شد، نه فقط زمانی که کلاود در اروپا مورد استفاده قرار می‌گیرد. به‌طور کلی، اگر OpenAI و گوگل بخواهند سیستم‌های هوش مصنوعی مولد مشمول این قانون را در اتحادیه اروپا عرضه کنند، با الزامات مشابهی روبرو خواهند بود.

OpenAI و گوگل اگرچه از ارائه اظهارنظر مشخص درباره این موضوع خودداری کرده اند، اما در بیانیه مختصری تاکید کرده اند:

به دنبال اجرای تعهداتمان ذیل “آیین‌نامه عمل کمیسیون اروپا در خصوص شفافیت محتوای تولیدشده توسط هوش مصنوعی”، هدف ما گسترش نشانگرهای منشأ تولید انواع محتوا از جمله متن است؛ بدین ترتیب، هم‌زمان با تکامل استانداردها و ابزارها، مشتریان و توسعه‌دهندگان راهکارهای مشخصی برای عمل به تعهدات خود در زمینه شفافیت در اختیار خواهند داشت.

۱-https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content?utm_source=chatgpt.com

۲-Generative AI

انتهای پیام/

درباره ی editor

مطلب پیشنهادی

تسلا و تاکسی سایبری در آستانه تحقق واقعیت

محمد حسن اسدی طاری سرمایه‌گذاران تسلا در حال آماده شدن برای رویداد رونمایی از تاکسی ...

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

کلیکس سافت