افزودن واترمارک نامرئی به متون ChatGPT و Codex توسط OpenAI

باشگاه خبرنگاران جوان؛ جواد فراهانی - شرکت OpenAI در حال آمادهسازی برای افزودن یک واترمارک (نشانگذاری) نامرئی به متون تولیدشده توسط ابزارهای هوش مصنوعی خود، بهویژه ChatGPT و Codex است. هدف از این اقدام، تسهیل شناسایی محتوای تولیدشده توسط هوش مصنوعی در شرایطی است که وابستگی به این ابزارها برای نوشتن و تولید محتوای دیجیتال رو به افزایش است.
این واترمارک جدید چیست؟
OpenAI این سیستم جدید واترمارکگذاری را «textGrain» مینامد. عملکرد آن بدین صورت است که الگوهای انتخاب کلمه توسط مدل را بهگونهای نامحسوس تغییر میدهد که برای خوانندگان انسانی قابل تشخیص نباشد. ابزارهای تشخیص OpenAI میتوانند این الگو را شناسایی کنند و تأیید نمایند که متن توسط یکی از مدلهای این شرکت تولید شده است. از آنجا که این واترمارک در خودِ فرآیند تولید متن تعبیه میشود، حتی در صورت کپی و پیست کردن متن در جای دیگر، همچنان قابل تشخیص باقی میماند.
چرا OpenAI این قابلیت را راهاندازی میکند؟
این اقدام در راستای الزامات «قانون هوش مصنوعی اتحادیه اروپا» (EU AI Act) صورت میگیرد؛ قانونی که ارائهدهندگان خدمات هوش مصنوعی مولد را ملزم میکند تا اطمینان حاصل کنند محتوای تولیدشده توسط هوش مصنوعی برای ماشینها قابل شناسایی باشد. OpenAI قصد دارد «textGrain» را در آیندهای نزدیک در اتحادیه اروپا عرضه کند، هرچند هنوز زمان عرضه جهانی آن را اعلام نکرده است. این شرکت همچنین سیستم مذکور را بهعنوان قابلیتی اختیاری برای مشتریان API در سراسر جهان و برای مدلهای منتخب در دسترس قرار داده و برنامههایی برای ارائه ابزار تشخیص به پژوهشگران و مؤسسات تخصصی دارد.
آیا این واترمارک بر کیفیت متن تأثیر میگذارد؟
به گفته OpenAI، استفاده از این واترمارک منجر به تغییرات قابلتوجهی در عملکرد مدل نشده است؛ این شرکت در آزمونهای مختلف سنجش عملکرد (بنچمارک) هوش مصنوعی، نتایج مشابهی را میان متون دارای واترمارک و متون بدون واترمارک مشاهده کرده است. علاوه بر این، شرکت اعلام کرده است که این سیستم هویت کاربر یا «پرامپت» (دستور متنی) خاص واردشده به ChatGPT را فاش نمیکند، بلکه صرفاً الگوی مرتبط با فرآیند تولید متن را شناسایی میکند.
این واترمارک بینقص نیست
با وجود اهمیت این فناوری، واترمارک مذکور روشی کامل و بینقص برای شناسایی تمام موارد متن تولیدشده توسط هوش مصنوعی نیست. OpenAI توضیح میدهد که دقت تشخیص بسته به طول و ماهیت متن متغیر است؛ هرچه متن کوتاهتر یا دایره واژگان محدودتر باشد، تشخیص واترمارک (نشانگر دیجیتال) دشوارتر میشود. توانایی سیستم در شناسایی واترمارک همچنین ممکن است تحت تأثیر بازنویسی متن یا جایگزینی برخی کلمات با مترادفهایشان قرار گیرد. آزمایشهای شرکت نشان داده است که جایگزینی بخشی از کلمات متن با مترادفها میتواند منجر به افت محسوس توانایی ابزار تشخیص در شناسایی واترمارک شود؛ به همین ترتیب، ترجمه متن به زبانی دیگر نیز میتواند کار تشخیص را دشوارتر کند.
آیا تشخیص واترمارک به معنای غیرقابلاعتماد بودن متن است؟
خیر. وجود واترمارک نشان میدهد که متن با استفاده از یکی از مدلهای هوش مصنوعی OpenAI تولید شده است، اما لزوماً به معنای دقیق یا نادرست بودن اطلاعات موجود در آن نیست. در مقابل، عدم تشخیص واترمارک نیز ثابت نمیکند که متن توسط انسان نوشته شده است؛ چرا که ممکن است متن دستخوش ویرایش یا ترجمه گسترده شده باشد، توسط مدل دیگری تولید شده باشد، یا مربوط به نسخهای قدیمیتر باشد که از سیستم واترمارکگذاری استفاده نمیکند.
گامی تازه در مواجهه با محتوای تولیدشده توسط هوش مصنوعی
فناوری textGrain بازتابدهنده روندی رو به رشد در میان شرکتهای هوش مصنوعی برای توسعه روشهایی است که میان محتوای نوشتهشده توسط انسان و محتوای تولیدشده توسط مدلهای مولد (Generative Models) تمایز قائل میشوند. با گسترش کاربرد هوش مصنوعی در حوزههایی همچون نویسندگی، آموزش، محیط کار و رسانه، توانایی شناسایی منشأ متن اهمیت فزایندهای پیدا کرده است. با این حال، موفقیت نهایی این فناوریها به توانایی آنها در عملکرد صحیح بر روی متون گوناگون و مقاومت در برابر تغییراتی همچون بازنویسی، ترجمه یا ویرایش انسانی بستگی خواهد داشت.
منبع: الیوم السابع











