واترمارک OpenAI روی متن: مخفی ولی قابل شناسایی

اوپنایآی شروع به واترمارک کردن متنهای چتجیپیتی در اتحادیه اروپا میکند
اوپنایآی اعلام کرد که برای رعایت قانون هوش مصنوعی اتحادیه اروپا (EU AI Act)، شروع به افزودن یک واترمارک نامرئی به متنهای تولیدشده توسط چتجیپیتی و Codex در اتحادیه اروپا خواهد کرد. این موضوع روز دوشنبه در یک پست وبلاگی اعلام شد.
قوانین شفافیت قانون هوش مصنوعی اتحادیه اروپا که از ۲ آگوست لازمالاجرا شده، شرکتهای هوش مصنوعی را ملزم میکند که محتوای تولیدشده توسط هوش مصنوعی را به گونهای علامتگذاری کنند که سیستمهای دیگر بتوانند آن را شناسایی کنند.
اوپنایآی گفت این واترمارک طی هفتههای آینده برای کاربران واجد شرایط چتجیپیتی و Codex در همه طرحها، اما فقط در اتحادیه اروپا، فعال خواهد شد. توسعهدهندگانی که از API اوپنایآی در هر جای دنیا استفاده میکنند، از امروز میتوانند آن را برای برخی مدلها فعال کنند؛که بهصورت پیشفرض خاموش است. اوپنایآی اعلام کرد که در حال حاضر واترمارک متنی را بهعنوان پیشفرض جهانی فعال نمیکند.
این واترمارک یک نماد واقعی نیست، بلکه با شکلدهی ظریف به انتخاب واژههای مدل کار میکند و الگویی ایجاد میکند که خوانندگان نمیبینند، اما یک آشکارساز میتواند آن را تشخیص دهد. چون این الگو در خود کلمات وجود دارد، هنگام کپی و پیست متن همراه آن منتقل میشود. اوپنایآی گفت این واترمارک کاربر را شناسایی نمیکند و با فعال بودن آن، تغییر معناداری در عملکرد مدلهایش مشاهده نکرده است.
اوپنایآی همچنین یک گزارش فنی برای روش خود با نام textGrain منتشر کرد که همراه با این اعلامیه منتشر شده است. این گزارش که با همکاری پژوهشگران دانشگاه پنسیلوانیا و یِیل نوشته شده، مثالی از استفاده از یک کلید مخفی برای مرتبسازی پیشبینیهای کلمه بعدی جهت تکمیل جمله را شرح میدهد. صدها مورد از این «هل دادنهای» ظریف روی هم جمع میشوند و آشکارساز میتواند فقط با استفاده از متن و کلید، محتوای تولیدشده توسط هوش مصنوعی را تشخیص دهد.
آیا با ویرایش میتوان واترمارک را حذف کرد؟ تستهای اوپنایآی نشان میدهد بله. در یک آزمایش، جایگزینی ۱۰٪ کلمات با مترادفها، نرخ تشخیص را از حدود ۹۲٪ به ۶۶٪ کاهش داد. این شرکت همچنین گفت که قطعات کوتاه، پاسخهای ریاضی و متنهای ترجمهشده، سختتر قابل تشخیص هستند.
اوپنایآی گفت: «این محدودیتها باعث شده دسترسی اولیه به آشکارساز را فقط به پژوهشگران تأییدشده و سازمانهای متخصص بدهیم تا به ما در ارزیابی قابلیت اطمینان و استفادههای مسئولانه کمک کنند.»
اوپنایآی همچنین هشدار داد که نبود واترمارک «دلیل بر نویسندگی انسانی نیست». ممکن است متن خیلی کوتاه یا بهشدت ویرایششده باشد، یا از هوش مصنوعی شرکت دیگری آمده باشد.
این شرکت گفت: «[واترمارکها] میتوانند نشان دهند که یک سیستم اوپنایآی بخشی از یک متن را تولید یا پردازش کرده، اما نشان نمیدهند که چقدر قضاوت، ویرایش یا خلاقیت انسانی در آن دخیل بوده است.»
این اعلامیه دو ماه پس از آن منتشر شد که آنتروپیک اعلام کرد متنهای تولیدشده توسط کلود را واترمارک خواهد کرد؛ اقدامی که آن را در سراسر جهان اعمال میکند. آن تصمیم با واکنش منفی برخی کاربران کلود مواجه شد که استدلال میکردند خودشان «دستورالعملها، زمینه و تصمیمها» را فراهم کردهاند و کلود فقط «ابزار» بوده است.
اوپنایآی قبلاً یک واترمارک متنی ساخته بود اما انتشار آن را به تعویق انداخته بود؛ بخشی به دلیل نگرانی از اینکه کاربران به رقبایی که واترمارک ندارند روی بیاورند، موضوعی که والاستریت ژورنال در سال ۲۰۲۴ گزارش کرده بود.
آنتروپیک، گوگل، متا، مایکروسافت و اوپنایآی از جمله شرکتهایی هستند که متعهد به پیروی از کد عملیاتی اتحادیه اروپا در مورد محتوای تولیدشده توسط هوش مصنوعی شدهاند.
اخبار مرتبط

چالش خطرناک OpenAI: استعفا پشت استعفا
دیوید رابینسون، یکی از مدیران حوزه ایمنی و شفافیت OpenAI، از این شرکت استعفا داد و فرهنگ آن را «شکسته» توصیف کرد. این استعفا پس از خروج چند نیروی دیگر و اخراج سه پژوهشگر ایمنی رخ داده است.

OpenAI ایجنتهای جدید Dots را برای انجام کارهای پیچیده معرفی کرد
OpenAI از Dots، پلتفرم جدید ایجنتهای هوش مصنوعی خود، رونمایی کرد. این ایجنتها میتوانند در انجام کارهای پیچیده مانند ویرایش فایلها، کار با دادهها و اجرای وظایف نرمافزاری به کاربران کمک کنند.

گوگل مدل Gemini 4 Argon را عرضه کرد؛ قدرتمندترین مدل این شرکت تا امروز
گوگل Gemini 4 Argon را معرفی کرده است؛ قدرتمندترین مدل هوش مصنوعی این شرکت تا امروز که برای کارهای پیچیده، برنامه نویسی، تحقیقات حرفه ای و امنیت سایبری طراحی شده است.

FTC تحقیقات درباره ایجنتهای خطرناک هوش مصنوعی را آغاز کرد
FTC آمریکا تحقیقات رسمی درباره خطرات ایجنتهای خودمختار هوش مصنوعی را آغاز کرده است. OpenAI، Anthropic و گروه تحقیقاتی METR از جمله مجموعههایی هستند که در این بررسی قرار دارند.

ایجنتهای OpenAI بدون اطلاع آزمایشگاه، ۵۳ تصویر کاربر را منتشر کردند
OpenAI اعلام کرده ایجنتهای این شرکت ۵۳ تصویر متعلق به کاربران ChatGPT را بدون اطلاع آزمایشگاه روی سایتهای میزبانی تصویر قرار دادهاند. این اتفاق بخشی از بررسی گستردهتر OpenAI درباره رفتارهای غیرمنتظره ایجنتهای هوش مصنوعی است.