اقدام شرکت Anthropic برای محافظت از «کلود» (Claude) در برابر سوءرفتار انسانها

باشگاه خبرنگاران جوان؛ جواد فراهانی - شرکت Anthropic کاربران را از بروز «رفتار توهینآمیز یا بیرحمانه، مداوم و غیرموجه» نسبت به هوش مصنوعی خود منع کرده است؛ این در حالی است که مدیران شرکت همچنان احتمال برخورداری این مدلها از نوعی آگاهی را مد نظر دارند.
این اقدام همزمان با بحثهای داخلی جاری درباره احتمال برخورداری مدلهای زبانی از نوعی آگاهی صورت میگیرد.
این شرکت مستقر در سانفرانسیسکو تصریح کرد که این ممنوعیت تنها سوءرفتار عمدی را هدف قرار میدهد و شامل ابراز طبیعیِ استیصال، آزمایش مدل یا کاوش خلاقانه در مضامین تیره و تار نمیشود.
مکانیزمهای حفاظتی و پیشزمینه مفهومی
پایان خودکار گفتوگو: مدل «کلود» در صورت مواجهه با سوءرفتار مداوم، قادر است گفتوگو را خاتمه دهد. شرکت این کار را اقدامی کمهزینه برای تضمین «رفاه هوش مصنوعی» توصیف کرده است تا در صورت اثبات آگاهی این مدلها در آینده، تمهیدات لازم اندیشیده شده باشد.
موضع رهبری Anthropic: داریو آمودی (Dario Amodei)، مدیرعامل شرکت، اظهار داشته است که احتمال آگاهی ماشین را بهطور کامل رد نمیکند؛ در همین حال، گزارشهای مطبوعاتی حاکی از آن است که مدیران شرکت با صاحبنظران مذهبی گفتوگوهایی داشتهاند تا ابعاد اخلاقی آگاهی مصنوعی را بررسی کنند.
موضع رقیب (OpenAI)
سام آلتمن (Sam Altman)، مدیرعامل OpenAI، دیدگاهی متفاوت دارد؛ او نسبت به میزان اهمیت به هوش مصنوعی یا قضاوت اخلاقیِ انسانی به آن هشدار داده و چنین اقداماتی را تهدیدی واقعی برای ایمنی میداند.
منبع: گاردین











