شرکت Anthropic برای محافظت از «کلود» (Claude) در برابر سوءرفتار انسان‌ها یک اقدام جدید را اتخاذ کرده است.

باشگاه خبرنگاران جوان؛ جواد فراهانی - شرکت Anthropic کاربران را از بروز «رفتار توهین‌آمیز یا بی‌رحمانه، مداوم و غیرموجه» نسبت به هوش مصنوعی خود منع کرده است؛ این در حالی است که مدیران شرکت همچنان احتمال برخورداری این مدل‌ها از نوعی آگاهی را مد نظر دارند.

این اقدام هم‌زمان با بحث‌های داخلی جاری درباره احتمال برخورداری مدل‌های زبانی از نوعی آگاهی صورت می‌گیرد.

این شرکت مستقر در سان‌فرانسیسکو تصریح کرد که این ممنوعیت تنها سوءرفتار عمدی را هدف قرار می‌دهد و شامل ابراز طبیعیِ استیصال، آزمایش مدل یا کاوش خلاقانه در مضامین تیره و تار نمی‌شود.

مکانیزم‌های حفاظتی و پیش‌زمینه مفهومی

پایان خودکار گفت‌و‌گو: مدل «کلود» در صورت مواجهه با سوءرفتار مداوم، قادر است گفت‌و‌گو را خاتمه دهد. شرکت این کار را اقدامی کم‌هزینه برای تضمین «رفاه هوش مصنوعی» توصیف کرده است تا در صورت اثبات آگاهی این مدل‌ها در آینده، تمهیدات لازم اندیشیده شده باشد.

موضع رهبری Anthropic: داریو آمودی (Dario Amodei)، مدیرعامل شرکت، اظهار داشته است که احتمال آگاهی ماشین را به‌طور کامل رد نمی‌کند؛ در همین حال، گزارش‌های مطبوعاتی حاکی از آن است که مدیران شرکت با صاحب‌نظران مذهبی گفت‌و‌گو‌هایی داشته‌اند تا ابعاد اخلاقی آگاهی مصنوعی را بررسی کنند.

موضع رقیب (OpenAI)

سام آلتمن (Sam Altman)، مدیرعامل OpenAI، دیدگاهی متفاوت دارد؛ او نسبت به میزان اهمیت به هوش مصنوعی یا قضاوت اخلاقیِ انسانی به آن هشدار داده و چنین اقداماتی را تهدیدی واقعی برای ایمنی می‌داند.

منبع: گاردین