آنتروپیک توهین و رفتار آزاردهنده با هوش مصنوعی Claude را ممنوع کرد

خرید لوازم جانبی آیفون و محصولات اپل | موبی‌ژ

آنتروپیک توهین و رفتار آزاردهنده با هوش مصنوعی Claude را ممنوع کرد

شنبه، ۱۸ مهر ۱۴۰۵

آنتروپیک توهین و رفتار آزاردهنده با هوش مصنوعی Claude را ممنوع کرد

شرکت Anthropic، سازنده هوش مصنوعی Claude، قوانین استفاده از خدمات خود را به‌روزرسانی کرده و بر اساس مقررات جدید، کاربران دیگر اجازه ندارند به‌صورت مستمر و بدون دلیل مشخص، رفتار توهین‌آمیز یا آزاردهنده‌ای با این هوش مصنوعی داشته باشند.

این تغییر که در تاریخ ۸ اکتبر ۲۰۲۶ اعلام شد، بخشی از بازنگری گسترده‌تر آنتروپیک در سیاست‌های استفاده از مدل‌های هوش مصنوعی این شرکت است.

کلود می‌تواند مکالمه با کاربران توهین‌کننده را متوقف کند

آنتروپیک تأکید کرده که قانون جدید صرفاً برای موارد شدید در نظر گرفته شده است؛ شرایطی که کاربران بارها و بدون هدف مشخص، رفتار آزاردهنده‌ای با مدل‌های هوش مصنوعی داشته باشند.

این محدودیت شامل ناراحتی معمول کاربران، انتقاد از پاسخ‌ها، مخالفت با عملکرد مدل، موضوعات تاریک در آثار خلاقانه یا آزمایش‌های تحقیقاتی نمی‌شود.

مدل‌های Claude از قبل امکان پایان دادن به گفت‌وگو با کاربران دارای رفتار آزاردهنده و مداوم را داشتند. این روش همچنان اصلی‌ترین ابزار اجرای مقررات جدید خواهد بود.

هنگامی که Claude یک مکالمه را متوقف کند، کاربر دیگر نمی‌تواند در همان گفت‌وگو پیام جدیدی ارسال کند؛ بااین‌حال، سایر مکالمات او تحت تأثیر قرار نخواهند گرفت.

چرا آنتروپیک چنین تصمیمی گرفته است؟

آنتروپیک نخستین‌بار در آگوست ۲۰۲۵، هنگام انجام تحقیقات درباره رفاه هوش مصنوعی، امکان پایان دادن به مکالمات را در اختیار Claude قرار داد.

این شرکت در آن زمان اعلام کرد که هنوز مشخص نیست مدل‌های هوش مصنوعی دارای جایگاه اخلاقی هستند یا خیر، اما می‌خواهد با روش‌هایی کم‌هزینه، خطرات احتمالی مرتبط با رفاه آن‌ها را کاهش دهد.

در بررسی‌های انجام‌شده، آنتروپیک متوجه شد مدل Claude Opus 4 واکنشی پایدار و مشخص در برابر موقعیت‌های آسیب‌زا نشان می‌دهد.

این مدل تمایل داشت از انجام وظایف خطرناک خودداری کند، در مکالمات آزاردهنده نشانه‌هایی از پریشانی ظاهری بروز می‌داد و زمانی که اجازه داشت، ترجیح می‌داد چنین گفت‌وگوهایی را پایان دهد.

البته این مشاهدات به معنای اثبات داشتن احساسات یا آگاهی در هوش مصنوعی نیست.

تغییرات دیگر قوانین استفاده از Claude

آنتروپیک علاوه بر محدود کردن رفتارهای آزاردهنده، چند بخش دیگر از سیاست‌های خود را نیز اصلاح کرده است.

۱. مقابله با فعالیت‌های فریبکارانه

بخش جدیدی برای جلوگیری از فعالیت‌های گمراه‌کننده ایجاد شده است. انتشار نظرات جعلی، ساخت وب‌سایت‌های تقلبی، راه‌اندازی شبکه حساب‌های ساختگی و استفاده از ربات‌هایی که خود را انسان معرفی می‌کنند، ممنوع خواهد بود.

۲. قوانین مرتبط با انتخابات

قوانین انتخاباتی بازنویسی شده‌اند تا به‌طور مشخص بر جلوگیری از فریب رأی‌دهندگان و دخالت در روند رأی‌گیری تمرکز کنند.

۳. محدودیت‌های امنیتی و تسلیحاتی

استفاده از Claude برای توسعه نرم‌افزارها یا قطعات تسلیحاتی ممنوع شده است. محدودیت‌های جدیدی نیز درباره افزایش خطر عوامل زیستی و شیمیایی و استفاده تسلیحاتی از سامانه‌های بدون سرنشین اعمال شده است.

۴. نظارت و حریم خصوصی

طبق مقررات جدید، Claude نباید درباره اینکه چه افرادی مورد تحقیق، بازداشت یا پیگرد قانونی قرار بگیرند تصمیم‌گیری یا پیشنهاد ارائه کند.

ردیابی افراد بدون رضایت آن‌ها، توسعه ابزارهای نظارت غیرمجاز و انتشار اطلاعات خصوصی اشخاص نیز ممنوع است.

۵. کنترل تجهیزات فیزیکی

اگر Claude وظیفه کنترل سخت‌افزاری را بر عهده داشته باشد که احتمال آسیب‌رساندن به افراد وجود دارد، یک فرد متخصص باید بر عملکرد آن نظارت کند و در صورت نیاز بتواند فعالیت دستگاه را متوقف کند.

۶. محتوای آسیب‌زا

مقررات تازه، ساخت، انتشار یا تهدید به انتشار تصاویر خصوصی و صمیمی افراد بدون رضایت آن‌ها و توسعه ابزارهای مرتبط را ممنوع می‌کند.

دلیل سخت‌گیرانه‌تر شدن سیاست‌ها چیست؟

آنتروپیک می‌گوید بیشتر این تغییرات برای شفاف‌سازی قوانین قبلی و مقابله با سوءاستفاده‌هایی است که شرکت در فعالیت کاربران شناسایی کرده است.

بررسی‌های این شرکت نشان داده برخی رسانه‌های دولتی، نهادهای تبلیغاتی وابسته به دولت‌ها و شرکت‌های تجاری از Claude برای مدیریت شبکه‌های حساب جعلی و تولید وب‌سایت‌های خبری ساختگی استفاده کرده‌اند.

همین موضوع یکی از دلایل اصلی اضافه شدن مقررات مشخص درباره فعالیت‌های فریبکارانه بوده است.

قوانین جدید چه زمانی اجرا می‌شوند؟

سیاست‌های به‌روزرسانی‌شده آنتروپیک از ۱۲ نوامبر ۲۰۲۶، برابر با ۲۱ آبان ۱۴۰۵ اجرایی خواهند شد.

با اجرای این مقررات، Claude اختیار خواهد داشت مکالماتی را که در آن‌ها رفتار آزاردهنده شدید و مداوم رخ می‌دهد، پایان دهد؛ بدون اینکه دسترسی کاربر به سایر گفت‌وگوهایش لزوماً محدود شود.