
Anthropic دسترسی به Claude Fable 5 را دوباره فعال کرد؛ بازگشت قدرتمندترین مدل این شرکت با لایههای امنیتی جدید
شرکت Anthropic بهصورت رسمی اعلام کرد که دسترسی به Claude Fable 5 و Claude Mythos 5 دوباره برقرار شده است. این دو مدل که تنها چند روز پس از معرفی، به دلیل اعمال محدودیتهای صادراتی دولت ایالات متحده از دسترس خارج شده بودند، اکنون پس از رفع این محدودیتها و اعمال بهبودهای امنیتی گسترده، بار دیگر در اختیار کاربران قرار گرفتهاند.
بر اساس اعلام Anthropic، در تاریخ ۱۲ ژوئن دولت آمریکا محدودیتهای صادراتی جدیدی را برای مدلهای Fable 5 و Mythos 5 اعمال کرد. این تصمیم شرکت را ملزم میکرد دسترسی کاربران خارجی را متوقف کند. از آنجایی که امکان تشخیص آنی ملیت کاربران وجود نداشت، Anthropic تصمیم گرفت بهصورت موقت دسترسی تمام کاربران به این دو مدل را متوقف کند.
اکنون با لغو این محدودیتها در ۳۰ ژوئن، شرکت اعلام کرده است که از اول جولای، Claude Fable 5 دوباره بهصورت جهانی از طریق Claude.ai، Claude Platform، Claude Code و Claude Cowork در دسترس قرار خواهد گرفت. همچنین Anthropic اعلام کرده است که دسترسی از طریق سرویسهای AWS، Google Cloud و Microsoft Foundry نیز بهزودی دوباره فعال خواهد شد.
چرا دسترسی به Fable 5 متوقف شد؟
به گفته Anthropic، علت اصلی این تصمیم گزارشی بود که توسط پژوهشگران Amazon تهیه شده بود. در این گزارش روشی برای دور زدن بخشی از مکانیزمهای امنیتی Fable 5 معرفی شده بود؛ روشی که در برخی شرایط میتوانست مدل را وادار کند اطلاعاتی درباره آسیبپذیریهای نرمافزاری ارائه دهد یا نمونهای از نحوه بهرهبرداری از یک آسیبپذیری را تولید کند.
پس از بررسی مشترک Anthropic، دولت آمریکا و Amazon مشخص شد که این رفتار منحصر به Fable 5 نیست و بسیاری از مدلهای پیشرفته دیگر نیز توانایی ارائه نتایج مشابه را دارند. همچنین بررسیها نشان داد این روش هیچیک از قابلیتهای سطح بالای امنیت سایبری اختصاصی مدل Mythos 5 را آشکار نمیکند و بیشتر مربوط به یکی از نواحی محافظهکارانه سیستم ایمنی Fable 5 بوده است.
با این حال، Anthropic تصمیم گرفت پیش از بازگرداندن مدل، لایههای حفاظتی آن را تقویت کند.
تقویت سیستمهای امنیتی
مهمترین تغییر نسخه جدید، توسعه یک Safety Classifier پیشرفتهتر است؛ سیستمی که هنگام تعامل کاربر با مدل، درخواستهای مرتبط با فعالیتهای بالقوه خطرناک در حوزه امنیت سایبری را شناسایی میکند.
طبق اعلام Anthropic، این طبقهبند جدید اکنون میتواند بیش از ۹۹ درصد از روش گزارششده برای دور زدن محدودیتهای مدل را شناسایی و مسدود کند. در صورتی که درخواستی پرخطر تشخیص داده شود، کاربر از این موضوع مطلع خواهد شد و درخواست به جای Fable 5 توسط مدل Claude Opus 4.8 پردازش میشود.
البته Anthropic تأکید میکند که این محافظت هزینهای نیز به همراه دارد؛ برخی درخواستهای کاملاً سالم در زمینه برنامهنویسی یا اشکالزدایی ممکن است به اشتباه مسدود شوند. این شرکت اعلام کرده است که همچنان روی کاهش خطاهای مثبت کاذب و بهبود دقت این سیستم کار خواهد کرد.
معماری امنیتی چندلایه
Anthropic توضیح میدهد که امنیت Fable 5 تنها به یک مکانیزم وابسته نیست. این مدل با رویکرد Defense in Depth طراحی شده است؛ یعنی چندین لایه دفاعی بهصورت همزمان از سوءاستفاده جلوگیری میکنند.
این لایهها شامل آموزش مستقیم مدل برای رد درخواستهای خطرناک، تحلیل الگوهای سوءاستفاده و استفاده از سیستمهای طبقهبندی هوشمند هستند که قبل و بعد از تولید پاسخ، رفتار مدل را بررسی میکنند.
همچنین برای Fable 5 حاشیه امنیت (Safety Margin) نسبت به تمامی مدلهای قبلی Anthropic بزرگتر در نظر گرفته شده است. به همین دلیل، مدل حتی برخی درخواستهایی را که احتمال خطر بسیار کمی دارند نیز رد میکند تا احتمال عبور درخواستهای مخرب به حداقل برسد.
چارچوب جدید برای مقابله با Jailbreak
Anthropic معتقد است صنعت هوش مصنوعی هنوز استاندارد مشترکی برای ارزیابی شدت Jailbreakها ندارد؛ تکنیکهایی که با استفاده از آنها میتوان محدودیتهای امنیتی مدلهای هوش مصنوعی را دور زد.
به همین دلیل این شرکت به همراه Amazon، Microsoft، Google و سایر شرکای پروژه Glasswing در حال توسعه یک چارچوب مشترک برای ارزیابی Jailbreakها است.
این چارچوب چهار معیار اصلی را بررسی میکند:
میزان افزایش قابلیتهای مدل پس از Jailbreak گستردگی قابلیتهایی که آزاد میشوند میزان دشواری تبدیل Jailbreak به یک حمله واقعی میزان دسترسی عمومی به روش Jailbreak
هدف از این استاندارد، ایجاد روشی واحد برای ارزیابی ریسک، اولویتبندی اصلاحات امنیتی و هماهنگی بهتر میان شرکتهای توسعهدهنده مدلهای هوش مصنوعی و دولتها است.
همکاری گستردهتر با دولت آمریکا
Anthropic همچنین اعلام کرده است که همکاری خود با دولت آمریکا را در حوزه امنیت مدلهای Frontier گسترش خواهد داد. این همکاری شامل ارائه دسترسی زودهنگام به مدلهای جدید برای ارزیابی امنیتی، اشتراکگذاری سریع اطلاعات مربوط به Jailbreakها، انجام پروژههای تحقیقاتی مشترک و توسعه استانداردهای امنیتی مشترک میان شرکتهای بزرگ فعال در حوزه هوش مصنوعی خواهد بود.
جمعبندی
بازگشت Claude Fable 5 تنها به معنای فعال شدن دوباره یک مدل هوش مصنوعی نیست، بلکه نشاندهنده تغییر رویکرد صنعت به سمت توسعه مسئولانهتر مدلهای پیشرفته است. Anthropic تلاش کرده است با ترکیب قابلیتهای قدرتمند Fable 5 و مکانیزمهای امنیتی چندلایه، تعادل مناسبی میان عملکرد، دسترسی و ایمنی ایجاد کند.
این اتفاق همچنین نشان میدهد که در نسل جدید مدلهای هوش مصنوعی، موفقیت تنها به کیفیت مدل وابسته نیست؛ بلکه امنیت، همکاری با نهادهای قانونگذار و ایجاد استانداردهای مشترک، به بخش جداییناپذیر توسعه مدلهای Frontier تبدیل شدهاند.
دیدگاهها
برای نوشتن دیدگاه یا پاسخ، ابتدا با گوگل وارد شو:
در حال بارگذاری...