بازگشت Claude Fable 5 با رفع محدودیتهای آمریکا: فیلتر جدید، سد راه سوءاستفاده از آسیبپذیریهای نرمافزاری
Anthropic دسترسی جهانی به Claude Fable 5 را بازگرداند، یک روز پس از آنکه وزارت بازرگانی ایالات متحده کنترلهای صادراتی اعمال شده بر این مدل را در ۱۲ ژوئن لغو کرد، طبق یک پست وبلاگ شرکت. راهحلی که به یک بنبست ۱۸ روزه پایان داد، یک فیلتر ایمنی واحد بود که برای مسدود کردن یک تکنیک خاص که توسط محققان آمازون شناسایی شده بود، تنظیم شده بود. مرکز استانداردهای هوش مصنوعی و نوآوری (CAISI) وزارت بازرگانی نیز قبل از لغو کنترلها، این اقدامات حفاظتی را بررسی کرده بود.
Fable 5 امروز در Claude.ai، پلتفرم Claude، Claude Code و Claude Cowork بازمیگردد و دسترسی به آن در AWS، Google Cloud و Microsoft Foundry نیز به زودی فراهم خواهد شد. دستورالعمل ۱۲ ژوئن، هر تبعه خارجی، از جمله کارکنان غیرشهروند Anthropic را از استفاده از Fable 5 یا Mythos 5 که قابلیتهای بیشتری دارد و Fable 5 بر پایه آن ساخته شده، منع کرده بود. Anthropic به دلیل عدم امکان تأیید ملیت کاربران خود، هر دو مدل را در سراسر جهان از دسترس خارج کرده بود.
تکنیک بحثبرانگیز توسط محققان آمازون شناسایی شد؛ آنها راهی پیدا کرده بودند تا Fable 5 را وادار به شناسایی آسیبپذیریهای نرمافزاری کند و در یک مورد، کدی بنویسد که نحوه سوءاستفاده از آن را نشان میداد. Anthropic یک طبقهبندیکننده جدید آموزش داد که این تکنیک خاص را در بیش از ۹۹٪ موارد مسدود میکند و درخواستهای شناسایی شده را به Opus 4.8 قدیمیتر هدایت میکند. این شرکت اعلام کرد که این تغییر، درخواستهای کدنویسی و اشکالزدایی بیخطرتر را نیز به عنوان یک عارضه جانبی شناسایی میکند.
این طبقهبندیکننده، درخواست گزارش شده را هدف قرار میدهد و نه قابلیتهای مدل را. Fable 5 همچنان میتواند آسیبپذیریهای موجود در گزارش آمازون را شناسایی کند؛ فیلتر، درخواست را تشخیص داده و آن را هدایت میکند، نه اینکه قابلیت را از مدل سلب کند. اقدامات حفاظتی مبتنی بر تشخیص نیز همانهایی بودند که در وهله اول برای اعمال ممنوعیت شکست خوردند، و یک طبقهبندیکننده که برای یک تکنیک شناخته شده تنظیم شده است، برای تکنیکهایی که هنوز کشف نشدهاند، کاری انجام نمیدهد. Anthropic اذعان دارد که هیچ مدلی را نمیتوان در برابر جیلبریکها کاملاً مقاوم ساخت و انتظار دارد موارد بیشتری ظاهر شوند.
بررسی Anthropic، که با همکاری دولت و آمازون انجام شد، نشان داد که Opus 4.8، GPT-5.5 از OpenAI و Kimi K2.7 از چین نیز میتوانند همان آسیبپذیریها را شناسایی کنند. هر مدلی که آزمایش شد، از جمله Haiku 4.5، Sonnet 4.6 و چندین نسخه Opus، میتوانستند همان یک نمونه سوءاستفاده را بازتولید کنند، که این موضوع از این استدلال حمایت میکند که قابلیتهای سایبری در سطح Mythos بیش از حد تبلیغ شده بودند.
بازگشت Fable 5 موقعیتهای بنچمارکی را که GLM-5.2 از آزمایشگاه چینی Z.ai در زمان آفلاین بودن Fable به طور پیشفرض در اختیار داشت، از جمله بالاترین امتیاز قابل دسترس در آزمون چند هفتهای AA-Briefcase، بازپس میگیرد. Mythos 5، که دارای محافظهای کمتری است و به شرکای Project Glasswing محدود میماند، در ۲۶ ژوئن به مجموعهای از سازمانهای آمریکایی بازگشت.
Anthropic همچنین یک برنامه HackerOne برای محققان جهت گزارش جیلبریکهای جدید Fable 5 راهاندازی کرد و متعهد شد که به شرکای دولتی تعیینشده، دسترسی زودهنگام برای آزمایش مدلهای پیشرفته آینده قبل از انتشار را بدهد. برای طرحهای Pro، Max، Team و Enterprise منتخب، Fable 5 تا ۷ ژوئیه تا ۵۰٪ از محدودیتهای استفاده هفتگی را شامل میشود، پس از آن به اعتبار استفاده منتقل خواهد شد.
- کولبات
- تیر 10, 1405
- 99 بازدید






