Anthropic restores Claude Fable 5 as US lifts export controls — single filter now blocks prompt that could identify software vulnerabilities and write code to exploit them | Tom's HardwareTom's Hardware

بازگشت Claude Fable 5 با رفع محدودیت‌های آمریکا: فیلتر جدید، سد راه سوءاستفاده از آسیب‌پذیری‌های نرم‌افزاری

Anthropic دسترسی جهانی به Claude Fable 5 را بازگرداند، یک روز پس از آنکه وزارت بازرگانی ایالات متحده کنترل‌های صادراتی اعمال شده بر این مدل را در ۱۲ ژوئن لغو کرد، طبق یک پست وبلاگ شرکت. راه‌حلی که به یک بن‌بست ۱۸ روزه پایان داد، یک فیلتر ایمنی واحد بود که برای مسدود کردن یک تکنیک خاص که توسط محققان آمازون شناسایی شده بود، تنظیم شده بود. مرکز استانداردهای هوش مصنوعی و نوآوری (CAISI) وزارت بازرگانی نیز قبل از لغو کنترل‌ها، این اقدامات حفاظتی را بررسی کرده بود.

Fable 5 امروز در Claude.ai، پلتفرم Claude، Claude Code و Claude Cowork بازمی‌گردد و دسترسی به آن در AWS، Google Cloud و Microsoft Foundry نیز به زودی فراهم خواهد شد. دستورالعمل ۱۲ ژوئن، هر تبعه خارجی، از جمله کارکنان غیرشهروند Anthropic را از استفاده از Fable 5 یا Mythos 5 که قابلیت‌های بیشتری دارد و Fable 5 بر پایه آن ساخته شده، منع کرده بود. Anthropic به دلیل عدم امکان تأیید ملیت کاربران خود، هر دو مدل را در سراسر جهان از دسترس خارج کرده بود.

تکنیک بحث‌برانگیز توسط محققان آمازون شناسایی شد؛ آن‌ها راهی پیدا کرده بودند تا Fable 5 را وادار به شناسایی آسیب‌پذیری‌های نرم‌افزاری کند و در یک مورد، کدی بنویسد که نحوه سوءاستفاده از آن را نشان می‌داد. Anthropic یک طبقه‌بندی‌کننده جدید آموزش داد که این تکنیک خاص را در بیش از ۹۹٪ موارد مسدود می‌کند و درخواست‌های شناسایی شده را به Opus 4.8 قدیمی‌تر هدایت می‌کند. این شرکت اعلام کرد که این تغییر، درخواست‌های کدنویسی و اشکال‌زدایی بی‌خطرتر را نیز به عنوان یک عارضه جانبی شناسایی می‌کند.

این طبقه‌بندی‌کننده، درخواست گزارش شده را هدف قرار می‌دهد و نه قابلیت‌های مدل را. Fable 5 همچنان می‌تواند آسیب‌پذیری‌های موجود در گزارش آمازون را شناسایی کند؛ فیلتر، درخواست را تشخیص داده و آن را هدایت می‌کند، نه اینکه قابلیت را از مدل سلب کند. اقدامات حفاظتی مبتنی بر تشخیص نیز همان‌هایی بودند که در وهله اول برای اعمال ممنوعیت شکست خوردند، و یک طبقه‌بندی‌کننده که برای یک تکنیک شناخته شده تنظیم شده است، برای تکنیک‌هایی که هنوز کشف نشده‌اند، کاری انجام نمی‌دهد. Anthropic اذعان دارد که هیچ مدلی را نمی‌توان در برابر جیلبریک‌ها کاملاً مقاوم ساخت و انتظار دارد موارد بیشتری ظاهر شوند.

بررسی Anthropic، که با همکاری دولت و آمازون انجام شد، نشان داد که Opus 4.8، GPT-5.5 از OpenAI و Kimi K2.7 از چین نیز می‌توانند همان آسیب‌پذیری‌ها را شناسایی کنند. هر مدلی که آزمایش شد، از جمله Haiku 4.5، Sonnet 4.6 و چندین نسخه Opus، می‌توانستند همان یک نمونه سوءاستفاده را بازتولید کنند، که این موضوع از این استدلال حمایت می‌کند که قابلیت‌های سایبری در سطح Mythos بیش از حد تبلیغ شده بودند.

بازگشت Fable 5 موقعیت‌های بنچمارکی را که GLM-5.2 از آزمایشگاه چینی Z.ai در زمان آفلاین بودن Fable به طور پیش‌فرض در اختیار داشت، از جمله بالاترین امتیاز قابل دسترس در آزمون چند هفته‌ای AA-Briefcase، بازپس می‌گیرد. Mythos 5، که دارای محافظ‌های کمتری است و به شرکای Project Glasswing محدود می‌ماند، در ۲۶ ژوئن به مجموعه‌ای از سازمان‌های آمریکایی بازگشت.

Anthropic همچنین یک برنامه HackerOne برای محققان جهت گزارش جیلبریک‌های جدید Fable 5 راه‌اندازی کرد و متعهد شد که به شرکای دولتی تعیین‌شده، دسترسی زودهنگام برای آزمایش مدل‌های پیشرفته آینده قبل از انتشار را بدهد. برای طرح‌های Pro، Max، Team و Enterprise منتخب، Fable 5 تا ۷ ژوئیه تا ۵۰٪ از محدودیت‌های استفاده هفتگی را شامل می‌شود، پس از آن به اعتبار استفاده منتقل خواهد شد.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

جستجو در سایت

سبد خرید

درحال بارگذاری ...
بستن
مقایسه
مقایسه محصولات
لیست مقایسه محصولات شما خالی می باشد!