امنیت، اخلاق و قوانین هوش مصنوعی

معرفی مدل هوش مصنوعی Anthropic با نسخه جدید Fable

مدل هوش مصنوعی Anthropic
💡نکته کلیدی و خلاصه این مقاله:

شرکت Anthropic با انتشار نسخه‌های پیشرفته Fable و Mythos 5.1، گام بزرگی در جهت معرفی مدل هوش مصنوعی Anthropic با قابلیت کاهش هزینه‌ها و ارتقای حریم خصوصی کاربران برداشت. روز سه‌شنبه، شرکت Anthropic مدل‌های Fable...

شرکت Anthropic با انتشار نسخه‌های پیشرفته Fable و Mythos 5.1، گام بزرگی در جهت معرفی مدل هوش مصنوعی Anthropic با قابلیت کاهش هزینه‌ها و ارتقای حریم خصوصی کاربران برداشت.

روز سه‌شنبه، شرکت Anthropic مدل‌های Fable و Mythos 5.1 را منتشر کرد که نسخه‌های جدید و پیشرفته از مدل‌های هوش مصنوعی این شرکت محسوب می‌شوند. علاوه بر ارتقای سطح عملکرد، نسخه جدید Fable شامل تغییراتی است که با هدف کاهش هزینه توکن‌ها و همچنین کاهش محدودیت‌های ناشی از خطاهای تشخیص (مثبت کاذب) در سیستم‌های حفاظتی مدل طراحی شده است.

همانند مدل قبلی Mythos، نسخه 5.1 این مدل تنها در اختیار شرکای ثبت‌شده‌ی Anthropic قرار خواهد گرفت که در حوزه‌های امنیت سایبری یا تحقیقات علوم زیستی فعالیت می‌کنند. در مقابل، Fable 5.1 که نسخه‌ای بدون محدودیت است، از امروز از طریق پلتفرم‌های ابری یا API شرکت Anthropic در دسترس کاربران قرار دارد.

یکی از مهم‌ترین تغییرات، پذیرش سیاست «عدم نگهداری داده‌ها» (Zero Data Retention) توسط Anthropic است که پیش‌تر نیز به آن اشاره شده بود. این قابلیت به مشتریان اجازه می‌دهد مدل‌های Anthropic را روی زیرساخت‌های خودشان اجرا کنند، بدون اینکه نگرانی بابت خروج داده‌ها وجود داشته باشد. سرویس با سطح حریم خصوصی بالا (که Enterprise Frontier Safeguards نامیده می‌شود) که پیش از این به دلیل مسائل امنیتی برای Fable در دسترس نبود، در ماه ژوئن برای کاربران عرضه خواهد شد. نکته قابل توجه این است که سیستم همچنان سوءاستفاده‌های احتمالی توسط عامل‌ها (agents) یا کاربران انسانی را رصد می‌کند، اما کنترل نحوه انجام این نظارت بر عهده خود مشتریان است.

در بخشی از این اطلاعیه، Anthropic به مشتریان اطمینان داد که هیچ دسترسی غیرمجازی به داده‌های آن‌ها صورت نگرفته است. در این بیانیه آمده است: «Anthropic هرگز بدون اجازه صریح، از داده‌های سازمانی برای آموزش استفاده نکرده است و هرگز نیز چنین نخواهد کرد.»

بررسی عملکرد و امنیت مدل هوش مصنوعی Anthropic

طبق روال همیشگی در محصولات Anthropic، مدل‌های جدید در مجموعه‌ای از بنچمارک‌ها (معیارهای ارزیابی) رکوردشکنی کرده‌اند؛ از جمله Terminal-Bench 4.0 (برای برنامه‌نویسی مبتنی بر خط فرمان یا CLI) و Humanity’s Last Exam (برای استدلال عمومی). همچنین Anthropic سه یافته علمی نوآورانه را که توسط این مدل‌ها پیش از عرضه تولید شده بودند، منتشر کرد؛ این یافته‌ها شامل یک بهینه‌سازی سفارشی برای پردازنده‌های گرافیکی (GPU) و نقشه‌ای با وضوح بالا از سیاره زهره (Venus) است که از ترکیب عکس‌های موجود تهیه شده است.

مانند نسخه‌های قبلی، این مدل‌ها به همراه یک «کارت سیستم» (system card) دقیق عرضه می‌شوند که قابلیت‌های آن‌ها را با زبانی بسیار ساده و شفاف توضیح می‌دهد. در این کارت، سطح ریسک Mythos در رابطه با نگرانی‌های مربوط به «توسعه خودکار هوش مصنوعی» — فرآیندی که در آن هوش مصنوعی خودش را بهبود می‌بخشد و برخی آن را عاملی برای از دست رفتن کنترل انسان می‌دانند — در رده «کم‌خطر» قرار گرفته است. در این متن آمده است: «توانایی این مدل در تسریع پیشرفت تحقیق و توسعه (R&D) داخلی هوش مصنوعی، با روندهای فعلی همسو است.»

از نظر رفتارهای نامطلوب عمومی، Mythos نسبت به مدل Opus کمی بیشتر مستعد خطا است که احتمالا نتیجه‌ی قابلیت‌های بهبودیافته‌ی آن است.

در «کارت سیستم» (system card) این مدل آمده است: «Mythos 5.1 در مقایسه با Opus 5، از نظر رفتارهای ناهماهنگ کلی (misaligned behavior) دچار پسرفت اندکی شده است، اما نسبت به Mythos 5 و Claude Sonnet 5 بهبود یافته است.» این سند می‌افزاید: «این مدل نسبت به Opus 5، بیشتر در معرض سوءاستفاده‌های انسانی قرار می‌گیرد و ادعاهای غیرقابل راستی‌آزمایی درباره داشتن مجوز یا اختیار را با سهولت بیشتری می‌پذیرد؛ اما احتمال اینکه محدودیت‌های صریح را نادیده بگیرد، در پردازش ورودی‌ها دچار توهم (hallucinate) شود یا به دروغ ادعا کند که وظایف محوله را انجام داده است، نسبت به مدل‌های پیشین کمتر است.»

همیار وب

تیم تحریریه همیار وب

مرجع تخصصی ابزارها، قالب‌ها و آموزش‌های عملی توسعه کسب‌وکار آنلاین مبتنی بر هوش مصنوعی و اتوماسیون.