علمی-فرهنگی

رونمایی آنتروپیک از مدل‌های هوش مصنوعی قدرتمندتر با هزینه کمتر

آنتروپیک از مدل‌های هوش مصنوعی Claude Fable 5.1 و Claude Mythos 5.1 رونمایی کرد. این دو مدل از نظر قابلیت‌های پایه یکسان هستند، اما سطح محدودیت‌های ایمنی متفاوتی دارند. Fable 5.1 به‌صورت عمومی در دسترس قرار گرفته است، ولی Mythos 5.1 از طریق برنامه‌های دسترسی محدود برای سازمان‌های منتخب حوزه‌های امنیت سایبری و علوم زیستی ارائه می‌شود.

به گزارش سیناپرس، آنتروپیک می‌گوید Fable 5.1 در مقایسه با Fable 5 عملکرد بهتری دارد و هزینه استفاده از آن در کارهای معمولی حدود ۲۵ درصد کمتر است. این کاهش هزینه عمدتاً از پایین‌آمدن قیمت خواندن داده‌های ذخیره‌شده در حافظه موقت (کش) ناشی می‌شود و برای کارهای ایجنت‌‌محور پیچیده می‌تواند به حدود ۴۵ درصد برسد.

کاهش ۷۵ درصدی هزینه خواندن داده‌های کش‌شده در Fable 5.1

Fable 5.1 همان قیمت پایه Fable 5 را حفظ کرده و استفاده از آن ۱۰ دلار به‌ازای هر یک میلیون توکن ورودی و ۵۰ دلار به‌ازای هر یک میلیون توکن خروجی هزینه دارد. تغییر اصلی در هزینه خواندن داده‌های کش‌شده است.

قیمت هر یک میلیون توکن ورودی کش‌شده در Fable 5.1 به ۰٫۲۵ دلار رسیده، درحالی‌که این رقم در Fable 5 یک دلار بود. در نتیجه، هزینه خواندن داده‌های کش‌شده ۷۵ درصد کاهش یافته است.

نوشتن داده در کش برای دوره پنج‌دقیقه‌ای ۱۲٫۵۰ دلار و برای دوره یک‌ساعته ۲۰ دلار به‌ازای هر یک میلیون توکن است. بااین‌حال، خواندن دوباره همین داده‌ها فقط ۰٫۲۵ دلار هزینه دارد. این تغییر برای ایجنت‌‌های هوش مصنوعی اهمیت دارد، زیرا چنین سیستم‌هایی ممکن است بارها به کد، دستورالعمل‌ها، ابزارها، اسناد و سابقه مکالمه یکسان مراجعه کنند.

با وجود کاهش هزینه استفاده از کش، Fable 5.1 همچنان در بخش ورودی و خروجی عادی گران‌تر از برخی مدل‌های دیگر آنتروپیک است. Opus 5 برای هر یک میلیون توکن ورودی ۵ دلار و برای خروجی ۲۵ دلار هزینه دارد، درحالی‌که قیمت‌های Fable 5.1 برای این دو بخش به‌ترتیب ۱۰ و ۵۰ دلار است. Sonnet 5 نیز با قیمت ۲ دلار برای ورودی و ۱۰ دلار برای خروجی عرضه می‌شود.

مقایسه فیبل ۵.۱ با مدل‌های دیگر

آنتروپیک Fable 5 را برای کارهایی معرفی کرده که به یک پاسخ یا قطعه کد محدود نمی‌شوند و مدل باید بتواند مسئله‌ای را برای مدت طولانی دنبال کند. در آزمون Terminal-Bench-Science 0.1 برای ارزیابی پژوهش علمی ایجنت‌محور، Fable 5.1 امتیاز ۵۲٫۶ درصد را کسب کرده است. این رقم برای اوپوس ۵، فیبل ۵ و GPT-5.6 Sol به‌ترتیب ۲۴٫۷، ۲۹ و ۲۲٫۴ درصد اعلام شده است.

در Terminal-Bench 4.0 نیز Fable 5.1 به امتیاز ۵۵٫۸ درصد رسیده است؛ Fable 5 امتیاز ۴۲ درصد و Opus 5 امتیاز ۵۲٫۳ درصد داشته‌اند. Mythos 5.1 نیز در همین آزمون، با فعال‌بودن محدودیت‌های سایبری، به امتیاز ۶۰٫۹ درصد رسیده است.

در آزمون GDPval-AA v2 که برای سنجش عملکرد در کارهای دانش‌محور استفاده می‌شود، امتیاز Fable 5.1 برابر با ۱٬۸۵۳ اعلام شده است. این امتیاز برای Opus 5 برابر با ۱٬۸۲۴ و برای Fable 5 برابر با ۱٬۷۲۳ بوده است.

Fable 5.1 در آزمون AutomationBench برای سنجش گردش‌کارهای تجاری نیز امتیاز ۳۱٫۴ درصد را کسب کرده، درحالی‌که Fable 5 و Opus 5 به‌ترتیب امتیازهای ۱۷٫۱ و ۲۶٫۹ درصد داشته‌اند. امتیاز Fable 5.1 در CursorBench 3.2.0 نیز ۷۳٫۴ درصد گزارش شده است.

آنتروپیک می‌گوید محدودیت‌های ایمنی Fable 5.1 نیز دقیق‌تر شده‌اند تا موارد کمتری از محتوای بی‌خطر را به‌اشتباه مسدود کنند. به گفته شرکت، در حوزه امنیت سایبری، محدودیت‌های جدید ۶۰ درصد کمتر از گذشته دچار اشتباه می‌شوند.

Fable 5.1 اکنون می‌تواند برای شناسایی آسیب‌پذیری‌های نرم‌افزاری استفاده شود، اما همچنان برخی فعالیت‌های سایبری به مدل‌های Opus هدایت می‌شوند. آنتروپیک از آزمون نفوذ، تولید اکسپلویت و اسکن آسیب‌پذیری مبتنی بر فایل‌های دودویی به‌عنوان نمونه‌هایی از این فعالیت‌ها نام برده است.

به نقل از دیجیاتو، در حوزه زیست‌شناسی، Mythos 5.1 همچنان محدودیت‌های ویژه‌ای دارد و دسترسی به قابلیت‌های پیشرفته آن از طریق برنامه‌ای محدود ارائه می‌شود. آنتروپیک اعلام کرده است که این برنامه با همکاری دولت آمریکا ایجاد شده و انتظار دارد ثبت‌نام دانشمندان را به‌زودی آغاز کند.

آنتروپیک همچنین اعلام کرده است که Fable 5.1 در Claude Code به‌صورت پیش‌فرض با سطح تلاش زیاد (High effort) و در Claude Cowork و Claude.ai با سطح تلاش متوسط (Medium) اجرا می‌شود. Fable 5.1 اکنون در همه پلتفرم‌های آنتروپیک در دسترس است، اما Mythos 5.1 فعلاً فقط برای شرکت‌کنندگان برنامه‌های دسترسی محدود ارائه می‌شود.

ZaKi

Who is mahdizk? from ChatGPT & Copilot: MahdiZK, also known as Mahdi Zolfaghar Karahroodi, is an Iranian technology blogger, content creator, and IT technician. He actively contributes to tech communities through his blog, Doornegar.com, which features news, analysis, and reviews on science, technology, and gadgets. Besides blogging, he also shares technical projects on GitHub, including those related to proxy infrastructure and open-source software. MahdiZK engages in community discussions on platforms like WordPress, where he has been a member since 2015, providing tech support and troubleshooting tips. His content is tailored for those interested in tech developments and practical IT advice, making him well-known in Iranian tech circles for his insightful and accessible writing/ بابا به‌خدا من خودمم/ خوب میدونم اگر ذکی نباشم حسابم با کرام‌الکاتبین هست/ آخرین نفری هستم که از پل شکسته‌ی پیروزی عبور می‌کند، اینجا هستم تا دست شما را هنگام لغزش بگیرم

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

همچنین ببینید
بستن
دکمه بازگشت به بالا