آنتروپیک Sonnet 5.5 را معرفی کرد؛ سرعت بیشتر و هزینه کمتر
آنتروپیک مدل Claude Sonnet 5.5 را با سرعت بیش از ۳۰ درصد بیشتر و کاهش تا ۳۰ درصدی هزینه اجرای وظایف نسبت به نسل قبل عرضه کرد . هوش مصنوعی تکناک در چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به شکل قابلتوجهی به مدل گرانتر Opus 5.5 نزدیک شده است. آنتروپیک این م…
خلاصه تحلیلی خبر
آنتروپیک مدل Claude Sonnet 5.5 را با سرعت بیش از ۳۰ درصد بیشتر و کاهش تا ۳۰ درصدی هزینه اجرای وظایف نسبت به نسل قبل عرضه کرد . هوش مصنوعی تکناک در چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به شکل قابلتوجهی به مدل گرانتر Opus 5.5 نزدیک شده است. آنتروپیک این م…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، Sonnet، مدل، توکن
آنتروپیکمدلClaude Sonnet 5.5را با سرعت بیش از۳۰درصد بیشتر و کاهش تا۳۰درصدی هزینه اجرای وظایف نسبت به نسل قبل عرضه کرد.
هوش مصنوعیتکناکدر چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به شکل قابلتوجهی به مدل گرانتر Opus 5.5 نزدیک شده است.
آنتروپیک این مدل پرچمدار جدید را تنها یک هفته پیش عرضه کرده بود. این موضوع میتواند Sonnet 5.5 را به گزینه دیگری برای شرکتهایی تبدیل کند که نمیخواهند هزینه استفاده از یک مدل پیشرفته ردهبالا را پرداخت کنند.
آنتروپیک میگوید Sonnet 5.5 خروجی را بیش از ۳۰ درصد سریعتر از Claude Sonnet 5 تولید میکند و میتواند هزینه کلی انجام یک وظیفه را تا ۳۰ درصد کاهش دهد.
این کاهش هزینه بیشتر به دلیل استفاده کمتر از توکنها و فراخوانیهای ابزار کمتر اتفاق میافتد، نه به دلیل کاهش قیمت هر توکن در API.
قیمت API مدل Sonnet 5.5 مانند نسل قبلی، یعنی Sonnet 5، برابر با ۲ دلار برای هر یک میلیون توکن ورودی و ۱۰ دلار برای هر یک میلیون توکن خروجی است.
هزینه خواندن توکنهای کششده نیز به ۰.۲۰ دلار برای هر یک میلیون توکن رسیده و نوشتن کش ۲.۵۰ دلار برای هر یک میلیون توکن هزینه دارد.
در مقابل، Opus 5.5 برای هر یک میلیون توکن ورودی ۴ دلار و برای هر یک میلیون توکن خروجی ۲۰ دلار هزینه دارد و قیمت نوشتن کش آن ۵ دلار است.
قابلیتهای Opus بیشتر به Sonnet میآیند
آنتروپیک میگوید Sonnet 5.5 برای کارهای روزمره و نسبتاً مشخص مانند رفع اشکال نرمافزار، برنامهنویسی، تولید اسناد، ساخت ارائهها و صفحات گسترده و طراحی یا اصلاح رابطهای کاربری مناسب است.
Opus 5.5 همچنان برای کارهای مبهم و باز که به قضاوت مستمر نیاز دارند، گزینه اصلی شرکت محسوب میشود.
نتایج آزمایشهای خود آنتروپیک نشان میدهد فاصله میان این دو مدل در برخی وظایف به میزان قابلتوجهی کاهش یافته است.
Sonnet 5.5 در آزمون GDPval-AA امتیاز ۱۸۴۴ را به دست آورده، در حالی که Opus 5.5 امتیاز ۱۸۴۶ و Sonnet 5 امتیاز ۱۴۴۹ کسب کردهاند.
Sonnet 5.5 در آزمون AA-Briefcase نیز امتیاز ۱۸۱۱ را ثبت کرده است، در حالی که امتیاز Opus 5.5 برابر با ۱۸۲۲ بوده است.
این مدل در ارزیابی OSWorld 2.1 نیز به امتیاز ۸۰.۱ درصد رسیده که فاصله کمی با امتیاز ۸۱.۸ درصدی Opus 5.5 دارد. Sonnet 5 در همین آزمون امتیاز ۵۷ درصد کسب کرده است.
در آزمون تشخیص نمودار Chartography، Sonnet 5.5 امتیاز ۶۱.۶ درصد را به دست آورده است، در حالی که Opus 5.5 امتیاز ۶۴.۴ درصد و Sonnet 5 تنها ۱۵.۶ درصد کسب کردهاند.
عملکرد Sonnet 5.5 در برنامهنویسی نیز بهبود یافته است. این مدل در آزمون Terminal-Bench 4.0 امتیاز ۷۰.۶ درصد را ثبت کرده، در حالی که امتیاز Sonnet 5 برابر با ۱۰.۳ درصد و Opus 5.5 برابر با ۶۶.۴ درصد بوده است.
Sonnet 5.5 در CursorBench 4.0 نیز به امتیاز ۵۵.۵ درصد رسیده که اندکی کمتر از امتیاز ۵۷.۸ درصدی Opus 5.5 است.
آنتروپیک تأکید میکند نتایج بنچمارکها لزوماً عملکرد مدل در تمام محیطهای واقعی را نشان نمیدهند و Opus 5.5 همچنان در کارهای دشوار و باز عملکرد بهتری دارد.
با این حال، از دید اقتصادی، هزینه انجام هر وظیفه ممکن است اهمیت بیشتری از رتبه مدلها در بنچمارکها داشته باشد.
آنتروپیک میگوید Sonnet 5.5 در چندین ارزیابی، هنگام استفاده از سطح تلاش Low یا Medium میتواند با هزینهای حدود یکدهم هزینه هر وظیفه، از بهترین امتیاز Sonnet 5 عبور کند.
در آزمون FrontierCode نیز Sonnet 5.5 در سطح تلاش High حدود ۱۰ امتیاز بیشتر از Sonnet 5 کسب کرده و هزینه انجام هر وظیفه آن تقریباً یکپانزدهم مدل قدیمیتر بوده است.
در Claude Code و اپلیکیشنهای مصرفی آنتروپیک، سطح تلاش Medium بهصورت پیشفرض فعال خواهد بود، در حالی که Claude Platform از سطح High استفاده میکند.
تنظیمات پایینتر، عمق استدلال را در ازای کاهش تأخیر و مصرف توکن کاهش میدهند و تنظیمات بالاتر به مدل اجازه میدهند زمان بیشتری برای بررسی و اصلاح خروجی صرف کند.
بیشتر بخوانیدآنتروپیک نسخه پیشرفته Opus 5.5 را با هزینه کمتر عرضه کرد
مشتریان سازمانی از کاهش تعداد مراحل خبر میدهند
آنتروپیک همچنین نتایج اولیه آزمایش مشتریان را منتشر کرده است که تصویر عملیتری از تأثیر این بهبودها در محیطهای سازمانی ارائه میدهد.
در شرکت Box، یاشودا بهوانانی، معاون محصولات هوش مصنوعی، گفت Sonnet 5.5 توانسته اسناد منبع را دوباره بررسی کند و خطاهایی را شناسایی کند که مدل قبلی متوجه آنها نشده بود.
او اعلام کرد این مدل نسبت به نسل قبلی ۲.۴ برابر سریعتر بوده و ۱۲ درصد توکن کمتری مصرف کرده است.
Zendesk نیز این مدل را روی صدها پرونده پشتیبانی آزمایش کرد. این شرکت اعلام کرده است پردازش درخواستها ۲۰ درصد سریعتر شده و مدل تصمیمهای اشتباه کمتری نسبت به مدلهای Claude مورد استفاده فعلی در محیط عملیاتی داشته است.
Slack نیز اعلام کرده است Sonnet 5.5 در تقریباً تمام ارزیابیهای آفلاین Slackbot عملکرد بهتری نسبت به Sonnet 5 داشته و برای رسیدن به نتیجه به مراحل کمتری نیاز داشته است.
مصرف توکن خروجی نیز حدود ۱۴ درصد کاهش یافته است.
در عاملهای برنامهنویسی، کاهش تعداد مراحل اهمیت بیشتری دارد.
شرکت Lovable اعلام کرده است Sonnet 5.5 برای تکمیل وظایف برنامهنویسی حدود یکسوم فراخوانی ابزار کمتر و تقریباً نیمی از اجرای دستورات shell نسبت به مدل قبلی نیاز داشته است.
شرکت Base44 نیز پس از بررسی ۱۱۸ ساخت واقعی اپلیکیشن اعلام کرد Sonnet 5.5 توانسته با میانگین ۳.۶ تکرار برای هر پروژه به نتایجی مشابه Opus 5 برسد، در حالی که Opus 5 بهطور میانگین به ۷.۷ تکرار نیاز داشته است.
این نتایج نشان میدهند قیمت هر توکن تنها بخشی از هزینه واقعی استفاده سازمانها از عاملهای هوش مصنوعی است.
هر فراخوانی غیرضروری ابزار، اقدام ناموفق و تلاش مجدد میتواند تأخیر و هزینه زیرساخت را افزایش دهد.
بیشتر بخوانیدشکست کلید توقف اضطراری؛ OpenAI آموزش قدرتمندترین مدلهایش را متوقف کرد
رقابت قیمت مدلهای هوش مصنوعی فشردهتر میشود
Claude Sonnet 5.5 در بازاری عرضه شده که رقابت میان مدلهای ردهبالای ارزانتر شدت گرفته است.
OpenAI هفته گذشته GPT-6 Sol را عرضه کرد و قیمت استاندارد API آن نیز ۲ دلار برای هر یک میلیون توکن ورودی و ۱۰ دلار برای هر یک میلیون توکن خروجی است.
این مدل برای برنامهنویسی پیچیده و فرایندهای مبتنی بر عاملهای هوش مصنوعی طراحی شده و پنجره زمینه ۱.۰۵ میلیون توکنی دارد.
گوگل با Gemini 3.8 Flash قیمت پایینتری ارائه میدهد. قیمت اولیه این مدل تا پایان سال ۲۰۲۶ برابر با ۰.۷۵ دلار برای هر یک میلیون توکن ورودی و ۳.۷۵ دلار برای هر یک میلیون توکن خروجی است.
گوگل اعلام کرده است قیمت استاندارد از اول ژانویه ۲۰۲۷ بهترتیب به ۱.۵۰ و ۷.۵۰ دلار افزایش خواهد یافت.
در چنین شرایطی، آنتروپیک تلاش نمیکند صرفاً با ارزانترین قیمت هر توکن رقابت کند.
استدلال این شرکت این است که مدلی که یک وظیفه را با مراحل استدلال، توکن و فراخوانی ابزار کمتری انجام دهد، حتی با قیمت ثابت هر توکن میتواند هزینه عملیاتی نهایی پایینتری داشته باشد.
قابلیتهای سایبری قدرتمندتر با محدودیتهای بیشتر
بهبود عملکرد Sonnet 5.5 با تغییرات امنیتی نیز همراه شده است. این مدل نخستین مدل Sonnet شرکت آنتروپیک است که هنگام عرضه، از سازوکارهای حفاظتی امنیت سایبری مشابه سیستمهای قدرتمندتر این شرکت استفاده میکند.
آنتروپیک میگوید توسعه معمول نرمافزار و رفع آسیبپذیریها همچنان بدون محدودیت انجام خواهد شد، اما برخی درخواستهای پرخطر در حوزه امنیت سایبری بهصورت خودکار به Sonnet 5 منتقل میشوند.
این شرکت همچنین قصد دارد برنامه Cyber Verification Program را گسترش دهد تا متخصصان امنیتی تأییدشده بتوانند به قابلیتهای پیشرفتهتر Sonnet 5.5، Opus 5.5 و مدلهای Mythos دسترسی داشته باشند.
Sonnet 5.5 همچنین نخستین مدل Sonnet است که با طبقهبندیکنندههایی برای جلوگیری از استخراج فرایند استدلال عرضه میشود.
آنتروپیک میگوید سیستم «تفکر حفظشده» خود را نیز گسترش داده است تا فرایند استدلال از حساب کاربری ایجادکننده آن جدا نشود. سازوکارهای حفاظتی زیستی نیز مانند Sonnet 5 باقی ماندهاند.
عرضه Sonnet 5.5 در سرویسهای ابری
Claude Sonnet 5.5 از طریق خود آنتروپیک و همچنین Amazon Web Services، Google Cloud و Microsoft Azure در دسترس خواهد بود و از قابلیت نگهداری صفر داده پشتیبانی میکند.
توسعهدهندگان میتوانند این مدل را از طریق Claude Platform و با شناسه claude-sonnet-5-5 دریافت کنند.
آنتروپیک اعلام کرده است Claude Haiku 5.5 که برای وظایف پرتعداد و بهویژه کاربردهای حساس به هزینه طراحی شده، در هفتههای آینده عرضه خواهد شد.
برای توسعهدهندگان سازمانی، اهمیت اصلی Sonnet 5.5 به کاهش چشمگیر قیمت API مربوط نمیشود.
آنتروپیک تلاش میکند مدل میانرده خود را آنقدر به مدل پرچمدار نزدیک کند که بسیاری از وظایف دیگر به استفاده از مدل گرانتر نیاز نداشته باشند.
نوشتهآنتروپیک Sonnet 5.5 را معرفی کرد؛ سرعت بیشتر و هزینه کمتراولین بار درTechnoc. پدیدار شد.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.