اخبار هوش مصنوعی

آنتروپیک Sonnet 5.5 را معرفی کرد؛ سرعت بیشتر و هزینه کمتر

آنتروپیک مدل Claude Sonnet 5.5 را با سرعت بیش از ۳۰ درصد بیشتر و کاهش تا ۳۰ درصدی هزینه اجرای وظایف نسبت به نسل قبل عرضه کرد . هوش مصنوعی تک‌ناک در چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به شکل قابل‌توجهی به مدل گران‌تر Opus 5.5 نزدیک شده است. آنتروپیک این م…

8 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • امنیت سایبری
  • Sonnet
  • مدل
  • توکن
  • امتیاز
  • هزینه
آنتروپیک Sonnet 5.5 را معرفی کرد؛ سرعت بیشتر و هزینه کمتر

خلاصه تحلیلی خبر

آنتروپیک مدل Claude Sonnet 5.5 را با سرعت بیش از ۳۰ درصد بیشتر و کاهش تا ۳۰ درصدی هزینه اجرای وظایف نسبت به نسل قبل عرضه کرد . هوش مصنوعی تک‌ناک در چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به شکل قابل‌توجهی به مدل گران‌تر Opus 5.5 نزدیک شده است. آنتروپیک این م…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، Sonnet، مدل، توکن

آنتروپیکمدلClaude Sonnet 5.5را با سرعت بیش از۳۰درصد بیشتر و کاهش تا۳۰درصدی هزینه اجرای وظایف نسبت به نسل قبل عرضه کرد.

هوش مصنوعیتک‌ناکدر چندین آزمایش آنتروپیک، عملکرد Sonnet 5.5 به شکل قابل‌توجهی به مدل گران‌تر Opus 5.5 نزدیک شده است.

آنتروپیک این مدل پرچم‌دار جدید را تنها یک هفته پیش عرضه کرده بود. این موضوع می‌تواند Sonnet 5.5 را به گزینه دیگری برای شرکت‌هایی تبدیل کند که نمی‌خواهند هزینه استفاده از یک مدل پیشرفته رده‌بالا را پرداخت کنند.

آنتروپیک می‌گوید Sonnet 5.5 خروجی را بیش از ۳۰ درصد سریع‌تر از Claude Sonnet 5 تولید می‌کند و می‌تواند هزینه کلی انجام یک وظیفه را تا ۳۰ درصد کاهش دهد.

این کاهش هزینه بیشتر به دلیل استفاده کمتر از توکن‌ها و فراخوانی‌های ابزار کمتر اتفاق می‌افتد، نه به دلیل کاهش قیمت هر توکن در API.

قیمت API مدل Sonnet 5.5 مانند نسل قبلی، یعنی Sonnet 5، برابر با ۲ دلار برای هر یک میلیون توکن ورودی و ۱۰ دلار برای هر یک میلیون توکن خروجی است.

هزینه خواندن توکن‌های کش‌شده نیز به ۰.۲۰ دلار برای هر یک میلیون توکن رسیده و نوشتن کش ۲.۵۰ دلار برای هر یک میلیون توکن هزینه دارد.

در مقابل، Opus 5.5 برای هر یک میلیون توکن ورودی ۴ دلار و برای هر یک میلیون توکن خروجی ۲۰ دلار هزینه دارد و قیمت نوشتن کش آن ۵ دلار است.

قابلیت‌های Opus بیشتر به Sonnet می‌آیند

تصویری از لوگوی Claude Opus 5.5

آنتروپیک می‌گوید Sonnet 5.5 برای کارهای روزمره و نسبتاً مشخص مانند رفع اشکال نرم‌افزار، برنامه‌نویسی، تولید اسناد، ساخت ارائه‌ها و صفحات گسترده و طراحی یا اصلاح رابط‌های کاربری مناسب است.

Opus 5.5 همچنان برای کارهای مبهم و باز که به قضاوت مستمر نیاز دارند، گزینه اصلی شرکت محسوب می‌شود.

نتایج آزمایش‌های خود آنتروپیک نشان می‌دهد فاصله میان این دو مدل در برخی وظایف به میزان قابل‌توجهی کاهش یافته است.

Sonnet 5.5 در آزمون GDPval-AA امتیاز ۱۸۴۴ را به دست آورده، در حالی که Opus 5.5 امتیاز ۱۸۴۶ و Sonnet 5 امتیاز ۱۴۴۹ کسب کرده‌اند.

Sonnet 5.5 در آزمون AA-Briefcase نیز امتیاز ۱۸۱۱ را ثبت کرده است، در حالی که امتیاز Opus 5.5 برابر با ۱۸۲۲ بوده است.

این مدل در ارزیابی OSWorld 2.1 نیز به امتیاز ۸۰.۱ درصد رسیده که فاصله کمی با امتیاز ۸۱.۸ درصدی Opus 5.5 دارد. Sonnet 5 در همین آزمون امتیاز ۵۷ درصد کسب کرده است.

در آزمون تشخیص نمودار Chartography، Sonnet 5.5 امتیاز ۶۱.۶ درصد را به دست آورده است، در حالی که Opus 5.5 امتیاز ۶۴.۴ درصد و Sonnet 5 تنها ۱۵.۶ درصد کسب کرده‌اند.

عملکرد Sonnet 5.5 در برنامه‌نویسی نیز بهبود یافته است. این مدل در آزمون Terminal-Bench 4.0 امتیاز ۷۰.۶ درصد را ثبت کرده، در حالی که امتیاز Sonnet 5 برابر با ۱۰.۳ درصد و Opus 5.5 برابر با ۶۶.۴ درصد بوده است.

Sonnet 5.5 در CursorBench 4.0 نیز به امتیاز ۵۵.۵ درصد رسیده که اندکی کمتر از امتیاز ۵۷.۸ درصدی Opus 5.5 است.

آنتروپیک تأکید می‌کند نتایج بنچمارک‌ها لزوماً عملکرد مدل در تمام محیط‌های واقعی را نشان نمی‌دهند و Opus 5.5 همچنان در کارهای دشوار و باز عملکرد بهتری دارد.

با این حال، از دید اقتصادی، هزینه انجام هر وظیفه ممکن است اهمیت بیشتری از رتبه مدل‌ها در بنچمارک‌ها داشته باشد.

آنتروپیک می‌گوید Sonnet 5.5 در چندین ارزیابی، هنگام استفاده از سطح تلاش Low یا Medium می‌تواند با هزینه‌ای حدود یک‌دهم هزینه هر وظیفه، از بهترین امتیاز Sonnet 5 عبور کند.

در آزمون FrontierCode نیز Sonnet 5.5 در سطح تلاش High حدود ۱۰ امتیاز بیشتر از Sonnet 5 کسب کرده و هزینه انجام هر وظیفه آن تقریباً یک‌پانزدهم مدل قدیمی‌تر بوده است.

در Claude Code و اپلیکیشن‌های مصرفی آنتروپیک، سطح تلاش Medium به‌صورت پیش‌فرض فعال خواهد بود، در حالی که Claude Platform از سطح High استفاده می‌کند.

تنظیمات پایین‌تر، عمق استدلال را در ازای کاهش تأخیر و مصرف توکن کاهش می‌دهند و تنظیمات بالاتر به مدل اجازه می‌دهند زمان بیشتری برای بررسی و اصلاح خروجی صرف کند.

بیشتر بخوانیدآنتروپیک نسخه پیشرفته Opus 5.5 را با هزینه کمتر عرضه کرد

مشتریان سازمانی از کاهش تعداد مراحل خبر می‌دهند

آنتروپیک همچنین نتایج اولیه آزمایش مشتریان را منتشر کرده است که تصویر عملی‌تری از تأثیر این بهبودها در محیط‌های سازمانی ارائه می‌دهد.

در شرکت Box، یاشودا بهوانانی، معاون محصولات هوش مصنوعی، گفت Sonnet 5.5 توانسته اسناد منبع را دوباره بررسی کند و خطاهایی را شناسایی کند که مدل قبلی متوجه آن‌ها نشده بود.

او اعلام کرد این مدل نسبت به نسل قبلی ۲.۴ برابر سریع‌تر بوده و ۱۲ درصد توکن کمتری مصرف کرده است.

Zendesk نیز این مدل را روی صدها پرونده پشتیبانی آزمایش کرد. این شرکت اعلام کرده است پردازش درخواست‌ها ۲۰ درصد سریع‌تر شده و مدل تصمیم‌های اشتباه کمتری نسبت به مدل‌های Claude مورد استفاده فعلی در محیط عملیاتی داشته است.

Slack نیز اعلام کرده است Sonnet 5.5 در تقریباً تمام ارزیابی‌های آفلاین Slackbot عملکرد بهتری نسبت به Sonnet 5 داشته و برای رسیدن به نتیجه به مراحل کمتری نیاز داشته است.

مصرف توکن خروجی نیز حدود ۱۴ درصد کاهش یافته است.

در عامل‌های برنامه‌نویسی، کاهش تعداد مراحل اهمیت بیشتری دارد.

شرکت Lovable اعلام کرده است Sonnet 5.5 برای تکمیل وظایف برنامه‌نویسی حدود یک‌سوم فراخوانی ابزار کمتر و تقریباً نیمی از اجرای دستورات shell نسبت به مدل قبلی نیاز داشته است.

شرکت Base44 نیز پس از بررسی ۱۱۸ ساخت واقعی اپلیکیشن اعلام کرد Sonnet 5.5 توانسته با میانگین ۳.۶ تکرار برای هر پروژه به نتایجی مشابه Opus 5 برسد، در حالی که Opus 5 به‌طور میانگین به ۷.۷ تکرار نیاز داشته است.

این نتایج نشان می‌دهند قیمت هر توکن تنها بخشی از هزینه واقعی استفاده سازمان‌ها از عامل‌های هوش مصنوعی است.

هر فراخوانی غیرضروری ابزار، اقدام ناموفق و تلاش مجدد می‌تواند تأخیر و هزینه زیرساخت را افزایش دهد.

بیشتر بخوانیدشکست کلید توقف اضطراری؛ OpenAI آموزش قدرتمندترین مدل‌هایش را متوقف کرد

رقابت قیمت مدل‌های هوش مصنوعی فشرده‌تر می‌شود

تصویری از Claude Sonnet 5.5

Claude Sonnet 5.5 در بازاری عرضه شده که رقابت میان مدل‌های رده‌بالای ارزان‌تر شدت گرفته است.

OpenAI هفته گذشته GPT-6 Sol را عرضه کرد و قیمت استاندارد API آن نیز ۲ دلار برای هر یک میلیون توکن ورودی و ۱۰ دلار برای هر یک میلیون توکن خروجی است.

این مدل برای برنامه‌نویسی پیچیده و فرایندهای مبتنی بر عامل‌های هوش مصنوعی طراحی شده و پنجره زمینه ۱.۰۵ میلیون توکنی دارد.

گوگل با Gemini 3.8 Flash قیمت پایین‌تری ارائه می‌دهد. قیمت اولیه این مدل تا پایان سال ۲۰۲۶ برابر با ۰.۷۵ دلار برای هر یک میلیون توکن ورودی و ۳.۷۵ دلار برای هر یک میلیون توکن خروجی است.

گوگل اعلام کرده است قیمت استاندارد از اول ژانویه ۲۰۲۷ به‌ترتیب به ۱.۵۰ و ۷.۵۰ دلار افزایش خواهد یافت.

در چنین شرایطی، آنتروپیک تلاش نمی‌کند صرفاً با ارزان‌ترین قیمت هر توکن رقابت کند.

استدلال این شرکت این است که مدلی که یک وظیفه را با مراحل استدلال، توکن و فراخوانی ابزار کمتری انجام دهد، حتی با قیمت ثابت هر توکن می‌تواند هزینه عملیاتی نهایی پایین‌تری داشته باشد.

قابلیت‌های سایبری قدرتمندتر با محدودیت‌های بیشتر

بهبود عملکرد Sonnet 5.5 با تغییرات امنیتی نیز همراه شده است. این مدل نخستین مدل Sonnet شرکت آنتروپیک است که هنگام عرضه، از سازوکارهای حفاظتی امنیت سایبری مشابه سیستم‌های قدرتمندتر این شرکت استفاده می‌کند.

آنتروپیک می‌گوید توسعه معمول نرم‌افزار و رفع آسیب‌پذیری‌ها همچنان بدون محدودیت انجام خواهد شد، اما برخی درخواست‌های پرخطر در حوزه امنیت سایبری به‌صورت خودکار به Sonnet 5 منتقل می‌شوند.

این شرکت همچنین قصد دارد برنامه Cyber Verification Program را گسترش دهد تا متخصصان امنیتی تأییدشده بتوانند به قابلیت‌های پیشرفته‌تر Sonnet 5.5، Opus 5.5 و مدل‌های Mythos دسترسی داشته باشند.

Sonnet 5.5 همچنین نخستین مدل Sonnet است که با طبقه‌بندی‌کننده‌هایی برای جلوگیری از استخراج فرایند استدلال عرضه می‌شود.

آنتروپیک می‌گوید سیستم «تفکر حفظ‌شده» خود را نیز گسترش داده است تا فرایند استدلال از حساب کاربری ایجادکننده آن جدا نشود. سازوکارهای حفاظتی زیستی نیز مانند Sonnet 5 باقی مانده‌اند.

عرضه Sonnet 5.5 در سرویس‌های ابری

Claude Sonnet 5.5 از طریق خود آنتروپیک و همچنین Amazon Web Services، Google Cloud و Microsoft Azure در دسترس خواهد بود و از قابلیت نگهداری صفر داده پشتیبانی می‌کند.

توسعه‌دهندگان می‌توانند این مدل را از طریق Claude Platform و با شناسه claude-sonnet-5-5 دریافت کنند.

آنتروپیک اعلام کرده است Claude Haiku 5.5 که برای وظایف پرتعداد و به‌ویژه کاربردهای حساس به هزینه طراحی شده، در هفته‌های آینده عرضه خواهد شد.

برای توسعه‌دهندگان سازمانی، اهمیت اصلی Sonnet 5.5 به کاهش چشمگیر قیمت API مربوط نمی‌شود.

آنتروپیک تلاش می‌کند مدل میان‌رده خود را آن‌قدر به مدل پرچم‌دار نزدیک کند که بسیاری از وظایف دیگر به استفاده از مدل گران‌تر نیاز نداشته باشند.

نوشتهآنتروپیک Sonnet 5.5 را معرفی کرد؛ سرعت بیشتر و هزینه کمتراولین بار درTechnoc. پدیدار شد.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.