آنتروپیک با هوش مصنوعی Claude Haiku 5.5 و کاهش ۹۰ درصدی قیمت به جنگ رقبا رفت
آنتروپیک با معرفی Claude Haiku 5.5 و کاهش ۹۰ درصدی هزینهی توکنها، رقابت قیمتی مستقیمی را با GPT-6 Luna آغاز کرد. آنتروپیک از جدیدترین مدل زبانی کوچک خود با نام Claude Haiku 5.5 پرده برداشت؛ مدلی که با کاهش ۹۰ درصدی نرخ توکنها برای درخواستهای زیر ۱۰۰٬۰۰۰ تو…
خلاصه تحلیلی خبر
آنتروپیک با معرفی Claude Haiku 5.5 و کاهش ۹۰ درصدی هزینهی توکنها، رقابت قیمتی مستقیمی را با GPT-6 Luna آغاز کرد. آنتروپیک از جدیدترین مدل زبانی کوچک خود با نام Claude Haiku 5.5 پرده برداشت؛ مدلی که با کاهش ۹۰ درصدی نرخ توکنها برای درخواستهای زیر ۱۰۰٬۰۰۰ تو…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، مدل، Haiku، توکن، ۰۰۰
آنتروپیک با معرفی Claude Haiku 5.5 و کاهش ۹۰ درصدی هزینهی توکنها، رقابت قیمتی مستقیمی را با GPT-6 Luna آغاز کرد.
آنتروپیک از جدیدترین مدل زبانی کوچک خود با نام Claude Haiku 5.5 پرده برداشت؛ مدلی که با کاهش ۹۰ درصدی نرخ توکنها برای درخواستهای زیر ۱۰۰٬۰۰۰ توکن، مستقیما هزینههای بالای پردازشهای سازمانی را هدف میگیرد.
تمرکز اصلی مدل جدید بر انجام وظایف تکراری مانند خلاصهسازی اسناد، دستهبندی دادهها، کوئریزدن به پایگاههای داده و پشتیبانی از عاملهای هوشمند پیچیدهتر است.
نرخ پایهی مدل جدید از ۰٫۱۰ دلار به ازای هر یک میلیون توکن ورودی و ۰٫۵۰ دلار به ازای هر یک میلیون توکن خروجی آغاز میشود که همتراز با مدل GPT-6 Luna متعلق به اوپنایآی است.
با در نظر گرفتن ابعاد درخواستها و بهینهسازیهای اعمالشده روی توکنایزر، هزینهی اجرای حجمهای کاری سازمانی در مقایسه با Haiku 4.5 تا حدود ۷۵ درصد کاهش مییابد. در کنار این اقدام، نرخ دسترسی به حافظهی موقت (Caching) در مدل Sonnet 5.5 نیز کاهش یافته و اعتبارات ماهانهی جدیدی به مشترکان بستههای Max و Team اختصاص داده شده است.
توسعهدهندگان آنتروپیک مدل Haiku را به عنوان بازوی کمکی و پردازشگر مکمل در کنار مدلهای قدرتمندتر Opus و Sonnet معرفی میکنند؛ مدلهایی که همچنان گزینهی اصلی برای وظایف سنگین برنامهنویسی به شمار میروند. در معماریهای نوین، یک مدل بزرگ میتواند چارچوب کلی یک ارائهی مالی پیچیده را سامان دهد، در حالی که Haiku استخراج ارقام دقیق درآمدی برای هر اسلاید را بر عهده میگیرد.
الکس وانگاز متخصصان هوش مصنوعی کاربردی در شرکت مالی Rogo، دربارهی عملکرد این مدل اظهار کرد: «دقت مدل در حدی است که بتوانیم به آن تکیه کنیم و همزمان سرعت بالا و هزینهی اندک آن امکان استفادهی پیوسته و مکرر را برای ما فراهم میسازد.»
ساختار قیمتگذاری بر اساس آستانهی حجم درخواستها تفکیک شده است. درخواستهای بالاتر از ۱۰۰٬۰۰۰ توکن مشمول نرخ ۰٫۵۰ دلار برای ورودی و ۲٫۵۰ دلار برای خروجی میشوند که حاکی از کاهش ۵۰ درصدی نسبت به نسل پیشین است، در شرایطی که درخواستهای زیر این آستانه مشمول کاهش ۹۰ درصدی قیمت شدهاند.
جدول زیر ساختار دقیق هزینههای توکن و حافظهی موقت مدلهای Haiku را نشان میدهد.
هزینه بر اساس هر یک میلیون توکن | Haiku 5.5: زیر ۱۰۰,۰۰۰ توکن | Haiku 5.5: بالای ۱۰۰,۰۰۰ توکن | Haiku 4.5 |
|---|---|---|---|
ورودی | $0.10 | $0.50 | $1.00 |
خروجی | $0.50 | $2.50 | $5.00 |
خواندن از حافظهی موقت (Cache reads) | $0.01 | $0.05 | $0.10 |
نوشتن در حافظهی موقت (Cache writes) | $0.125 | $0.625 | $1.25 |
طبق دادههای آماری ارائهشده، حدود ۹۰ درصد از درخواستهای کاربران مدل Haiku 4.5 در دستهی کوتاهتر از ۱۰۰٬۰۰۰ توکن جای میگیرند. هرچند توکنایزر جدید تعداد توکنهای بیشتری را برای اجرای وظایف همارز مصرف میکند، میانگین صرفهجویی نهایی در هزینهها به ۷۵ درصد میرسد.
تعرفههای جدید توان رقابتی محصول آنتروپیک را در بازار مدلهای اختصاصی ارتقا داده است، گرچه این مدل در تمام شاخصها ارزانترین گزینهی بازار به شمار نمیرود. مدل GPT-6 Luna اوپنایآی در تمام چهار نرخ ردهی پایین از جمله بخش حافظهی موقت با مدل جدید برابری میکند.
جدول زیر مقایسهی قیمت ورودی و خروجی میان ارائهدهندگان مطرح هوش مصنوعی را نمایش میدهد.
مدل | ورودی به ازای هر یک میلیون توکن | خروجی به ازای هر یک میلیون توکن | شرایط قیمتگذاری |
|---|---|---|---|
Anthropic Claude Haiku 5.5 | $0.10 | $0.50 | درخواستهای زیر ۱۰۰,۰۰۰ توکن |
OpenAI GPT-6 Luna | $0.10 | $0.50 | نرخ پایه؛ نرخهای بالاتر از ۲۷۲,۰۰۰ توکن ورودی |
Google Gemini 3.5 Flash-Lite | $0.30 | $2.50 | قیمتگذاری استاندارد |
Anthropic Claude Haiku 5.5 | $0.50 | $2.50 | درخواستهای بالای ۱۰۰,۰۰۰ توکن |
Google Gemini 3.8 Flash | $0.75 | $3.75 | نرخهای پروموشنال استاندارد تا پایان سال ۲۰۲۶ |
Grok 4.3 | $1.25 | $2.50 | زیر ۲۰۰,۰۰۰ توکن پرامپت |
Grok 4.7 | $2.00 | $6.00 | زیر ۲۰۰,۰۰۰ توکن پرامپت |
OpenAI GPT-6.1 Sol | $2.00 | $10.00 | نرخ استاندارد پایه |
Anthropic Claude Sonnet 5.5 | $2.00 | $10.00 | نرخهای فهرستشده در جدول عرضه |
تفاوت در آستانهی اعمال تعرفهها نقشی کلیدی در محاسبات مالی سازمانها دارد. ردهی بالاتر تعرفهی Haiku پنج برابر ردهی پایینی آن محاسبه میشود، در حالی که هزینهی اضافی مدل Luna از آستانهی ۲۷۲٬۰۰۰ توکن ورودی آغاز میشود. از سویی دیگر، مواردی همچون دقت پاسخ، نیاز به تلاش مجدد و میزان توکن مصرفی تاثیر مستقیمی بر هزینهی تمامشدهی پروژهها دارند.
دادههای ارائهشده در آزمونهای بنچمارک نشاندهندهی برتری محسوس مدل جدید نسبت به Haiku 4.5 و پیشیگرفتن از GPT-6 Luna در برخی ارزیابیهای منتخب است، هرچند Sonnet 5.5 همچنان دست بالا را در دستاوردهای فنی دارد.
جدول زیر عملکرد مدلهای مختلف را در بنچمارکهای تخصصی مقایسه میکند.
ارزیابی | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
GDPval-AA v2.1: کارهای دانشی | 1,620 | 735 | 1,437 | 1,840 |
AA-Briefcase v1.1: کارهای دانشی | 1,578 | 614 | 1,336 | 1,824 |
OSWorld 2.1, زیرمجموعهی آفلاین: کار با کامپیوتر | 72.4% | 15.7% | 48.9% | 83.9% |
Terminal-Bench 4.0: کدنویسی مبتنی بر عامل | 39.2% | 0.0% | 16.4% | 70.6% |
FrontierCode 1.1, ارزیابی اصلی | 46.4% | 42.4% | 52.1%* |
قابلیت تنظیم سطوح پردازش (Effort Levels) از نوآوریهای Claude Haiku 5.5 محسوب میشود که حالت پیشفرض آن روی سطح متوسط قرار دارد. دستیابی به امتیاز حدود ۳۹ درصد در بنچمارک Terminal-Bench 4.0 در شرایط حداکثر توان پردازشی رخ داده است، در حالی که سطح پردازش متوسط به امتیاز حدود ۲۰ درصد میرسد.
سرعت مدل جدید در وضعیت استاندارد بالاترین میزان را در میان محصولات آنتروپیک ثبت کرده است، هرچند مدل Opus در حالت Fast Mode عملکرد سریعتری نشان میدهد. آنتروپیک شاخص دقیق تعداد توکن بر ثانیه را منتشر نکرده، اما گزارشهای دریافتی از شرکتهای همکار حاوی نکات قابل توجهی است.
یاشودا باونانیاز مدیران ارشد هوش مصنوعی در پلتفرم Box از بهبود ۱۱ امتیازی عملکرد نسبت به نسل پیشین همراه با نصف شدن میزان تاخیر خبر میدهد.
آرون وینمهندس نرمافزار Asana، به کاهش بیش از ۳۰ درصدی تاخیر در اتمام وظایف و افزایش ۲٫۵ برابری سرعت استنتاج در هر گام عامل اشاره کرده است.
زیو کلاپومهندس برجستهی HubSpot، میانگین امتیاز ۹۲٫۸ درصد را در سه دور آزمون سامانهی مدیریت ارتباط با مشتریان گزارش کرده است.
عرضهی مدل جدید علاوهبر پلتفرم اختصاصی آنتروپیک، روی زیرساختهای ابری بزرگ شامل AWS، گوگل کلاد و مایکروسافت آژور با شناسهی claude-haiku-5-5 آغاز شده است. بستههای توسعهی نرمافزاری پایتون و تایپاسکریپت نیز بهروزرسانی شدهاند و امکانات آزمایشی برای هدایت مرورگرها و کنترل کامپیوتر را در اختیار برنامهنویسان قرار میدهند.
محدودیتهای امنیتی تازهای در زمینهی سایبری اعمال شده است و اجرای تستهای نفوذ تحت پروتکلهای محافظتی استاندارد مسدود میشود. سازمانهای متقاضی دسترسی به ابزارهای پیشرفتهی امنیتی یا بیولوژیکی ملزم به ثبتنام در برنامههای راستیآزمایی آنتروپیک خواهند بود.
چالش اصلی پیش روی توسعهدهندگان تجاری، ارزیابی توانایی مدل در انجام دقیق وظایف مشخص بهمنظور توجیه اقتصادی بهکارگیری مداوم آن در فرآیندهای کاری است.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.