رقابت Claude و ChatGPT؛ این دو دستیار هوش مصنوعی چه تفاوتهایی با یکدیگر دارند؟
بسیاری از مخاطبان، فاتح این نبرد سایبری را از پیش مشخص و قطعی میدانند. با توجه به جذب سیل عظیمی از کاربران مدت کوتاهی پس از عرضه چتجیپیتی (ChatGPT) در سال ۲۰۲۲، این چتبات احتمالا نخستین رویارویی عموم با یک مدل زبانی بزرگ (LLM) را رقم زد. این هوش مصنوعی هم…
خلاصه تحلیلی خبر
بسیاری از مخاطبان، فاتح این نبرد سایبری را از پیش مشخص و قطعی میدانند. با توجه به جذب سیل عظیمی از کاربران مدت کوتاهی پس از عرضه چتجیپیتی (ChatGPT) در سال ۲۰۲۲، این چتبات احتمالا نخستین رویارویی عموم با یک مدل زبانی بزرگ (LLM) را رقم زد. این هوش مصنوعی هم…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، چتجیپیتی، کلود، میکند، درصد
بسیاری از مخاطبان، فاتح این نبرد سایبری را از پیش مشخص و قطعی میدانند.
با توجه به جذب سیل عظیمی از کاربران مدت کوتاهی پس از عرضه چتجیپیتی (ChatGPT) در سال ۲۰۲۲، این چتبات احتمالا نخستین رویارویی عموم با یک مدل زبانی بزرگ (LLM) را رقم زد. این هوش مصنوعی همچنین تا زمان عرضه کلود (Claude) توسط شرکت آنتروپیک (Anthropic) در مارس ۲۰۲۳، جایگاه ویژه و بدون رقیب خود را حفظ کرد. از آن زمان تاکنون، هر دو شرکت بیوقفه مدلهای خود را ارتقا دادند و ویژگیهای تازهای را به آنها افزودند. اما به دلیل همپوشانی امکانات (نظیر حالت برنامهنویسی و فضای کاری اختصاصی در هر دو پلتفرم)، انتخاب ابزار برتر، کاربران را بر سر دوراهی سختی قرار میدهد.
در مصارف روزمره، تفاوت چندانی میان این دو مدل به چشم نمیآید: میتوانید هر یک از آنها را برای کدنویسی، پاسخ به یک پرسش سریع، خلاصهسازی اسناد یا ساماندهی فایلها به کار بگیرید؛ حتی در صورت تمایل به هنجارشکنی، توانایی نگارش مقالات رهبری فکری را با سبک و سیاق هرمن ملویل در اختیار خواهید داشت.
با وجود این، برای انجام وظایف فراتر از این موارد، باید گزینه همسوتر با نیازهای تخصصی خود را بیابید.
آیا کلود دقت بالاتری نسبت به چتجیپیتی ارائه میدهد؟
سنجش میزان دقت در مدلهای زبانی بزرگ، پیچیدگیهای خاص خود را به دنبال دارد؛ چرا که هیچ پاسخ سرراستی برای این پرسش وجود ندارد. مدل انتخابی و پرامپتی که در اختیار آن میگذارید، نقش بسیار مهمی در تعیین کیفیت خروجی ایفا میکنند.
در رقابت مدلهای پرچمدار (یعنی Claude Fable 5 Max و GPT 5.6 Sol Max)، کلود بر اساس بنچمارک دقت AA-Omniscience، با اختلافی جزئی دست بالاتر را میگیرد. این دو هوش مصنوعی بهترتیب امتیازات ۶۱ و ۵۹ درصد را از آن خود میکنند. به دلیل همین حاشیه اختلاف ناچیز، در استفادههای روزمره بهندرت متوجه چنین تفاوتی خواهید شد.
با این حال، بهجز زمان استفاده از تمام ظرفیت توکنها، مدلهای میانرده بار اکثر پردازشها را به دوش میکشند. این نسخهها در کلود با نام Sonnet 5 و در چتجیپیتی با نام 5.6 Terra فعالیت میکنند. در این میدان، محصول شرکت OpenAI رقابت را به نفع خود پایان میدهد: نسخه مکس GPT 5.6 Terra امتیاز ۴۶ درصد را ثبت میکند، در حالی که Claude Sonnet 5 با افتی محسوس، تنها به امتیاز ۳۸ درصد میرسد.
تمایل چتباتها به توهمزایی (Hallucination)، معیار حیاتی دیگری در ارزیابی دقت نقشآفرینی میکند. در شرایط آرمانی، اگر یک مدل زبانی بزرگ پاسخ پرسشی را نداند، باید بهجای ساختن اطلاعات دروغین، از پاسخگویی امتناع بورزد. بنچمارک نرخ توهم AA-Omniscience این عامل را میسنجد؛ جایی که کلود برتری چشمگیری را بر رقیب خود دیکته میکند. در این بنچمارک، کسب امتیاز کمتر، عملکرد بهتر را نشان میدهد و مدل Fable 5 از کلود با امتیاز ۵۵ درصد، شکست سنگینی را بر نمره ضعیف ۸۹ درصدی GPT 5.6 Sol تحمیل میکند. این اختلاف در مدلهای میانرده، ابعاد فاحشتری به خود میگیرد: کلود Sonnet 5 امتیاز ۳۷ درصد را کسب میکند، در حالی که چتجیپیتی 5.6 Terra رکورد فاجعهبار ۸۵ درصد را بر جای میگذارد.
کلود از پس چه کارهایی برمیآید که چتجیپیتی توانایی انجام آنها را ندارد؟
اهداف مخاطبان از بهکارگیری کلود و چتجیپیتی، تفاوتهای معناداری را برجسته میسازند. طبق گزارش شاخص اقتصادی آنتروپیک در مارس ۲۰۲۶، بالغ بر ۴۲ درصد از مکالمات کلود حول محور استفادههای شخصی میچرخیدند و ۴۵ درصد آنها مستقیماً با محیط کار ارتباط میکردند (مابقی نیز به تکالیف دانشگاهی اختصاص داشتند). گزارش مشابهی از سوی شرکت OpenAI تأیید میکند که ۷۰ درصد از مصارف چتجیپیتی کاملاً غیرکاری دستهبندی میشوند.
ابزار Claude Cowork (محصول ژانویه ۲۰۲۶)، وظایف دانشمحور را بهنیابت از شما پیش میبرد؛ ویژگی قدرتمندی که منِ نویسنده شخصاً بیشترین بهره را از آن برای ساماندهی فایلهایم میبرم. همچنین میتوانید مجموعهای از دستورالعملها را تحت عنوان مهارتها (Skills) خلق کنید و آنها را در میانه مکالمه با استفاده از علامت اسلش (/) فرا بخوانید. افزون بر این، ویژگی Claude Artifacts قطعهکدها، وبسایتهای تکصفحهای HTML، کامپوننتهای تعاملی React و نمودارهای گوناگون را در لحظه رندر میکند. شما مستقیماً توانایی اشتراکگذاری و انتشار این آرتیفکتها را روی وب در دست خواهید داشت.
چتجیپیتی نیز از مهارتها پشتیبانی میکند، اما در زمینه پیادهسازی، مسیر کاملاً متفاوتی را میپیماید. بهعنوان مثال، کاربران بهصورت فردی تنها میتوانند مهارتهای چتجیپیتی را در محیط Codex و API به کار بگیرند و دسترسی آنها در چتهای معمولی مسدود میماند. در سوی مقابل، کاربران میتوانند مهارتهای کلود را بهراحتی در چتهای عادی، Claude Cowork و Claude Code احضار کنند. قابلیت Sites (معادل آرتیفکتها در چتجیپیتی)، مستقیماً کسبوکارها و مصارف داخلی آنها را هدف قرار میدهد و تنها در Codex در دسترس قرار میگیرد. علاوهبر این، برخلاف کلود آرتیفکتس که با استفاده از اپلیکیشنهای متصل و رابطهای پروتکل زمینه مدل (MCP) دادههای زنده را استخراج میکند، ویژگی Sites در چتجیپیتی از انجام چنین کاری بازمیماند.
با این تفاسیر، سازندگان برخی از ویژگیها را در چتجیپیتی بهمراتب بهتر پیادهسازی کردهاند. قابلیت صوتی، بهعنوان مهمترین نقطه قوت این هوش مصنوعی میدرخشد؛ صدای چتجیپیتی بسیار طبیعیتر به گوش میرسد و میتوانید بدون از دست رفتن رشته کلام چتبات، صحبتهای آن را قطع کنید. برای دریافت کمک در لحظه، امکان بهرهگیری از ویژگی ویدیوی زنده در حالت Advanced Voice فراهم میآید تا دوربین را مستقیماً روی مشکل پیش رو تنظیم نمایید. چتجیپیتی همچنین ابزاری را برای خلق تصاویر فوقواقعگرایانه (Photorealistic) در اختیار مخاطب میگذارد؛ در حالی که کلود تنها به ساخت نمودارها، چارتها و جلوههای بصری تعاملی با استفاده از کدهای HTML و SVG بسنده میکند.
آیا چتجیپیتی در سال ۲۰۲۶ مسیر پسرفت را طی میکند؟
مدلهای جدید چتجیپیتی تقریباً در تمام بنچمارکهای AA-Omniscience امتیازات بهتری نسبت به نسخههای پیشین ثبت میکنند؛ با این حال، تجربه کلی استفاده از این اپلیکیشن روندی نزولی را نشان میدهد. اگر چنین احساسی دارید، اصلاً اشتباه نمیکنید؛ چرا که در برخی حوزهها، مدلهای قبلی عملکرد درخشانتری را نسبت به آخرین نسخهها به نمایش میگذاشتند.
بحث توهمزایی، دقیقاً یکی از همین حوزههای بحرانی را شامل میشود. بنچمارک نرخ توهم AA-Omniscience (که پیشتر به آن اشاره کردم) گواهی میدهد که مدل GPT-4o نرخ توهم ۳۸ درصدی را ثبت میکند؛ برتری قاطعانهای که ضعف مدل GPT 5.6 Sol با نرخ فاجعهبار ۸۹ درصد را کاملاً عیان میسازد. شرکت OpenAI همچنین برای همگام شدن با بلوغ صنعت، اقدامات حفاظتی و محدودکنندهای (Safeguards) را در دل مدلهای خود گنجاند. بهعنوان نمونه، تغییرات لحن چتبات پس از هر بهروزرسانی، تضاد ناخوشایندی را به مخاطب القا میکند.
علاوهبر این، OpenAI نمایش تبلیغات را در طرح رایگان و نسخه ChatGPT Go آغاز کرد؛ در حالی که آنتروپیک با افزودن ویژگیهای بیشتر و حذف کامل تبلیغات، سطح رایگان کلود را ارتقا داد. با در نظر گرفتن این موضوع که شرکت OpenAI حتی از طریق مشتریان پولی خود نیز ضرر مالی میدهد و سم آلتمن، مدیرعامل مجموعه، زمانی تبلیغات را آخرین راهکار میخواند، میتوان با اطمینان نتیجه گرفت که تجربه کاربری چتجیپیتی برای مصرفکنندگان نسخه رایگان، در آینده شرایط وخیمتری را رقم خواهد زد.
مهاجرت کاربران از چتجیپیتی و افزایش همزمان دانلودهای کلود طی ماههای اخیر، دلیل مهم دیگری را نیز در پس پرده پنهان میکند. لغو قرارداد آنتروپیک با وزارت جنگ ایالات متحده در فوریه ۲۰۲۶، سبب شد تا این شرکت (به دلیل امتناع از صدور مجوز برای استفاده از مدلهایش در نظارت گسترده داخلی و سلاحهای کاملاً خودمختار)، برچسب خطر برای زنجیره تأمین را دریافت کند. تنها چند ساعت بعد، OpenAI اعلام کرد که با اتخاذ برخی تدابیر حفاظتی، جای آنتروپیک را برای امضای قراردادی مشابه با دولت آمریکا گرفته است. این تصمیم، موجی از کاربران را به سمت کلود سوق داد؛ زیرا آنتروپیک جایگاه یک شرکت هوش مصنوعی بسیار اخلاقمدارتر را در ذهن مخاطبان تصاحب کرد.
قیمتگذاری مشابه برای چتجیپیتی و کلود
طرحهای پولی کلود، اشتراک Pro با قیمت ۲۰ دلار در ماه (یا ۱۷ دلار در صورت پرداخت سالانه)، طرح Max 5x با قیمت ۱۰۰ دلار در ماه (همراه با محدودیت استفاده پنج برابری نسبت به Pro) و طرح Max 20x با قیمت ۲۰۰ دلار در ماه (معادل ۲۰ برابر استفاده بیشتر از Pro) را در بر میگیرند. طرحهای پولی، کلید دسترسی به مدلهای پرچمدار و ابزار Claude Code را در اختیار شما میگذارند. با این حال، کاربران Pro باید صورتحساب استفاده از مدل Fable 5 را بر اساس تعداد توکنها بپردازند؛ در حالی که خریداران طرحهای Max 5x یا Max 20x میتوانند ۵۰ درصد از محدودیت مصرف هفتگی خود را روی این مدل خرج کنند. در صورت پر شدن سقف مجاز، همواره میتوانید اعتبار بیشتری خریداری کنید.
استراتژی قیمتگذاری چتجیپیتی نیز شباهت تنگاتنگی با رقیب خود دارد. طرحهای ۲۰، ۱۰۰ و ۲۰۰ دلاری در ماه، افزایش سقف مصرف و دسترسی به مدلهای پرچمدار را به ارمغان میآورند. سازندگان دسترسی به Codex را رایگان اعلام کردهاند، اما محدودیت مصرف بسیار پایین، عملاً کارایی آن را زیر سؤال میبرد. با وجود این، برخلاف کلود، چتجیپیتی یک اشتراک ۸ دلاری در ماه را نیز به فروش میرساند که ضمن افزایش محدودیتهای استفاده، همچنان تبلیغات را به کاربر نمایش میدهد.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.