اخبار هوش مصنوعی

نتایج یک آزمایش فنی ادعای ارزان‌تر بودن دیپ‌سیک را رد کرد

ارزیابی فنی شرکت The Call Center Doctors نشان می‌دهد ادعای کاهش هزینه ۸۰ برابری استفاده از مدل DeepSeek در محیط‌های عملیاتی کدنویسی چندان دقیق نیست. هوش مصنوعی تکناک، شرکت مشاوره‌ای The Call Center Doctors که به صورت تخصصی در زمینه طراحی و اداره مراکز تماس برا…

5 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • دلار
  • هزینه
  • مدل
  • استفاده
  • Claude
  • حدود
نتایج یک آزمایش فنی ادعای ارزان‌تر بودن دیپ‌سیک را رد کرد

خلاصه تحلیلی خبر

ارزیابی فنی شرکت The Call Center Doctors نشان می‌دهد ادعای کاهش هزینه ۸۰ برابری استفاده از مدل DeepSeek در محیط‌های عملیاتی کدنویسی چندان دقیق نیست. هوش مصنوعی تکناک، شرکت مشاوره‌ای The Call Center Doctors که به صورت تخصصی در زمینه طراحی و اداره مراکز تماس برا…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، دلار، هزینه، مدل، استفاده

ارزیابی فنی شرکت The Call Center Doctors نشان می‌دهد ادعای کاهش هزینه ۸۰ برابری استفاده از مدل DeepSeek در محیط‌های عملیاتی کدنویسی چندان دقیق نیست.

هوش مصنوعیتکناک، شرکت مشاوره‌ای The Call Center Doctors که به صورت تخصصی در زمینه طراحی و اداره مراکز تماس برای دیگر کسب‌وکارها فعالیت می‌کند، در گزارشی فنی و دقیق، نتایج حاصل از یک آزمایش عملیاتی را منتشر کرد که دیدگاه‌های رایج درباره برتری اقتصادی مدل‌های زبانی جدید را به چالش می‌کشد. این شرکت برای ارزیابی ادعاهایی مبنی بر اینکه DeepSeek تا ۸۰ برابر ارزان‌تر از Claude است، تصمیم گرفت سروری مجهز به چهارپردازنده گرافیکی Nvidia H200 AIاجاره کند تا مدل DeepSeek V4.1 Flash را جایگزین مدل Claude Opus 5.5 در ایجنت‌های کدنویسی خود نماید. این آزمایش نه تنها محدودیت‌های زیرساختی، بلکه پیچیدگی‌های پنهان در هزینه‌های عملیاتی استفاده از هوش مصنوعی در محیط‌های تولیدی را آشکار کرد.

در ابتدای این عملیات، سرور اجاره‌شده با هزینه ۴۴۰.۸۸ دلار به صورت روزانه و در نرخ درخواستی، توانست به سرعت خروجی حدود ۲۱۳ توکن در ثانیه دست یابد. اگرچه این رقم در نگاه نخست قابل توجه به نظر می‌رسید، اما زمانی که با هزینه‌های استفاده از رابط برنامه‌نویسیAPI مدل DeepSeekکه بین ۱۸۴ تا ۲۲۳ دلار در روز برآورد می‌شود مقایسه شد، مشخص گردید که صرفه اقتصادی چندانی ندارد. در نهایت، با توجه به مجموع هزینه‌های جاری و مقایسه آن با نرخ‌های ثابت اشتراک‌محور، این مرکز تماس تصمیم گرفت بار دیگر به استفاده از Claude Opus 5.5 روی بیاورد، چرا که هزینه‌های تمام‌شده در آن مدل به‌مراتب پایین‌تر بود.

پیچیدگی بازخوانی مداوم توکن‌ها

یکی از نکات کلیدی که در این گزارش مورد توجه قرار گرفت، ساختار متفاوت کارکرد ایجنت‌های کدنویسی است. این ایجنت‌ها برخلاف ربات‌های گفتگو، برای عملکرد درست به بازخوانی مداوم تاریخچه مکالمات نیاز دارند. داده‌های ثبت‌شده نشان می‌دهد که ۹۶ درصد از محتوایی که توسط ایجنت‌ها به مدل ارائه می‌شد، متون قدیمی و تکراری بوده است. در واقع، برای تولید هر توکن جدید، حدود ۱۰۰۰ توکن قدیمی باید توسط سیستم خوانده شود. این فرآیند بازخوانی، اگرچه از نظر محاسباتی ارزان‌تر است، اما حجم آن به قدری بالاست که منابع سخت‌افزاری را به شدت درگیر کرده و فرصت کمتری برای تولید محتوای جدید باقی می‌گذارد. این موضوع باعث شد سرورِ قدرتمند درگیر بازخوانی‌های بی‌پایان شود و عملاً بهره‌وری تولید کد کاهش یابد.

پایداری مدل نیز در این آزمایش چالش‌های خاص خود را داشت. اجرای موفقیت‌آمیز مدل نیازمند پنج بار تلاش متوالی بود که هر بار بین ۱۰ تا ۱۵ دقیقه زمان صرف بارگذاری اولیه می‌شد. نکته حائز اهمیت این بود که صورت‌حساب سرور صرف‌نظر از مشغول بودن یا نبودن آن صادر می‌شد که این امر برای یک محیط عملیاتی، وضعیتی غیربهینه تلقی می‌شود. محاسبات نشان داد که در یک ماه کاری با طول استاندارد و با نرخ ۱۸.۳۷ دلار در ساعت، هزینه این سرور به حدود ۱۳ هزار و ۲۰۰ دلار می‌رسد. این مبلغ بیش از دو برابر هزینه اشتراک Claude Code برای این شرکت در ماه سپتامبر بود. علاوه بر این، ظرفیت پردازشی یک سرور در این شرایط، روزانه حدود ۲۰ میلیارد توکن ارزیابی شد، در حالی که ایجنت‌های شرکت در پرکارترین روزهای خود به ۵۱ میلیارد توکن نیاز داشتند.

قطعه سخت‌افزاری و تراشه انویدیا (NVIDIA) با لوگوی سبز و سفید روی برد الکترونیکی که زیر نورپردازی قرمز و آبی قرار دارد.

این بررسی با هدف شفاف‌سازی ادعاهای تبلیغاتی پیرامون صرفه‌جویی ۸۰ برابری DeepSeek انجام شد. در بازه زمانی اول تا بیست‌وهفتم سپتامبر، سیستم مورد آزمایش ۲.۰۳ میلیون فراخوانی مدل، ۳۸۸.۵ میلیارد توکن خوانده‌شده و ۳۹۳ میلیون توکن نوشته‌شده ثبت کرد. هزینه اشتراک Claude Code برای شرکت در همان ماه حدود ۵۵۰۰ دلار بود. همین حجم از پردازش در صورت استفاده از رابط برنامه‌نویسی DeepSeek، بسته به نوسانات قیمت در ساعات پیک، بین ۳۵۰۰ تا ۷۰۰۰ دلار هزینه در بر می‌داشت. برآورد میانگین در صورت توزیع یکنواخت استفاده در طول هفته، حدود ۴۲۰۰ دلار تعیین شد.

به‌نوشتهتامز هاردورتفاوت قیمتی ۸۰ برابری که در برخی گزارش‌ها به آن اشاره شده، عمدتاً ناشی از مقایسه قیمت‌های فهرست‌شده برای Claude Opus 5.5 با هزینه‌های واقعی استفاده در مقیاس بالاست. با محاسبات انجام‌شده، هزینه همان تعداد توکن‌ها در Claude Opus 5.5 حدود ۱۴۰ هزار دلار برآورد می‌شد که بیش از ۲۵ برابر هزینه اشتراک فعلی شرکت است. این شکاف عمیق میان قیمت لیست و هزینه اشتراک، منشأ اصلی اعداد تبلیغاتی است. همچنین، شرکت هزینه هر تغییر ادغام‌شده در کد را بررسی کرد؛ حدود ۱ دلار برای هر مورد در Claude و حدود ۰.۶۳ دلار در DeepSeek (در صورت برابری عملکرد). برآورد ۱.۱۵ تا ۴.۹۰ دلاری برای DeepSeek با فرض نیاز به توکن‌های بیشتر برای رسیدن به دقت مشابه و استفاده از Claude برای بازبینی نهایی کار انجام شد.

در نهایت، بخش امنیت و عملکرد ایجنت‌ها یکی از بزرگترین موانع بود. در طول آزمایش، بازبین‌ها دائماً راه‌هایی کشف می‌کردند که کد ایجنت می‌توانست از محیط سندباکس فرار کند؛ به عنوان مثال، از طریق یک فایل تنظیمات در پوشه موقت اشتراکی که امکان اجرای کد با دسترسی مدیر را فراهم می‌کرد. به همین دلیل، ایجنت‌های کدنویس هرگز اجازه یافتند کد واقعی را در محیط اصلی بنویسند و در عوض، مدل تنها به عنوان ۴۸ تا ۶۴ ایجنت بازبین فقط‌خواندنی به کار گرفته شد که وظیفه آن‌ها خواندن ۲۳۷۷ پوشه و ثبت ۳۸ گزارش خطا بود. در پایان آزمایش، سرور اجاره‌شده با نرخ لحظه‌ای ۹.۱۹ دلار در ساعت، تنها دقایقی پس از آخرین تست توسط ارائه‌دهنده بازپس گرفته شد که پایان‌بخش این تجربه عملیاتی در استفاده از مدل‌های متن‌باز برای کارهای حساس کدنویسی بود.

نوشتهنتایج یک آزمایش فنی ادعای ارزان‌تر بودن دیپ‌سیک را رد کرداولین بار درTechnoc. پدیدار شد.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.