فهرست مطالب
ارزیابی فنی شرکت The Call Center Doctors نشان میدهد ادعای کاهش هزینه ۸۰ برابری استفاده از مدل DeepSeek در محیطهای عملیاتی کدنویسی چندان دقیق نیست.
به گزارش سرویس هوش مصنوعی تکناک، شرکت مشاورهای The Call Center Doctors که به صورت تخصصی در زمینه طراحی و اداره مراکز تماس برای دیگر کسبوکارها فعالیت میکند، در گزارشی فنی و دقیق، نتایج حاصل از یک آزمایش عملیاتی را منتشر کرد که دیدگاههای رایج درباره برتری اقتصادی مدلهای زبانی جدید را به چالش میکشد. این شرکت برای ارزیابی ادعاهایی مبنی بر اینکه DeepSeek تا ۸۰ برابر ارزانتر از Claude است، تصمیم گرفت سروری مجهز به چهار پردازنده گرافیکی Nvidia H200 AI اجاره کند تا مدل DeepSeek V4.1 Flash را جایگزین مدل Claude Opus 5.5 در ایجنتهای کدنویسی خود نماید. این آزمایش نه تنها محدودیتهای زیرساختی، بلکه پیچیدگیهای پنهان در هزینههای عملیاتی استفاده از هوش مصنوعی در محیطهای تولیدی را آشکار کرد.
در ابتدای این عملیات، سرور اجارهشده با هزینه ۴۴۰.۸۸ دلار به صورت روزانه و در نرخ درخواستی، توانست به سرعت خروجی حدود ۲۱۳ توکن در ثانیه دست یابد. اگرچه این رقم در نگاه نخست قابل توجه به نظر میرسید، اما زمانی که با هزینههای استفاده از رابط برنامهنویسی API مدل DeepSeek که بین ۱۸۴ تا ۲۲۳ دلار در روز برآورد میشود مقایسه شد، مشخص گردید که صرفه اقتصادی چندانی ندارد. در نهایت، با توجه به مجموع هزینههای جاری و مقایسه آن با نرخهای ثابت اشتراکمحور، این مرکز تماس تصمیم گرفت بار دیگر به استفاده از Claude Opus 5.5 روی بیاورد، چرا که هزینههای تمامشده در آن مدل بهمراتب پایینتر بود.
پیچیدگی بازخوانی مداوم توکنها
یکی از نکات کلیدی که در این گزارش مورد توجه قرار گرفت، ساختار متفاوت کارکرد ایجنتهای کدنویسی است. این ایجنتها برخلاف رباتهای گفتگو، برای عملکرد درست به بازخوانی مداوم تاریخچه مکالمات نیاز دارند. دادههای ثبتشده نشان میدهد که ۹۶ درصد از محتوایی که توسط ایجنتها به مدل ارائه میشد، متون قدیمی و تکراری بوده است. در واقع، برای تولید هر توکن جدید، حدود ۱۰۰۰ توکن قدیمی باید توسط سیستم خوانده شود. این فرآیند بازخوانی، اگرچه از نظر محاسباتی ارزانتر است، اما حجم آن به قدری بالاست که منابع سختافزاری را به شدت درگیر کرده و فرصت کمتری برای تولید محتوای جدید باقی میگذارد. این موضوع باعث شد سرورِ قدرتمند درگیر بازخوانیهای بیپایان شود و عملاً بهرهوری تولید کد کاهش یابد.
پایداری مدل نیز در این آزمایش چالشهای خاص خود را داشت. اجرای موفقیتآمیز مدل نیازمند پنج بار تلاش متوالی بود که هر بار بین ۱۰ تا ۱۵ دقیقه زمان صرف بارگذاری اولیه میشد. نکته حائز اهمیت این بود که صورتحساب سرور صرفنظر از مشغول بودن یا نبودن آن صادر میشد که این امر برای یک محیط عملیاتی، وضعیتی غیربهینه تلقی میشود. محاسبات نشان داد که در یک ماه کاری با طول استاندارد و با نرخ ۱۸.۳۷ دلار در ساعت، هزینه این سرور به حدود ۱۳ هزار و ۲۰۰ دلار میرسد. این مبلغ بیش از دو برابر هزینه اشتراک Claude Code برای این شرکت در ماه سپتامبر بود. علاوه بر این، ظرفیت پردازشی یک سرور در این شرایط، روزانه حدود ۲۰ میلیارد توکن ارزیابی شد، در حالی که ایجنتهای شرکت در پرکارترین روزهای خود به ۵۱ میلیارد توکن نیاز داشتند.

این بررسی با هدف شفافسازی ادعاهای تبلیغاتی پیرامون صرفهجویی ۸۰ برابری DeepSeek انجام شد. در بازه زمانی اول تا بیستوهفتم سپتامبر، سیستم مورد آزمایش ۲.۰۳ میلیون فراخوانی مدل، ۳۸۸.۵ میلیارد توکن خواندهشده و ۳۹۳ میلیون توکن نوشتهشده ثبت کرد. هزینه اشتراک Claude Code برای شرکت در همان ماه حدود ۵۵۰۰ دلار بود. همین حجم از پردازش در صورت استفاده از رابط برنامهنویسی DeepSeek، بسته به نوسانات قیمت در ساعات پیک، بین ۳۵۰۰ تا ۷۰۰۰ دلار هزینه در بر میداشت. برآورد میانگین در صورت توزیع یکنواخت استفاده در طول هفته، حدود ۴۲۰۰ دلار تعیین شد.
تبلیغات گمراهکننده ادعای ۸۰ برابر ارزانتر
بهنوشته تامز هاردور، تفاوت قیمتی ۸۰ برابری که در برخی گزارشها به آن اشاره شده، عمدتاً ناشی از مقایسه قیمتهای فهرستشده برای Claude Opus 5.5 با هزینههای واقعی استفاده در مقیاس بالاست. با محاسبات انجامشده، هزینه همان تعداد توکنها در Claude Opus 5.5 حدود ۱۴۰ هزار دلار برآورد میشد که بیش از ۲۵ برابر هزینه اشتراک فعلی شرکت است. این شکاف عمیق میان قیمت لیست و هزینه اشتراک، منشأ اصلی اعداد تبلیغاتی است. همچنین، شرکت هزینه هر تغییر ادغامشده در کد را بررسی کرد؛ حدود ۱ دلار برای هر مورد در Claude و حدود ۰.۶۳ دلار در DeepSeek (در صورت برابری عملکرد). برآورد ۱.۱۵ تا ۴.۹۰ دلاری برای DeepSeek با فرض نیاز به توکنهای بیشتر برای رسیدن به دقت مشابه و استفاده از Claude برای بازبینی نهایی کار انجام شد.
در نهایت، بخش امنیت و عملکرد ایجنتها یکی از بزرگترین موانع بود. در طول آزمایش، بازبینها دائماً راههایی کشف میکردند که کد ایجنت میتوانست از محیط سندباکس فرار کند؛ به عنوان مثال، از طریق یک فایل تنظیمات در پوشه موقت اشتراکی که امکان اجرای کد با دسترسی مدیر را فراهم میکرد. به همین دلیل، ایجنتهای کدنویس هرگز اجازه یافتند کد واقعی را در محیط اصلی بنویسند و در عوض، مدل تنها به عنوان ۴۸ تا ۶۴ ایجنت بازبین فقطخواندنی به کار گرفته شد که وظیفه آنها خواندن ۲۳۷۷ پوشه و ثبت ۳۸ گزارش خطا بود. در پایان آزمایش، سرور اجارهشده با نرخ لحظهای ۹.۱۹ دلار در ساعت، تنها دقایقی پس از آخرین تست توسط ارائهدهنده بازپس گرفته شد که پایانبخش این تجربه عملیاتی در استفاده از مدلهای متنباز برای کارهای حساس کدنویسی بود.

















