API مدلهای DeepSeek
گزینهٔ کمهزینه با کیفیت نزدیک به مدلهای گران، برای تیمهایی که حجم کارشان زیاد است و بودجهشان محدود.
مدلها و تعرفه
۴ مدل از این خانواده روی API باز است. قیمتها شامل مالیات بر ارزش افزودهاند و همان مبلغیاند که در لحظهٔ فراخوان کسر میشوند.
| مدل | ورودی (۱M توکن) | پاسخ (۱M توکن) | پنجرهٔ متن |
|---|---|---|---|
| DeepSeek V3.2deepseek-deepseek-v3.2 | ۱۰۷٬۸۰۰ تومان | ۱۶۱٬۷۰۰ تومان | ۱۶۳٬۸۴۰ توکن |
| DeepSeek V4 Pro 0423deepseek-deepseek-v4-pro | ۳۰۱٬۴۵۵ تومان | ۶۰۲٬۹۱۰ تومان | ۱٬۰۴۸٬۵۷۶ توکن |
| DeepSeek V4.1 Flashdeepseek-deepseek-v4.1-flash | ۷٬۶۲۳ تومان | ۱۵۲٬۴۶۰ تومان | ۱٬۰۴۸٬۵۷۶ توکن |
| DeepSeek R1deepseek-deepseek-r1 | ۲۶۹٬۵۰۰ تومان | ۹۶۲٬۵۰۰ تومان | ۶۴٬۰۰۰ توکن |
همه از یک نشانی صدا زده میشوند: /api/v1/ai/chat/completions/. عوضکردن مدل یعنی عوضکردن یک رشته در بدنهٔ درخواست. برای برآورد هزینهٔ متن خودتان، ماشینحساب قیمت هست.
دربارهٔ مدلهای DeepSeek
دلیل اینکه اسم این خانواده را زیاد میشنوی ساده است: نسبت کیفیت به قیمت. برای بخش بزرگی از کارهای روزمره، خروجیاش بهاندازهٔ کافی خوب است و تعرفهاش کسری از مدلهای پرچمدار.
این یعنی کارهایی که با مدل گران اصلاً بهصرفه نبودند ممکن میشوند: خلاصهکردن هر تیکت پشتیبانی، برچسبزدن هر محصول، نوشتن پیشنویس برای هر ایمیل. وقتی هزینهٔ هر فراخوان پایین میآید، تصمیمِ «ارزشش را دارد یا نه» عوض میشود.
مدل معمولی یا مدل استدلالی
مدلهای معمولی این خانواده برای نوشتن، خلاصهسازی، پرسش و پاسخ روی متنِ دادهشده، و کدنویسی روزمرهاند.
مدل استدلالی پیش از پاسخ یک مرحلهٔ فکرکردن دارد که در آن مسئله را برای خودش میشکند. برای مسئلهای که جوابش از چند گام پشت سر هم درمیآید همین مرحله تفاوت بین جواب درست و جوابِ بهظاهر درست است.
🔴 توکن استدلال هم پول دارد
توکنهایی که مدل استدلالی برای فکرکردن مصرف میکند، در صورتحساب بهعنوان توکن خروجی حساب میشوند، حتی آن بخشی که در پاسخ نهایی به تو نمیرسد. یعنی پاسخی که روی صفحه صد کلمه است، ممکن است چند برابر آن توکن خرج کرده باشد.
این بزرگترین تعجب کسانی است که اولین بار مدل استدلالی را در محیط عملیاتی میگذارند. باگ نیست و از دید ما هم قابل کمکردن نیست؛ همان چیزی است که ارائهدهنده گزارش میکند و ما از روی همان حساب میکنیم. نتیجهٔ عملی: برای مدل استدلالی max_tokens را سخاوتمندانهتر بگذار، وگرنه پاسخ وسط استدلال قطع میشود و پولی دادهای بدون اینکه جواب بگیری.
دادهات از کجا رد میشود
فراخوان از سرور ما به ارائهدهنده میرود و نه از مرورگر کاربر. ولی این را جدی بگیر: هر چیزی که در پیام بفرستی به ارائهدهنده میرسد. کد ملی، شمارهٔ کارت، شماره حساب و هر دادهٔ شخصیِ غیرلازم را پیش از فرستادن حذف یا جایگزین کن. این قاعده به این خانواده اختصاص ندارد.
پرسشهای متداول
کیفیتش واقعاً نزدیک مدلهای گران است؟
برای کارهای رایج مثل نوشتن، خلاصهکردن و کد روزمره، تفاوت در بیشتر موارد آنقدری نیست که تفاوت قیمت را توجیه کند. برای استدلال چندمرحلهای تفاوت دیده میشود. جواب قطعی از سنجش روی دادههای خودتان درمیآید، نه از جدول مقایسه.
چرا پاسخ مدل استدلالی کوتاه است ولی هزینه زیاد؟
چون توکنهای مرحلهٔ استدلال هم بهعنوان توکن خروجی حساب میشوند، حتی بخشی که در پاسخ نهایی به شما نمیرسد. این ویژگی ذاتی مدلهای استدلالی است و صورتحساب ما از همان عددی بسته میشود که ارائهدهنده گزارش میکند.
مهاجرت از مدل دیگر چقدر کد میخواهد؟
در حد عوضکردن مقدار model در بدنهٔ درخواست. نقطهٔ فراخوان، کلید و شکل پاسخ یکسان است. پرامپت را دست نزنید و اول ببینید همان پرامپت چه خروجیای میدهد؛ اگر از اول هر دو را عوض کنید، نمیدانید تفاوت از کدام است.
