احرازینو

API مدل‌های DeepSeek

گزینهٔ کم‌هزینه با کیفیت نزدیک به مدل‌های گران، برای تیم‌هایی که حجم کارشان زیاد است و بودجه‌شان محدود.

ساخت حساب کسب‌وکار

مدل‌ها و تعرفه

۴ مدل از این خانواده روی API باز است. قیمت‌ها شامل مالیات بر ارزش افزوده‌اند و همان مبلغی‌اند که در لحظهٔ فراخوان کسر می‌شوند.

مدلورودی (۱M توکن)پاسخ (۱M توکن)پنجرهٔ متن
DeepSeek V3.2deepseek-deepseek-v3.2۱۰۷٬۸۰۰ تومان۱۶۱٬۷۰۰ تومان۱۶۳٬۸۴۰ توکن
DeepSeek V4 Pro 0423deepseek-deepseek-v4-pro۳۰۱٬۴۵۵ تومان۶۰۲٬۹۱۰ تومان۱٬۰۴۸٬۵۷۶ توکن
DeepSeek V4.1 Flashdeepseek-deepseek-v4.1-flash۷٬۶۲۳ تومان۱۵۲٬۴۶۰ تومان۱٬۰۴۸٬۵۷۶ توکن
DeepSeek R1deepseek-deepseek-r1۲۶۹٬۵۰۰ تومان۹۶۲٬۵۰۰ تومان۶۴٬۰۰۰ توکن

همه از یک نشانی صدا زده می‌شوند: /api/v1/ai/chat/completions/. عوض‌کردن مدل یعنی عوض‌کردن یک رشته در بدنهٔ درخواست. برای برآورد هزینهٔ متن خودتان، ماشین‌حساب قیمت هست.

دربارهٔ مدل‌های DeepSeek

دلیل اینکه اسم این خانواده را زیاد می‌شنوی ساده است: نسبت کیفیت به قیمت. برای بخش بزرگی از کارهای روزمره، خروجی‌اش به‌اندازهٔ کافی خوب است و تعرفه‌اش کسری از مدل‌های پرچم‌دار.

این یعنی کارهایی که با مدل گران اصلاً به‌صرفه نبودند ممکن می‌شوند: خلاصه‌کردن هر تیکت پشتیبانی، برچسب‌زدن هر محصول، نوشتن پیش‌نویس برای هر ایمیل. وقتی هزینهٔ هر فراخوان پایین می‌آید، تصمیمِ «ارزشش را دارد یا نه» عوض می‌شود.

مدل معمولی یا مدل استدلالی

مدل‌های معمولی این خانواده برای نوشتن، خلاصه‌سازی، پرسش و پاسخ روی متنِ داده‌شده، و کدنویسی روزمره‌اند.

مدل استدلالی پیش از پاسخ یک مرحلهٔ فکرکردن دارد که در آن مسئله را برای خودش می‌شکند. برای مسئله‌ای که جوابش از چند گام پشت سر هم درمی‌آید همین مرحله تفاوت بین جواب درست و جوابِ به‌ظاهر درست است.

🔴 توکن استدلال هم پول دارد

توکن‌هایی که مدل استدلالی برای فکرکردن مصرف می‌کند، در صورتحساب به‌عنوان توکن خروجی حساب می‌شوند، حتی آن بخشی که در پاسخ نهایی به تو نمی‌رسد. یعنی پاسخی که روی صفحه صد کلمه است، ممکن است چند برابر آن توکن خرج کرده باشد.

این بزرگ‌ترین تعجب کسانی است که اولین بار مدل استدلالی را در محیط عملیاتی می‌گذارند. باگ نیست و از دید ما هم قابل کم‌کردن نیست؛ همان چیزی است که ارائه‌دهنده گزارش می‌کند و ما از روی همان حساب می‌کنیم. نتیجهٔ عملی: برای مدل استدلالی max_tokens را سخاوتمندانه‌تر بگذار، وگرنه پاسخ وسط استدلال قطع می‌شود و پولی داده‌ای بدون اینکه جواب بگیری.

داده‌ات از کجا رد می‌شود

فراخوان از سرور ما به ارائه‌دهنده می‌رود و نه از مرورگر کاربر. ولی این را جدی بگیر: هر چیزی که در پیام بفرستی به ارائه‌دهنده می‌رسد. کد ملی، شمارهٔ کارت، شماره حساب و هر دادهٔ شخصیِ غیرلازم را پیش از فرستادن حذف یا جایگزین کن. این قاعده به این خانواده اختصاص ندارد.

پرسش‌های متداول

کیفیتش واقعاً نزدیک مدل‌های گران است؟

برای کارهای رایج مثل نوشتن، خلاصه‌کردن و کد روزمره، تفاوت در بیشتر موارد آن‌قدری نیست که تفاوت قیمت را توجیه کند. برای استدلال چندمرحله‌ای تفاوت دیده می‌شود. جواب قطعی از سنجش روی داده‌های خودتان درمی‌آید، نه از جدول مقایسه.

چرا پاسخ مدل استدلالی کوتاه است ولی هزینه زیاد؟

چون توکن‌های مرحلهٔ استدلال هم به‌عنوان توکن خروجی حساب می‌شوند، حتی بخشی که در پاسخ نهایی به شما نمی‌رسد. این ویژگی ذاتی مدل‌های استدلالی است و صورتحساب ما از همان عددی بسته می‌شود که ارائه‌دهنده گزارش می‌کند.

مهاجرت از مدل دیگر چقدر کد می‌خواهد؟

در حد عوض‌کردن مقدار model در بدنهٔ درخواست. نقطهٔ فراخوان، کلید و شکل پاسخ یکسان است. پرامپت را دست نزنید و اول ببینید همان پرامپت چه خروجی‌ای می‌دهد؛ اگر از اول هر دو را عوض کنید، نمی‌دانید تفاوت از کدام است.

شروع