API مدلهای Anthropic Claude
خانوادهٔ کلاد، برای متن بلند و کارهایی که باید دستور را مو به مو اجرا کنند: تحلیل سند، بازنویسی با لحن مشخص، خروجی با قالب ثابت.
مدلها و تعرفه
۶ مدل از این خانواده روی API باز است. قیمتها شامل مالیات بر ارزش افزودهاند و همان مبلغیاند که در لحظهٔ فراخوان کسر میشوند.
| مدل | ورودی (۱M توکن) | پاسخ (۱M توکن) | پنجرهٔ متن |
|---|---|---|---|
| Claude Fable 5.1anthropic-claude-fable-5.1 | ۳٬۸۵۰٬۰۰۰ تومان | ۱۹٬۲۵۰٬۰۰۰ تومان | ۱٬۰۰۰٬۰۰۰ توکن |
| Claude Haiku 4.5anthropic-claude-haiku-4.5 | ۳۸۵٬۰۰۰ تومان | ۱٬۹۲۵٬۰۰۰ تومان | ۲۰۰٬۰۰۰ توکن |
| Claude Opus 4.5anthropic-claude-opus-4.5 | ۱٬۹۲۵٬۰۰۰ تومان | ۹٬۶۲۵٬۰۰۰ تومان | ۲۰۰٬۰۰۰ توکن |
| Claude Opus 5.5anthropic-claude-opus-5.5 | ۱٬۵۴۰٬۰۰۰ تومان | ۷٬۷۰۰٬۰۰۰ تومان | ۱٬۰۰۰٬۰۰۰ توکن |
| Claude Sonnet 4.5anthropic-claude-sonnet-4.5 | ۱٬۱۵۵٬۰۰۰ تومان | ۵٬۷۷۵٬۰۰۰ تومان | ۱٬۰۰۰٬۰۰۰ توکن |
| Claude Sonnet 5.5anthropic-claude-sonnet-5.5 | ۷۷۰٬۰۰۰ تومان | ۳٬۸۵۰٬۰۰۰ تومان | ۱٬۰۰۰٬۰۰۰ توکن |
همه از یک نشانی صدا زده میشوند: /api/v1/ai/chat/completions/. عوضکردن مدل یعنی عوضکردن یک رشته در بدنهٔ درخواست. برای برآورد هزینهٔ متن خودتان، ماشینحساب قیمت هست.
دربارهٔ مدلهای Anthropic Claude
تفاوتی که در کار روزمره بیشتر از همه به چشم میآید، پیروی از دستور است. وقتی میگویی «فقط جدول برگردان، هیچ توضیحی ننویس»، مدلی که یک جملهٔ مقدمه اضافه میکند، پردازش خودکار خروجی را میشکند. برای سامانهای که خروجی را مستقیم مصرف میکند، این از هر معیار دیگری مهمتر است.
سه لایه، با مرز روشن
Opus گرانترین است و فقط جایی ارزش دارد که پاسخ اشتباه هزینهای بیشتر از خود فراخوان داشته باشد: تحلیل حقوقی، بازبینی معماری، پیداکردن ایراد در استدلالی که بهظاهر درست است.
Sonnet نقطهٔ تعادل است و برای بیشتر کارها همین کافی است: سند بلند، خروجی ساختاریافته، بازنویسی با لحن برند.
Haiku برای حجم بالا و کار سبک است، جایی که تأخیر و هزینه مهمتر از ظرافتاند.
🔴 max_tokens را روی مدل گران حتماً بفرست
پیش از هر فراخوان، سقف هزینه از موجودیات رزرو میشود و آن سقف از max_tokens حساب میشود. اگر نفرستی، سقف کامل مدل فرض میشود، و برای پرسشی که پاسخش صد کلمه است مبلغی چند ده برابرِ هزینهٔ واقعی قفل میماند. مبلغ اضافه بلافاصله برمیگردد و چیزی از دست نمیرود، ولی در همان چند ثانیه فراخوانهای موازیات ممکن است «موجودی کافی نیست» بگیرند.
سند بلند، یکجا و نه تکهتکه
اگر ده سؤال از یک سند داری، ده بار کل سند را نفرست؛ یک بار بفرست و هر ده سؤال را در همان یک فراخوان بپرس. هر فراخوان تازه یعنی کل سند دوباره شمرده میشود.
پرسشهای متداول
چرا با اینکه موجودی دارم «موجودی کافی نیست» میگیرم؟
چون پیش از فراخوان، سقف هزینه از موجودی رزرو میشود و آن سقف از max_tokens حساب میشود. اگر max_tokens نفرستید، سقف کامل مدل فرض میشود و رزرو بسیار بزرگتر از هزینهٔ واقعی میشود. یک عدد واقعبینانه بفرستید تا مشکل حل شود.
Opus یا Sonnet؟
معیار عملی این است: پاسخ اشتباه چقدر برایتان هزینه دارد؟ اگر جواب «دوباره میزنم» است، Sonnet انتخاب درست است. اگر جواب «یک تصمیم غلط یا یک باگ در محیط عملیاتی» است، Opus ارزان است.
