احرازینو

API مدل‌های Anthropic Claude

خانوادهٔ کلاد، برای متن بلند و کارهایی که باید دستور را مو به مو اجرا کنند: تحلیل سند، بازنویسی با لحن مشخص، خروجی با قالب ثابت.

ساخت حساب کسب‌وکار

مدل‌ها و تعرفه

۶ مدل از این خانواده روی API باز است. قیمت‌ها شامل مالیات بر ارزش افزوده‌اند و همان مبلغی‌اند که در لحظهٔ فراخوان کسر می‌شوند.

مدلورودی (۱M توکن)پاسخ (۱M توکن)پنجرهٔ متن
Claude Fable 5.1anthropic-claude-fable-5.1۳٬۸۵۰٬۰۰۰ تومان۱۹٬۲۵۰٬۰۰۰ تومان۱٬۰۰۰٬۰۰۰ توکن
Claude Haiku 4.5anthropic-claude-haiku-4.5۳۸۵٬۰۰۰ تومان۱٬۹۲۵٬۰۰۰ تومان۲۰۰٬۰۰۰ توکن
Claude Opus 4.5anthropic-claude-opus-4.5۱٬۹۲۵٬۰۰۰ تومان۹٬۶۲۵٬۰۰۰ تومان۲۰۰٬۰۰۰ توکن
Claude Opus 5.5anthropic-claude-opus-5.5۱٬۵۴۰٬۰۰۰ تومان۷٬۷۰۰٬۰۰۰ تومان۱٬۰۰۰٬۰۰۰ توکن
Claude Sonnet 4.5anthropic-claude-sonnet-4.5۱٬۱۵۵٬۰۰۰ تومان۵٬۷۷۵٬۰۰۰ تومان۱٬۰۰۰٬۰۰۰ توکن
Claude Sonnet 5.5anthropic-claude-sonnet-5.5۷۷۰٬۰۰۰ تومان۳٬۸۵۰٬۰۰۰ تومان۱٬۰۰۰٬۰۰۰ توکن

همه از یک نشانی صدا زده می‌شوند: /api/v1/ai/chat/completions/. عوض‌کردن مدل یعنی عوض‌کردن یک رشته در بدنهٔ درخواست. برای برآورد هزینهٔ متن خودتان، ماشین‌حساب قیمت هست.

دربارهٔ مدل‌های Anthropic Claude

تفاوتی که در کار روزمره بیشتر از همه به چشم می‌آید، پیروی از دستور است. وقتی می‌گویی «فقط جدول برگردان، هیچ توضیحی ننویس»، مدلی که یک جملهٔ مقدمه اضافه می‌کند، پردازش خودکار خروجی را می‌شکند. برای سامانه‌ای که خروجی را مستقیم مصرف می‌کند، این از هر معیار دیگری مهم‌تر است.

سه لایه، با مرز روشن

Opus گران‌ترین است و فقط جایی ارزش دارد که پاسخ اشتباه هزینه‌ای بیشتر از خود فراخوان داشته باشد: تحلیل حقوقی، بازبینی معماری، پیداکردن ایراد در استدلالی که به‌ظاهر درست است.

Sonnet نقطهٔ تعادل است و برای بیشتر کارها همین کافی است: سند بلند، خروجی ساختاریافته، بازنویسی با لحن برند.

Haiku برای حجم بالا و کار سبک است، جایی که تأخیر و هزینه مهم‌تر از ظرافت‌اند.

🔴 max_tokens را روی مدل گران حتماً بفرست

پیش از هر فراخوان، سقف هزینه از موجودی‌ات رزرو می‌شود و آن سقف از max_tokens حساب می‌شود. اگر نفرستی، سقف کامل مدل فرض می‌شود، و برای پرسشی که پاسخش صد کلمه است مبلغی چند ده برابرِ هزینهٔ واقعی قفل می‌ماند. مبلغ اضافه بلافاصله برمی‌گردد و چیزی از دست نمی‌رود، ولی در همان چند ثانیه فراخوان‌های موازی‌ات ممکن است «موجودی کافی نیست» بگیرند.

سند بلند، یکجا و نه تکه‌تکه

اگر ده سؤال از یک سند داری، ده بار کل سند را نفرست؛ یک بار بفرست و هر ده سؤال را در همان یک فراخوان بپرس. هر فراخوان تازه یعنی کل سند دوباره شمرده می‌شود.

پرسش‌های متداول

چرا با اینکه موجودی دارم «موجودی کافی نیست» می‌گیرم؟

چون پیش از فراخوان، سقف هزینه از موجودی رزرو می‌شود و آن سقف از max_tokens حساب می‌شود. اگر max_tokens نفرستید، سقف کامل مدل فرض می‌شود و رزرو بسیار بزرگ‌تر از هزینهٔ واقعی می‌شود. یک عدد واقع‌بینانه بفرستید تا مشکل حل شود.

Opus یا Sonnet؟

معیار عملی این است: پاسخ اشتباه چقدر برایتان هزینه دارد؟ اگر جواب «دوباره می‌زنم» است، Sonnet انتخاب درست است. اگر جواب «یک تصمیم غلط یا یک باگ در محیط عملیاتی» است، Opus ارزان است.

شروع