احرازینو

API مدل‌های Meta Llama

خانوادهٔ Llama متا، با وزن‌های باز و چند اندازهٔ مختلف، برای تیم‌هایی که می‌خواهند بعداً امکان میزبانی خودشان را داشته باشند.

ساخت حساب کسب‌وکار

مدل‌ها و تعرفه

۳ مدل از این خانواده روی API باز است. قیمت‌ها شامل مالیات بر ارزش افزوده‌اند و همان مبلغی‌اند که در لحظهٔ فراخوان کسر می‌شوند.

مدلورودی (۱M توکن)پاسخ (۱M توکن)پنجرهٔ متن
Llama 3.3 70B Instructmeta-llama-llama-3.3-70b-instruct۳۸٬۵۰۰ تومان۱۲۳٬۲۰۰ تومان۱۳۱٬۰۷۲ توکن
Llama 4 Maverickmeta-llama-llama-4-maverick۷۲٬۱۸۸ تومان۲۵۱٬۲۱۳ تومان۱٬۰۴۸٬۵۷۶ توکن
Llama 4 Scoutmeta-llama-llama-4-scout۳۸٬۵۰۰ تومان۱۱۵٬۵۰۰ تومان۱٬۳۱۰٬۷۲۰ توکن

همه از یک نشانی صدا زده می‌شوند: /api/v1/ai/chat/completions/. عوض‌کردن مدل یعنی عوض‌کردن یک رشته در بدنهٔ درخواست. برای برآورد هزینهٔ متن خودتان، ماشین‌حساب قیمت هست.

دربارهٔ مدل‌های Meta Llama

تفاوت مهم این خانواده با بقیه، وزن‌های باز است. یعنی اگر روزی بخواهی همین مدل را روی سرور خودت ببری، راهش بسته نیست. برای تیمی که نگران وابستگی به یک ارائه‌دهنده است، این خودش یک معیار انتخاب است.

از اینجا شروع کن، بعد تصمیم بگیر

منطقی‌ترین مسیر این است که اول از API ما استفاده کنی تا بفهمی مدل برای کارت جواب می‌دهد یا نه. میزبانی خودت هزینهٔ سخت‌افزار و نگهداری دارد و تا وقتی حجم کارت کم است، توجیه ندارد.

اندازه‌ها

نسخه‌های بزرگ‌تر برای کار پیچیده‌تر و نسخه‌های کوچک‌تر برای حجم بالا. همان قاعدهٔ همیشگی: با بزرگ شروع کن تا پرامپت درست شود، بعد کوچک را امتحان کن.

پرسش‌های متداول

وزن باز یعنی می‌توانم خودم میزبانی کنم؟

بله، همین خانواده را می‌شود روی زیرساخت خودتان اجرا کرد. ولی تا وقتی حجم کارتان کم است، هزینهٔ سخت‌افزار و نگهداری از هزینهٔ فراخوان بیشتر درمی‌آید. اول از API استفاده کنید و وقتی حجم بالا رفت دوباره حساب کنید.

کدام اندازه را انتخاب کنم؟

با بزرگ‌ترین نسخه شروع کنید تا پرامپتتان تثبیت شود، بعد همان پرامپت را روی نسخهٔ کوچک‌تر امتحان کنید و خروجی‌ها را روی بیست ورودی واقعی مقایسه کنید.

شروع