
تامینکننده
Inference
پلتفرم Inference مجموعهای جامع از پیشرفتهترین مدلهای هوش مصنوعی جهان را برای توسعهدهندگان و کسبوکارها فراهم میکند. این سرویس با پشتیبانی از مدلهای قدرتمندی نظیر خانواده GPT-4 و GPT-5، سری Claude و معماریهای تخصصی Llama و Qwen، دسترسی به پردازش هوشمند را تسهیل کرده است. شما میتوانید از قابلیتهای تحلیل بصری، تولید متن پیشرفته و مدلهای جاسازی (Embedding) دقیق برای ارتقای پروژههای خود استفاده کنید. Inference با ارائه زیرساختی مقیاسپذیر و متنوع، نیازهای مختلف از تحلیل داده تا پاسخگویی هوشمند را با بالاترین کیفیت پوشش میدهد.
| مدل | نام مدل | مدل اصلی | ورودی ($/1M) | خروجی ($/1M) | رایگان |
|---|---|---|---|---|---|
|
|
— | glm-5.3-flash |
- | - | — |
|
|
— | gemini-2.5-flash-lite |
- | - | — |
|
|
— | gemini-2.5-flash |
- | - | — |
|
|
— | gemini-2.5-pro |
- | - | — |
|
|
— | gemini-3.1-flash-lite |
- | - | — |
|
|
— | gemini-3.5-flash |
- | - | — |
|
|
— | gemini-3.5-flash-lite |
- | - | — |
|
|
— | qwen3.7-plus |
- | - | — |
|
|
— | gemini-3-flash-preview |
- | - | — |
|
|
Llama 3.1 8B Instruct | meta/llama-3.1-8b-instruct |
$0.025 | $0.025 | — |
|
|
Llama 3.2 11B Vision Instruct | meta/llama-3.2-11b-vision-instruct |
$0.06 | $0.06 | — |
|
|
— | nvidia/nemotron3-super |
- | - | — |
|
|
Qwen 3 Embedding 4B | qwen/qwen3-embedding-4b |
$0.01 | $0.00 | — |
|
|
Llama 3.2 1B Instruct | meta/llama-3.2-1b-instruct |
$0.01 | $0.01 | — |
|
|
— | gpt-5-nano |
- | - | — |
|
|
— | gpt-5-mini |
- | - | — |
|
|
— | gpt-4o-mini |
- | - | — |
|
|
— | gpt-4o |
- | - | — |
|
|
— | gpt-4.1-nano |
- | - | — |
|
|
— | gpt-4.1-mini |
- | - | — |
|
|
— | gpt-4.1 |
- | - | — |
|
|
— | claude-haiku-4-5 |
- | - | — |
|
|
— | claude-sonnet-4-6 |
- | - | — |
|
|
— | claude-fable-5 |
- | - | — |
|
|
— | claude-opus-4-6 |
- | - | — |
|
|
— | claude-opus-4-7 |
- | - | — |
|
|
— | claude-opus-4-8 |
- | - | — |
|
|
— | claude-opus-5 |
- | - | — |
|
|
— | gemini-3.6-flash |
- | - | — |
مدلی با این مشخصات پیدا نشد.