مدل GPT-4o Audio یک پیشرفت انقلابی از OpenAI در حوزه هوش مصنوعی چندوجهی است که تعاملات صوتی را به سطحی بیسابقه از واقعگرایی رسانده است. این مدل با قابلیت درک و تولید پاسخهای صوتی با تأخیر بسیار کم، تجربه مکالمهای طبیعی و انسانی را برای کاربران فراهم میکند. با استفاده از این فناوری پیشرفته، پردازش سیگنالهای صوتی بدون نیاز به تبدیل متن، با دقت و ظرافت بیشتری انجام میشود. gpt-4o-audio-preview به توسعهدهندگان اجازه میدهد تا اپلیکیشنهایی با قابلیت درک لحن، احساس و جزئیات صوتی طراحی کنند. این مدل انتخابی ایدهآل برای ساخت دستیارهای صوتی هوشمند و سیستمهای تعاملی نسل جدید است.
GPT-4o Audio
OpenAI
gpt-4o-audio-preview
اطلاعات مدل
- شناسه (Slug)
gpt-4o-audio-preview- تاریخ انتشار
- سازمان
- OpenAI
- دسترسی
- پولی
- سایت رسمی
- openai.com
دادههای تحلیلی
- شاخصها
-
هوش ۱۱,۱کدنویسی —عامل (Agentic) —
- عملکرد
-
سرعت خروجی ۱۳۴,۷ t/sزمان تا اولین توکن ۰,۹۱ ثانیهزمان پاسخ کامل ۴,۶۲ ثانیه
- مجوز
- Proprietary
- ورودی
- متن، تصویر، فایل
- خروجی
- متن
- پنجرهٔ زمینه
- ۱۲۸,۰ هزار توکن
- میانگین قیمت ورودی (در ۱ میلیون توکن)
- $2,50
- میانگین قیمت خروجی (در ۱ میلیون توکن)
- $10,0
- نوع استفاده
- متن
بنچمارکها
general
MMLU
۸۸,۷%
#17
زبان
MMLU-Pro
۷۲,۶%
#81
ریاضی
MGSM
۹۰,۵%
#9
MATH
۷۶,۶%
#24
MathVista
۶۳,۸%
#23
استدلال
HumanEval
۹۰,۲%
#12
DROP
۸۳,۴%
#8
GPQA
۵۳,۶%
#173
تامینکنندهها (Providers)
| ارائهدهنده | نوع | نام مدل | مدل اصلی | ورودی ($/1M) | خروجی ($/1M) | رایگان |
|---|---|---|---|---|---|---|
|
|
گفتگو کدنویسی | gpt-4o-audio-preview | gpt-4o-audio-preview |
$2.50 | $10.00 | — |