Qwen2.5 VL 72B Instruct، مدل چندوجهی پیشرفته از qwen، ادغام بینظیری از درک زبان و قابلیتهای بصری را ارائه میدهد. این مدل ۷۲ میلیارد پارامتری، مبتنی بر معماری نوین Qwen2.5، قادر به تحلیل همزمان متن و تصاویر است. با درک عمیق مفاهیم پیچیده، Qwen2.5 VL 72B Instruct پاسخهای دقیق و خلاقانه تولید میکند. ایدهآل برای تولید محتوا، خلاصهسازی، پرسش و پاسخهای پیشرفته و تحلیل بصری، این مدل تعامل انسان و ماشین را متحول میسازد.
Qwen2.5 VL 72B Instruct
qwen
qwen2-5-vl-72b
اطلاعات مدل
- شناسه (Slug)
qwen2-5-vl-72b- تاریخ انتشار
- سازمان
- qwen
- دسترسی
- پولی
- سایت رسمی
- qwen.ai
دادههای تحلیلی
- شاخصها
-
هوش ۹,۴کدنویسی —عامل (Agentic) —
- شمار پارامترها
- ۷۲,۰B پارامتر
- مجوز
- tongyi-qianwen
- ورودی
- متن، تصویر
- خروجی
- متن
- پنجرهٔ زمینه
- ۱۲۸,۰ هزار توکن
- میانگین قیمت ورودی (در ۱ میلیون توکن)
- $0,80
- میانگین قیمت خروجی (در ۱ میلیون توکن)
- $1,00
- نوع استفاده
- متن
بنچمارکها
general
MLVU-M
۷۴,۶%
#8
AndroidWorld_SR
۳۵,۰%
#6
ریاضی
MathVista-Mini
۷۴,۸%
#16
MathVision
۳۸,۱%
#30
چندحالته
Android Control Low_EM
۹۳,۷%
#1
AITZ_EM
۸۳,۲%
#1
VideoMME w/o sub.
۷۳,۳%
#8
MMMU
۷۰,۲%
#31
MobileMiniWob++_SR
۶۸,۰%
#2
Android Control High_EM
۶۷,۴%
#2
OSWorld
۸,۸%
#19
استدلال
ChartQA
۸۹,۵%
#3
ویدیو
PerceptionTest
۷۳,۲%
#1
MMBench-Video
۲,۰%
#1
بینایی
DocVQA
۹۶,۴%
#1
OCRBench
۸۸,۵%
#10
AI2D
۸۸,۴%
#16
MMBench
۸۸,۰%
#2
ScreenSpot
۸۷,۱%
#13
CC-OCR
۷۹,۸%
#12
EgoSchema
۷۶,۲%
#2
MMVet
۷۶,۲%
#1
TempCompass
۷۴,۸%
#1
MMStar
۷۰,۸%
#15
MVBench
۷۰,۴%
#11
OCRBench-V2 (en)
۶۱,۵%
#11
Hallusion Bench
۵۵,۲%
#16
MMMU-Pro
۵۱,۱%
#59
LVBench
۴۷,۳%
#22
ScreenSpot Pro
۴۳,۶%
#23