اصطلاح advanced

رمزگشایی سریع | Speculative Decoding

تکنیک تسریع استنتاج که یک مدل کوچک (Draft) پیش‌بینی‌های موقت می‌کند و مدل بزرگ (Verifier) آن‌ها را تأیید یا رد می‌کند.

Speculative Decoding — رمزگشایی سریع | Speculative Decoding

تکنیک تسریع استنتاج که یک مدل کوچک (Draft) پیش‌بینی‌های موقت می‌کند و مدل بزرگ (Verifier) آن‌ها را تأیید یا رد می‌کند.

تعریف

تکنیک تسریع استنتاج که یک مدل کوچک (Draft) پیش‌بینی‌های موقت می‌کند و مدل بزرگ (Verifier) آن‌ها را تأیید یا رد می‌کند.

توضیح کامل

مدل Draft چند توکن سریع پیش‌بینی می‌کند؛ مدل اصلی همه را موازی تأیید می‌کند. در بهترین حالت سرعت ۲-۳ برابر افزایش می‌یابد بدون افت کیفیت. Self-speculative decoding از لایه‌های اولیه همان مدل به‌عنوان Draft استفاده می‌کند.

مثال کاربردی

Gemini و Claude از نسخه‌هایی از Speculative Decoding برای کاهش تأخیر در API استفاده می‌کنند.

موارد مرتبط

نرخ یادگیری
اصطلاح
هوش مصنوعی مولد | Generative AI
اصطلاح
چندوجهی | Multimodal AI
اصطلاح
حافظه مدل | LLM Memory
اصطلاح