Skip to yearly menu bar Skip to main content


Poster

Speculate Deep and Accurate: Lossless and Training-Free Acceleration for Offloaded LLMs via Substitute Speculative Decoding

Pei-Shuo Wang ⋅ Jian-Jia Chen ⋅ Chun-Che Yang ⋅ Chi-Chih Chang ⋅ Ning-Chi Huang ⋅ Mohamed Abdelfattah ⋅ Kai-Chiang Wu
2025 Poster

Abstract

Video

Chat is not available.