LLM推論加速。Speculative Decoding (Draft Model+Target Model Verify・2-3x speedup)・Self-Speculative Decoding・Medusa (Multiple Heads・5-Head Vicuna)・EAGLE-2 EAGLE-3 (Tree-Based・3x faster Llama 3)・Lookahead Decoding・SpecInfer・REST (Retrieval-Based)・PLD (Prompt Lookup Decoding)・Multi-Token Prediction MTP (DeepSeek V3)・vLLM 0.7+対応・llama.cpp対応・¥0 OSS、2026年Multi-Token Prediction主流。