← 工具雷达
devtool

DSpark: Speculative decoding accelerates LLM inference [pdf]

一个有前途的研究原型,实际可用性和易用性仍需打磨。

4.9综合
实用性6
上手速度4
完成度4
不可替代5
生命力5

5 维独立打分,综合分为加权平均。分数只对同一套标准内部可比。

适合谁

想在本地或自建集群上实验加速 LLM 推理的研发团队

不适合谁

需要稳定、即插即用推理服务的生产环境

项目自述

github.com

替代品

vLLMTensorRT-LLMFasterTransformerOpenAI's spec‑decoding (if available)DeepSpeed Inference
访问官网717 · 评测时 Stars评测于 2026-06-28

同类工具