项目详情
由
分享


HelloGitHub 评分
0 人评分
开源•MIT
认领
讨论
收藏
分享
6.1k
星数
否
中文
Python
主语言
是
活跃
8
贡献者
32
Issues
否
组织
无
最新版本
745
Forks
MIT
协议
更多
该项目是用 Python 实现的轻量级 vLLM(大语言模型推理引擎)项目,核心代码仅 1000 多行。它结构清晰、易于阅读,推理速度媲美 vLLM 原版,并集成了前缀缓存(Prefix Caching)、张量并行(Tensor Parallelism)和 Torch 编译等推理优化技术。
评论
评分:
暂无精选评论