perf: skip the throwaway DOM parse on the completion and chat ingress. (#2332)
English | 中文
xLLM 是一个高效的开源大模型推理框架,专为国产芯片优化设计,提供企业级的服务部署,使得性能更高、成本更低。
本项目的实现得益于以下开源项目:
感谢以下合作的高校实验室:
感谢以下为xLLM作出贡献的开发者
如果你觉得这个仓库对你有帮助,欢迎引用我们:
@article{liu2025xllm, title={xLLM Technical Report}, author={xLLM team}, journal={arXiv preprint arXiv:2510.14686}, year={2025} }
版权所有:中国计算机学会技术支持:开源发展技术委员会 京ICP备13000930号-9 京公网安备 11010802047560号
English | 中文
📢 新闻
更多新闻
简介
xLLM 是一个高效的开源大模型推理框架,专为国产芯片优化设计,提供企业级的服务部署,使得性能更高、成本更低。
亮点
硬件支持
入门指南
社区支持
致谢
本项目的实现得益于以下开源项目:
感谢以下合作的高校实验室:
感谢以下为xLLM作出贡献的开发者
引用
如果你觉得这个仓库对你有帮助,欢迎引用我们: