公司概况
SGLang 是一个开源的高性能大语言模型推理与服务框架,由加州大学伯克利分校 LMSYS 团队等发起,现已成为业界广泛采用的开源推理引擎之一,据其官方仓库介绍,相关部署已覆盖全球超过 40 万张 GPU。
主营业务
- 高吞吐 LLM 推理引擎,支持连续批处理等推理加速技术
- 结构化输出与前端编程接口,便于精确控制模型生成
- 多模态模型的服务支持
- 支持 NVIDIA 与 AMD 等主流硬件平台的部署
- OpenAI 兼容接口与活跃的开源社区文档生态
服务教育行业
适用于高校大模型科研与校级算力平台场景,可服务于院校在 GPU 集群上为多个科研团队并发提供高性能推理服务,也适合人工智能相关课程讲授推理优化与服务部署技术时作为实践平台,支撑大模型应用开发等教学科研活动。