由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

llm-serving

话题找到数量

liguodongiot/llm-action

本项目旨在分享大模型相关技术原理及实战经验(大模型工程化、大模型应用落地)。

24k
2.8k
730
+4
排名 #11
8月19日
查看详情

NVIDIA/TensorRT-LLM

TensorRT LLM provides users with an easy-to-use Python API to define Large Language Models (LLMs) and supports state-of-the-art optimizations to perform inference efficiently on NVIDIA GPUs. TensorRT LLM also contains components to create Python and C++ runtimes that orchestrate the inference execution in a performant way.

14k
2.8k
1k
+14
排名 #5
9月19日
查看详情

skypilot-org/skypilot

在任何AI基础设施上运行、管理和扩展AI工作负载。使用统一系统访问和管理所有AI计算资源(Kubernetes、17+云平台或本地部署)。

10k
1.2k
1.4k
+4
排名 #15
8月13日
查看详情

vllm-project/vllm-ascend

面向昇腾平台的vLLM社区维护硬件插件

2.9k
2.3k
1.7k
+1
排名 #3
9月19日
查看详情

alibaba/rtp-llm

RTP-LLM:阿里巴巴面向多样化应用的高性能大语言模型推理引擎。

1.3k
270
1.3k
+6
排名 #12
9月6日
查看详情

gpustack/gpustack

用于高性能 AI 模型服务(vLLM、SGLang)和按需可通过 SSH 访问的 GPU 实例的 GPU 集群管理器。

0
0
329
排名 #7
9月11日
查看详情

vllm-project/vllm

面向大语言模型的高吞吐量与内存优化型推理服务引擎

0
0
2.1k
排名 #12
8月23日
查看详情
助手