由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

inference

话题找到数量

Andyyyy64/whichllm

找到真正能在你的硬件上运行且性能最佳的本地大语言模型。基于真实且考虑时效性的基准进行排名,而非参数数量。一条命令,即刻运行。

5.5k
289
754
+3.2k
排名 #12
6月30日
查看详情

vllm-project/vllm-omni

一个面向全模态模型的高效推理框架。

5.1k
1.1k
1.4k
+24
排名 #15
6月10日
查看详情

llm-d/llm-d

llm-d 是基于 Kubernetes 的高性能分布式 LLM 推理框架

4.6k
773
884
+15
排名 #13
9月17日
查看详情

OpenNMT/CTranslate2

面向Transformer模型的快速推理引擎

4.5k
497
771
+3
排名 #5
6月27日
查看详情

hao-ai-lab/FastVideo

面向加速视频生成的统一推理与训练后处理框架

4.5k
467
1.2k
+17
排名 #13
9月17日
查看详情

ruvnet/RuVector

RuVector是一款用Rust构建的高性能向量与图数据库,专为人工智能、智能体系统和实时分析设计。它将HNSW搜索、动态最小割一致性、图智能与自学习记忆融合为统一引擎,实现可扩展、低延迟的推理与结构化检索。

4.5k
589
0
+22
排名 #20
8月25日
查看详情

OpenCSGs/csghub

CSGHub是由OpenCSG团队开发的全新开源大语言模型管理平台,提供开源版和本地化/SaaS解决方案,功能对标Hugging Face。完整掌控大语言模型、数据集和智能体的生命周期,Python SDK与Hugging Face兼容。欢迎加入我们!⭐️

4.2k
519
967
+1
排名 #11
6月15日
查看详情

zml/zml

任意模型·任意硬件·零妥协·基于@ziglang/@openxla/MLIR/@bazelbuild构建

4.1k
184
906
+5
排名 #8
9月18日
查看详情

NVIDIA/GenerativeAIExamples

面向加速基础设施与微服务架构优化的生成式AI参考工作流

4k
1.1k
1.3k
+6
排名 #17
5月13日
查看详情

thu-ml/SageAttention

量化注意力机制相比FlashAttention和xformers实现了2-5倍和3-11倍的速度提升,且在语言、图像和视频模型上保持端到端指标无损。

3.8k
510
1.2k
+16
排名 #5
9月19日
查看详情

raullenchai/Rapid-MLX

专为Apple Silicon打造的最快本地AI引擎。比Ollama快4.2倍,缓存TTFT仅0.08秒,100%工具调用。支持17种工具解析器、提示缓存、推理分离与云路由。可直接替代OpenAI,兼容Claude Code、Cursor、Aider。

3.4k
395
886
+18
排名 #7
7月23日
查看详情

pgmpy/pgmpy

用于因果人工智能的Python库

3.2k
1k
1.1k
+7
排名 #5
3月7日
查看详情

openvinotoolkit/openvino_notebooks

📚 OpenVINO™ 的 Jupyter Notebook 教程

3.2k
1k
1.2k
排名 #17
8月10日
查看详情

superlinked/sie

适用于代理所需的所有模型的开源推理服务器和生产集群。

3k
299
548
+60
排名 #5
9月2日
查看详情

spiceai/spiceai

一个用Rust编写的便携式加速SQL查询、搜索及LLM推理引擎,适用于数据驱动的AI应用与智能体。

3k
204
700
+4
排名 #8
6月22日
查看详情

vllm-project/vllm-ascend

面向昇腾平台的vLLM社区维护硬件插件

2.9k
2.3k
1.7k
+1
排名 #3
9月19日
查看详情

microsoft/foundry-local

暂无项目描述

2.5k
357
0
+1
排名 #8
8月7日
查看详情

google/XNNPACK

面向移动设备、服务器和Web的高效浮点神经网络推理算子

2.4k
542
1k
+1
排名 #8
8月19日
查看详情

TuringLang/Turing.jl

概率规划的贝叶斯推理。

2.2k
241
525
排名 #13
8月12日
查看详情

RightNow-AI/picolm

在仅256MB内存、10美元成本的开发板上运行10亿参数大语言模型

2.2k
272
861
+23
排名 #3
9月16日
查看详情

envoyproxy/ai-gateway

基于Envoy Gateway构建的生成式AI服务统一访问管理平台

2k
361
1k
+26
排名 #18
9月6日
查看详情

youssofal/MTPLX

MLX 速度提高 3 倍 |酷文3.8 27B | Apple Silicon 上的本机 MTP 推测解码,无需外部起草器。

1.9k
140
387
+746
排名 #17
8月31日
查看详情

xLLM-AI/xllm

A high-performance inference engine for LLM, VLM, DiT and REC models, optimized for diverse AI accelerators. It is hosted in OpenAtom Foundation.

1.5k
269
590
+5
排名 #21
7月24日
查看详情

theopenco/llmgateway

Route, manage, and analyze your LLM requests across multiple providers with a unified API interface.

1.5k
163
685
+6
排名 #8
7月24日
查看详情
助手