由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
inference
话题找到数量
Andyyyy64/whichllm
找到真正能在你的硬件上运行且性能最佳的本地大语言模型。基于真实且考虑时效性的基准进行排名,而非参数数量。一条命令,即刻运行。
ruvnet/RuVector
RuVector是一款用Rust构建的高性能向量与图数据库,专为人工智能、智能体系统和实时分析设计。它将HNSW搜索、动态最小割一致性、图智能与自学习记忆融合为统一引擎,实现可扩展、低延迟的推理与结构化检索。
OpenCSGs/csghub
CSGHub是由OpenCSG团队开发的全新开源大语言模型管理平台,提供开源版和本地化/SaaS解决方案,功能对标Hugging Face。完整掌控大语言模型、数据集和智能体的生命周期,Python SDK与Hugging Face兼容。欢迎加入我们!⭐️
thu-ml/SageAttention
量化注意力机制相比FlashAttention和xformers实现了2-5倍和3-11倍的速度提升,且在语言、图像和视频模型上保持端到端指标无损。
raullenchai/Rapid-MLX
专为Apple Silicon打造的最快本地AI引擎。比Ollama快4.2倍,缓存TTFT仅0.08秒,100%工具调用。支持17种工具解析器、提示缓存、推理分离与云路由。可直接替代OpenAI,兼容Claude Code、Cursor、Aider。
youssofal/MTPLX
MLX 速度提高 3 倍 |酷文3.8 27B | Apple Silicon 上的本机 MTP 推测解码,无需外部起草器。
theopenco/llmgateway
Route, manage, and analyze your LLM requests across multiple providers with a unified API interface.