由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

rocm

话题找到数量

tracel-ai/burn

Burn是下一代深度学习框架,在灵活性、效率和可移植性方面毫不妥协。

15k
998
1.6k
+18
排名 #15
7月29日
查看详情

cupy/cupy

面向GPU的NumPy与SciPy

12k
1.1k
973
+628
排名 #10
7月5日
查看详情

LMCache/LMCache

通过最快的KV缓存层为您的LLM加速

10k
1.5k
1.1k
+101
排名 #9
7月10日
查看详情

lemonade-sdk/lemonade

Lemonade 通过直接在用户自己的 GPU 和 NPU 上运行优化后的 LLM,帮助用户发现并运行本地 AI 应用。加入我们的 Discord:https://discord.gg/5xXzkMu8Zk

5.7k
491
936
+14
排名 #12
9月7日
查看详情

iree-org/iree

一个基于MLIR的可重定向机器学习编译器与运行时工具包。

3.9k
986
1.5k
+1
排名 #20
8月24日
查看详情

SemiAnalysisAI/InferenceX

开源持续推理基准测试:Qwen3.5、DeepSeek、GPTOSS - GB200 NVL72对比MI355X、B200、GB300 NVL72、H100,即将支持TPUv6e/v7/Trainium2/3

1.1k
202
1.1k
+11
排名 #8
6月17日
查看详情

unilabsim/UniLab

UniLab:一种超越GPU主导范式的机器人强化学习异构架构

572
47
730
+90
排名 #11
6月4日
查看详情

JuliaGPU/AMDGPU.jl

AMD GPU(ROCm)编程(Julia实现)

336
72
689
排名 #14
7月5日
查看详情

supranational/sppark

零知识模板库

220
98
581
+1
排名 #12
7月13日
查看详情

JuliaGPU/AcceleratedKernels.jl

面向Julia CPU与GPU后端的跨架构并行算法。

188
11
886
+2
排名 #2
3月15日
查看详情

ROCm/hipBLASLt

已弃用,代码已迁移至 ROCm/rocm-libraries 仓库

113
147
885
排名 #12
6月29日
查看详情

gpustack/gpustack

用于高性能 AI 模型服务(vLLM、SGLang)和按需可通过 SSH 访问的 GPU 实例的 GPU 集群管理器。

0
0
333
排名 #7
9月11日
查看详情
助手