由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
jump-dev/JuMP.jl
数学优化建模语言(涵盖线性、混合整数、锥规划、半定规划及非线性问题)
MrNeRF/LichtFeld-Studio
LichtFeld工作室:现实与数字世界的交融之处
google/or-tools
Google的运筹学工具:
zeux/meshoptimizer
网格优化库:缩小网格体积并提升渲染速度
CliMA/ClimaAtmos.jl
ClimaAtmos.jl 是一个大气模型,旨在利用数据同化和机器学习工具来建模和校准次网格尺度过程。
NVIDIA/CUDALibrarySamples
CUDA库示例集
rapidsai/cugraph
cuGraph - RAPIDS 图分析库
NVIDIA/cub
[已归档] CUDA C++协同原语 参见https://github.com/NVIDIA/cccl
NVIDIA/raft
RAFT 包含用于机器学习和信息检索的基础性、广泛使用的算法与原语。这些算法经过 CUDA 加速,构成了更轻松编写高性能应用程序的构建模块。
rapidsai/raft
RAFT包含用于机器学习和信息检索的基础性广泛使用算法与原语。
NVIDIA/nvbench
CUDA内核基准测试库
NVIDIA/cuvs
cuVS - 一个用于GPU上的向量搜索与聚类的库
brucefan1983/GPUMD
图形处理器分子动力学
rapidsai/cuvs
cuVS - GPU向量搜索与聚类计算库
NVIDIA/cuCollections
项目竞品项目否描述
NVlabs/parrot
Parrot 是一个基于 NVIDIA CCCL 库(Thrust/CUB)构建的数组融合 GPU 库。
catboost/catboost
一个快速、可扩展、高性能的基于决策树的梯度提升库,用于Python、R、Java、C++的排序、分类、回归及其他机器学习任务,支持CPU和GPU计算。
NVIDIA/warp
一个用于加速仿真、数据生成和空间计算的 Python 框架。
flashinfer-ai/flashinfer
FlashInfer:大语言模型服务的核心计算库
NVIDIA/nccl
面向集体多GPU通信的优化原语
相关项目推荐
karpathy/llm.c
基于纯C/CUDA的简易大语言模型训练
NVlabs/instant-ngp
即时神经图形原语:极速神经辐射场(NeRF)及其他技术
xlite-dev/LeetCUDA
📚LeetCUDA:面向初学者的现代CUDA学习笔记(基于PyTorch)🐑,包含200+个CUDA内核、张量核心、HGEMM、FA-2 MMA。🎉
HigherOrderCO/HVM2
一个基于Rust的大规模并行、最优函数运行时
deepseek-ai/DeepEP
DeepEP:高效的专家并行通信库
deepseek-ai/DeepGEMM
DeepGEMM:具备细粒度缩放功能的精简高效FP8通用矩阵乘内核