由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

attention

话题找到数量

rasbt/LLMs-from-scratch

使用PyTorch从零开始逐步实现类ChatGPT大型语言模型

99k
15k
589
+83
排名 #4
7月24日
查看详情

sgl-project/sglang

SGLang是面向大语言模型与视觉语言模型的高速推理框架。

30k
7.5k
990
+73
排名 #7
7月29日
查看详情

xlite-dev/LeetCUDA

📚LeetCUDA:面向初学者的现代CUDA学习笔记(基于PyTorch)🐑,包含200+个CUDA内核、张量核心、HGEMM、FA-2 MMA。🎉

11k
1.2k
174
+8
排名 #6
7月25日
查看详情

flashinfer-ai/flashinfer

FlashInfer:大语言模型服务的核心计算库

6k
1.2k
739
+5
排名 #8
7月24日
查看详情

ruvnet/RuVector

RuVector是一款用Rust构建的高性能向量与图数据库,专为人工智能、智能体系统和实时分析设计。它将HNSW搜索、动态最小割一致性、图智能与自学习记忆融合为统一引擎,实现可扩展、低延迟的推理与结构化检索。

4.3k
569
0
+8
排名 #6
7月8日
查看详情

thu-ml/SageAttention

量化注意力机制相比FlashAttention和xformers实现了2-5倍和3-11倍的速度提升,且在语言、图像和视频模型上保持端到端指标无损。

3.6k
451
579
+27
排名 #2
8月4日
查看详情

kyegomez/awesome-multi-agent-papers

最佳多智能体论文汇编

1.6k
158
367
+2
排名 #9
8月4日
查看详情

thu-ml/SpargeAttn

SpargeAttention:一种免训练的稀疏注意力机制,可加速任何模型推理

951
87
549
+1
排名 #8
2月25日
查看详情

psmarter/CUDA-Practice

CUDA编程练习项目——动手实践CUDA内核与性能优化,涵盖GEMM、FlashAttention、Tensor Cores、CUTLASS、量化、KV缓存、NCCL及性能分析。

155
12
264
+49
排名 #4
5月31日
查看详情
助手