由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

reinforcement-learning

话题找到数量

unslothai/unsloth

大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存

76k
7k
1.5k
+68
排名 #14
9月19日
查看详情

sgl-project/sglang

SGLang是面向大语言模型与视觉语言模型的高速推理框架。

35k
8.6k
2k
+708
排名 #5
9月5日
查看详情

eriklindernoren/ML-From-Scratch

从头开始机器学习。机器学习模型和算法的基本 NumPy 实现,重点是可访问性。旨在涵盖从线性回归到深度学习的所有内容。

32k
5.5k
833
+83
排名 #18
9月6日
查看详情

AI4Finance-Foundation/FinGPT

FinGPT:开源金融大语言模型!我们发布革命性🔥训练模型于HuggingFace平台

21k
3k
1.2k
+4
排名 #10
8月31日
查看详情

Unity-Technologies/ml-agents

Unity机器学习代理工具包(ML-Agents)是一个开源项目,能让游戏和模拟场景成为训练智能代理的环境,支持深度强化学习与模仿学习。

19k
4.5k
1.3k
+4
排名 #16
8月19日
查看详情

microsoft/agent-lightning

点亮AI智能体的终极训练器

18k
1.6k
1.3k
+54
排名 #13
9月18日
查看详情

AI4Finance-Foundation/FinRL

FinRL®:金融强化学习框架。🔥

16k
3.5k
1.3k
+8
排名 #12
9月9日
查看详情

owainlewis/awesome-artificial-intelligence

人工智能(AI)课程、书籍、视频讲座与论文的精选列表

15k
2.4k
919
+49
排名 #8
7月21日
查看详情

carla-simulator/carla

开源自动驾驶研究模拟器

14k
4.7k
1.4k
+8
排名 #13
8月6日
查看详情

datawhalechina/easy-rl

强化学习中文教程(蘑菇书🍄),在线阅读地址:https://datawhalechina.github.io/easy-rl/

14k
2.3k
1.1k
+9
排名 #13
5月20日
查看详情

kmario23/deep-learning-drizzle

通过聆听这些精彩讲座,沉浸式学习深度学习、强化学习、机器学习、计算机视觉和自然语言处理!!

12k
3k
733
+9
排名 #4
7月20日
查看详情

simular-ai/Agent-S

Agent S:仿人类操作计算机的开放式智能体框架

11k
1.3k
1.1k
+29
排名 #12
5月17日
查看详情

aws/amazon-sagemaker-examples

示例 📓 Jupyter 笔记本,展示如何使用 🧠 Amazon SageMaker 构建、训练和部署机器学习模型。

10k
7k
1.6k
排名 #6
6月25日
查看详情

OpenPipe/ART

智能体强化训练器:使用GRPO为现实任务训练多步智能体。为智能体提供在职培训。支持Qwen2.5、Qwen3、Llama等模型的强化学习

9.8k
867
1.1k
+44
排名 #15
5月23日
查看详情

MITDeepLearning/introtodeeplearning

麻省理工学院6.S191课程实验材料:深度学习导论

8.7k
4.6k
1.1k
排名 #6
8月16日
查看详情

NVlabs/Sana

SANA:基于线性扩散 Transformer 的高效高分辨率图像合成

8.5k
685
1k
+12
排名 #11
7月25日
查看详情

tailcallhq/forgecode

面向Claude、GPT、O系列、Grok、Deepseek、Gemini及300多种模型的AI增强型结对编程工具

7.1k
1.4k
1k
+1.9k
排名 #4
4月30日
查看详情

HenryNdubuaku/maths-cs-ai-compendium

成为顶尖的人工智能与机器学习研究工程师

6.9k
825
954
+381
排名 #7
7月18日
查看详情

kvcache-ai/Mooncake

Mooncake是Moonshot AI旗下领先大语言模型服务Kimi的部署平台。

6.6k
1.2k
1.3k
+10
排名 #15
9月18日
查看详情

PufferAI/PufferLib

简化复杂游戏环境中的强化学习实现

6k
474
930
+54
排名 #6
6月11日
查看详情

huggingface/deep-rl-class

该仓库包含Hugging Face的深度强化学习课程。

5k
808
1.2k
排名 #7
8月2日
查看详情

antinomyhq/forge

面向Claude、GPT、O系列、Grok、Deepseek、Gemini及300多种模型的AI增强型结对编程工具

4.9k
1.2k
1.2k
+240
排名 #7
3月15日
查看详情

inclusionAI/AReaL

专为大型语言模型推理与智能体打造的闪电式强化学习框架。

4.6k
378
1.1k
+969
排名 #9
3月8日
查看详情

open-spaced-repetition/fsrs4anki

基于自由间隔重复调度算法实现的现代Anki自定义调度系统。

3.9k
159
934
+1
排名 #13
4月12日
查看详情
助手