由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

reinforcement-learning

话题找到数量

open-spaced-repetition/fsrs4anki

基于自由间隔重复调度算法实现的现代Anki自定义调度系统。

3.9k
159
488
+1
排名 #13
4月12日
查看详情

enactic/openarm

用于接触密集型环境中物理AI研究和部署的全开源仿人机械臂

2.8k
307
587
+4
排名 #18
8月5日
查看详情

rasbt/reasoning-from-scratch

使用PyTorch从零开始逐步实现一个推理大语言模型

2.8k
398
540
+16
排名 #11
2月3日
查看详情

TradeMaster-NTU/TradeMaster

TradeMaster是一个基于强化学习的开源量化交易平台

2.7k
518
373
+10
排名 #12
5月25日
查看详情

NVlabs/ProtoMotions

ProtoMotions 是一个用于训练物理模拟数字人及人形机器人的 GPU 加速仿真与学习框架。

1.9k
226
175
+50
排名 #13
7月3日
查看详情

NVIDIA-NeMo/Nemotron

NVIDIA Nemotron 开发者资源中心——提供训练方案、使用指南及完整端到端参考示例的一站式资源库,助力基于Nemotron模型的开发。

1.8k
364
514
+8
排名 #8
7月28日
查看详情

NVIDIA-NeMo/Gym

为大型语言模型训练构建强化学习环境

941
169
563
+1
排名 #14
6月3日
查看详情

unilabsim/UniLab

UniLab:一种超越GPU主导范式的机器人强化学习异构架构

572
47
308
+90
排名 #11
6月4日
查看详情

HenryHuYu/DiffPhysDrone

发表于《自然·机器智能》!首个基于可微分物理训练的实体机器人(四旋翼飞行器)。

561
84
588
排名 #14
6月6日
查看详情
助手