rllm:rLLM是一个开源框架,旨在使用强化学习对语言代理进行后训练。它使用户能够轻松构建、训练和部署自定义代理和环境,以应对实际工作负载。;gym-pybullet-drones:gym-pybullet-drones 是其原始仓库的精简重构版本,提供了一个 Gym 环境,用于模拟多智能体四旋翼无人机控制。它旨在兼容 Gymnasium、Stable Baselines3 2.0 和各种飞行固件,以支持硬件在环仿真。
训练用于代码生成和错误修复等任务的强大编码模型。
开发和评估四旋翼飞行器的 PID 控制器