llmtrim:llmtrim是一个本地代理,通过智能地移除冗余Token来压缩LLM API请求,显著降低计费成本,同时不影响LLM响应的质量。它提供多种部署方式,包括作为代理、命令行工具、MCP服务器或多种编程语言的库。;on-policy:该存储库实现了MAPPO,一种PPO的多智能体变体,广泛应用于合作多智能体游戏和研究。它为星际争霸II、花火和谷歌足球等多种多智能体环境提供了健壮的实现,并附有详细的训练脚本和超参数指南。
降低AI代理(如Claude Code, Cursor, Aider)的LLM API成本。
合作多智能体强化学习的研究与实验