
GitHub 收藏1K
代码最近更新2026 年 9 月 15 日
许可证开源 · MIT
要不要花钱免费
主要用于在推理引擎运行过程中原地更新模型权重,支持广播与点对点传输。适合做大模型强化学习或频繁更新权重的技术人员。需要自己搭建多卡服务器环境并写代码调用。
用起来难吗要写代码在哪用Linux命令行自己部署
能做什么
- 在线原地更新模型权重
- 广播同步更新大批推理节点
- 点对点传输给新加入节点
- 支持跨卡流水线传输重叠
怎么开始
- 需要会写代码并在多卡 GPU 服务器上配置环境
- 准备好支持特定接口的 vLLM 推理服务环境
- 通过包管理器安装后调用参数服务运行更新代码
选它,如果你……
- 你在做强化学习训练且需要频繁向推理集群同步新权重
- 你需要在多卡或多机集群上极速同步千亿级大模型参数
- 你正在使用 vLLM 作为大模型在线推理后端
别选,如果你……
- 你只想直接找个大模型聊天或调用现成接口
- 你没有多卡 GPU 高性能服务器或不会编写代码
怎么用
代码开源,可以免费下载使用。
多少钱、在哪买
免费使用。
综合评价:不错(还在更新)
| 更新 | 活跃 | 近 90 天改代码 7 次;最近一次发版是 94 天前(v0.4.2) |
|---|---|---|
| 问题处理 | 暂不评 | 近 90 天只有 1 个新问题,太少不评 |
| 用的人 | 一般 | GitHub 收藏 1,006;19 人参与开发 |
| 用户口碑 | 暂不计 | 用过的人的评价满 5 条后才算进来 |
数字取自 GitHub 的公开记录(2026/10/5), 用过的人的评价来自本页口碑。自己核对:项目主页、问题、外部提交的修改、发版记录。
怎么评的
只看公开、能核对的数据,不打分数,只给四档结论,每一项的依据都写在旁边。
- 更新:近 90 天改了多少次代码、最近一次发版是哪天。7 天内有改动并且改得多或常发版,算「很活跃」;30 天内有改动算「活跃」;半年内算「放缓」;半年以上没动或者已经归档,算「停更」。
- 问题处理:近 90 天新开的问题解决了几成、一般几天解决、外部提交的修改积压了多少。解决八成以上、一般一周内解决、积压不比合进去的多,算「好」;解决不到一半算「差」;其余算「一般」。新问题不到 10 个的不评。
- 用的人:GitHub 收藏 5 万以上算很多,1 万以上算多,1 千以上算一般。旁边写近 7 天新增多少、多少人参与开发。
- 用户口碑:用过的人的评价满 5 条才算进来(注册不满 7 天的账号不算);平均分在 2.5 分及以下,总评降一档。
- 总评四档:还在更新、问题处理好、用的人多 → 推荐;还在更新 → 不错;更新放缓或问题处理差 → 一般;半年以上没更新 → 谨慎。许可证有附加条件、商用受限的,单独提醒,不影响总评。
- 收费软件(ChatGPT、Cursor 这类)没有公开的问题记录,就看 App Store:最近一次更新在 30 天内算「活跃」,半年内算「放缓」,半年以上算「停更」;打分人数 10 万以上算很多,1 万以上算多,1 千以上算一般;评分 4 分以上算好,2.5 分及以下算差,打分不到 100 人不评。再加上用过的人的评价。
收藏数能刷,所以只占一项;更新和问题处理很难刷。数据每天更新,超过两周没更新的不评。
最近更新和热度
- v0.4.2
可通过 HTTP 暴露参数服务器元数据以支持跨进程加入
- v0.4.1
支持 AWS EFA,单设备支持多网口,并优化了动态导入
- v0.4.0
新增无状态进程组扩展,并提前释放 IPC 缓冲区
看看它的样子
用过?说两句
用户口碑
用户评价
还没有评价平均分和优缺点人数只统计说自己用过的评价。注册未满 7 天的账号暂不计分。参与计分不足 5 条时不显示平均分。
用户提问
还没有提问还没有人提问。可以问装在哪、要不要花钱、能不能接自己的 Key、中文好不好用。
数据来源:GitHub,每天更新,更新时间 2026 年 10 月 6 日。 信息有误?告诉我们。