PaddleFormers
基于飞桨的大模型训练库,支持100+LLM/VLM模型分布式训练
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
基于飞桨的大模型训练库,支持100+LLM/VLM模型分布式训练
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象一下,你需要训练一个拥有数千亿参数的大语言模型——这不是普通开发者能触及的场景,却是百度 PaddleFormers 项目诞生的直接背景。当 OpenAI、Meta、Google 相继开源自己的训练框架,百度也给出了自己的答案:基于飞桨(PaddlePaddle)深度学习框架的 PaddleFormers。它瞄准的,是国内开发者最熟悉、使用门槛相对最低的大模型训练工具链。
2026年3月,PaddleFormers v1.1 正式发布,支持 GLM-4.5 系列模型的单步与多步 MTP(Multi-Token Prediction)训练能力;2026年1月 v1.0 首次亮相即支持 DeepSeek-V3、GLM-4.5-Air 等重磅模型,并公开宣称在训练性能上明显超越业界标杆 Megatron-LM。
PaddlePaddle(飞桨)是百度自研的深度学习框架,在国内工业界拥有大量用户基础。然而,当大模型时代到来,开发者们普遍面临一个尴尬局面:飞桨生态缺乏一个对标 Hugging Face Transformers 的模型训练库。PaddleFormers 正是为了填补这一空白而诞生的。
从 GitHub 数据来看,该项目已收获超过 12,900 颗星、2,100+ 次 forks、225 个 open issues——这说明社区活跃度相当高,不是一个被废弃的"僵尸项目"。项目采用 Apache-2.0 开源许可证,代码贡献来自百度内部团队和社区开发者。
PaddleFormers 的核心定位非常清晰:在 PaddlePaddle 生态内,提供与 Hugging Face Transformers 对等的模型接口和训练功能体验。它不是简单的模型权重转换工具,而是一个完整的训练框架,包含从数据处理到模型训练再到权重导出的全流程能力。
PaddleFormers 的代码结构体现了清晰的模块化设计理念。核心模块包括:
这种架构设计让不同需求的用户可以各取所需:只想微调一个模型的开发者只需关注 trainer + peft 模块;需要进行模型架构研究的开发者则可以深入 transformers 模块。
大模型训练的核心挑战在于算力扩展。PaddleFormers 全面支持三种主流分布式训练策略:
结合 FP8 低精度训练、自动混合精度(AMP)、通信计算重叠优化等特性,PaddleFormers 在 DeepSeek-V3 和 GLM-4.5-Air 等模型上的训练性能据称明显超越 Megatron-LM。虽然这类对比数据来自百度官方,但考虑到飞桨团队在国产计算平台的深度优化积累,这一说法有其合理性。
完成预训练后,PaddleFormers 支持完整的后训练流程:
值得注意的是,PaddleFormers 对国产计算芯片做了深度适配:
这体现了百度在 AI 基础设施自主可控方面的战略考量。对于无法获取 NVIDIA 高端 GPU 的国内机构和企业,PaddleFormers 提供了一条可行的本地训练路径。
除了常规训练能力,PaddleFormers 还实现了大模型前沿能力的训练支持:
PaddleFormers 提供了完整的命令行工具 paddleformers-cli,通过子命令驱动训练和导出流程:
# 训练(精调)
paddleformers-cli train ./config/sft/lora.yaml
# 导出(LoRA 权重合并)
paddleformers-cli export --model_name_or_path /path/to/model --output_dir /path/to/lora_ckpt
模型导出后自动转为 Safetensors 格式,与 Hugging Face 生态完全兼容。这意味着训练好的模型可以直接被 vLLM、SGLang、FastDeploy 等推理框架使用。
PaddleFormers 支持从 Hugging Face、ModelScope、AI Studio 三个源下载模型权重,通过设置 DOWNLOAD_SOURCE 环境变量切换。
PaddleFormers 的目标用户是具备以下条件的开发者:
对于普通 AI 爱好者,PaddleFormers 不是一个"开箱即用"的项目——它要求用户有一定的分布式训练背景和对 YAML 配置文件的理解能力。但对于有需求的开发者来说,它的 CLI 设计降低了使用门槛,配置文件驱动的训练流程比纯代码调用更易维护。
PaddleFormers 是百度在大模型时代给出的训练框架答卷。它的核心价值不在于"替代 PyTorch 生态",而在于为 PaddlePaddle 生态用户提供了一条完整的大模型训练路径。对于已经在使用飞桨的团队,它是一个值得认真考虑的选择;对于其他开发者,理解 PaddleFormers 的设计思路也有助于把握大模型训练的工程实践前沿。