Yi
国产开源双语大模型,从零训练覆盖6B-34B参数规模,支持消费级GPU量化部署
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
国产开源双语大模型,从零训练覆盖6B-34B参数规模,支持消费级GPU量化部署
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象这样一个场景:你经营着一家跨国电商公司,每天要处理海量的中英文客服对话、产品描述翻译、多语言市场分析——以前需要同时调用多个翻译和 NLP API,成本高、延迟大、体验割裂。如今,一套开源模型就能同时搞定中英双语理解与生成,还能根据你的业务数据微调出一个专属客服大脑。这正是 Yi 模型诞生的背景与价值所在。
Yi 是由深圳 01.AI(零一万物)团队从零开始训练的大型语言模型系列,GitHub 累计获得超过 7800 颗星。作为国产大模型中的代表性开源项目,Yi 填补了当时开源社区缺乏高质量中英双语 34B 模型的空白,并在多项国际基准测试中展现出与闭源模型相媲美的能力。

图1:Yi 模型 Logo
2023 年下半年,开源大模型社区面临一个尴尬局面:英文能力强悍的 LLaMA 2、Mistral 纷纷开源,但中文能力普遍偏弱;而国内公司发布的大模型大多数只开放 API,不开源权重。Yi 的出现打破了这个僵局——它不仅开源权重,还同时优化了中英双语能力,34B 参数规模在消费级硬件和数据中心之间找到了一个难得的平衡点。 01.AI 由创新工场创始人李开复创办,核心团队来自 Google、Microsoft、Meta 等国际大厂,在大模型预训练领域有深厚积累。Yi 模型的技术报告(arXiv:2403.04652)详细披露了训练流程,包括数据处理、Tokenizer 设计、Long Context 扩展等关键细节,在学术和工程社区都获得了较高引用。
Yi 项目提供了完整的模型矩阵,覆盖不同参数规模和用途:
| 模型类型 | 代表型号 | 特点 |
|---|---|---|
| 基础模型 | Yi-34B、Yi-9B、Yi-6B | 从零预训练,适合继续微调 |
| 对话模型 | Yi-34B-Chat、Yi-6B-Chat | SFT + RLHF 对齐,开箱即用 |
| 长上下文 | Yi-34B-200K、Yi-9B-200K | 20 万 token 上下文窗口 |
| 量化模型 | Chat-4bits/8bits(AWQ/GPTQ) | 消费级 GPU 即可运行 |
| 这种「全家桶」式的发布策略,让不同条件的开发者都能找到适合自己的入口——有高端 GPU 的可以直接跑全精度大模型,有游戏显卡的可以跑 4-bit 量化版,有超长文档处理需求的可以选择 200K 版本。 | ||
![]() |
图2:Yi 基础模型在各大基准测试上的表现

图3:Yi 对话模型与其他主流模型的对比

图4:Yi-9B 整体性能 Benchmark 表现
与很多开源模型选择基于 LLaMA 进行继续预训练不同,Yi 完全从零训练。这意味着团队需要独立完成数据收集、清洗、Tokenizer 训练、模型架构设计、分布式训练优化等全套流程,工作量巨大,但也因此拥有完全自主的技术栈和数据配比控制权。 根据技术报告,Yi 的训练数据涵盖英文和中文网页、学术论文、代码、书籍等多种来源,数据质量通过多轮清洗和去重控制。Tokenizer 采用了 SentencePiece BPE,在中英混合文本上有良好的子词划分效率。
34B 参数规模的模型从头训练,需要数千张 GPU 和数周的计算资源。Yi 使用了 DeepSpeed ZeRO 分布式训练框架,结合混合精度训练和梯度累积,在保证训练效率的同时控制了硬件门槛。 对于普通开发者来说,完全没有必要重新训练——直接下载官方发布的预训练权重即可。6B 模型在单张 3090/4090 上即可完成推理,34B 模型需要多卡或量化后单卡运行。
Yi 项目在部署体验上下足了功夫,提供了四种部署路径:
pipeline 几行代码完成推理Yi 仓库的目录结构体现了良好的工程实践:
Yi/
├── Cookbook/ # 快速上手教程,含多种部署场景
├── VL/ # 视觉-语言多模态模型(Vision-Language)
├── finetune/ # 微调代码(LoRA/SFT 等)
├── quantization/ # 量化相关代码
├── demo/ # Gradio/WebUI 演示界面
├── docs/ # 文档
├── Dockerfile # 多阶段 Docker 构建
├── pyproject.toml # 现代 Python 包管理
└── requirements.txt # 核心依赖
核心推理基于 Hugging Face transformers 库,利用其成熟的 AutoModelForCausalLM + AutoTokenizer 接口。demo 目录提供了 Gradio WebUI,可以快速在浏览器中与模型交互,适合非技术用户。
微调(finetune)目录支持 LoRA、Full-parameter SFT 等常见微调方法,配合 DeepSpeed 和 Accelerate 库,可以在小成本下将 Yi 微调为垂直领域专家。
| 使用方式 | 技术门槛 | 硬件门槛 | 典型用户 | |---------|---------|---------|---------|| 在线 Demo | 无 | 无 | 快速体验、效果评估 | | API 调用(Replicate) | 低 | 无 | 直接集成到应用 | | 量化版本地推理 | 中 | RTX 3060+(4GB VRAM) | 个人开发者、AI 爱好者 | | 全精度本地推理 | 高 | 34B: 4×4090 或 A100 | 企业部署、定制微调 | | 微调定制 | 高 | 6B: 单卡 A100,34B: 多卡 | 垂直领域应用开发 | 对于大多数开发者,建议从 pip 快速安装 + 量化模型 入手,用 6B 或 9B 版本验证效果,再根据需求决定是否升级到 34B 全精度或进行微调。
客观看待,Yi 也存在一些局限:
数据来源:GitHub 01-ai/Yi (7823★)、arXiv:2403.04652