bisheng
开源企业级 LLM 应用开发平台,一键 docker-compose 部署,支持可视化 Workflow、RAG、Agent、SFT 微调与高精度中文文档解析
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
开源企业级 LLM 应用开发平台,一键 docker-compose 部署,支持可视化 Workflow、RAG、Agent、SFT 微调与高精度中文文档解析
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象一下这样的场景:一家世界 500 强企业想要打造智能客服系统,需要接入大模型、理解海量内部文档、支持复杂业务流程编排,还要确保数据完全私有化——这听起来像是一个需要数百万元预算的企业级项目。而 BISHENG 毕昇 正在把这件事变成开源现实:任何企业都可以在几十分钟内,用一台服务器搭建起完整的 LLM 应用平台。
BISHENG 毕昇(dataelement/bisheng,11,390+ ⭐)是一款专为企业场景设计的开源 LLM 应用开发平台,已有大量行业头部组织和世界 500 强企业在生产环境中使用。平台名字取自活字印刷术发明人毕昇——寓意如同活字印刷推动知识传播一样,推动 AI 智能应用在企业中的广泛落地。

2023 年以来,以 ChatGPT 为代表的大语言模型席卷全球,众多企业迫不及待想要将 AI 能力融入自身业务。然而真正落地的企业屈指可数——这背后是一个残酷的现实:通用大模型的能力很强,但把它变成企业可用的产品,需要跨越巨大的工程鸿沟。
缺乏统一模型管理、文档解析精度不足、工作流编排能力薄弱、企业级安全管控缺失……每一个问题都可能让一个 AI 项目死在 POC 阶段。在此背景下,面向企业的 LLM 应用开发平台应运而生,国外有 LangFlow、Haystack,而国内的代表性产品便是 BISHENG 毕昇。
BISHENG 由数据元(DataElement)团队开发和维护,GitHub 仓库于 2022 年底开放,之后持续活跃迭代,截至目前已获得超过 11,000 颗星,在企业级 LLM 应用开源平台中处于头部位置。
如果把大语言模型比作企业智能的「大脑」,那么 BISHENG 就是连接大脑与企业业务的「神经中枢」——一个完整的应用开发操作系统。它不是一个简单的聊天界面,而是包含了从模型管理、RAG 检索、工作流编排、Agent 构建,到数据标注、SFT 微调、效果评估的全链路工具箱。
打个更生活化的比方:如果 LLM 是 мощный 引擎,BISHENG 就是把引擎安装到整车里的一站式装配厂——企业提供业务需求,BISHENG 提供从零件到整车的全套解决方案。
BISHENG 通过 AGL(Agent Guidance Language)框架,将领域专家的偏好、经验与业务逻辑融入 AI Agent 中。简单来说,这就像给 AI 配备了一位「资深业务顾问」:Agent 不再只是机械地响应 Prompt,而是能够按照专家定义的规则和偏好处理任务,真正做到「专家级理解」。

这是 BISHENG 最具特色的核心能力。与同类产品需要区分「对话流」和「工作流」不同,BISHENG 在同一套框架下支持所有任务类型,并通过直观的流程图式界面完成编排。
具体亮点:

企业级特性不是可选项,而是 BISHENG 的设计底线:

企业在构建知识库时,最头疼的问题之一是文档解析精度——特别是中文场景下的表格、手写体、印章、复杂版式等。BISHENG 依托 5 年的海量数据积累,训练了一套高精度的文档解析模型,支持免费私有化部署使用:
这套 OCR 能力在同类型开源产品中处于领先水平。

BISHENG 内置完整的 RAG(检索增强生成)能力,支持对接多种向量数据库(Milvus、ES 等),配合高精度文档解析,可以构建高质量的企业知识库问答系统。
平台支持模型微调(基于 LLaMA-Factory)和完整的数据集管理流程,企业可以用自己的业务数据对模型进行定向优化,在保障数据隐私的同时提升模型在特定领域的表现。
内置多维度评估指标体系,支持对 Agent 和工作流的运行效果进行量化评估,形成数据驱动的优化闭环。
从代码结构来看,BISHENG 采用典型的前后端分离架构:
src/
backend/ # Python 后端(API 服务、Agent 引擎、Workflow 执行器)
frontend/ # TypeScript 前端(React 工作流编辑器、管理后台)
技术栈方面:
项目大量依赖 LangChain、LangFlow、Unstructured-IO、LLaMA-Factory 等主流开源生态组件,体现了良好的开源协作姿态。
BISHENG 提供了极为友好的部署体验。硬件要求为 CPU 8 核以上、内存 32GB 以上,系统需安装 Docker 和 Docker Compose。
部署步骤仅需两步:
# 1. 下载代码
git clone https://github.com/dataelement/bisheng.git
cd bisheng/docker
# 2. 一键启动
docker compose -f docker-compose.yml -p bisheng up -d
启动后访问 http://IP:3001 即可看到登录页面。默认第一个注册用户自动成为系统管理员。
docker-compose.yml 会自动拉起全部依赖服务(MySQL、Redis、Elasticsearch、Milvus、MinIO、OnlyOffice 等),无需手动安装任何第三方组件,极大降低了部署门槛。
尽管 BISHENG 在功能覆盖和企业级特性上表现出色,但仍有一些局限性值得注意:
GPU 依赖缺失:当前 docker-compose 模板不包含 GPU 配置,对于需要本地推理(LLaMA、Qwen 等开源模型)的场景,用户需要自行修改配置添加 CUDA 支持,门槛略有提升。
前端非纯前端:前端项目虽然使用 TypeScript,但没有独立的 package.json,说明前后端耦合度较高,模块化程度有提升空间。
文档体系封闭:核心使用文档托管在飞书 Wiki,对习惯 GitHub README 的开发者而言有一定跳转成本。
仅支持私有化部署:暂不支持云服务订阅模式,对于没有运维团队的小型组织,部署和维护仍有一定挑战。
BISHENG 的出现和发展,折射出几个重要的行业趋势:
趋势一:企业 AI 平台从「能用」走向「好用」。早期企业 LLM 应用开发需要大量定制开发,BISHENG 这类平台通过可视化编排、内置组件、标准化工作流,正在让企业 AI 开发从「专家专属」变成「业务人员可上手」。
趋势二:开源生态加速整合。BISHENG 深度整合了 LangChain、LangFlow、LLaMA-Factory 等多个顶级开源项目,体现了开源社区「各司其职、生态协作」的成熟模式,而非重复造轮子。
趋势三:中文场景的深度优化。相比海外产品,BISHENG 在中文文档解析、OCR 识别、飞书集成等方面的本地化深度,是其差异化的核心护城河。
从 GitHub 星标增长曲线来看,BISHENG 保持着稳定的活跃度,随着企业 AI 需求的持续爆发,其在企业级 LLM 应用平台领域的影响力有望进一步扩大。
