RAGFlow是什么?
RAGFlow是InfiniFlow团队推出的开源检索增强生成引擎和AI Agent平台。它把文档采集、版面理解、分块、向量化、全文检索、重排、问答、Agent工作流与API集中在一套系统中,目标是为大语言模型构建可追溯、可管理的上下文层。
与只把纯文本切成固定长度的轻量知识库相比,RAGFlow更强调复杂文档结构。它会识别标题、段落、表格、图片和页面布局,并允许用户查看、修改每个Chunk及其位置,适合合同、财报、论文、操作手册、扫描件和结构复杂的Office文件。
核心功能
1. 深度文档理解
内置DeepDoc和可编排的Ingestion Pipeline用于解析Word、Slides、Excel、TXT、图片、扫描件、结构化数据和网页。系统可以结合OCR、布局分析和多模态模型提取文字、表格与图片含义,并保留文档位置和元数据。
新版还可选择MinerU、Docling、OpenDataLoader等解析后端。不同解析器对扫描件、双栏论文、公式、复杂表格和大文件的效果差异明显,正式入库前应抽查解析预览,而不是默认任何PDF都能无损转换。
2. 模板化分块
RAGFlow根据文档类型提供不同Chunk模板,例如通用文档、书籍、论文、法律文件、问答、表格、图片和知识图谱等。模板会参考标题层级、段落边界和版面信息,用户能够在界面中查看分块结果并人工修改。
分块决定检索颗粒度。块太小会失去上下文,太大则增加噪声和Token成本。
应使用真实问题验证每种模板,并根据资料结构调整分隔符、块大小、重叠与元数据。
3. 向量、BM25与混合检索
检索层同时支持向量语义搜索和BM25全文搜索,可设置两者权重并对多路召回结果融合。向量适合同义表达,BM25适合编号、人名、产品型号和精确术语;
重排模型会再次判断候选片段与问题的相关性。
系统默认可使用Elasticsearch存储全文与向量,也能切换到InfiniFlow开源的Infinity文档引擎。切换文档引擎涉及数据重建甚至清除已有卷,不能直接在生产环境执行未经备份的迁移命令。
4. 可追溯问答与引用
聊天助手会显示答案所依据的文档片段和引用,用户可以快速返回原文核查。检索测试页可单独观察召回内容、相似度和排序,用于区分“没有找到正确资料”与“模型读到了资料但回答错误”。
引用只证明系统使用了某个片段,不保证结论完整或正确。法律、医疗、金融和研究报告仍需人工阅读原文,核对日期、版本、表格单位与例外条款。
5. RAPTOR、PageIndex与知识图谱
RAPTOR会对文档或数据集进行分层聚类与摘要,让系统既能检索细节,也能召回跨章节的高层主题。新版提供GMM与AHC模式,AHC把语义组织扩展到整个数据集。
PageIndex则利用目录和层次信息定位长文档内容。
知识图谱解析可以抽取实体和关系,为多跳问题补充结构化连接。这些高级索引会增加解析时间、模型调用和存储,并可能放大错误摘要或错误实体,应该用评测数据确认收益后再开启。
6. 数据源连接与同步
除本地上传,RAGFlow可连接S3、Google Drive、Notion、Confluence、Discord、GitHub、GitLab、Bitbucket、Gmail、IMAP、Zendesk、RSS、Seafile、Airtable、Asana、Moodle、钉钉AI表格及通用REST API等数据源。
部分连接器支持增量同步和远端删除同步。
数据源连接器需要访问令牌或服务账户。应使用只读、最小范围权限,限制同步目录并确认删除传播规则。
远端文档更新后重新解析可能改变Chunk ID和引用,生产应用要安排索引窗口与回归测试。
7. AI Agent与可视化编排
Agent画布可以把知识库检索、模型、工具、代码执行、浏览器、文档生成、搜索和其他Agent组合成工作流。官方提供数据分析、投资研究、法律案例分析和制造维护等场景模板,也支持多Agent协作、自主规划和用户级长期记忆。
浏览器组件可以让AI导航并操作网页;Python与JavaScript执行器可生成图表和处理文件。
这类功能必须放入沙箱,限制网络、文件和执行时间。
模型自主操作网页或代码时,应在登录、支付、发送和删除等关键步骤要求人工确认。
8. MCP与工具
RAGFlow可在工作流中使用MCP服务,也能启动官方MCP服务器,把数据集检索、聊天等能力提供给支持MCP的客户端。新版还提供轻量的Python工具装饰器,帮助开发者注册函数。
MCP处于快速演进阶段,字段、鉴权和工具返回可能在版本间变化。接入生产Agent前应固定版本、测试错误处理并配置最小权限,不能把第三方MCP工具视为已经过官方安全审计。
9. REST API与SDK
开发者可使用REST API和官方Python SDK管理数据集、文档、Chunk、聊天助手、会话、Agent和检索。聊天完成接口兼容常见的流式调用方式,便于把RAGFlow接入网站、客服、内部系统和自动化任务。
API Key应只存放在服务端,并根据租户隔离资源、限制请求频率和记录审计。官方云免费版不提供API Key,Starter与Pro才包含API能力。
10. 多模型支持
平台可配置多家语言模型、Embedding、Rerank、语音、视觉和图片生成供应商,也能连接本地模型服务。自托管镜像自0.22版起不再内置Embedding模型,需要配置外部或本地模型端点。
云模型费用与RAGFlow软件费用分开计算。向量模型一旦更换,应重新生成索引;
本地大模型和OCR加速还需要额外GPU资源。
11. 多渠道发布
聊天、Agent和搜索页面可嵌入第三方网站,新版内嵌页面兼容移动端,并支持飞书、Discord、Telegram、Line等聊天渠道。发布前应配置身份、会话隔离、配额、内容审核和引用下载权限。
云服务价格
RAGFlow官方云服务当前显示三档美元月付方案,页面同时展示划线原价,以下采用当前优惠价:
| 套餐或版本 | 价格、额度与核心权益 |
|---|---|
| Free | 0美元/月,5个App、1名团队成员、0.1GB数据集存储、每月500 Credits,不提供API Key; |
| Starter | 29美元/月,50个App、5名成员、5GB数据集存储、每月5000 Credits,提供API Key;页面原价为59美元/月; |
| Pro | 129美元/月,App数量不限、20名成员、50GB数据集存储、每月20000 Credits,提供API Key;页面原价为259美元/月。 |
Credits的具体消耗与模型、解析和运行任务有关,套餐价格、优惠和资源限制可能调整,应以结算页为准。大型企业的更高容量、私有部署支持和SLA需联系官方或服务商确认。
自托管与硬件要求
RAGFlow可以通过Docker Compose私有部署。官方最低要求为4核CPU、16GB内存、50GB磁盘、Docker 24.0或更高、Docker Compose 2.26.1或更高,源码开发要求Python 3.13或更高。
使用代码执行沙箱时还需要gVisor。
官方预构建镜像当前面向x86平台,不直接提供ARM64镜像,ARM64用户需要自行构建。0.22版以后仅发布约2GB的精简镜像,不包含Embedding模型;
镜像解压运行后约占7GB,文档、索引、日志和数据库会继续增加磁盘使用。
默认依赖通常包括MySQL、MinIO、Redis以及Elasticsearch或Infinity。Elasticsearch要求主机的虚拟内存映射数量至少为262144。
生产环境还需HTTPS、持久化卷、数据库和对象存储备份、监控、密钥轮换与升级回滚。
GitHub与开源许可
RAGFlow源代码托管在InfiniFlow官方GitHub组织,采用Apache License 2.0,允许在许可证与NOTICE等条件下使用、修改、分发和商用。官方Python SDK同样采用Apache 2.0。
截至本次核验,官方文档和默认Docker配置使用稳定版0.26.4。项目仍在0.x阶段且更新频繁,API、数据库与连接器可能变化;
部署时应固定镜像和代码为同一版本,并阅读升级脚本与发行说明。
数据安全与运维
私有部署可以把文件、索引和会话保留在自己的环境,但若使用外部LLM、Embedding、Rerank、OCR或搜索服务,相应文本和片段仍会传给第三方。敏感文档应核对供应商的数据保留、训练与地区条款,必要时全部使用本地模型。
代码执行、浏览器、连接器和MCP扩大了攻击面。应启用沙箱、最小权限、网络白名单、文件大小和类型限制、防提示词注入、日志脱敏及补丁管理。
配置文件中的数据库和对象存储默认密码必须修改。
RAGFlow使用教程
完成一次基础任务
- 注册RAGFlow并创建仅用于测试环境的API Key;
- 根据输入类型、上下文、质量、速度和价格选择模型;
- 先调用深度文档理解完成最小请求并检查返回结构;
- 再用模板化分块测试流式输出、参数和异常响应;
- 记录Tokens、调用次数、延迟、错误率和单次成本;
- 把密钥移入服务端密钥管理器后再接入正式应用;
建立可复用的专业工作流
- 为开发、测试和生产环境使用不同密钥与额度;
- 按深度文档理解、模板化分块和向量、BM25与混合检索建立代表性评测集;
- 设置超时、并发、重试、限流和预算上限;
- 对输出执行事实、安全、格式和敏感信息检查;
- 监控模型版本、价格、延迟和失败率变化;
- 准备降级模型、熔断和人工接管方案;
适合哪些用户?
- 需要解析财报、论文、合同、手册和扫描件的企业;
- 重视表格、图片和文档版面结构的RAG项目;
- 需要混合检索、重排、RAPTOR和知识图谱的研发团队;
- 希望连接大量云盘、协作平台和业务数据源的组织;
- 需要Agent工作流、代码、浏览器和MCP工具的开发者;
- 希望通过API或SDK把检索上下文接入现有产品的团队。
产品优势
- 复杂文档解析和可视化Chunk是核心特色;
- 向量、BM25、多路召回与重排组合完整;
- 引用可追溯,便于定位和人工修正知识片段;
- 支持RAPTOR、PageIndex和知识图谱等高级索引;
- 数据源连接器、Agent、MCP、API与SDK覆盖广;
- Apache 2.0许可对商业集成较友好;
- 同时提供官方云服务和完整私有部署方案。
限制与注意事项
- RAGFlow组件多、资源占用高,运维复杂度通常高于轻量知识库;
- 官方最低16GB内存仅适合起步,海量文档、高并发、OCR和本地模型需要更高规格与集群规划;
- 深度解析也不能保证所有文件正确;
- 上传后必须抽样检查文字、表格、图片、Chunk和引用;
- 高级索引会增加成本和等待时间;
- 0.x版本更新快,生产环境不应直接使用nightly镜像;
常见问题
RAGFlow免费吗?
自托管开源版免费,服务器和模型成本自理;官方云服务有0美元免费版,Starter为29美元/月,Pro为129美元/月。
RAGFlow支持中文吗?
支持中文界面、文档解析、检索和多种中文模型。实际OCR、分词与回答质量取决于解析器、Embedding、Rerank和LLM配置。
最低需要什么服务器?
官方最低为4核CPU、16GB内存和50GB磁盘;代码执行需gVisor,GPU不是启动必需,但可加速DeepDoc和本地模型。
支持ARM服务器吗?
官方当前预构建Docker镜像面向x86,不提供ARM64镜像;ARM用户需要按文档自行构建,部分Infinity组合也尚未正式支持。
RAGFlow提供API吗?
提供REST API、Python SDK和MCP服务器。官方云Free方案不提供API Key,Starter和Pro提供。
RAGFlow可以商用吗?
可以按Apache 2.0许可证使用、修改和分发,仍需保留许可证与相关声明,并单独遵守所接模型、数据和第三方组件的许可。
桂公网安备45132202000164号