Doctly AI 是什么
Doctly AI 是面向企业的文档解析、结构化数据提取和文档问答平台。它通过网页控制台与 API 接收 PDF、Office 文件和图片,再输出 Markdown、JSON、CSV 或 XML。
产品重点是把复杂版式、表格、表单、图表、手写和扫描资料转成机器可用数据。它适合财务、保险、医疗、法律、政府、物流和施工等高文档量流程。
主要功能概览
| 功能 | 输入 | 输出 | 适合任务 |
|---|---|---|---|
| 文档转换 | PDF、DOCX 和图片 | 清理后的 Markdown | RAG、搜索和内容迁移 |
| 结构化提取 | 发票、合同、表单与报告 | JSON、CSV 或 XML | 数据录入和系统同步 |
| 自定义 Extractor | 字段定义和业务文档 | 指定结构的数据 | 行业字段批量抽取 |
| 集合与问答 | 多个索引文档和问题 | 回答与页级引用 | 资料库检索和研究 |
| 文档聊天 | 集合、会话和消息 | 一次性或流式回答 | 应用内交互式查询 |
| 异步处理 | 文件、参数与回调 | 状态、下载结果与Webhook | 生产级批量工作流 |
支持的文件与内容
网页列出的文件格式包括 PDF、DOCX、PNG、JPG、TIFF 和 XLSX。平台也强调可处理扫描图像、照片、复杂布局、表格、表单、手写、图表和插图。
- PDF:合同、财报、保单、病历、报告和施工资料。
- DOCX:办公文档、说明书和模板化报告。
- 图片:扫描件、手机照片、票据和手写表单。
- XLSX:表格型业务资料,实际解析边界需用样本测试。
- 复杂页面:多栏、嵌套表格、页眉页脚和图文混排。
API 的错误说明显示单个上传文件上限为 100MB。超大文件、密码保护文档、低清扫描、旋转页面和复杂公式应在正式接入前测试。
文档转 Markdown
转换接口把 PDF、DOCX 和图片变成清洁的 Markdown,便于进入搜索、知识库、RAG 或内容管理系统。处理是异步的,上传后会经历排队、处理中和完成等状态。
- 创建账户并生成专用 API key。
- 提交文件并选择适合的准确度或解析参数。
- 保存文档标识,轮询状态或配置完成回调。
- 下载 Markdown 或结构化结果。
- 检查页序、标题、表格、注释和缺失内容。
- 将确认后的结果写入业务系统,并删除不再需要的原文件。
转换成功不等于版式语义完全保留。合并单元格、图注、跨页表格和手写字符尤其需要人工抽查。
结构化数据提取
Extractor 用于从文档中抽取指定字段,并维持字段之间的关系。团队可以为发票、索赔、合同、病例、物流单据或施工文件定义所需结构。
- 明确字段名称、类型、是否必填和允许的空值。
- 为日期、金额、货币和编号设置格式规则。
- 保留页码、原文片段或置信信息供复核。
- 为多表格、多实体和重复项目设计数组结构。
- 把校验失败和模型拒绝的页面送入人工队列。
条款明确输出可能错误、不完整或出现幻觉。财务记账、医疗处理和法律提交必须建立人工复核与业务规则校验。
集合问答与文档聊天
开发者可以创建 Collection,上传文件进行索引,再通过一次性 Query 或会话聊天提出问题。回答可提供页级引用,帮助调用方回到对应文档位置核验。
- 按客户、案件、项目或权限边界拆分集合。
- 为索引文件设置版本和更新时间。
- 问题中明确时间、主体、文档和所需字段。
- 显示引用页,并允许用户打开原文复核。
- 删除过期资料,避免旧版本参与回答。
集合问答适合检索和辅助阅读,不应替代正式审查。页级引用只能证明系统关联了某页,不能保证回答对该页的理解正确。
API 接入
Doctly API 以 Bearer token 认证,响应为 JSON。主要接口覆盖文档、Extractor、Collection、文件、一次性问答、聊天会话与消息历史。
| 接口组 | 主要操作 | 典型用途 |
|---|---|---|
| Documents | 上传、列表、详情、下载、删除 | 文档转换流水线 |
| Extractors | 列表、运行、更新和删除 | 字段提取模板管理 |
| Collections | 创建、更新、删除和文件管理 | 文档资料库 |
| Query | 对集合单次提问 | 无状态问答 |
| Chat | 会话、消息、流式回复与删除 | 连续对话界面 |
| Webhook | 处理完成通知 | 异步业务编排 |
Webhook 投递失败时最多重试 3 次,每次间隔 5 秒。接收端仍应校验签名或可信条件、实现幂等,并处理通知丢失后主动查询状态。
错误与限速
- 文件超过 100MB 会返回负载过大错误。
- 缺失或无效密钥会返回未授权错误。
- 验证失败会给出字段级错误详情。
- 超过套餐限速会返回请求过多错误。
- 客户端应使用指数退避,不要无限立即重试。
- 保存 request ID,便于向支持团队排查。
Python SDK
Doctly 提供可通过 pip 安装的 Python 客户端,主要封装 PDF 上传、异步轮询和 Markdown 结果读取。SDK 支持 LITE 与 ULTRA 准确度选项,并提供 DoctlyError 异常类型。
该 SDK 采用 MIT 许可证并接受贡献,但功能范围可能落后于完整 API。新的 Extractor、Collection 和 Chat 接口应以当前开发文档为准。
页面计量与用量计算
| 输入类型 | 计量方式 | 注意事项 |
|---|---|---|
| 每个实际页面计1页 | 空白或封面也可能计入处理 | |
| 图片 | 每个图片文件计1页 | 多张图片分别计费 |
| DOCX | 每3000个字符计1页 | 不同语言与隐藏文本会影响字符数 |
| Professional 超额 | 每页0.02美元 | 达到25000页后继续计费 |
用量达到额度 80% 时平台会通知,并可配置自动加量。生产环境应另外设置内部预算、单任务上限和异常页数告警。
价格与套餐
| 套餐或版本 | 价格 | 计费周期 | 核心权益或额度 | 适合用户 |
|---|---|---|---|---|
| Flexible | 0.02美元/页 | 按量付费,无月度承诺 | 全部格式、Markdown/JSON/CSV、API、1席、99% SLA | 试验和波动用量 |
| Professional | 499美元/月 | 月付,年付可优惠 | 每月25000页、超额0.02美元/页、5席、自定义提取器、Webhook、ZDR选项 | 持续批量处理团队 |
| Enterprise | 定制报价 | 按量和合同约定 | 自定义页量、专用基础设施、SSO、自托管、99.9%+ SLA | 大型与受监管组织 |
所有套餐都提供无需信用卡的试用,Enterprise 可用实际文档进行概念验证。年付页面标注 10% 优惠,但需要联系销售确认具体合同金额。
Flexible 的每页单价看似较低,但不包含月度预付额度。实际成本还应计入失败重试、重复处理、超大文档、人工复核和存储集成。
升级、降级与退款
套餐可以随时升级或降级,升级立即获得新功能,降级从下一计费周期开始。订阅费用预付并自动周期结算,条款规定除法律要求外通常不退款。
平台可提前至少 30 天通知涨价。取消后 API 访问立即停止,账户历史中的余留数据按删除周期永久清除,最长不超过 30 天。
数据保留与零保留
| 套餐 | 默认或可选策略 | 说明 |
|---|---|---|
| Flexible | 最长30天 | 用于历史记录和调试,可主动删除 |
| Professional | 可选ZDR | 价格表标注24小时删除窗口 |
| Enterprise | 可选ZDR或完全定制 | 可结合私有云或本地部署 |
首页的“文档从不存储”是对零保留能力的概括,隐私与套餐页则明确保留策略因计划而异。对敏感数据应以账户配置、DPA、BAA 或企业合同中的书面条款为准。
安全、隐私与合规
平台声明使用 TLS 1.2 以上版本保护传输,使用 AES-256 保护静态数据,并通过 SOC 2 Type II 审计。所有套餐都承诺输入和输出不会用于训练或微调 Doctly 与第三方基础模型。
- AI 处理商包括 OpenAI、Google、Anthropic 及其他零训练协议服务商。
- 支付由 Stripe 处理,平台只保留卡号后四位、到期日和账单地址等有限信息。
- Professional 和 Enterprise 可申请 DPA 与 HIPAA BAA。
- 未签有效 BAA 前禁止上传受保护健康信息。
- 个人数据可能跨境处理,特定地区要求需事先联系确认。
- 用户可请求访问、更正、删除、限制、移植或撤回同意。
- 所有用户均可通过 API 或控制台删除文档。
HIPAA Ready、BAA 可用和已签署 BAA 是不同状态。医疗组织必须先完成合格套餐、合同、权限、审计和保留配置,再上传受保护数据。
数据所有权、版权与限制
用户保留输入文档的权利,条款将提取和结构化输出的权利转让给用户。Doctly 保留平台、API、代码和底层技术的知识产权。
- 不得用服务或输出创建训练神经网络与机器学习模型的数据集。
- 不得构建竞争产品或逆向工程平台。
- 不得超过套餐速率和额度。
- 用户负责确认上传文档具有必要权利。
- 输出必须人工验证,不能直接视为医疗、法律或财务建议。
平台、部署与开源状态
| 项目 | 当前状态 | 说明 |
|---|---|---|
| 网页控制台 | 已提供 | 账户、文件和配置管理 |
| REST API | 已提供 | 文档、提取、集合与聊天 |
| Webhook | 已提供 | Professional 及相应企业方案 |
| Python SDK | 开源 | MIT许可证,偏重PDF转Markdown |
| Doctly SaaS 平台 | 闭源 | SDK开源不代表平台源码开放 |
| 私有云或本地部署 | Enterprise 可选 | 商业部署方式,不等于开源 |
| 原生移动或桌面应用 | 暂未确认 | 当前以API和网页为主 |
典型应用场景
- 财务:从发票、对账单和财报中抽取金额与项目。
- 保险:处理保单、索赔资料和附件。
- 医疗:在有效 BAA 和合规配置下结构化病历与表单。
- 法律:提取合同条款、当事方、日期和义务。
- 物流:读取提单、装箱单、收据和运输单据。
- 施工:整理图纸说明、检验报告和项目表格。
- 知识系统:把文档转为 Markdown,建立带页级引用的问答集合。
优势与能力边界
主要优势
- 同时提供转换、结构化提取和集合问答。
- 支持复杂布局、表格、扫描件和手写内容。
- API 覆盖完整,支持异步状态与 Webhook。
- 所有套餐均有不用于模型训练的书面承诺。
- 提供 SOC 2、BAA、ZDR、SSO 和私有部署路径。
- Python SDK 采用宽松 MIT 许可证。
主要限制
- AI 输出仍可能错误、不完整或产生幻觉。
- Professional 起价较高,低量用户需仔细比较按量成本。
- 首页与隐私页对“零保留”的表述需要结合套餐理解。
- 医疗数据必须先签 BAA,不能只看 HIPAA 宣传标识。
- 开源 SDK 仅覆盖部分使用路径,完整平台闭源。
- 复杂文档的准确度和成本必须用真实样本验证。
常见问题
Doctly AI 可以处理哪些文件?
公开页面列出 PDF、DOCX、PNG、JPG、TIFF 和 XLSX,并强调扫描件、照片、表格、表单、图表与手写内容。
能输出哪些格式?
常见输出包括 Markdown、JSON、CSV 和 XML。结构化字段由 Extractor 定义。
Flexible 是否有月费?
没有月度承诺,按每页 0.02 美元计费。仍需关注重复处理、失败重试和附加流程成本。
Professional 包含多少页?
每月包含 25000 页,超额部分按每页 0.02 美元计费。页的定义随 PDF、图片和 DOCX 不同。
文档会被用于训练模型吗?
平台对所有客户和套餐承诺不会用输入或输出训练、微调或改进自身及第三方基础模型。
Doctly 是零数据保留吗?
不能一概而论。Flexible 最长可保留 30 天,Professional 和 Enterprise 提供 ZDR 选项,实际策略取决于配置与合同。
可以处理医疗数据吗?
只有 Professional 或 Enterprise 且已签署有效 BAA 后,才可上传受保护健康信息。
有公开 API 吗?
有,覆盖文档、Extractor、Collection、查询和聊天。所有请求使用 API key,并受套餐限速。
Python SDK 是开源的吗?
是,正式 Python SDK 使用 MIT 许可证。Doctly 云平台本身仍是闭源商业服务。
能部署到自己的环境吗?
Enterprise 提供自有基础设施、私有云或本地部署选项,具体架构、维护责任和价格需联系销售。
输出需要人工检查吗?
需要。条款明确大模型输出可能错误、不完整或出现幻觉,重要业务必须建立人工复核。
总结
Doctly AI 适合需要把复杂文档稳定接入自动化流程,并同时要求结构化提取、API、合规和部署选择的团队。上线前应以真实样本验证准确度与页量成本,并把人工复核、数据保留和密钥治理纳入设计。
桂公网安备45132202000164号