Doctly AI
免费增值
AI办公工具 AI文档工具

Doctly AI

Doctly AI,让AI文档处理工作更高效、更简单

标签:

Doctly AI 是什么

Doctly AI 是面向企业的文档解析、结构化数据提取和文档问答平台。它通过网页控制台与 API 接收 PDF、Office 文件和图片,再输出 Markdown、JSON、CSV 或 XML。

产品重点是把复杂版式、表格、表单、图表、手写和扫描资料转成机器可用数据。它适合财务、保险、医疗、法律、政府、物流和施工等高文档量流程。

主要功能概览

功能输入输出适合任务
文档转换PDF、DOCX 和图片清理后的 MarkdownRAG、搜索和内容迁移
结构化提取发票、合同、表单与报告JSON、CSV 或 XML数据录入和系统同步
自定义 Extractor字段定义和业务文档指定结构的数据行业字段批量抽取
集合与问答多个索引文档和问题回答与页级引用资料库检索和研究
文档聊天集合、会话和消息一次性或流式回答应用内交互式查询
异步处理文件、参数与回调状态、下载结果与Webhook生产级批量工作流

支持的文件与内容

网页列出的文件格式包括 PDF、DOCX、PNG、JPG、TIFF 和 XLSX。平台也强调可处理扫描图像、照片、复杂布局、表格、表单、手写、图表和插图。

  • PDF:合同、财报、保单、病历、报告和施工资料。
  • DOCX:办公文档、说明书和模板化报告。
  • 图片:扫描件、手机照片、票据和手写表单。
  • XLSX:表格型业务资料,实际解析边界需用样本测试。
  • 复杂页面:多栏、嵌套表格、页眉页脚和图文混排。

API 的错误说明显示单个上传文件上限为 100MB。超大文件、密码保护文档、低清扫描、旋转页面和复杂公式应在正式接入前测试。

文档转 Markdown

转换接口把 PDF、DOCX 和图片变成清洁的 Markdown,便于进入搜索、知识库、RAG 或内容管理系统。处理是异步的,上传后会经历排队、处理中和完成等状态。

  1. 创建账户并生成专用 API key。
  2. 提交文件并选择适合的准确度或解析参数。
  3. 保存文档标识,轮询状态或配置完成回调。
  4. 下载 Markdown 或结构化结果。
  5. 检查页序、标题、表格、注释和缺失内容。
  6. 将确认后的结果写入业务系统,并删除不再需要的原文件。

转换成功不等于版式语义完全保留。合并单元格、图注、跨页表格和手写字符尤其需要人工抽查。

结构化数据提取

Extractor 用于从文档中抽取指定字段,并维持字段之间的关系。团队可以为发票、索赔、合同、病例、物流单据或施工文件定义所需结构。

  • 明确字段名称、类型、是否必填和允许的空值。
  • 为日期、金额、货币和编号设置格式规则。
  • 保留页码、原文片段或置信信息供复核。
  • 为多表格、多实体和重复项目设计数组结构。
  • 把校验失败和模型拒绝的页面送入人工队列。

条款明确输出可能错误、不完整或出现幻觉。财务记账、医疗处理和法律提交必须建立人工复核与业务规则校验。

集合问答与文档聊天

开发者可以创建 Collection,上传文件进行索引,再通过一次性 Query 或会话聊天提出问题。回答可提供页级引用,帮助调用方回到对应文档位置核验。

  • 按客户、案件、项目或权限边界拆分集合。
  • 为索引文件设置版本和更新时间。
  • 问题中明确时间、主体、文档和所需字段。
  • 显示引用页,并允许用户打开原文复核。
  • 删除过期资料,避免旧版本参与回答。

集合问答适合检索和辅助阅读,不应替代正式审查。页级引用只能证明系统关联了某页,不能保证回答对该页的理解正确。

API 接入

Doctly API 以 Bearer token 认证,响应为 JSON。主要接口覆盖文档、Extractor、Collection、文件、一次性问答、聊天会话与消息历史。

接口组主要操作典型用途
Documents上传、列表、详情、下载、删除文档转换流水线
Extractors列表、运行、更新和删除字段提取模板管理
Collections创建、更新、删除和文件管理文档资料库
Query对集合单次提问无状态问答
Chat会话、消息、流式回复与删除连续对话界面
Webhook处理完成通知异步业务编排

Webhook 投递失败时最多重试 3 次,每次间隔 5 秒。接收端仍应校验签名或可信条件、实现幂等,并处理通知丢失后主动查询状态。

错误与限速

  • 文件超过 100MB 会返回负载过大错误。
  • 缺失或无效密钥会返回未授权错误。
  • 验证失败会给出字段级错误详情。
  • 超过套餐限速会返回请求过多错误。
  • 客户端应使用指数退避,不要无限立即重试。
  • 保存 request ID,便于向支持团队排查。

Python SDK

Doctly 提供可通过 pip 安装的 Python 客户端,主要封装 PDF 上传、异步轮询和 Markdown 结果读取。SDK 支持 LITE 与 ULTRA 准确度选项,并提供 DoctlyError 异常类型。

该 SDK 采用 MIT 许可证并接受贡献,但功能范围可能落后于完整 API。新的 Extractor、Collection 和 Chat 接口应以当前开发文档为准。

页面计量与用量计算

输入类型计量方式注意事项
PDF每个实际页面计1页空白或封面也可能计入处理
图片每个图片文件计1页多张图片分别计费
DOCX每3000个字符计1页不同语言与隐藏文本会影响字符数
Professional 超额每页0.02美元达到25000页后继续计费

用量达到额度 80% 时平台会通知,并可配置自动加量。生产环境应另外设置内部预算、单任务上限和异常页数告警。

价格与套餐

套餐或版本价格计费周期核心权益或额度适合用户
Flexible0.02美元/页按量付费,无月度承诺全部格式、Markdown/JSON/CSV、API、1席、99% SLA试验和波动用量
Professional499美元/月月付,年付可优惠每月25000页、超额0.02美元/页、5席、自定义提取器、Webhook、ZDR选项持续批量处理团队
Enterprise定制报价按量和合同约定自定义页量、专用基础设施、SSO、自托管、99.9%+ SLA大型与受监管组织

所有套餐都提供无需信用卡的试用,Enterprise 可用实际文档进行概念验证。年付页面标注 10% 优惠,但需要联系销售确认具体合同金额。

Flexible 的每页单价看似较低,但不包含月度预付额度。实际成本还应计入失败重试、重复处理、超大文档、人工复核和存储集成。

升级、降级与退款

套餐可以随时升级或降级,升级立即获得新功能,降级从下一计费周期开始。订阅费用预付并自动周期结算,条款规定除法律要求外通常不退款。

平台可提前至少 30 天通知涨价。取消后 API 访问立即停止,账户历史中的余留数据按删除周期永久清除,最长不超过 30 天。

数据保留与零保留

套餐默认或可选策略说明
Flexible最长30天用于历史记录和调试,可主动删除
Professional可选ZDR价格表标注24小时删除窗口
Enterprise可选ZDR或完全定制可结合私有云或本地部署

首页的“文档从不存储”是对零保留能力的概括,隐私与套餐页则明确保留策略因计划而异。对敏感数据应以账户配置、DPA、BAA 或企业合同中的书面条款为准。

安全、隐私与合规

平台声明使用 TLS 1.2 以上版本保护传输,使用 AES-256 保护静态数据,并通过 SOC 2 Type II 审计。所有套餐都承诺输入和输出不会用于训练或微调 Doctly 与第三方基础模型。

  • AI 处理商包括 OpenAI、Google、Anthropic 及其他零训练协议服务商。
  • 支付由 Stripe 处理,平台只保留卡号后四位、到期日和账单地址等有限信息。
  • Professional 和 Enterprise 可申请 DPA 与 HIPAA BAA。
  • 未签有效 BAA 前禁止上传受保护健康信息。
  • 个人数据可能跨境处理,特定地区要求需事先联系确认。
  • 用户可请求访问、更正、删除、限制、移植或撤回同意。
  • 所有用户均可通过 API 或控制台删除文档。

HIPAA Ready、BAA 可用和已签署 BAA 是不同状态。医疗组织必须先完成合格套餐、合同、权限、审计和保留配置,再上传受保护数据。

数据所有权、版权与限制

用户保留输入文档的权利,条款将提取和结构化输出的权利转让给用户。Doctly 保留平台、API、代码和底层技术的知识产权。

  • 不得用服务或输出创建训练神经网络与机器学习模型的数据集。
  • 不得构建竞争产品或逆向工程平台。
  • 不得超过套餐速率和额度。
  • 用户负责确认上传文档具有必要权利。
  • 输出必须人工验证,不能直接视为医疗、法律或财务建议。

平台、部署与开源状态

项目当前状态说明
网页控制台已提供账户、文件和配置管理
REST API已提供文档、提取、集合与聊天
Webhook已提供Professional 及相应企业方案
Python SDK开源MIT许可证,偏重PDF转Markdown
Doctly SaaS 平台闭源SDK开源不代表平台源码开放
私有云或本地部署Enterprise 可选商业部署方式,不等于开源
原生移动或桌面应用暂未确认当前以API和网页为主

典型应用场景

  • 财务:从发票、对账单和财报中抽取金额与项目。
  • 保险:处理保单、索赔资料和附件。
  • 医疗:在有效 BAA 和合规配置下结构化病历与表单。
  • 法律:提取合同条款、当事方、日期和义务。
  • 物流:读取提单、装箱单、收据和运输单据。
  • 施工:整理图纸说明、检验报告和项目表格。
  • 知识系统:把文档转为 Markdown,建立带页级引用的问答集合。

优势与能力边界

主要优势

  • 同时提供转换、结构化提取和集合问答。
  • 支持复杂布局、表格、扫描件和手写内容。
  • API 覆盖完整,支持异步状态与 Webhook。
  • 所有套餐均有不用于模型训练的书面承诺。
  • 提供 SOC 2、BAA、ZDR、SSO 和私有部署路径。
  • Python SDK 采用宽松 MIT 许可证。

主要限制

  • AI 输出仍可能错误、不完整或产生幻觉。
  • Professional 起价较高,低量用户需仔细比较按量成本。
  • 首页与隐私页对“零保留”的表述需要结合套餐理解。
  • 医疗数据必须先签 BAA,不能只看 HIPAA 宣传标识。
  • 开源 SDK 仅覆盖部分使用路径,完整平台闭源。
  • 复杂文档的准确度和成本必须用真实样本验证。

常见问题

Doctly AI 可以处理哪些文件?

公开页面列出 PDF、DOCX、PNG、JPG、TIFF 和 XLSX,并强调扫描件、照片、表格、表单、图表与手写内容。

能输出哪些格式?

常见输出包括 Markdown、JSON、CSV 和 XML。结构化字段由 Extractor 定义。

Flexible 是否有月费?

没有月度承诺,按每页 0.02 美元计费。仍需关注重复处理、失败重试和附加流程成本。

Professional 包含多少页?

每月包含 25000 页,超额部分按每页 0.02 美元计费。页的定义随 PDF、图片和 DOCX 不同。

文档会被用于训练模型吗?

平台对所有客户和套餐承诺不会用输入或输出训练、微调或改进自身及第三方基础模型。

Doctly 是零数据保留吗?

不能一概而论。Flexible 最长可保留 30 天,Professional 和 Enterprise 提供 ZDR 选项,实际策略取决于配置与合同。

可以处理医疗数据吗?

只有 Professional 或 Enterprise 且已签署有效 BAA 后,才可上传受保护健康信息。

有公开 API 吗?

有,覆盖文档、Extractor、Collection、查询和聊天。所有请求使用 API key,并受套餐限速。

Python SDK 是开源的吗?

是,正式 Python SDK 使用 MIT 许可证。Doctly 云平台本身仍是闭源商业服务。

能部署到自己的环境吗?

Enterprise 提供自有基础设施、私有云或本地部署选项,具体架构、维护责任和价格需联系销售。

输出需要人工检查吗?

需要。条款明确大模型输出可能错误、不完整或出现幻觉,重要业务必须建立人工复核。

总结

Doctly AI 适合需要把复杂文档稳定接入自动化流程,并同时要求结构化提取、API、合规和部署选择的团队。上线前应以真实样本验证准确度与页量成本,并把人工复核、数据保留和密钥治理纳入设计。

©️版权声明:若无特殊声明,本站所有文章版权均归AI工具分享原创和所有,未经许可,任何个人、媒体、网站、团体不得转载、抄袭或以其他方式复制发表本站内容,或在非我站所属的服务器上建立镜像。否则,我站将依法保留追究相关法律责任的权利。

类似于Doctly AI的工具