ChatDOC是什么
ChatDOC 是一款面向 PDF 和其他文件的 AI 阅读、总结与问答工具。用户上传文档后,可以提问、提取信息、比较内容,并通过引用标记跳回原文位置。
产品不仅支持单个 PDF,还覆盖 Word、Markdown、ePub、TXT、扫描件、图片和部分网页内容。它适合提高阅读效率,但不能替代对原文、表格、公式和关键事实的人工核查。
核心功能
1. 文档总结与问答
ChatDOC 会解析文档结构并生成摘要、建议问题和针对性回答。用户可以要求它概括章节、定位条款、提取数字或解释专业概念。
2. 可追溯引用
回答会附带来源引用,点击或悬停可以查看对应原文、表格或图片。细粒度追踪还能从回答中的关键数字跳转到文档位置,降低核查成本。
3. 多文档与文件夹问答
Pro 用户可以上传文件夹,把多个文件组织到 Collection 中并跨文档提问。导出问答时,系统还能标明答案来自哪个具体文档。
4. 表格、公式与图片理解
产品支持选择文本、表格和公式进行提问,并可识别图片内容。复杂跨页表格、数学符号和低质量扫描件仍可能解析错误。
5. OCR扫描件识别
ChatDOC 可处理扫描 PDF 和图片型文档,最新更新日志已将 OCR 开放给所有用户。OCR 页数、语言和套餐额度仍应以账户页面为准。
6. 整篇文档翻译
产品提供 PDF 和 DOC 文件的整篇翻译功能,可将文档转换为其他语言。该功能仍标注为 Beta,版式、术语和表格翻译需要人工复核。
7. 自定义模型
用户可以使用自己的模型服务密钥,选择 OpenAI、OpenRouter、DeepSeek、SiliconFlow、阿里云等提供商的兼容模型。自带密钥会产生第三方模型费用和数据处理关系。
主要功能一览
- 总结整份文档、章节、论文和报告。
- 围绕文件提问并获得带原文引用的回答。
- 选中文本、表格、公式或图片进行定向分析。
- 跨多个文件搜索、比较和汇总信息。
- 识别扫描文档并提取可问答的文字内容。
- 定位合同条款、数字、日期、人物和关键结论。
- 将PDF或DOC整篇翻译为其他语言。
- 保存常用提示词并重复使用阅读工作流。
- 导出文档问答及对应来源文件信息。
- 通过API接入文档上传、问答和PDF结构化解析能力。
支持的文件与输入方式
| 输入类型 | 支持情况 | 注意事项 |
|---|---|---|
| 支持 | 免费与Pro页数、文件大小和上传数量不同 | |
| Word | 支持DOC与DOCX | Pro支持,单文件内容上限以实时页面为准 |
| Markdown、TXT、ePub | 支持 | 属于Pro扩展格式 |
| 扫描文件 | 支持OCR | 效果受分辨率、语言、旋转和版式影响 |
| 图片 | 支持分析 | 高级视觉模型或问题包可能另计 |
| 网页内容 | 支持部分白名单或可访问页面 | 单文件可达约30万Token,受页面权限影响 |
| 文件夹 | 支持 | 用于Collection和多文档问答 |
适合哪些用户
- 需要快速阅读论文、教材和研究报告的学生与研究者。
- 需要核对合同、案例和法规材料的法律从业者。
- 分析财报、招股书和行业报告的商业与投资人员。
- 查找产品手册、规范和技术文档的工程师。
- 需要对多份资料做对比和归纳的咨询人员。
- 整理出版物、事实和背景资料的编辑与内容团队。
- 希望把PDF解析和文档问答接入应用的开发者。
如何上传文档并开始问答
- 注册账号并确认当前套餐的上传、页数和大小限制。
- 删除文档中的密码保护,并确认拥有上传权限。
- 点击上传或把文件拖入页面,等待自动解析完成。
- 先查看系统摘要与文档结构,确认内容读取正常。
- 提出具体问题,并要求返回数字、条件和出处。
- 点击引用跳回原文,检查回答是否准确理解上下文。
- 对重要结论使用不同问法复核,并保留人工判断。
如何进行多文档对比
- 把同一项目或主题的文件放入独立文件夹。
- 创建Collection并上传文件夹或逐个添加资料。
- 检查每份文件的解析状态和名称是否正确。
- 先询问各文档的核心观点,再提出跨文档比较问题。
- 要求答案标出来源文件、页码和引用内容。
- 对冲突数据返回原始文件检查口径与日期。
- 导出结果后再次核对引用,不把AI综合内容当作原文。
免费版与Pro额度
ChatDOC 的旧帮助页仍显示免费版每天2个文件、每文件20页,但较新的官方更新日志已把免费 PDF 提升到每个300页、每天5个文件,并把文件处理上限提升到最高200MB。不同入口的文档尚未完全同步,最终以账户实时页面为准。
| 项目 | 免费版 | Pro版 |
|---|---|---|
| 上传数量 | 最新日志为每天5个PDF;旧帮助页为每天2个且总计10个 | 每30天最多300个文件 |
| PDF页数 | 最新日志为每个300页 | PDF不设公开页数上限 |
| 文件大小 | 最新日志最高200MB | 最新日志最高200MB |
| 提问次数 | 受免费额度限制 | 每24小时最多300个问题 |
| 文件格式 | 主要为PDF及当前开放格式 | DOC、DOCX、Markdown、ePub、TXT、扫描件和网页 |
| 多文档问答 | 受文件和集合限制 | Collection内不限制文件数量并支持文件夹 |
| 公式与图片 | 基础能力视当前页面 | 公式识别、图片问答和高级模型能力 |
| OCR | 最新日志已免费开放 | 帮助页曾列每30天500页,实时额度为准 |
Pro价格与附加包
官方 FAQ 当前列出的自动续费参考价格为30天8.99美元、360天89.90美元;旧博客还显示过更高原价和活动价。由于支付渠道与活动会变化,购买前应在升级页面确认实际价格和续费方式。
| 方案或附加包 | 参考价格 | 有效期与说明 |
|---|---|---|
| Pro月度自动续费 | $8.99/30天 | 到期自动续费,可在订阅设置管理 |
| Pro年度自动续费 | $89.90/360天 | 实际结算价以购买页面为准 |
| 额外文件包 | $0.29/文件 | 购买后90天内有效 |
| 额外页面包 | $0.06/页 | 旧价格信息,购买页可能调整 |
| OCR页面包 | $0.10/页 | 旧价格信息;最新日志已开放免费OCR |
| 高级问题包 | 结算页实时价格 | 用于GPT-4o等增强回答,通常90天有效 |
支付方式包括 Visa、PayPal、支付宝,部分附加包还支持微信支付。Pro 续费、问题包和文件包属于不同额度,购买时需要分别确认。
模型选择与自带API Key
- 内置模型可用于摘要、建议问题和文档问答。
- 更新日志显示GPT-5 mini已成为可选内置模型。
- DeepSeek-R1支持推理过程展示和自定义服务商。
- OpenAI与OpenRouter可接入多种兼容模型。
- SiliconFlow和阿里云等提供商可用于指定模型。
- 自带密钥的费用由模型提供商另行收取。
- 不同模型的引用、图片、上下文和结构化输出能力不同。
- API Key只能安全保存在账户设置中,不能公开分享。
ChatDOC API与PDF Parser API
ChatDOC 提供开发者 API,可完成文件上传、文档问答、Collection 管理和结果获取。PDF Parser API 则专注将 PDF 转换为结构化 JSON 或 Markdown,并支持文档大纲与复杂表格提取。
| 开发能力 | 主要用途 | 当前情况 |
|---|---|---|
| Documents API | 上传文件、网页并读取处理状态 | 需要购买API套餐或相应权限 |
| Questions API | 针对文件发起问题并取得回答 | 支持异步任务与结果查询 |
| Collections API | 创建资料集合和跨文档工作流 | 官方Demo提供调用参考 |
| PDF Parser API | 提取大纲、表格和结构化内容 | 支持JSON与Markdown输出 |
| ChatDOC Studio API | 上传、解析、聊天、RAG与提取应用 | 官方Skills仓库提供多语言示例 |
API 价格和配额没有一个稳定的公开统一数字,应以开发者控制台为准。开发者还需处理文件权限、任务轮询、失败重试、数据删除和密钥安全。
引用为什么仍要人工核查
- 引用位置正确不等于AI对原文含义解释正确。
- 表格可能跨页、合并单元格或采用不同统计口径。
- 扫描件OCR会混淆数字、符号、姓名和专业术语。
- 文档中的否定、例外和脚注容易在摘要中被遗漏。
- 多文件回答可能把不同日期或版本的内容合并。
- 法律、医疗、财务和学术引用必须返回原文件确认。
产品优势
- 回答与原文引用结合,核查路径比普通聊天工具更清晰。
- 支持文本、表格、公式、图片和扫描件等复杂文档元素。
- Collection和文件夹功能适合跨文档搜索与比较。
- 支持多种内置模型和用户自己的模型服务密钥。
- 浏览器扩展可在Chrome和Edge中辅助阅读本地或在线PDF。
- 提供文档问答、PDF解析和Studio等开发接口。
- 官方GitHub提供API Demo、OCRFlux和开发Skills。
使用限制与注意事项
- 官方旧帮助页与最新日志的免费额度存在差异。
- AI可能产生错误总结、错误引用解释或遗漏重要条款。
- 复杂表格、公式、脚注和跨页结构仍可能解析失败。
- Pro不限PDF页数不代表没有文件大小、Token或公平使用限制。
- 高级模型问题包、文件包和会员额度需要分别购买和管理。
- 整篇翻译仍处于Beta,专业文件不宜直接交付。
- 自定义模型会把内容交给相应第三方提供商处理。
- 在线平台核心代码不开源,不能自行完整私有部署。
隐私与数据安全
ChatDOC 通过云端处理上传文档,并在隐私政策中说明会使用服务提供商、保存账户信息和处理用户请求。政策称个人信息通常不会在账户终止后保留超过12个月,但法律、税务和争议处理可能要求更长时间。
- 不要上传客户机密、未公开合同和包含身份信息的原始文件。
- 必须处理敏感资料时先脱敏并确认组织允许使用云端服务。
- 自带模型密钥前阅读第三方模型商的数据保留和训练政策。
- 共享文档或问答链接前检查访问权限和有效期。
- 定期删除不再使用的文件、Collection和API密钥。
- 浏览器扩展安装前查看读取网页和本地文件的权限。
- 高风险行业应要求合规、数据处理和安全方面的书面确认。
退款与订阅管理
- 符合条件的Pro购买可在7天内申请退款。
- 官方FAQ要求未使用Pro权益,并提供账号和支付凭证。
- 退款通常在审核后3至5个工作日处理。
- 开启自动续费后会提前收取下一周期费用。
- 不希望续费时应在头像下的Subscription页面取消。
- 文件包和问题包有独立有效期,通常不会随会员暂停。
官方GitHub与开源状态
ChatDOC 官方 GitHub 组织公开了 ChatDOC-API-Demo、API Reference、OCRFlux 和 ChatDOC Studio Skills 等项目。其中 OCRFlux 是 PDF 转 Markdown 工具,Demo 和 Skills 用于开发接入;它们不等于 ChatDOC 在线平台整体开源。
平台与开源状态
| 项目 | 当前情况 |
|---|---|
| 网页端 | 提供文档上传、阅读、问答、Collection和翻译 |
| 移动端 | 支持移动浏览器使用 |
| 浏览器扩展 | 支持Chrome和Edge |
| 开发者API | 提供ChatDOC API、PDF Parser API和Studio API |
| GitHub | 官方公开Demo、文档、OCRFlux和Skills仓库 |
| 是否整体开源 | 否,在线平台与核心服务不开源 |
基本信息
| 字段 | 内容 |
|---|---|
| 工具名称 | ChatDOC |
| 工具类型 | AI文档阅读、PDF问答与解析工具 |
| 支持内容 | PDF、Word、Markdown、ePub、TXT、扫描件、图片和网页 |
| 核心特色 | 细粒度引用、多文档问答、表格公式与OCR |
| 价格模式 | 免费版、Pro订阅和附加包 |
| Pro参考价格 | $8.99/30天或$89.90/360天 |
| 是否提供API | 是 |
| 是否开源 | 部分工具与Demo开源;平台不开源 |
推荐指数
4.5 / 5。ChatDOC 的引用定位、多文档问答和复杂PDF处理很适合专业阅读,API体系也较完整;但免费额度文档更新不同步、附加包较复杂,重要结论仍必须回到原文核查。
常见问题
ChatDOC可以免费使用吗?
可以。最新更新日志显示免费用户每天可上传5个PDF、每个最多300页,并支持最高200MB文件;账户实时显示应作为最终标准。
ChatDOC支持扫描PDF吗?
支持。最新日志已把OCR开放给所有用户,但页数、语言和质量限制仍需查看账户页面。
可以同时询问多个文件吗?
可以。Pro支持文件夹上传和Collection内多文档问答,并能在导出结果中标出来源文件。
ChatDOC回答可靠吗?
回答提供引用,比无来源问答更便于核验,但引用并不能保证解释正确。数字、公式、合同和专业结论仍要人工检查。
ChatDOC提供API吗?
提供。开发者可使用文档问答API、PDF Parser API和ChatDOC Studio相关接口,价格与额度以控制台为准。
ChatDOC开源吗?
在线平台不整体开源。官方GitHub公开了OCRFlux、API Demo、文档和Skills等辅助项目。
桂公网安备45132202000164号