火山方舟是什么?
火山方舟是火山引擎提供的一站式大模型服务与开发平台,面向企业和开发者提供模型体验、API调用、评测、精调、推理部署和应用增强能力。平台以豆包模型为核心,同时接入业界主流模型,覆盖文本生成、深度思考、视觉理解、语音、图片、视频、3D和向量化等任务。
它不是面向普通用户聊天的豆包App,也不是单一模型。开发者在方舟控制台选择模型、创建API Key或推理接入点,再通过SDK、HTTP API、CLI或应用组件集成到自己的客服、内容生产、搜索、办公和Agent系统。
核心功能
1. 模型广场与体验中心
模型广场用于查看豆包系列及其他供应商模型的能力、上下文、输入类型、工具调用和价格。体验中心可以在控制台中直接测试提示词、文本与多模态输入,比较模型输出后再决定是否接入。
模型名称相近但版本、能力和计费可能不同。选型时应确认模型ID、发布日期、上下文长度、是否支持深度思考、视觉、函数调用和结构化输出,并关注模型下线公告。
2. Chat与Responses API
方舟提供对话Chat API和Responses API,支持流式与非流式输出、多轮消息、系统提示词、工具调用、推理参数和文件输入。接口风格与主流大模型API相近,便于接入Web应用、服务端和Agent框架。
API请求需要在服务端保存密钥,并通过IAM、项目和配额控制权限。前端网页或移动App不应直接内置长期API Key,否则容易被提取并产生盗刷费用。
3. 深度推理、文本与代码模型
豆包通用模型提供Pro、Lite、Mini等不同能力与成本档位,覆盖复杂推理、长文本、信息抽取、写作和Agent任务;Code模型针对代码理解、生成和Agentic Coding优化。
平台还提供Agent Plan与Coding Plan等订阅入口,适配CLI和编码工具。
模型榜单和演示不能替代业务评测。企业应使用自己的中文专业术语、长上下文、结构化输出、工具调用和安全样本测试,并分别记录准确率、延迟与单次成本。
4. 图片、视频、语音与3D生成
方舟提供图片生成与编辑、视频生成、语音相关模型及3D资产生成API。开发者可以提交文字、图片、首尾帧或其他条件,异步查询生成任务,并在完成后保存结果。
多媒体模型通常按图片、视频时长、Token、字符或具体规格计费,且分辨率、时长和是否包含视频输入会影响成本。生成内容还需审核版权、肖像、商标、声音授权和平台标识要求。
5. 视频与图片理解
视觉模型可以理解图片、视频和PDF中的文字、物体、场景、表格与关系,用于文档问答、质检、内容审核和视觉定位。File API可先上传并预处理较大的视频、图片或PDF,再在模型请求中引用。
视觉模型可能漏读小字、图例和关键帧,坐标定位也存在误差。医疗影像、工业缺陷和安全审核不能只依赖通用多模态模型,应使用专业数据和人工复核。
6. Embedding与向量化
文本与多模态向量模型可把文字、图片等内容编码为向量,用于语义搜索、推荐、聚类和RAG知识库。分词API可在调用前估算Token,帮助控制上下文与预算。
不同Embedding模型生成的向量空间不兼容,更换模型后需要重新构建索引。向量维度、批量大小、归一化和距离算法也要与向量数据库配置一致。
7. 模型评测
平台支持预置评测集与用户数据集,可以从模型广场、模型仓库、精调任务或机器学习平台服务发起评测。推理方式可选择在线推理或批量推理,评测结果用于比较模型和精调版本。
在线推理适合实时小规模任务,批量推理利用非高峰资源处理可容忍延迟的大数据集。评测应同时包含质量、事实性、安全、延迟、稳定性和费用,避免只用单一自动指标下结论。
8. SFT与DPO模型精调
火山方舟提供监督微调SFT和直接偏好优化DPO,用户上传符合格式的数据集,配置基础模型与训练参数后生成精调模型,并可部署为在线推理服务。适合固定输出格式、行业语言、角色风格和特定任务增强。
精调不等于注入实时知识,也不能替代RAG。训练数据需要去重、脱敏、授权和划分验证集;
错误或偏置样本会被模型学习。
训练、评测和部署资源分别可能产生费用。
9. Prompt优解
Prompt优解提供提示词生成、调优和管理能力,帮助把简短需求扩展为结构更完整的系统指令,并通过样例和评测迭代。团队可以保存Prompt版本,减少每个项目重复试错。
自动优化可能改变约束或增加冗余,正式上线前要检查角色、禁止项、输出JSON结构、边界情况和注入防护,并固定可回滚版本。
10. 知识库与RAG
知识库插件可从本地、对象存储、公开下载链接或飞书文档导入资料,支持PDF、DOC、DOCX、PPTX、Markdown、TXT、FAQ表格、JSONL、CSV和XLSX等格式。系统完成解析、切片、向量化和索引后,可在模型工具调用中搜索私域知识。
火山引擎知识库还支持语义与关键词混合检索、重排、标量过滤、切片修改、引用溯源和图文混排。检索片段会作为模型输入并额外消耗Token;
扫描件、表格和图片仍需抽样核对解析质量。
11. 联网搜索与图像处理插件
Web Search让模型获取当前网络信息,图像处理工具可辅助裁剪、识别或理解,豆包助手工具则封装常用能力。联网插件按内容源调用次数计费,并可能增加模型Token;
Pro服务还可能存在保底消费和扩容费用。
搜索结果可能过时、错误或受版权限制。应用应显示来源、时间并处理无结果和冲突信息,医疗、金融、法律场景不能将联网生成结果直接作为最终建议。
12. 函数调用与MCP
Function Calling允许模型按预定义Schema选择并填写业务函数参数,用于查询订单、调用数据库或执行操作。方舟还支持云部署MCP与Remote MCP,把外部工具接入Agent流程。
模型输出的函数参数不可信,服务端必须校验类型、范围、身份和权限。删除、付款、发送等高风险操作要二次确认,MCP服务应限制网络与密钥访问并防范提示词注入。
13. 批量推理与上下文缓存
批量推理适合数据标注、离线摘要、评测和内容处理,通过异步任务提高吞吐并降低成本。上下文缓存可复用固定系统提示词、长文档或共同前缀,减少重复计算和输入费用。
缓存有有效期和命中规则,动态内容或用户敏感数据不应跨租户复用。批量任务需要处理失败重试、输出对齐、任务取消、数据保存周期和成本上限。
14. 稳定性与分账
平台提供用量统计、项目分账、限流管理、突发流量优化和自定义推理接入点。控制台可以按在线、体验和批量推理查看输入、输出与总Token,便于按业务核算成本。
生产应用应设置超时、指数退避、并发队列、熔断和备用模型,并监控TPM、RPM、错误率与余额。默认限流不等于业务峰值保障,需要提前压测和申请扩容。
价格与计费
| 套餐或版本 | 价格、额度与核心权益 |
|---|---|
| Pro | 2026新年活动页还曾展示豆包2.0资源包19元约800万Token、新客100元约4000万Token以及CodingPlanPro200元/月等活动,但部分商品已标注暂时不能购买,不能作为长期标准价。 |
| Lite | 该价格只代表页面所示模型,不适用于Lite、Mini、Code、视觉、旧版本或第三方模型。 |
火山方舟按具体模型和能力分别计费。文本模型通常区分输入与输出Token,图片、视频、语音、3D、Embedding、知识库、精调、批量和插件各有独立规则。
平台并不存在覆盖全部能力的单一固定月费。
截至本次核验,火山引擎官网首页展示的最新豆包旗舰模型参考价为输入6元/百万Token、输出30元/百万Token。该价格只代表页面所示模型,不适用于Lite、Mini、Code、视觉、旧版本或第三方模型。
2026新年活动页还曾展示豆包2.0资源包19元约800万Token、新客100元约4000万Token以及Coding Plan Pro 200元/月等活动,但部分商品已标注暂时不能购买,不能作为长期标准价。企业应以模型服务价格页、控制台开通页与订单为准。
插件、知识检索和多轮工具会增加额外Token与调用次数。使用前应估算一次完整业务链路,而不是只乘主模型单价;
预付资源包、免费额度、批量折扣、缓存折扣和节省计划也有有效期与适用模型限制。
SDK、CLI与GitHub
方舟提供Python、Java、Go及其他语言SDK、API Explorer和Ark CLI。Python运行时支持同步、异步与流式调用,通用火山引擎SDK还提供AK/SK、STS、角色、超时、重试和代理配置。
火山引擎在GitHub公开了Python、Java等SDK,以及AgentKit、VEADK等Agent开发套件,部分采用Apache 2.0许可。SDK开源不代表火山方舟平台、豆包模型权重和托管推理服务开源;
核心模型与云平台仍是专有商业服务。
数据安全与合规
方舟提供IAM项目权限、访问密钥、日志、配额和安全互信方案。某些自定义在线服务说明请求日志对模型提供方与平台均不可见,但具体数据处理方式仍取决于所选模型、产品协议和是否主动授权数据使用。
平台协议可能包含客户数据授权、服务地域和商业使用条件。企业上传训练集、知识库、视频和人脸前应核对个人信息、著作权、保密协议、数据出境及行业监管要求。
上线生成式AI应用还可能需要算法备案、内容标识和安全评估。
火山方舟使用教程
完成一次基础任务
- 注册火山方舟并创建仅用于测试环境的API Key;
- 根据输入类型、上下文、质量、速度和价格选择模型;
- 先调用模型广场与体验中心完成最小请求并检查返回结构;
- 再用Chat与Responses API测试流式输出、参数和异常响应;
- 记录Tokens、调用次数、延迟、错误率和单次成本;
- 把密钥移入服务端密钥管理器后再接入正式应用;
建立可复用的专业工作流
- 为开发、测试和生产环境使用不同密钥与额度;
- 按模型广场与体验中心、Chat与Responses API和深度推理、文本与代码模型建立代表性评测集;
- 设置超时、并发、重试、限流和预算上限;
- 对输出执行事实、安全、格式和敏感信息检查;
- 监控模型版本、价格、延迟和失败率变化;
- 准备降级模型、熔断和人工接管方案;
适合哪些用户?
- 需要调用豆包文本、推理、视觉和生成模型API的开发者;
- 希望在同一平台完成选型、评测、精调与推理的企业;
- 建设智能客服、企业搜索、内容生产与审核系统的团队;
- 需要知识库、联网搜索、函数与MCP增强Agent的应用;
- 需要批量推理、缓存、限流和分账控制成本的高并发业务;
- 需要国内云服务、合同与备案材料支持的组织。
产品优势
- 豆包系列与多类主流模型集中接入;
- 文本、视觉、图片、视频、语音、3D和向量API完整;
- 覆盖体验、评测、SFT/DPO精调、在线与批量推理;
- 提供知识库、联网、函数调用和MCP工具链;
- 上下文缓存、批量任务和多档模型便于优化成本;
- SDK、CLI、IAM、监控和企业合规配套较完善。
限制与注意事项
- 火山方舟功能多且计费项分散,模型、插件、知识库和媒体生成费用需要分别核算;
- 体验中心效果不代表生产SLA,免费额度和活动价格也可能过期;
- 模型会产生事实错误、偏见、格式失败或工具误调用;
- 企业必须建立评测、内容安全、人工复核、权限和回滚机制,并关注模型版本更新与下线公告;
常见问题
火山方舟和豆包一样吗?
不一样。豆包是模型与面向用户的应用品牌,火山方舟是企业和开发者调用豆包及其他模型、进行评测精调和部署的云平台。
火山方舟免费吗?
控制台可能提供体验或新用户额度,但正式API、精调、知识库和生成服务按量或资源包收费,具体以模型开通页为准。
火山方舟API多少钱?
不同模型价格不同。当前官网示例旗舰模型为输入6元、输出30元/百万Token;
Lite、Mini、视觉、视频和插件需查看各自价格。
支持OpenAI兼容接口吗?
方舟运行时的对话调用方式与主流Chat接口接近,并提供Chat、Responses和官方SDK;迁移时仍要核对Base URL、模型ID、参数和工具格式。
可以微调模型吗?
可以,支持SFT与DPO,并可评测和部署精调模型。训练数据、训练计算和在线服务可能分别收费。
火山方舟开源吗?
平台和豆包模型本身不开源;官方在GitHub公开了多语言SDK和部分Agent开发套件,不能把SDK许可证等同于模型或云服务许可证。
桂公网安备45132202000164号