一句话介绍
GooseAI是一项面向开发者的托管式NLP推理服务,可通过兼容行业标准的Completions接口调用多种开放语言模型,并按生成Token计费。
当前产品状态
截至2026年8月23日,GooseAI官网、注册页面、Playground、API Key控制台和价格页均可访问,未认证的模型接口会返回需要授权的状态。平台仍处于可注册和调用的在线状态。
当前官网继续主推GPT-Neo、GPT-J、Fairseq和GPT-NeoX等较早的生成模型,主要接口仍是传统文本Completions。它不是现代多模态聊天平台,也不要与同名的goose开源AI Agent混淆。
| 检查项目 | 当前结果 | 结论 |
|---|---|---|
| 官网 | 正常展示产品与模型价格 | 服务仍在运营 |
| 账户注册 | 认证页面可访问 | 可创建账户 |
| Playground | 页面可访问 | 可用于模型试验 |
| API Key控制台 | 页面可访问并要求登录 | 支持自助密钥 |
| API接口 | 未带密钥返回未授权 | 接口在线并受认证保护 |
| 模型更新 | 仍以早期开源文本模型为主 | 采购前先做质量测试 |
工具简介
GooseAI由CoreWeave与Anlatan联合推出,面向在产品中集成文本生成能力的开发者和创意技术团队。平台负责模型托管和推理基础设施,用户通过API提交提示词并接收续写结果。
其核心卖点是迁移成本较低:使用旧版OpenAI Python客户端的项目,可以保留大部分Completions调用方式,只替换密钥、接口基础地址和模型ID。实际兼容范围仍需通过测试确认。
主要功能
托管式文本生成
Completions接口根据用户提供的Prompt预测后续Token,可用于句子续写、文章草稿、故事生成、标题或结构化文本原型。它不是检索引擎,回答不会自动附带可核验依据。
多种开放语言模型
当前价格页按参数规模列出125M、1.3B、2.7B、6B、13B和20B档位,覆盖GPT-Neo、Fairseq、GPT-J与GPT-NeoX。不同模型的Tokenizer、连贯性、速度和成本并不相同。
Playground模型测试
网页Playground允许用户在接入代码前尝试模型与生成参数,比较同一提示词的输出差异。模型选择应基于真实业务样本,而不是只看参数量。
引擎列表与详情
Engines接口用于列出可调用模型,或查询单个引擎的名称、所有者、可用性和描述。生产环境应定期检查目标Engine是否仍可用。
单条或批量Prompt
Completions文档允许Prompt使用字符串、字符串数组、Token数组或Token数组集合,并可并发处理多个输入。批量输入会放大总生成量和费用,应设置严格上限。
多结果生成
请求可以通过数量参数为每个Prompt生成多个候选结果。候选数与Prompt数量相乘,实际计费和响应体积也会同步增加。
生成长度控制
用户可以设置最大和最小生成Token数,价格页写单次最多可扩展到2,048个生成Token。Prompt与输出仍受具体模型上下文长度限制。
采样与Token偏置
接口提供多种生成参数,用于控制随机性、候选分布、停止条件和特定Token倾向。GPT-NeoX与其他模型的Token ID并非完全通用,迁移偏置配置时需要重新验证。
预付费余额管理
API使用信用额结算,账户需要保持正余额。API Key的调用会直接消耗账户余额,因此必须采用服务器端密钥管理。
模型与价格总览
以下为2026年8月23日官网美元公开价格。每次请求的基础价包含前25个生成Token,超过部分再按每个输出Token计费,输入Token当前不单独收费。
| 参数档位 | 模型系列 | 基础价/请求 | 额外输出Token | 适合测试方向 |
|---|---|---|---|---|
| 125M | GPT-Neo、Fairseq | 0.000035美元 | 0.000001美元/Token | 低成本格式与流程验证 |
| 1.3B | GPT-Neo、Fairseq | 0.000110美元 | 0.000003美元/Token | 轻量续写和批量原型 |
| 2.7B | GPT-Neo、Fairseq | 0.000300美元 | 0.000008美元/Token | 中小型文本任务 |
| 6B | GPT-J、Fairseq | 0.000450美元 | 0.000012美元/Token | 较长内容与创意生成 |
| 13B | Fairseq | 0.001250美元 | 0.000036美元/Token | 需要更大模型的任务 |
| 20B | GPT-NeoX | 0.002650美元 | 0.000063美元/Token | 最高档开放模型试验 |
模型规模越大不代表每种任务都更准确,也可能增加延迟和成本。上线前应固定测试集,对输出质量、吞吐、错误率和单任务费用同时评估。
计费规则
| 项目 | 官方规则 | 实际影响 |
|---|---|---|
| 计费单位 | 基础请求价加额外生成Token | 短输出也会产生基础费用 |
| 基础包含量 | 前25个生成Token | 超过后按Token累加 |
| 输入Token | 当前不收费 | 长Prompt仍受上下文与性能限制 |
| 单次生成上限 | 价格页写最多2,048 Token | 应按模型上下文再次校验 |
| 付款方式 | 预购GooseAI Credits | 余额不足前需充值 |
| 信用额有效期 | 购买后12个月 | 未使用余额会到期 |
| 退款 | 信用额不可退款 | 先小额验证再充值 |
| 企业折扣 | 批量信用额联系销售 | 需要单独报价 |
信用额按先购先用顺序消耗,较早购买的余额会先扣除。平台费用和税费可能变化,企业采购应在合同中确认价格、有效期、服务范围和账单责任。
成本计算示例
| 示例 | 模型档位 | 生成长度 | 估算方式 | 未含项目 |
|---|---|---|---|---|
| 短续写 | 1.3B | 25 Token | 仅基础价0.000110美元 | 税费与失败重试 |
| 100 Token续写 | 1.3B | 100 Token | 基础价加75个额外Token | 并发候选与重试 |
| 100 Token续写 | 6B | 100 Token | 基础价加75个额外Token | 网络与应用成本 |
| 多候选生成 | 任意 | 每个Prompt生成多条 | 各候选生成量累加 | 后处理成本 |
| 批量Prompt | 任意 | 多个输入并发 | 每个请求与输出分别累计 | 限流与失败重放 |
估算时不能只看一次调用价格,还要统计平均输出长度、候选数量、重试率、无效结果和峰值并发。生产系统应记录每个业务动作的实际消耗。
API接入教程
创建并保护API Key
- 注册GooseAI账户并完成邮箱或账户验证。
- 进入Dashboard的API Key管理区域,创建单独的Secret Key。
- 把密钥保存到服务器端密钥管理或环境配置,不写进前端代码。
- 为开发、测试和生产环境分别创建密钥,避免共用。
- 先充值小额信用额,并设置内部余额与费用告警。
- 密钥泄露时立即撤销并更换,同时检查异常调用。
从旧版OpenAI客户端迁移
- 确认现有应用使用的是传统Completions和Engine调用,而不是新式聊天接口。
- 保留兼容的客户端库,并替换为GooseAI Secret Key。
- 把客户端基础地址改为GooseAI的第一版API地址。
- 通过Engines列表获取当前可用模型ID,不要凭文档手写旧ID。
- 选择一个模型,用固定Prompt执行最小请求。
- 核对响应结构、停止原因、Token数量、错误码和费用。
- 通过测试后再逐步切换流量,并保留回退配置。
设计一条Completions请求
- 准备简洁Prompt,明确输出格式、语气和结束条件。
- 指定Engine ID,并设置合理的最大生成Token数。
- 从较低随机性和单个候选开始建立可重复基线。
- 配置停止序列,避免模型继续生成无关段落。
- 记录请求ID、模型、参数、延迟、输出量和费用。
- 对输出进行安全过滤、格式校验和事实审查。
- 出现限流或服务错误时采用有上限的指数退避。
适合哪些用户
- 维护旧式Completions应用的开发团队:降低接口迁移工作量。
- 创意写作产品:测试开放模型的续写、故事和风格生成。
- 批量文本原型团队:用小模型验证格式和工作流。
- 模型评测人员:在统一托管环境比较不同参数规模。
- 教育与研究用户:观察GPT-Neo、GPT-J和GPT-NeoX行为。
- 成本敏感型项目:按输出Token控制短文本生成预算。
- 需要OpenAI旧版客户端兼容的后端开发者。
典型使用场景
- 为文章、故事或游戏文本生成后续段落与候选版本。
- 根据固定模板补全产品描述、摘要草案或标题。
- 对多个开放模型执行相同Prompt的质量与成本评测。
- 用125M或1.3B档位进行低成本接口和队列压测。
- 把旧版OpenAI Completions原型切换到另一托管推理商。
- 批量生成需要后续人工筛选的创意文本。
- 研究不同采样参数、Token偏置和停止条件。
产品优势
- 由平台管理GPU推理基础设施,无需自行部署模型。
- 兼容传统OpenAI客户端调用思路,迁移门槛相对低。
- 价格页公开基础请求价和额外输出Token单价。
- 只对生成Token计费,输入当前不单独收费。
- 提供从125M到20B的多个规模和模型系列。
- 网页Playground便于在编码前快速比较输出。
- 自助创建API Key,并提供企业批量信用额方案。
使用限制与注意事项
- 当前模型以早期开放文本模型为主,能力明显不同于新一代聊天模型。
- 服务重点是Completions,不应假设支持图像、音频、工具调用或现代Chat接口。
- 文档多数法律与隐私内容最后更新于2022年,可能滞后于当前实践。
- 官网宣称节省比例属于营销比较,实际成本取决于输出和重试。
- 输入虽不收费,但长Prompt仍影响上下文、延迟和模型表现。
- 多Prompt与多候选会快速放大生成Token和费用。
- 信用额12个月到期且不可退款,不宜一次预购过多。
- 模型可能产生虚构、偏见、有害内容或不符合格式的输出。
- 不同模型Tokenizer不同,Token偏置与长度估算不能直接复用。
- 没有公开现代SLA、数据驻留和最新安全认证摘要,企业需单独确认。
支持的接口与输出
| 能力 | 支持情况 | 说明 |
|---|---|---|
| Engine列表 | 支持 | 列出可用模型 |
| Engine详情 | 支持 | 查询单个模型状态与描述 |
| 文本Completions | 支持 | 根据Prompt生成续写 |
| 多个Prompt | 支持 | 可并发处理 |
| 多个候选 | 支持 | 每个Prompt生成多条 |
| 流式输出 | 旧版接口通常支持,需实测 | 以当前响应行为为准 |
| Chat Completions | 未在当前核心文档确认 | 不要按现代聊天接口假设 |
| Embeddings | 未在当前导航确认 | 不作为已支持能力 |
| 图像与音频 | 不支持 | 文本NLP推理服务 |
| 微调 | 未找到现行自助文档 | 需要联系官方确认 |
GitHub、SDK与开源情况
GooseAI拥有同名GitHub组织,但当前三个公开仓库都是其他项目的Fork,包括Go语言GPT-3客户端、KoboldAI和Transformers。它们不代表GooseAI平台后端源码已经开放。
官方文档主要推荐使用OpenAI旧版Python客户端并修改基础地址,没有提供独立GooseAI SDK。服务使用开放模型不等于托管平台本身开源。
| 项目 | 当前情况 | 开源判断 |
|---|---|---|
| GooseAI云平台 | 源码未公开 | 闭源托管服务 |
| 托管模型 | 来自多个开放模型项目 | 许可证按各模型分别判断 |
| 官方GitHub组织 | 有三个公开Fork | 不是平台核心源码 |
| 独立官方SDK | 未找到 | 使用兼容客户端或直接请求 |
| go-gpt3 Fork | MIT许可证 | 通用旧版客户端,不是平台源码 |
| KoboldAI Fork | AGPL-3.0许可证 | 不同应用项目 |
| Transformers Fork | Apache-2.0许可证 | 上游框架分支 |
隐私与数据处理
现行网站仍展示最后更新于2022年1月31日的隐私政策。政策覆盖账户信息、使用数据、Cookies、设备和第三方账户信息,并说明可能与服务商、分析提供商、业务受让方或法律机构共享。
政策明确表示其一般隐私说明不适用于客户通过服务处理的数据,企业用户需要额外审查DPA与合同。当前公开文档没有清晰承诺Prompt和生成结果的固定保存期限或不用于训练。
- 不要在Prompt中提交密码、密钥、身份证件或受监管数据。
- 企业接入前索取现行DPA、子处理方和数据保留说明。
- 确认数据跨境传输、删除、备份和执法请求处理方式。
- 在应用中向最终用户披露第三方模型服务的参与。
- 对Prompt和输出进行脱敏,并保留必要的访问审计。
- 未满18岁用户不应使用该服务。
条款与合规
服务条款最后修改日期同样为2022年1月31日,费用可以调整,付款由Stripe等处理。客户购买并消耗信用额,因违规、虚假账单信息或非法行为,信用额可能被撤销。
客户保有自己数据的责任,并授予GooseAI为提供服务所需的托管、存储、传输和格式化许可。条款限制逆向工程,适用法律与争议管辖指向纽约。
- 不得生成或传播违法、滥用、侵权和非自愿私密内容。
- 不得用服务侵犯版权、商标、隐私或公开权。
- 必须保护API Key并对其产生的全部费用负责。
- 面向用户提供生成内容时应建立投诉与删除流程。
- 企业采购应确认税费、责任限制、停服和余额处理。
- 上线前重新阅读最新条款,不只依赖2022年摘要。
基本信息
| 项目 | 内容 |
|---|---|
| 工具名称 | GooseAI |
| 运营主体 | GooseAI, Inc. |
| 联合推出方 | CoreWeave与Anlatan |
| 工具类型 | 托管式NLP和语言模型推理API |
| 主要模型 | GPT-Neo、GPT-J、Fairseq、GPT-NeoX |
| 核心接口 | Engines与文本Completions |
| 价格模式 | 预付信用额、按生成Token计费 |
| 输入计费 | 当前不收费 |
| 信用额有效期 | 12个月 |
| 退款 | 信用额不可退款 |
| Playground | 有 |
| 公共API | 有 |
| 独立官方SDK | 未找到 |
| 平台是否开源 | 否 |
| 信息核验日期 | 2026年8月23日 |
推荐指数
推荐指数:3.5 / 5。GooseAI的计价公开、接口简单,适合仍维护传统Completions应用或需要评测早期开放模型的开发者。
主要不足是模型与接口体系偏旧,政策文档更新时间较早,也缺少现代聊天、多模态和企业安全能力的清晰说明。新项目应先与更新的模型API进行质量和总成本比较。
常见问题
GooseAI是什么?
它是托管式语言模型推理服务,通过API提供开放模型的文本续写能力。主要面向开发者,而不是普通聊天用户。
GooseAI还在运营吗?
是。官网、注册、Playground、Dashboard和受认证保护的API目前仍在线。
GooseAI免费吗?
创建账户可以免费,但API按生成量消耗预购信用额。不能把免费注册理解为永久免费推理。
输入Token收费吗?
当前定价页写只按生成Token计费,输入不单独收费。长Prompt仍受上下文和性能限制。
基础价包含多少Token?
每次请求的基础价包含前25个生成Token,超出部分按照模型档位的额外Token单价计算。
信用额会过期吗?
会,购买后12个月到期,并按先购先用方式扣除。信用额不可退款。
支持哪些模型?
当前价格页列出GPT-Neo、Fairseq、GPT-J和GPT-NeoX,参数规模从125M到20B。实际可用Engine应通过API列表确认。
兼容OpenAI API吗?
兼容传统Engine与Completions调用思路,旧版客户端通常只需替换密钥、基础地址和模型ID。现代Chat接口不能直接假定兼容。
提供官方SDK吗?
没有找到独立GooseAI SDK。官方示例使用OpenAI旧版Python客户端,也可以直接发送接口请求。
GooseAI开源吗?
托管平台不开源。它服务的部分模型和GitHub Fork有各自许可证,但不代表云服务代码开放。
它与goose AI Agent是什么关系?
没有关系。后者是另一套开源AI代理项目,产品定位、团队、域名和代码均不同。
可以用于商业产品吗?
可以按平台条款调用服务,但还要分别检查所选模型许可证、生成内容权利、AUP和业务合规。企业应签署适用合同与DPA。
总结
GooseAI适合需要低迁移成本调用GPT-Neo、GPT-J、Fairseq或GPT-NeoX等开放模型的开发团队。它的输出计费方式直观,Playground也便于先验证提示词和模型差异。
新项目不应只因单次价格低就直接上线,应比较模型质量、上下文、并发、政策时效和维护风险。先以小额信用额完成真实业务评测,再决定是否扩大使用。
桂公网安备45132202000164号