一句話介紹
GooseAI是一項面向開發者的託管式NLP推理服務,可透過符合行業標準的Completions介面來調用多種開放式語言模型,並按生成的Token數量計費。
當前產品狀態
截至2026年8月23日,GooseAI的官方網站、註冊頁面、Playground、API Key控制台以及價格頁面皆可正常訪問,未經認證的模型接口則會顯示需要授權的訊息。該平台目前仍處於可註冊及調用的在線狀態。
目前,該官網仍主要推廣GPT-Neo、GPT-J、Fairseq和GPT-NeoX等較早出現的生成模型,其主要介面仍是傳統的文本補全功能。它並非現代的多模態聊天平台,也不應與同名的goose開源AI Agent混淆。
| 檢查項目 | 當前結果 | 結論 |
|---|---|---|
| 官網 | 正常展示產品與模型價格 | 服務仍在運營 |
| 帳戶註冊 | 認證頁面可訪問 | 可創建帳戶 |
| Playground | 頁面可訪問 | 可用於模型試驗 |
| API Key控制台 | 頁面可訪問並要求登入 | 支援自助金鑰 |
| API介面 | 未帶密鑰返回未授權 | 介面在線並受認證保護 |
| 模型更新 | 仍以早期開源文本模型為主 | 採購前先做品質測試 |
工具簡介
GooseAI是由CoreWeave與Anlatan共同推出的產品,主要面向那些希望將文字生成功能整合到自己產品中的開發者以及創意技術團隊。該平台負責模型的管理與運算,使用者則可以透過API提交提示詞,並獲得相應的續寫結果。
其核心賣點是遷移成本較低:使用舊版OpenAI Python用戶端的项目,可以保留大部分Completions調用方式,只替換密鑰、接口基礎地址和模型ID。實際相容範圍仍需透過測試確認。
主要功能
託管式文本生成
Completions介面會根據使用者提供的提示詞來預測後續的Token,可用於句子續寫、文章草稿、故事生成、標題或結構化文本的原型製作。它並非搜尋引擎,因此其回應不會自動附上可驗證的依據。
多種開放語言模型
當前價格頁面依參數規模列出125M、1.3B、2.7B、6B、13B和20B等檔位,涵蓋GPT-Neo、Fairseq、GPT-J與GPT-NeoX。不同模型的Tokenizer、連貫性、速度和成本並不相同。
Playground模型測試
網頁Playground允許用戶在接入代碼前嘗試模型與生成參數,比較同一提示詞的輸出差異。模型選擇應基於真實業務樣本,而不是只看參數量。
引擎列表與詳情
Engines介面用於列出可調用的模型,或查詢單個引擎的名稱、擁有者、可用性及描述。在生產環境中,應定期檢查目標Engine是否仍可使用。
單條或批量Prompt
Completions文件允許Prompt使用字串、字串陣列、Token陣列或Token陣列集合,並可同時處理多個輸入。批量輸入會增加總的生成量與費用,應設定嚴格的上限。
多結果生成
請求可以透過數量參數為每個Prompt產生多個候選結果。候選數與Prompt數量相乘,實際計費和回應體積也會同步增加。
生成長度控制
使用者可以設定生成Token的最大數量與最小數量,價格頁面顯示,單次最多可擴展至2,048個生成Token。Prompt與輸出仍受特定模型上下文長度的限制。
採樣與Token偏置
介面提供多種產生參數,用於控制隨機性、候選分布、停止條件以及特定Token的傾向。GPT-NeoX與其他模型的Token ID並非完全通用,遷移偏置設定時需要重新驗證。
預付費餘額管理
API是透過信用額度來結算的,因此帳戶必須保持正餘額。API Key的呼叫會直接消耗帳戶餘額,所以必須採用伺服器端密鑰管理方式。
模型與價格總覽
以下為2026年8月23日官網的美元公開價格。每次請求的基礎價格包含前25個生成的Token,超過的部分則會按照每個輸出Token來計費,而輸入的Token目前不另收費。
| 參數檔位 | 模型系列 | 基礎價/請求 | 額外輸出Token | 適合測試方向 |
|---|---|---|---|---|
| 125M | GPT-Neo、Fairseq | 0.000035美元 | 0.000001美元/Token | 低成本格式與流程驗證 |
| 1.3B | GPT-Neo、Fairseq | 0.000110美元 | 0.000003美元/Token | 輕量續寫和批量原型 |
| 2.7B | GPT-Neo、Fairseq | 0.000300美元 | 0.000008美元/Token | 中小型文本任務 |
| 6B | GPT-J、Fairseq | 0.000450美元 | 0.000012美元/Token | 較長內容與創意生成 |
| 13B | Fairseq | 0.001250美元 | 0.000036美元/Token | 需要更大模型的任務 |
| 20B | GPT-NeoX | 0.002650美元 | 0.000063美元/Token | 最高檔開放模型試驗 |
模型規模越大並不代表每種任務都更準確,也可能增加延遲和成本。上線前應固定測試集,對輸出品質、吞吐量、錯誤率及單任務費用同時進行評估。
計費規則
| 項目 | 官方規則 | 實際影響 |
|---|---|---|
| 計費單位 | 基礎請求價加額外生成Token | 短輸出也會產生基礎費用 |
| 基礎包含量 | 前25個生成Token | 超過後按Token累加 |
| 輸入Token | 當前不收費 | 長Prompt仍受上下文與性能限制 |
| 單次生成上限 | 價格頁寫最多2,048 Token | 應按模型上下文再次校驗 |
| 付款方式 | 預購GooseAI Credits | 餘額不足前需儲值 |
| 信用額有效期 | 購買後12個月 | 未使用餘額會到期 |
| 退款 | 信用額不可退款 | 先小額驗證再充值 |
| 企業折扣 | 批量信用額聯繫銷售 | 需要單獨報價 |
信用額度會依照先購先用原則來消耗,較早購買的項目所剩的信用額度會先被扣除。平台費用和稅金可能會有所變動,企業在採購時應在合約中明確價格、有效期、服務範圍以及帳單相關的責任。
成本計算示例
| 示例 | 模型檔位 | 生成長度 | 估算方式 | 未含項目 |
|---|---|---|---|---|
| 短續寫 | 1.3B | 25 Token | 僅基礎價0.000110美元 | 稅費與失敗重試 |
| 100 Token續寫 | 1.3B | 100 Token | 基礎價加75個額外Token | 並發候選與重試 |
| 100 Token續寫 | 6B | 100 Token | 基礎價加75個額外Token | 網路與應用成本 |
| 多候選生成 | 任意 | 每個Prompt生成多條 | 各候選生成量累加 | 後處理成本 |
| 批量Prompt | 任意 | 多個輸入並發 | 每個請求與輸出分別累計 | 限流與失敗重放 |
估算時不能只看一次調用價格,還要統計平均輸出長度、候選數量、重試率、無效結果和峰值併發。生產系統應記錄每個業務動作的實際消耗。
API接入教學
創建並保護API Key
- 註冊GooseAI帳戶並完成電子郵件或帳戶驗證。
- 進入 Dashboard 的 API Key 管理區域,建立單獨的 Secret Key。
- 把密鑰保存到伺服器端密鑰管理或環境配置,不寫進前端代碼。
- 為開發、測試和生產環境分別建立金鑰,避免共用。
- 先充值小額信用額,並設定內部餘額與費用告警。
- 密鑰洩露時立即撤銷並更換,同時檢查異常呼叫。
從舊版OpenAI用戶端遷移
- 確認現有應用使用的是傳統Completions和Engine呼叫,而不是新式聊天介面。
- 保留相容的用戶端函式庫,並替換為GooseAI Secret Key。
- 把用戶端基礎地址改為GooseAI的第一版API地址。
- 透過Engines列表獲取當前可用模型ID,不要憑文件手寫舊ID。
- 選擇一個模型,用固定Prompt執行最小請求。
- 核對回應結構、停止原因、Token數量、錯誤碼和費用。
- 透過測試後再逐步切換流量,並保留回退配置。
設計一條Completions請求
- 準備簡潔Prompt,明確輸出格式、語氣和結束條件。
- 指定Engine ID,並設定合理的最大生成Token數。
- 從較低的隨機性及單個候選者開始建立可重複的基線。
- 配置停止序列,避免模型繼續生成無關段落。
- 記錄請求ID、模型、參數、延遲、輸出量及費用。
- 對輸出進行安全過濾、格式校驗和事實審查。
- 出現限流或服務錯誤時採用有上限的指數退避。
適合哪些用戶
- 維護舊式Completions應用的開發團隊:降低介面遷移的工作量。
- 創意寫作產品:測試開放模型的續寫、故事和風格生成。
- 批量文本原型團隊:用小模型驗證格式和工作流。
- 模型評測人員:在統一託管環境比較不同參數規模。
- 教育與研究用戶:觀察GPT-Neo、GPT-J和GPT-NeoX的行為。
- 成本敏感型專案:按輸出Token控制短文本生成預算。
- 需要OpenAI舊版客戶端相容的後端開發者。
典型使用場景
- 為文章、故事或遊戲文本生成後續段落與候選版本。
- 根據固定模板補全產品描述、摘要草案或標題。
- 對多個開放模型執行相同Prompt的品質與成本評測。
- 用125M或1.3B檔位進行低成本接口和隊列壓測。
- 把舊版OpenAI Completions原型切換到另一託管推理商。
- 批量生成需要後續人工篩選的創意文本。
- 研究不同採樣參數、Token偏置和停止條件。
產品優勢
- 由平台管理GPU推理基礎設施,無需自行部署模型。
- 相容傳統OpenAI用戶端呼叫思路,遷移門檻相對低。
- 價格頁公開基礎請求價和額外輸出Token單價。
- 只對生成Token計費,輸入當前不單獨收費。
- 提供從125M到20B的多個規模和模型系列。
- 網頁Playground便於在編碼前快速比較輸出。
- 自助創建API Key,並提供企業批量信用額方案。
使用限制與注意事項
- 目前模型以早期開放文本模型為主,能力明顯不同於新一代聊天模型。
- 服務重點是Completions,不應假設支援圖像、音頻、工具調用或現代Chat介面。
- 文件中的多數法律與隱私相關內容最後更新於2022年,可能落後於現行實務。
- 官網宣稱節省比例屬於行銷比較,實際成本取決於輸出和重試。
- 輸入雖不收費,但長Prompt仍影響上下文、延遲和模型表現。
- 多Prompt與多候選會快速放大生成Token和費用。
- 信用額12個月到期且不可退款,不宜一次預購過多。
- 模型可能產生虛構、偏見、有害內容或不符合格式的輸出。
- 不同模型Tokenizer不同,Token偏置與長度估算不能直接復用。
- 沒有公開現代SLA、資料駐留及最新安全認證摘要,企業需單獨確認。
支援的介面與輸出
| 能力 | 支持情況 | 說明 |
|---|---|---|
| Engine列表 | 支持 | 列出可用模型 |
| 引擎詳情 | 支持 | 查詢單個模型狀態與描述 |
| 文本補完 | 支持 | 根據Prompt生成續寫 |
| 多個Prompt | 支持 | 可並發處理 |
| 多個候選 | 支持 | 每個Prompt生成多條 |
| 流式輸出 | 舊版介面通常支援,需實測 | 以當前響應行為為準 |
| Chat Completions | 未在當前核心文件確認 | 不要按現代聊天介面假設 |
| Embeddings | 未在當前導航確認 | 不作為已支援能力 |
| 圖像與音頻 | 不支援 | 文本NLP推理服務 |
| 微調 | 未找到現行自助文件 | 需要聯繫官方確認 |
GitHub、SDK與開源情況
GooseAI擁有同名的GitHub組織,但目前的三個公開倉庫都是其他專案的Fork,包括用Go語言編寫的GPT-3用戶端、KoboldAI以及Transformers。這些並不代表GooseAI平台的後端原始碼已經被公開。
官方文件主要推薦使用OpenAI舊版Python用戶端並修改基礎地址,沒有提供獨立的GooseAI SDK。服務使用開放模型並不等於託管平台本身是開源的。
| 項目 | 當前情況 | 開源判斷 |
|---|---|---|
| GooseAI雲平台 | 源碼未公開 | 閉源託管服務 |
| 託管模型 | 來自多個開放模型項目 | 許可證按各模型分別判斷 |
| 官方GitHub組織 | 有三個公開Fork | 不是平台核心源碼 |
| 獨立官方SDK | 未找到 | 使用相容用戶端或直接請求 |
| go-gpt3 Fork | MIT許可證 | 通用舊版用戶端,不是平台源碼 |
| KoboldAI Fork | AGPL-3.0許可證 | 不同應用項目 |
| Transformers Fork | Apache-2.0許可證 | 上游框架分支 |
隱私與資料處理
現行網站仍顯示最後更新於2022年1月31日的隱私政策。該政策涵蓋帳戶資訊、使用數據、Cookies、裝置以及第三方帳戶資訊,並說明這些資訊可能會與服務供應商、分析服務提供者、業務受讓方或法律機構共享。
政策明確指出,其一般的隱私說明不適用於客戶透過服務所處理的資料,企業用戶需要另行審查DPA與合約。目前的公開文件中,並未明確說明對Prompt及生成結果的保存期限,或是是否可用於訓練。
- 不要在Prompt中提交密碼、金鑰、身分證件或受監管數據。
- 企業接入前索取現行DPA、子處理方和數據保留說明。
- 確認數據跨境傳輸、刪除、備份及執法請求處理方式。
- 在應用中向最終用戶披露第三方模型服務的參與。
- 對Prompt和輸出進行脫敏,並保留必要的訪問審計。
- 未滿18歲用戶不應使用該服務。
條款與合規
服務條款的最後修改日期同樣為2022年1月31日,費用可進行調整,付款則由Stripe等平台處理。客戶購買並消耗信用額度時,若出現違規、虛假帳單資訊或非法行為,其信用額度可能會被撤銷。
客戶負有保管自身資料的責任,並授予GooseAI為提供服務所需之托管、儲存、傳輸及格式化之許可。條款禁止逆向工程,適用法律及爭議管轄權均以紐約為準。
- 不得生成或傳播違法、濫用、侵權和非自願私密內容。
- 不得用服務侵犯版權、商標、隱私或公開權。
- 必須保護API Key,並對其產生的全部費用負責。
- 面向用戶提供生成內容時應建立投訴與刪除流程。
- 企業採購應確認稅費、責任限制、停服和餘額處理。
- 上線前重新閱讀最新條款,不只依賴2022年摘要。
基本資訊
| 項目 | 內容 |
|---|---|
| 工具名稱 | GooseAI |
| 運營主體 | GooseAI, Inc. |
| 聯合推出方 | CoreWeave與Anlatan |
| 工具類型 | 託管式NLP和語言模型推理API |
| 主要模型 | GPT-Neo、GPT-J、Fairseq、GPT-NeoX |
| 核心介面 | 引擎與文本補全 |
| 價格模式 | 預付信用額、按生成Token計費 |
| 輸入計費 | 當前不收費 |
| 信用額有效期 | 12個月 |
| 退款 | 信用額不可退款 |
| Playground | 有 |
| 公共API | 有 |
| 獨立官方SDK | 未找到 |
| 平台是否開源 | 否 |
| 資訊核驗日期 | 2026年8月23日 |
推薦指數
推薦指數:3.5 / 5。GooseAI的計價方式透明,介面簡單,適合那些仍在維護傳統Completions應用,或是需要測試早期開放型模型的開發者。
主要不足是模型與接口體系偏舊,政策文件更新時間較早,也缺少現代聊天、多模態及企業安全能力的清晰說明。新項目應先與更新的模型API進行品質與總成本比較。
常見問題
GooseAI是什麼?
它是一種託管式的語言模型推理服務,透過 API 提供開放型模型的文字續寫功能。主要面向開發者,而非一般聊天用戶。
GooseAI還在運營嗎?
是。官網、註冊、Playground、Dashboard以及經過認證保護的API目前仍處於線上狀態。
GooseAI免費嗎?
建立帳戶是免費的,但 API 會根據產生量消耗預購的信用額度。不可將免費註冊理解為可永久免費進行推理。
輸入Token收費嗎?
目前定價頁面寫明僅按生成的Token計費,輸入內容不額外收費。長篇Prompt仍受上下文與性能限制。
基礎價包含多少Token?
每次請求的基礎價格包含前25個生成的Token,超出部分則按照模型檔位的額外Token單價計算。
信用額會過期嗎?
會,購買後12個月到期,並按先購先用方式扣除。信用額不可退款。
支援哪些模型?
當前價格頁面列出了GPT-Neo、Fairseq、GPT-J和GPT-NeoX,參數規模從125M到20B不等。實際可用的引擎則需透過API列表來確認。
相容OpenAI API嗎?
相容傳統Engine與Completions的呼叫方式,舊版用戶端通常只需替換金鑰、基礎地址和模型ID。現代Chat介面無法直接假設相容。
提供官方SDK嗎?
沒有找到獨立的GooseAI SDK。官方範例使用OpenAI舊版Python用戶端,也可以直接發送介面請求。
GooseAI是開源的嗎?
託管平台並非開源的。它所服務的部分模型以及 GitHub Fork 擁有各自的許可證,但這並不意味著雲端服務的代碼是開放的。
它與goose AI Agent是什麼關係?
沒關係。後者是另一套開源AI代理專案,產品定位、團隊、域名和代碼均不同。
可以用於商業產品嗎?
可以依照平台條款來使用該服務,但還必須分別檢查所選模型的許可證、所產生內容的權利、AUP以及業務合規性。企業應簽署適用的合約與DPA。
總結
GooseAI適合那些需要以較低的成本來調用GPT-Neo、GPT-J、Fairseq或GPT-NeoX等開放式模型的開發團隊。它的輸出計費方式相當直觀,而Playground則方便用戶先測試不同的提示詞以及模型效果。
新項目不應只因單次價格低就直接上線,應比較模型品質、上下文、併發量、政策時效及維護風險。先以小額信貸額度完成真實業務評測,再決定是否擴大使用。
桂公網安備45132202000164號