DeepSeek是什麼
DeepSeek是杭州深度求索人工智能基礎技術研究有限公司推出的大模型品牌、免費AI助手及開發者API平台。用戶可以在網頁端或官方App中進行問答、寫作、翻譯、解題、編程、網路搜尋、圖片理解與文件閱讀;
開發者可以透過相容 OpenAI 和 Anthropic 格式的介面來接入模型,也可以下載官方公開的模型權重用於研究、微調或本地部署。
截至本次核驗,DeepSeek目前正式主線已經進入DeepSeek-V4在這個系列中,不應再將R1或V3稱為最新的旗艦產品了。V4則包括強調速度與成本效率的V4-Flash,以及規模更大、擁有更強大知識處理及複雜推理能力的V4-Pro。
官方在2026年7月31日上線V4-Flash正式版API公測,重點增強代碼Agent與工具執行能力;該次更新沒有同步更換V4-Pro API和App/Web端模型。
網上流傳的“DeepSeek-R2”沒有官方正式發布資訊,目錄不應把謠言當作現有產品。
核心功能
- 通用AI對話:處理知識問答、內容總結、中文寫作、翻譯、學習講解、方案構思及日常決策。模型可在快速回答與更深入的推理之間切換,但輸出仍可能存在錯誤。
- 深度思考:V4-Pro與V4-Flash皆支援非思考、Think High和Think Max三種推理強度。日常任務可使用非思考模式提升速度,數學、代碼、規劃及複雜分析則更適合使用高強度思考模式。
- 聯網搜尋:消費端可以搜尋網際網路資料後綜合回答,適合查詢新聞背景、產品資訊和即時事件。搜尋摘要並不等同於原文,日期、數字、引用和政策仍需打開原始頁面核實。
- 識圖與圖片提問:官方行動端已上線識圖模式,可上傳照片、截圖或圖表進行理解、文字提取和問答。它屬於視覺理解,不應誤寫為已經提供專業級文生圖或影片生成。
- 文件閱讀:支援上傳文件,並可針對內容進行總結、提取要點、解釋概念以及持續提問,適用於論文、報告、合約的初讀以及學習資料。超大檔案、複雜排版、掃描件和表格的辨識效果會受到格式的影響。
- 代碼與數學:可生成、解釋、調試和重構代碼,處理算法、數學推導與工程問題。V4-Flash正式版針對代碼Agent任務進行了強化,適合在開發工具中承擔倉庫分析、補丁編寫和終端任務,但生產代碼必須經過測試與安全審查。
- 長上下文:V4-Pro和V4-Flash的官方模型規格皆支援100萬Token的上下文量,最大輸出長度為384K。實際可用長度還會受到接入平台、顯存、費用、延遲以及用戶端限制的影響。
- Agent與工具調用:API支援JSON Output、Tool Calls、對話前綴續寫以及FIM補全;V4-Flash版本則支援Responses API,可與代碼代理及自動化工作流程相整合。工具調用會將模型錯誤放大為實際操作,因此在進行寫入檔案、發布、支付或刪除等操作時,應保留人工確認的步驟。
- 多端同步:提供Web、iPhone、iPad和Android版本。行動端支援搜尋歷史對話、表格複製與下載、字號調整、圖片和檔案上傳;具體功能會隨版本與地區逐步開放。
V4-Pro與V4-Flash怎麼選
V4-Flash為284B總參數、13B啟動參數的MoE模型,適合追求速度、低API成本、批量文本和代碼Agent的使用者;V4-Pro則為1.6T總參數、49B啟動參數,更適合用於知識密集型問題、複雜推理、長文件分析以及高難度編程。
兩者均在超過32T Token的數據上預訓練,並採用混合注意力架構以降低百萬級長上下文的計算與緩存成本。
「Pro一定適合所有任務」並不準確。簡單問答、分類、抽取和高併發業務通常使用Flash更划算;
複雜研究或高難度代碼再切換Pro。
Think Max會消耗更多計算與輸出Token,官方本地部署說明還建議為該模式準備至少384K上下文,因此不適合作為所有請求的預設檔位。
免費使用與API價格
DeepSeek網頁版和官方App目前可免費使用,蘋果應用商店將官方App標示為「免費」,並未列出應用內的購買項目。免費並不代表可以無限使用資源:在高峰時段可能需排隊,搜索、圖像辨識、檔案上傳、對話長度以及單條訊息的重新生成次數,也可能受到風控或容量限制。
官方沒有承諾消費端永久不限量,實際額度以帳號界面為準。
API與免費聊天是兩套產品。開發者需要單獨創建API Key並充值,費用按輸入和輸出Token結算。
目前官方公開的價格是以每百萬Token為單位:
| 套餐或版本 | 價格、額度與核心權益 |
|---|---|
| V4-Pro | 緩存命中輸入0.025元,緩存未命中輸入3元,輸出6元。 |
| Pro | V4-Pro:緩存命中輸入0.025元,緩存未命中輸入3元,輸出6元。 |
V4-Flash的公開並發限制為2500,V4-Pro則為500;兩者的上下文數量皆為100萬個Token。
官方已提示計劃整體上調API價格且預計漲幅較大,因此這些數字只適合作為本次核驗時的參考,正式上線前應查看控制台實時價格。
充值餘額和贈送餘額同時存在時,優先扣贈送餘額,消費端免費額度不能轉成API餘額。
API與開發者接入
DeepSeek API提供與OpenAI相容的Chat Completions格式,同時也提供Anthropic格式的接口。現有的SDK通常只需要修改金鑰、模型名稱以及服務地址,就能進行連接。目前正式推出的模型名稱為deepseek-v4-flash和deepseek-v4-pro。
舊有的deepseek-chat和deepseek-reasoner已於2026年7月24日停止使用,舊教學中的模型名稱需要更新。
V4-Flash目前支援Responses API,而V4-Pro的Responses功能之支援狀態則以最新文件為準。這兩款模型都支援思考與非思考模式、JSON格式的輸出,以及工具調用功能,但思考模式與強制指定某個工具之間可能存在相容性問題。
在構建LangChain、代碼代理或結構化輸出流程時,應針對實際參數進行回歸測試,不能僅因介面「相容OpenAI」就假定所有欄位的行為完全一致。
開源狀態與本地部署
DeepSeek-V4-Pro、V4-Flash及其Base版本的官方權重已經公開,模型卡明確採用MIT許可證。V4-Pro的總參數約為1.6T,V4-Flash則約為284B,官方提供了FP8以及FP4與FP8混合精度的權重,並說明了如何使用Transformers、vLLM和SGLang等工具來進行部署。
R1、V3、Coder、VL、OCR以及幾個用於訓練的基礎設施專案,也都已在官方社群中公開,但每個倉庫的許可證仍需分別核對。
「開源權重」並不等於普通電腦就能輕鬆運行完整模型。即便採用低精度,V4-Flash以及尤其是V4-Pro,仍需要大量的儲存空間、記憶體、顯示記憶體,以及多卡並行處理的能力;而百萬級的上下文量還會進一步增加KV緩存的負擔。
個人用戶通常更適合使用官方免費版、API或可信的託管推理服務;下載量化模型前要確認來源、精確度損失、許可證及硬體需求。
官方模型權重、研究代碼與DeepSeek在線產品也要區分:聊天網站、帳號系統、聯網搜尋、內容安全與雲端推理平台並未作為一個完整應用開源。目錄中更準確的標記是“核心模型權重開源,在線產品與託管服務不開源”。
支援平台
DeepSeek提供Web、iPhone、iPad、Android和API。中國區的Apple用戶端目前要求iOS或iPadOS 15.0以上,並支援多種語言;
Android官方應用也已覆蓋手機和平板。
下載時應核對開發者為杭州深度求索,避免安裝名稱相似、要求額外訂閱或收集過多權限的第三方套殼應用。
DeepSeek使用教學
完成一次基礎任務
- 註冊DeepSeek並創建僅用於測試環境的API Key;
- 根據輸入類型、上下文、品質、速度和價格選擇模型;
- 先調用通用AI對話完成最小請求並檢查返回結構;
- 再用深度思考測試流式輸出、參數和異常響應;
- 記錄Tokens、呼叫次數、延遲、錯誤率及單次成本;
- 把密鑰移入服務端密鑰管理器後再接入正式應用;
建立可重複使用的專業工作流
- 為開發、測試與生產環境使用不同密鑰與額度;
- 按通用AI對話、深度思考和聯網搜尋建立代表性評測集;
- 設定超時、併發、重試、限流和預算上限;
- 對輸出執行事實、安全、格式和敏感資訊檢查;
- 監控模型版本、價格、延遲和失敗率變化;
- 準備降級模型、熔斷和人工接管方案;
適合哪些用戶
- 需要免費中文問答、寫作、翻譯、上網搜尋與學習講解的普通用戶;
- 需要閱讀論文、報告、截圖及長篇文件的学生與知識工作者;
- 需要代碼生成、倉庫分析、除錯以及 Agent 工作流的開發者;
- 希望以較低Token成本接入長上下文模型的團隊與企業;
- 具備多卡硬體,希望研究、微調或私有部署開放權重模型的機構。
使用限制與安全注意事項
- DeepSeek的回答可能出現幻覺、過時資訊、虛構引用和計算錯誤;
- 聯網搜尋只能提高時效性,不能保證結論正確;
- 醫療、法律、金融、政策及學術引用必須由專業人員或原始資料進行核複;
- 長上下文也不意味著模型能無損記住每個細節,重要數字、條款和跨頁表格應單獨核驗;
- 上傳合約、履歷表、原始碼、客戶資料、照片和語音之前,應先刪除不必要的身分證號碼、密鑰、商業機密與個人資訊;
- 蘋果的隱私披露顯示,App可能處理大致位置、聯絡資料、使用者內容、搜尋記錄、裝置識別碼、使用與診斷數據;
- 企業敏感業務應評估資料儲存地區、保留期限、刪除機制及內部合規要求;
- 本地部署雖然能提升資料控制能力,但同時也將模型下載、供應鏈、存取控制、日誌、漏洞修復以及內容合規的責任交給部署者;
- 公開權重並不等於輸出不受法律約束,也不會自動賦予第三方商標、人物肖像、資料集或生成內容的權利;
常見問題
DeepSeek免費嗎?
官方網頁和App目前免費,且沒有公開會員內購;API則依Token單獨收費。
免費端仍可能存在高峰排隊、功能額度和風控限制。
DeepSeek現在最新模型是什麼?
目前正式主線為DeepSeek-V4,包括V4-Pro與V4-Flash。V4-Flash正式版API已於2026年7月31日上線公測;
R2尚無官方正式發布資訊。
DeepSeek支援圖片和檔案嗎?
支持。官方App已經提供識圖模式,並持續優化圖片和文件上傳;
可用於圖片理解、文字提取、文件總結和追問,但不是專業的圖片或影片生成工具。
DeepSeek是開源的嗎?
V4-Pro、V4-Flash以及Base的權重是以MIT許可證的方式公開的,R1和V3等模型也有官方的開源儲存庫;不過,網頁、應用程式、搜尋功能以及雲端平台並非完全開源的產品。
DeepSeek API多少錢?
目前每百萬Token,V4-Flash緩存命中時輸入0.02元、未命中時輸入1元、輸出2元;V4-Pro則分別為0.025元、3元和6元。
官方已預告可能大幅調價,接入前要重新確認。
普通電腦能本地運行V4嗎?
完整V4模型的規模很大,通常需要專業的多卡伺服器。個人電腦只能嘗試使用社區提供的量化、切分方案,或是較小的蒸餾模型,這樣在速度、上下文處理能力或效果方面都會有所犧牲。
桂公網安備45132202000164號