LightOn是什麼
LightOn是一家於2016年在巴黎成立的法國AI公司,為企業和公共機構提供安全且可控的生成式AI解決方案。其目前的核心產品Paradigm,用於將大型語言模型與組織內部的文件、業務知識及工具相連結。
LightOn最初從光學計算硬體的研發做起,2020年之後則將重點轉向大型語言模型及企業用生成式AI。該公司已在巴黎泛歐交易所的Growth市場上市,其業務範圍涵蓋金融、工業、醫療、國防以及公共部門等領域。
一句話介紹
Paradigm是一套可部署在主權雲、客戶基礎設施或隔離網路中的企業AI搜尋與智能體平台,支援文件理解、檢索增強生成、模型切換、權限治理、工作流自動化以及開發介面。
Paradigm解決什麼問題
- 讓員工在受控環境中使用生成式AI處理內部知識。
- 從大量非結構化文件中檢索資訊並生成有依據的回答。
- 把掃描件、表格、圖表和複雜版式轉為可檢索知識。
- 建立面向法務、財務、研發或客服的專用AI智能體。
- 在統一平台中管理多個商業或開源模型。
- 將AI服務部署在滿足數據駐留要求的基礎設施中。
- 透過API和MCP將企業系統接入自動化流程。
- 使用用戶組、工作區、審計和SSO控制訪問。
核心功能
企業AI對話
員工可以選擇組織所允許的模型來進行對話,並以工作區中的文件作為上下文。管理員則可以設定系統指令、可用的工具、模型以及資料範圍。
增強搜尋與文件問答
平台透過語意、關鍵字以及重新排序的功能,從授權文件中搜尋相關片段,再由模型產生答案。使用者可以查看被找到的文件與片段,但重要的結論仍需回到原文加以核實。
多模態文件理解
Paradigm能夠處理文字、掃描頁面、圖表、圖形、手寫內容以及複雜的頁面佈局,並透過OCR與視覺語言模型進行解析。其識別品質會受到掃描清晰度、語言、版式以及檔案大小的影響。
企業智能體
組織可以建立多個專用 Agent,並為每個 Agent 設定指令、模型、原生工具、MCP 伺服器以及可存取的工作區。Agent 可以屬於個人、團隊或公司,其存取權限則由使用者群組來控制。
模型管理
管理員可以接入視覺模型、語言模型和嵌入模型,並選擇自托管、第三方API或其他部署方式。模型能否使用取決於實例配置和API金鑰的權限,並非所有客戶都能看到相同的模型列表。
企業連接器
該平台支援將 SharePoint、Teams、Google Drive 和 ServiceNow 等企業資料接入工作區,並可依設定來同步文件。連接器的實際功能範圍則取決於其版本、部署方式以及合約條款。
內建工具與MCP
Paradigm的智能體可以調用文件搜尋、文件分析、網頁搜尋以及程式碼執行等原生工具,同時也能連接到外部的MCP伺服器。管理員可以決定這些工具是由模型自動選擇,還是由使用者手動指定。
| 工具類型 | 主要能力 | 管理重點 |
|---|---|---|
| 文件搜尋 | 在授權工作區中檢索相關片段 | 數據範圍和引用核驗 |
| 文件分析 | 對上傳材料進行綜合處理 | 檔案類型、大小和敏感級別 |
| 網頁搜尋 | 獲取實時公開資訊 | 外部數據合規與事實核驗 |
| 代碼執行 | 運行分析或轉換邏輯 | 執行權限、依賴和資源限制 |
| 外部MCP工具 | 連接內部API和第三方系統 | 令牌、伺服器可信度及資料邊界 |
| 自訂模型 | 使用組織指定的LLM或VLM | 部署位置、成本和模型許可 |
MCP集成方式
系統管理員或公司管理員可以登記外部MCP伺服器,再將相應的工具分配給Agent。MCP的結果不會自動寫入Paradigm的內部索引,其回覆品質取決於外部伺服器本身的檢索與權限設計。
- 確認實例已經啟用Agent和MCP能力。
- 在管理後台登記受信任的MCP伺服器。
- 配置伺服器名稱、地址、認證令牌和可見範圍。
- 檢查令牌是否加密保存並限制最小權限。
- 將MCP伺服器關聯到指定Agent或聊天配置。
- 測試工具發現、參數、返回值和錯誤處理。
- 驗證不同用戶組不能查看無權訪問的連接資訊。
- 上線後審計調用日誌並定期輪換憑證。
工作區、集合與權限
Paradigm透過公司、用戶群組、工作區、集合以及文件來整理知識。用戶群組決定了成員可以存取哪些工作區,而Agent則可以進一步限制可搜尋的工作區範圍。
| 層級 | 作用 | 訪問控制重點 |
|---|---|---|
| 公司 | 隔離組織級配置與資源 | 租戶邊界和管理員角色 |
| 用戶組 | 組織成員和資源權限 | 成員變化與最小授權 |
| 工作區 | 承載業務知識與協作範圍 | 與用戶組的關聯 |
| 集合 | 對文件進行業務分類 | 檢索範圍和生命週期 |
| 文件 | 具體知識內容 | 敏感等級、版本和刪除 |
| Agent | 組合指令、模型、工具和工作區 | 可見範圍與代執行權限 |
文件處理流程
- 按部門和資料敏感度規劃用戶組與工作區。
- 上傳檔案或配置企業資料連接器。
- 選擇適合文件類型的解析和OCR方式。
- 等待文件完成提取、分塊、嵌入和索引。
- 使用代表性問題檢查檢索片段是否準確。
- 調整標籤、過濾、元數據和訪問權限。
- 讓業務人員核驗回答和對應原文。
- 制定更新、重新同步、歸檔和刪除策略。
支援的輸入與輸出
| 類型 | 輸入範例 | 輸出或用途 |
|---|---|---|
| 辦公文件 | 報告、制度、合約和演示材料 | 檢索、摘要、問答和分析 |
| 掃描材料 | 掃描PDF、圖片和手寫頁面 | OCR文本、版面理解與知識索引 |
| 表格數據 | 文本型表格和電子表格 | 內容檢索與結構化分析 |
| 圖片與圖表 | 圖形、照片、示意圖和圖表 | 視覺理解與多模態回答 |
| 企業連接器 | SharePoint、Teams、Drive和ServiceNow | 同步到授權工作區 |
| API請求 | 聊天、檢索、檔案和Agent任務 | JSON結果、流式消息或結構化輸出 |
模型選擇與自訂模型
組織可以在同一Paradigm實例中配置多個商業模型、開源模型或自託管模型,並根據隱私、效能和成本等因素將其分配給使用者。該平台還支援接入LoRA微調模型,並建議在需要高處理量之場景下使用專用的模型服務框架。
- 語言模型用於回答、改寫和智能體推理。
- 視覺語言模型用於圖表、掃描頁和圖片的理解。
- 嵌入模型把文件和查詢轉換為檢索向量。
- 重排序模型改善候選片段的可相關性排序。
- 自託管模型需要客戶負責算力、監控和版本管理。
- 第三方模型API會引入額外的資料處理和計費規則。
Alfred與開放模型
LightOn開發了Alfred系列商業語言模型,同時也公開了多種研究模型、資料集以及檢索技術。客戶在部署Paradigm時,可以選擇使用LightOn的模型,或是接入其他模型;不能將該平台的機能等同於某個固定的模型。
部署方式
| 部署架構 | 數據與計算位置 | 主要特點 | 適合組織 |
|---|---|---|---|
| SaaS | 由LightOn在歐洲主權雲管理 | 上線快、平台運維由服務方承擔 | 團隊、部門和快速試點 |
| 混合部署 | 數據留在客戶端,部分推理由主權雲GPU加速 | 兼顧數據駐留與計算彈性 | 醫療、法務和企業研發 |
| 本地或私有雲 | 數據、平台和算力均在客戶基礎設施 | 控制範圍完整,可連接內部系統 | 金融、工業和關鍵基礎設施 |
| 隔離網路 | 部署在不連接公共網絡的環境 | 適合機密和受監管工作負載 | 國防、情報和高敏感場景 |
| 白標 | 由合作夥伴按客戶架構交付 | 品牌、域名、介面和方案可訂製 | 雲服務商和軟體廠商 |
SaaS、混合與本地部署怎麼選
- 需要最快驗證業務價值時優先評估SaaS。
- 資料必須留在內部,但在缺乏GPU時可評估混合部署。
- 對基礎設施和日誌有完整控制要求時選擇本地部署。
- 完全斷網或機密環境需要隔離網路方案。
- 面向外部客戶提供產品時可以評估白標或嵌入式API。
- 選型時同時計算算力、儲存、連接器、運維和升級成本。
API能力
Paradigm提供覆蓋模型、聊天、Agent、執行緒、工具、檔案、工作區、搜尋以及文件檢索等功能的REST API。在呼叫此API之前,必須先從實例中產生API金鑰,且只能使用實際可見的模型與資源來進行操作。
| API類別 | 主要用途 | 開發注意事項 |
|---|---|---|
| 模型列表 | 獲取當前金鑰可訪問的模型 | 不同租戶返回結果不同 |
| 聊天補全 | 調用模型生成文本或結構化結果 | 處理流式回應和模型版本 |
| 檢索 | 返回相關文件片段或工具結果 | 校驗權限、過濾和排序 |
| Agent與線程 | 運行多步推理和工具調用 | 接口隨版本更新較快 |
| 文件與工作區 | 上傳、查詢和管理企業文件 | 等待解析狀態並處理刪除 |
| OCR | 解析掃描和複雜版式文件 | 注意頁數與批處理限制 |
| 管理介面 | 配置模型、工具與組織資源 | 僅授予受控後台服務 |
API版本注意事項
Paradigm的現有文件同時保留了v2、v3以及與舊版本相關的範例,部分Agent說明已標記為過時。新專案應先確認實例的發行版本,再選擇對應的最新介面,不得直接混用不同版本的請求結構。
- 向管理員確認Paradigm實例的發行版本。
- 創建權限最小化的專用API金鑰。
- 調用模型列表確認可用技術名稱。
- 先測試文件上傳、解析狀態和檢索結果。
- 為Agent工具調用增加超時、重試和審計。
- 把API密鑰放入伺服器密鑰管理系統。
- 升級前比較v2、v3和新發行說明。
- 在測試環境驗證後再更新生產集成。
開發者SDK與GitHub
LightOn負責維護官方的GitHub組織,並公開提供Python SDK、檢索模型訓練庫、向量檢索引擎以及研究數據集。不同的儲存庫分別採用Apache 2.0或MIT等授權條款,但這並不代表Paradigm商業平台的全部核心代碼都是開源的。
| 項目類型 | 代表內容 | 許可或狀態 | 與Paradigm的關係 |
|---|---|---|---|
| Python SDK | LightOn API用戶端 | Apache 2.0 | 用於開發接入,不包含平台伺服器端 |
| PyLate | Late Interaction檢索模型訓練與檢索 | MIT | 可用於檢索研發 |
| NextPlaid | 多向量檢索基礎設施 | Apache 2.0 | 屬於開放檢索技術 |
| FastPlaid | 高效能多向量搜尋引擎 | MIT | 屬於開放檢索組件 |
| 模型與資料集 | 研究模型和檢索數據 | 按各項目許可證 | 需逐項核對商用範圍 |
| Paradigm平台核心 | 管理、權限、介面和企業服務 | 閉源商業產品 | 不能從公開倉庫完整自建 |
定價方式
LightOn並未公佈統一的固定金額,Paradigm則通常根據用戶的席位數量、所選方案、部署架構、基礎設施以及服務範圍來定價。該平台強調以固定席位或基礎設施作為定價依據,而非僅根據生成的代幣數量來計費。
| 方案或版本 | 公開價格 | 計費方式 | 主要權益 | 適合用戶 |
|---|---|---|---|---|
| SaaS | 聯絡銷售 | 按席位及所選方案 | 主權雲託管、快速上線和平台運維 | 團隊、部門和快速試點 |
| 混合部署 | 訂製報價 | 席位、雲端算力與服務合約 | 數據留在客戶端,主權GPU提供推理 | 受監管企業 |
| 本地或私有雲 | 訂製報價 | 軟體許可、席位、算力與支援 | 完整客戶端部署與權限控制 | 大型企業和公共機構 |
| 隔離網路 | 訂製報價 | 項目合約 | 斷網部署、機密環境和專門支援 | 國防與關鍵基礎設施 |
| 白標與轉售 | 訂製報價 | 合作夥伴合同 | 品牌定制、API報表和客戶交付 | 雲服務供應商與整合商 |
| 檢索API | 聯絡銷售 | 基礎設施或容量方案 | 多模態RAG、搜尋和推理介面 | 軟體廠商與產品團隊 |
詢價前需要確認
- 席位數量、管理員數量和外部用戶範圍。
- SaaS、混合、本地或隔離網路架構。
- 需要接入的模型及其獨立許可費用。
- 文件規模、增量同步頻率及儲存容量。
- OCR、檢索、推理及併發效能要求。
- SharePoint等連接器是否包含在方案內。
- SSO、SCIM、審計、備份及高可用性範圍。
- 實施、培訓、升級、支援及SLA費用。
- 測試、預生產和災備環境是否額外計費。
企業安全與合規
Paradigm強調GDPR、資料存放地點、資料傳輸與靜態加密、細粒度的權限控制以及審計功能,其產品頁面還列出了SOC 2 Type 1的合規性認證。至於具體的認證範圍、部署邊界以及合約上的承諾,則需由客戶的安全團隊去核對相關證明文件。
| 控制項 | 平台能力 | 採購時的驗證重點 |
|---|---|---|
| 身分管理 | SSO、自動帳戶配置和用戶組 | 協議、角色和離職回收 |
| 訪問控制 | 工作區、集合、Agent和工具權限 | 是否繼承企業目錄權限 |
| 資料加密 | 傳輸和儲存加密 | 密鑰歸屬和輪換方式 |
| 審計 | 活動日誌和管理報表 | 覆蓋事件、留存和導出 |
| 數據駐留 | 歐洲主權雲或客戶基礎設施 | 備份、日誌和支持訪問位置 |
| 隔離 | 租戶分段、私有部署和斷網模式 | 網路、模型服務和更新通道 |
| 合規 | GDPR及SOC 2 Type 1聲明 | 認證主體、有效期和產品範圍 |
隱私與資料處理
Paradigm是為專業用戶所設計的,用於處理帳戶、使用日誌、文件以及客戶設定等資料。資料的實際儲存與處理方式,則取決於SaaS、混合式或本地部署的合約規定;因此,無法將本地部署時的隱私保護原則直接套用到託管型服務上。
- 上傳前對個人資訊、商業機密和受監管數據分類。
- 確認模型供應商是否接收提示詞或文件片段。
- 限制支援人員和管理員訪問生產數據。
- 為連接器配置只讀和最小範圍憑證。
- 制定文件同步、版本、歸檔和刪除規則。
- 確認日誌、備份和向量索引的保存期限。
- 離職、部門調整和專案結束後及時回收權限。
適合哪些用戶
- 希望在敏感數據上部署生成式AI的大型企業。
- 需要主權雲或本地部署的法國及歐洲組織。
- 受嚴格合規約束的金融、醫療和公共機構。
- 需要多模態文件檢索的法務、研發和知識團隊。
- 希望建立多個專業Agent並控制數據範圍的組織。
- 需要把RAG能力嵌入產品的軟體廠商。
- 計劃為客戶提供白標企業AI的雲服務商和整合商。
典型使用場景
| 場景 | 輸入 | 輸出 | 主要價值 |
|---|---|---|---|
| 企業知識助手 | 制度、手冊、專案與技術文件 | 帶原文依據的問答 | 減少內部檢索時間 |
| 合同與法務分析 | 合約、法規和合規材料 | 條款提取、對比和問題清單 | 輔助法務初審 |
| 金融研究 | 報告、會議材料及財務文件 | 摘要、檢索和結構化分析 | 提高研究效率 |
| 工業技術支援 | 設備手冊、故障記錄和工藝資料 | 診斷線索和操作步驟 | 幫助工程人員定位知識 |
| 公共部門知識庫 | 政策、流程和辦事材料 | 內部問答和草稿 | 兼顧數據駐留要求 |
| 產品內嵌RAG | 客戶文件和應用數據 | 搜尋、聊天和Agent能力 | 縮短自建檢索週期 |
產品優勢
- 部署方式覆蓋SaaS、混合、本地和隔離網路。
- 文件檢索、OCR、模型、Agent及權限集中管理。
- 支持商業、開源和自託管模型並存。
- 多模態解析適合複雜企業文件。
- 提供REST API、MCP及企業資料連接器。
- 能夠按團隊和工作區限制Agent知識範圍。
- 價格強調席位或基礎設施的可預測性。
- 官方同時維護開放檢索技術和開發SDK。
限制與注意事項
- 沒有公開統一金額,採購需要銷售溝通和技術評估。
- 本地部署仍需要客戶準備算力、儲存和運維能力。
- 文件識別與回答無法保證完全準確。
- 權限配置錯誤可能讓Agent檢索到不應訪問的資料。
- 外部MCP伺服器的品質與安全並非由Paradigm單獨負責保證。
- 不同實例、版本和API金鑰可見的模型不同。
- API v2、v3及舊版本文件同時存在,開發時需匹配實例版本。
- 公開GitHub專案不等於Paradigm核心開源。
- 第三方模型和連接器可能引入額外合約與數據邊界。
實施建議
- 選擇一個文件範圍清晰且價值可衡量的業務場景。
- 完成數據分類、權限梳理和部署架構評估。
- 準備代表性文件、問題集和人工標準答案。
- 在測試環境配置工作區、用戶組、模型和連接器。
- 評估OCR、檢索召回、回答準確性及原文可追溯性。
- 為Agent工具調用設定審批、權限和審計策略。
- 進行安全、合規、性能和故障恢復測試。
- 培訓員工區分檢索依據、模型回答和業務判斷。
- 小範圍上線並記錄節省時間、錯誤率和使用率。
- 確認升級、備份、刪除和退出方案後再擴大部署。
常見問題
LightOn和Paradigm是什麼關係?
LightOn是一家從事開發與運營工作的公司,而Paradigm則是它為企業及公共機構所打造的生成式AI平台。此外,LightOn還開發了Alfred模型以及多種開放式檢索技術。
Paradigm可以私有化部署嗎?
可以。平台提供本地、私有雲、混合及隔離網路等架構,也可使用歐洲主權雲SaaS。
Paradigm只能使用LightOn模型嗎?
不是。管理員可以接入LightOn模型、商業模型、開源模型或客戶自托管模型,但具體可用範圍取決於實例配置和合約。
是否支援API和MCP?
支持。Paradigm提供多版本REST API,並能讓Agent連接外部MCP伺服器;開發時需要確認實例版本、金鑰權限和工具範圍。
LightOn是開源公司嗎?
LightOn公開了SDK、檢索庫、模型和資料集等項目,但Paradigm平台的核心部分依然是封閉式的商業軟體。開源狀態必須根據具體的儲存庫和許可證來判斷。
Paradigm多少錢?
沒有公開的固定金額,通常會根據席位數、方案內容、部署架構、基礎設施以及服務範圍來量身定製報價。SaaS、混合式、本地化以及白標方案的成本結構各不相同。
適合個人用戶嗎?
產品主要面向專業組織,而非一般個人聊天用戶。個人或小型團隊若沒有企業級的資料管理、治理及部署需求,可能難以發揮其完整價值。
總結
LightOn Paradigm的核心優勢在於,它能將企業知識檢索、多模態文件理解、模型管理、Agent、API以及權限治理等功能整合到一個可控制的部署架構中。因此,它特別適用於那些對資料保密性要求高、合規性嚴格,且希望減少對公共AI依賴的組織。
選型時不能只比較模型回答效果,還要評估文件解析、權限繼承、連接器、基礎設施、升級、審計以及總擁有成本。建議從可量化的小範圍場景開始,再根據真實準確率和運營成本逐步擴展。
桂公網安備45132202000164號