LightOn是什么
LightOn是一家2016年创立于巴黎的法国AI公司,面向企业和公共机构提供安全、可控的生成式AI。其当前核心产品Paradigm用于把大语言模型连接到组织内部文档、业务知识和工具。
LightOn最初从光学计算硬件研发起步,2020年后重点转向大语言模型和企业生成式AI。公司已在巴黎泛欧交易所Growth市场挂牌,业务重点覆盖金融、工业、医疗、国防和公共部门。
一句话介绍
Paradigm是一套可部署在主权云、客户基础设施或隔离网络中的企业AI搜索与智能体平台,支持文档理解、检索增强生成、模型切换、权限治理、工作流自动化和开发接口。
Paradigm解决什么问题
- 让员工在受控环境中使用生成式AI处理内部知识。
- 从大量非结构化文档中检索信息并生成有依据的回答。
- 把扫描件、表格、图表和复杂版式转为可检索知识。
- 建立面向法务、财务、研发或客服的专用AI智能体。
- 在统一平台中管理多个商业或开源模型。
- 把AI服务部署在满足数据驻留要求的基础设施中。
- 通过API和MCP把企业系统接入自动化流程。
- 使用用户组、工作区、审计和SSO控制访问。
核心功能
企业AI对话
员工可以选择组织允许的模型进行对话,并把工作区文档作为上下文。管理员能够配置系统指令、可用工具、模型和数据范围。
增强搜索与文档问答
平台通过语义、关键词和重排序能力从授权文档中检索相关片段,再由模型生成回答。用户可以查看命中的文档和片段,重要结论仍需回到原文核实。
多模态文档理解
Paradigm能够处理文字、扫描页、图表、图形、手写内容和复杂页面布局,并通过OCR与视觉语言模型进行解析。识别质量会受扫描清晰度、语言、版式和文件规模影响。
企业智能体
组织可以创建多个专用Agent,为每个Agent配置指令、模型、原生工具、MCP服务器和可访问工作区。Agent可归属个人、团队或公司,并由用户组控制访问。
模型管理
管理员可以接入视觉模型、语言模型和嵌入模型,并选择自托管、第三方API或其他部署方式。模型能否使用取决于实例配置和API密钥权限,不是所有客户都看到同一模型列表。
企业连接器
平台支持把SharePoint、Teams、Google Drive和ServiceNow等企业数据接入工作区,并按设置同步文档。连接器的实际范围与版本、部署和合同有关。
内置工具与MCP
Paradigm的智能体可以调用文档搜索、文档分析、网页搜索和代码执行等原生工具,也可以连接外部MCP服务器。管理员可决定工具能否被模型自动选择或由用户手动指定。
| 工具类型 | 主要能力 | 管理重点 |
|---|---|---|
| 文档搜索 | 在授权工作区中检索相关片段 | 数据范围和引用核验 |
| 文档分析 | 对上传材料进行综合处理 | 文件类型、大小和敏感级别 |
| 网页搜索 | 获取实时公开信息 | 外部数据合规与事实核验 |
| 代码执行 | 运行分析或转换逻辑 | 执行权限、依赖和资源限制 |
| 外部MCP工具 | 连接内部API和第三方系统 | 令牌、服务器可信度和数据边界 |
| 自定义模型 | 使用组织指定的LLM或VLM | 部署位置、成本和模型许可 |
MCP集成方式
系统管理员或公司管理员可以登记外部MCP服务器,再把相应工具分配给Agent。MCP结果不会自动写入Paradigm内部索引,回答质量取决于外部服务器自身的检索和权限设计。
- 确认实例已经启用Agent和MCP能力。
- 在管理后台登记受信任的MCP服务器。
- 配置服务器名称、地址、认证令牌和可见范围。
- 检查令牌是否加密保存并限制最小权限。
- 把MCP服务器关联到指定Agent或聊天配置。
- 测试工具发现、参数、返回值和错误处理。
- 验证不同用户组不能查看无权访问的连接信息。
- 上线后审计调用日志并定期轮换凭证。
工作区、集合与权限
Paradigm通过公司、用户组、工作区、集合和文档组织知识。用户组决定成员能够访问哪些工作区,Agent还可以进一步限定可检索的工作区范围。
| 层级 | 作用 | 访问控制重点 |
|---|---|---|
| 公司 | 隔离组织级配置与资源 | 租户边界和管理员角色 |
| 用户组 | 组织成员和资源权限 | 成员变化与最小授权 |
| 工作区 | 承载业务知识和协作范围 | 与用户组的关联 |
| 集合 | 对文档进行业务分类 | 检索范围和生命周期 |
| 文档 | 具体知识内容 | 敏感级别、版本和删除 |
| Agent | 组合指令、模型、工具和工作区 | 可见范围与代执行权限 |
文档处理流程
- 按部门和数据敏感度规划用户组与工作区。
- 上传文件或配置企业数据连接器。
- 选择适合文件类型的解析和OCR方式。
- 等待文档完成提取、分块、嵌入和索引。
- 使用代表性问题检查检索片段是否准确。
- 调整标签、过滤、元数据和访问权限。
- 让业务人员核验回答和对应原文。
- 制定更新、重新同步、归档和删除策略。
支持的输入与输出
| 类型 | 输入示例 | 输出或用途 |
|---|---|---|
| 办公文档 | 报告、制度、合同和演示材料 | 检索、摘要、问答和分析 |
| 扫描材料 | 扫描PDF、图片和手写页面 | OCR文本、版面理解和知识索引 |
| 表格数据 | 文本型表格和电子表格 | 内容检索与结构化分析 |
| 图片与图表 | 图形、照片、示意图和图表 | 视觉理解和多模态回答 |
| 企业连接器 | SharePoint、Teams、Drive和ServiceNow | 同步到授权工作区 |
| API请求 | 聊天、检索、文件和Agent任务 | JSON结果、流式消息或结构化输出 |
模型选择与自定义模型
组织可以在同一Paradigm实例中配置多个商业模型、开源模型或自托管模型,并按隐私、性能和成本分配给用户。平台还支持接入LoRA微调模型,并建议高吞吐场景使用专门的模型服务框架。
- 语言模型用于回答、改写和智能体推理。
- 视觉语言模型用于图表、扫描页和图片理解。
- 嵌入模型把文档和查询转换为检索向量。
- 重排序模型改善候选片段的相关性排序。
- 自托管模型需要客户负责算力、监控和版本管理。
- 第三方模型API会引入额外的数据处理和计费规则。
Alfred与开放模型
LightOn开发了Alfred系列商业语言模型,也公开过多种研究模型、数据集和检索技术。客户部署Paradigm时可以使用LightOn模型或接入其他模型,不能把平台功能等同于某一个固定模型。
部署方式
| 部署架构 | 数据与计算位置 | 主要特点 | 适合组织 |
|---|---|---|---|
| SaaS | 由LightOn在欧洲主权云管理 | 上线快、平台运维由服务方承担 | 团队、部门和快速试点 |
| 混合部署 | 数据留在客户侧,部分推理由主权云GPU加速 | 兼顾数据驻留与计算弹性 | 医疗、法务和企业研发 |
| 本地或私有云 | 数据、平台和算力均在客户基础设施 | 控制范围完整,可连接内部系统 | 金融、工业和关键基础设施 |
| 隔离网络 | 部署在不连接公共网络的环境 | 适合机密和受监管工作负载 | 国防、情报和高敏感场景 |
| 白标 | 由合作伙伴按客户架构交付 | 品牌、域名、界面和方案可定制 | 云服务商和软件厂商 |
SaaS、混合与本地部署怎么选
- 需要最快验证业务价值时优先评估SaaS。
- 数据必须留在内部但缺少GPU时可评估混合部署。
- 对基础设施和日志有完整控制要求时选择本地部署。
- 完全断网或机密环境需要隔离网络方案。
- 面向外部客户提供产品时可以评估白标或嵌入式API。
- 选型时同时计算算力、存储、连接器、运维和升级成本。
API能力
Paradigm提供覆盖模型、聊天、Agent、线程、工具、文件、工作区、检索和文档搜索等能力的REST API。调用前需要从实例生成API密钥,并以实际密钥可见的模型和资源为准。
| API类别 | 主要用途 | 开发注意事项 |
|---|---|---|
| 模型列表 | 获取当前密钥可访问的模型 | 不同租户返回结果不同 |
| 聊天补全 | 调用模型生成文本或结构化结果 | 处理流式响应和模型版本 |
| 检索 | 返回相关文档片段或工具结果 | 校验权限、过滤和排序 |
| Agent与线程 | 运行多步推理和工具调用 | 接口随版本更新较快 |
| 文件与工作区 | 上传、查询和管理企业文档 | 等待解析状态并处理删除 |
| OCR | 解析扫描和复杂版式文档 | 注意页数与批处理限制 |
| 管理接口 | 配置模型、工具和组织资源 | 仅授予受控后台服务 |
API版本注意事项
Paradigm当前文档同时保留v2、v3和与旧版本相关的示例,部分Agent说明已经标记为过时。新项目应先确认实例发行版本,再选择对应的最新接口,不能直接混用不同版本的请求结构。
- 向管理员确认Paradigm实例的发行版本。
- 创建权限最小化的专用API密钥。
- 调用模型列表确认可用技术名称。
- 先测试文件上传、解析状态和检索结果。
- 为Agent工具调用增加超时、重试和审计。
- 把API密钥放入服务器密钥管理系统。
- 升级前比较v2、v3和新发行说明。
- 在测试环境验证后再更新生产集成。
开发者SDK与GitHub
LightOn维护官方GitHub组织,并公开Python SDK、检索模型训练库、向量检索引擎和研究数据集。不同仓库分别采用Apache 2.0或MIT等许可证,但这不代表Paradigm商业平台的核心代码全部开源。
| 项目类型 | 代表内容 | 许可或状态 | 与Paradigm的关系 |
|---|---|---|---|
| Python SDK | LightOn API客户端 | Apache 2.0 | 用于开发接入,不包含平台服务端 |
| PyLate | Late Interaction检索模型训练与检索 | MIT | 可用于检索研发 |
| NextPlaid | 多向量检索基础设施 | Apache 2.0 | 属于开放检索技术 |
| FastPlaid | 高性能多向量搜索引擎 | MIT | 属于开放检索组件 |
| 模型与数据集 | 研究模型和检索数据 | 按各项目许可证 | 需逐项核对商用范围 |
| Paradigm平台核心 | 管理、权限、界面和企业服务 | 闭源商业产品 | 不能从公开仓库完整自建 |
定价方式
LightOn没有公开统一的固定金额,Paradigm通常按照用户席位、所选方案、部署架构、基础设施和服务范围报价。平台强调固定席位或基础设施定价,而不是单纯按生成令牌计费。
| 方案或版本 | 公开价格 | 计费方式 | 主要权益 | 适合用户 |
|---|---|---|---|---|
| SaaS | 联系销售 | 按席位及所选方案 | 主权云托管、快速上线和平台运维 | 团队、部门和快速试点 |
| 混合部署 | 定制报价 | 席位、云端算力与服务合同 | 数据留在客户侧,主权GPU提供推理 | 受监管企业 |
| 本地或私有云 | 定制报价 | 软件许可、席位、算力和支持 | 完整客户侧部署与权限控制 | 大型企业和公共机构 |
| 隔离网络 | 定制报价 | 项目合同 | 断网部署、机密环境和专门支持 | 国防与关键基础设施 |
| 白标与转售 | 定制报价 | 合作伙伴合同 | 品牌定制、API报表和客户交付 | 云服务商与集成商 |
| 检索API | 联系销售 | 基础设施或容量方案 | 多模态RAG、搜索和推理接口 | 软件厂商与产品团队 |
询价前需要确认
- 席位数量、管理员数量和外部用户范围。
- SaaS、混合、本地或隔离网络架构。
- 需要接入的模型及其独立许可费用。
- 文档规模、增量同步频率和存储容量。
- OCR、检索、推理和并发性能要求。
- SharePoint等连接器是否包含在方案内。
- SSO、SCIM、审计、备份和高可用范围。
- 实施、培训、升级、支持和SLA费用。
- 测试、预生产和灾备环境是否额外计费。
企业安全与合规
Paradigm强调GDPR、数据驻留、传输与静态加密、细粒度权限和审计能力,产品页面还列出SOC 2 Type 1合规。具体认证范围、部署边界和合同承诺应由客户安全团队核对证明文件。
| 控制项 | 平台能力 | 采购时的验证重点 |
|---|---|---|
| 身份管理 | SSO、自动账户配置和用户组 | 协议、角色和离职回收 |
| 访问控制 | 工作区、集合、Agent和工具权限 | 是否继承企业目录权限 |
| 数据加密 | 传输和存储加密 | 密钥归属和轮换方式 |
| 审计 | 活动日志和管理报表 | 覆盖事件、留存和导出 |
| 数据驻留 | 欧洲主权云或客户基础设施 | 备份、日志和支持访问位置 |
| 隔离 | 租户分段、私有部署和断网模式 | 网络、模型服务和更新通道 |
| 合规 | GDPR及SOC 2 Type 1声明 | 认证主体、有效期和产品范围 |
隐私与数据处理
Paradigm面向专业用户,处理账户、使用日志、文档和客户配置等数据。数据实际存放和处理方式取决于SaaS、混合或本地部署合同,不能把本地部署的隐私边界直接套用到托管实例。
- 上传前对个人信息、商业秘密和受监管数据分类。
- 确认模型提供商是否接收提示词或文档片段。
- 限制支持人员和管理员访问生产数据。
- 为连接器配置只读和最小范围凭证。
- 制定文档同步、版本、归档和删除规则。
- 确认日志、备份和向量索引的保存期限。
- 离职、部门调整和项目结束后及时回收权限。
适合哪些用户
- 希望在敏感数据上部署生成式AI的大型企业。
- 需要主权云或本地部署的法国及欧洲组织。
- 受严格合规约束的金融、医疗和公共机构。
- 需要多模态文档检索的法务、研发和知识团队。
- 希望建立多个专业Agent并控制数据范围的组织。
- 需要把RAG能力嵌入产品的软件厂商。
- 计划为客户提供白标企业AI的云服务商和集成商。
典型使用场景
| 场景 | 输入 | 输出 | 主要价值 |
|---|---|---|---|
| 企业知识助手 | 制度、手册、项目和技术文档 | 带原文依据的问答 | 减少内部检索时间 |
| 合同与法务分析 | 合同、法规和合规材料 | 条款提取、对比和问题清单 | 辅助法务初审 |
| 金融研究 | 报告、会议材料和财务文档 | 摘要、检索和结构化分析 | 提高研究效率 |
| 工业技术支持 | 设备手册、故障记录和工艺资料 | 诊断线索和操作步骤 | 帮助工程人员定位知识 |
| 公共部门知识库 | 政策、流程和办事材料 | 内部问答和草稿 | 兼顾数据驻留要求 |
| 产品内嵌RAG | 客户文档和应用数据 | 搜索、聊天和Agent能力 | 缩短自建检索周期 |
产品优势
- 部署方式覆盖SaaS、混合、本地和隔离网络。
- 文档检索、OCR、模型、Agent和权限集中管理。
- 支持商业、开源和自托管模型并存。
- 多模态解析适合复杂企业文档。
- 提供REST API、MCP和企业数据连接器。
- 能够按团队和工作区限制Agent知识范围。
- 价格强调席位或基础设施可预测性。
- 官方同时维护开放检索技术和开发SDK。
限制与注意事项
- 没有公开统一金额,采购需要销售沟通和技术评估。
- 本地部署仍需要客户准备算力、存储和运维能力。
- 文档识别和回答不保证完全准确。
- 权限配置错误可能让Agent检索到不应访问的资料。
- 外部MCP服务器的质量和安全不由Paradigm单独保证。
- 不同实例、版本和API密钥可见的模型不同。
- API v2、v3及旧版本文档并存,开发时需匹配实例版本。
- 公开GitHub项目不等于Paradigm核心开源。
- 第三方模型和连接器可能引入额外合同与数据边界。
实施建议
- 选择一个文档范围清晰且价值可衡量的业务场景。
- 完成数据分类、权限梳理和部署架构评估。
- 准备代表性文档、问题集和人工标准答案。
- 在测试环境配置工作区、用户组、模型和连接器。
- 评估OCR、检索召回、回答准确性和原文可追溯性。
- 为Agent工具调用设置审批、权限和审计策略。
- 进行安全、合规、性能和故障恢复测试。
- 培训员工区分检索依据、模型回答和业务判断。
- 小范围上线并记录节省时间、错误率和使用率。
- 确认升级、备份、删除和退出方案后再扩大部署。
常见问题
LightOn和Paradigm是什么关系?
LightOn是开发和运营公司,Paradigm是其面向企业和公共机构的生成式AI平台。LightOn还开发Alfred模型以及多种开放检索技术。
Paradigm可以私有化部署吗?
可以。平台提供本地、私有云、混合和隔离网络等架构,也可使用欧洲主权云SaaS。
Paradigm只能使用LightOn模型吗?
不是。管理员可以接入LightOn模型、商业模型、开源模型或客户自托管模型,但具体可用范围取决于实例配置和合同。
是否支持API和MCP?
支持。Paradigm提供多版本REST API,并能让Agent连接外部MCP服务器;开发时需要确认实例版本、密钥权限和工具范围。
LightOn是开源公司吗?
LightOn公开了SDK、检索库、模型和数据集等项目,但Paradigm平台核心仍是闭源商业软件。开源状态必须按具体仓库和许可证判断。
Paradigm多少钱?
没有公开固定金额,通常按席位、方案、部署架构、基础设施和服务范围定制报价。SaaS、混合、本地和白标方案的成本结构不同。
适合个人用户吗?
产品主要面向专业组织,而不是普通个人聊天用户。个人或小团队若没有企业数据、治理和部署需求,可能难以体现其完整价值。
总结
LightOn Paradigm的核心优势是把企业知识检索、多模态文档理解、模型管理、Agent、API和权限治理整合到可控部署架构中。它尤其适合数据敏感、合规严格并希望减少公共AI依赖的组织。
选型时不能只比较模型回答效果,还要评估文档解析、权限继承、连接器、基础设施、升级、审计和总拥有成本。建议从可量化的小范围场景开始,再根据真实准确率和运营成本逐步扩展。
桂公网安备45132202000164号