CSM AI是什么?
CSM AI由Common Sense Machines开发,核心产品Cube是一款面向游戏、设计、动画和仿真的3D生成平台。它可以从文字、草图、产品图或角色图开始,先生成参考图片,再转换为3D网格,并继续完成细化、分割、重贴图和动画。
平台定位是3D创作协作者,而不是替代所有建模软件。快速Preview适合探索造型,Refine用于提高网格与纹理质量,最终资产仍可导入Blender、Maya、Unity或Unreal进行拓扑、材质、绑定和性能检查。
Image to 3D图片转3D
用户上传主体图片后,Cube会先分离对象并生成多个Spin预览,再创建Preview Mesh。确认大体形状后可以执行Refine,获得更高清的几何和纹理。
正面清晰、背景简单、主体完整且遮挡较少的图片更容易生成。单张图片看不到的背面由模型推测,因此精确产品、非对称角色和机械结构更适合使用多视图。
Turbo Preview与Refine区别
Turbo或Preview阶段强调数秒级的快速3D预测,适合筛选构图和形状;Refine需要更多时间和Credits,用于增强几何定义、纹理、光照细节和整体真实感。
先预览再细化可以减少把Credits花在错误构图上。Refine也不能自动保证生产就绪,尤其是关节变形、薄片结构、文字和精确尺寸。
多视图图片转3D
Multi-View最多可上传同一物体的5张不同角度图片,适合要求前后左右更准确的产品或角色。每张图片应保持对象、比例、材质和光线一致。
不同照片的焦距、造型或部件状态互相冲突时,模型可能产生重影和扭曲。应使用固定镜头和背景拍摄,并按需要逐张手动分割。
Manual Segmentation手动分割
图片包含多个物体、复杂背景或细长结构时,可以用Manual Segmentation指定要保留的主体。准确遮罩能够避免把桌面、阴影或相邻道具错误生成到网格中。
Text to Image to 3D
没有参考图时,可先用文字生成适合3D重建的单体概念图,再送入Image to 3D。提示词应明确单个主体、完整轮廓、简洁背景和理想视角,避免一开始生成复杂场景。
Parts-based部件建模
复杂角色、车辆和机械物体可以拆成头部、身体、武器、轮子等独立部件生成,再在3D软件中组合。部件方式能保留更多局部细节,并便于替换和复用资产包。
组合前要统一尺度、原点、坐标轴、连接面和材质命名。AI生成部件不会自动形成严密工程装配关系。
AI Retexturing重贴图
AI Retexturing可以根据文字和参考方向重新生成资产表面,适合修改材质、颜色、磨损和风格,也可尝试修复原图中的Logo或文字。
生成式贴图仍可能拼错品牌文字或在UV接缝处断裂。正式资产应检查UV密度、法线、PBR通道和商标准确性。
Retopology与纹理烘焙
高质量展示模型不一定适合实时引擎。用户可在后续流程中重拓扑、降低面数并把高模细节烘焙到低模。角色还需要为关节和面部变形建立合理边线。
Text to 4D与动画
CSM提供从文字生成动画的方向,可上传FBX网格,再提交一个或多个动作描述生成动画。Text to 4D强调把3D资产扩展为随时间变化的可动画内容。
动作生成适合快速原型,最终仍需检查骨骼、脚底滑动、碰撞、重心和循环接缝。输入网格需要符合官方参考方向与结构。
3D Agent与Blender MCP
CSM探索使用生成式Agent控制3D工具,让用户通过自然语言在Blender等环境中创建和修改场景。MCP方向可把建模工具开放给AI代理执行多步任务。
代理具有修改文件和场景的能力,应该在副本项目运行并设置确认点。自动生成代码、下载资产和批量修改材质后都要人工审查。
套餐与版本对比
| 套餐 | 价格方式 | 主要权益 | 生成内容权利 |
|---|---|---|---|
| Tinkerer | 免费或基础体验,具体额度以账户页为准 | 用于体验基础3D生成,速度、分辨率和工作流有限 | 生成内容采用CC BY 4.0,使用时需要署名 |
| Maker | 按月订阅,金额与Credits以结算页为准 | 每月Credits、高清网格、快速专用服务器和完整创作工作流 | 内容为私有并由客户拥有 |
| Creative Pro | 高级月度订阅,实时价格以结算页为准 | 付费完整能力、早期功能与隐私控制 | 内容为私有并由客户拥有 |
| API或Enterprise | 按Credits、用量或合作方案 | REST API、Python接入、批量生成与Webhook | 按账户计划和合同确定 |
官方公开FAQ没有稳定展示当前美元金额,价格入口需要账户动态加载。购买时应核对每月Credits、Preview与Refine消耗、生成速度、隐私控制、API额度和税费,不应引用旧评测中的历史月费。
免费版与付费版授权差异
Tinkerer输出采用Creative Commons Attribution 4.0,允许在遵守署名等条件下使用。Maker和Creative Pro输出为私有且客户拥有。无论套餐如何,用户仍必须拥有输入图片、角色、产品和商标的合法权利。
导出格式对比
| 格式 | 适合用途 | 注意事项 |
|---|---|---|
| GLB | 网页、AR与通用单文件传输 | 便于携带网格和材质 |
| FBX | 游戏引擎、DCC与动画 | 检查坐标轴、骨骼和单位 |
| OBJ | 静态网格与广泛软件兼容 | 材质和纹理通常分开保存 |
| USDZ | Apple AR预览和生态 | 需检查材质与设备兼容 |
尺寸与Pivot控制
Refine API允许设置三维Bounding Box尺寸与Pivot Point。正确的尺度和原点对游戏放置、旋转、动画和产品展示很重要。生成后仍要在目标软件验证真实单位。
CSM REST API
REST API覆盖Image to 3D会话、Preview、Refine、网格地址、Text to Image、动画、Credits与Webhook。任务采用异步会话方式,应用提交后要轮询状态或等待通知。
API Key必须保存在服务端。下载地址可能有时效,应用应在任务完成后及时转存,并处理失败、超时、重复Webhook与Credits不足。
Python Library
官方Python库封装REST API,可从图片URL、本地文件或PIL图片启动Image to 3D,轮询结果并导出OBJ、GLB、FBX或USDZ。它适合批量资产管线和原型开发。
Python包装库公开文档不等于生成模型开源;调用仍依赖CSM云服务、API Key和Credits。
输入建议
- 使用高分辨率、清晰且主体完整的图片;
- 角色尽量采用T Pose或四肢分离姿态;
- 避免透明、反光、毛发和极细结构占据主体;
- 复杂背景使用手动分割;
- 精确物体提供最多5张一致多视图;
- 复杂角色优先拆分部件生成。
隐私与数据
Creative Pro提供隐私控制方向,免费档内容权利不同。处理未公开产品、客户角色和商业机密前,应核实可见性、训练使用、保留期限、删除方式和团队权限。
GitHub与开源状态
CSM的Cube生成模型、Web平台和云端API不是开源产品。实时GitHub搜索没有核实到由官网明确指向的完整核心模型仓库;同名CSM项目大量来自其他组织,不能视为Common Sense Machines官方代码。
Python客户端或相关代理集成即使公开,也不意味着可离线运行Cube模型。
适合哪些用户?
- 快速把概念图转成3D的游戏开发者;
- 制作角色、道具与环境原型的3D艺术家;
- 需要产品3D和AR展示的电商团队;
- 通过部件工作流制作资产包的创作者;
- 需要AI重贴图和文字动画的设计师;
- 通过REST API和Python批量生成的开发者。
主要优势
- 支持文字、单图与最多5张多视图生成;
- Preview和Refine分阶段控制成本与质量;
- 提供手动分割、部件建模和AI重贴图;
- 覆盖3D动画与Agent控制方向;
- 支持多种主流网格格式;
- 提供REST API、Webhook与Python库。
限制与注意事项
单图无法恢复不可见面的真实结构,精确尺寸、文字、薄片和复杂拓扑仍可能出错。Refine需要更多时间和Credits,付费价格需登录动态查看。
免费输出需要按CC BY 4.0署名。核心模型不开源,云端处理涉及素材隐私;最终游戏或产品资产仍需专业软件验收。
常见问题
CSM AI免费吗?
有Tinkerer基础方案,其输出采用CC BY 4.0。高清网格、快速服务器和完整工作流需要Maker或Creative Pro。
最多可以上传几张多视图?
Multi-View当前最多支持同一物体的5张不同角度图片。
Preview和Refine有什么区别?
Preview用于快速判断造型,Refine进一步提高几何和纹理质量并消耗更多资源。
支持哪些导出格式?
Python库明确支持OBJ、GLB、FBX和USDZ,网页端具体下载选项以当前会话为准。
CSM提供API吗?
提供REST API、Webhook和Python包装库,覆盖图片转3D、文字转图和动画。
CSM AI开源吗?
核心Cube平台和生成模型不开源,没有核实到官方公开完整模型权重与服务端源代码。
桂公网安备45132202000164号