V2Fun HarmonyOS 7 开发分享:用ArkGraphics 3D打开空间智能想象力
头像 Yvonne 2026-08-19 18:24:01    发布
1184 浏览 1 点赞 1 收藏

我是极顶数创(Vertex Lab)创始人兼 CEO 嵇盼,也是AI 3D 内容生产工具“V2Fun”的负责人。

在过去很长一段时间里,3D 内容生产始终是一件高度专业化的事情。一个可用的 3D 模型背后,往往意味着建模、贴图、拓扑、绑定、动画、格式转换等一系列复杂流程。对于专业团队来说,这些流程会带来高成本和长周期;对于普通创作者来说,这是一道天然门槛。

但我们一直有一个判断:3D内容会成为未来数字世界的刚需基础设施。

无论是游戏、影视、工业设计、机器人,还是未来的世界模型和空间智能,最终都绕不开三维结构、材质、空间位置和交互关系。今天 AI 显著降低了文字、图片、视频的创作门槛,但如果 AI 要真正进入空间世界,就必须跨过 3D 内容生产这道坎,这也是我们做 V2Fun 的原因。


从AI 3D建模到空间内容流转:重塑3D内容的生产关系

V2Fun 提出“重塑 3D 逻辑,解构空间交互,让灵感随处发生”,这里的“重塑”,并不只是把传统建模流程变快一点,而是希望改变 3D 内容的生产关系。过去是先有专业能力,才有 3D 内容。我们希望把这个关系倒过来:先有灵感,再让 AI 补齐专业能力。

具体来说,V2Fun采用“移动端轻量创作 + Web 端专业生产”的双端闭环。移动端负责降低入口门槛,用户拍摄或上传图片,就可以快速得到一个可预览、可分享、可导出的 3D 模型。移动端的用户体验是拍摄或上传图片,AI 自动识别主体,生成 3D 模型,完成 360° 预览,再进行保存、导出、分享或打印。Web 端则承担更专业的生产任务,让创作者继续进行模型优化、材质处理、动作绑定、动画生成和后续工作流衔接。流程背后,V2Fun 实际上连接的是一条完整的 AI 3D 内容生产链路:从图片或文字创意出发,到 3D 模型生成,再到 PBR 材质、网格重拓扑、动画绑定、跨设备流转和 3D 打印。


除了移动端,用户可在V2Fun Web端完成更复杂3D工作


大众要惊喜,专业要确定性,这也是 AI 3D 工具最难平衡的地方。V2Fun选择分层:移动端只做一件事,把默认值做对,让用户传照片就能得到不错的结果;Web 工作台则把控制权交还给专业用户,承担进一步编辑、优化和生产的角色。

V2Fun 背后的核心能力,是团队自研的 3D 大模型和工程化交付能力。我们的 3D 大模型走过三阶段:从图像理解做"二维升三维",到 VAE + Diffusion 的原生 3D 生成,再到现在 VAE + DiT 的新一代架构——DiT 更适合大规模训练和复杂结构,能统一处理几何、纹理、视角与语义,也更能走向场景、动画乃至世界模型。自研模型最大的技术差异在底层两处:一是几何表达,我们用"局部表面证据采样"大幅压缩表示冗余,同等算力下几何精度上限更高;二是纹理生成,用局部-全局双流去噪+稀疏 3D 空间库注意力,做到 8K–12K 且稳定不崩。

为了在移动端可以实现"数十秒"建模生成3D内容,团队在算法创新、工程优化和云端协同方面做了大量的调优工作。算法层从源头少算——几何 token 压缩、纹理侧用稀疏注意力替代密集跨视角注意力;推理层做量化、算子融合、采样步数压缩这些扎实工程;架构层是任务式异步管线,用户看到的第一个可旋转结果,不必等整条链路跑完。

ArkGraphics 3D 等HarmonyOS 系统能力,为开发者打开生态想象力

V2Fun 作为鸿蒙系统首个 3D 大模型 AI 原生应用,已深度接入 HarmonyOS 的系统级能力。V2Fun 与 HarmonyOS 的结合,核心在于让 AI 生成的 3D 内容不再停留在专业文件层面,而是进入用户熟悉的系统级内容生态。

3D 文件过去在手机上有一个长期痛点:用户生成后不知道如何打开、查看、分享。通过 HarmonyOS 的ArkGraphics 3D 等系统级 3D 图形服务,让V2Fun用户能够在移动端实现更自然的 3D 模型预览、旋转、缩放和交互体验。3D 模型不再只是一个专业文件,而是普通用户可以直观操作的数字资产。

另外,端侧 3D 内容运行时,常见问题是模型体积大、加载慢、渲染压力高。团队主要从三个层面解决这个问题:

  • 生成源头轻量化:前述几何表达框架本身就是"最小充分证据"的压缩表示,相比传统 SDF 或密集体素表示,模型数据量大幅降低。
  • 格式优化:支持 GLB(传输优化格式)和 3MF(3D 打印优化格式)等标准格式,针对移动端传输和加载做了专门优化。
  • 端侧渲染:依托 ArkGraphics 3D 的系统级图形能力,而非自研渲染引擎,充分利用鸿蒙在 GPU 调度、内存管理和渲染管线上的底层优化。我们在 Pura、Mate、Nova 等全系鸿蒙设备上做了适配,确保 3D 预览的丝滑流畅。

另外V2Fun团队花了大量精力在生成后的体验和全链路闭环的打通,让 3D 模型在手机上被自然查看、旋转、理解。通过与鸿蒙图库、ArkGraphics 3D 的深度集成,V2Fun 可以让 3D 资产进入用户熟悉的内容管理体系,大幅降低认知门槛;从 AI 生成 → 移动端预览 → 图库管理 → 格式导出 → 跨设备流转 → 3D 打印,每个环节涉及不同系统能力、不同格式标准、不同硬件设备。我们和华为团队紧密协作,在产品适配、性能优化、上架流程等方面做深度联调。对初创公司来说,这种生态协同让我们可以更专注在 AI 3D 核心能力本身

HarmonyOS 空间化能力对开发者最大的价值,我认为是"全场景、多终端、空间智能"的生态想象力。过去做 3D 应用,团队要自己实现或集成 3D 渲染引擎、处理格式兼容性、搭建跨设备传输协议、教育用户如何管理 3D 文件——这些不是核心价值,却消耗大量资源。HarmonyOS 7 空间计算能力让V2Fun团队可以聚焦在 AI 3D 生成的核心算法和产品体验,而把 3D 图形渲染、系统级资产管理、跨设备流转这些能力交给系统。因此,我建议更多想进入空间计算领域的开发者,可以借助HarmonyOS 7的能力,去关注"内容如何在空间中自然流转",而不只是"如何在单个设备上渲染 3D"


3D 是数字世界的底层语言,AI 3D内容的未来发展短期看模型质量,中期看空间计算系统能力,长期看 3D 资产流通生态,并形成相互促进的飞轮效应。模型生成质量是当前最紧迫的瓶颈,决定 AI 3D 能否从"玩具"变成"工具";空间计算系统能力(如 HarmonyOS 7 正在构建的)决定 3D 内容能否从"单个应用"进入"全场景生态";3D 资产流通生态是最终胜负手——当 3D 模型可以像图片一样自由流转、交易、复用,才会真正爆发平台级机会。


我们希望空间智能到来时,中国团队能更多地承接底层能力,而不只是应用层适配。正如V2Fun的长期愿景:不是只做一个更快的建模工具,而是构建 AI 进入三维世界所需要的底层能力,让每一个人都拥有“创造世界”的能力



本文作者:嵇盼 V2Fun负责人、极顶数创(Vertex Lab)创始人兼 CEO

媒体合作请联系:yvonne@vertexlab.ai  


©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。
分类
HarmonyOS

暂无评论数据

加载中...

发布

地址:北京市朝阳区北三环东路三元桥曙光西里甲1号第三置业A座1508室 商务内容合作QQ:2291221 电话:13391790444或(010)62178877
版权所有:电脑商情信息服务集团 北京赢邦策略咨询有限责任公司
声明:本媒体部分图片、文章来源于网络,版权归原作者所有,我司致力于保护作者版权,如有侵权,请与我司联系删除

京ICP备:2022009079号-2

京公网安备:11010502051901号

ICP证:京B2-20230255