VAST半年融资约50亿:曾经的非共识玩家,成了「世界的基座」|智能涌现首发
创业3年,即使经历过大模型赛道从萌芽到狂奔的全过程,VAST创始人兼CEO宋亚宸依旧觉得最近发展速度“超出预期”——对世界模型、UGC交互内容平台的共识形成得极其迅速。在他原来的设想里,“可能还要再讲十年,(3D)技术才能成熟,大家才能慢慢理解这是什么”。
近期,他创办的人工智能公司VAST完成了B轮和B+轮融资,金额合计约30亿元,由经纬创投领投。
其余投资方包括:完美世界、蓝色光标、芯动能投资、延趣游戏、中科创达、广电投资、三七互娱等一线产业资本,鼎晖VGC、中金资本、CMC资本、洪泰基金、三正健康投资、中平资本、福建产投基金、福创投、卓源亚洲、江西金控等一线财投。
与此同时,老股东达晨财智、春华资本、四三九九、慕华科创、绿洲资本、渶策资本、华控基金持续超额追投
不到半年,VAST累计融资约50亿人民币,刷新了AI 3D领域的融资额纪录。
迅猛的融资节奏背后,值得关注的一点是,最近几个月以来,VAST投资方的背景变得更加多元——来自汽车、电商、游戏、消费电子、XR、影视、⼴告、⽂旅等多个产业方资本,纷纷加注这个赛道。
正如Salesforce投资Anthropic并接入Claude,BMW加注Figure AI并将机器人引入生产线,下游产业资本的加注,往往意味着技术发展进入新的阶段:从“可用”,变得“好用”;技术带来的巨大商业回报,也从BP上的数字,变成产业方肉眼可见的效益。
产业资本首先看好的是VAST的技术能力。
8月,VAST刚刚推出最新一代AI 3D基础模型Tripo P2.0 Preview,这是全球先一步能在数秒内生成高质量四边面网格的3D大模型。
和上一个版本P1.0对比,P2.0的生成精度、面数范围等能力都有了质的飞跃——单面数上限由2万三角面提升至5万三角面,同时还新增了原生四边面拓扑模式,最高支持2.5万四边面。

产业方真金白银押注的另一面,则源于VAST突出的落地和商业化成绩。
当下,VAST是为数不多同时拥有自研的基础模型,又在垂直领域中拿到商业化结果的AI创业公司。其核心产品Tripo Studio目前已经服务了全球数千万用户,3D原生基础模型Tripo,则已经接入网易、腾讯、字节、微软等国内外公司的工作流。
“3D是世界的原生表征。”宋亚宸曾表示。VAST如今的备受追逐,也源于它恰好站在当下投资人们的相信上:大模型的下一阶段跃迁,将发生在对物理世界的理解、模拟与交互。
要持续领跑每个阶段,模型和应用必须要一起抓——基模决定着落地场景的边界,而平台将承接应用与商业化。
不过,VAST无意为自己描绘一个爽文式的剧本。此前,宋亚宸数次在公开场合承认:公司刚成立时,一上来就想做UGC交互内容平台,但很快发现3D领域的“手机摄像头”还没被发明出来——在一个赛道技术、产品都远未成熟的时期,单凭一家公司的力量,也难让3D UGC内容走到商业闭环。
想明白这点后,宋亚宸带着团队完成了从模型到平台的“两步走”:第一步,解决基础模型和新生产力的问题,让每个人都可以零门槛、零成本、实时地创作;第二步,建立平台,把内容和体验分发给终端消费者,并完成商业化。
宋亚宸相信,AI 3D会带来新的平台级机会,其潜在市场规模会比我们如今熟悉的内容平台大得多。
“让AI适应人类工业标准,而不是反过来”
“如果有人告诉你一天能生成10万个资产,你会做什么?”这是VAST首席科学家曹炎培,过去一段时间常常思考的问题。
这样的假设在半年前听上去还像天方夜谭。
在传统3D工业管线中,极花时间的重拓扑和绑定,艺术创意成分很少,本质上是繁杂的人工劳动——手工重拓扑单个资产要数小时到数天,是整条生产管线最大的人力瓶颈。一旦卡在拓扑和绑定上,整体的制作节奏都会被拖慢。
要让AI生成的3D资产更直接地进入生产管线,需要实现原生mesh生成,即直接在mesh表示上生成具备合理面数、规整结构和恰当拆分的3D资产。
大模型时代来临之后,并不是没有人尝试解决这个问题。
时间拨回2024年,AI 3D赛道上尤为火热的技术共识其实是自回归(Auto-Regressive)。
自回归范式在大语言模型上取得的巨大成功,让3D领域深受影响。不少研究者试图将3D表示序列化——原本不存在天然线性顺序的mesh(网格),被编码成一个个排好序的token,再像生成句子一样逐个预测。
两三年来,自回归路线的确让行业尝到了“甜头”,MeshGPT、MeshAnything等项目实践证明,基于自回归路线,3D模型可以生成低面数、结构紧凑、具有一定生产价值的原生mesh。
不过,VAST很早就意识到,自回归为原生mesh生成带来的,是一种“虚假繁荣”。强行将mesh塞进序列化的表征,会造成信息的折损,一旦追求更高的上限,误差积累等问题便会集中暴露。
“这其实是在原始数据和最终想要的资产之间,绕了很远的路径。”VAST首席科学家曹炎培表示。
这一领跑于行业的判断,源于VAST自成立以来坚持的原则:“生成即可用”。用曹炎培的话说,“要让AI适应人类的工业标准,而不是反过来”。
“要在秒级内生成高质量网格,不可能走自回归路线——以现在的算力和范式,要生成几万个面,不可能在一秒内生成几万个token。”曹炎培说。
这迫使VAST走上一条难度更高的端到端路线:直接在3D模型最原始的网格数据上训练,一次性整体生成——这也是VAST如今基座模型Nexus的核心训练思想。
为了达到这个目标,VAST重构了整个模型和数据管线,包括全球规模庞大的3D原生数据资产库,以及自研的训练与推理基础设施。同时,团队还同步构建将研究原型推进到鲁棒高效线上服务的工程体系,这意味着,实验室中的技术,最后能够落地为用户可以稳定使用的产品。
模型能力迭代的拐点,始于VAST对自研算法框架Nexus的探索。
相较于线形生成的自回归路线,Nexus把顶点与拓扑的生成解耦,用分层扩散由粗到细全局生成顶点,再通过“时空区间”编码任意拓扑——简单理解,先生成整体,再补充细节。
基于这一路径,Nexus首次基于扩散模型实现完全无需排序的原生网格生成。相关论文被国际图像学顶级会议SIGGRAPH收录。
在扩散路线上的先发优势、敏锐的know-how,以及训练资源的持续投入,让VAST在AI 3D领域稳居算法全球SOTA——Tripo P1.0是全球先一步能在数秒内输出生产级网格的3D大模型,较市面其他方案提速百倍;P系列自今年3月上线至今,行业尚无达到同等效果的模型产品。
Nexus带来的底层算法优势,很快又在今年8月上线的P2.0 Preview上得到验证。
长期以来,四边面网格一直是游戏、影视等行业生产的工业标准。但多条传统的重拓扑路线,都无法兼顾四边面的生成速度和质量。
在Nexus框架下,不同面类型(面的阶数)的生成,成了模型自带的能力;同时,不需要经过先生成高模、再转换的漫长流程,多边面网格可以在一次生成中直接产出——这让Tripo P2.0成为全球先一步实现原生四边面拓扑的3D原生基础模型,生成的3D资产,可以直接满足工业生产标准。
这是非共识的胜利,也是第一性原理的胜利。
模型能力的边界,创造世界的边界
在曹炎培看来,过去三年模型能力的进展,本质上都是在解决模型侧的3D资产供给问题。和以前需要半个月才能获得一个主角资产相比,“一旦内容产量提上去了,内容消费者们会做很不一样的选择”,这会为内容领域带来制作范式和思路上的质变。
在C端,模型厂商在视频创作、Vibe Coding上的实践证明:模型能力,决定需求边界。这一定律同样在AI 3D领域得到验证。
Tripo P系列上线以来,全球越来越多的开发者,开始基于模型的Coding能力,“口喷式”开发包含3D交互内容的网页、游戏等产品。
比如,海外独立开发者@thebuggeddev已基于Tripo,以及Claude Code、Codex等Coding模型,创作出多款精美的3D互动网页。从3D资产生成、网页搭建,到Three.js代码编写与渲染,整个创作流程无需依赖Blender等传统专业工具,开发者仅通过自然语言与代码即可完成从模型到可交互网页的搭建。
近期,他在X上发布的3D人体解剖交互应用,被OpenAI总裁Greg Brockman转发,原帖收获超万赞。而这个精美网页的制作过程并不复杂:先用GPT Image 2.0画出设计图,逐个生成器官图片,再用Tripo把它们一一变成3D模型,最后,交给Codex写代码组装。
在不少C端创作者看来,Tripo P系列模型,尤其是最新发布的P2.0,生成迅速、拓扑干净、分件贴合语义结构,恰恰满足了Agent理解、编辑3D资产的要求——这也让Tripo P2.0,成为迄今尤为适合Vibe Coding的3D原生基座模型。
更摧枯拉朽的质变,发生在位于下游的千行百业中。
当下,Tripo P系列的能力跃升,让AI生成的3D资产第一次可以不经人工返工,直接被各个行业的生产管线接住。即使是小白用户,“言出法随”也真正成为可能:无需学习复杂的建模和渲染,一句话就能获得高精度的、可以用于下一阶段加工的白模。
帮助下游内容行业提效,是VAST落地的第一步。
游戏是AI 3D极早落地、也吃得极深的行业。如今,AI已经同时进入了两条通路:大厂的美术生产管线,和玩家自己的创作工具箱。
在B端管线,Tripo Studio已经进入网易、腾讯、微软等团队的美术生产流程,用于概念生成、场景资产快速搭建、关卡原型验证和多方案比较。曾经有游戏公司平均用2.5个人加上2周时间,完成了原本需要数月的大空间场景搭建。
在玩家侧,网易《蛋仔派对》2025年就与VAST达成战略合作。2026年7月,蛋仔工坊再度与Tripo联手,上线了3D模型拆分功能——AI生成的模型可以从一个整体拆成多个可编辑、可组合的部件。
进一步,随着3D AI生成的实时交互性进一步提升,它会成为游戏玩法本身。
在网易《燕云十六声》基于Tripo API上线“万物太极”后,玩家上传一张照片,系统就可以实时生成对应的3D拟真模型。玩家真正可以做到“遇河造桥、遇敌造树”,生成的3D内容会直接改变地形和互动方式,成为游戏开放世界的一部分。
同样的逻辑,正在游戏之外的行业里重复上演。在Tripo的实践中,AI 3D已经能够在多个行业的核心工作流里,补上“从想法到可用的3D模型”这段极其难走的路。
3D打印是一个典型例子。
如果说硬件突破、价格下探,点燃了3D市场第一波大增长——市场研究机构CONTEXT数据显示,2026年第一季度,全球3D打印设备收入同比增长了32%。但要支撑这场爆发持续下去,内容侧必须有3D生成模型的支撑。
如今,Tripo已覆盖拓竹、黑格、纵维立方、创想三维、爱乐酷等几乎所有头部3D打印硬件厂商。Tripo H系列模型面向高保真3D打印场景,生成水密性模型无需修复即可直接切片打印。2024年底,作为最早接入拓竹MakerWorld的AI 3D大模型,自H2.5系列到最近的H3.1 Ultra,Tripo帮助3D打印用户实现“上传图片—生成3D模型—切片打印”的全流程闭环,原型制作速度提升约90%。
在影视领域,近期,由苹果、皮克斯成员创立的海外创意平台Intangible AI、国内视频生成平台TapNow等多个视频创作平台的“3D导演台”,都接入了Tripo——影视行业对3D原生基础模型的需求,源于精准控片的刚需。如今Tripo P2.0能在几秒内产出白模和预可视化资产,影视团队可以先在3D场景里规划镜头、机位和调度,再进入正式拍摄,省去了此前大量的前置建模投入,实现精确控片。
XR为人、物理世界、虚拟世界的交互提供了硬件入口,VAST则为其提供更为丰富体验和交互形式。
近期,VAST已开发出适配新一代XR设备的原生AI 3D生成应用,无需手柄或专业软件,语言描述即可生成3D内容,再通过眼动与手势操作。与此同时,VAST算法团队还与香港大学、PICO等机构开源了双目世界模型StereoWorld,既消除了单目模型在用户移动时的空间漂移,也能把现有单目视频转换为双目立体内容,为AI 3D在XR行业的落地打好了地基。
资本往往会沿着生产力变革的方向流动。
VAST本轮融资汇聚了来自游戏、XR、影视、广告、文旅等不同产业的资本,这些产业方同时也是3D内容的生产者与使用者。资本、技术与真实场景开始在同一条链路上汇合,也意味着Tripo正从“生成工具”,成为千行百业的AI 3D基础设施。
帮助产业降本增效只是起点。VAST更希望用AI创造消费级的增量——“我们希望用智能让每个人都能享有可交互的极致体验,最终实现让3D成为每个人表达自我、构建世界的本能。”宋亚宸曾提到。
这一目标的最终图景,是让普通人不仅能够基于AI模型“造物”,还能“造世界”。
今年6月,VAST推出了世界模型研究项目Project Eden(伊甸园计划)。基于Eden生成的“世界”支持多玩家并发、具备原生持久性,还能像真实世界一样持续演化。
目前,Project Eden已展示了“文本到可交互仿真场景”的生成流程,生成资产自带碰撞体、关节与物理属性。随着能力持续迭代,Eden将作为下一代交互式内容的底层引擎,让每个人都能直接生成并进入一个长程持久、可交互、具备物理规则的世界——一个代表性的进展是:SIGGRAPH 2026上,项目演化出的生成式渲染器(generative rendering),演示了其在具身智能仿真场景下的应用。
从3D互动内容到创造“世界”,AI时代的内容基建始终绕不开几何一致性与AI 3D。“它(AI 3D)不只会改变3D内容,还会影响人类对物理世界的理解、仿真与交互。”VAST的天使轮独家领投、本轮加注的绿洲资本创始合伙人张津剑表示。
这也许才是真正接近VAST创始人宋亚宸终极想象的时刻。“如果机器人替代第一产业、第二产业,人工智能替代第三产业,生物医药让人活得更久,那么最终,这个世界可能只剩下一个产业——创造世界、体验世界。”他说。
责任编辑: 流过
