先说结论
这期节目最有信息量的地方,恰恰不是"抖音早期负责人再创业"这个标题党叙事,而是一个反向的坦白:卷卷承认互联网的成功经验在制造业大部分不可复用,甚至有副作用——对增长的渴望、对极致质量的执念,都让他在实体交付上摔过跟头。数美万物做的事情是"图生3D → 可打印 → 可交付"的完整管线:模型端2048³精度、文字符号的几何级还原号称全球独有;制造端自建广州番禺实验工厂,T+7准交率做到90-95%。当多模态视频模型正在把AI 3D的游戏、影视应用场景"跨模态吸走"时,实体制造反而是3D绕不过去的护城河——这是"基础模型不会吞噬一切"这个判断的行业注脚。
从雕刻时间到雕刻空间:两次从零到一的共同方法论
卷卷复盘抖音立项时,给出的不是产品神话,而是一套基建变量分析法:2015年底政府工作报告提出2016年全面降低家庭宽带资费、提升网速,5G基建启动;硬件侧OV华米不约而同在2016年普及大屏,利好影像采集(手机摄像头)与渲染(GPU)。在他看来,快手(朴实的记录)和Musically(音乐趣味表达)验证了内容方向,公司管理层据此立项火山小视频和抖音两个产品,后者交给了他——一个当时没有做过产品、运营出身的nobody。
这套"先看变量、再选赛道"的方法直接迁移到了数美万物:这次的变量一个是AI(2022年底Midjourney让他第一次感知到AIGC的magic,还有prompt engineer这个词的流行),另一个是他在Pico做VR时亲身遇到的三D资产产能瓶颈——三D资产制作成本极高、周期极长,接近迷你版3A游戏制作。加上他个人长期混翡翠吧、茶吧积累的制造业产业带兴趣暗线(材料、设备、工艺、产线),两线交汇成创业方向。他给这个转变的概括很漂亮:抖音是帮用户"雕刻时间"(表达欲的普惠),数美万物是帮用户"雕刻空间"(创造欲的普惠),三维空间加一维时间,正好是人能理解的四维世界。
融资规模累计过亿美金,最近一轮约五千万美金,团队一百大几十人,服务全球用户——这是节目给出的公司基本盘。
Twinkle 3.0现场演示:文字几何还原与"脑补背部"的能力
节目录制当天恰逢其新模型上线。卷卷现场演示的核心卖点有三个:
**一是2048³商用级超高精度下的还原一致性。**博美犬案例中,宠物手办要求神态还原——主人对自家宠物的神态一眼能识别,这对一致性的要求远高于普通商品。毛发在传统三D建模里要用电子笔刷一根根刷出来,而模型从纹理还原到了几何层面。
**二是文字符号的几何级还原。**计算器上的字母、数字、复杂符号,面具收纳箱上每个面具的名字,甚至《天净沙·秋思》的书本模型——中文以雕刻(凹刻)形式呈现在几何上,深浅有别,重笔轻笔可辨。卷卷称这一点"目前全球AI生成三D领域只有我们这版模型做得到"。他还给出一个时间参照:图片生成对文字的精准可控也是去年下半年才发生的事,三D在几何层面追上这个能力,节奏并不慢。
**三是从单张正视图推演不可见部分。**斗牛士与牛的铜雕案例中,输入图上牛的前肢遮挡人的后背,模型既要正确理解位姿关系,又要"脑补"出看不见的背部肌肉线条与衣服褶皱;关之琳人像案例中,原图刘海飘起、有光影干扰,模型干净处理了阴影(否则头发会生成一坨黑),还推演出合理的发辫。金刚狼头雕去贴图看白模、黑悟空甲胄的内部结构推理、佛牌背部的浅雕细节,都属于同一能力维度的展示。
他解释3.0的提升来自三件事:高质量数据投入达到空前规模(依赖长期积累+清洗标注)、三D表示的新技术路线、以及训练后管线化的后处理算法(比如对输入图光影的理解与剥离)。过去建一个六臂观音坐莲这类模型"少说一个月",现在一张图直出白模再局部修补即可。
基础模型吞噬不了的部分:拆件、加桩、摆盘与T+7准交率
这是整期节目里行业价值最高的段落。卷卷的判断是:AI 3D的应用场景正在剧变——2025年还均匀分布在游戏、3D打印、电商、影视、建筑、教育等领域,2026年上半年第一大场景已经是3D打印(直接指向制造落地),而游戏影视的占比大幅下降。需求没有消失,而是"被跨模态的视频模型、甚至coding方向更好地满足了"。但实体制造领域,很难用视觉化的表达解决生产问题,三D绕不过去。
数美万物的差异化正落在这个"绕不过去"的链条上。Koji问得直接:国内做3D模型的友商很多,为什么你们的优化目标和别人都不一样?卷卷的回答是他们的目标是"准确的可以打印",这反向决定了模型训练:几何精度、结构理解、已实际生产过的材料与结构力学信息都进入数据构建和调参目标;基模之上还有大量指向落地设备与工艺的后处理模型。具体能力包括:
- 语义分割与拆件:基于AI模型对人体的部位按结构合理拆分;
- 加桩:在拆分件上自动添加球形、榫卯、铆钉连接结构件——这是传统制造几何领域的问题,他们用AI模型与传统几何管线融合解决,并称"目前全球唯一只有我们平台能提供";
- 自动摆盘:托盘尺寸有限、大模型需分部件摆盘,位姿决定支撑强度、打印时长与拆支撑时的损坏风险;
- 智能调参:不同材料的打印温度不同,用户口中的"炒面"往往既不是模型问题也不是设备问题,而是调参问题——系统自动识别模型并给出参数,统一进3MF格式直接导入切片软件。
生产级的标准被他量化为一个商业命题:“高并发的非标商品订单的准时交付率”。每个订单造型都不一样,要在承诺时间内统一交付,传统管线靠人工逐个建模保质量,交付周期必然卡死。造好物目前的做法是T+7物流发出,准交率90-95%。如果模型不能近乎直出,人工修模的成本会让"高并发+个性化长尾+准时"三者构成商业悖论。为守住这个标准,他们设了线下实验室,采购市面上主流硬件设备,请外部专业建模师组成评测专家团,每天测试软件报错(非流形、破洞、不水密)、一键打印成功率、悬垂失败、多色映射异色等问题——用他自己的话说,“实打实自己试图建立一个行业的标准来评测可落地性”。
制造业的学费:自建工厂、交付时效的教训与Maker OS愿景
互联网人进制造业交的学费,卷卷讲得毫不留情面。第一个摩擦是语言不通:对产业带工厂讲AI概念没人理解,工厂关心的是"有订单吗?能保利润吗?能养活我的工厂吗?"——提效不重要。被逼无奈,他们在广州番禺自建了一个小型实验工厂:工业级3D打印机、激光切割雕刻机、小型CNC、柔性面料板房,覆盖树脂、金属、毛绒布艺,并和产业带共同探索陶瓷方向。第二个摩擦是增长惯性:做用户产品的人对数字和规模有天然渴望,但"行业的变量没有来临之前,你很难用外力让规模变大"。
最具体的教训是交付时效。早期他对商品交付质量极度较真,追求极致,结果承诺十天的订单拖了一个多月——用户不再关心你的质量追求,只看到履约失败,“不再给你再一次试错的机会”。同事直接批评他"想法幼稚",他接受了,建立了准交率标准,把质量定义为其中一个维度而非无限追求的目标,业务才顺畅起来。这个故事是他整场"轴与认错"张力的最好注脚。
为什么软件公司要碰这么重的制造?他的答案是路径依赖:最早上线的是造好物,要解决用户多样商品的落地就必须解决模型端问题,当时市面上没有可用的模型,而他们恰好有数据和技术预研,于是补做模型——创业快一年才上线To C产品,模型反而是先行的。之后1.0模型2025年6月发到Hugging Face公开评测,获过千赞,与微软Trellis(转写作"Trails",疑为TRELLIS)、腾讯混元、Stability并列为3D垂类仅有的四家过千赞模型,才顺势推出Hi3D平台。
对外的想象空间分两阶段:先是Maker行业的OS——综合3D打印、激光、CNC、柔性面料等多种工艺,连接桌面级与工业级设备(光固化服务即将推出,含空腔积液自动打孔);再到制造业的OS——连接各行业,解决实体制造的软件侧管线基建。与拓竹MakerWorld的关系他明确表述为合作而非竞争:数美万物的模型也在MakerWorld上提供接口服务,但MakerWorld以3D打印和激光为主,柔性面料尚无,工艺多样性是自己长期定位的差异。
值得展开的是柔性面料这个新战场。他观察到的信号是Maker市场正从偏男性的硬体材料(3D打印、激光、CNC)向女性Maker市场扩展——妈妈辈织毛衣、老婆辈十字绣、更年轻一代玩钩针刺绣毛毡。深圳已有不少硬件背景团队在做柔性材料处理设备的桌面化小型化立项。数美万物对应的软件侧研究是毛绒数字化开版算法和AI刺绣算法:毛绒玩具多是世界上不存在的凭空创造角色,没有真人台模可参照,他们用图生3D先建"一模",再在三D表面找分割线拆画片、处理弹力系数(曲面展开时在张力大的部位裁剪卸力,得到纯平纸样),最后输入冷激光切割机裁布、车缝填充。刺绣的逻辑是格式映射:任意图片→.emb矢量文件(针迹路径+颜色信息)→.dst电绣设备格式,对应3D打印的STL。这里还有一个行业危机感:培养一个资深版师要十年起步,人才稀缺而需求爆发,AI开版既是提效也是补产能缺口。
行业生态观察:3D打印农场、创作者激励与去工业化大背景
对3D打印农场,他坦承自己认知"还谈不上深刻",但给出的行业图景很具体:小农场三百五百台,大农场厂房里过万台甚至三万台;需求大头是满足海外市场商品。核心问题有两个:一是商品同质化——铰链龙、解压挤压球火一条街都在打,下一个爆款在哪是所有农场要回答的问题;二是创作者没获利——模型网站上下载量最高的模型被农场批量生产,原作者的收益无人保障。数美万物的解法是在Hi3D平台连接农场做一键下单派单,同时从下载和商品购买两个环节抽成反哺创作者,试图构建"尊重创意、尊重版权"的正向平台关系。
支撑这个市场的时代要素,他归结为两点:全球去工业化几十年,老百姓的商品需求遇上贸易对抗下的供给不足与价格昂贵,小型DIY设备成为解决需求的现实选项(疫情是加速器);社交媒体让"手搓手办"的内容激发模仿与创作者职业化,3D打印农场本身就是需求端爆发的产物——解压玩具、铰链结构这类商品只有3D打印能做,注塑量产反而做不出这个工艺。设备端的数据他引用得很具体:回溯过去五年桌面级3D打印设备年复合增长率23%以上,3D打印设备出口连续几年位居海关不分品类增速Top 20;去年年出货量五百万台,他判断年出货过千万是确定性事件;中国电商平台上桌面3D打印机已是打印品类下的Top商品——第一名不再是纸质打印机。
一个人和他的张力:INFP的F、CEO的T,以及"让子弹再飞一会儿"
这期节目的后半段是罕见坦诚的创始人自剖。他说自己本质是feeling驱动的INFP,判断常起于"灵感乍现那一刻",然后用产品经理训练出的T把自己拽回来拆解验证——运营出身的感性理解与产品工程的理性落地在他身上反复拉扯。抖音时期的反面教材是:他曾用个人审美约束内容画风,调整后发现效果不好,在双月会上公开自我检讨"用个人想法左右了用户需求",转向尊重内容多样性后,投稿率、留存、用户规模都涨了。这引出他引用的三句话:“学于贤者是为君子,学于圣人是为贤人,学于众人是为圣人”——圣人向众人学,大规模用户画像让他见过了众生相,谦卑与成就他人由此而来。
创业心态上他描述了三个阶段:乐观→觉得什么都做不成→能做好一点点小事。如今"每天都在坐过山车——我说的是每天的每个时段",应对方法是情绪剥离、关注问题本身,口头禅是"别急,让子弹再飞一会儿"。张楠(他称"贵人")反复批评他"过于乐观、沉浸在自我视角";一鸣留给他反复参悟的话是"事儿烦心不烦";如果还在和一鸣开周会,最可能被问的问题是"你做的事情变量有多大?要么质变要么成本大幅降低,别总做小优化"。他自认底层是自卑的——贴吧小白管吧主、运营序列出身做第一个产品——而自卑被定义为"对自己苛刻的认知",用学习和实践缩短能力与目标的差距,“行动是治疗焦虑的良药”,这接近他挂在嘴边的王阳明心学知行合一。
对外他会给想来咨询创业的前同事泼冷水:“没事儿,别创业"“别没苦硬吃”。劝退不了的是泼完冷水依然义无反顾、且其逻辑你无法用知识结构否定、在做增量创新的人。他总结自己的两个词是"赤诚”(专注问题本身)与"无心"(做和自己利益无关的利他之事,佛家"无心而为"、菩萨渡己亦渡人)。对年轻员工的建议则是反直觉的保守:“机会往往不是找来的,而是等来的”——在现有岗位上沉淀足够深,机会在足够深的积累中发生转机。管理上他自述"越来越不nice了":拿了股东的钱、组织了优秀的人,就不能以个人情感导向做管理决策;好的领导力第一件事是认知自己、敢于带团队推翻自己错误的言论,第二件事是先做好负向管理(辨识人岗不匹配并调整)而非只做升职加薪的正向管理——他用本我与超我的切换来解释这种角色分裂,并提到英特尔前CEO《只有偏执狂才能胜利》里"脑补自己是新任CEO"的清零方法。
这场访谈对行业的三个判断
**第一,3D是国人从AI模型发展初期一路领先到现在的模态。**其他模态是中美博弈式攀登,三D领域"基本都是国人的团队在引领",这一点在节目中被他反复强调为"值得中国人骄傲的事"。但应用方向分化明显:数美万物深耕高精模型(生产制造、游戏高模、影视CG),而小游戏低模拓扑、绑骨动画等领域友商做得优秀,垂直深耕会是往后格局。
**第二,“AI时代的抖音"大概率是给现有平台做嫁衣。**卷卷的判断是:内容领域做开创性产品必须能定义内容的新格式——抖音是竖屏加音乐,B站是横屏加弹幕,早期Ins和小红书是图片打tag。只聚焦模型效果而不在格式上创新,用户用完好的模型产品,第一时间想到的是把内容发到已成型的网络效应平台,而不是你的产品。这个判断对当下所有"AI时代XX"的创业叙事都适用。
**第三,数据获取是3D模态最深的护城河,而它的本质是信任。**三D是所有模态里最难获取训练数据的领域——数据分散在游戏公司、制造业板房、模型网站。数美万物能拿到产业带、行业协会乃至政府层面的数据支持,靠的是卷卷多年混产业带积累的身份认同:“大家不把我当成纯互联网人……不会怀疑你的动机,不会觉得你获取数据是为了复刻抄袭同款商品。“叠加正规数据采买渠道,这个先发优势同时是后来者的进入障碍。AI时代的行业数据壁垒,归根结底是行业里的人愿不愿意给你。
留一个节目没有回答的悬念:营收数据、造好物与Hi3D的具体用户规模都没有披露,“五千万美金最近一轮"的估值与商业化进度之间的关系无从验证。一个试图成为"制造业OS"的公司,最终要回答的不是模型榜单排名,而是这条管线在多大订单量级上还能守住90-95%的准交率——这是比任何demo都硬的指标。