欢迎光临北京软件和信息服务业协会官方网站
GPT-6 会建 3D 模型了,不是靠「生成」,是「会用 Blender」
发布日期:2026-09-17    来源:翠鸟智擎科技    分享到:

那栋房子是它「操作 Blender」搭出来的

这是整件事的技术核心,也是最容易被演示效果盖过去的地方。

  • 市面上的 3D 生成模型(比如各种 native 3D generator)走的是一条路:

    给个提示或图片,模型直接吐出一个网格(mesh),大概九十秒出个基础模型。

  • Astra 走的是完全不同的另一条路——它像个会用软件的工程师那样操作 Blender 本身:

规划场景,写出真实的 Blender Python 代码来建对象、加材质、摆相机,然后无界面地跑 Blender 渲染出一帧,回头看这张渲染图,发现和要求不符就改自己的脚本,再渲染、再看、再改。

32231eef-3b14-47ce-aebb-d2df76dbd036.png

看它的模型页就明白了:Astra 的输入是文本和图像、输出是文本。

也就是说,那栋房子的几何体不是它「生成」的,是它写代码写出来的。

发布会那个把美术宫(Palace of Fine Arts)建进 Blender 的案例更说明问题——

它先查档案蓝图和老照片,写代码重建立面,用自己的渲染结果核对比例,比例不对再回去改,然后才继续。

扩散模型是凭想象画一个 3D 物体,Astra 是打开建模软件、一行行把它搭出来、边搭边照镜子——

交给你的不是一张定格照片,是一个还能继续改的工程文件。


01. 这个区别为什么重要:它把生产过程交到你手里

  • 直接生成 mesh 的模型有个天花板:

它给你的是一个成品,导出即用,但你很难在它内部继续精修——它不理解对象之间的坐标关系、相机、灯光、场景状态。

  • 而操作 Blender 意味着 Astra 必须理解这些,还要理解「改这一步不能把前面几步毁掉」的动作顺序。

结果是它交给你一个可编辑的生产环境:打开那个 .blend 文件就能接着改、换材质、调布局。

ced44fcc-05b0-433d-a22f-2bfa252e3698.png

对建筑、游戏场景、可玩原型来说,这等于把「一版可信初稿」的成本一下子打了下来。

有个游戏工作室 Playco 做过实测:

从一个灰盒地基出发,Astra 做出了三个能玩的游戏原型,而且开发过程中人工返工比传统流程少了约一半。

这个数字如果站得住,是实打实的效率变化。


02. benchmark 有硬提升,但漂亮数字要拆开看

支撑这些演示的能力,有个专门的测试 BenchCAD——考模型能不能从多视角渲染图反推出 3D 物体,

方式是让它生成 CAD 代码(CadQuery)去重建,一共 17900 个工业零件。

这里又有一个典型的「口径要较真」的地方:

口径

Astra

GPT-5.6 Sol

Claude Fable 5.1

 BenchCAD 裸分

  57.9%

  37.3%

  55.8%

几何重叠(带工具)

95.9%

83.3%  

84.3%

被到处引用的是 95.9% 那个,听着几乎完美。

但那是带工具的几何重叠分;同一个 BenchCAD,裸分只有 57.9%。

7aca1758-ea1b-4cc3-afa0-2feb8fda1f4a.png

57.9% 相比上一代 37.3% 已经是大跳,也确实领先 Claude,这是真进步——但和「95.9%,快满分了」给人的印象差着一个量级。

看这类发布,先分清厂商想让你记住哪个数、独立复核的又是哪个数。


03. 形状对了,离「能用」和「能造」还差最硬的一公里

这是我觉得最该给这波热闹泼的一盆冷水。

BenchCAD 这类测试本质上是形状匹配——重建出来的几何和目标重合度高不高。但形状对,不等于东西能用。

拿它另一个演示 KiCad 画电路板来说:

把电路原理图变成一块布好铜线的 PCB,形状匹配能做到,可真要送去工厂生产,还有公差、约束、可制造性检查一堆关卡要过——这些恰恰是形状匹配测不出来的。

3D 打印同理,模型好看没用,得检查壁厚够不够、要不要加支撑。

设计里最难、最值钱的那部分,往往就在「形状之后」。

96ec4b4e-8a4d-4987-9115-242b7ade7708.png

⚠️ 还有几条早期测试者报的软肋:

  • 规则几何(方盒子、机械件)它做得好,有机形体(人物、生物、自然造型)明显弱;

  • 大型生产文件和陌生插件下的可靠性还没验证过;

  • 社区疯传的那些 SolidWorks、复杂装配演示,多是创作者自己发的、未经独立复核——官方 demo 和网友 demo 得分开看。

94ac46d2-5de1-4d23-b3f8-5d5fa8dd9b48.png

一句流传的评价很到位:

这些作品「第一眼惊艳,第二眼有瑕疵」。

能走的曼哈顿不是能上线的 3A 场景,能玩的 Minecraft 克隆也不是 Minecraft。


04. 还有一笔账:自我纠错是要花钱的

「写代码→渲染→看图→再改」这个自纠错循环是它强的原因,也是它贵的原因。

一个开放式的探索任务,反复渲染反复改,输出 token 能堆到数百万,一次任务花掉十几美元甚至更多很正常(定价是输入 10 美元、输出 50 美元每百万 token)。

指令越模糊、越要它自己试错,账单越厚。

所以它省的是人工,费的是算力——这笔账划不划算,取决于你那个岗位的人工到底贵不贵。

eca2a89b-f93d-40a3-9130-a7c8c2f1457d.png


05. 这波 3D 突破该怎么定性


我的判断是:

Astra 没有让「AI 生成 3D」更强,它做的是另一件更有意思的事——让 AI 成为专业 3D 软件的操作者。

它坐进了 Blender、KiCad 的驾驶座,会写脚本、会看结果、会返工。

这是从「给你一个资产」到「替你控制一段生产过程」的转变,也是它比单纯的 mesh 生成器更值得关注的原因。

但别把演示当成品。

  • 它现在适合干的,是快速出可信初稿、搭原型、做那些规则几何为主的场景铺陈;

  • 不适合的,是直接交付要送厂、要上线、要过公差和可制造性检查的终版——那一公里还得靠人。

更务实的用法,是拿原生生成器快速铺量产资产,再让 Astra 在隔离的原型文件上做深度编辑,最后留一道人工 QC 把关拓扑、材质和文件卫生。

d4af96e0-c78a-4418-8147-359e89b3cb95.png

说到底,它开始接管 3D 创作里「熟练的手上功夫」那一段,把人往上推到指挥和把关的位置。

它会用软件了,但要做出真正能送厂、能上线的东西,这一步暂时还得人跟它一起走。

你知道你的Internet Explorer是过时了吗?

为了得到我们网站最好的体验效果,我们建议您升级到最新版本的Internet Explorer或选择另一个web浏览器.一个列表最流行的web浏览器在下面可以找到.