GPT-6 Astra 从图像到3D (四)—— 离优秀建模师的距离
前面三篇里(一、二、三), GPT-6 Astra 在空间理解和工业品建模上的表现相当不错;然而,大家也慢慢发现,Astra 对于造型或细节比较复杂的物体,效果常常「一言难尽」。
我选了跑车、怪物、哈利波特手办三个例子进行测试,前两个例子以 ArtStation 3D 艺术家们的建模作品的渲染图作为参考(因此本身不存在 Sim-to-Real Gap),手办则使用本人拍摄的照片。
跑车
输入参考图来自 3D 艺术家 Santiago Avril 创作的 Porsche 911 GT3 模型。
生成模型的预览结果:
怪物
输入参考图1来自 3D 艺术家 Andrea Di Natale 创作的系列怪物中的一个。
生成模型的预览结果:
手办
鉴于以上两个例子展示出的显著差距,最后一个例子放弃了原计划的数字人建模(也是华为期间的老本行了,顺便强烈推荐 3D 艺术家 Şefki Ibrahim),转向相对简单的手办。
输入图片来自本人手机拍摄:
建模结果:
小结
Astra 虽然有了极强的空间理解和建模能力,但精细建模能力仍然存在较大问题。下一篇会尝试让 Agent 自动调用图生 3D 模型的能力,尝试补齐短板。
-
白模 ↩