跳至主要內容

img2threejs 實測:丟一張圖片給 Codex,真的能做成 Three.js 3D 模型嗎?

我用 GPT-5.6 SOL、medium 推理測試 img2threejs。F1 賽車這類複雜物件很容易翻車,換成紅白機手把後,按鈕、視角切換與爆炸圖都有做出來。這篇整理實測結果、適用範圍與 Codex 安裝方式。

7 min read/ Medium

前言

img2threejs 這個名字很直白:給 Agent 一張參考圖片,讓它用程式重建成可以在瀏覽器裡操作的 Three.js 3D 模型。

它不是把照片直接轉成 Mesh,也不是攝影測量。Agent 會先拆解圖片裡的輪廓、零件、材質與細節,再用 Three.js 的幾何圖形、材質和程式碼把物件重新做出來。理論上還會經過 blockout、結構、外型、材質、燈光、互動與最佳化等階段。

我這次用 GPT-5.6 SOL,推理強度選 medium。前面先拿 F1 賽車這種複雜物件測,結果很直接:翻車。曲面、車身比例、輪胎與空力套件只要幾個地方沒抓準,最後看起來就不像同一台車。

後來我換成結構比較簡單的紅白機手把,只跑一次完整任務,沒有再叫 Agent 針對成品反覆人工精修。這次至少有做出手把外殼、十字鍵、Select/Start、A/B 按鈕和電線,也能切換視角、點選零件與打開爆炸圖。效果稱不上精緻,但拿來做粗略 Demo 已經可以接受。

Codex 使用 img2threejs 依照參考圖片重建的紅白機手把 Three.js 模型

這是我用 GPT-5.6 SOL、medium 推理跑出來的紅白機手把

下面是這次實測的完整操作畫面,可以直接看到 Agent 產生模型後的旋轉、按鈕互動和爆炸圖效果。