vibe-openscad

モデル比較 leaderboard

各モデルの provider 既定の単発 bare run を 7 タスク横断で集計。 成功率・平均コスト・平均レイテンシでソートでき、右のサムネ帯はタスク別のレンダ結果。 クリックで拡大(←→ / ↑↓ で隣のモデル・タスクへ)。 effort/thinking variant や iteration chain を含む詳細は各モデル名のリンク先で。

sort
status successrender_error / no_codesubmit_missing / timeout
tasks 1 cube-with-hole 2 simple-mug 3 stepped-pyramid 4 hex-bolt 5 l-bracket 6 offset-handle-mug 7 butt-hinge 枠色 = tier2 / tier3
# model 成功率 試行 平均レイテンシ短い=速い 平均コスト短い=安い
renders / task
gemini 3.1 flash-lite
36 run
100% 8/8
7
2.2s
$0.0001
gemini 3.1 flash-lite
39 run
100% 7/7
7
1.9s
$0.0005
gemini 3.5 flash-lite
18 run
100% 7/7
7
2.5s
$0.0014
gpt 5.4 mini
42 run
100% 7/7
7
3.2s
$0.0014
gemini 3.6 flash
18 run
100% 7/7
7
18s
$0.0015
gemini 3.7 flash
18 run
100% 7/7
7
6.3s
$0.0016
gemini 3.8 flash
18 run
100% 7/7
7
11s
$0.0016
claude haiku 4.5
32 run
100% 7/7
7
4.7s
$0.0028
gemini 3.1 pro
35 run
100% 8/8
7
48s
$0.0030
gemini 3.5 flash
39 run
100% 7/7
7
13s
$0.0036
gpt 5.3 codex
28 run
100% 7/7
7
6.7s
$0.0051
gpt 5.4
46 run
100% 7/7
7
5.5s
$0.0052
claude sonnet 4
19 run
100% 7/7
7
7.3s
$0.0071
claude sonnet 4.5
19 run
100% 7/7
7
7.2s
$0.0072
claude opus 4.5
35 run
100% 7/7
7
8.5s
$0.0146
gpt 5.6 terra
39 run
100% 7/7
7
15s
$0.0156
claude sonnet 4.6
46 run
100% 7/7
7
19s
$0.0181
claude opus 4.8
60 run
100% 7/7
7
8.8s
$0.0184
claude opus 4.7
60 run
100% 7/7
7
10s
$0.0187
gpt 5.2 codex
28 run
100% 7/7
7
26s
$0.0249
o3
42 run
100% 7/7
7
48s
$0.0262
claude opus 4.1
28 run
100% 7/7
7
7.2s
$0.0281
gpt 5.5
46 run
100% 7/7
7
1.0m
$0.0289
gpt 5.6 sol
39 run
100% 7/7
7
16s
$0.0341
gpt 6 astra
39 run
100% 7/7
7
13s
$0.0355
claude opus 4
22 run
100% 7/7
7
9.4s
$0.0398
claude opus 5
74 run
100% 7/7
7
21s
$0.0430
gpt 5.1 codex max
28 run
100% 7/7
7
33s
$0.0464
gpt 5
42 run
100% 7/7
7
1.2m
$0.0489
gpt 5.1 codex
28 run
100% 7/7
7
1.8m
$0.0692
gpt 5.1 codex mini
28 run
100% 7/7
7
42s
$0.0711
claude fable 5.1
32 run
100% 7/7
7
26s
$0.0932
claude sonnet 5
39 run
100% 7/7
7
1.8m
$0.1026
gpt 5 codex
27 run
100% 7/7
7
1.8m
$0.1200
claude fable 5
53 run
100% 7/7
7
32s
$0.1241
qwen3-32b
3 run · 3/7 task
100% 3/3
3
3.5m
—
·
·
·
·
gemini 2.5 flash-lite
34 run
88% 7/8
7
6.2s
$0.0006
gemini 3 flash
40 run
88% 7/8
7
14s
$0.0009
gemini 2.5 flash
36 run
88% 7/8
7
27s
$0.0020
gemini 2.5 pro
29 run
88% 7/8
7
42s
$0.0057
gpt 5.6 luna
39 run
86% 6/7
7
19s
$0.0019
×
gpt 5.4 nano
42 run
86% 6/7
7
7.1s
$0.0022
×
gpt 4.1
28 run
86% 6/7
7
6.7s
$0.0045
×
gpt 5 nano
42 run
86% 6/7
7
2.1m
$0.0062
×
gpt 5 mini
42 run
86% 6/7
7
1.3m
$0.0098
×
o4 mini
42 run
86% 6/7
7
31s
$0.0151
×
google/gemma-3-27b
11 run
86% 6/7
7
2.3m
—
×
google/gemma-4-12b-qat
30 run
86% 6/7
7
2.7m
—
×
google/gemma-4-e2b
11 run
86% 6/7
7
16s
—
×
openai/gpt-oss-20b
7 run
86% 6/7
7
7.3s
—
×
qwen/qwen3.8-27b
21 run
86% 6/7
7
11.2m
—
×
google/gemma-4-e4b
11 run
71% 5/7
7
25s
—
×
×
openai/gpt-oss-120b
7 run
71% 5/7
7
26s
—
×
×
prism-ml/bonsai-2-27b
7 run
71% 5/7
7
6.1m
—
×
×
qwen/qwen3.5-9b
22 run
57% 4/7
7
4.1m
—
×
×
×
nvidia/nemotron-3-nano-4b
7 run
29% 2/7
7
20s
—
×
×
×
×
×
qwen3-8b
14 run
29% 2/7
7
3.2m
—
×
×
×
×
×
qwen3-0.6b
7 run
0% 0/7
7
17s
—
×
×
×
×
×
×
×