🧪 AI 모델 실험실
같은 미션, 다른 모델. 클로드부터 로컬 오픈모델까지 — 동일한 프롬프트 하나로 게임을 만들게 시키고, 직접 다 돌려본 결과를 그대로 비교합니다.
🧱 테트리스 ✅ 3 · ⚠️ 3 · ❌ 1
| # | 모델 | 판정 | 점수 | 빌드 | 플레이 |
|---|---|---|---|---|---|
| 1 | Claude Haiku 4.5Anthropic | ✅ 정상 작동 | 6 | 44s | ▶ Play |
| 2 | Claude Opus 4.8Anthropic | ✅ 정상 작동 | 6 | 58s | ▶ Play |
| 3 | Claude Sonnet 4.6Anthropic | ✅ 정상 작동 | 6 | 133s | ▶ Play |
| 4 | Llama 3.1 8BMeta | ⚠️ 작동 이상 | 6 | 392s | ▶ Play |
| 5 | Qwen3 8BAlibaba | ⚠️ 작동 이상 | 6 | 483s | ▶ Play |
| 6 | Gemma 4 E2BGoogle | ⚠️ 작동 이상 | 6 | 483s | ▶ Play |
| 7 | Mistral Small 3.2Mistral | ❌ 생성 실패 | 0 | 483s | — |
▶ Play를 누르면 해당 모델이 만든 결과물이 새 페이지에서 그대로 실행됩니다 (방향키/WASD로 조작). ⚠️ 표시는 결과물이 만들어졌지만 실제로는 제대로 동작하지 않은 경우로, 직접 눌러서 확인해볼 수 있습니다.