要約
今回の実験では、GPT-5.6、Claude Fable 5、Grok 4.5、Gemini 3.6の4つの視覚モデルを用いて、モナリザとゴッホの星月夜を題材とした28の絵画を生成しました。各モデルは、白いキャンバスと色鉛筆のツールを使って、描画を行い、出力を評価しました。これらのテストは、モデルの創造性や芸術的能力を直接評価するものではなく、オープンエンドな課題を通じて能力を視覚的に示すことを目的としています。
これらの実験の意義は、モデルが複雑なタスクにどのように取り組むかを観察することで、従来のベンチマークでは見えない能力の違いを浮き彫りにすることです。特に、Grok 4.5は基本的な描画タスクにおいて苦戦し、オープンウェイトモデルのいくつかは全く機能しませんでした。また、Claude Fable 5は処理に時間がかかり、コストが高いにもかかわらず、出力が劣る結果となりました。
このような実験は、AIモデルの限界やコストを理解する助けとなります。参加者からのフィードバックを受けて、今後のタスクや設定についても改善を図っていく予定です。AIの創造性に関する議論も活発で、今後の研究や開発に期待が寄せられています。
元記事: https://www.tryai.dev/blog/ai-drawing-arena-colored-pencils-claude-gpt-grok
公開日: Tue, 21 Jul 2026 21:13:20 +0000
この記事はAIアシスト編集により作成されています。
📰 元記事: 元記事を読む