Anthropic

Claude Composer 2.5

Version 2.5 benchmark runs across the shared Superbash visual prompts.

Visual prompt runs

Benchmark runs

Open each generated scene, or compare the same prompt across models.

9 runs