Questions · Models
The AI that writes best
6 of 10
models named Claude 3.5 Sonnet · each model counted once, by its most frequent named answer
Claude 3 Opus, Claude Opus 4.5 and Grok got one model each. Five different answers in all. 4 models (Gemini 3.7 Flash and DeepSeek V4 Pro 0423 among them) gave the same answer in every reply.
Every model’s answer (10)
| Model | Answer | Replies |
|---|---|---|
| DeepSeek V4 Pro 0423 | Claude 3.5 Sonnet | 6 of 6 · every reply |
| GLM-5.3 | Claude 3.5 Sonnet | 6 of 6 · every reply |
| GPT-5.6 Terra | Claude 3.5 Sonnet | 6 of 6 · every reply |
| Gemini 3.7 Flash | Claude 3.5 Sonnet | 6 of 6 · every reply |
| Kimi K3 | Claude 3.5 Sonnet | 3 of 6 |
| Qwen3.8 Max | Claude 3.5 Sonnet | 5 of 6 |
| Large 2512 | Claude 3 Opus | 6 of 6 · every reply |
| Claude Opus 5 | Claude Opus 4.5 | 4 of 6 |
| Grok 4.6 | Grok | 5 of 6 |
| Llama 3.3 70B | LLaMA | 5 of 5 · every reply |
How to read this
- 10 models gave a usable, named answer; 59 replies in all under default sampling. Refusals, errors and ties are not counted.
- “Every reply” marks a model that gave the same answer in every one of at least three replies.
- Part of a published study: read it.