Large Language Models
docAnalyzer keeps pace with releases from Alibaba, Anthropic, DeepSeek, Google, Minimax, Moonshot AI, OpenAI, Xiaomi, and xAI, adding new models within days so you can pick the right fit for every workflow. We surface 21 models across 9 creators, each benchmarked for quality, speed, and responsiveness.
Refreshed 2026-09-12
50.7 top quality · Claude Opus 5
345 tok/s top speed · Gemini 3.5 Flash Lite
0 ms top responsiveness · GPT-5 nano
| Model | |||
|---|---|---|---|
Claude Opus 5 Anthropic | 50.7 | 61 tok/s | 36.03 s |
GPT-5.6 Sol OpenAI | 47.1 | 69 tok/s | 124.83 s |
Grok 4.6 xAI | 44.4 | 71 tok/s | 38.01 s |
Kimi K3 Moonshot AI | 43.8 | 37 tok/s | 2.99 s |
GPT-5.6 Terra OpenAI | 42.3 | 116 tok/s | 107.22 s |
Gemini 3.8 Flash Google | 41.2 | 339 tok/s | 12.31 s |
Qwen3.8 Max Alibaba | 40.3 | 41 tok/s | 1.80 s |
DeepSeek V4.1 Flash DeepSeek | 39.5 | 261 tok/s | 920 ms |
Claude Sonnet 5 Anthropic | 38.4 | 83 tok/s | 114.22 s |
GPT-5.6 Luna OpenAI | 37.5 | 121 tok/s | 96.08 s |
Qwen 3.8 27B Alibaba | 33.9 | 43 tok/s | 1.31 s |
Gemini 3.1 Pro Preview Google | 30.4 | 125 tok/s | 24.48 s |
Qwen3.7 Max Alibaba | 29.9 | 0 tok/s | 0 ms |
MiniMax M3 Minimax | 29.6 | 106 tok/s | 830 ms |
MiMo V2.5 Pro Xiaomi | 26.4 | 44 tok/s | 7.72 s |
Qwen3.7 Plus Alibaba | 25.8 | 70 tok/s | 1.46 s |
Grok 4.3 xAI | 25.4 | 0 tok/s | 0 ms |
Gemini 3.5 Flash Lite Google | 22.7 | 345 tok/s | 7.71 s |
MiMo V2.5 Xiaomi | 22.3 | 52 tok/s | 6.13 s |
Claude Haiku 4.5 Anthropic | 17.6 | 106 tok/s | 12.43 s |
GPT-5 nano OpenAI | 13.0 | 0 tok/s | 0 ms |
* Latency uses a logarithmic scale: shorter time means a longer bar.