# 中国大模型性能排名概览(截至2025年中)
> ⚠️ 大模型排名变化极快,以下为基于多个主流评测榜单的综合梳理,仅供参考。
---
## 一、国际综合排名(主要参考 LMSYS Chatbot Arena、OpenCompass 等)
| 梯队 | 模型 | 所属公司 | 备注 |
|------|------|----------|------|
| **第一梯队** | GPT-4o / o3 / o4-mini | OpenAI | 综合能力顶尖 |
| | Claude 4 / 3.5 Sonnet | Anthropic | 长文本与推理强 |
| | Gemini 2.5 Pro | Google | 多模态突出 |
| **第一~第二梯队** | **DeepSeek-R1 / V3** | 深度求索(中国🇨🇳) | 开源标杆,性价比极高 |
| | Grok 3 | xAI | 推理能力强 |
| **第二梯队** | **Qwen2.5 / Qwen3** | 阿里巴巴(中国🇨🇳) | 开源生态最好之一 |
| | Llama 4 | Meta | 开源代表 |
| | **Kimi k2** | 月之暗面(中国🇨🇳) | 长上下文突出 |
| **第二~第三梯队** | **GLM-4 / ChatGLM** | 智谱AI(中国🇨🇳) | |
| | **豆包(Doubao)** | 字节跳动(中国🇨🇳) | 国内用户量大 |
| | **文心 4.0 / 4.5** | 百度(中国🇨🇳) | |
| | **Yi