Claude 对比 Grok 一览
| Claude | Grok | |
|---|---|---|
| 开发者 | Anthropic | xAI |
| 最新版本 | Claude Opus 4.8 | Grok 4.5 |
| 以此闻名 | Thoughtful | Real-time |
| 上下文窗口 | Up to 1 million tokens (Opus & Sonnet) | Up to 2 million tokens (flagship tier) |
| 多模态支持 | Text and images | Text, images, and video |
| 开源 | 否 | 否 |
| 官方定价 | Free tier available; Pro is $20/mo, Max is $100/mo | Free tier on X and grok.com; SuperGrok is $30/mo |
Claude 的基准测试亮点
Scores 88.6% on SWE-bench Verified and 93.6% on GPQA Diamond
Grok 的基准测试亮点
Posts 83.3% on Terminal-Bench 2.1 and leads outright on SWE Marathon
你应该使用哪一个?
C
如果你想要以下内容,请选择 Claude:
- 长文档和代码库
- 细致周到的写作
- 智能体编程任务
- 多步骤研究
G
如果你想要以下内容,请选择 Grok:
- 时事与热门话题
- 快速变化的研究
- 数学与推理问题
- 更直接、更少过滤的语气
突出优势
Claude
百万 token 上下文窗口
在单次提示中处理整个代码库、法律文件或书籍级别的内容。
自适应推理
评估问题的复杂程度,并决定在回答前需要进行多少推理。
持久记忆
在多次对话中记住你的名字、沟通风格以及正在进行的项目背景。
Grok
实时信息
读取实时公开帖子和事件,因此在突发新闻和快速变化的话题上表现强劲。
DeepSearch 引用
直接提取并引用来源,而非仅凭训练记忆作答。
强大的推理与数学能力
在学术和博士级科学基准测试中具有竞争力,幻觉率大幅降低。