AI 聊天机器人比较
嵌入网站、应用或消息渠道中的对话式智能体,可在聊天界面中回答问题或执行范围明确的任务,通常围绕常见问题、简单工作流或特定领域知识,而非长期负责一项任务。
如需比较语言模型,请参阅我们的模型基准测试。
我们使用 AI 收集部分结果
亮点
比较套餐选项
| 产品 | 等级 | 价格 | 模型 | 智能 | 输入 | 媒体生成 | 工具 | 记忆 | MCP | 连接器 | 功能得分 | 应用 | 隐私 | |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| ChatGPT Plus | 标准 | $20/月 | GPT-5.6 Sol (max) | 47 | 图像PDFExcel语音 | 图像视频语音语音到语音 | 网页代码数据研究 | 记忆历史 | 9/10 | 5.7/6 | iOSAndroidmacOSWindows | |||
| Claude Pro | 标准 | $20/月 | Claude Opus 5 (max) | 51 | 图像PDFExcel语音 | 语音 | 网页代码数据研究 | 记忆历史 | 8/10 | 4.8/6 | iOSAndroidmacOSWindows | |||
| Google AI Pro | 标准 | $20/月 | Gemini 3.6 Flash | 34 | 图像PDFExcel视频语音 | 图像视频语音语音到语音 | 网页代码数据研究 | 记忆历史 | 5/10 | 4.5/6 | iOSAndroid | |||
| Poe Pro | 标准 | $20/月 | Claude Opus 4.6 (max) | 32 | 图像PDFExcel语音 | 图像视频 | 网页 | 记忆历史 | 0/10 | 2.5/6 | iOSAndroidmacOSWindows | |||
| Perplexity Pro | 标准 | $20/月 | Gemini 3.1 Pro Preview | 30 | 图像PDFExcel语音 | 图像视频语音 | 网页代码数据研究 | 记忆历史 | 2/10 | 3.8/6 | iOSAndroidmacOSWindows | |||
| SuperGrok | 标准 | $30/月 | Grok 4.6 (high) | 44 | 图像PDFExcel语音 | 图像视频语音语音到语音 | 网页代码数据研究 | 记忆历史 | 8/10 | 5.6/6 | iOSAndroid | |||
| Mistral Vibe Pro | 标准 | $15/月 | Mistral Medium 3.5 | 15 | 图像PDFExcel语音 | 图像 | 网页代码数据研究 | 记忆历史 | 7/10 | 4.8/6 | iOSAndroid |
市场概览
Claude、ChatGPT、Gemini、Meta AI 等主要产品在推理、回答质量和功能方面各有所长。方案从免费层到每月 8 美元起的付费层,高端层可达每月 200 美元。各产品在模型访问、用量限制、工具、连接器、隐私和多模态功能上存在差异。
差异化特点
- 有些产品侧重编程和数据工具,另一些则侧重研究、语音、媒体生成或集成。
- 模型访问、用量限制、工具、连接器、语音和多模态支持构成主要差异。
智能
Artificial Analysis 智能指数:所支持的最高智能模型
Artificial Analysis Intelligence Index · Higher is better
Estimate (independent evaluation forthcoming)
功能
智能指数 vs. 功能得分
Feature score · Higher is better · 6 categories tracked
Most attractive quadrant
价格
智能指数 vs. 价格(付费套餐)
Artificial Analysis Intelligence Index · Monthly price (USD) · Standard & premium plans
Most attractive quadrant
月费:付费聊天机器人套餐
Monthly price (USD) · Standard & premium plans
功能得分 vs. 价格(付费套餐)
Feature score · Higher is better · 6 categories tracked · Monthly price (USD) · Standard & premium plans
Most attractive quadrant
常见问题
我们的比较使用基准数据,包括智能指数、功能得分、价格、隐私和平台支持。你可以按模型筛选、并排比较套餐,并查看智能与价格、智能与功能的图表。
智能指数是基于 Artificial Analysis 基准测试的综合得分,用于衡量推理、知识和响应质量。得分越高,表示在标准化评估中的表现越强。付费套餐通常比免费等级得分更高。
大多数主流提供商(Claude、ChatGPT、Gemini、Meta AI)都提供有不同限制的免费等级。我们的比较表显示每个套餐的功能得分和能力。免费等级的模型和工具用量限制通常低于付费套餐。
关键差异包括模型访问、实时网页搜索、语音、多模态理解与生成、编程和数据工具、记忆、MCP、连接器和原生应用。
Artificial Analysis 发布详细的 LLM 基准测试,包括延迟、成本和质量指标。我们的聊天机器人比较链接到模型级数据,以便进行更深入的分析。 查看 LLM 基准测试