核心规格对比

规格Mistral LargeMistral Medium
厂商mistralmistral
版本largemedium
发布日期2024-02-262023-12-11
上下文窗口32000 tokens32000 tokens
输入模态texttext
输出模态texttext
许可Apache 2.0Apache 2.0
SOC2✓✓
HIPAA✗✗
GDPR✓✓
ISO 27001✓✓

基准测试结果

基准Mistral LargeMistral Medium胜出
ARC93.394.6Mistral Medium
BBH76.783.4Mistral Medium
GPQA38.148.7Mistral Medium
GSM8K80.982.5Mistral Medium
HUMANEVAL73.478Mistral Medium
IFEVAL75.877.4Mistral Medium
MATH49.354.9Mistral Medium
MMLU8282.9Mistral Medium
MUSR52.164.3Mistral Medium
WINOGRANDE83.382.4Mistral Large

定价对比

项目 (每百万Token)Mistral LargeMistral Medium
输入$4$2.7
输出$12$8.1
缓存读$0$0
缓存写$0$0

Mistral Large 对比 Mistral Medium

模型概述

Mistral Large 与 Mistral Medium 均为 AI 模型市场的重要选项。本页对比两者在基准、定价与合规性上的差异。

核心规格对比

厂商发布日期上下文窗口许可证
Mistral / Mistral2024-02-26 / 2023-12-1132K / 32KApache 2.0 / Apache 2.0

基准测试表现

基准Mistral LargeMistral Medium胜出
ARC93.394.6B
BBH (BIG-Bench Hard)76.783.4B
GPQA38.148.7B
GSM8K (Grade School Math 8K)80.982.5B
HumanEval73.478.0B
IFEval75.877.4B
MATH49.354.9B
MMLU (Massive Multitask Language Understanding)82.082.9B
MUSR52.164.3B
WinoGrande83.382.4A

定价对比

输入输出缓存读取缓存写入
— / —— / —— / —— / —

每百万 token — A / B

优势 & 劣势

Mistral Large

  • ✅ MMLU 得分 82.0,知识推理能力强。
  • ⚠️ 闭源专有模型,不支持自托管。

Mistral Medium

  • ✅ MMLU 得分 82.9,知识推理能力强。
  • ⚠️ 闭源专有模型,不支持自托管。

编辑点评

Mistral Large 与 Mistral Medium 各有侧重。建议根据具体场景(代码、长文本、视觉等)选择,参考上方基准与定价表。

常见问题

哪个模型在代码任务上更优?

参考 HumanEval 基准得分表,得分更高者更适合代码任务。

哪个模型价格更低?

参考上方的定价对比表,输入/输出价格更低者更具成本优势。

上下文窗口哪个更长?

参考核心规格对比表,上下文窗口更大的模型适合长文档处理。

参考文献

编辑点评

See Editor's Take section.