AI 模型

Mistral models

查看时间线

当前模型

官方模型目录
  • Mistral Medium 3.5
  • Mistral Small 4
  • Mistral Large 3
  • Ministral 3 14B
  • Ministral 3 8B
  • Ministral 3 3B
  • OCR 4.1
  • Voxtral TTS
  • Voxtral Mini Transcribe 2
  • Voxtral Mini Transcribe Realtime
  • Voxtral Small
  • Codestral
  • Codestral Embed
  • Mistral Embed
  • Shieldstral 1.0
  • Mistral Moderation 2
发布记录测试/抢先体验

Mistral Medium 3.5 announcement

Mistral 宣布 128B 模型,支持视觉输入与可调推理强度。

  • 开放权重采用 Modified MIT 许可。

发布时的开放条件

5 月 22 日新闻公告描述公开预览;型号文档另列 API 版本日期为 4 月 28 日,标为 GA。

完整发布记录

发布与测评材料

9 份材料
官方发布官方
Remote agents in Vibe. Powered by Mistral Medium 3.5.
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

Mistral Medium 3.5 announcement

独立测评
Factuality in the Arena

抽样对战并核查可通过网页验证的事实,将事实性与人类偏好结合;偏好分数不等于纯事实正确率。

核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

Mistral Medium 3.5 announcement

当前测评榜

独立测评
Artificial Analysis LLM Leaderboard · 4.3.2

Intelligence Index v4.3.2 核对快照;旧方法版本的分数不能直接比较。

查看数据原榜未注明更新日期

原榜未注明更新日期

Artificial Analysis Intelligence Index · 核对快照 2026年10月5日
Claude Opus 5.5max with fallback58
Claude Sonnet 5.5max with fallback56
GPT-6 Astramax53
Gemini 4 Argonhigh53
GPT-6.1 Solmax52
Qwen3.8 Max (0902)45
Muse Spark 1.3max48
GLM-5.3max45
GLM-5.3low34
GLM-5.3-Flash42
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料

独立测评
Text Arena Overall

文本偏好评分,保留 preliminary 标记和不确定性;只在同一榜内比较。

查看数据2026年10月2日

数据更新 ·

Arena score · 核对快照 2026年10月5日
Gemini 4 Argonhigh; preliminary1525±9
Claude Opus 5.5high1504±9
Claude Fable 5.1max1501±6
Gemini 3.8 Flashhigh; preliminary1495±5
Muse Spark 1.3max1494±6
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料

独立测评
Code Arena WebDev Overall

网页开发偏好评分,保留 preliminary 标记和不确定性;只在同一榜内比较。

查看数据2026年10月1日

数据更新 ·

Arena score · 核对快照 2026年10月5日
Claude Opus 5.5max1815+16/-16
Claude Sonnet 5.5xhigh1786+18/-18
GPT-6.1 Solmax1758+17/-17
Gemini 4 Argonhigh; preliminary1680+13/-13
Qwen3.8 Max (0902)preliminary1670+8/-8
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料

独立测评
Agent Arena Overall

Agent Arena 这里展示净改善指标,不是任务成功率;分数对应所列配置。

查看数据2026年10月2日

数据更新 ·

Net Improvement · 核对快照 2026年10月5日
Claude Fable 5.1max14.31%±1.90%
Claude Opus 5.5high13.82%±2.17%
Claude Sonnet 5.5max12.52%±3.09%
GPT-6 Astramax12.27%±2.23%
GPT-6.1 Solmax11.23%±2.76%
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料

独立测评
Task-Completion Time Horizons of Frontier AI Models · TH1.1

TH1.1 任务完成时间跨度;未读取各型号的交互图数值,不填写分数。

数据更新 ·

核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料

独立测评
Artificial Analysis TTS Provider Voice · Provider Voice

厂商自有声音的盲听偏好评测,不是统一声音或延迟评测。

查看数据原榜未注明更新日期

原榜未注明更新日期

Provider Voice Elo · 核对快照 2026年10月5日
Eleven v495% CI1303–1339;1930samples;8nativevoices1321 ±18
Qwen-Audio-3.1-TTS-Plus95% CI1274–1310;1481samples;8nativevoices1292 ±18
Gemini3.8 Flash TTS95% CI1259–1291;2446samples;8nativevoices1275 ±16
MiniMax Speech2.8 HD95% CI1162–1184;4638samples;8nativevoices1173 ±11
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料

系列资料1

这些材料讨论整个模型系列或历史版本,不是当前发布的测评。

模型卡与文档官方系列资料
Models Overview | Mistral Docs
核查与关联范围

已核读原文 · 2026年10月5日

阅读原文

系列资料