AIモデル

Mistral models

履歴を開く

現行モデル

公式モデル一覧
  • Mistral Medium 3.5
  • Mistral Small 4
  • Mistral Large 3
  • Ministral 3 14B
  • Ministral 3 8B
  • Ministral 3 3B
  • OCR 4.1
  • Voxtral TTS
  • Voxtral Mini Transcribe 2
  • Voxtral Mini Transcribe Realtime
  • Voxtral Small
  • Codestral
  • Codestral Embed
  • Mistral Embed
  • Shieldstral 1.0
  • Mistral Moderation 2
発表記録ベータ/先行提供

Mistral Medium 3.5 announcement

Mistral は視覚入力と推論強度の調整に対応する 128B モデルを発表しました。

  • 公開重みは Modified MIT ライセンス。

発表時の利用条件

5月22日の記事では公開プレビューと記載。モデル文書はAPI版を4月28日・GAと別に記載しています。

発表の詳細

発表と評価の資料

9 件の資料
公式発表公式
Remote agents in Vibe. Powered by Mistral Medium 3.5.
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

Mistral Medium 3.5 announcement

独立評価
Factuality in the Arena

対戦を抽出しWebで検証できる主張を確認。事実性と人の好みを組み合わせた指標で、好みの点数は純粋な正確率ではありません。

確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

Mistral Medium 3.5 announcement

現在の評価表

独立評価
Artificial Analysis LLM Leaderboard · 4.3.2

Intelligence Index v4.3.2 の確認時データ。旧手法のスコアとは直接比較できません。

データを見る更新日は未記載

更新日は未記載

Artificial Analysis Intelligence Index · 確認時のデータ 2026年10月5日
Claude Opus 5.5max with fallback58
Claude Sonnet 5.5max with fallback56
GPT-6 Astramax53
Gemini 4 Argonhigh53
GPT-6.1 Solmax52
Qwen3.8 Max (0902)45
Muse Spark 1.3max48
GLM-5.3max45
GLM-5.3low34
GLM-5.3-Flash42
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料

独立評価
Text Arena Overall

テキストの選好スコア。暫定判定と不確実性を保持し、同一ランキング内で比較してください。

データを見る2026年10月2日

データ更新 ·

Arena score · 確認時のデータ 2026年10月5日
Gemini 4 Argonhigh; preliminary1525±9
Claude Opus 5.5high1504±9
Claude Fable 5.1max1501±6
Gemini 3.8 Flashhigh; preliminary1495±5
Muse Spark 1.3max1494±6
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料

独立評価
Code Arena WebDev Overall

WebDev の選好スコア。暫定判定と不確実性を保持し、同一ランキング内で比較してください。

データを見る2026年10月1日

データ更新 ·

Arena score · 確認時のデータ 2026年10月5日
Claude Opus 5.5max1815+16/-16
Claude Sonnet 5.5xhigh1786+18/-18
GPT-6.1 Solmax1758+17/-17
Gemini 4 Argonhigh; preliminary1680+13/-13
Qwen3.8 Max (0902)preliminary1670+8/-8
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料

独立評価
Agent Arena Overall

Agent Arena の Net Improvement 指標です。タスク成功率ではなく、記載した設定に対応します。

データを見る2026年10月2日

データ更新 ·

Net Improvement · 確認時のデータ 2026年10月5日
Claude Fable 5.1max14.31%±1.90%
Claude Opus 5.5high13.82%±2.17%
Claude Sonnet 5.5max12.52%±3.09%
GPT-6 Astramax12.27%±2.23%
GPT-6.1 Solmax11.23%±2.76%
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料

独立評価
Task-Completion Time Horizons of Frontier AI Models · TH1.1

TH1.1 のタスク完了時間。モデル別のグラフ値は未確認のため、数値を掲載しません。

データ更新 ·

確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料

独立評価
Artificial Analysis TTS Provider Voice · Provider Voice

各社の音声を使うブラインド聴取の選好評価。統一音声や遅延の比較ではありません。

データを見る更新日は未記載

更新日は未記載

Provider Voice Elo · 確認時のデータ 2026年10月5日
Eleven v495% CI1303–1339;1930samples;8nativevoices1321 ±18
Qwen-Audio-3.1-TTS-Plus95% CI1274–1310;1481samples;8nativevoices1292 ±18
Gemini3.8 Flash TTS95% CI1259–1291;2446samples;8nativevoices1275 ±16
MiniMax Speech2.8 HD95% CI1162–1184;4638samples;8nativevoices1173 ±11
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料

モデル群の資料1

モデル群や過去のバージョンを扱う資料です。今回の発表を評価したものではありません。

モデルカード・文書公式モデル群の資料
Models Overview | Mistral Docs
確認と関連範囲

原文確認済み · 2026年10月5日

原文を読む

モデル群の資料