Muse Spark
查看时间线当前模型
官方模型目录- Muse Spark 1.3
- Muse Spark 1.3 Contributor
- Muse Glimmer 30B
- Muse Image
- Muse Voice Transcribe 1.0
- Llama 4 Scout
- Llama 4 Maverick
发布记录已发布
Muse Spark 1.3
Meta 发布 Muse Spark 1.3。
发布时的开放条件
当前访问条件见官方模型目录;本条保留原始公布日期。
发布与测评材料
13 份材料当前测评榜
独立测评
Artificial Analysis LLM Leaderboard · 4.3.2Intelligence Index v4.3.2 核对快照;旧方法版本的分数不能直接比较。
查看数据原榜未注明更新日期
原榜未注明更新日期
| Claude Opus 5.5max with fallback | 58 |
|---|---|
| Claude Sonnet 5.5max with fallback | 56 |
| GPT-6 Astramax | 53 |
| Gemini 4 Argonhigh | 53 |
| GPT-6.1 Solmax | 52 |
| Qwen3.8 Max (0902) | 45 |
| Muse Spark 1.3max | 48 |
| GLM-5.3max | 45 |
| GLM-5.3low | 34 |
| GLM-5.3-Flash | 42 |
独立测评
Text Arena Overall文本偏好评分,保留 preliminary 标记和不确定性;只在同一榜内比较。
查看数据2026年10月2日
数据更新 ·
| Gemini 4 Argonhigh; preliminary | 1525±9 |
|---|---|
| Claude Opus 5.5high | 1504±9 |
| Claude Fable 5.1max | 1501±6 |
| Gemini 3.8 Flashhigh; preliminary | 1495±5 |
| Muse Spark 1.3max | 1494±6 |
独立测评
Code Arena WebDev Overall网页开发偏好评分,保留 preliminary 标记和不确定性;只在同一榜内比较。
查看数据2026年10月1日
数据更新 ·
| Claude Opus 5.5max | 1815+16/-16 |
|---|---|
| Claude Sonnet 5.5xhigh | 1786+18/-18 |
| GPT-6.1 Solmax | 1758+17/-17 |
| Gemini 4 Argonhigh; preliminary | 1680+13/-13 |
| Qwen3.8 Max (0902)preliminary | 1670+8/-8 |
独立测评
Agent Arena OverallAgent Arena 这里展示净改善指标,不是任务成功率;分数对应所列配置。
查看数据2026年10月2日
数据更新 ·
| Claude Fable 5.1max | 14.31%±1.90% |
|---|---|
| Claude Opus 5.5high | 13.82%±2.17% |
| Claude Sonnet 5.5max | 12.52%±3.09% |
| GPT-6 Astramax | 12.27%±2.23% |
| GPT-6.1 Solmax | 11.23%±2.76% |
独立测评
Task-Completion Time Horizons of Frontier AI Models · TH1.1TH1.1 任务完成时间跨度;未读取各型号的交互图数值,不填写分数。
数据更新 ·
独立测评
Arena Text-to-Image文字生图偏好评分,保留初步结果与生成配置。
查看数据2026年9月24日
数据更新 ·
| gpt-image-2.5-sunburstPreliminary | 1424 ±8 |
|---|---|
| gpt-image-2.5-flarePreliminary | 1401 ±8 |
| muse-image | 1276 ±5 |
| gemini-3.1-flash-imagenano-banana-2; web-search | 1261 ±4 |
| seedream-5.0-pro | 1256 ±4 |
| qwen-image-3.0-pro | 1256 ±6 |
| qwen-image-2.1Preliminary | 1228 ±9 |
| flux-2-max | 1162 ±3 |
独立测评
Artificial Analysis TTS Provider Voice · Provider Voice厂商自有声音的盲听偏好评测,不是统一声音或延迟评测。
查看数据原榜未注明更新日期
原榜未注明更新日期
| Eleven v495% CI1303–1339;1930samples;8nativevoices | 1321 ±18 |
|---|---|
| Qwen-Audio-3.1-TTS-Plus95% CI1274–1310;1481samples;8nativevoices | 1292 ±18 |
| Gemini3.8 Flash TTS95% CI1259–1291;2446samples;8nativevoices | 1275 ±16 |
| MiniMax Speech2.8 HD95% CI1162–1184;4638samples;8nativevoices | 1173 ±11 |
系列资料5
这些材料讨论整个模型系列或历史版本,不是当前发布的测评。