Claude Mythos
查看时间线当前模型
官方模型目录- Claude Mythos 5.1受限访问
发布记录已发布
Claude Mythos 5.1
Mythos 5.1 与 Fable 5.1 采用同一模型,防护条件和访问范围不同。
- 仅通过可信访问计划提供,首发面向获准的美国网络防御与生命科学机构。
发布时的开放条件
仅通过可信访问计划提供,首发面向获准的美国网络防御与生命科学机构。
发布与测评材料
6 份材料当前测评榜
独立测评
Artificial Analysis LLM Leaderboard · 4.3.2Intelligence Index v4.3.2 核对快照;旧方法版本的分数不能直接比较。
查看数据原榜未注明更新日期
原榜未注明更新日期
| Claude Opus 5.5max with fallback | 58 |
|---|---|
| Claude Sonnet 5.5max with fallback | 56 |
| GPT-6 Astramax | 53 |
| Gemini 4 Argonhigh | 53 |
| GPT-6.1 Solmax | 52 |
| Qwen3.8 Max (0902) | 45 |
| Muse Spark 1.3max | 48 |
| GLM-5.3max | 45 |
| GLM-5.3low | 34 |
| GLM-5.3-Flash | 42 |
独立测评
Text Arena Overall文本偏好评分,保留 preliminary 标记和不确定性;只在同一榜内比较。
查看数据2026年10月2日
数据更新 ·
| Gemini 4 Argonhigh; preliminary | 1525±9 |
|---|---|
| Claude Opus 5.5high | 1504±9 |
| Claude Fable 5.1max | 1501±6 |
| Gemini 3.8 Flashhigh; preliminary | 1495±5 |
| Muse Spark 1.3max | 1494±6 |
独立测评
Code Arena WebDev Overall网页开发偏好评分,保留 preliminary 标记和不确定性;只在同一榜内比较。
查看数据2026年10月1日
数据更新 ·
| Claude Opus 5.5max | 1815+16/-16 |
|---|---|
| Claude Sonnet 5.5xhigh | 1786+18/-18 |
| GPT-6.1 Solmax | 1758+17/-17 |
| Gemini 4 Argonhigh; preliminary | 1680+13/-13 |
| Qwen3.8 Max (0902)preliminary | 1670+8/-8 |
独立测评
Agent Arena OverallAgent Arena 这里展示净改善指标,不是任务成功率;分数对应所列配置。
查看数据2026年10月2日
数据更新 ·
| Claude Fable 5.1max | 14.31%±1.90% |
|---|---|
| Claude Opus 5.5high | 13.82%±2.17% |
| Claude Sonnet 5.5max | 12.52%±3.09% |
| GPT-6 Astramax | 12.27%±2.23% |
| GPT-6.1 Solmax | 11.23%±2.76% |
独立测评
Task-Completion Time Horizons of Frontier AI Models · TH1.1TH1.1 任务完成时间跨度;未读取各型号的交互图数值,不填写分数。
数据更新 ·