Archivo de contenido de AI 旗舰模型 Benchmark 横向对比
9 publicaciones · Página 1 de 1
- Claude Sonnet 5:官方 Benchmark 横向对比
- GPT-5.6 Sol:官方 Benchmark 横向对比
- Claude Opus 5:官方 Benchmark 横向对比
- DeepSeek-V4-Pro GA:官方 Benchmark 横向对比
- GLM-5.3:同一基座,后训练把哪些 benchmark 推到了前列
- Claude Fable 5.1 / Mythos 5.1:同一权重,分开的能力与安全边界
- GPT-6 Astra:Critical cyber、Agent 工作流与一张官方 benchmark 总表
- GPT-6 Astra:工作任务官方 Benchmark、单任务成本与部署安全边界
- DeepSeek-V4.1-Flash:取代 V4-Pro 成为现役主力的全量官方 Benchmark 与架构解析