Archivo de contenido de AI 旗舰模型 Benchmark 横向对比

9 publicaciones · Página 1 de 1

  1. Claude Sonnet 5:官方 Benchmark 横向对比
  2. GPT-5.6 Sol:官方 Benchmark 横向对比
  3. Claude Opus 5:官方 Benchmark 横向对比
  4. DeepSeek-V4-Pro GA:官方 Benchmark 横向对比
  5. GLM-5.3:同一基座,后训练把哪些 benchmark 推到了前列
  6. Claude Fable 5.1 / Mythos 5.1:同一权重,分开的能力与安全边界
  7. GPT-6 Astra:Critical cyber、Agent 工作流与一张官方 benchmark 总表
  8. GPT-6 Astra:工作任务官方 Benchmark、单任务成本与部署安全边界
  9. DeepSeek-V4.1-Flash:取代 V4-Pro 成为现役主力的全量官方 Benchmark 与架构解析

Explora más canales en Descubrir