GPT-6 Luna
OpenAI · 2026-09-22 发布 · 10/03 20:06 更新
MyHOT 评分 · 综合35.4分综合参考位次 · 第 44 位0–100 分,非正确率 · 证据覆盖 65%
可比较分类3/ 4 项分类
已有成绩12项评测
上下文窗口105万Token
各有所长,看得更清楚。
每类单独评分,越高表示该分类表现越强。具体能力请看原始成绩与配置。
编程MyHOT 评分—分暂无足够的可比成绩1 项评测 · 覆盖 67%推理MyHOT 评分48.6分参考第 29 位5 项评测 · 覆盖 100%知识MyHOT 评分45.1分参考第 32 位前 30 位之外2 项评测 · 覆盖 100%专业办公MyHOT 评分33.5分参考第 36 位前 30 位之外2 项评测 · 覆盖 100%
评分和参考位次只在同一分类、同一轮内比较。缺测不补分;覆盖比例不代表能力高低。
每一项成绩,都有来处。
下面是该模型的公开汇总成绩。展开可查看运行配置与采用方式。
综合评测与体验2 项
编程1 项
推理5 项
知识2 项
专业办公2 项
还有一些未知
参考顺序只概括已取得的公开证据,缺测不补分。不同运行配置、未知误差与新评测都可能改变顺序,相邻位次不等于已证明的能力差距。
尚缺能力维度:视觉理解、中文与多语言。
5 项采用的成绩未公开可用标准误;未知不按零误差处理。
了解计算方法 →