首页 AI实时资讯内容详情

GPT-5.6 Sol:月之暗面 Kimi K3 模型 AI 智能体知识工作跑分仅次于 Claude Fable 5

2026-07-24 1 暗号导航联盟

7月24日, IT之家传来消息, 7月22日更新AI智能体知识工作基准AA-, Kimi K3模型在此次更新中斩获1543分, 该分数超过GPT-5.6 Sol的1501分, 却仅次于Fable 5模型的1574分。

IT之家作如下注明, AA是的全新前沿AI智能体, 也就是独立AI评测机构, 其于2026年6月推出了知识工作基准测试。

它是专门用于评估AI在处理长周期、高复杂程度真实业务时的表现而设计的, 模拟企业里真实且杂乱的办公环境, 对数据科学、产品管理、企业战略这类场景进行测试, 要处理海量碎片化上下文, 该上下文涵盖25000多条Slack消息、3500多封电子邮件、会议纪要以及财务报表等, 还要求生成Excel财务模型、董事会汇报PPT等实际的商务交付物。

GPT-5.6 Sol:月之暗面 Kimi K3 模型 AI 智能体知识工作跑分仅次于 Claude Fable 5__GPT-5.6 Sol:月之暗面 Kimi K3 模型 AI 智能体知识工作跑分仅次于 Claude Fable 5

按照最新的跑分结果来呈现, Kimi K3模型在AA-这个项目上, 其跑分达成了1543分, 它的分数, 在跑分排名里仅次于Fable 5(其跑分是1574分),它的分数超过了GPT - 5.6 Sol(其最高跑分是1501), 和5(其最高跑分是1388), 以及Opus 4.8(其最高跑分是1347)。换个角度进行比较, Kimi K2.6模型在该榜单上所取得的成绩是816分。

相关标签: # AI智能体 # 知识工作基准 # KimiK3模型 # ClaudeFable5 # 性能测试