[NS :
7月31日消息,OpenAI公司今天(7月31日)发布公告,宣布通过改进框架,让GPT-5.6Sol模型的ARC-AGI-3提高了188%。ARC-AGI-3由ARCPrize团队推出的全新交互式推理基准测试,是目前全球公认衡量AI通用智能(AGI)最严苛、最顶尖的交互式推理评测基准。该基准完全打破了传统AI“做题
bakohok] 最严苛 AI 交互推理测试:OpenAI 两项改进让 GPT-5.6 Sol 提分 188%7月31日消息,OpenAI公司今天(7月31日)发布公告,宣布通过改进框架,让GPT-5.6Sol模型的ARC-AGI-3提高了188%。ARC-AGI-3由ARCPrize团队推出的全新交互式推理基准测试,是目前全球公认衡量AI通用智能(AGI)最严苛、最顶尖的交互式推理评测基准。该基准完全打破了传统AI“做题