当前位置:首页 > 探索

北大AI奥数评测,o1

Omni-MATH团队 投稿量子位 | 公众号 QbitAIOpenAI的o1系列一发布,传统数学评测基准都显得不够用了。MATH-500,满血版o1模型直接拿下94.8分。更难的奥数邀请赛AIME ...

探索


2153.top