数学能力上,低推理强度下的o3-mini(low)达到了与o1-mini相当的水平;中等推理强度下能力媲美满血版o1;而一旦推理强度拉满(high),其表现直接超越o1系列一众模型。
回答(Sam Altman):这个还在讨论中。我个人认为在这个问题上我们站在了历史的错误一方,需要找出一个不同的开源策略。不过不是所有OpenAI的人都同意这个观点,而且目前这也不是我们最高优先级。 回答(Kevin ...