> 科技

号称博士生水准!OpenAI最新模型仍分不出9.11和9.8哪个大

发布时间:2024-09-14 10:05:20

9月14日消息,OpenAI推出了OpenAI o1预览模型,官方宣称推理能力更强,可达理科博士生水准。

按照官方技术博客说法,o1在推理能力上代表了人工智能最强的水平。同时官方放出了更多OpenAI o1的更多演示视频。比如使用OpenAI o1来编写一个找松鼠的网页游戏

这个游戏的目标是控制一只考拉躲避不断增加的草莓,并在3秒后找到出现的松鼠。这类游戏的逻辑相对复杂,更考验OpenAI o1的逻辑推理能力。

官方还表示,相较于GPT-4o等现有的大模型,OpenAI o1能够解决更加困难的推理问题,同时改善过往模型中存在的机制性缺陷。

比如在解答编程问题时也会更有条理,在着手写代码前,把整个回答的流程全部思考完一遍,再动手输出代码。

不过,经过实测,OpenAI o1依然无法解决“9.11和9.8哪个大”的经典难题,严重扣分。

因为9.11和9.8哪个大这个问题,之前AI大模型集体失智,所以....

(责编: admin)

免责声明:本文为转载,非本网原创内容,不代表本网观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。

如有疑问请发送邮件至:goldenhorseconnect@gmail.com