登录
首页 >  科技周边 >  人工智能

OpenAI发布新一代AI模型o3:AGI评测成绩刷新纪录

时间:2024-12-25 21:25:07 462浏览 收藏

哈喽!大家好,很高兴又见面了,我是golang学习网的一名作者,今天由我给大家带来一篇《OpenAI发布新一代AI模型o3:AGI评测成绩刷新纪录》,本文主要会讲到等等知识点,希望大家一起学习进步,也欢迎大家关注、点赞、收藏、转发! 下面就一起来看看吧!

OpenAI在为期12个工作日的线上新品发布活动中,于最后一天重磅推出下一代模型o3,包含正式版o3和精简版o3-mini。OpenAI首席执行官Sam Altman盛赞o3为“极其聪明的模型”,其在软件工程、代码编写、竞赛数学以及掌握人类博士级自然科学知识等方面,均显著超越前代o1模型。更重要的是,o3在OpenAI追求通用人工智能(AGI)的道路上取得了突破性进展,部分测试成绩已达到类人水平。

OpenAI发布新一代AI模型o3:AGI评测成绩刷新纪录

今年9月发布的o1预览版在GPQA-diamond基准测试(涵盖化学、物理和生物学专业知识)中,准确率达到78.3%,已超过人类博士专家的69.7%。而新模型o3在同一测试中的准确率高达87.7%,提升近13%。

在ARC-AGI评估中,o3模型的成绩范围为75.7%到87.5%,超过了代表人类水平的85%门槛。前谷歌高级工程师、AI研究员François Chollet认为,OpenAI这些推理模型在AGI测试中的进步是“稳固的”。

同时发布的o3-mini模型,在性能与成本之间取得了良好平衡,能够以更低的成本提供高效服务。其在编码评估和数学能力测试中表现出色,与o1模型不相上下。

尽管o3的测试结果令人瞩目,OpenAI表示不会很快向公众发布这款强大的推理模型。从12月20日起,OpenAI已允许安全研究人员注册访问o3和o3-mini的预览版本,并计划在明年初正式发布这两个新模型。

好了,本文到此结束,带大家了解了《OpenAI发布新一代AI模型o3:AGI评测成绩刷新纪录》,希望本文对你有所帮助!关注golang学习网公众号,给大家分享更多科技周边知识!

相关阅读
更多>
最新阅读
更多>
课程推荐
更多>