登录
首页 >  科技周边 >  人工智能

击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三

来源:机器之心

时间:2024-06-28 22:48:54 334浏览 收藏

最近发现不少小伙伴都对科技周边很感兴趣,所以今天继续给大家介绍科技周边相关的知识,本文《击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三》主要内容涉及到等等知识点,希望能帮到你!当然如果阅读本文时存在不同想法,可以在评论中表达,但是请勿使用过激的措辞~

近日,云从科技从容大模型在综合评测权威平台 OpenCompass 的多模态评测领域中取得重大进展。最新评测结果显示,云从科技的从容大模型在该体系中的平均得分为 65.5,这一成绩使得从容大模型跻身全球前三,超越了谷歌的 Gemini-1.5-Pro 和 GPT-4v,仅次于 GPT-4o(69.9)和 Claude3.5-Sonnet(67.9)。而在国内市场,从容大模型的成绩也超过了 InternVL-Chat(61.7)和 GLM-4V(60.8),排名首位。

击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三

1. OpenCompass 多模态榜单
  1. OpenCompass 大模型开放评测体系是上海人工智能实验室推出的完整开源可复现的评测框架。
  2. OpenCompass 多模态评测方面采用了 8 个具有代表性的数据集,从多种视角客观量化多模态大模型的能力,评估维度覆盖:

    • 目标检测
    • 文字识别
    • 动作识别
    • 图像理解和关系推理
    • 艺术与设计
    • 商业
    • 科学
    • 健康与医学
    • 人文与社会科学
    • 技术与工程
    • 数学推理

      击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三

                                   图 2:从容大模型 - 2.0 多模态能力示例

在本次测评中,从容大模型在其中的 6 个数据集表现优异,排名国内第一(MMbench、MMStar、MathVista、HallusionBench、AI2D、OCRBench),尤其是在 OCRBench 测试集上以 827 分(总分为 1000 分)取得全球最高分,且高于第二名 GLM-4v 13 分,进一步提升从容大模型在文本识别、以文本为中心的视觉问答、面向文档的视觉问答、关键信息提取等业务场景下的适用性。

击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三

图 3:OpenCompass 中国大模型能力展示

从容大模型在此体系中的优秀表现,依赖云从科技自研的高效多模态处理架构和先进的计算技术,实现了高效的多模态数据处理能力,能够在视觉和语言任务之间实现高效的融合和切换,并最大化利用计算资源,保证在处理大规模多模态数据时仍能保持较高的性能和响应速度,使得模型的训练过程更加高效,收敛速度更快,性能更稳定。

同时也得益于云从科技长期在视觉、语言领域的深厚积累和不断创新。

击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三

                             图 4:从容大模型 - 2.0 多模态能力示例

此前,从容大模型已在视觉、跨模态领域 10 次刷新世界纪录,综合性能经第三方 SuperClue、C-Eval 等综合评测,位列全球前五。

作为一家专注于人机协同技术研发的平台企业, 云从科技 一直在积极推动 AI 智能体及大模型技术 的发展和应用。

随着人工智能技术的迅猛发展,多模态大模型已成为驱动产业变革的核心引擎。此次从容大模型在 OpenCompass 大模型开放评测体系 中的出色表现,不仅是对 云从科技 技术创新实力的认可,更在业界树立典范,激励全球科技企业在新一轮的人工智能竞争中勇攀高峰。

理论要掌握,实操不能落!以上关于《击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三》的详细介绍,大家都掌握了吧!如果想要继续提升自己的能力,那么就来关注golang学习网公众号吧!

声明:本文转载于:机器之心 如有侵犯,请联系study_golang@163.com删除
相关阅读
更多>
最新阅读
更多>
课程推荐
更多>