国产多模态大模型开源！无条件免费商用，性能超Claude 3 Sonnet | 人人都是产品经理

APP

起点课堂会员权益

职业体系课特权

线下行业大会特权

个人IP打造特权

30+门专项技能课

1300+专题课程

12场职场软技能直播

12场求职辅导直播

12场专业技能直播

会员专属社群

荣耀标识

发布

注册 | 登录

国产多模态大模型开源！无条件免费商用，性能超Claude 3 Sonnet

2024-04-29

0 评论 646 浏览 0 收藏

产品经理的职业发展路径主要有四个方向：专业线、管理线、项目线和自主创业。管理线是指转向管理岗位，带一个团队..

现在国内的大模型发展日新月异，比如正文提到的元象发布的这款开源大模型，各个方面的表现都很不错。

又一个国产多模态大模型开源！

XVERSE-V，来自元象，还是同样的无条件免费商用。

此前元象曾率先发布国内规模最大的开源大模型，如今开源家族系列又多了一个。

最新的多模态大模型支持任意宽高比图像输入，在主流评测中保持着效果领先——

在多项权威多模态评测中，XVERSE-V超过零一万物Yi-VL-34B、面壁智能OmniLMM-12B及深度求索DeepSeek-VL-7B等开源模型。
在综合能力测评MMBench中超过了谷歌GeminiProVision、阿里Qwen-VL-Plus和Claude-3V Sonnet等知名闭源模型。

支持任意长宽比图像输入

传统的多模态模型的图像表示只有整体，XVERSE-V 采用了融合整体和局部的策略，支持输入任意宽高比的图像。

B端产品经理的能力模型与学习提升

B端产品经理面临的第一大挑战，是如何正确的分析诊断业务问题。这也是最难的部分，产品设计知识对这部分工作基本没有帮助，如果想做好业务分析诊断，必须具备扎实 ...

兼顾全局的概览信息和局部的细节信息，能够识别和分析图像中的细微特征，看的更清楚，理解的更准确

这样的处理方式使模型可以应用于广泛的领域，包括全景图识别、卫星图像、古文物扫描分析等。

△示例- 高清全景图识别

△示例-图片细节文字识别

除了基本能力表现不错，也能轻松应对各种不同的实际应用场景，比如图表、文献、代码转化、视障真实场景等。

图表理解

不论是复杂图文结合的信息图理解，还是单一图表的分析与计算，模型都能够自如应对。

自动驾驶

代码撰写

还有视障真实场景

在真实视障场景测试集VizWiz中，XVERSE-V的表现超过了InternVL-Chat-V1.5、DeepSeek-VL-7B等几乎所有主流的开源多模态大模型。该测试集包含了来自真实视障用户提出的超过31000个视觉问答，能准确反映用户的真实需求与琐碎细小的问题，帮助视障人群克服他们日常真实的视觉挑战。

本文由人人都是产品经理作者【量子位】，微信公众号：【量子位】，原创/授权发布于人人都是产品经理，未经许可，禁止转载。

题图来自Unsplash，基于 CC0 协议。

更多精彩内容，请关注人人都是产品经理微信公众号或下载App

追踪人工智能新趋势，关注科技行业新突破

72篇作品 188702总阅读量

大模型“终结”自动驾驶

06-301960 浏览

大模型“终结”自动驾驶

聚合支付通道如何对接？

09-082811 浏览

聚合支付通道如何对接？

产品经理难题：别人都在管理，我还在画原型，为何？

刚刚

低频+高客单，会员复购率超32%，周大福是如何做好会员运营的？

12-114536 浏览

低频+高客单，会员复购率超32%，周大福是如何做好会员运营的？

WhatsApp Business为什么会被封号？该如何解决

11-012751 浏览

WhatsApp Business为什么会被封号？该如何解决

数字游民的旅居AB面：自由与舒适，以及众多的不确定性

03-151990 浏览

数字游民的旅居AB面：自由与舒适，以及众多的不确定性

评论

目前还没评论，等你发挥！

小公司成长记：如何自我提升业务理解能力？

私域案例 | 1个月加粉5w+，百万GMV，金融行业标杆加粉链路拆解，他们是怎么做的？

04-183940 浏览
AI生成写真照，妙鸭能取代海马体？

07-264409 浏览
互联网金融信贷中，新客户营销流程及常用监测指标

09-185340 浏览

19474人已学习13篇文章

广告商业化流量变现的思路

如何通过广告模式来进行商业化流量变现？本专题的文章提供了广告变现的思路。

13714人已学习13篇文章

了解货运平台

互联网IT技术与产业的结合，衍生出了许多生命力强大的平台经济，货运领域就是如此衍生而来的。本专题的文章帮助大家了解货运平台。

12861人已学习12篇文章

产品经理如何挖掘数据？

数据挖掘是指从大量的、不完全的、有噪声的、模糊的、随机的数据中通过算法搜索隐藏于其中信息的过程。本专题的文章分享了如何挖掘数据。

64418人已学习26篇文章

促活：搭建用户激励体系，让用户持久活跃不变心

好不容易拉来的用户，千万别让TA溜走了。

15152人已学习12篇文章

互联网金融风控体系的设计指南

本专题的文章分享了互联网金融风控体系的设计指南。

56689人已学习14篇文章

如何策划一次靠谱的线上活动

一次成功的线上活动能让你刷爆朋友圈，拉新活跃留存应有尽有。