多模态视觉语言测评：Gemini-3-pro登顶国内多款大模型表现亮眼-行业纵横-媒体界

近日，SuperCLUE-VLM多模态视觉语言基准测评12月总榜正式揭晓，全球多款主流大模型在基础认知、视觉推理、视觉应用三大核心维度展开激烈角逐，最终谷歌Gemini-3-pro以绝对优势登顶榜首，国内多款模型凭借技术突破跻身前列，展现出中国人工智能领域的强劲实力。

谷歌Gemini-3-pro以83.64分的总成绩领跑全场，其在三项细分指标中均表现卓越：基础认知得分89.01分，视觉推理82.82分，视觉应用79.09分，三项数据均远超其他竞品。这一成绩不仅巩固了谷歌在多模态领域的领先地位，也为行业树立了新的技术标杆。

国内阵营中，商汤科技SenseNova V6.5 Pro以75.35分位居第二，成为榜单中排名最高的国产模型。字节跳动旗下两款模型表现亮眼：豆包大模型以73.15分跻身前三，其视觉版在基础认知环节得分82.70分，甚至超越部分国际竞品，仅在视觉推理环节稍显不足；另一款模型则凭借均衡表现稳居前列。百度ERNIE-5.0-Preview、阿里巴巴Qwen3-vl等模型也成功进入前五，其中Qwen3-vl作为榜单中首个开源且总分超70分的模型，为开源社区贡献了重要技术资产。

国际头部模型在此次测评中表现分化。Anthropic的Claude-opus-4-5以71.44分位列第六，而OpenAI的GPT-5.2(high)仅获69.16分，排名相对靠后。这一结果反映出，尽管国际巨头在通用人工智能领域占据先发优势，但国内模型通过针对性优化和垂直场景深耕，正在逐步缩小技术差距。

据测评机构介绍，本次评估从基础认知能力、复杂视觉推理、实际应用场景适配性三个维度展开，覆盖图像理解、逻辑推断、跨模态交互等关键技术指标。评测数据显示，国内模型在中文语境下的语义理解、文化相关视觉内容处理等方面表现突出，而国际模型则在多语言支持、通用场景泛化能力上保持优势。随着技术迭代加速，多模态大模型正从实验室走向实际应用，在医疗、教育、工业检测等领域展现出巨大潜力。

固态电池首个国标征求意见分类细化判定趋严产业迈向新阶段

2025-12-31

12月31日盘前：*ST亚太等3家公司临停友邦吊顶等2家公司复牌

2025-12-31

京东携手宇树科技首店将开业，机器人ETF鹏华(159278)早盘涨近1%

截至2025年12月30日 09:42，国证机器人产业指数(980022)上涨0.68%，成分股步科股份(688160)上涨8.18%，昊志机电(300503)上涨4.94%，鸣志电器(603728)上涨4…

2025-12-31

交易商协会公布新名单：24家银行券商获非金融企业债务融资工具承销资格

2025-12-31

远方安选单月GMV破10亿：社区电商信任模式崛起，开启行业新增长路径

2025-12-31

空气能热泵供暖“稳定器”：缓冲水箱作用及选型全解析

如果没有缓冲水箱，气体就会在系统中积存，造成主机有时出现流量开关故障和高压报警等问题，影响系统的正常运行。在实际工程中，我们应根据具体情况选择合适的方法来确定缓冲水箱的容量，为热泵供暖系统打造一个稳定、高效的…

2025-12-31

《连线》预测：性能优异灵活部署，阿里千问或引领2026年AI潮流

《连线》杂志采访了数家企业和研究机构，发现千问能够胜任大多数先进AI模型所能完成的任务，已经成为企业落地AI大模型的首选：比如中国“电动汽车之王”比亚迪，将千问集成到其新款车载仪表盘助手中；智能眼镜Roki…

2025-12-31

Meta收购Manus：借AI智能体浪潮，拓展全球AI业务新版图

像CodeGPT、GitHub Copilot、Replit和Jules等编程智能体已经改变了软件开发，而Salesforce和ServiceNow等公司也推出了专为不同行业垂直领域工作自动化设计的AI智能体…

2025-12-31

清华华科联合快手破局：AI视觉系统实现理解与生成“双精通”

研究团队创造性地提出了VQRAE技术，它能够同时产生两种类型的"视觉语言"：一种是连续的语义特征用于理解任务，另一种是离散的精细标记用于生成任务。通过两阶段训练，VQRAE不仅保持了与原始视觉基础模型相当的语…

2025-12-31

跨年夜北京商圈“火力全开”：延长营业多元活动引爆冬日夜经济

2025-12-31

多模态视觉语言测评：Gemini-3-pro登顶 国内多款大模型表现亮眼

多模态视觉语言测评：Gemini-3-pro登顶国内多款大模型表现亮眼