节后上班第一天,姚顺雨坐在了马化腾旁边。这是广东省领导调研腾讯的座谈现场,能坐到Pony身边,是腾讯高层对他的明确认可。更直接的成果来得很快:他出任腾讯AI Data部负责人刚不到一个月,旗下的混元Hy4 Preview就拿到了Arena对齐指数榜单的中国第一,全球第五,得分78.5。
新官上任三十天,姚顺雨手里的牌是什么?
其实从今年上半年起,姚顺雨就已经在实际管理腾讯AI Data部,直到9月才正式获得任命,向TEG总裁卢山汇报。这个部门管的是大模型的数据采集、整理和评测体系建设,原负责人是刘煜宏。现在模型、基础设施、数据、评测全归他一手抓,这刚好和他2025年写的《The Second Half》里的判断对上:AI下半场的瓶颈,不再是怎么训练模型,而是让它符合用户的真实需求。这次的对齐榜单,就是他这套思路的直接落地。
对齐指数测的不是跑分,是模型会不会“越狱”
和之前拼性能、刷跑分的榜单不同,Arena这次的Alignment Index,专门测模型的安全风险。它基于9万多条真实的Agent会话,覆盖27个模型,挑的全是模型“不听话”的时刻。核心看三个指标:UA越权、FA甩锅、DC虚假完成。
Hy4的UA越权率是1.47%,是中国实验室里最低的,意味着它最少“擅自动手”;但DC虚假完成率是13.24%,100次任务里大约13次“谎报军情”——这是它的短板,也是接下来要补的地方。全球第一的GPT-6.1 Sol,DC只有2.34%,差距确实不小。
行业叙事转了,姚顺雨押的方向对吗?
过去大模型的故事是“谁更强”:MMLU分数高、数学题答得好、代码跑分猛,就能抢用户。但现在头部模型的性能越来越接近,单靠分数已经拉不开差距,安全成了新的核心叙事。全球三家顶尖AI公司都调整了模型发布策略:Anthropic启动Project Glasswing,OpenAI、谷歌都把强模型的访问权限限给了少数合作伙伴,理由是“模型太强怕出事”。
这也直接影响到中国AI的出海。之前国内模型出海是自己做海外API卖,现在换成上架AWS这类海外云平台,靠云厂商背书拿订单。比如智谱的GLM 5.3进了Amazon Bedrock,当天智谱港股一度涨超7%。企业采购最怕的就是模型乱删文件、甩锅、谎报进度,对齐问题直接成了出海的准入门槛。
对Hy4来说,78.5分的意义不止是排名,更是拿到了第三方、国际通行的安全背书。之前混元要说服海外客户,只能靠内部的盲测数据,现在有了“越权率1.47%”这样的硬数字。不过它还只是preview版本,13.24%的DC率离第一还有不小距离,榜单本身也刚推出,方法论还需时间检验。
当全球AI行业把“对齐”当成头号难题,下一个拿到国际认可的中国模型,还会是混元吗?
素材来源:钛媒体 · AI情报、大模型
查看报道原文

发表第一条评论吧