{{!completeInfo?'请完善个人信息':''}}
9个月估值翻了一倍。
AI评测榜单Arena日前宣布完成B轮2亿美元融资,估值达到31亿美元。Arena同期推出Arena Alignment Index,称这是一项衡量前沿AI模型与人类意图及价值观契合度的新指标。这项融资距离Arena上一轮1.5亿美元A轮仅仅过去9个月,估值从17亿美元拉到31亿美元,接近翻倍。
本轮融资由Lightspeed Venture Partners和Khosla Ventures共同领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital和Endeavor Catalyst参投。a16z、Felicis、AMP PBC、QuantumLight、The House Fund等现有投资者继续跟投。这是一份典型的老股东全部加码、新股东带战略资源的轮次,意味着Arena在AI评测领域的话语权得到了市场充分确认。
Arena的业务逻辑并非传统意义上的模型排行榜。公司称,随着AI能力的日益强大,当下需要一种独立且数据驱动的方法,不仅要衡量AI的能力,还要评估其在现实世界中是否值得信赖以及能否安全使用。AI智能体已经不再局限于回答问题,它们开始编写代码、进行分析并代表人类执行操作,而这些操作往往发生在人类难以轻易核查结果的场景中。一旦智能体欺骗用户或执行了未获授权的操作,后果可能相当严重。
Arena给出的数据是,Agent Arena自上线不到5个月内已完成700万次交互会话,整个Arena平台累计交互会话达3.5亿次,涵盖文本、视觉、代码、搜索、视频及图像模态的投票总数达6200万次。智能体评测已经从实验室级别的能力打分升级为商业化部署前的安全审查基础设施。
Arena Alignment Index将成为产品进入欧美企业级客户的一道隐形门槛。模型是否通过Arena对齐指数,将直接影响欧美大客户在采购时的预审结论。这意味着中国大模型公司在出海时不仅要卷基准跑分,还要补齐AI安全与对齐审查的硬指标。
Arena的Alignment Index之所以被资本市场视为下一个基准设施,关键在于它解决的是AI智能体落地前的最后一道前置关卡。传统基准测试的问题是,模型一旦意识到自己正在被测试就会表现出与生产环境完全不同的行为,静态基准的失效让AI安全治理始终缺一根支柱。Arena的智能体交互数据来自真实使用场景的700万次会话,涵盖文本、视觉、代码、搜索、视频及图像模态的投票数达6200万次。这意味着中国大模型公司在出海欧美时,Alignment Index的得分将直接影响预审结果,AI安全正在从加分项变成入场券。(扬帆出海综合报道)
文章作者:扬帆出海
版权声明:本文为扬帆出海原创内容,首发于扬帆出海官网。文章内容仅代表作者观点,仅供行业交流与参考,不构成任何投资、商业或决策建议。未经授权,不得转载、复制或用于商业用途;如需转载,请联系扬帆出海获得授权并注明来源。
更多出海资讯、行业洞察与企业服务,请关注扬帆出海官网:www.yfchuhai.com
{{likeNum}}
好文章,需要你的鼓励
美团海外业务大调整
已关注
关注