← AI 智库
行业场景
成为AI行业裁判的博士生们
2026 年 3 月 18 日 · TechCrunch Enterprise AI · 2 分钟阅读
Arena(前身为LM Arena)由伯克利博士生创立,七个月内成长为估值17亿美元的LLM公开排行榜,影响融资与产品节奏;本文探讨其结构性中立机制、企业级基准测试拓展及向智能体评测演进的战略路径。

人工智能模型正以极快速度激增,竞争异常激烈。随着众多参与者涌入这一领域,究竟哪一款模型会成为最佳模型——又由谁来决定?Arena(前身为 LM Arena)已崛起为前沿大语言模型(LLM)事实上的公开排行榜,影响着融资、产品发布和公关周期。仅用七个月时间,这家初创公司便从加州大学伯克利分校(UC Berkeley)的一名博士生研究项目发展为 估值达 17 亿美元。
在 TechCrunch 的 Equity 播客本期节目中,Rebecca Bellan 采访了 Arena 联合创始人 Anastasios Angelopoulos 和 Wei-Lin Chiang ,探讨像他们这样的团队如何在所排名的公司同时也是其投资方的情况下,构建一个中立的基准测试平台。
收听完整节目,了解以下内容:
- Arena 实际如何运作,以及其创始人为何表示你无法像对待静态基准测试那样操纵它。
- “结构性中立”究竟意味着什么,以及接受 OpenAI、Google 和 Anthropic 的资金是否构成利益冲突。
- Arena 如何超越聊天场景,通过一款新的企业级产品,对智能体(agents)、编程及现实世界任务进行基准测试。
- Claude 当前为何在法律与医疗应用场景的专家排行榜上领先。
- Arena 对 LLM 之后技术演进的押注,以及为何智能体(agents)将成为排行榜的下一个重点。
在 YouTube、 Apple 播客、 Overcast、 Spotify 及所有播客平台上订阅 Equity。你还可以在 X 和 Threads上关注 Equity,账号为 @EquityPod。
本文由 JOTO AI 智库从已授权的 TechCrunch Enterprise AI 同步并整理。

