Benchmarks

Arena 年營收跑速破 1 億美元:AI 排行榜把群眾評測變成大生意

2026 年 6 月 29 日,TechCrunch 報導 AI 排行榜公司 Arena 年化營收跑速達 1 億美元:付費的 AI Evaluations 服務八個月內把年化營收從 3,000 萬推上 1 億,群眾評測正式成為一門大生意。

Arena 年營收跑速破 1 億美元:AI 排行榜把群眾評測變成大生意 — 文章封面

6 月 29 日,TechCrunch 報導了一個多數人沒想過的數字:AI 排行榜公司 Arena 的年化營收跑速達到 1 億美元,而距離它推出第一個商業產品只過了八個月。大多數人認識的是它那個免費排行榜:使用者送出提示、比較兩個匿名模型的回答、投票選出較好的一方,累積超過 1,000 萬次評測,涵蓋文字、程式、視覺與圖像生成。執行長 Anastasios Angelopoulos 對此的說法是:「很多人根本不知道我們有在賺錢」、「大家還是把我們看成開源專案」。

從人人免費使用的排行榜,到年收 1 億美元的生意,這中間的轉折值得每個關心模型評測的人細看。

從 Berkeley 專案到 17 億估值公司

Arena 起源於 2023 年的一個 UC Berkeley 研究專案,2025 年 4 月正式成立公司。共同創辦人是執行長 Anastasios Angelopoulos 與技術長 Wei-Lin Chiang,兩位都是 Berkeley 博士後;指導這個專案的則是 Berkeley 教授、Databricks 共同創辦人 Ion Stoica。

資本市場的腳步更快:2026 年 1 月,公司以 17 億美元投後估值完成 1.5 億美元 A 輪,當時年化營收為 3,000 萬美元。累計募資已達 2.5 億美元,投資者包括 Felicis、Andreessen Horowitz、The House Fund、LDVP、Kleiner Perkins、Lightspeed、Laude Ventures 與 UC Investments。

營收引擎:AI Evaluations

收入來自 2025 年 9 月推出的 AI Evaluations:向模型實驗室與企業銷售深入的效能分析。產品上線八個月,年化營收從 3,000 萬美元推到 1 億美元,成長三倍以上。

有一個計費細節必須看清楚。Angelopoulos 說計費基礎是「用量(consumption)」,換句話說,這 1 億美元的「年化營收」並不是真正的經常性訂閱收入,而是把當期用量年化後的數字。在 AI 新創普遍美化 ARR 的環境裡,這是一個誠實但也不能忽略的註腳:用量一旦放緩,這個數字不會像訂閱收入那樣黏住。

真正的對手:資料標註市場

Angelopoulos 對競爭的定位很坦白:Arena 與 Mercor、Surge、Scale AI「搶的是同一塊錢」——模型 post-training 階段的資料與評估工作。這個市場正在快速膨脹:報導引述的數字顯示,Handshake 的 AI 訓練年化營收從 5.5 億美元成長到近 10 億美元,Mercor 則已突破 10 億美元。

同型的群眾評測新創 Yupp 已在 2026 年 3 月關閉,Arena 實質上沒有直接的排行榜對手。排行榜本身也在擴張戰線,透過新的 Agent Mode 開始評測長時程的 agent 工作流,而不只是單輪問答。

影響力與隱憂

Arena 的權威性建立在超過 1,000 萬次群眾投票之上,而投票者很多是為了搶先用到未發表模型而來。這個機制同時是護城河與利益結構:實驗室付費購買深度分析,同時依賴排行榜爭取曝光與信任。當「人人都在用的排行榜」變成年收 1 億美元的生意,評測中立性與商業利益之間的界線,會是接下來每一輪模型發布都會被放大檢視的問題。

對模型團隊的實際啟示有兩個:第一,群眾偏好評測已經是產業定價與定位的基礎設施,不能只看學術 benchmark;第二,排行榜上的名次背後有一門正在高速成長的商業服務,解讀排名時應該把這層生態納入考量。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

這篇內容對你有幫助嗎?

支持本站繼續整理實用的 AI 文章、教學與開發筆記。

請我喝杯咖啡
分享X電郵