
Only the Market Can Unlock the Value of Data Assets
2026 年,Reddit 與 Google 那份簽約價約 6000 萬美元/年的數據授權合同即將到期續約。加上同期與 OpenAI 簽訂的姊妹合同,兩份協議目前合計為 Reddit 貢獻約 1.3 億美元的年化數據授權收入。分析師預測,續約后兩份合同總價可能跳升至 5.5 億美元。那麼,這些價格是怎麼定出來的?更廣義地,數據資產應該如何定價?
相較於其他資產,數據資產有很強的獨特性,這也決定了對其定價的難度。首先,數據價值高度依賴使用場景。同一份消費者行為數據,對快消品公司價值巨大,對工業品公司可能無用。同一份語料,對訓練通用大模型和訓練專業醫療模型貢獻完全不同。同一份衛星圖像,對量化基金和對保險公司用途差異巨大。數據的價值不存在於數據本身,而存在於「數據 + 買方 + 使用場景」的匹配里。
更關鍵的是,即便鎖定一個買方,數據價值也無法在簽約時被完全確定。一份語料、一份醫療數據庫、一份用戶畫像,它的真實貢獻要在與買方現有資產、產品迭代、其他數據源的交互中才能逐步顯現。買方在使用之前能做的估值——無論是樣本測試、試點項目還是歷史回測——都只是粗略判斷,無法穿透「未來交互」這一層。這兩層因素疊加,意味着數據資產很難有「內在價值」可估。任何外部估值方法——估值標準、定價模型、交易所掛牌價——都很難穿透「使用場景 + 買方組合 + 未來交互」這幾層不確定性。
面對這種獨特性,市場沒有等待理論成熟,而是自發演化出一套精巧的合同設計。
一是短約加續約重談。Reddit 與 Google 的合同期是 2 到 3 年,與 OpenAI 類似。這等於雙方默認「現在定不準,到期再談」。續約本身成了價格發現機制——雙方都已經從中間幾年的實際使用中積累了信息。
二是混合對價。2024 年 News Corp 與 OpenAI 簽訂的總價超過 2.5 億美元的 5 年合同中,News Corp 拿到的不是純現金,而是現金加 OpenAI 的服務抵用額度。這種安排的邏輯是:如果數據真的值錢,那建立在數據上的 OpenAI 服務也會值錢,兩者綁在一起對沖了「現在不知道數據值多少」的風險。
這些條款的功能不是定價,而是讓交易能在雙方都不知道價格的情況下發生。它把「定價」這件事,從一次性事件變成了一個反覆進行的過程。
與市場作為價格發掘機制并行的,是中國正在展開的一個自上而下、全鏈條推進的數據要素市場制度實驗。中國把數據列為繼土地、勞動力、資本、技術之後的第五大生產要素。從 2022 年「數據二十條」、2023 年組建國家數據局,到財政部數據資源入表於 2024 年 1 月施行,再到上海、深圳、北京三大數據交易所運營,制度鏈條完整且自上而下。
這套制度設計與市場發掘價格的機制,不是相互替代的關係,而是可以形成互補。制度框架解決的是市場賴以運轉的基礎條件——權屬界定、入表口徑、交易場所、合規邊界。這些是單靠雙邊交易無法演化出來的基礎設施。但價格本身,仍然只能在交易中浮現。制度無法替代交易,正如交易也無法自發產生制度。
換個角度說:好的制度設計不應替市場決定價格,而應讓市場發掘價格的過程發生得更充分、更順暢。讓真實交易能持續發生、讓續約博弈能積累信息、讓買方間競爭能形成基準、讓合同條款能在迭代中演化——這是制度可以、也應該承擔的角色。
Reddit 2026 年續約最終談出來的價格——無論是 5.5 億美元、3 億美元還是其他數字——都比任何模型更接近「這份數據值多少錢」這個問題的真實答案。因為它來自市場,而且是帶着兩年新信息回來的、第二輪的市場。
熊琰教授
港大經管學院金融學副教授
(本文同時於二零二六年七月二十三日載於《FT中文網》明德商論專欄)






