六十多億次人工智能請求,被整理成了一份公開數據。

去中心化推理平臺Chutes與哈佛大學的研究者合作,公開了一份可能是同類中規模最大的大模型服務元數據數據集。數據覆蓋一年,從2025年4月11日到2026年4月12日,包含六十一億兩千兩百四十一萬三千七百五十六次請求、九千一百七十四個模型、三十一萬四千九百七十名匿名用戶,可經代碼託管平臺與校方存儲下載。

公開的是元數據,不是對話內容。裏面有時間、令牌數量、延遲和首字響應時間,沒有提示詞,也沒有回答。這種只放元數據的做法,本身是隱私與可研究性之間的一次取捨。

這一年的流量裏,輸入令牌約三十五點八萬億,輸出約二點五二萬億。研究者給出的一個結論是,約百分之九十九的請求在十五分鐘內是重複的,這些數字讓外界第一次能按真實流量估算推理服務的成本結構。

這個比例對基礎設施的意義很直接。既然大量請求在短時間內重複,緩存和調度就有很大的優化空間,而不是一味堆算力,重複率帶來的價值可能高於參數規模。

最貴的問題,往往是被重複問了很多遍的那個。

#人工智能 #數據