昨日、GoogleとMetaが前後して新しいモデルを発表し、評価機関の1回のテストのスコアが200点以上も差がある——まるで血洗いの現場のように見える。しかし、AI業界はこの2年で、すでにランキングの“刷り方”をどこまででも把握している。まずはこっそり社内のバージョンを数十個テストし、最高得点のものを選んでランキングに提出する。こうした操作は、2025年の論文『ランキング幻覚』で明確に暴かれている。聞き覚えがありませんか?暗号資産界隈のTVL、TPS、日活(DAU)のランキングでも、やっていることは同じ——指標がKPIに変わった瞬間、すぐに誰かが刷り始める。本当に誰が残れるかを決めるのは、発表当日のベンチマークではなく、3か月後に本当に誰かが使っているかどうかだ。AIでも、チェーン上のプロジェクトでもいい。ランキングを見るな、リテンションを見ろ。$BTC $ETH #Crypto #AI #Web3
