最近我越来越觉得,AI下一阶段真正稀缺的东西,可能不是算力,而是可信的人类数据
互联网上从来不缺数据,缺的是你能不能证明:
这些数据来自真实的人,而不是Bot、批量账号或者AI自己生成的内容
这个问题正在变得越来越严重。模型越强,AI生成内容越多,互联网就越容易进入一个循环:
AI读取人类数据 → 生成更多内容 → 新模型再拿这些 AI 内容训练
最后数据量越来越大,但真正来自人类世界的有效信号反而被稀释
KGeN 做的不是简单的数据标注平台,而是在搭一层 Verified Human Network
目前它的网络覆盖 60+ 个国家、45+种语言,K-Quest可以收集语音、图像、视频以及真实环境中的多模态数据;背后的Reputation System又通过Proof of Human、Proof of Skill、Proof of Engagement等维度持续验证参与者
这两层结合起来很关键
未来AI公司买的可能不再只是100万条数据,而是:
100 万条来自什么人、什么地区、什么语言、什么真实环境,并且可以验证来源的数据
尤其当 AI 从聊天框走向机器人、自动驾驶、Voice AI、World Model,数据需求也会从文字变成声音、动作、空间和真实世界反馈
KGeN 已经在往 Physical AI 方向扩展。它现在强调的 Sound、Sight、Motion 等多模态数据,本质上是在押注 AI 下一阶段的数据入口
我觉得 $KGEN 更值得观察的地方也在这里
如果 Verified Human Data最终成为AI产业链里的基础资源,那么 KGeN 面向的市场就不只是Web3,也不只是游戏用户增长,而可能继续延伸到LLM训练、模型评测、Voice AI、机器人、World Model,甚至更广泛的人机协作数据市场。其 KAI 网络已经覆盖Coding、Healthcare、Financial Services、Legal等专业领域的人类专家
过去 AI 时代争的是谁拥有更多数据
接下来可能争的是:
谁能证明这些数据真的来自人类
数据越容易生成,真实反而越贵
这可能才是 KGeN 最值得关注的长期叙事