8 月 18 日,据 MaxForAI 披露,今日在 X 平台爆火的 AI 项目 J-Space Cognition Suite 遭社区质疑,被指其宣传的 DeepSeek V4 测试成绩无法复现。项目此前宣称,V4 Flash 搭配 J-Space 可追平 GLM-5.3,V4 Pro 则能在多个 Agent Benchmark 上超过 Fable 5,同时速度提升 2.53 倍、Token 效率提升 2.21 倍。
GitHub 用户 GoForceX 使用 Terminal Bench 2.1 的 87 道题子集进行高并发复测,并确认加载 J-Space 相关模块。结果显示,加入 J-Space 后 Benchmark 成绩反而略有下降,Token 使用量和成本均有所增加,与项目宣称的性能、速度及 Token 效率提升方向相反。
社区随后要求项目公开完整评测配置、逐题结果、运行日志、原始耗时及 Token 消耗等数据。目前项目主要公开汇总结果,尚未提供足以验证上述精确数据的完整原始实验记录。值得注意的是,面对质疑,项目作者曾回应称相关数据「确实是夸张的」,并表示实际提升大致处于 1.6 倍至 3 倍之间。截止目前,作者尚未就社区质疑作出正式回应,部分相关质疑 Issue 已被删除。

🧧🧧🧧回复221获得$SOL 🧧🧧🧧
🎁🎁🎁👇👇👇🎁🎁🎁