J-Space 宣传数据遭质疑

8月18日,AI 项目 J-Space Cognition Suite 被社区质疑造假。项目方此前宣称,其产品可让 DeepSeek V4 Flash 追平 GLM-5.3,V4 Pro 在多个 Agent Benchmark 上超过 Fable 5,速度提升 2.53 倍,Token 效率提升 2.21 倍。

复测结果截然相反

GitHub 用户 GoForceX 用 Terminal Bench 2.1 的 87 道题进行高并发复测,确认已加载 J-Space 模块。结果显示:

  • 加入 J-Space 后成绩反而略降

  • Token 使用量和成本均增加

  • 与官方宣称的性能提升方向完全相反


要求公开原始数据

社区要求项目方公开完整评测配置、逐题结果、运行日志及 Token 消耗。目前仅有汇总结果,缺乏原始实验记录。项目作者曾私下承认数据"确实是夸张的",实际提升约 1.6 至 3 倍,但未正式回应,部分质疑 Issue 已被删除。