返回全部动态

J-Space造假案引热议:思维链作者称小模型加工具难敌大模型

原标题:Harness 神器 J-Space 造假案背后,思维链作者暴论,小模型 + 工具干不掉顶级大模型

雷峰网 AI科技评论观点质量 74

AI 摘要

雷峰网报道了开源项目J-Space Cognition Suite被指造假,其宣称通过外部Harness让小模型追平甚至超越顶级大模型,但独立复测结果相反。OpenAI思维链发明者Jason Wei发文指出小模型加工具无法替代大模型的内化能力,引发行业对Scaling Law与工程路线的讨论。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

0 作者丨高允毅 编辑丨岑 峰 这两天在 X 上,一款蹭 DeepSeek 热度的 Harness 工具被打假了。 这是一个名为 J-Space Cognition Suite 的开源项目,它声称无需修改模型权重,仅靠 DeepSeek V4 Flash 加其精巧的外部 Harness,就能在 Agent 任务中追平 GLM-5.3;若换成 DeepSeek V4 Pro,甚至能直接超越Claude Fable 5。同时速度提升 2.53倍,Token 效率提升 2.21倍。 如果这是真的,这无疑是 AI 工程史上的奇迹。这意味着J-Space能用几十分之一的成本复刻顶级大模型的效果。 然而,泡沫破裂的速度比想象中更快。 GitHub 用户 GoForceX 严格按照项目说明,使用 Terminal Bench 完成了独立复测,最终结果与宣传完全相反。加入 J-Space 后,基准测试分数不升反降,Token 消耗量明显增加,推理速度也比原生模型更慢。 当社区进一步要求公开完整原始实验数据时,作者承认数据 "确实夸张",却始终拿不出可复现的运行日志,反而开始删除质疑的 issue。 几


发布时间:2026-08-20 11:53
抓取时间:2026-08-20 14:08
来源机构:雷峰网
阅读原文leiphone.com