消费级GPU能跑的开源版本JEV,Bespoke Nimble来了!
基于Qwen3.5-9B LoRA 微调,不靠蒸馏 Jev 。
核心指标:🔹单题推理仅33ms,速度是Jev的6–10倍🔹typed-decisions准确率0.766,高于Jev的0.727🔹校准能力更强:ECE 0.081,对比Jev 0.246🔹支持 choice / score / noul 三类判断模式🔹支持100+语言,Apache 2.0协议,本地部署零成本🔹50%自动放行阈值下,准确率可达约92%
github.com/bespokelabsai/nimble
