V2EX › 分享发现 Jev 基本上就是个纯噱头,本科生课后作业水平 yjhatfdu2 · 26 mins ago · 130 views 我进行了以下测试发现 Jev 完全没有任何价值完全是噱头, 我使用了 vllm+Qwen3.8 27B 本地部署,构造一个 prompt ,直接从接口输出 topk logprobs ,直接可以读取单选项 token 概率换算即可,不需要自定义采样,几行脚本就行都不需要很复杂的开发 各种官方用例端到端延迟 100ms 以内(包含网络延迟),并没有比官方的慢(实际上官方 API 基本上在 1000ms 以上),用小模型会更快 测试了官方给的各种简单和疑难案例,结果符合率 100% 对于非常明确的问题,Qwen 给出来的 choice 概率更明确更自信 Qwen3.8 还可以做到 Jev 完全做不到的图片输入判断 使用 GPT 编造足够复杂和绕或者模糊或者专业的问题,Qwen 正确率高于 Jev 总结:基本就是个本科生机器学习课后作业水平的垃圾玩意儿,现在真的很多人都是 LLM 出来以后才知道 AI ,感性理解 AI ,基本不懂原理,很容易被忽悠 Jev 噱头 AI 3 replies • 2026-09-22 12:18:34 +08:00 1 heganj 17 mins ago 想问下大佬,Jev 官方说的采样器和并行训练,是否有参考价值?
2 yjhatfdu2 OP 14 mins ago @ heganj 实际测试不做这些直接用 LLM 已经可以达到足够理想的结果,你还可以很容易的微调小模型适合自己的场景 3 yjhatfdu2 OP 13 mins ago 其实主要还是大部分人用 llm 只会输出一长串 json 不会使用原始 logprobs 而已