yjhatfdu2

Jev 基本上就是个纯噱头,本科生课后作业水平

  •  
  •   yjhatfdu2 · 2h 31m ago · 823 views

    我进行了以下测试发现 Jev 完全没有任何价值完全是噱头,

    1. 我使用了 vllm+Qwen3.8 27B 本地部署,构造一个 prompt ,直接从接口输出 topk logprobs ,直接可以读取单选项 token 概率换算即可,不需要自定义采样,几行脚本就行都不需要很复杂的开发
    2. 各种官方用例端到端延迟 100ms 以内(包含网络延迟),并没有比官方的慢(实际上官方 API 基本上在 1000ms 以上),用小模型会更快
    3. 测试了官方给的各种简单和疑难案例,结果符合率 100%
    4. 对于非常明确的问题,Qwen 给出来的 choice 概率更明确更自信
    5. Qwen3.8 还可以做到 Jev 完全做不到的图片输入判断
    6. 使用 GPT 编造足够复杂和绕或者模糊或者专业的问题,Qwen 正确率高于 Jev
    7. 总结:基本就是个本科生机器学习课后作业水平的垃圾玩意儿,现在真的很多人都是 LLM 出来以后才知道 AI ,感性理解 AI ,基本不懂原理,很容易被忽悠
    9 replies    2026-09-22 14:35:09 +08:00
    heganj
        1
    heganj  
       2h 22m ago
    想问下大佬,Jev 官方说的采样器和并行训练,是否有参考价值?
    yjhatfdu2
        2
    yjhatfdu2  
    OP
       2h 20m ago
    @heganj 实际测试不做这些直接用 LLM 已经可以达到足够理想的结果,你还可以很容易的微调小模型适合自己的场景
    yjhatfdu2
        3
    yjhatfdu2  
    OP
       2h 19m ago
    其实主要还是大部分人用 llm 只会输出一长串 json 不会使用原始 logprobs 而已
    billlee
        4
    billlee  
       1h 29m ago
    是啊,我看第一眼感觉就是:“这不就是一开始没有自回归的时候的模型吗”
    hackyuan
        5
    hackyuan  
       53 mins ago
    Qwen 的宣传口、应用口还是缺乏能力,真的是心目中超好用的小模型了。
    SkywalkerJi
        6
    SkywalkerJi  
       45 mins ago
    阿里做事不行,开源还名声这么差。
    wsseo
        7
    wsseo  
       43 mins ago
    不可能吧,最近这么火。不可能每个人都不懂。
    yjhatfdu2
        8
    yjhatfdu2  
    OP
       36 mins ago
    @wsseo 有很多懂的,但更多的不懂在尬吹,和之前吹龙虾的差不多同一批人
    keenkiller
        9
    keenkiller  
       2 mins ago
    如果它预测明天股市的涨跌准确率达到 80%以上,我就承认他有点用 XD
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5710 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 36ms · UTC 06:38 · PVG 14:38 · LAX 23:38 · JFK 02:38
    ♥ Do have faith in what you're doing.