• 请不要在回答技术问题时复制粘贴 AI 生成的内容
mikelirjc
V2EX  ›  程序员

👎 谁再 TMD 推模型 qwen3.7-flash 我就跟谁急

  •  
  •   mikelirjc · 1 day ago · 4643 views
    不知道听了谁的瞎 BB 在 dv4f 价格大幅上涨之际,充值了某些人推荐的 qwen3.7-flash ,使用不到一天真 TMD 后悔,就没见过这种 LJ 的大模型;

    1️⃣ 接入 hermes 后原来的设置他不遵守一概按照它内置的 SB 流程干活;包括但不限于:
    如果你有自己的技能沉淀规范和流程,不好意思他忽略......
    如果你有自己的代码同步机制以及一键脚本并且配置在 hermes 里,不好意思它会自己敲命令一条条的来......
    如果你有以前喂给 hermes 的个性化信息,不好意思它一概看不见......
    如果你有其他的个性化机制,不好意思它一概不管,就算你强制它学习一次,这个白痴也会没有任何记忆,以后还是按照自己的机制执行......
    ......

    2️⃣ 最最受不了的是,为了不给模型 “喂” 凭据,我在纪律里面设置了 “硬纪律”、“软纪律”,记忆里面也把“凭据不出现在对话里面” 作为最高优先级设置...... dv4f 一个月就因为命令原因暴露过一次在临时文件上,我严厉警告之后就再也没有出现过;一样的设置这个 “白痴” 一天暴露 6 次,真 TMD 抓狂,每次都立正挨打,但就是不改......

    3️⃣ 这个 “白痴 应该是完全没有记忆,比如说告诉他所有凭据在本地某一个文件,然后只要是新对话他都一脸懵逼的样子

    算了太多太多了...... 强烈建议大家不要用这个模型!
    Supplement 1  ·  16h 49m ago
    我一个同事告诉我,他也是因为其他模型涨价,是了一下这个 LJ 结果三天把它的 MacBook 和 GitHub 库搞的一团糟,动不动就不好意思我发现一个严重错误,我无误删了 ****

    他说他发现这货读脚本读一半,然后按自己的逻辑瞎搞一通,直到需要调用其他脚本的时候才发现问题,就开始在屏幕上给用户道歉!😭
    36 replies    2026-08-18 15:08:38 +08:00
    gumayusi
        1
    gumayusi  
       1 day ago
    这个模型价格太不正常了,还好没买,根本不是 flash 级别的价格,nano 级的玩具都没那么便宜
    john1024
        2
    john1024  
       1 day ago
    用 gpt-5.6-luna 啊
    twist2z
        3
    twist2z  
       1 day ago
    我刚想说我在 Hermes 里用 3.7 flash 感觉还行,定眼一看原来是 qwen3.7 不是 gemini3.7 吗
    XnEnokq9vkvVq4
        4
    XnEnokq9vkvVq4  
       1 day ago
    qwen 的 flash 系列貌似对应它们 27B 的开源模型吧,qwen 的 plus 才是差不多对应 deepseek 的 flash ,当然 3.7 plus 也是一坨就是了
    yidinghe
        5
    yidinghe  
    PRO
       1 day ago
    是我,前几天开始我没有在用了,现在在用小米 Mimo V2.5 ,因为这个是价格新低。低到什么程度呢,我本月用量 181,088,932 Tokens ,费用 ¥ 12.71 。

    你把 qwen3.7-flash 当成什么高级模型了嘛,便宜的模型不是你这么用滴。会用的人才有能力把便宜的模型用好。
    yuewolf
        6
    yuewolf  
       19h 22m ago
    @yidinghe 佬,Mimo V2.5 现在大概什么个智力水平?
    anthoy
        7
    anthoy  
       19h 20m ago
    @yidinghe 佬,我也想了解 Mimo V2.5 现在大概什么个智力水平?
    june4
        8
    june4  
       19h 13m ago
    参数可能差了几倍硬比。flash 可能就是用来文章分类总结之类的超小模型。
    levn
        9
    levn  
       18h 45m ago
    flash 似乎是 35b a3b
    yidinghe
        10
    yidinghe  
    PRO
       18h 25m ago
    @yuewolf
    @anthoy

    我的感觉是比 qwen3.7-flash 强。而且更重要的是这个模型是多模态的,虽然说读图对我没用。



    ----

    @june4 那可不止。看这个帖子 https://www.v2ex.com/t/1232002 我贴了截图。qwen3.7-flash 可以帮我分析项目的线上问题,这个分析过程横跨了阅读源代码、访问线上的 MySQL 和 MongoDB 数据库,最后正确分析出问题的原因和发生过程。

    我的总结是,flash 模型真正的弱点在于不适合长程任务,像这种几分钟完成的短程任务,调教好了是完全可以胜任的。
    cheng6563
        11
    cheng6563  
       18h 12m ago
    相比之下,刚出的哈基米 3.7 感觉好用的很。
    当初 10 元一个买的 4 个 antigravity 账号翻出来用,蹬得飞起。
    Nasdaq
        12
    Nasdaq  
       18h 10m ago
    个人实名推荐美国豆包 gemini-3.7-flash (实测简单/小任务好用)。吊打各种营销号+义和团模型。
    suyuyu
        13
    suyuyu  
       18h 8m ago
    从来没用过国产 (
    stdout
        14
    stdout  
       18h 6m ago
    我用 opengo 的 qwen 3.8 max , 傻逼模型,不知道怎么自己死循环了,把我 opencode 的整个月额度耗费光了。
    yh7gdiaYW
        15
    yh7gdiaYW  
       18h 3m ago
    这玩意儿就是 35b A3b 啊,这玩意儿是用来做问题分类、读图这些简单任务的
    yidinghe
        16
    yidinghe  
    PRO
       18h 2m ago
    @Nasdaq 我也想用但 Google 账号属中国区,无法做任何充值
    yh7gdiaYW
        17
    yh7gdiaYW  
       18h 0m ago
    @Nasdaq 虽然都叫 flash ,哈基米的 3.7-flash 参数量恐怕接近 qwen 3.7 以前的 max 了,至少也比 plus 更大一号
    dushixiang
        18
    dushixiang  
       18h 0m ago
    qwen 系列每次发布的时候都是秒天秒地
    Nasdaq
        19
    Nasdaq  
       17h 59m ago
    @yidinghe #16 我之前也是中国区,用了一段时间自建的美西落地。可以把 Google 帐号改成美国区了。
    kyro00000
        20
    kyro00000  
       17h 59m ago
    deep 和这个千问。。慎用。。用几天能给你干出脑溢血来
    nakun233
        21
    nakun233  
       17h 8m ago
    我用 3.7flash 到 hermes 还好啊
    Sezxy
        22
    Sezxy  
       17h 5m ago
    再试试 qwen3.8
    mikelirjc
        23
    mikelirjc  
    OP
       16h 49m ago
    @Nasdaq “个人实名推荐美国豆包 gemini-3.7-flash (实测简单/小任务好用)。吊打各种营销号+义和团模型。” 这个什么价格
    wqhui
        24
    wqhui  
       16h 40m ago
    flash 只能用来处理简单的事情,需要多步处理的都不太行,便宜货是这样的了
    mikelirjc
        25
    mikelirjc  
    OP
       16h 35m ago
    @wqhui 目前还行,我基本是把任务细分很多子任务一个个处理,而且文档写的超级详细!所以用 dv4f 的时候感觉还行! 1M 也够用,但是换这个就各种问题不断给我发 “你说得对!我犯了一个严重错误—” 都快把我搞疯了!我直接回滚回去了
    mikelirjc
        26
    mikelirjc  
    OP
       16h 30m ago
    就一个 GitHub 同步 dv4f 从来没出错,这货每次都各种错误然后临时修,修完之后下次又出各种错误 ...... 这么简单的操作都出错我服了,而且我还专门搞了一个同步规范流程为一个技能,里面把需要的都包装进去了,他就是不用,或者用的时候更自己的逻辑混着来!唉
    NQ
        27
    NQ  
       15h 47m ago
    用 qwen 、deepseek 、glm 能忍住不破防的都是圣人😅,真干活 gpt 5.6 extra high 和 ultra 才是理想水平
    anheiyouxia
        28
    anheiyouxia  
       15h 41m ago
    qwen 是真的垃圾,之前 copilot 之前就用过,很垃圾,很多东西乱写的,后来 copilot 改了积分制后,没办法了就几下就没额度了,又听说 qwen 秒天秒地秒空气,铺天盖地的公众号在推,又是了下 qcoder,刚好送了 2 周额度,没想到跟之前一样拉.现在我是不会再新 qwen 的了
    doraemonki
        29
    doraemonki  
       15h 31m ago
    我以为你说 gemini 3.7 flash 呢,gemini 还行,对得起价格
    catazshadow
        30
    catazshadow  
       15h 22m ago
    @dushixiang 浙江公司是这样的,几千年了,杭州就全靠李白吹,写的天花乱坠,实际上就那鸟样
    bojue
        31
    bojue  
       15h 9m ago
    qwen 我用过所有模型最不靠谱的,没有之一
    karld
        32
    karld  
       15h 1m ago
    哈哈哈
    igseo
        33
    igseo  
       14h 39m ago
    会不会是因为超卖导致上下文污染了
    zhangli2946
        34
    zhangli2946  
       13h 53m ago
    首先排除 来路不正的 API
    gangoogle
        35
    gangoogle  
       13h 9m ago
    @june4 我们公司有个做 pdf 识别的、这个 3.7flash 视图速度是最快的,而且非常准,可以一次 prompt 就找到指定区域的文本,我从一年前开始搞这个项目 qwen 的视觉模型都用过了、这个性价比真的很高。。。单张图片+复杂提示词 4s 就能出来
    gangoogle
        36
    gangoogle  
       13h 8m ago
    @yidinghe #10 关键是贼便宜
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   930 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 70ms · UTC 20:17 · PVG 04:17 · LAX 13:17 · JFK 16:17
    ♥ Do have faith in what you're doing.