blackantt
V2EX  ›  Claude

为啥 fable 5-max 有时给的方案没有 gemini 好呢? 是智者千虑吗?

  •  
  •   blackantt · 1 day ago · 2170 views

    如题。 看来不能看低了 gemini 。

    8 replies    2026-08-30 09:46:10 +08:00
    chjqpmain
        1
    chjqpmain  
       1 day ago
    需求以及 fabel 和 gemini 各自给的方案也发一下吧,方案的好坏,你自己一个人的评价有一定价值,但是多个人的更类似多次独立实验,更有意义吧.
    毕竟人自己也可能当局者迷
    chjqpmain
        2
    chjqpmain  
       1 day ago
    然后智者千虑和愚者千虑 我个人理解为大数定律类似的意思,
    肯定没有一个东西给的答案,永永远远都是最好的,
    而且评判什么是好的人的状态会变,人也可能会变,标准也可能变,

    并不能单纯的说不能看低了 gemini,一切本就都可能有其独特之处,feature 和 bug 只在一念之间
    szzadkk
        3
    szzadkk  
       1 day ago
    可能 95%的置信度强的模型给出的结果是比较好的,但是不排除有极少可能翻车
    cellsyx
        4
    cellsyx  
       1 day ago
    1. 模型输出本来就是有概率的,再强的模型也避免不了失误,只是出问题的概率低一些而已
    2. 不同模型擅长内容不一样,比如 Gemini 实现的前端效果是公认的好,但是后端任务也是公认的烂
    3. 可能撞到服务端问题 fable 模型降智,或者 fallback 到了其他模型
    4. 检查一下使用两个模型时的提示词和背景资料是不是给的完全一样
    moon2a
        5
    moon2a  
       1 day ago
    同意楼上关于概率的看法,同时想看看楼主的提示词和方案
    nakun233
        6
    nakun233  
       1 day ago
    先要理解 LLM 的本质
    Sorhyu
        7
    Sorhyu  
       7h 17m ago
    可能也要考虑模型训练的侧重,Gemini 定位是北美豆包,那么稀奇古怪的训练内容应该很多。
    如果需求较为偏僻,Gemini 的答案比较 anthropic 的偏执狂可能给的方案更有“人性”一点。
    我有一个 review 任务 DeepSeek pro 好几遍都跑不明白,Gemini 3.7 flash 一次就点中要害。。。
    v400127
        8
    v400127  
       6h 43m ago
    @Sorhyu 这可真实抬举豆包了...
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2893 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 42ms · UTC 08:30 · PVG 16:30 · LAX 01:30 · JFK 04:30
    ♥ Do have faith in what you're doing.