为啥 fable 5-max 有时给的方案没有 gemini 好呢? 是智者千虑吗?

blackantt 2026-08-28 20:54 1

如题。 看来不能看低了 gemini 。

最新回复 (8)
  • chjqpmain 08-28 21:09
    1
    需求以及 fabel 和 gemini 各自给的方案也发一下吧,方案的好坏,你自己一个人的评价有一定价值,但是多个人的更类似多次独立实验,更有意义吧.
    毕竟人自己也可能当局者迷
  • chjqpmain 08-28 21:14
    2
    然后智者千虑和愚者千虑 我个人理解为大数定律类似的意思,
    肯定没有一个东西给的答案,永永远远都是最好的,
    而且评判什么是好的人的状态会变,人也可能会变,标准也可能变,

    并不能单纯的说不能看低了 gemini,一切本就都可能有其独特之处,feature 和 bug 只在一念之间
  • szzadkk 08-28 22:42
    3
    可能 95%的置信度强的模型给出的结果是比较好的,但是不排除有极少可能翻车
  • cellsyx 08-29 08:18
    4
    1. 模型输出本来就是有概率的,再强的模型也避免不了失误,只是出问题的概率低一些而已
    2. 不同模型擅长内容不一样,比如 Gemini 实现的前端效果是公认的好,但是后端任务也是公认的烂
    3. 可能撞到服务端问题 fable 模型降智,或者 fallback 到了其他模型
    4. 检查一下使用两个模型时的提示词和背景资料是不是给的完全一样
  • moon2a 08-29 11:23
    5
    同意楼上关于概率的看法,同时想看看楼主的提示词和方案
  • nakun233 08-29 14:08
    6
    先要理解 LLM 的本质
  • Sorhyu 08-30 09:12
    7
    可能也要考虑模型训练的侧重,Gemini 定位是北美豆包,那么稀奇古怪的训练内容应该很多。
    如果需求较为偏僻,Gemini 的答案比较 anthropic 的偏执狂可能给的方案更有“人性”一点。
    我有一个 review 任务 DeepSeek pro 好几遍都跑不明白,Gemini 3.7 flash 一次就点中要害。。。
  • v400127 08-30 09:46
    8
    @Sorhyu 这可真实抬举豆包了...
* 帖子来源V2EX
返回