关于 Astra 的"对齐"

RERASER 2026-09-04 06:25 1

Claude Fable 虽然可能有幻觉并且有着很高的自信,

但这些幻觉在未经验证之前可以视为猜想与探索并帮助其推进任务目标,

自信可以帮助其持续研究那些可能性微小的想法与关联,

从而在一些比较困难的科研任务上取得超越人类的进展,

比如之前的雅可比猜想反例和黎曼猜想新进展。

而 Open AI 声称 Astra 在训练过程中将其训练为会放弃不可能或无法完成的任务,

无法完成的任务很难定义,

那么 Astra 会不会在困难问题上追求正确放弃推理并声称问题无法解决?


以下是 GPT 5.6 Sol 的回答:


最新回复 (1)
  • 天上火 09-04 06:56
    1

    应该没有想象的那么严重,毕竟这模型之前解决了十个四大级数学问题,这些问题有些难度上看起来也是属于“不可完成的”

* 帖子来源Linux.do
返回