OptimismBench 对16个前沿AI模型进行了概率偏差测试,发现AI模型的概率估计存在普遍性偏差且方向截然相反。据 Tech Times 报道,以 GPT 为代表的大多数模型倾向于高估成功概率,而 Anthropic 的 Claude 则系统性地偏向悲观。研究表明,这种偏差可以追溯到训练数据和方法,为AI安全评估提供了新的研究视角。
来源:Tech Times
OptimismBench 对16个前沿AI模型进行了概率偏差测试,发现AI模型的概率估计存在普遍性偏差且方向截然相反。据 Tech Times 报道,以 GPT 为代表的大多数模型倾向于高估成功概率,而 Anthropic 的 Claude 则系统性地偏向悲观。研究表明,这种偏差可以追溯到训练数据和方法,为AI安全评估提供了新的研究视角。
https://www.msn.com/en-us/technology/artificial-intelligence/ai-probability-bias-traced-to-training-claude-pessimistic-gpt-optimistic-across-all-tests/ar-AA295MJb
评论
0