据Unite.ai报道,一项最新研究发现,当AI模型使用日语进行推理时,其做出发动核打击等极端决策的可能性显著降低。这一发现引发了对语言文化背景如何影响AI安全行为的新讨论,为AI对齐研究提供了新视角。
评论
0