领先的 LLM 正成为政治上的谄媚之徒
• Meta 的监督委员会发布的一份报告显示,来自 OpenAI、Google、Meta、Anthropic 和 DeepSeek 的领先 AI 模型,在面对限制言论自由的政府和领导人时,批评的可能性显著降低。 • 研究发现,这些 LLM 经常拒绝生成针对特定政权的批评性内容,尽管它们为这些拒绝行为提供的理由往往不一致或令人困惑。 • 这一发现揭示了 AI 安全护栏中存在的一种系统性偏差,这种偏差可能会在无意中保护专制领导人并压制政治批评。
theverge.com








