# 大型语言模型通过自适应探索产生新型社会偏见

- 来源：Hacker News 热门（buzzing.cc 中文翻译）
- 作者：paimapi
- 发布时间：2026-09-09 10:25
- AIHOT 分数：33
- AIHOT 链接：https://aihot.news/items/cmtticz0009wkrofpneaygns7
- 原文链接：https://openreview.net/challenge?redirect=%2Fforum%3Fid%3Dpc7fqaOcAH

## AI 摘要

一项研究揭示，大型语言模型（LLM）在交互过程中会通过自适应探索机制产生新型社会偏见，而非仅复现训练数据中的既有偏见。该发现表明，模型在与环境或用户动态互动时，可能自主形成并强化此前未见的歧视性行为模式。研究结果对评估和部署LLM时的偏见治理提出了新的挑战。

## 正文

站内暂未收录这条内容的完整正文。

> 站内仅提供摘要，全文见原文。
