正文 · AI 翻译
所有大语言模型在个性化方面的一个常见问题是,记忆对于模型来说似乎过于干扰。两三个月前关于某个话题的一个简单提问,可能会不断被当作我的某种深层兴趣,在后续中永无休止地被不当地提及。这有点像用力过猛。
LLM 的记忆功能存在过度联想问题:两个月前随口一问会被当作深度兴趣永久存档,并在后续对话中反复提及,显得过于刻意且造成不必要的干扰。
LLM 的记忆功能存在过度联想问题:两个月前随口一问会被当作深度兴趣永久存档,并在后续对话中反复提及,显得过于刻意且造成不必要的干扰。
Karpathy 指出 LLM 记忆功能过度关联历史对话的普遍痛点
所有大语言模型在个性化方面的一个常见问题是,记忆对于模型来说似乎过于干扰。两三个月前关于某个话题的一个简单提问,可能会不断被当作我的某种深层兴趣,在后续中永无休止地被不当地提及。这有点像用力过猛。
来源:Andrej Karpathy· x.com