# Cache-to-Cache：让 LLM 之间直接进行语义通信

- 来源：Hacker News：AI 热帖
- 作者：rochansinha
- 发布时间：2026-09-19 02:55
- AIHOT 分数：47
- AIHOT 链接：https://aihot.news/items/cmu7jpi1l0g06rogryqrmo2df
- 原文链接：https://arxiv.org/abs/2510.03215

## AI 摘要

研究者提出 Cache-to-Cache（C2C），一种让 LLM 绕过文本、直接通过 KV-cache 进行语义通信的新范式，用神经网络将源模型的 KV-cache 投影并融合到目标模型中，并用可学习门控机制选择受益的目标层。实验显示 C2C 平均准确率比单个模型高 6.4-14.2%，比文本通信范式高约 3.1-5.4%，延迟平均加速 2.5 倍。代码已开源。

## 正文

该来源未收录可展示正文，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
