这篇帖子核心内容真实。
清华大学与无问芯穹(Infinigence AI)等团队的论文《Cache-to-Cache: Direct Semantic Communication Between Large Language Models》已收录于ICLR 2026,代码开源(https://t.co/tw4fbTPN1q)。C2C通过神经网络投影融合KV-Cache实现模型间直接语义通信,准确率比单模型高6.4-14.2%,比文本通信高约3.1-5.4%,平均速度提升2.5倍,与帖中数据基本吻合。表述有一定夸张,但技术事实成立。