至知研究院提出大模型可解释性新路线:拆权重,数据成本不到1%
中文摘要
至知研究院提出大模型可解释性新方案:通过拆解权重实现,无需训练替代网络。
English Summary
Zhizhi Research Institute proposes a new LLM interpretability method via weight decomposition, reducing data costs to under 1% without training surrogate networks.
Original Excerpt
理解大模型,无需再训练一个替代网络