跳到正文
原文
Hugging Face Daily Papers·· 3 天前AI 评分46

自然语言自编码器中如何选择信息量最高的 token

Selecting The Most Informative Tokens in Natural Language Autoencoders

AI 导读

一项研究分析自然语言自编码器中哪些 token 位置最值得审计,以降低解释语言模型内部激活的成本。研究覆盖 prompt injection 和 concealment 的 4.7 million 条解释,发现仅解释 5% 的位置,在四个数据集中的三个上几乎保留了解释全部位置的成功率。聊天结构训练的 ranker 通常比计算信号更能选出相关解释,且无需为位置选择执行模型 forward pass。

来源:Hugging Face Daily Papers · arxiv.org