Hugging Face Daily Papers·· 3 天前AI 评分46
自然语言自编码器中如何选择信息量最高的 token
Selecting The Most Informative Tokens in Natural Language Autoencoders
AI 导读
一项研究分析自然语言自编码器中哪些 token 位置最值得审计,以降低解释语言模型内部激活的成本。研究覆盖 prompt injection 和 concealment 的 4.7 million 条解释,发现仅解释 5% 的位置,在四个数据集中的三个上几乎保留了解释全部位置的成功率。聊天结构训练的 ranker 通常比计算信号更能选出相关解释,且无需为位置选择执行模型 forward pass。
来源:Hugging Face Daily Papers · arxiv.org