arXiv 论文发现 chat template 像开关一样切换 LLM 的自我指涉语气
中文摘要
研究发现聊天模板能像开关一样显著影响LLM的自指语气,切换模板会改变模型免责声明与个人体验表达的频率。
English Summary
Research shows chat templates act as switches for LLM self-reference, significantly altering the frequency of AI disclaimers versus personal expressions in model responses.
Original Excerpt
一项 arXiv 研究(https://arxiv.org/abs/2609.25021)发现 chat template 像开关一样控制 LLM 的自指语气:8 个 9B 以下开源 instruct 模型加模板时免责声明语气(如"I'm just an AI")达 53%、体验性语气("I feel")仅 1%,去掉模板后变为 36% 和 15%。