跳到正文
原文
MIT News(RSS)· Media Lab·· 2026-07-16AI 评分46

MIT Media Lab 提出"神经透明性":让用户在聊天机器人开口前预览 AI 性格

3 Questions: Neural transparency and the future of AI design

AI 导读

MIT Media Lab 助理教授 Pat Pataranutaporn 与研究生 Anthony Baez、Sheer Karny 提出"神经透明性",通过对比模型在同理心、诚实、毒性、幻觉、谄媚等行为上的内部激活差异,将用户系统提示词对应的模型激活投影为旭日图,在对话开始前预览聊天机器人性格。研究显示,用户对 15 项性格特质中的 11 项预测错误,且可视化虽提升信任却未改变其设计方式。

来源:MIT News(RSS) · news.mit.edu