技术博客/Tracing the Thoughts of a Large Language Model(追踪大语言模型的思维过程)
Anthropic入门2025-03-27· 3 分钟· 安全与对齐

Tracing the Thoughts of a Large Language Model(追踪大语言模型的思维过程)

对多语言版本\"opposite of small\"的实验表明,模型内部先激活\"小\"和\"对立\"的抽象特征,触发\"大\"的概念,再将结果翻译为提问语言输出。Claude 3.5 Haiku跨语言共享特征的比例是小模型的两倍以上——模型越大,概念的普适性越强。这意味着在一

🔒

本文需解锁后阅读

免费开放 feed 中最新 5 篇博客。其余文章输入通行码后可阅读全文。

支持链接自动解锁:在地址后加 ?access=你的通行码