苏菲拉底
THE SOPHIE LAB
问题库
人物库
视频库
关于苏菲
订阅苏菲周报
尼
档案编号 — MIND_31
领域 — 科学与技术
入库 — 1 期
回应问题 — 4 问
人物档案 · MINDS ON FILE
尼尔·南达
Neel Nanda
Google DeepMind 语言模型可解释性团队负责人,机制可解释性领域的代表性研究者,曾在 Anthropic 工作;以 Othello-GPT、Gemma Scope 稀疏自编码器等工作及「务实可解释性」立场闻名。
Ⅱ·11
内省可靠吗?
Ⅱ·04
答得上来,就算懂了吗?
新·01
模型知道自己在被测试时,评估结果还算数吗?
Ⅱ·03
能预言,就等于能解释吗?
入库谈话
尼尔·南达在本实验室的全部精读
NO.131 · 2026·07·10
Understanding the inner thoughts of AI
尼尔·南达
· Google DeepMind
Ⅱ·03「能预言,就等于能解释吗?」
← 上一份档案
大卫·查尔默斯
下一份档案 →
Hannah Fry
订阅苏菲周报
每周一封:本周入库的精读、一个值得带走的问题、一条苏菲按。免费,随时退订。
订阅
免费 · 每周一封 · 一键退订
苏菲拉底
THE SOPHIE LAB · ASK THE BIG QUESTIONS · THINK DEEPLY · SEE THE WORLD DIFFERENTLY
内容仅供学习 · thesophielab.com