《影响亚洲》35位35岁以下精英 · 人工智能
丹·亨德里克斯
30岁 · 研究领军者与评估体系构建者 · 美国;其成果被前沿模型实验室和政策界广泛采用
基准构建者:检验前沿智能仍会在何处失效
- 年龄
- 30
- 领域
- 前沿模型评估与AI安全
- 国家或地区
- 美国;其成果被前沿模型实验室和政策界广泛采用
- 榜单得分
- 88.0 / 100
人物简介
职业经历与公开业绩
丹·亨德里克斯推动前沿模型安全从抽象争论转变为一门以高难度、可审查测试为基础的学科。他近期的研究探讨:先进系统能否跨越专业领域进行推理、如实作答,并在内部策略日益复杂时仍保持可理解性。丹·亨德里克斯的工作处于模型能力快速发展与治理所需证据的交界处。担任人工智能安全中心主任期间,他协助建立了一系列基准,用以揭示先进系统能够和无法可靠完成的任务。2025年,他参与了由大型协作团队推出的《人类终极考试》;这项由来自500家机构、覆盖50个国家的贡献者共同编制的专家基准包含3,000道题。其刻意设置的高难度问题成为评估前沿推理能力的重要参照,随后的一次独立审计也表明,基准本身的质量同样必须接受公开审查。亨德里克斯还是MASK研究的资深作者;该基准旨在区分模型的事实准确性与其将内部认定为虚假的内容表述出来的倾向。
入选理由
丹·亨德里克斯为何入选
《影响亚洲》入选亨德里克斯,是因为他让安全论点变得更可检验。他最出色的工作并非要求读者凭权威接受预测,而是提供可供实验室、政策制定者和独立研究人员审查的成果。《人类最后的考试》扩大了用于测试前沿系统的专家知识范围,MASK和可监控性合作项目则探讨更细微的诚实性与监督问题。此次入选认可的是他在大型团队中的作用,而非将团队成果完全归于他一人;同时也将HLE此后的修正视为健康评估文化的证据,而非需要掩盖的注脚。