显示屏◈ღ◈✿,太阳网城官方网站◈ღ◈✿,www.tyc234cc.com◈ღ◈✿,广告设计◈ღ◈✿,澳门太阳城◈ღ◈✿。澳门太阳集团◈ღ◈✿,夜景拍摄◈ღ◈✿。Anthropic 公司 CEO Dario Amodei 于周四发表了一篇文章◈ღ◈✿,指出研究人员对于全球领先 AI 模型内部运作的了解非常有限◈ღ◈✿。为了解决这一问题◈ღ◈✿,Amodei 为 Anthropic 设定了一个雄心勃勃的目标◈ღ◈✿,即到 2027 年能够可靠地发现大多数 AI 模型的问题◈ღ◈✿。
Amodei 承认前路充满挑战◈ღ◈✿。在 The Urgency of Interpretability 一文中◈ღ◈✿,这位 CEO 表示◈ღ◈✿,Anthropic 已经在追踪模型如何得到答案方面取得了早期突破——但他强调◈ღ◈✿,随着系统变得更加强大◈ღ◈✿,需要进行更多研究来解读这些系统◈ღ◈✿。
在没有更好地理解其可解释性之前◈ღ◈✿,我非常担忧部署这种系统◈ღ◈✿, Amodei 在文章中写道◈ღ◈✿。 这些系统将对经济◈ღ◈✿、技术和国家安全起到绝对核心的作用◈ღ◈✿,并且拥有如此高度的自主性◈ღ◈✿,以至于我认为人类对它们的运作原理一无所知是完全不可接受的◈ღ◈✿。
Anthropic 是在机械可解释性领域的先驱公司之一◈ღ◈✿,该领域旨在揭开 AI 模型黑箱◈ღ◈✿,理解它们为何做出特定决策◈ღ◈✿。尽管科技行业的 AI 模型在性能上快速提升◈ღ◈✿,但我们对这些系统如何做出决策仍知之甚少◈ღ◈✿。
例如◈ღ◈✿,OpenAI 最近推出了新的推理 AI 模型 o3 和 o4-mini太阳成集团tyc234cc官网◈ღ◈✿,在某些任务上的表现更出色◈ღ◈✿,但它们产生虚构内容的情况也比其他模型更多福利宝APP导入◈ღ◈✿。该公司尚未弄清楚原因所在◈ღ◈✿。
当一个生成式 AI 系统执行某项任务时◈ღ◈✿,例如总结一份财务文件◈ღ◈✿,我们在具体◈ღ◈✿、精确的层面上完全无法解释它为何会做出这些选择——为什么它会选择某些词语而不是其他词语◈ღ◈✿,或为何在通常准确的情况下偶尔出现错误◈ღ◈✿, Amodei 在文章中写道◈ღ◈✿。
在文章中◈ღ◈✿,Amodei 引用了 Anthropic 联合创始人 Chris Olah 的观点◈ღ◈✿,他认为 AI 模型是 更多是生长出来而非被建造的◈ღ◈✿。换句话说福利宝APP导入◈ღ◈✿,AI 研究人员已经找到提高 AI 模型智能的方法太阳成集团tyc234cc官网◈ღ◈✿,但他们并不完全明白其中原因◈ღ◈✿。
Amodei 在文章中表示◈ღ◈✿,在不了解这些模型如何运作的情况下太阳成集团tyc234cc官网◈ღ◈✿,达到 AGI——或者如他所称的 数据中心中的天才国度——可能会带来危险◈ღ◈✿。在之前的一篇文章中◈ღ◈✿,Amodei 曾声称科技行业有望在 2026 或 2027 年达到这一里程碑◈ღ◈✿,但他认为我们在彻底理解这些 AI 模型方面还有很长的路要走福利宝APP导入◈ღ◈✿。
从长远来看◈ღ◈✿,Amodei 表示 Anthropic 希望基本上能够对最尖端的 AI 模型进行 脑部扫描 或 MRI 检查◈ღ◈✿。他称◈ღ◈✿,这些检查将有助于发现 AI 模型中广泛存在的问题◈ღ◈✿,包括它们撒谎◈ღ◈✿、追求权力或其他弱点的倾向◈ღ◈✿。实现这一目标可能需要五到十年◈ღ◈✿,但他补充道◈ღ◈✿,这些措施对于测试和部署 Anthropic 未来的 AI 模型将是必要的◈ღ◈✿。
Anthropic 已取得了一些研究突破◈ღ◈✿,使其对 AI 模型的工作原理有了更深入的了解◈ღ◈✿。例如◈ღ◈✿,该公司最近找到了一种方法◈ღ◈✿,能够通过所谓的 circuits (电路) 追踪 AI 模型的思维路径◈ღ◈✿。Anthropic 识别出了一条电路◈ღ◈✿,帮助 AI 模型理解哪些美国城市位于哪些美国州内福利宝APP导入◈ღ◈✿。虽然该公司只发现了少数几条这样的电路◈ღ◈✿,但它估计 AI 模型中可能存在数百万条类似的电路◈ღ◈✿。
Anthropic 一直在投资于可解释性研究◈ღ◈✿,并且最近首次对一家专注于该领域的初创企业进行了投资◈ღ◈✿。虽然目前可解释性大多被视为安全研究的一个领域◈ღ◈✿,Amodei 指出◈ღ◈✿,最终解释 AI 模型如何得出答案可能会带来商业优势◈ღ◈✿。
在文章中◈ღ◈✿,Amodei 呼吁 OpenAI 和 Google DeepMind 加大该领域的研究力度福利宝APP导入太阳成集团tyc234cc官网◈ღ◈✿。除了这一友好的推动外◈ღ◈✿,这位 CEO 还呼吁各国政府施加 light-touch (轻触式) 监管◈ღ◈✿,以鼓励可解释性研究◈ღ◈✿,例如要求公司公开其安全和保密措施太阳成集团tyc234cc官网◈ღ◈✿。Amodei 在文章中还表示◈ღ◈✿,美国应对向中国出口芯片实施管控太阳成集团tyc234cc官网◈ღ◈✿,以减少全球失控 AI 竞赛的可能性◈ღ◈✿。
Anthropic 一直以对安全的关注在 OpenAI 和 Google 中脱颖而出◈ღ◈✿。当其他科技公司对加州有争议的 AI 安全法案 SB 1047 持反对态度时◈ღ◈✿,Anthropic 对该法案给予了适度支持并提出了建议◈ღ◈✿。该法案旨在为前沿 AI 模型开发者设定安全报告标准太阳成集团tyc234cc官网◈ღ◈✿。
在这种情况下◈ღ◈✿,Anthropic 似乎在推动整个行业共同努力福利宝APP导入◈ღ◈✿,以更好地理解 AI 模型◈ღ◈✿,而不仅仅是提升它们的能力◈ღ◈✿。