OpenAI首席科学家回应AI推理不透明争议

IT时代网9月3日消息,OpenAI首席科学家雅库布·帕乔基公开回应了围绕AI模型Astra“推理不透明”的争议。他表示,包括Astra在内最先进模型的计算图深度与GPT-4相差不超过两倍,架构并未出现外界担忧的跳跃式复杂度增长,OpenAI也将为Astra部署额外的思维链监控。

争议源于一篇深度报道:OpenAI正在测试“深度循环”技术,让模型重复调用同一组网络层、持续更新内部表征。相较于按线性步骤处理信息的传统Transformer架构,这种方式会让更多实际推理留在难以直接阅读的内部状态中,研究人员更难借助思维链追踪模型的决策路径,报道发布后引发AI圈热议。

帕乔基在回应中称,希望避免因混乱的媒体报道引发“AI冲向不可监控状态”的竞赛。他表示,OpenAI自最初的推理模型问世以来一直维护和利用思维链监控,这项技术能帮助了解模型对齐如何从训练分布中泛化;他坦承思维链监控目前还很脆弱,但可以采取措施加强,这也是当前研究项目的核心目标之一。

OpenAI首席科学家回应AI推理不透明争议

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

THE END