OpenAI首席科学家Jakub Pachocki近日公开回应外界争议,否认Astra循环架构导致模型突然变得难以解释。

针对《The Information》此前报道称Astra采用recurrent depth(循环深度)技术,使同一组Transformer层反复计算,部分推理过程转向模型内部而非显式思维链,Pachocki澄清:包括Astra在内,OpenAI前沿模型的计算图深度与GPT-4相比最多仅差2倍,并未突然跃升数个数量级。

他承认思维链(CoT)监控确实脆弱,且行业正向更难监控的方向演进,但强调此变化与架构革新无关。OpenAI自首代推理模型起便持续保留并应用CoT监控,目前仍将强化该能力列为核心研究目标。