OpenAI发布o1模型新突破，推理时间增强对抗鲁棒性

AI快讯网1月23日消息，今天凌晨2点，OpenAI发布了一项新技术研究，通过增加推理时间、算力资源来大幅度提升模型的对抗鲁棒性。与传统的对抗训练样本方法不同的是，OpenAI提出的新方法不需要对大模型进行专门的对抗训练，也不需要提前了解攻击的具体形式。只需要通过增加推理时间和算力资源，模型就可以更充分地利用其推理能力表现出更强的鲁棒性。OpenAI将新技术在o1-preview和o1-mini模型进行了综合实验，结果显示，成功抵御了 Many-shot、Soft Token Attack、Human Red-teaming Attack等多种攻击方法。

OpenAI发布o1模型新突破，推理时间增强对抗鲁棒性

发表回复