CMU与谷歌团队的最新研究发现,通过在训练大型AI模型时加入“暂停token”,可以提高模型的准确率。这种方法允许模型在给出答案前多思考一下,从而提高输出的质量。实验结果显示,使用这种方法的模型在多个任务上都有显著的性能提升。例如,SQuAD的EM得分提高了18%。这种方法的核心思想是在输入数据后追加一系列的“暂停token”,从而给模型更多的计算时间来处理复杂的输入。