反向推断AI模型真实训练时间线
该方法利用大语言模型在预训练时学习到的知识存在时间边界这一特性。开发者通过向模型提问“某事件发生在什么时候”,观察模型能否正确回答,从而勾勒出知识截止的模糊区间。 实验发现,部分模型声称的版本号与实际表现出的知识截止日期并不一致。例如,某个标注为特定版本的模型,其知识截止日期可能早于或晚于官方宣称的时间点,暗示训练数…
该方法利用大语言模型在预训练时学习到的知识存在时间边界这一特性。开发者通过向模型提问“某事件发生在什么时候”,观察模型能否正确回答,从而勾勒出知识截止的模糊区间。 实验发现,部分模型声称的版本号与实际表现出的知识截止日期并不一致。例如,某个标注为特定版本的模型,其知识截止日期可能早于或晚于官方宣称的时间点,暗示训练数…