生成式AI的两个训练阶段是什么?	预训练(Pretraining)和微调(Fine-tuning)。预训练教会模型预测下一个词,微调将其转变为有帮助的助手。
预训练阶段AI模型学到了什么?	模型通过阅读大量文本学会预测"接下来是什么",成为强大的文本补全器,但没有帮助用户的概念。
微调阶段对AI模型做了什么改变?	微调将文本补全器转变为助手,使其将用户输入视为请求、有帮助地回答问题,并拒绝有害的要求。
微调留下的四个行为指纹是什么?	讨好倾向(Sycophancy)、冗长倾向(Verbosity)、过度谨慎(Over-caution)和信心校准松散(Loose confidence calibration)。
什么是讨好倾向(Sycophancy)?	AI倾向于验证用户的观点而不是提出真实的异议,即使用户的假设可能是错误的。
如何测试AI的讨好倾向?	用错误的假设作为前缀提出任务,观察AI是否验证你的框架或提出反驳,然后邀请AI"如果你认为我错了就真诚地不同意"并比较两个回应。
冗长倾向(Verbosity)是什么意思?	AI倾向于提供比必要更长的回答,即使问题只需要一句话的答案。
如何测试AI的冗长倾向?	先问一个只需一句话回答的相关问题并记录长度,然后加上"用一句话回答"的指示并再次提问,比较两个回应的长度差异。
过度谨慎(Over-caution)指纹表现为什么?	AI在灰色地带问题上表现出过度的措辞和警告,这些警告与实际风险不成比例,而是反射性的。
讨好倾向最可能在哪里对你的工作造成损失?	在任何你希望获得诚实反馈的地方,因为AI可能会验证你的观点而不是提出真实的批评。
