←
ChatGPT编辑历史
提交《ChatGPT》修改,状态:approved
查看这次修改
# ChatGPT ## 1 发展历史 ### 1.1 前身:GPT系列模型 #### 1.1.1 GPT-1(2018年) GPT-1是OpenAI于2018年6月发布的第一代生成式预训练变换模型。它拥有1.17亿个参数,采用无监督预训练加有监督微调的训练范式。尽管参数规模在当时并不突出,但GPT-1证明了通过大规模文本预训练获得的通用语言能力可以在多种自然语言处理任务上取得显著提升,为后续模型奠定了基础。 #### 1.1.2 GPT-2(2019年) GPT-2于2019年2月发布,参数规模跃升至15亿。因其生成的文本质量极高,OpenAI最初出于对潜在滥用的担忧而推迟了完全开源,仅在有限范围内发布。GPT-2展示了更大规模数据和模型带来的“涌现”能力,能够在摘要、翻译、问答等任务中实现零样本或少样本学习。但它的发布也首次引发了关于AI文本滥用风险的公开讨论。 #### 1.1.3 GPT-3(2020年) GPT-3于2020年6月问世,参数规模达到惊人的1750亿。GPT-3的“零样本”和“少样本”能力显著增强,用户仅需提供少量示例(即“提示工程”)即可获得优质输出。GPT-3的能力包括编写论文、创作诗歌、生成代码、翻译语言等,其API产品首次面向开发者开放,推动了生成式AI的商业化萌芽。但GPT-3也存在答非所问、生成有害内容等问题。 ### 1.2 从InstructGPT到ChatGPT #### 1.2.1 隐式人机对齐技术(RLHF) 在GPT-3基础上,OpenAI引入了一种名为“基于人类反馈的强化学习”(Reinforcement Learning from Human Feedback, RLHF)的技术。该技术通过让人类评估模型输出,训练一个奖励模型来指引强化学习过程,使得AI的回答更符合用户期望、更安全、更有用。InstructGPT是RLHF的首个产品化应用,于2022年1月发布,显著减少了有害与事实错误输出。 #### 1.2.2 2022年发布与病毒式传播 2022年11月30日,OpenAI基于InstructGP
Ciallo~(∠・ω< )⌒★