大语言模型
赵鑫 / 李军毅 / 周昆 / 唐天一 / 文继荣 · 2024 · 8.0 分
当ChatGPT掀起新一轮人工智能浪潮,大语言模型已成为技术变革的核心。本书由中国人民大学赵鑫教授团队倾力撰写,是国内首部系统讲解大语言模型原理与技术的权威教材。它从Transformer架构出发,沿着预训练、微调、对齐、推理等关键技术脉络,深入剖析了模型如何理解与生成语言,并探讨了高效训练、能力评估及安全挑战等前沿议题。无论你是AI研究者、工程师,还是希望系统理解大模型奥秘的学生,这本书都将成为你探索智能边界、把握技术脉搏的可靠向导。
『 经典台词 / 金句 』
「大语言模型的核心能力来源于海量数据与大规模参数。」
「对齐是让模型真正服务于人类价值的关键一步。」
『 章节说明 』
全书内容分为三大主题板块。第一部分为基础理论,系统介绍语言模型的历史演进、Transformer架构原理以及大语言模型的基本能力与涌现特性。第二部分为关键技术,深入讲解预训练数据构建、模型架构设计、训练策略、指令微调、人类反馈对齐以及推理加速等核心环节。第三部分为应用与展望,涵盖模型评测方法、典型应用场景、安全与伦理挑战,并探讨了未来发展方向。整体结构由浅入深,兼顾理论深度与实践指导。
『 试读 · 导读 』
想象你正在搭建一个智能客服系统,你喂给模型海量对话数据,它却常常答非所问。你开始困惑:为什么模型背下了百科全书,却理解不了“退换货”的简单请求?你翻遍技术博客,却总在“注意力机制”和“参数更新”之间迷失。此刻,你需要的不是零散的知识点,而是一张清晰的技术地图。这本书将带你从语言模型的基本原理出发,一步步走过数据清洗、模型预训练、指令微调、人类对齐的完整旅程,让你真正理解大模型如何从“会说话”走向“会做事”,并学会如何驾驭它解决实际问题。
AI,人工智能,大语言模型,深度学习,自然语言处理,Transformer,
📖 在微信读书阅读