搜索
高级检索
高级搜索
书       名 :
著       者 :
出  版  社 :
I  S  B  N:
文献来源:
出版时间 :
从零构建大模型/图灵程序设计丛书
0.00     定价 ¥ 109.80
图书来源: 浙江图书馆(由浙江新华配书)
此书还可采购15本,持证读者免费借回家
  • 配送范围:
    浙江省内
  • ISBN:
    9787115666000
  • 作      者:
    作者:(美)塞巴斯蒂安·拉施卡|责编:王军花|译者:覃立波//冯骁骋//刘乾
  • 出 版 社 :
    人民邮电出版社
  • 出版日期:
    2025-04-01
收藏
畅销推荐
内容介绍
本书是关于如何从零开始构建大模型的指南,由畅销书作家塞巴斯蒂安·拉施卡撰写,通过清晰的文字、图表和实例,逐步指导读者创建自己的大模型。在本书中,读者将学习如何规划和编写大模型的各个组成部分、为大模型训练准备适当的数据集、进行通用语料库的预训练,以及定制特定任务的微调。此外,本书还将探讨如何利用人工反馈确保大模型遵循指令,以及如何将预训练权重加载到大模型中。 本书适合对机器学习和生成式AI感兴趣的读者阅读,特别是那些希望从零开始构建自己的大模型的读者。
展开
目录
第1章 理解大语言模型
1.1 什么是大语言模型
1.2 大语言模型的应用
1.3 构建和使用大语言模型的各个阶段
1.4 Transformer架构介绍
1.5 利用大型数据集
1.6 深入剖析GPT架构
1.7 构建大语言模型
1.8 小结
第2章 处理文本数据
2.1 理解词嵌入
2.2 文本分词
2.3 将词元转换为词元ID
2.4 引入特殊上下文词元
2.5 BPE
2.6 使用滑动窗口进行数据采样
2.7 创建词元嵌入
2.8 编码单词位置信息
2.9 小结
第3章 编码注意力机制
3.1 长序列建模中的问题
3.2 使用注意力机制捕捉数据依赖关系
3.3 通过自注意力机制关注输入的不同部分
3.3.1 无可训练权重的简单自注意力机制
3.3.2 计算所有输入词元的注意力权重
3.4 实现带可训练权重的自注意力机制
3.4.1 逐步计算注意力权重
3.4.2 实现一个简化的自注意力Python类
3.5 利用因果注意力隐藏未来词汇
3.5.1 因果注意力的掩码实现
3.5.2 利用dropout掩码额外的注意力权重
3.5.3 实现一个简化的因果注意力类
3.6 将单头注意力扩展到多头注意力
3.6.1 叠加多个单头注意力层
3.6.2 通过权重划分实现多头注意力
3.7 小结
第4章 从头实现GPT模型进行文本生成
4.1 构建一个大语言模型架构
4.2 使用层归一化进行归一化*
4.3 实现具有GELU*函数的前馈神经网络
4.4 添加快捷连接
4.5 连接Transformer块中的注意力层和线性层
4.6 实现GPT模型
4.7 生成文本
4.8 小结
第5章 在无标签数据上进行预训练
5.1 评估文本生成模型
5.1.1 使用GPT来生成文本
5.1.2 计算文本生成损失
5.1.3 计算训练集和验证集的损失
5.2 训练大语言模型
5.3 控制随机性的解码策略
5.3.1 温度缩放
5.3.2 Top-k采样
5.3.3 修改文本生成函数
5.4 使用PyTorch加载和保存模型权重
5.5 从OpenAI加载预训练权重
5.6 小结
第6章 针对分类的微调
6.1 不同类型的微调
6.2 准备数据集
6.3 创建数据加载器
6.4 初始化带有预训练权重的模型
6.5 添加分类头
6.6 计算分类损失和*率
6.7 在有监督数据上微调模型
6.8 使用大语言模型作为垃圾消息分类器
6.9 小结
第7章 通过微调遵循人类指令
7.1 指令微调介绍
7.2 为有监督指令微调准备数据集
7.3 将数据组织成训练批次
7.4 创建指令数据集的数据加载器
7.5 加载预训练的大语言模型
7.6 在指令数据上微调大语言模型
7.7 抽取并保存模型回复
7.8 评估微调后的大语言模型
7.9 结论
7.9.1 下一步
7.9.2 跟上领域的*进展
7.9.3 写在*
7.10 小结
附录A PyTorch简介
附录B 参考文献和延伸阅读
附录C 练习的解决方案
附录D 为训练循环添加更多细节和优化功能
附录E 使用LoRA进行参数*微调
附录F 理解推理大语言模型:构建与优化推理模型的方法和策略
展开
加入书架成功!
收藏图书成功!
我知道了(3)
发表书评
读者登录

请选择您读者所在的图书馆

选择图书馆
浙江图书馆
点击获取验证码
登录
没有读者证?在线办证