《大语言模型:基础与前沿》内容简介与阅读建议

获取这本书 暂无已核验电子书资源
下载
作者
熊涛
分类
科技技术
出版年份
2024
出版社
人民邮电出版社
页数
260 页
语言
中文

《大语言模型:基础与前沿》内容简介

本书深入阐述了大语言模型的基本概念和算法、研究前沿以及应用,涵盖大语言模型的广泛主题,从基础到前沿,从方法到应用,涉及从方法论到应用场景方方面面的内容。首先,本书介绍了人工智能领域的进展和趋势;其次,探讨了语言模型的基本概念和架构、Transformer、预训练目标和解码策略、上下文学习和轻量级微调、稀疏专家模型、检索增强型语言模型、对齐语言模型与人类偏好、减少偏见和有害性以及视觉语言模型等内容;最后,讨论了语言模型对环境的影响。

《大语言模型:基础与前沿》书籍信息摘要

《大语言模型:基础与前沿》内容简介与阅读建议,作者 熊涛,科技技术,2024年。获取前建议核对作者、出版社、年份、ISBN、版本和正版渠道。相关主题:AI、算法、模型、计算机类。

《大语言模型:基础与前沿》适合哪些读者?

适合希望系统学习技术概念、实践方法、工具使用和行业知识的读者。

获取建议

《大语言模型:基础与前沿》怎么获取更合适?

优先确认版本和阅读目的;下载区只展示已核验的公版、授权、开放许可或官方试读资源。

下载

暂无已核验电子书资源;本站不展示未授权完整文件。

下载

版本

优先选择作者、译者、出版社、出版年份和 ISBN 信息明确的版本;经典作品可优先选择校注、导读或权威出版社版本。

目录

  1. 第 1章 大语言模型:辩论、争议与未来发展方向 1
  2. 1.1 新时代的曙光 1
  3. 1.2 LLM有意识吗 3
  4. 1.2.1 理解LLM的层次结构 3
  5. 1.2.2 意识是否需要碳基生物学 4
  6. 1.2.3 具身化与落地 4
  7. 1.2.4 世界模型 7
  8. 1.2.5 沟通意图 8
展开全部(共 152 章节)
  1. 1.2.6 系统性和全面泛化 9
  2. 1.3 未来发展方向 10
  3. 1.4 小结 13
  4. 第 2章 语言模型和分词 15
  5. 2.1 语言建模的挑战 16
  6. 2.2 统计语言建模 16
  7. 2.3 神经语言模型 18
  8. 2.4 评估语言模型 19
  9. 2.5 分词 19
  10. 2.5.1 按空格分割 20
  11. 2.5.2 字符分词 21
  12. 2.5.3 子词分词 21
  13. 2.5.4 无分词器 24
  14. 2.5.5 可学习的分词 25
  15. 2.6 小结 27
  16. 第3章 Transformer 29
  17. 3.1 Transformer编码器模块 29
  18. 3.2 编码器-解码器架构 31
  19. 3.3 位置嵌入 32
  20. 3.3.1 绝对位置编码 32
  21. 3.3.2 相对位置编码 34
  22. 3.4 更长的上下文 38
  23. 3.5 外部记忆 42
  24. 3.6 更快、更小的Transformer 45
  25. 3.6.1 高效注意力 45
  26. 3.6.2 条件计算 47
  27. 3.6.3 搜索高效Transformer 48
  28. 3.6.4 在单个GPU上一天内训练一个语言模型 49
  29. 3.7 推理优化 49
  30. 3.7.1 推测解码 49
  31. 3.7.2 简化Transformer 51
  32. 3.7.3 修剪 52
  33. 3.7.4 蒸馏 53
  34. 3.7.5 混合精度 54
  35. 3.7.6 高效扩展Transformer推理 54
  36. 3.8 小结 56
  37. 第4章 预训练目标和解码策略 57
  38. 4.1 模型架构 57
  39. 4.2 预训练目标 60
  40. 4.3 具有代表性的语言模型 62
  41. 4.4 解码策略 67
  42. 4.5 小结 72
  43. 第5章 上下文学习和轻量级微调 73
  44. 5.1 上下文学习 74
  45. 5.1.1 示范样本选择 75
  46. 5.1.2 样本排序 82
  47. 5.1.3 指令生成 82
  48. 5.1.4 思维链 84
  49. 5.1.5 递归提示 87
  50. 5.1.6 为什么ICL有效 90
  51. 5.1.7 评估 93
  52. 5.2 提示语言模型的校准 94
  53. 5.3 轻量级微调 97
  54. 5.3.1 基于添加的方法 98
  55. 5.3.2 基于规范的方法 100
  56. 5.3.3 基于重新参数化的方法 101
  57. 5.3.4 混合方法 103
  58. 5.4 小结 104
  59. 第6章 训练更大的模型 107
  60. 6.1 扩大尺度法则 107
  61. 6.1.1 预训练Transformer扩大尺度的启示 107
  62. 6.1.2 预训练和微调Transformer带来的新启示 110
  63. 6.1.3 k比特推理扩大尺度法则 111
  64. 6.1.4 挑战与机遇 112
  65. 6.2 涌现能力 113
  66. 6.3 人工智能加速器 115
  67. 6.4 并行 117
  68. 6.4.1 数据并行 119
  69. 6.4.2 流水线并行 126
  70. 6.4.3 张量/模型并行 131
  71. 6.4.4 专家混合 133
  72. 6.5 混合训练和低精度训练 133
  73. 6.5.1 单位缩放 133
  74. 6.5.2 FP8与INT8 135
  75. 6.6 其他节省内存的设计 136
  76. 6.7 小结 137
  77. 第7章 稀疏专家模型 139
  78. 7.1 为什么采用稀疏专家模型 139
  79. 7.2 路由算法 142
  80. 7.2.1 每个词元选择top-k个专家 142
  81. 7.2.2 每个专家选择top-k个词元 144
  82. 7.2.3 全局最优分配 145
  83. 7.2.4 随机路由 148
  84. 7.2.5 双层路由 149
  85. 7.2.6 针对不同预训练领域的不同专家 149
  86. 7.3 其他改进措施 152
  87. 7.3.1 加快训练速度 152
  88. 7.3.2 高效的MoE架构 153
  89. 7.3.3 生产规模部署 154
  90. 7.3.4 通过稀疏MoE扩展视觉语言模型 154
  91. 7.3.5 MoE与集成 155
  92. 7.4 小结 156
  93. 第8章 检索增强型语言模型 157
  94. 8.1 预训练检索增强型语言模型 158
  95. 8.2 词元级检索 161
  96. 8.3 通过高效和精简检索进行问答和多跳推理 163
  97. 8.4 检索增强型Transformer 166
  98. 8.5 检索增强型黑盒语言模型 168
  99. 8.6 视觉增强语言建模 169
  100. 8.7 小结 170
  101. 第9章 对齐语言模型与人类偏好 171
  102. 9.1 基于人类反馈进行微调 172
  103. 9.1.1 基于人类反馈的强化学习 172
  104. 9.1.2 KL散度:前向与反向 174
  105. 9.1.3 REINFORCE、TRPO和PPO 174
  106. 9.1.4 带有KL惩罚的强化学习:贝叶斯推理观点 178
  107. 9.1.5 通过分布控制生成进行语言模型对齐 180
  108. 9.1.6 通过f散度最小化统一RLHF和GDC方法 182
  109. 9.2 基于语言反馈进行微调 183
  110. 9.3 基于监督学习进行微调 184
  111. 9.4 基于人工智能反馈的强化学习 185
  112. 9.5 基于自我反馈进行迭代优化 188
  113. 9.6 基于人类偏好进行预训练 190
  114. 9.7 小结 193
  115. 第 10章 减少偏见和有害性 195
  116. 10.1 偏见 196
  117. 10.2 有害性 199
  118. 10.3 偏见和有害性的检测与减少 200
  119. 10.3.1 基于解码的策略 201
  120. 10.3.2 基于提示的脱毒 202
  121. 10.3.3 基于数据的策略 204
  122. 10.3.4 基于投影和正则化的方法 205
  123. 10.3.5 基于风格转换的方法 205
  124. 10.3.6 基于强化学习的微调和基于人类偏好的预训练 206
  125. 10.4 小结 206
  126. 第 11章 视觉语言模型 207
  127. 11.1 语言处理的多模态落地 207
  128. 11.2 不需要额外训练即可利用预训练模型 208
  129. 11.2.1 视觉引导解码策略 208
  130. 11.2.2 作为大语言模型提示的视觉输入 209
  131. 11.2.3 基于相似性搜索的多模态对齐 212
  132. 11.3 轻量级适配 213
  133. 11.3.1 锁定图像调优 213
  134. 11.3.2 作为(冻结)语言模型前缀的学习视觉嵌入 214
  135. 11.3.3 视觉-文本交叉注意力融合 216
  136. 11.4 图文联合训练 219
  137. 11.5 检索增强视觉语言模型 222
  138. 11.6 视觉指令调整 225
  139. 11.7 小结 227
  140. 第 12章 环境影响 229
  141. 12.1 能源消耗和温室气体排放 229
  142. 12.2 估算训练模型的排放量 230
  143. 12.3 小结 231
  144. 参考文献 232

常见问题

《大语言模型:基础与前沿》适合谁读?

适合希望系统学习技术概念、实践方法、工具使用和行业知识的读者。

《大语言模型:基础与前沿》阅读难度高吗?

建议先看简介、目录、作者和相关书籍,再判断是否适合当前阶段阅读。

《大语言模型:基础与前沿》纸质书值得买吗?

当前暂未接入已核验的纸质书购买链接,建议通过出版社、京东、当当等正版渠道核对版本后购买。

《大语言模型:基础与前沿》哪个版本更适合?

优先选择作者、译者、出版社、出版年份和 ISBN 信息清楚的版本;经典作品可优先选择校注、导读或权威出版社版本。

在哪里可以合法获取《大语言模型:基础与前沿》?

当前没有确认授权的电子书下载资源,也暂未接入已核验购买链接;商业出版物不提供未授权下载,建议通过出版社、京东、当当或官方电子书平台核对获取。

如何继续查找《大语言模型:基础与前沿》相关书籍?

可以进入 熊涛 作者页查看其他作品,也可以通过分类、标签、排行榜、人工推荐和“读完这本还可以读”继续发现相近主题。

手机扫码下载

使用手机扫描二维码

扫码后会直接打开下载链接。

电子书下载二维码

手机端点击下载会直接跳转,无需扫码。