DeepSeek图解:大模型是怎样构建的
温馨提示:电子书为虚拟商品,一经发货概不退换,请谨慎购买。3小时内发货(节假日除外),发货时效不超过24小时,急单慎拍!
内容简介
书名:DeepSeek图解:大模型是怎样构建的
作者:张治政,薛栋,公鑫著
ISBN:978-7-301-36202-0
出版社:北京大学出版社
出版日期:2025.06
本书以深入浅出的方式全面解析了DeepSeek大模型的构建过程及其核心技术,帮助读者理解大模型从架构设计到实际部署的全过程。本书共分为三个部分,从基础理论到前沿实践,循序渐进地带领读者探索大模型的奥秘。第一部分(第1-3章)介绍大模型的基础理论与技术背景,包括自然语言处理的基本概念(第1章)、DeepSeek的架构设计与创新(第2章)以及数据处理与预训练的重要性(第3章),为读者奠定理论基础。第二部分(第4-8章)深入探讨DeepSeek模型的关键技术,从模型训练与优化(第4章)、注意力机制的演进(第5章),到预训练与微调策略(第6章)、强化学习的应用(第7章)、以及多模态融合技术(第8章),帮助读者掌握大模型的核心实现方法。第三部分(第9-10章)则关注模型的实际应用与性能优化,包括DeepSeek模型的应用实践(第9章)和性能优化与部署策略(第10章),为读者提供丰富的实践案例和部署指南。本书不仅适合对大模型感兴趣的初学者,也为从事AI模型研发与优化的专业人士提供了深入的技术指导。
作者:张治政,薛栋,公鑫著
ISBN:978-7-301-36202-0
出版社:北京大学出版社
出版日期:2025.06
本书以深入浅出的方式全面解析了DeepSeek大模型的构建过程及其核心技术,帮助读者理解大模型从架构设计到实际部署的全过程。本书共分为三个部分,从基础理论到前沿实践,循序渐进地带领读者探索大模型的奥秘。第一部分(第1-3章)介绍大模型的基础理论与技术背景,包括自然语言处理的基本概念(第1章)、DeepSeek的架构设计与创新(第2章)以及数据处理与预训练的重要性(第3章),为读者奠定理论基础。第二部分(第4-8章)深入探讨DeepSeek模型的关键技术,从模型训练与优化(第4章)、注意力机制的演进(第5章),到预训练与微调策略(第6章)、强化学习的应用(第7章)、以及多模态融合技术(第8章),帮助读者掌握大模型的核心实现方法。第三部分(第9-10章)则关注模型的实际应用与性能优化,包括DeepSeek模型的应用实践(第9章)和性能优化与部署策略(第10章),为读者提供丰富的实践案例和部署指南。本书不仅适合对大模型感兴趣的初学者,也为从事AI模型研发与优化的专业人士提供了深入的技术指导。
上一本:
Python大模型优化策略:理论与实践
下一本:
关于两门新科学的对话
