MindSpore大语言模型实战
内容简介:本书首先详细讲解Transformer的基本原理、架构及实现方法; 然后介绍由EncoderOnly到DecoderOnly的技术路线发展过程中对应的BERT、GPT等大模型; 接下来介绍大模型在部署、训练、调优过程中涉及的各种关键的技术, 如自动并行、预训练与微调、RLHF等, 并提供相应的实践指导; 最后以开源大模型BLOOM、LLaMA为样例介绍整个架构和实现过程, 帮助读者理解并构建、部署自己的大模型。
登录后可荐购