《Happy-LLM:从零开始构建大模型》朱信忠

【书籍介绍】
2022年底ChatGPT的诞生引发变革,大语言模型(LLM)成为人工智能领域的研究热点。本书分为基础知识与实战应用两大部分,共7章。基础知识部分(第1~4章)介绍NLP基本任务及文本表示发展历程,阐述LLM基本架构Transformer和经典PLM架构(BERT、GPT、LLaMA、GLM等),详述LLM的特点、能力和训练过程(预训练、SFT、RLHF)。实战应用部分(第5~7章)讲解基于PyTorch搭建LLM的全流程,借助Transformers框架和DeepSpeed实现LLM训练(含LoRA微调),以及LLM的各类应用(评测、RAG、智能体)。适合具备Python编程经验、掌握深度学习知识的大学生、研究人员及LLM爱好者阅读。人民邮电出版社出版,2026年6月发行,173千字。

【作者介绍】
朱信忠,工学博士,博士生导师,二级教授,浙江省特级专家,浙江师范大学杭州人工智能研究院院长,国家高层次人才,国家有突出贡献中青年专家,国家科技进步奖二等奖第一完成人,享受国务院政府特殊津贴。Datawhale首席科学家,Happy-LLM、Hello-Agents等开源项目总体负责人。主要研究方向为大模型、具身智能、世界模型、自主移动机器人及低空具身等。合著者宋志学(西湖大学科研助理,Datawhale成员,GitHub星标5.5万余次)、邹雨衡(小红书AI工程师,Datawhale成员,GitHub星标7.6万余次)。

VIP会员免费

已有0人支付

我们相聚,见证阅读的力量!
相聚书屋 » 《Happy-LLM:从零开始构建大模型》朱信忠

发表回复