大家好,我是苍何。
最近,和朋友们成立了 AgentWork 开源社区,也陆续推出了《WorkBuddy 蓝皮书》、《豆包工作蓝皮书》。

收到了很多朋友的喜欢,现在保守估计全网已经累计千万曝光吧,主要确实也帮助到了不少人。
但我们发现,随着开源模型能力的提升,越来越多的人希望自己能部署、微调、评测开源模型。
但网络上并没有比较系统全面的这样一份指南,于是我们几个一拍即合,决定再次给大家带来全新的作品。
只不过,因为开源模型微调、部署这块的实践就比较耗费时间,我们一边跑实验,一边写教程,熬了不知多少个大夜,一共耗时 30 天,今天终于和大家见面了。

开源地址:https://github.com/modelscope/ms-cookbook,如果觉得有帮助,可以毫不留情的点个 star 给我们支持。
你可能想象不到,Nvidia CEO 黄仁勋在X上发出了自己的第一条帖子,竟然献给了开源。

这个世界既需要前沿的闭源模型,也需要前沿的开源模型。
中国模型的开源阵容也越来越强:阿里千问累计下载量超 30 亿次,2.8 万亿参数的 Kimi K3 与智谱 GLM-5.3 接连开放权重,MiniMax H3 的开源基础模型则支持最长 15 秒的音视频生成,等等等。

但模型下载下来,离真正用好还有一段路,这份指南就是想把我们踩过的坑、跑通的方法留给大家。
ModelScope(魔搭)是很多人找开源模型的第一站,把指南放在这里,也方便大家找到模型就能接着动手。
现在项目也被魔搭开源组织收录了,欢迎大家一起补案例、提问题,把它慢慢完善起来。
我们还做了一个专门的网站,起了个特殊的名字《魔搭紫皮书》:

我们把网站也直接放在了 ModelScope 的创空间,你现在可以直接访问 modelscope.cn/active/ms-cookbook 就能在全球访问。
这是一份开源模型应用实战,从开源模型选型、运行到微调与应用,累计 40 余万字,7 个真实任务手把手教学。
全书一共分为 8 章,分别是认识开源模型、从问题出发、让模型工作起来、微调与评测、业务系统实践、AIGC 特别篇、Agent 特别篇、基础知识补充。

一共加起来的话是 34 个章节,共计 40 余万字。
你能学会开源模型的基础理论知识,比如开源模型选型、开源和开放区别等。

比如你现在接收到公司任务,要进行开源模型的选择,你上来让 AI 一顿给你分析,说实在的,不大好,
所有模型在选择前,通用指标只能是一个参考标准,最终模型选择还要看在业务数据上的表现。

大家每次看模型评测榜单数据,很多人也是有些懵的吧,我们就补充了这方面的知识。

下载开源模型,如何快速部署工作起来,成为了很多人难以迈出的一脚,现在,你只需要一步步跟着我们的教程,就能跑起来了。

里面所有涉及的模型实验任务,步骤截图,全是人类手动跑过。
写到这里,有些自我感动,在这个 AI 快速发展的当下,还有像我们一样的笨蛋,坚持用最笨的方式来做这些东西,搞这些开源。
或许能留下点什么,也是我们 AgentWork 开源社区的使命所在。
我记得当时 DeepSeek 爆火的时候,很多人用 Ollama 在自己电脑部署小模型,现在依旧有很多人不会部署,我们也把这部分内容单独抽出一章了。

当然了,也可以把模型部署到云端跑,用 Notebook试试 CPU 和 GPU。

在微调和评测这一章,我们花了大量的时间打磨,比如把业务素材变为训练数据,快速用ms-swift,完成开源模型的轻量微调、做偏好对齐等。

对于业务系统实践这一部分,我们直接通过几个实际业务系统演练,带着大家一起做真实项目。比如 AI 健身教练。

比如智能客服质检:

现在 AIGC 开源模型能力也越来越强,在这一部分,我们先用10个Case,带你看看AIGC的开源模型能做到什么地步。

还有使用 DiffSynth 训练图像 LoRA 也讲的很清晰。

现在 H3 本地部署很火,我们也即将推出这部分的教程解决方案。
在 Agent 特别篇,从 MCP、Skill 到 Claude Code、再到最近的 DeepSeek Harness,我们把最新的内容教程做了更新,带大家一步步了解 Agent。

当然你如果想学大模型基础知识,也可以在紫皮书中找到。

以上就是大概的介绍了下,我们这一个月做的一些事情,以及我们这次给大家带来的作品。
希望多少能给想要探索模型,亲自上手的小伙伴们一丝丝帮助。
也欢迎转发给需要的伙伴,更欢迎有相关经验的伙伴一起加入共创。也会列出所有的共创者。

我们也在网站上加了许愿池,大家也可以直接写下你想了解的内容,让有经验的伙伴来补上。

我们熬了 30 天,最想等到的,是你第一次跑通模型时的那句:“原来,我也可以。”







