ChatGPT开源模型本地部署保姆级教程:从安装到使用一步到位
最近OpenAI的动作让AI领域炸开了锅——距离上一次开源已过去6年,这次直接放出了gpt-oss-120b和gpt-oss-20b两个大模型。后台不少朋友问怎么在本地部署,今天就用最详细的步骤教会大家,看完就能上手实操。
一、哪些情况适合本地部署这两个模型?
先说明:不是所有人都需要折腾本地部署,得看具体需求。
但以下情况特别适合本地部署:
- 电脑配置达标(gpt-oss-20b需要16GB以上显存,比如RTX 4090这类消费级显卡基本够用;120b需要80GB显存,更适合H100等专业显卡);
- 处理私密数据(比如企业内部文档、个人敏感信息),担心云端存储泄露风险;
- 每天高频使用AI工具,想省掉长期API调用的费用;
- 想基于开源模型做二次开发,比如训练专属垂直领域功能(如法律文书生成、医疗病例分析);
- 需要和本地工作流深度结合,比如离线处理PDF文档、对接本地办公软件。
人话总结:
电脑够强+怕泄密+用得多→果断本地部署
新手小白+偶尔用+图省事→直接用网页版更方便
二、本地部署核心步骤
第一步:安装Ollama
Ollama相当于一个"AI模型管理器",能帮你轻松加载、运行各种大模型,这次部署必须靠它。
-
打开浏览器,访问Ollama官网(ollama.com);

-
点击首页中间的"Download"按钮,进入下载页面;

-
根据电脑系统选择对应版本:苹果电脑选左侧 macOS 版,Windows 选右侧(需Windows 10及以上),Linux用户选中间;

-
下载完成后点击安装,建议默认装在C盘(如果想装在其他盘,需要手动配置环境变量:右键"此电脑"→属性→高级系统设置→环境变量,在系统变量的Path里添加Ollama安装路径,新手建议先按默认来);
-
安装完成后,桌面会出现羊驼图标,说明安装成功。

第二步:选择要安装的模型
OpenAI这次开源的两个模型定位不同,按需选择更高效:
-
回到Ollama官网,点击左上角"Models"进入模型库;

-
搜索"gpt-oss",会显示两个型号:
(小提示:普通用户优先选20b,120b对硬件要求太高,非专业场景没必要)
- gpt-oss-20b:中等规模,16GB显存可运行,性能接近o3-mini,适合日常对话、文档处理、基础代码生成;
- gpt-oss-120b:大型模型,80GB显存起步,性能接近o4-mini,适合复杂逻辑推理、长文本分析、高精度代码开发。

-
选好模型后,复制对应的安装命令:
- 20b版本:
ollama pull gpt-oss:20b - 120b版本:
ollama pull gpt-oss:120b
- 20b版本:
第三步:安装并运行模型
-
打开命令行工具(Windows推荐用Windows Terminal,比cmd更方便,可在微软应用商店下载;macOS/Linux直接用终端);

-
在命令行里粘贴刚才复制的命令,比如安装20b就输入:
ollama pull gpt-oss:20b

-
按下回车,模型会自动开始下载(20b约14GB,120b约65GB,建议连接稳定网络,耗时根据网速从几十分钟到几小时不等);
-
下载完成后,输入运行命令:
ollama run gpt-oss:20b -
看到">>>"提示符后,就可以开始和模型对话了,断网状态下也能正常使用。
第四步:后续如何快速启动模型
关闭电脑后,下次使用不用重新下载,直接这样操作:
-
打开命令行工具;
-
输入对应模型的运行命令(和之前一样):
ollama run gpt-oss:20b -
回车后瞬间启动,直接进入对话界面。
三、进阶:安装Open-WebUI优化交互(可选)
如果觉得命令行界面不够直观,可以装个Open-WebUI美化交互,新手建议先熟悉基础操作,再尝试进阶步骤。
-
先安装Docker:
浏览器搜索"Docker"进入官网,下载对应系统的桌面版(Windows需开启WSL2,安装时会自动提示);
-
安装完成后重启电脑,桌面出现Docker图标即成功;
-
安装Open-WebUI:
浏览器搜索"Open-WebUI"进入官网,复制Docker命令:docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main -
打开命令行,粘贴命令并运行,等待安装完成;
-
启动使用:
双击Docker图标,在容器列表找到"open-webui",点击右侧"端口3000"进入界面;
首次使用需要注册本地账号(数据仅存在电脑里),左上角模型选择栏点选"gpt-oss:20b",就能用类似ChatGPT的可视化界面聊天了,还能切换深色模式、保存对话历史。

四、常见问题及解决办法
-
如何查看已安装的模型?
命令行输入ollama list,会显示所有模型的名称、大小和安装时间。 -
想删除不需要的模型怎么办?
输入ollama rm 模型名,比如删除20b:ollama rm gpt-oss:20b -
模型运行卡顿、响应慢?
- 检查显存是否充足(20b建议保留18GB以上空闲显存,120b需85GB以上);
- 关闭其他占用显卡的程序(如游戏、视频渲染软件、浏览器多个标签页);
- 若用的是笔记本,确保切换到"高性能模式"(电源选项里设置)。
-
命令报错、无法下载?
- 确认Ollama已启动(桌面图标右键"打开");
- 检查网络是否正常,可尝试切换手机热点下载;
- Windows用户右键命令行工具,选择"以管理员身份运行"重试。
-
模型下载速度太慢?
可尝试在Ollama官网找国内镜像源(部分社区有分享),或在凌晨等网络低谷时段下载。
五、最后想说的话
这次OpenAI开源的两个模型确实让人惊喜,尤其是gpt-oss-20b,让普通用户用消费级显卡就能体验接近云端的AI能力。本地部署最大的优势是"隐私+免费"——数据全程在自己电脑里,不用担心泄露;而且没有调用次数限制,日常办公、学习完全够用。
从实际测试来看,20b模型在文本生成、逻辑推理上表现稳定,120b则在复杂任务(如多语言翻译、代码调试)上更精准,大家可以根据自己的硬件和需求选择。如果动手能力强,还能试试给模型喂自己的数据集,训练出专属功能,这正是开源的魅力所在。
最后附上两个模型的核心性能对比,供大家参考:

(性能对比图说明:gpt-oss-20b在常识问答、短句生成上得分85+,gpt-oss-120b在长文本理解、逻辑推理上得分90+,均优于同量级开源模型)
按照步骤操作,半小时内基本能完成部署,快试试用自己的电脑跑起OpenAI的开源模型吧!
六、那么,如何系统的去学习大模型LLM?
作为一名从业五年的资深大模型算法工程师,我经常会收到一些评论和私信,我是小白,学习大模型该从哪里入手呢?我自学没有方向怎么办?这个地方我不会啊。如果你也有类似的经历,一定要继续看下去!这些问题啊,也不是三言两语啊就能讲明白的。
所以我综合了大模型的所有知识点,给大家带来一套全网最全最细的大模型零基础教程。在做这套教程之前呢,我就曾放空大脑,以一个大模型小白的角度去重新解析它,采用基础知识和实战项目相结合的教学方式,历时3个月,终于完成了这样的课程,让你真正体会到什么是每一秒都在疯狂输出知识点。
由于篇幅有限,⚡️ 朋友们如果有需要全套 《2025全新制作的大模型全套资料》,扫码获取~

七、为什么要学习大模型?
我国在A大模型领域面临人才短缺,数量与质量均落后于发达国家。2023年,人才缺口已超百万,凸显培养不足。随着AI技术飞速发展,预计到2025年,这一缺口将急剧扩大至400万,严重制约我国AI产业的创新步伐。加强人才培养,优化教育体系,国际合作并进是破解困局、推动AI发展的关键。


八、👉大模型学习指南+路线汇总👈
我们这套大模型资料呢,会从基础篇、进阶篇和项目实战篇等三大方面来讲解。


👉①.基础篇👈
基础篇里面包括了Python快速入门、AI开发环境搭建及提示词工程,带你学习大模型核心原理、prompt使用技巧、Transformer架构和预训练、SFT、RLHF等一些基础概念,用最易懂的方式带你入门大模型。

👉②.进阶篇👈
接下来是进阶篇,你将掌握RAG、Agent、Langchain、大模型微调和私有化部署,学习如何构建外挂知识库并和自己的企业相结合,学习如何使用langchain框架提高开发效率和代码质量、学习如何选择合适的基座模型并进行数据集的收集预处理以及具体的模型微调等等。

👉③.实战篇👈
实战篇会手把手带着大家练习企业级的落地项目(已脱敏),比如RAG医疗问答系统、Agent智能电商客服系统、数字人项目实战、教育行业智能助教等等,从而帮助大家更好的应对大模型时代的挑战。

👉④.福利篇👈
最后呢,会给大家一个小福利,课程视频中的所有素材,有搭建AI开发环境资料包,还有学习计划表,几十上百G素材、电子书和课件等等,只要你能想到的素材,我这里几乎都有。我已经全部上传到CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

相信我,这套大模型系统教程将会是全网最齐全 最易懂的小白专用课!!
AtomGit 是由开放原子开源基金会联合 CSDN 等生态伙伴共同推出的新一代开源与人工智能协作平台。平台坚持“开放、中立、公益”的理念,把代码托管、模型共享、数据集托管、智能体开发体验和算力服务整合在一起,为开发者提供从开发、训练到部署的一站式体验。
更多推荐



所有评论(0)