AI 文章摘要
这篇文章介绍了如何安装和运行Qwen3.8-27B大模型。首先,需要确认已安装驱动和CUDA版本,并下载llama包和模型文件夹。然后,将模型和启动器放入llama文件夹,通过双击批处理文件启动模型。...
本文中所有用到的文件都在此处的夸克网盘下载链接中:
我用夸克网盘给你分享了「qwen3.8-27b」,点击链接或复制整段内容,打开「夸克网盘APP」即可获取。
/~fe683aJn8e~:/
链接:https://pan.quark.cn/s/1691ca1657da
环境安装
1、首先确认自己已经装好驱动,并确认nvidia显卡cuda版本号,查询方式,cmd/ps执行:
nvidia-smi

截至2026-08-20,目前最新的还是CUDA 13.3
如果没有版本或者不是自己想要的可以去 CUDA Toolkit 13.3 Downloads | NVIDIA Developer 下载自己需要的版本,这里提供的是当时CUDA 13.3

2、下载对应的llama包:Releases · ggml-org/llama.cpp ,两个都要下载:

3、下载后解压到一个文件夹中。
加载模型
1、下载模型:整个models文件夹,下载后放到llama解压的文件夹中:

2、下载批处理启动器:qwen3.8启动器基于零度解说大佬3.6越狱修改.bat,也放到llama文件夹中
运行
1、直接双击bat文件,在窗口中输入1/2运行对应的模型。

2、可以直接用IP:8080/v1调用api接口,也可以打开IP:8080在页面上运行




4080S可以达到60t/s,A4000能达到30t/s




