Qwen3.8-27B 正式开源!27B 参数媲美顶级闭源模型,支持 100 万 Token,本地 8GB 显存即可运行
Qwen3.8-27B 正式开源!27B 参数媲美顶级闭源模型,支持 100 万 Token,本地 8GB 显存即可运行

Qwen3.8-27B 正式开源!27B 参数媲美顶级闭源模型,支持 100 万 Token,本地 8GB 显存即可运行

部署教程

https://www.freedidi.com/25144.html

一、 Qwen3.8-27B 开源模型 

目前量化的 Qwen3.8 27B 模型总共有21个,格式为GGUF,可以适配多种不同尺寸的显存大小,最低支持8G显存,当然如果你的显存是低于8G的,那么你可以直接跳到第四步,下载越狱的模型,越狱模型最低支持4G显存!

1、Huggingface 下载: 【点击前往

2、网盘下载: 【点击前往

3、备用下载:【点击前往

阅读我们的《如何运行Qwen3.8-27B指南》!

Qwen3.8-27B 要求:

Qwen3.8-27B 4位量化显存可以在大多数17-19GB显存设备上运行,比如RTX 5080、4090或配备24GB内存的Mac。表格:硬件需求(单位 = 总内存:RAM + 显存,或统一内存)

2位3位4位6位8位BF16
11-13 GB13-16 GB17-19 GB24 GB31 GB56 GB
量化文件大小权重(GiB)8K 上下文32K 上下文建议显卡
UD-IQ2_XXS9.01 GB8.49.912.48~12G(3060 12G / 5070)
UD-IQ2_M10.3 GB9.611.113.612G(32K 需降 ctx)
UD-Q2_K_XL10.7 GB10.011.514.012G 极限 / 16G 舒适
UD-IQ3_XXS11.9 GB11.112.615.116G(4060Ti 16G / 5060Ti 16G)
Q3_K_S12.6 GB11.713.215.716G
UD-Q3_K_XL13.4 GB12.514.016.516G 低显存首选
Q3_K_M13.8 GB12.914.416.916G
IQ4_XS15.7 GB14.616.118.620G / 24G
Q4_K_S / Q4_016.1 GB15.016.519.020G(7900XT / 4000 Ada)
IQ4_NL16.3 GB15.216.719.220G
Q4_K_M17.1 GB15.917.419.924G
Q4_117.5 GB16.317.820.324G
UD-Q4_K_XL17.9 GB16.718.220.724G  全场最佳性价比
Q5_K_S19.3 GB18.019.522.024G(3090 / 4090)
Q5_K_M19.8 GB18.419.922.424G
UD-Q5_K_XL20.2 GB18.820.322.824G 偏紧 / 32G 舒适
Q6_K22.9 GB21.322.825.324G 仅短上下文 / 32G
UD-Q6_K_XL25.9 GB24.125.628.132G(5090)
Q8_029 GB27.028.531.032G 极限 / 48G
UD-Q8_K_XL31.5 GB29.330.833.348G(A6000 / 双卡 24G)
BF16(文件夹)~54 GB~50~52~5480G 或双卡 48G

二、下载llama.cpp

1、Github 下载:【点击前往

2、网盘下载:【点击前往

三、一键启动脚本

1、国内网盘下载:【点击前往

2、国外网盘下载:【点击下载

2、备用高速下载:【点击前往

该一键启动脚本可以自动识别你当前的电脑硬件配置,并根据你的配置帮你匹配合适的启动参数,同时支持加载多个模型,启动后可以自动切换你需要的模型,超级方便!

启动脚本后,它会自动弹出窗口进入到 llama.cpp 控制面板

四、越狱模型(无审查)

Qwen3.8-27B 现在已经推出了多个真正无审查的越狱模型,如果你想更自由,不受约束和限制,在本地使用越狱模型,那么下方的模型切勿错过!真正实现模型自由,几乎可以满足你任何的特殊需求。并且最低支持4G显存!

1、Huggingface 下载 【点击前往

2、备用下载:【点击前往

五、对接 Hermes Agent

1、官方下载:【点击前往

2、备用下载:【点击前往

安装hermes Agent 以后可以通过本地子托管形式进行对接,就可以讲Qwen 3.8 27 开源模型,在 Agent 中进行调用使用,完全免费

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注