← 所有模型

qwen3-30b-a3b

公开

Qwen3 模型家族的 30B 参数 (MoE) 版本。

40K 下载量

7 星标

功能

推理

最低系统内存

17GB

标签

30B
qwen3moe

README

Qwen3 30B A3B (qwen)

使用 YaRN 最多支持 131,072 个上下文 token(默认 32k)

支持 /no_think 以禁用推理,只需将其添加到提示的末尾

MoE 模型,具有 3.3B 激活权重,总共 128 个专家,其中 8 个处于活跃状态

支持思考和非思考模式,并在两种模式下增强推理能力,显著提升数学、编码和常识能力

擅长创意写作、角色扮演、多轮对话和指令遵循

高级代理功能,支持 100 多种语言和方言

自定义字段

模型作者定义的特殊功能

启用思考

: 布尔值

(默认值 =true)

控制模型在回复前是否会进行思考

参数

此模型附带的自定义配置选项

最小 P 采样
0
Top K 采样
20

来源

此模型使用的底层模型文件

© . This site is unofficial and not affiliated with Element Labs, Inc.