概览
gpt-oss 系列的小尺寸版本,与 gpt-oss-120b 同在 2025-08-05 发布,同样是 Apache 2.0 许可的开源权重模型。MoE 架构,21B 总参数、3.6B 激活参数,上下文 131,072 token,MXFP4 量化后只需约 16GB 内存,笔记本电脑或边缘设备就能本地跑,适合低延迟与隐私敏感场景。OpenAI 称它在常见基准上与 o3-mini 表现相当。和大版本一样必须搭配官方 harmony 响应格式使用,且不通过 OpenAI API 或 ChatGPT 提供。它也是消费级硬件上做本地微调最省事的一档。
- 模态
- 文本
- 参数量
- 21B 总参数 / 3.6B 激活参数(MoE)
- 许可说明
- 开源 · Apache-2.0
能力
- Apache 2.0 许可,可自由下载、自托管、商用与二次分发
- 约 16GB 内存即可运行,笔记本与边缘设备可本地部署
- 三档推理强度:low / medium / high
- 输出完整思维链,原生支持函数调用、浏览与 Python 执行
- 可在消费级硬件上微调
版本历史
2025-08 发布
上下文 131K- 与 gpt-oss-120b 同期发布,面向低延迟、本地与专用场景
- MXFP4 量化后约 16GB 内存即可运行,消费级硬件可微调
