当前位置: 首页 » 资讯 » 新科技 » 正文

AMD、高通宣布旗下硬件支持OpenAI gpt-oss开放推理模型

IP属地 中国·北京 编辑:赵磊 IT之家 时间:2025-08-06 16:07:15

IT之家 8 月 6 日消息,OpenAI 当地时间昨日以 Apache 2.0 许可证的形式推出了两款 gpt-oss 系列开放推理模型,其中参数规模较小的 gpt-oss-20b 模型可在仅配备 16GB 内存的边缘设备上运行、参数更多的 gpt-oss-120b 则能在单个 80GB GPU 上高效运行。

AMD 与高通均宣布旗下硬件支持 gpt-oss 系列开放模型,具体是 AMD 锐龙 AI Max+ 395 处理器支持 gpt-oss-120b、AMD Radeon RX 9070 16GB 显卡支持 gpt-oss-20b、高通旗舰骁龙平台支持 gpt-oss-20b。

AMD 宣称锐龙 AI Max+ 395 是全球首款能运行 gpt-oss-120b 模型的消费级 AI PC 处理器:采用 GGML 框架转换的 MXFP4 格式 gpt-oss-120b 大约需要 61GB 显存,而 Strix Halo 平台在 128GB 统一内存下支持将 96GB 分配给 GPU,轻松满足这一需求。

锐龙 AI Max+ 395 在 gpt-oss-120b 上有 30 Token / s 的输出速率,同时支持该模型的 MCP 模型上下文协议实现。

而 Radeon RX 9070 16GB 显卡则能在 gpt-oss-20b 上实现出色的首 Token 输出时间 (TTFT) 和每秒 Token 输出数量表现。

高通表示根据早期测试 gpt-oss-20b 可在端侧实现出色思维链推理表现,开发者可通过 Hugging Face 和 Ollama 等热门平台在搭载骁龙芯片的设备上访问 gpt-oss-20b 模型并充分发挥其功能。

标签: 高通 模型 硬件 旗下 骁龙 平台 许可证 边缘 首款 形式 内存 全球 功能 充分发挥 推理模型 旗舰 协议 热门 芯片 参数 数量

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。