当前位置: 首页 » 资讯 » 新科技 » 正文

AMD、高通宣布旗下硬件支持 OpenAI gpt-oss 开放推理模型

IP属地 中国·北京 编辑:沈瑾瑜 IT之家 时间:2025-08-06 14:22:21

IT之家 8 月 6 日消息,OpenAI 当地时间昨日以 Apache 2.0 许可证的形式推出了两款 gpt-oss 系列开放推理模型,其中参数规模较小的 gpt-oss-20b 模型可在仅配备 16GB 内存的边缘设备上运行、参数更多的 gpt-oss-120b 则能在单个 80GB GPU 上高效运行。

AMD 与高通均宣布旗下硬件支持 gpt-oss 系列开放模型,具体是 AMD 锐龙 AI Max+ 395 处理器支持 gpt-oss-120b、AMD Radeon RX 9070 16GB 显卡支持 gpt-oss-20b、高通旗舰骁龙平台支持 gpt-oss-20b。

AMD 宣称锐龙 AI Max+ 395 是全球首款能运行 gpt-oss-120b 模型的消费级 AI PC 处理器:采用 GGML 框架转换的 MXFP4 格式 gpt-oss-120b 大约需要 61GB 显存,而 "Strix Halo" 平台在 128GB 统一内存下支持将 96GB 分配给 GPU,轻松满足这一需求。


锐龙 AI Max+ 395 在 gpt-oss-120b 上有 30 Token / s 的输出速率,同时支持该模型的 MCP 模型上下文协议实现。


而 Radeon RX 9070 16GB 显卡则能在 gpt-oss-20b 上实现出色的首 Token 输出时间 (TTFT) 和每秒 Token 输出数量表现。


高通表示根据早期测试 gpt-oss-20b 可在端侧实现出色思维链推理表现,开发者可通过 Hugging Face 和 Ollama 等热门平台在搭载骁龙芯片的设备上访问 gpt-oss-20b 模型并充分发挥其功能。


免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。

全站最新