必读视频专题飞象趣谈光通信人工智能低空经济5G手机智能汽车智慧城市会展特约记者

AMD、高通宣布旗下硬件支持 OpenAI gpt-oss 开放推理模型

2025年8月6日 16:26IT之家作 者:溯波

OpenAI 当地时间昨日以 Apache 2.0 许可证的形式推出了两款 gpt-oss 系列开放推理模型,其中参数规模较小的 gpt-oss-20b 模型可在仅配备 16GB 内存的边缘设备上运行、参数更多的 gpt-oss-120b 则能在单个 80GB GPU 上高效运行。

AMD 与高通均宣布旗下硬件支持 gpt-oss 系列开放模型,具体是 AMD 锐龙 AI Max+ 395 处理器支持 gpt-oss-120b、AMD Radeon RX 9070 16GB 显卡支持 gpt-oss-20b、高通旗舰骁龙平台支持 gpt-oss-20b。

AMD 宣称锐龙 AI Max+ 395 是全球首款能运行 gpt-oss-120b 模型的消费级 AI PC 处理器:采用 GGML 框架转换的 MXFP4 格式 gpt-oss-120b 大约需要 61GB 显存,而 "Strix Halo" 平台在 128GB 统一内存下支持将 96GB 分配给 GPU,轻松满足这一需求。

锐龙 AI Max+ 395 在 gpt-oss-120b 上有 30 Token / s 的输出速率,同时支持该模型的 MCP 模型上下文协议实现。

而 Radeon RX 9070 16GB 显卡则能在 gpt-oss-20b 上实现出色的首 Token 输出时间 (TTFT) 和每秒 Token 输出数量表现。

高通表示根据早期测试 gpt-oss-20b 可在端侧实现出色思维链推理表现,开发者可通过 Hugging Face 和 Ollama 等热门平台在搭载骁龙芯片的设备上访问 gpt-oss-20b 模型并充分发挥其功能。

编 辑:章芳
飞象网版权及免责声明:
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
推荐阅读

精彩视频

精彩专题

关于我们广告报价联系我们隐私声明本站地图

CCTIME飞象网 CopyRight © 2007-2025 By CCTIME.COM

京ICP备08004280号-1 电信与信息服务业务经营许可证080234号 京公网安备110105000771号

公司名称: 北京飞象互动文化传媒有限公司

未经书面许可,禁止转载、摘编、复制、镜像