NVIDIA RTX GPU 将前沿水准的 Qwen3.8-27B 编程智能体带到本地AI平台
NVIDIA RTX GPU 为开发者提供高性能解决方案,借助 Qwen3.8-27B,在本地运行前沿水准的编程智能体。
作为 Qwen3.8-Max 的本地搭档,这款 270 亿参数开放模型可在单个 GPU 上运行,专为需要调用本地文件、工具和项目上下文信息的快速响应式编程工作流打造。开发者可将敏感代码、专有数据和项目上下文信息保留在自己的系统中,同时在整个开发过程中获得强大的 AI 辅助。
NVIDIA RTX GPU 为该模型提供首日支持,包括 NVIDIA RTX PRO GPU 和 NVIDIA GeForce RTX 5080。经多 Token 预测优化后,Qwen3.8-27B 借助 MTP 可在单个 GeForce RTX GPU 上,为智能体编程、工具调用和长时开发任务提供高速的本地推理能力。
开发者现在即可在 llama.cpp、Ollama、Unsloth 和 LM Studio Bionic 上部署。这些工具均支持在 NVIDIA RTX GPU 上运行 Qwen3.8-27B。NVIDIA RTX 的高性能、CUDA 软件生态和开发者熟悉的开源工具协同配合,为新模型提供广泛支持,并为高响应速度的本地智能体编程工作流奠定坚实基础。
该模型还支持 DGX Spark ,更多优化即将推出,包括为所有 NVIDIA 本地 AI 设备提供 NVFP4 支持。Qwen3.8-27B 将前沿水准的本地编程智能体带到 NVIDIA 全天候运行的个人 AI 系统中。
除 PC 和个人 AI 系统外,NVIDIA Jetson 为边缘端侧 Qwen3.8-27B 提供首日支持。NVIDIA 发现该模型能力出众,具备强大的推理和智能体能力,而通过 MTP 实现的推测解码则可在边缘端提供快速、高速响应的本地推理。
关于NVIDIA
NVIDIA (NASDAQ: NVDA) 是加速计算领域的全球领导者。
# # #
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
中科院梅宏:具身智能的大脑负责想,小脑负责动
在2026 CCF中国开源大会上,中国科学院院士梅宏点破了这个过程的核心痛点:当前的具身智能卡在了模型局限、本体适配、任务执行三道现实难题上,而大模型的能力很难直接落到机器人实体系统里..[详细]
AI基础设施变成金融化资产,光连接需求再度放大
5000亿,AI建设迎来了阿波罗、贝莱德、黑石、布鲁克菲尔德、高盛和KKR六大华尔街巨头的投资。当各大科技巨头纷纷成为AI基建狂魔,光连接的需求正在被再次放大。[详细]
内存、芯片涨价停不下来 手机市场竞争逻辑生变
2026,一场史无前例的成本大挪移正在消费市场上演,很难有人置身事外。在AI基础设施投资的虹吸作用下,SoC、DRAM、NAND芯片接连涨价,层层向下挤压整机利润,倒逼手机厂商重新审视定价、产品..[详细]
别人在定义手机,荣耀在定义未来
纵观智能手机行业十余年发展,行业长期陷入硬件参数微迭代、交互逻辑固化、产品形态趋同的内卷困局。曾经引领行业变革、定义智能手机发展方向的标杆品牌苹果,如今也逐渐褪去了创新光环。当..[详细]
一场足球盛宴,运营商可以提供哪些服务
不久前落幕的世界杯,无线技术成为保障赛场体验的隐形英雄,几万名的观众、偌大的体育场、高清转播的需求,网络稍有一卡,都会引来球迷或转播商的抱怨。近期,GSMA智库发布的《2026世界杯:..[详细]
张平院士:人工智能发展的尽头一定是信息
8月5日,在主题为“AI赋能频谱创新,智能引领产业未来”的2026无线电技术与应用发展论坛上,中国工程院院士张平的主旨报告,却把话题引向了一个看似反潮流的方向。这背后也是一个被热浪掩盖..[详细]













