NVIDIA RTX GPU 将前沿水准的 Qwen3.8-27B 编程智能体带到本地AI平台

NVIDIA RTX GPU 为开发者提供高性能解决方案,借助 Qwen3.8-27B,在本地运行前沿水准的编程智能体。

作为 Qwen3.8-Max 的本地搭档,这款 270 亿参数开放模型可在单个 GPU 上运行,专为需要调用本地文件、工具和项目上下文信息的快速响应式编程工作流打造。开发者可将敏感代码、专有数据和项目上下文信息保留在自己的系统中,同时在整个开发过程中获得强大的 AI 辅助。

NVIDIA RTX GPU 为该模型提供首日支持,包括 NVIDIA RTX PRO GPU 和 NVIDIA GeForce RTX 5080。经多 Token 预测优化后,Qwen3.8-27B 借助 MTP 可在单个 GeForce RTX GPU 上,为智能体编程、工具调用和长时开发任务提供高速的本地推理能力。

开发者现在即可在 llama.cpp、Ollama、Unsloth 和 LM Studio Bionic 上部署。这些工具均支持在 NVIDIA RTX GPU 上运行 Qwen3.8-27B。NVIDIA RTX 的高性能、CUDA 软件生态和开发者熟悉的开源工具协同配合,为新模型提供广泛支持,并为高响应速度的本地智能体编程工作流奠定坚实基础。

该模型还支持 DGX Spark ,更多优化即将推出,包括为所有 NVIDIA 本地 AI 设备提供 NVFP4 支持。Qwen3.8-27B 将前沿水准的本地编程智能体带到 NVIDIA 全天候运行的个人 AI 系统中。

除 PC 和个人 AI 系统外,NVIDIA Jetson 为边缘端侧 Qwen3.8-27B 提供首日支持。NVIDIA 发现该模型能力出众,具备强大的推理和智能体能力,而通过 MTP 实现的推测解码则可在边缘端提供快速、高速响应的本地推理。

给TA打赏
共{{data.count}}人
人已打赏
AMD超威电脑

AMD十年前首次展示Zen处理器性能:同频3.0GHz跑赢Intel从此翻身

2026-8-20 11:21:58

CPU电脑

GPU砍到三分之一!Intel新芯片瞄准低价掌机:功耗8-25W

2026-8-20 11:48:56

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索