NVIDIA RTX GPU 为开发者带来高性能本地 AI 解决方案,借助 Qwen3.8-27B,可在本地运行前沿级别的编程智能体。

作为 Qwen3.8-Max 的本地版本搭档,这款拥有 270 亿参数的开放模型可在单张 GPU 上运行,专为需要调用本地文件、工具以及项目上下文信息的高响应编程工作流而设计。开发者能够将敏感代码、专有数据和项目上下文安全保留在自己的系统中,同时在整个开发流程中获得强大的 AI 编程辅助能力。
该模型在发布首日即获得 NVIDIA RTX GPU 支持,其中包括 NVIDIA RTX PRO GPU 和 NVIDIA GeForce RTX 5080。经过多 Token 预测优化后,Qwen3.8-27B 借助 MTP,可在单个 GeForce RTX GPU 上为智能体编程、工具调用以及长时间开发任务提供高速本地推理能力。
目前,开发者已经可以在 llama.cpp、Ollama、Unsloth 以及 LM Studio Bionic 上部署该模型。这些工具均已支持在 NVIDIA RTX GPU 上运行 Qwen3.8-27B。凭借 NVIDIA RTX 的强劲性能、成熟的 CUDA 软件生态,以及开发者熟悉的开源工具链,新模型获得了广泛支持,也为低延迟、高响应的本地智能体编程工作流奠定了坚实基础。
该模型还支持 DGX Spark,后续还将推出更多优化,包括为所有 NVIDIA 本地 AI 设备提供 NVFP4 支持。Qwen3.8-27B 正将前沿水平的本地编程智能体带入 NVIDIA 可全天候运行的个人 AI 系统。
除 PC 和个人 AI 系统外,NVIDIA Jetson 也为边缘端侧部署 Qwen3.8-27B 提供首日支持。NVIDIA 认为,该模型展现出突出的推理能力与智能体能力,而通过 MTP 实现的推测解码,则能够在边缘端提供快速、低延迟且高响应的本地推理体验。
