8月13日,阿里千问大模型团队正式开放了Qwen3.8-Max基座模型Qwen3.8-2.4T-A95B的权重。随后在8月14日晚,同系列的Qwen3.8-27B稠密多模态模型也同步开源权重。值得关注的是,澎峰科技DF35 AI大模型推理一体机已率先完成对Qwen3.8-27B的适配,实现Day 0同步支持。这意味着在模型发布后的24小时内,澎峰科技便完成了模型调优与全链路验证。对于企业用户而言,无需经历漫长等待,即可第一时间解锁Qwen3.8-27B旗舰多模态大模型的完整能力,包括:极致高性价比、开箱即用、本地私有化运行以及零云端Token计费。
此次实现“开源即适配”的核心底层能力,来自众智 FlagOS 完整开源生态。依托 FlagOS 自研跨芯片推理插件vLLM-plugin-FL,DF35构建了“框架层统一、算子层弹性分发”的先进架构,能够高效响应通义千问全系列新版本迭代,从底层破解多硬件、多模型适配碎片化和维护成本高的行业难题。
关于Qwen3.8-27B模型
Qwen3.8基于Qwen3.5的架构基础,在代码生成、专业任务、科研场景以及长周期智能体任务等方面实现了显著提升。Qwen3.8-27B则将这些能力整合到一个紧凑、易部署的稠密模型中:它是一款原生视觉-语言模型,支持图像理解与视频理解,具备灵活的思维控制能力,能够更加稳定、可靠地完成复杂多步骤任务。在官方多项评测中,它已经开始正面挑战Claude等顶级闭源模型。
Qwen3.8-27B 具备以下增强特性:
核心能力:在代码生成、专业工作、科研分析和长周期智能体任务方面实现全面增强。
智能体执行:具备更强的自主规划能力和更优的环境反馈处理能力,从而实现更稳定、更可靠的端到端任务执行。
下游兼容性:更广泛支持主流评测框架与开发工具,便于快速集成到现有技术栈和企业应用系统中。
灵活的思维控制:默认启用思维模式,可根据请求关闭;同时可通过 reasoning_effort 调整推理深度,并借助 preserve_thinking 保留历史消息中的推理上下文。
视觉-语言理解:原生支持图像和视频理解,覆盖 STEM 图表、文档解析乃至长达数小时的视频内容处理。
面向政企和中小企业私有化部署的实际痛点,DF35依托 FlagOS生态打造差异化竞争优势,全面适配 Qwen3.8-27B 本地部署需求:
1. 极致高性价比,轻量化落地旗舰 Qwen3.8-27B 模型
无需部署大规模算力集群,单台 DF35 即可完整加载并稳定运行 Qwen3.8-27B 稠密模型。通过软硬件深度协同优化显存占用,有效降低企业算力采购门槛;相比云端 API 的长期调用成本,一次性硬件投入可显著降低长期使用支出,中小企业同样能够快速搭建专属本地大模型算力平台。
2. 本地运行,无云端Token消耗,数据不外流
整机采用纯本地化推理方案,企业文档、业务数据以及对话交互全程在内网流转,无需上传第三方云端,能够有效规避数据泄露风险;同时不存在云端 Token 按量收费限制,不限对话频次、不限知识库长度,业务系统与内部员工均可无限调用,尤其适合政务、金融、制造等高合规行业的AI本地部署需求。
3.开箱即用,软硬一体化方案,大幅降低运维门槛
一体机预装 FlagOS、vLLM-plugin-FL 统一推理插件及 PerfXLM 自研推理框架,预置 Qwen、Gemma、Embedding 等主流开源模型,并内置 OpenClaw、RAGFlow 全套应用工具链,搭配 PerfXCloud 平台。企业无需投入大量人力反复编译环境、适配调试算子,可大幅简化本地化大模型部署流程,显著降低落地成本与后续运维成本。

未来,澎峰将持续深化软硬件协同优化,依托 FlagOS 异构算力底座,不断降低企业本地 AI 落地门槛,提供更低成本、更高性能、更安全可控的私有化推理基础设施,助力千行百业安全、高效落地专属大模型能力。
开源生态共建通道:诚邀广大开发者与合作伙伴携手共建开放AI算力生态,FlagOS官方网站:https://flagos.io
