8 月 13 日,阿里千问大模型团队开放 Qwen3.8-Max 基座 Qwen3.8-2.4T-A95B 模型权重;8 月 14 日晚,同系列 Qwen3.8-27B 稠密多模态模型正式开放权重!澎峰科技 DF35 AI 大模型推理一体机已完成 Qwen3.8-27B 适配,实现 Day 0 同步支持,于模型发布后24小时内完成模型调优与全链路验证,企业用户无需漫长等待,可第一时间解锁 Qwen3.8-27B 旗舰多模态模型完整能力:极致高性价比、开箱即用、本地私有化运行、零云端 Token 计费。
本次能实现开源即适配的核心底层支撑,来自众智 FlagOS 完整开源生态。依托 FlagOS 自研跨芯片推理插件vLLM-plugin-FL,DF35 落地 “框架层统一、算子层弹性分发” 的先进架构,高效响应通义千问全系列新版本迭代,从根源解决多硬件、多模型适配碎片化、维护成本高的行业痛点。
关于Qwen3.8-27B模型
Qwen3.8 基于 Qwen3.5 的架构基础,在代码生成、专业工作、科研以及长周期智能体任务等方面实现了显著提升。Qwen3.8-27B 将这些进步融入一个紧凑且易于部署的稠密模型中:它是一个原生的视觉-语言模型,能够理解图像和视频,具备灵活的思维控制能力,旨在更可靠地完成复杂的多步骤任务。
Qwen3.8-27B 具备以下增强特性:
核心能力:在代码生成、专业工作、科研和长周期智能体任务方面实现全面改进。
智能体执行:更强的自主规划能力与更优的环境反馈处理能力,从而实现更可靠的端到端任务完成。
下游兼容性:更广泛地支持主流评测框架和开发工具,便于集成到您现有的技术栈中。
灵活的思维控制:默认启用思维模式,可按请求禁用;可通过 reasoning_effort 调整推理深度,并通过 preserve_thinking 保留历史消息中的推理上下文。
视觉-语言理解:原生支持图像和视频理解,涵盖 STEM 图表、文档乃至长达数小时的视频。
面向政企、中小企业私有化落地痛点,DF35依托 FlagOS生态打造差异化竞争力,完美适配 Qwen3.8-27B 本地部署需求:
1. 极致高性价比,轻量化落地旗舰 Qwen3.8-27B 模型
无需大规模算力集群,单台 DF35 即可完整加载、稳定运行 Qwen3.8-27B 稠密模型,软硬件深度协同优化显存占用,降低企业算力采购门槛;对比云端 API 长期调用成本,一次性硬件投入,长期使用成本显著下降,中小企业也可搭建专属本地大模型算力。
2. 本地运行,无云端Token消耗,数据不外流
整机纯本地化推理,企业文档、业务数据、对话交互全部在内网流转,不上传第三方云端,规避数据泄露风险;不存在云端 Token 按量收费限制,不限对话频次、不限知识库长度,业务系统、内部员工可无限调用,适配政务、金融、制造等强合规行业。
3.开箱即用,软硬一体化方案,大幅降低运维门槛

未来澎峰将持续深化软硬件协同优化,依托 FlagOS 异构算力底座,持续降低企业本地 AI 落地门槛,提供更低成本、更高性能、更安全可控的私有化推理基础设施,助力千行百业安全落地专属大模型能力。
开源生态共建通道:诚邀广大开发者、合作伙伴携手共建开放AI算力生态,FlagOS官方网站:https://flagos.io

往期推荐