Qwen3.8-27B-FP8发布:FP8量化视觉语言模型
2026年8月,通义千问团队正式发布Qwen3.8-27B-FP8开源模型,标志着该家族在轻量级高效部署领域取得重要突破。该模型采用FP8细粒度量化技术,在27B紧凑参数量下实现了与原始模型近乎一致的性能表现。作为原生视觉语言架构,它不仅具备高精度的图文视频理解能力,更在代码生成、软件工程、长程智能体任务及多模态推理等核心基准测试中全面超越前代,多项指标持平或领先于当前主流前沿模型。 针对企业级应用需求,模型原生支持二十六万Tokens上下文,结合动态缩放技术可无缝扩展至一百万Tokens,有效破解超长文本处理瓶颈。系统默认启用深度思考模式,并开放推理力度与思维链保留的灵活调控接口。官方同步预告Qwen Cloud托管服务上线,将内置百万上下文与官方工具集,进一步降低运维成本。目前该模型已全面适配vLLM、SGLang等主流推理框架,并提供标准化的API调用方案。业内指出,Qwen3.8-27B-FP8凭借卓越的参数效率与强大的智能体协同能力,将显著加速开源大模型在复杂专业场景的商业化落地进程。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
