开源引擎Strata:本地部署Qwen千亿参数模型
近日,开源项目Strata正式发布,这是一款专为消费级硬件打造的高性能AI推理引擎,成功将参数量高达1250亿的Qwen3.8-Flash-Next大模型部署至普通PC运行。该项目基于MIT开源协议,底层整合了Qwen团队基座模型与多家机构的量化压缩技术。 Strata彻底打破了千亿参数模型必须依赖云端服务器的传统瓶颈。工具原生支持Windows与Linux系统,广泛兼容NVIDIA RTX 20至50系列及AMD RX 6000至9000系列显卡,仅需12GB以上显存即可启动。通过创新的显存与系统内存协同调度架构,引擎能够将模型权重智能拆分,利用主板内存与多显卡并行计算,实现低资源消耗下的稳定推理。基准测试表明,在搭载RTX 5070或RX 9070 XT的终端上,模型文本生成速度可达每秒44至94个词元,同时具备高质量的代码编写、复杂对话及图像解析能力。 在实际应用层面,Strata提供一键式部署脚本,并内置完全兼容OpenAI与Anthropic标准的本地API及MCP服务,可无缝对接Cursor、Copilot等主流AI编程助手。所有交互数据均严格限制在本地终端处理,有效规避云端泄露风险。Strata的落地极大拓宽了端侧大模型的硬件适配边界,为开发者及注重数据隐私的个人用户提供了高性能、零成本的下沉解决方案,标志着消费级终端向本地化AI枢纽演进迈出关键一步。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
