开源AstaBrief:Asta平台快速科研报告生成模型
近日,美国人工智能研究所(Ai2)正式开源科学报告生成模型AstaBrief 8B及全套训练数据。该项目核心训练与评测工作均于2025年完成,模型基于Qwen3-8B底座构建,专为科学文献综述场景定制,旨在提供高效且支持本地化部署的证据溯源工具。 训练过程中,团队利用数万条真实科研查询数据,采用监督微调与直接偏好优化策略,并创新引入引用密度过滤机制,有效遏制模型过度推断倾向。实测数据显示,AstaBrief生成速度较原有闭源方案提升约3.5倍,单次报告生成平均耗时仅51.1秒。在多项基准评测中,其引用准确率与内容相关性表现优异。平台内测反馈显示,超八成用户给出正面评价,部分研究人员已将其纳入常规工作流。 作为美国NSF OMAI开源科学AI基础设施计划的阶段性成果,AstaBrief的发布使科研机构能在隔离环境中安全处理敏感数据。Ai2团队表示,下一步将聚焦检索增强强化学习与多轮工具交互技术,进一步打磨面向复杂科研任务的专业模型。该模型已接入Asta平台快速模式,并同步在Hugging Face开源。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
