开源 #开源模型 2026-10-05 · 原文发布 10-02

Ai2 开源 AstaBrief 8B:一次生成带引用的研究报告,比 Claude 驱动的模式快约 3.5 倍

把「检索结果 → 带引用的长报告」交给一个 8B 开源模型,权重和训练数据一起放出。

一手来源 Ai2 官方博客 · huggingface.co 读原文 ↗

// 要点

  • 基于 Qwen3-8B,输入研究问题与检索到的文献片段,一次写完整篇带引用的报告,而不是逐节生成。
  • 在 Asta 里,Fast 模式平均每份报告 51.1 秒,Claude 驱动的 Thinking 模式为 178.5 秒,约快 3.5 倍。
  • 用过滤后的 4.7 万条样本做后训练;模型与训练数据一并开源,方便复现和二次开发。
  • Ai2 表示,权重开放后机构可以在自有基础设施上部署,适合研究问题本身敏感的场景。

开发者视角「检索后写成带引用的长文」是 AI 云盘文档问答最常见的需求,8B 小模型能在一次调用里做完,意味着可以私有化部署、把成本压下来。我会先拿自己的文档集对比引用准确率,再决定是否替掉现有的大模型调用。