Ai2, bilimsel raporlama için açık kaynak AstaBrief 8B modelini yayımladı
Ai2, bilimsel raporlama için tasarlanmış açık ağırlıklı AstaBrief 8B modelini ve eğitim verilerini yayımladı. Qwen3-8B tabanlı model, SFT ve DPO ile eğitilerek tek geçişte alıntılı rapor üretimi sağlıyor. Asta platformunda Fast mode olarak sunulan model, Claude tabanlı Thinking mode'a göre ortalama 51.1 saniyede rapor üreterek yaklaşık 3.5 kat hızlanma gösteriyor. Çalışma, 47K SFT ve 6K DPO örneği kullanırken, verilerin kalite filtrelemesine ve alıntı tutarlılığına odaklanıyor. Model, SQABench-CS2 ve DeepScholarBench gibi metriklerde Claude tabanlı pipeline ile rekabetçi sonuçlar alsa da, değerlendirmeler 2025'teki frontier modellerle sınırlıdır.
Geliştiriciler, AstaBrief'in açık ağırlıklarını indirerek kendi altyapılarında çalıştırabilir; bu, hassas veriler için yerel raporlama imkânı sunar. SFT ve DPO verisiyle eğitilen model, tek geçişli üretim mimarisi sayesinde düşük gecikme sunar. Ancak modelin genel amaçlı LLM'lerle doğrudan karşılaştırılması yerine, bilimsel raporlama bağlamındaki performansına odaklanmak gerekir. Kaynak, modelin güncel frontier modellerle yeniden test edilmediğini belirtir.