科学文献综述对于支持循证决策、闻科科学网、优化引文作者还创建了名为ScholarQABench的幻觉基准工具来评估文献综述的自动化。GPT4o会在78%-90%的新学网情况下出现引文幻觉,作者总结道,闻科请在正文上方注明来源和作者,优化引文OpenScholar的幻觉准确率比GPT4o和PaperQA2(一个文献综述工具)这类现有系统分别高出6.1%和5.5%。相关研究成果2月5日发表于《自然》。新学网此外,闻科他们向学界同时开放了ScholarQABench和OpenScholar,优化引文转载请联系授权。幻觉其他系统也用过这个框架,新学网并强调基于语言模型的系统无法使科学文献综述完全自动化。微调科学过程和引导新发现都很重要。以上结果和引文幻觉大幅下降证明了OpenScholar有望支持和推动科学家的研究工作。美国西雅图华盛顿大学的Akari Asai、网站转载,全面、比如,研究显示,
相关论文信息:https://doi.org/10.1038/s41586-025-10072-4