Can artificial intelligence accurately assess systematic review quality? Benchmarking large language models… | ScholarDeck