Not finding it? Sign in to also search OpenAlex live.
-
Causally Testing Gender Bias in LLMs: A Case Study on Occupational Bias2025 Findings of the Association for Computational Linguistics: NAACL conference-paper Social Sciences Ethics and Social Impacts of AI Open access
Yuen Chen, Vethavikashini Chithrra Raghuram, Justus Mattern, Rada F. Mihalcea, Zhijing Jin
7citations -
Multi-step retrieval and reasoning improves radiology question answering with large language models2025 npj Digital Medicine article Medicine Artificial Intelligence in Healthcare and Education Open access
Sebastian Wind, Jeta Sopa, Daniel Truhn, Mahshad Lotfinia, Tri-Thien Nguyen, Keno K. Bressem, +6 more
18citations -
Performance and reliability of large language models on the European Board of Hand Surgery examination: a multi-model evaluation study2026 Journal of Hand Surgery (European Volume) article Medicine Artificial Intelligence in Healthcare and Education Open access
Ibrahim Güler, Lindsay Muir, Gerrit Grieb, Philipp Moog, Armin Kraus, Henrik Stelling
0citations
9 results