Not finding it? Sign in to also search OpenAlex live.
-
LLM Evaluation in Practice: A Review of Metrics, Practitioner Insights, and Lessons Learned2026 Language Resources and Evaluation Conference (LREC) conference-paper Computer Science Topic Modeling Open access
Roos M. Bakker, Marianne Witte-Schaaphok, Julia García‐Fernández, Tom Brand, Jens van der Weide, Stephan Raaijmakers
0citations -
From Survey Personas to LLM Agents: A Generative Agent-based Simulation of Mobility Policy Preference Dynamics2026 arXiv (Cornell University) preprint Computer Science Multi-Agent Systems and Negotiation Open access
Ali Torkayesha, Julia Offermann, Regina Gimpel, Linda Engelmann, Katrin Arning, Martina Ziefle, +1 more
0citations -
TOSSS: a CVE-based Software Security Benchmark for Large Language Models2026 Centrum Wiskunde & Informatica (CWI), the national research institute for mathematics and computer science in the Netherlands other Computer Science Software Engineering Research Open access
Marc Damie, Murat Bilgehan Ertan, Domenico Essoussi, Angela Makhanu, Gaëtan Peter, Roos Wensveen
0citations -
LLM-Driven Evolutionary Generation of Multi-Objective Bayesian Optimization Algorithms2026 arXiv (Cornell University) preprint Computer Science Advanced Multi-Objective Optimization Algorithms Open access
Georgios Laskaris, Reuben Brasher, Bas van Stein, Elena Raponi, Thomas Bäck, Florian Neukart
0citations