JudgeAgent: Beyond Static Benchmarks for Knowledge-Driven and Dynamic LLM EvaluationPublished in Findings of the Association for Computational Linguistics: ACL 2026, 2026Share on Twitter Facebook LinkedIn Previous Next