REFUTE
Can Language Models Falsify? Evaluating Algorithmic Reasoning with Counterexample Creation
// repository documentation
Was this content helpful?
(0 ratings)
