نسخة أولية وصول مفتوح
Characterizing Overconfident Failure in LLM-Based Code Generation
Large language models (LLMs) are increasingly used for automated code generation, but generated programs can appear syntactically plausible while still failing execution-based correctness checks. Existing validation methods, such as testing and program analysis, remain essential but are often incomplete, costly, or app …