Abstract

Large Language Models have emerged as promising tools for software vulnerability analysis, but their effectiveness depends heavily on prompt design. Existing research primarily compares prompting strategies using aggregate performance metrics, providing limited insight into why models fail or how prompts can be improved systematically. We propose Failure-Driven Prompt Refinement (FDPR), a methodology that analyzes recurring model failures to guide evidence-based prompt refinement. Using the Damn Vulnerable Java Application (DVJA), we identify recurring failure modes, including false positives, false negatives, unsupported reasoning, and CWE misclassification, and translate them into targeted prompt refinements. We then evaluate the resulting prompt on the Juliet Test Suite and perform cross-model validation to assess generalizability. The results show that failure-driven refinement improves the reliability of LLM-based vulnerability analysis while yielding reusable prompt design principles. More broadly, this work demonstrates that recurring model failures provide a principled foundation for prompt engineering, enabling the systematic development of more reliable LLM-based vulnerability analysis systems.

Keywords

Subject

Publication details

Journal
Not available
Open access
Green open access

Cite this article

APA 7

Ghadamian, M., & Mohaisen, D. (2026). Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis. https://omanscience.com/en/articles/learning-from-failures-a-failure-driven-prompt-refinement-for-llm-based-vulnerability-analysis

MLA 9

Ghadamian, Mandana, and David Mohaisen. "Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis." https://omanscience.com/en/articles/learning-from-failures-a-failure-driven-prompt-refinement-for-llm-based-vulnerability-analysis.

Chicago (author–date)

Ghadamian, Mandana, and David Mohaisen. 2026. "Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis." https://omanscience.com/en/articles/learning-from-failures-a-failure-driven-prompt-refinement-for-llm-based-vulnerability-analysis.

Harvard

Ghadamian, M. and Mohaisen, D. (2026) 'Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis', Available at: https://omanscience.com/en/articles/learning-from-failures-a-failure-driven-prompt-refinement-for-llm-based-vulnerability-analysis.

Vancouver

Ghadamian M, Mohaisen D. Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis. https://omanscience.com/en/articles/learning-from-failures-a-failure-driven-prompt-refinement-for-llm-based-vulnerability-analysis

IEEE

M. Ghadamian, and D. Mohaisen, "Learning from Failures: A Failure-Driven Prompt Refinement for LLM-Based Vulnerability Analysis," https://omanscience.com/en/articles/learning-from-failures-a-failure-driven-prompt-refinement-for-llm-based-vulnerability-analysis.