Leveraging a corpus of natural language descriptions for program similarity
Abstract
Program similarity is a central challenge in many programming-related applications, such as code search, clone detection, automatic translation, and programming education.