Skip to main contentVenues / CGO / CGO 2022
27 papers
- A Compiler Framework for Optimizing Dynamic Parallelism on GPUs · Mhd Ghaith Olabi, Juan Gómez-Luna, Onur Mutlu, Wen-Mei Hwu, Izzat El Hajj
- A Compiler for Sound Floating-Point Computations using Affine Arithmetic · Joao Rivera, Franz Franchetti, Markus Püschel
- Aggregate Update Problem for Multi-clocked Dataflow Languages · Hannes Kallwies, Martin Leucker, Torben Scheffel, Malte Schmitz, Daniel Thoma
- Automatic Generation of Debug Headers through BlackBox Equivalence Checking · Vaibhav Kiran Kurhe, Pratik Karia, Shubhani Gupta, Abhishek Rose, Sorav Bansal
- Automatic Horizontal Fusion for GPU Kernels · Ao Li, Bojian Zheng, Gennady Pekhimenko, Fan Long
- CompilerGym: Robust, Performant Compiler Optimization Environments for AI Research · Chris Cummins, Bram Wasti, Jiadong Guo, Brandon Cui, Jason Ansel, Sahir Gomez + 6 more
- Comprehensive Accelerator-Dataflow Co-design Optimization for Convolutional Neural Networks · Miheer Vaidya, Aravind Sukumaran-Rajam, Atanas Rountev, P. Sadayappan
- DARM: Control-Flow Melding for SIMT Thread Divergence Reduction · Charitha Saumya, Kirshanthan Sundararajah, Milind Kulkarni
- Distill: Domain-Specific Compilation for Cognitive Models · Ján Veselý, Raghavendra Pradyumna Pothukuchi, Ketaki Joshi, Samyak Gupta, Jonathan D. Cohen, Abhishek Bhattacharjee
- Efficient Execution of OpenMP on GPUs · Joseph Huber, Melanie Cornelius, Giorgis Georgakoudis, Shilei Tian, Jose Manuel Monsalve Diaz, Kuter Dinel + 2 more
- Enabling Near Real-Time NLU-Driven Natural Language Programming through Dynamic Grammar Graph-Based Translation · Zifan Nan, Xipeng Shen, Hui Guan
- F3M: Fast Focused Function Merging · Sean Stirling, Rodrigo C. O. Rocha, Kim M. Hazelwood, Hugh Leather, Michael F. P. O'Boyle, Pavlos Petoumenos
- Gadgets Splicing: Dynamic Binary Transformation for Precise Rewriting · Linan Tian, Yangyang Shi, Liwei Chen, Yanqi Yang, Gang Shi
- GraphIt to CUDA Compiler in 2021 LOC: A Case for High-Performance DSL Implementation via Staging with BuilDSL · Ajay Brahmakshatriya, Saman P. Amarasinghe
- HECATE: Performance-Aware Scale Optimization for Homomorphic Encryption Compiler · Yongwoo Lee, Seonyeong Heo, Seonyoung Cheon, Shinnung Jeong, Changsu Kim, Eunkyung Kim + 2 more
- Lambda the Ultimate SSA: Optimizing Functional Programs in SSA · Siddharth Bhat, Tobias Grosser
- Loop Rolling for Code Size Reduction · Rodrigo C. O. Rocha, Pavlos Petoumenos, Björn Franke, Pramod Bhatotia, Michael F. P. O'Boyle
- M3V: Multi-modal Multi-view Context Embedding for Repair Operator Prediction · Xuezheng Xu, Xudong Wang, Jingling Xue
- NOELLE Offers Empowering LLVM Extensions · Angelo Matni, Enrico Armenio Deiana, Yian Su, Lukas Gross, Souradip Ghosh, Sotiris Apostolakis + 7 more
- Optimizing GPU Deep Learning Operators with Polyhedral Scheduling Constraint Injection · Cédric Bastoul, Zhen Zhang, Harenome Razanajato, Nelson Lossing, Adilla Susungi, Javier de Juan + 4 more
- PALMED: Throughput Characterization for Superscalar Architectures · Nicolas Derumigny, Théophile Bastian, Fabian Gruber, Guillaume Iooss, Christophe Guillon, Louis-Noël Pouchet + 1 more
- Recovering Container Class Types in C++ Binaries · Xudong Wang, Xuezheng Xu, Qingan Li, Mengting Yuan, Jingling Xue
- SPNC: An Open-Source MLIR-Based Compiler for Fast Sum-Product Network Inference on CPUs and GPUs · Lukas Sommer, Cristian Axenie, Andreas Koch
- SRTuner: Effective Compiler Optimization Customization by Exposing Synergistic Relations · Sunghyun Park, Salar Latifi, Yongjun Park, Armand Behroozi, Byungsoo Jeon, Scott A. Mahlke
- Solving PBQP-Based Register Allocation using Deep Reinforcement Learning · Minsu Kim, Jeong-Keun Park, Soo-Mook Moon
- Sound, Precise, and Fast Abstract Interpretation with Tristate Numbers · Harishankar Vishwanathan, Matan Shachnai, Srinivas Narayana, Santosh Nagarakatte
- Unified Compilation for Lossless Compression and Sparse Computing · Daniel Donenfeld, Stephen Chou, Saman P. Amarasinghe