kirancodes.me
To Proof Maintenance & Beyond!
Venues / CGO /

CGO 2026

56 papers

  1. A Reinforcement Learning Environment for Automatic Code Optimization in the MLIR Compiler · Mohammed Tirichine, Nassim Ameur, Nazim Bendib, Iheb Nassim Aouadj, Djad Bouchama, Rafik Bouloudene + 1 more
  2. Accelerating App Recompilation across Android System Updates by Code Reusing · Hongtao Wu, Yu Chen, Mengfei Xie, Futeng Yang, Jun Yan, Jiang Ma + 3 more
  3. Automatic Data Enumeration for Fast Collections · Tommy McMichen, Simone Campanoni
  4. BIT: Empowering Binary Analysis through the LLVM Toolchain · Puzhuo Liu, Peng Di, Jingling Xue, Yu Jiang
  5. Binary Diffing via Library Signatures · Andrei Rimsa, Anderson Faustino da Silva, Camilo Santana, Fernando Magno Quintão Pereira
  6. Compilation of Generalized Matrix Chains with Symbolic Sizes · Francisco López, Lars Karlsson, Paolo Bientinesi
  7. Compiler-Assisted Instruction Fusion · Ravikiran Ravindranath Reddy, Sawan Singh, Arthur Perais, Alberto Ros, Alexandra Jimborean
  8. Compiler-Runtime Co-operative Chain of Verification for LLM-Based Code Optimization · Hyunho Kwon, Sanggyu Shin, Ju Min Lee, Hoyun Youm, Seungbin Song, Seongho Kim + 3 more
  9. Dependence-Driven, Scalable Quantum Circuit Mapping with Affine Abstractions · Marouane Benbetka, Merwan Bekkar, Riyadh Baghdadi, Martin Kong
  10. Dr.avx: A Dynamic Compilation System for Seamlessly Executing Hardware-Unsupported Vectorization Instructions · Yue Tang, Mianzhi Wu, Yufeng Li, Haoyu Liao, Jianmei Guo, Bo Huang
  11. DyPARS: Dynamic-Shape DNN Optimization via Pareto-Aware MCTS for Graph Variants · Hao Qian, Guangli Li, Qiuchu Yu, Xueying Wang, Jingling Xue
  12. Eliminating Redundancy: Ultra-compact Code Generation for Programmable Dataflow Accelerators · Prasanth Chatarasi, Alex Gatea, Bardia Mahjour, Jintao Zhang, Alberto Mannari, Chris Bowler + 6 more
  13. Ember: A Compiler for Embedding Operations on Decoupled Access-Execute Architectures · Marco Siracusa, Olivia Hsu, Víctor Soria Pardos, Joshua Randall, Arnaud Grasset, Eric Biscondi + 5 more
  14. Enabling Automatic Compiler-Driven Vectorization of Transformers · Shreya Alladi, Alberto Ros, Alexandra Jimborean
  15. Enabling Spill-Free Compilation via Affine-Based Live Range Reduction Optimization · Prasanth Chatarasi, Alex Gatea, Wei Wang, Chris Bowler, Shubham Jain, Masoud Ataei Jaliseh + 5 more
  16. FHEFusion: Enabling Operator Fusion in FHE Compilers for Depth-Efficient DNN Inference · Tianxiang Sui, Jianxin Lai, Long Li, Peng Yuan, Yan Liu, Qing Zhu + 4 more
  17. FORTE: Online DataFrame Query Optimizer · Yoonho Choi, Kyoungtae Lee, Minji Kim, Hyungsoo Jung, Hyojin Sung
  18. FRUGAL: Pushing GPU Applications beyond Memory Limits · Lingqi Zhang, Tengfei Wang, Jiajun Huang, Chen Zhuang, Ivan R. Ivanov, Peng Chen + 2 more
  19. Fast Autoscheduling for Sparse ML Frameworks · Bobby Yan, Alexander J. Root, Trevor Gale, David Broman, Fredrik Kjolstad
  20. Flow-Graph-Aware Tiling and Rescheduling for Memory-Efficient On-Device Inference · Yeonoh Jeong, Taehyeong Park, Yongjun Park
  21. From Threads to Tiles: T2T, a Compiler for CUDA-to-NPU Translation via 2D Vectorization · Shuaijiang Li, Jiacheng Zhao, Ying Liu, Shuoming Zhang, Lei Chen, Yijin Li + 8 more
  22. GRANII: Selection and Ordering of Primitives in GRAph Neural Networks using Input Inspection · Damitha Lenadora, Vimarsh Sathia, Gerasimos Gerogiannis, Serif Yesil, Josep Torrellas, Charith Mendis
  23. Hexcute: A Compiler Framework for Automating Layout Synthesis in GPU Programs · Xiao Zhang, Yaoyao Ding, Bolin Sun, Yang Hu, Tatiana Shpeisman, Gennady Pekhimenko
  24. LEGO: A Layout Expression Language for Code Generation of Hierarchical Mapping · Amir Mohammad Tavakkoli, Cosmin E. Oancea, Mary W. Hall
  25. LLM-VeriOpt: Verification-Guided Reinforcement Learning for LLM-Based Compiler Optimization · Xiangxin Fang, Jiaqin Kang, Rodrigo Rocha, Sam Ainsworth, Lev Mukhanov
  26. Multidirectional Propagation of Sparsity Information across Tensor Slices · Kaio Henrique Andrade Ananias, Danila Seliayeu, José Nelson Amaral, Fernando Magno Quintão Pereira
  27. On the Precision of Dynamic Program Fingerprints Based on Performance Counters · Anderson Faustino Da Silva, Marcelo Borges Nogueira, Sérgio Queiroz de Medeiros, Jerónimo Castrillón, Fernando Magno Quintão Pereira
  28. OpenQudit: Extensible and Accelerated Numerical Quantum Compilation via a JIT-Compiled DSL · Ed Younis
  29. PASTA: A Modular Program Analysis Tool Framework for Accelerators · Mao Lin, Hyeran Jeon, Keren Zhou
  30. PIP: Making Andersen's Points-to Analysis Sound and Practical for Incomplete C Programs · Håvard Rognebakke Krogstie, Helge Bahmann, Magnus Själander, Nico Reissmann
  31. Partial-Evaluation Templates: Accelerating Partial Evaluation with Pre-compiled Templates · Florian Huemer, Aleksandar Prokopec, David Leopoldseder, Raphael Mosaner, Hanspeter Mössenböck
  32. PolyUFC: Polyhedral Compilation Meets Roofline Analysis for Uncore Frequency Capping · Nilesh Rajendra Shah, M. V. V. S. Manoj Kumar, Dhairya Baxi, Ramakrishna Upadrasta
  33. Practical: Are Abstract-Interpreter Baseline JITs Worth It? An Empirical Evaluation through Metacompilation · Nahuel Palumbo, Guillermo Polito, Stéphane Ducasse, Pablo Tesone
  34. PriTran: Privacy-Preserving Inference for Transformer-Based Language Models under Fully Homomorphic Encryption · Yuechen Mu, Guangli Li, Shiping Chen, Jingling Xue
  35. Progressive Low-Precision Approximation of Tensor Operators on GPUs: Enabling Greater Trade-Offs between Performance and Accuracy · Fan Luo, Guangli Li, Zhaoyang Hao, Xueying Wang, Xiaobing Feng, Huimin Cui + 1 more
  36. Proton: Towards Multi-level, Adaptive Profiling for Triton · Keren Zhou, Tianle Zhong, Hao Wu, Jihyeong Lee, Yue Guan, Yufei Ding + 4 more
  37. Pushing Tensor Accelerators beyond MatMul in a User-Schedulable Language · Yihong Zhang, Derek K. Gerstmann, Andrew Adams, Maaz Bin Safeer Ahmad
  38. Pyls: Enabling Python Hardware Synthesis with Dynamic Polymorphism via LCRS Encoding · Bolei Tong, Yongyan Fang, Chaorui Wang, Qingan Li, Jingling Xue, Mengting Yuan
  39. QIGen: A Kernel Generator for Inference on Nonuniformly Quantized Large Language Models · Tommaso Pegolotti, Dan Alistarh, Markus Püschel
  40. SecSwift, a Compiler-Based Framework for Software Countermeasures in Cybersecurity · François de Ferrière, Yves Janin, Sirine Mechmech
  41. Selene: Cross-Level Barrier-Free Pipelining for Irregular Nested Loops in High-Level Synthesis · Sungwoo Yun, Seonyoung Cheon, Dongkwan Kim, Heelim Choi, Kunmo Jeong, Chan Lee + 2 more
  42. SkeleShare: Algorithmic Skeletons and Equality Saturation for Hardware Resource Sharing · Jonathan Van der Cruysse, Tzung-Han Juang, Shakiba Bolbolian Khah, Christophe Dubach
  43. Space-Time Optimisations for Early Fault-Tolerant Quantum Computation · Sanaa Sharma, Prakash Murali
  44. SparseX: Synergizing GPU Libraries for Sparse Matrix Multiplication on Heterogeneous Processors · Ruifeng Zhang, Xiangwei Wang, Ang Li, Xipeng Shen
  45. Synthesizing Instruction Selection Back-Ends from ISA Specifications Made Practical · Florian Drescher, Alexis Engelke
  46. Synthesizing Specialized Sparse Tensor Accelerators for FPGAs via High-Level Functional Abstractions · Hamza Javed, Christophe Dubach
  47. TPDE: A Fast Adaptable Compiler Back-End Framework · Tobias Schwarz, Tobias Kamm, Alexis Engelke
  48. TRACE4J: A Lightweight, Flexible, and Insightful Performance Tracing Tool for Java · Haide He, Pengfei Su
  49. Tawa: Automatic Warp Specialization for Modern GPUs with Asynchronous References · Hongzheng Chen, Bin Fan, Alexander Collins, Bastian Hagedorn, Evghenii Gaburov, Masahiro Masuda + 5 more
  50. Tensor Program Superoptimization through Cost-Guided Symbolic Program Synthesis · Alexander Brauckmann, Aarsh Chaube, José Wesley de S. Magalhães, Elizabeth Polgreen, Michael F. P. O'Boyle
  51. The Parallel-Semantics Program Dependence Graph for Parallel Optimization · Yian Su, Brian Homerding, Haocheng Gao, Federico Sossai, Yebin Chon, David I. August + 1 more
  52. Thinking Fast and Correct: Automated Rewriting of Numerical Code through Compiler Augmentation · Siyuan Brant Qian, Vimarsh Sathia, Ivan R. Ivanov, Jan Hückelheim, Paul D. Hovland, William S. Moses
  53. Towards Path-Aware Coverage-Guided Fuzzing · Giacomo Priamo, Daniele Cono D'Elia, Mathias Payer, Leonardo Querzoni
  54. Towards Threading the Needle of Debuggable Optimized Binaries · Cristian Assaiante, Simone Di Biasio, Snehasish Kumar, Giuseppe Antonio Di Luna, Daniele Cono D'Elia, Leonardo Querzoni
  55. Unlocking Python Multithreading Capabilities using OpenMP-Based Programming with OMP4Py · César Piñeiro, Juan Carlos Pichel
  56. VFlatten: Selective Value-Object Flattening using Hybrid Static and Dynamic Analysis · Arjun H. Kumar, Bhavya Hirani, Hang Shao, Tobi Ajila, Vijay Sundaresan, Daryl Maier + 1 more