arXiv CS AI
techLeft
Reasoning-Aware Compression: Identifying and Protecting Vulnerable Reasoning Circuits for Energy-Efficient LLM Deploymenttranslating…
arXiv:2609.05512v1 Announce Type: new
Abstract: Large Reasoning Models (LRMs) impose substantial energy costs during deployment, yet current compression methods apply uniform quantization across all components, risking damage to critical reasoning circuits. We present a…
Keywords#Reasoning#Reasoning Circuits#Compression#Deployment#Energy-Efficient