FP8 / low-precision
63 papers in this thread, across 19 domains.
Progress0 of 44
- 2026Decomposing Runtime, Kernel, and Quantization Speedups via a Matched FP16 Intermediate: A Hardware-Conditioned Case Study on Four NVIDIA RTX A5000 GPUsno summary yetcs dc2607.11368UW0 citesJul 13, 2026cs dc
- 2026LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video GenerationArchitecture2605.18739NVIDIAMay 18, 2026~131 minArchitecture
- 2026OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache QuantizationInference Optimization2605.17757TogetherMay 18, 2026~114 minInference Optimization
- 2026FP4 Explore, BF16 Train: Diffusion Reinforcement Learning via Efficient Rollout ScalingTraining Methods2604.06916NVIDIAApr 8, 2026~116 minTraining Methods
- 2026MASQuant: Modality-Aware Smoothing Quantization for Multimodal Large Language ModelsMultimodal2603.04800alibaba-incMar 5, 2026score 9~125 minMultimodal
- 2026FP8-RL: A Practical and Stable Low-Precision Stack for LLM Reinforcement LearningLow Precision2601.18150NVIDIAJan 26, 2026score 9~102 minLow Precision
- 2026Jet-RL: Enabling On-Policy FP8 Reinforcement Learning with Unified Training and Rollout Precision FlowRL Training2601.14243NVIDIAJan 20, 2026score 9~104 minRL Training
- 2026Quartet II: Accurate LLM Pre-Training in NVFP4 by Improved Unbiased Gradient EstimationTraining Methods2601.22813NVIDIAJan 30, 2026score 9~112 minTraining Methods
- 2025Four Over Six: More Accurate NVFP4 Quantization with Adaptive Block ScalingInference Optimization2512.02010Dec 1, 2025~116 minInference Optimization
- 2025WUSH: Near-Optimal Adaptive Transforms for LLM QuantizationAlignment2512.00956 IST Austria Distributed Algorithms and Systems LabNov 30, 2025score 9~117 minAlignment
- 2025Kitty: Accurate and Efficient 2-bit KV Cache Quantization with Dynamic Channel-wise Precision BoostLLM Systems2511.18643Together AINov 23, 2025~108 minLLM Systems
- 2025FP8-Flow-MoE: A Casting-Free FP8 Recipe without Double Quantization ErrorTraining Methods2511.02302Nov 4, 2025~122 minTraining Methods
- 2025INT v.s. FP: A Comprehensive Study of Fine-Grained Low-bit Quantization FormatsInference Optimization2510.25602NVIDIAOct 29, 2025score 10~113 minInference Optimization
- 2025QeRL: Beyond Efficiency -- Quantization-enhanced Reinforcement Learning for LLMsRL Training2510.11696NVIDIAOct 13, 2025score 10~124 minRL Training
- 2025Bridging the Gap Between Promise and Performance for Microscaling FP4 QuantizationInference Optimization2509.23202NVIDIASep 27, 2025score 9~99 minInference Optimization
- 2025Pretraining Large Language Models with NVFP4Pretraining2509.25149Sep 29, 2025~126 minPretraining
- 2025The Geometry of LLM Quantization: GPTQ as Babai's Nearest Plane AlgorithmLLM Systems2507.18553 IST Austria Distributed Algorithms and Systems LabJul 24, 2025score 9~149 minLLM Systems
- 2025EfficientLLM: Efficiency in Large Language ModelsEvaluation2505.13840May 20, 2025score 10~104 minEvaluation
- 2025SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit TrainingInference Optimization2505.11594May 16, 2025score 10~110 minInference Optimization
- 2025An Empirical Study of Qwen3 QuantizationLow Precision2505.02214May 4, 2025score 9~89 minLow Precision
- 2025Quartet: Native FP4 Training Can Be Optimal for Large Language ModelsTraining Methods2505.14669NVIDIAMay 20, 2025score 9~124 minTraining Methods
- 2025Quantization for OpenAI's Whisper Models: A Comparative AnalysisInference Optimization2503.09905OpenAIMar 12, 2025score 3~112 minInference Optimization
- 2025Matryoshka QuantizationTraining Methods2502.06786Feb 10, 2025score 9~112 minTraining Methods
- 2025Optimizing Large Language Model Training Using FP4 QuantizationTraining Methods2501.17116Jan 28, 2025score 9~107 minTraining Methods
- 2024"Give Me BF16 or Give Me Death"? Accuracy-Performance Trade-Offs in LLM QuantizationInference Optimization2411.02355DropboxNov 4, 2024score 10~118 minInference Optimization
- 2024SageAttention2 Technical Report: Accurate 4 Bit Attention for Plug-and-play Inference AccelerationInference Optimization2411.10958Nov 17, 2024score 9~109 minInference Optimization
- 2024PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models QuantizationInference Optimization2410.05265Oct 7, 2024score 9~117 minInference Optimization
- 2024VPTQ: Extreme Low-bit Vector Post-Training Quantization for Large Language ModelsLow Precision2409.17066Sep 25, 2024score 9~107 minLow Precision
- 2023ZeroQuant(4+2): Redefining LLMs Quantization with a New FP6-Centric Strategy for Diverse Generative TasksLow Precision2312.08583Dec 14, 2023score 9~123 minLow Precision
- 2023MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantizationno summary yetcs lg2311.06798Google Research0 citesNov 12, 2023cs lg
- 2023LLM-FP4: 4-Bit Floating-Point Quantized TransformersInference Optimization2310.16836Oct 25, 2023score 9~104 minInference Optimization
- 2023LoftQ: LoRA-Fine-Tuning-Aware Quantization for Large Language ModelsTraining Methods2310.08659Oct 12, 2023score 9~110 minTraining Methods
- 2023FP8-LM: Training FP8 Large Language ModelsTraining Methods2310.18313Oct 27, 2023~108 minTraining Methods
- 2023Efficient Post-training Quantization with FP8 FormatsInference Optimization2309.14592Sep 26, 2023score 9~126 minInference Optimization
- 2023FLIQS: One-Shot Mixed-Precision Floating-Point and Integer Quantization SearchInference Optimization2308.03290Aug 7, 2023score 8~119 minInference Optimization
- 2023OmniQuant: Omnidirectionally Calibrated Quantization for Large Language ModelsInference Optimization2308.13137Aug 25, 2023score 9~100 minInference Optimization
- 2023AWQ: Activation-Aware Weight Quantization for On-Device LLM Compression and AccelerationInference Optimization2306.00978Microsoft ResearchJun 1, 2023~110 minInference Optimization
- 2023SqueezeLLM: Dense-and-Sparse QuantizationInference Optimization2306.07629Jun 13, 2023~109 minInference Optimization
- 2023Quantization-Aware and Tensor-Compressed Training of Transformers for Natural Language Understandingno summary yetcs cl2306.01076Amazon0 citesJun 1, 2023cs cl
- 2022SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language ModelsInference Optimization2211.10438Nov 18, 2022~96 minInference Optimization
- 2022LLM.int8(): 8-bit Matrix Multiplication for Transformers at ScaleInference Optimization2208.07339Aug 15, 2022~109 minInference Optimization
- 2022ZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale TransformersInference Optimization2206.01861Jun 4, 2022~92 minInference Optimization
- 2022Hybrid Contrastive Quantization for Efficient Cross-View Video Retrievalno summary yetcs ir2202.03384Tencent7 citesFeb 7, 2022cs ir
- 2021Low-bit Quantization of Recurrent Neural Network Language Models Using Alternating Direction Methods of Multipliersno summary yetcs lg2111.14836Microsoft Research0 citesNov 29, 2021cs lg
- 2021Continuous Control with Action Quantization from Demonstrationsno summary yetcs lg2110.10149Google Research2 citesOct 19, 2021cs lg
- 2021Quantization Algorithms for Random Fourier Featuresno summary yetstat ml2102.13079Baidu1 citesFeb 25, 2021stat ml
- 2020BinaryBERT: Pushing the Limit of BERT QuantizationLow Precision2012.15701Dec 31, 2020~104 minLow Precision
- 2020Quantization Guided JPEG Artifact Correctionno summary yeteess iv2004.09320Meta / FAIR1 citesApr 17, 2020eess iv
- 2020Least squares binary quantization of neural networksno summary yetcs lg2001.02786Apple1 citesJan 9, 2020cs lg
- 2019Q-BERT: Hessian Based Ultra Low Precision Quantization of BERTInference Optimization1909.05840Sep 12, 2019~112 minInference Optimization
- 2019Central Similarity Quantization for Efficient Image and Video Retrievalno summary yetcs cv1908.00347Tencent19 citesAug 1, 2019cs cv
- 2019Differentiable Product Quantization for End-to-End Embedding Compressionno summary yetcs lg1908.09756Google Research14 citesAug 26, 2019cs lg
- 2019Accelerating Large-Scale Inference with Anisotropic Vector Quantizationno summary yetcs lg1908.10396Google Research111 citesAug 27, 2019cs lg
- 2019Push for Quantization: Deep Fisher Hashingno summary yetcs cv1909.00206Tencent2 citesAug 31, 2019cs cv
- 2019Qsparse-local-SGD: Distributed SGD with Quantization, Sparsification, and Local Computationsno summary yetstat ml1906.02367Amazon20 citesJun 6, 2019stat ml
- 2019HAWQ: Hessian Aware Quantization of Neural NetworksLow Precision1905.03696Apr 29, 2019~102 minLow Precision
- 2019Shared Predictive Cross-Modal Deep Quantizationno summary yetcs cv1904.07488Tencent0 citesApr 16, 2019cs cv
- 2018The Generalized Lasso for Sub-gaussian Measurements with Dithered Quantizationno summary yetcs it1807.06976Google Research11 citesJul 18, 2018cs it
- 2018LQ-Nets: Learned Quantization for Highly Accurate and Compact Deep Neural Networksno summary yetcs cv1807.10029Microsoft Research45 citesJul 26, 2018cs cv
- 2018Model compression via distillation and quantizationno summary yetcs ne1802.05668Google Research262 citesFeb 15, 2018cs ne
- 2017Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only InferenceLow Precision1712.05877200 citesDec 15, 2017~113 minLow Precision
- 2016QSGD: Communication-Efficient SGD via Gradient Quantization and Encodingno summary yetcs lg1610.02132Microsoft Research41 citesOct 7, 2016cs lg
- 2015Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman CodingInference Optimization1510.00149Oct 1, 2015~94 minInference Optimization