7.3. TUTORIAL¶
This section describes Floating Point Model Preparation, Operator Fusion, Set up Different BPU Architectures, Heterogeneous model QAT, FX based quantization, Building Quantization-friendly Floating-point Models, QAT Experience Summary, Model Precision Debug Tool, and Ideas of Quantization Precision Debug.
- 7.3.1. Floating Point Model Preparation
- 7.3.2. Operator Fusion
- 7.3.3. Set Up Different BPU Architectures
- 7.3.4. Heterogeneous Model QAT
- 7.3.5. FX Based Quantization
- 7.3.6. Building Quantization-friendly Floating-point Models
- 7.3.7. QAT Experience Summary
- 7.3.8. Model Precision Debug Tool
- 7.3.8.1. Similarity
- 7.3.8.2. Visualization
- 7.3.8.3. Statistics
- 7.3.8.4. Step Quantization
- 7.3.8.5. Shared OP Check
- 7.3.8.6. Fuse Check
- 7.3.8.7. Single-operator Conversion Precision Debugging
- 7.3.8.8. Quantitative Configuration Check
- 7.3.8.9. Model Weight Comparison
- 7.3.8.10. Deploy Device Check of Hybrid Models
- 7.3.8.11. Integrated Interface
- 7.3.8.12. GPU Memory Profiler
- 7.3.9. Ideas of Quantization Precision Debug