AI VE VectorWorks Academy Quantization in Large Language Models: Balancing Efficiency and Accuracy Introduction