مع التوسع في استخدام التعلم الآلي في تحليل الطيف، تواجه نماذج التدريب تحديات مثل ندرة عينات البيانات وتوزيع الفئات غير المتوازن، مما يقيد أداء التعميم للنماذج ويزيد من مخاطر الإفراط في التكيّف. تستعرض هذه الورقة الأدبيات المفتوحة محليًا وعالميًا منذ عام 2017، وتقسم طرق تعزيز بيانات الطيف إلى فئتين رئيسيتين: طرق تعزيز البيانات غير العميقة وطرق تعزيز البيانات العميقة، وتكشف عن الاتجاه التطوري من توسيع البيانات السطحية إلى النمذجة التوليدية العميقة. تعتمد طرق تعزيز البيانات غير العميقة على تحويل الطيف وتركيب الطيف لتحقيق توسيع البيانات، وبفضل كفاءتها الحسابية، تظهر هذه الطرق ملاءمة جيدة في سيناريوهات عينات صغيرة مثل مراقبة العمليات الصناعية وتتبع الأعشاب الطبية وفحص جودة الأدوية والأغذية. النماذج التوليدية العميقة هي أساسًا شبكات الخصومة التوليدية (GAN) وطرقها المشتقة والمشفرات الذاتية المحسنة (AE). تقوم GAN بإنشاء عينات معززة ذات تشابه هيكلي وتوزيع متسق مع البيانات الأصلية عبر آلية التنافس، وتستخدم على نطاق واسع في مشاهد النمذجة عالية الدقة مثل تشخيص الصور الطبية والزراعة الدقيقة وتصنيف المواد؛ بينما تستخدم المشفرات الذاتية المحسنة تعلم تمثيل الفضاء الكامن لالتقاط الخصائص الجوهرية للبيانات، وحافظت البيانات المولدة على خصائص التوزيع الأصلي بالإضافة إلى متانة الخصائص، مما يعطي أفضلية في مهام معالجة البيانات عالية الأبعاد مثل تحديد المواد الكيميائية واختبار مكونات التربة. وتشير هذه المراجعة إلى قيود الطرق الحالية لتعزيز البيانات وتناقش اتجاهات التطوير المستقبلية.