PENGENALAN RASA SAKIT MELALUI EKSPRESI WAJAH BERBASIS DEEP LEARNING MENGGUNAKAN FUSION FITUR CITRA VISUAL DAN TERMAL | ELECTRONIC THESES AND DISSERTATION

Electronic Theses and Dissertation

Universitas Syiah Kuala

    DISSERTATION

PENGENALAN RASA SAKIT MELALUI EKSPRESI WAJAH BERBASIS DEEP LEARNING MENGGUNAKAN FUSION FITUR CITRA VISUAL DAN TERMAL


Pengarang

Raihan Islamadina - Personal Name;

Dosen Pembimbing

Fitri Arnia - 197311121999032001 - Dosen Pembimbing I
Taufik Fuadi Abidin - 197010081994031002 - Dosen Pembimbing I
Rusdha Muharar - 197804182006041003 - Dosen Pembimbing I



Nomor Pokok Mahasiswa

1909300060024

Fakultas & Prodi

Fakultas Pasca Sarjana / Program Doktor Ilmu Teknik (S3) / PDDIKTI : 20003

Subject
-
Kata Kunci
-
Penerbit

Banda Aceh : Program Studi Doktor Ilmu Teknik Universitas Syiah Kuala., 2026

Bahasa

No Classification

-

Literature Searching Service

Hard copy atau foto copy dari buku ini dapat diberikan dengan syarat ketentuan berlaku, jika berminat, silahkan hubungi via telegram (Chat Services LSS)

Rasa sakit (pain) biasanya dinilai berdasarkan laporan dari pasien sendiri. Namun, rasa sakit yang dilaporkan sendiri sulit untuk ditafsirkan dan mungkin cacat/tidak sesuai dalam beberapa keadaan (misalnya, anak-anak kecil, lansia dengan gangguan kognitif, dan orang yang sakit parah) yang tidak memungkinkan untuk berkomunikasi. Untuk menghindari masalah ini, para peneliti telah mengidentifikasi ekspresi wajah sebagai indikator yang andal dan valid dalam merepresentasikan rasa sakit menggunakan perkembangan teknologi deep learning.
Sebagian besar penelitian sebelumnya hanya memanfaatkan citra visual, pendekatan tersebut belum sepenuhnya mampu menangkap informasi fisiologis yang mendasari perubahan ekspresi. Citra termal menawarkan keunggulan tambahan karena dapat merekam distribusi suhu kulit yang dipengaruhi oleh kondisi fisiologis terhadap rasa sakit. Dengan demikian, integrasi kedua modalitas ini berpotensi menghasilkan representasi fitur yang lebih kaya dan akurat.
Penelitian ini berupa sistem pengenalan rasa sakit melalui ekspresi wajah menggunakan pendekatan multimodal dengan menggabungkan informasi dari fitur citra visual dan termal berbasis deep learning. Pendekatan yang diusulkan menerapkan strategi fusion fitur dengan memanfaatkan jaringan pretrained seperti VGGFace, ResNet50, dan DEYOLO, serta diperkuat dengan modul khusus, yaitu Dual Semantic Enhancing Channel Weight Assignment (DECA) dan Dual Spatial Enhancing Pixel Weight Assignment (DEPA) yang berfungsi untuk memperkuat representasi fitur melalui penekanan aspek semantik dan spasial. Sebagai pembanding, model hybrid baseline yang memproses citra visual dan termal secara terpisah juga dikembangkan untuk mengevaluasi perbedaan kinerja antara pendekatan fusion dan non-fusion. Eksperimen dilakukan pada dataset MintPain, serta divalidasi secara eksternal menggunakan dataset UNBC-McMaster yang hanya berisi citra visual.
Hasil menunjukkan bahwa model fusion berbasis VGGFace memberikan kinerja terbaik dengan F1-score sebesar 0,938 pada dataset MintPain. Selain itu, validasi eksternal pada dataset UNBC-McMaster menunjukkan akurasi sebesar 0,872 yang membuktikan kemampuan generalisasi yang kuat.

Pain is typically assessed based on self-reports from patients. However, self-reported pain can be difficult to interpret and may be flawed or unreliable in certain circumstances (e.g., young children, elderly individuals with cognitive impairments, and critically ill patients) where communication is not possible. To overcome this issue, researchers have identified facial expressions as a reliable and valid indicator for representing pain using advances in deep learning technology. Most previous studies have relied solely on visual images, an approach that has not fully succeeded in capturing the underlying physiological information behind expression changes. Thermal imaging offers an added advantage by recording skin temperature distribution, which is influenced by physiological responses to pain. Consequently, integrating these two modalities has the potential to produce richer and more accurate feature representations. This study proposes a facial expression-based pain recognition system using a multimodal approach that combines feature information from visual and thermal images using deep learning. The proposed approach applies a feature fusion strategy utilizing pretrained networks such as VGGFace, ResNet50, and DEYOLO, reinforced with specialized modules: Dual Semantic Enhancing Channel Weight Assignment (DECA) and Dual Spatial Enhancing Pixel Weight Assignment (DEPA), which function to enhance feature representations by emphasizing semantic and spatial aspects. For comparison, a baseline hybrid model that processes visual and thermal images separately was also developed to evaluate performance differences between fusion and non-fusion approaches. Experiments were conducted on the MintPain dataset and externally validated using the UNBC-McMaster dataset, which contains only visual images. The results show that the VGGFace-based fusion model achieves the best performance with an F1-score of 0.938 on the MintPain dataset. Additionally, external validation on the UNBC-McMaster dataset demonstrates an accuracy of 0.872, proving strong generalization capability.

Citation



    SERVICES DESK