Publicación:
Segmentación multimodal y fusión de clasificadores para la detección de sexismo en TikTok

dc.contributor.authorFernández García, David
dc.contributor.directorCardeñoso Payo, Valentín
dc.contributor.directorAmigo Cabrera, Enrique
dc.date.accessioned2026-01-28T17:57:51Z
dc.date.available2026-01-28T17:57:51Z
dc.date.issued2025-09-29
dc.description.abstractEste Trabajo de Fin de Máster aborda la detección automática de sexismo en vídeos de TikTok dentro del marco EXIST 2025. Partimos de la hipótesis de que el sexismo puede manifestarse en diferentes señales—texto, audio e imagen—y proponemos un enfoque segmental que descompone cada vídeo en canales especializados para su análisis independiente y posterior integración tardía. En el canal textual consideramos tres fuentes complementarias: el texto original del dataset, transcripciones y texto embebido en los videos, mientras que el audio y el vídeo se tratan como fuentes únicas. La combinación se estudia en dos regímenes: HARD (decisiones discretas) y SOFT (salidas probabilísticas), utilizando votación mayoritaria, OIE (One is Enough), Borda y OIQ para el primero, y agregadores básicos (media, max, min...), regresión logística y suma ponderada para el segundo. La evaluación sigue el marco informacional de ICM (Hard/Soft, normalizado), junto con métricas tradicionales como F1 y Cross-Entropy, permitiendo analizar tanto exactitud final como calidad de distribuciones. Los resultados muestran una contribución dominante del canal textual—especialmente cuando se emplea el texto original del dataset—, mientras que el audio y el vídeo aportan mejoras moderadas bajo fusión. En la evaluación oficial de EXIST 2025 (Task 7), nuestros sistemas se situaron 1.º, 3.º y 7.º sobre 41 envíos en HARD, y 15.º, 17.º y 18.º sobre 35 en SOFT, confirmando la eficacia del enfoque segmental y de los mecanismos de fusión empleados. Discutimos las implicaciones metodológicas, las limitaciones prácticas (coste computacional de audio/vídeo) y la necesidad de mejorar la robustez multimodal.es
dc.description.abstractThis Master’s Thesis addresses automatic sexism detection in TikTok videos within the EXIST 2025 framework. We start from the hypothesis that sexism can manifest across heterogeneous signals—text, audio, and image—and propose a segmental approach that decomposes each video into specialized channels for independent analysis followed by late integration. In the textual channel, we consider three complementary sources: the dataset’s original text, transcripts, and text embedded in the videos, while audio and video are treated as single-source modalities. We study combination under two regimes: HARD (discrete decisions) and SOFT (probabilistic outputs), using Majority Voting, OIE (One Is Enough), Borda, and OIQ for the former, and basic aggregators (mean, max, min), logistic regression, and weighted sum for the latter. Evaluation follows the information-theoretic ICM framework (Hard/Soft, normalized), together with standard metrics such as F1 and cross-entropy, enabling analysis of both final accuracy and distributional quality. Results show a dominant contribution from the textual channel—especially when using the dataset’s original text—while audio and video provide moderate gains under fusion. In the official EXIST 2025 evaluation (Task 7), our systems ranked 1st, 3rd, and 7th out of 41 submissions in HARD, and 15th, 17th, and 18th out of 35 in SOFT, confirming the effectiveness of the segmental approach and the employed fusion mechanisms. We discuss methodological implications, practical limitations (computational cost of audio/video), and the need to improve multimodal robustness.en
dc.description.provenanceMade available in DSpace on 2026-01-28T17:57:51Z (GMT). No. of bitstreams: 1 Segmentación multimodal y fusión de clasificadores para la detección de sexismo en TikTok. David Fernádez García.pdf: 4540998 bytes, checksum: c162a44a7292c381934f14f0321e4d4c (MD5) Previous issue date: 2025-09-23en
dc.identifier.citationFernández García, David. Trabajo de fin Máster: "Segmentación multimodal y fusión de clasificadores para la detección de sexismo en TikTok". Universidad Nacional de Educación a Distancia (UNED), 2025
dc.identifier.urihttps://hdl.handle.net/20.500.14468/31625
dc.language.isoes
dc.relation.centerE.T.S. de Ingeniería Informática
dc.relation.degreeMáster Universitario en Tecnologías del Lenguaje
dc.relation.departmentLenguajes y Sistemas Informáticos
dc.rightsinfo:eu-repo/semantics/openAccess
dc.rights.urihttp://creativecommons.org/licenses/by-nc-nd/4.0/deed.es
dc.subject1209.03 Análisis de datos
dc.subject.keywordsSexismoes
dc.subject.keywordsTikTok,es
dc.subject.keywordsClasificación multimodales
dc.subject.keywordsSegmentaciónes
dc.subject.keywordsFusión de clasificadoreses
dc.subject.keywordsICMes
dc.subject.keywordsEXIST 2025es
dc.subject.keywordsSexismen
dc.subject.keywordsTikTok,en
dc.subject.keywordsMultimodal classificationen
dc.subject.keywordsSegmentationen
dc.subject.keywordsClassifier fusionen
dc.subject.keywordsICMen
dc.subject.keywordsEXIST 2025en
dc.titleSegmentación multimodal y fusión de clasificadores para la detección de sexismo en TikTokes
dc.typetesis de maestríaes
dc.typemaster thesisen
dspace.entity.typePublication
relation.isDirectorOfPublicationf96c6e59-3a7a-4b0c-9b10-deec22f8c06b
relation.isDirectorOfPublication.latestForDiscoveryf96c6e59-3a7a-4b0c-9b10-deec22f8c06b
Archivos
Bloque original
Mostrando 1 - 1 de 1
Cargando...
Miniatura
Nombre:
Segmentación multimodal y fusión de clasificadores para la detección de sexismo en TikTok. David Fernádez García.pdf
Tamaño:
4.33 MB
Formato:
Adobe Portable Document Format
Bloque de licencias
Mostrando 1 - 1 de 1
No hay miniatura disponible
Nombre:
license.txt
Tamaño:
3.62 KB
Formato:
Item-specific license agreed to upon submission
Descripción: