$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Cuando dos o más idiomas se mezclan en una sola línea o voz, esto se denomina lenguaje de código mixto. Es común en diálogos casuales como Hinglish. Hay múltiples formas en que se pueden entender las emociones humanas, y modelar computacionalmente una serie de declaraciones emocionales es anotarlas por las personas que pronunciaron esas oraciones. Se puede entender en términos de niveles biológicos, fisiológicos, psicológicos, etc. Según científicos como Roger Penrose, muchos fenómenos en nuestro mundo no son computacionales, y científicos como Wolfram consideran que todo (cada fenómeno) se puede modelar computacionalmente1. Penrose cree que la conciencia involucra procesos (quizás relacionados con la mecánica cuántica dentro del cerebro) que van más allá de lo que puede lograr cualquier procedimiento algorítmico paso a paso. A menudo cita los teoremas de incompletitud de Gödel para apoyar la idea de que la visión matemática humana, por ejemplo, trasciende los sistemas formales2. Si la conciencia no es computacional, entonces las emociones, como un aspecto clave de la experiencia consciente, también pueden tener elementos no computacionales. Stephen Wolfram, conocido por Mathematica y su trabajo sobre autómatas celulares, propone el "Principio de equivalencia computacional". Esto sugiere que incluso los sistemas muy complejos, incluido potencialmente el universo mismo y los fenómenos dentro de él (como las emociones), pueden describirse y modelarse en última instancia mediante reglas computacionales, incluso si esas reglas son muy simples, generando un comportamiento complejo. Pero en la práctica, esto no es posible, y necesitamos a alguien que se refiera a él como un experto o simplemente un anotador que pueda hacer análisis de emociones3.
En esta investigación, propagamos la idea de construir modelos computacionales. Pero ese modelo será cuasi-computacional. Nuestra investigación en este contexto tiene como objetivo ser computacional en forma, pero es posible que no capture todos los aspectos a la perfección, tal vez dejando espacio para complejidades que son difíciles o imposibles de calcular por completo. Las emociones son difíciles de modelar computacionalmente porque dependen de experiencias subjetivas, contexto cultural y expresiones matizadas que no se pueden capturar completamente a través de algoritmos fijos.
Por lo tanto, para modelar las emociones humanas utilizando enfoques computacionales basados en variables, es necesario anotar las expresiones emocionales humanas. Esta anotación debe ser realizada por un experto o un anotador experto en análisis de emociones¹. Comprender las complejidades de las emociones humanas no es una tarea fácil, especialmente cuando se trata de idiomas mixtos. Además, los problemas relacionados con la escala significan que confiar únicamente en la anotación manual por parte de humanos no es una opción viable. Investigaciones recientes indican una necesidad constante de un enfoque humano en el bucle cuando se construyen sistemas para tareas tan complejas. En consecuencia, un enfoque semiautomático, que implica automatizar las partes más sencillas mientras se reservan tareas que requieren matices humanos para los anotadores, parece más apropiado para desarrollar sistemas de lenguaje natural en este dominio.
Un anotador humano, por supuesto, hará el trabajo manualmente, y en la era de la computación, esto no es lo que se espera de los científicos contemporáneos. Si el anotador (manual, semiautomático o completamente automático) es capaz de adivinar inteligentemente el tipo de emoción encarnada en los enunciados, enunciados que consisten en múltiples tipos de emociones expresadas como símbolos, con coloquialismo o código mixto y utilizando múltiples modalidades, entonces la tarea es difícil y fácil al mismo tiempo. La complejidad de la anotación de emociones en las expresiones en hinglish depende de la naturaleza de la expresión. Cuando las emociones se transmiten claramente usando palabras familiares o emojis, la anotación es relativamente sencilla. Sin embargo, la tarea se vuelve desafiante cuando las expresiones involucran múltiples emociones, mezcla de códigos o expresiones simbólicas ambiguas. Por lo tanto, la anotación puede ser fácil y difícil, dependiendo de qué tan directamente se exprese la emoción.
Los enfoques contemporáneos en la identificación de emociones y sentimientos abordan estos desafíos, incluida la naturaleza subjetiva de las emociones, la ambigüedad en las expresiones humanas, la complejidad de los lenguajes de código mixto como el hinglish y la naturaleza lenta e inconsistente de la anotación manual. asociado con la construcción de modelos computacionales y la gestión de tediosas tareas de anotación. Investigaciones recientes indican que los investigadores están empleando una amplia gama de métodos para lograr este objetivo, incluido el aprendizaje automático, el aprendizaje profundo y varios enfoques híbridos. Investigaciones recientes muestran que para superar estos problemas, los investigadores están empleando una variedad de técnicas, como el aprendizaje automático, el aprendizaje profundo y los modelos híbridos.
Investigaciones recientes muestran que los investigadores están empleando todo tipo de enfoques, incluido el aprendizaje automático, el aprendizaje profundo3 y los enfoques híbridos. El término análisis de sentimientos se refiere a un procedimiento utilizado cuando se cree que la polaridad de las emociones es un marcador para comprender la emoción cruda de los seres humanos 3,4. El desarrollo de dicha tecnología ha ayudado a reconocer el estado de ánimo, los sentimientos, el habla, las emociones faciales y las señales no verbales, y ya ha incursionado en aplicaciones que permiten la traducción en tiempo real2. Se podría utilizar un enfoque multimodal para traducir el hinglish al inglés y puede ser útil en el futuro para hacer que el cine indio sea más accesible para las sociedades remotas 5,6. Por ejemplo, en la India, el inglés suele ser el segundo idioma. La investigación en este contexto muestra que esto ha mejorado la calidad de la enseñanza del inglés al analizar el habla india (lenguaje de código mixto) para determinar la expresividad, o el grado de sentimiento y emoción, de cada palabra.
Dentro de este contexto de investigación, se ha demostrado que el uso del lenguaje de código mixto junto con la traducción mejora la calidad de la enseñanza del inglés. Esto se logra mediante el análisis del habla india (lenguaje de código mixto) para determinar la expresividad o valencia emocional de cada palabra. A través de la aplicación del aprendizaje profundo para entrenar a las computadoras en la interpretación del habla, esta investigación ya ha mejorado la precisión del análisis computarizado del habla y ha facilitado una mayor comprensión de la comunicación 4,5. Según los resultados del censo de 2001, el hinglish, un idioma que es una mezcla de hindi e inglés, es utilizado actualmente por aproximadamente 120 millones de personas en la India6.
Del panorama contemporáneo de los algoritmos de aprendizaje, está claro que el aprendizaje activo ha surgido como una herramienta poderosa para reducir significativamente el esfuerzo humano en la anotación de grandes conjuntos de datos, particularmente en el dominio de la identificación y el reconocimiento de emociones. Este enfoque iterativo, que anota selectivamente las anotaciones impactantes (con métricas adecuadas), no solo mejora la precisión de la anotación, sino que también mejora la eficiencia5. Estudios anteriores han demostrado su eficacia para lograr reducciones sustanciales en la carga de trabajo de anotación manual mientras se mantiene o incluso se mejora el rendimiento con conjuntos de datos de entrenamiento más pequeños y se propone un método basado en el análisis de conglomerados para la selección de instancias informativas 7,8. En el contexto específico del reconocimiento de emociones Hinglish, los investigadores han realizado valiosas contribuciones a través de modelos de aprendizaje profundo y un conjunto de datos anotados de múltiples etiquetas 9,10,11. Estudios anteriores12,13 han introducido métodos de aprendizaje activo y semisupervisados para minimizar la dependencia de los datos etiquetados por humanos, mejorando aún más la eficiencia y reduciendo los costos de anotación. Además, se ha demostrado en muchos proyectos que el aprendizaje activo aumenta el rendimiento de la clasificación, particularmente en la clasificación de emociones multietiqueta14.
La eficacia del aprendizaje activo para mejorar el rendimiento del clasificador ha sido reconocida en varias aplicaciones de aprendizaje automático. Los estudios15,16 destacaron su papel crucial en la mejora del rendimiento al centrarse en las aplicaciones educativas. De manera similar, un estudio inicial introdujo un algoritmo novedoso para el aprendizaje activo con máquinas de vectores de soporte, lo que redujo significativamente la necesidad de instancias etiquetadas17. Otro trabajo también exploró su aplicación en tareas que involucran instancias estructuradas, como la clasificación de textos18. El impacto del aprendizaje activo en las tareas de reconocimiento de emociones se extiende más allá de las ganancias de eficiencia, particularmente al minimizar la dependencia de los datos etiquetados por humanos. Un estudio introdujo un marco multitarea para la clasificación y regresión de emociones, superando el rendimiento de los métodos de una sola tarea10.
Además, los investigadores19 lograron avances significativos en el reconocimiento de emociones de voz y texto utilizando el aprendizaje activo, al tiempo que demostraron20 su efectividad en la clasificación personalizada de emociones musicales. Sin embargo, el proceso de categorización y etiquetado de las emociones presenta un desafío significativo, como se destaca21,22, particularmente en contextos de análisis de sentimientos. Señala que el uso de etiquetas puede influir significativamente en la categorización de las emociones, particularmente para las categorías aprendidas más tarde23. Para hacer frente a estos desafíos, se han desarrollado varios algoritmos, incluidos métodos basados en palabras clave y en el aprendizaje, logrando tasas de precisión notables24. La investigación sobre las emociones basada en expresiones escritas y textos se ha explorado en numerosos modelos, y los enfoques han implementado un modelo dimensional utilizando bases de datos normativas para la detección efectiva de emociones25. En otro estudio26, un modelo cognitivo de emociones mejoró un método secuencial utilizado para la identificación de la causa de las emociones sociales. El autor proporcionó una interpretación lingüística computacional del modelo de emoción OCC, mientras que un estudio similar27propuso un sistema que utiliza ontologías para representar las relaciones de dependencia de palabras y las emociones. Los autores de un estudio28discutieron las señales que se correlacionan con el procesamiento emocional de palabras, destacando la adaptación del cerebro para expresar emociones en el lenguaje escrito. La anotación de múltiples matrices de emociones en bruto, incluida la de los datos de múltiples modelos, es un desafío. Sin embargo, investigar las emociones relacionadas con la guerra y el conflicto proporciona una ventana científica y sistemática a la psique humana en circunstancias extremas, lo que nos permite comprender mejor cómo los individuos y las comunidades enfrentan el trauma, la pérdida y la incertidumbre5. Otro estudio encontró que la técnica de anotación mejoró efectivamente la clasificación de géneros, y la característica del título jugó un papel crucial en el proceso29. Un estudio creó un conjunto de datos de visión táctil de 44K con expertos y GPT-4V para entrenar un codificador táctil y un modelo TVL para la generación de texto30. Otro estudio exploró la minería de opiniones y tendencias sobre tuits políticos, centrándose en el proceso de aprendizaje activo para anotar automáticamente tuits en francés sobre políticos41. Otro estudio presentó CloudFlows, una plataforma de flujo de trabajo científico basada en la nube diseñada para el análisis central adaptativo dinámico en flujos de datos. Permite el aprendizaje activo para mejorar la clasificación de sentimientos, lo que permite que el algoritmo se adapte a los cambios en los datos en tiempo real42.
Existe una clara tensión entre la complejidad de la emoción humana y el deseo de un análisis automatizado de las emociones. Existe una tensión inherente entre la complejidad de la emoción humana y el objetivo del análisis automatizado de las emociones. La mayor parte del trabajo contemporáneo reconoce las limitaciones de la anotación manual y enfatiza la necesidad de métodos computacionales sofisticados para abordar los desafíos de comprender las emociones en diversas formas de comunicación. Este escenario ideal es en gran medida poco práctico, es decir, obtener anotaciones de las personas que escribieron o pronunciaron las oraciones43. El escenario ideal para obtener datos, específicamente obtener anotaciones directamente de las personas que escribieron o pronunciaron las oraciones, es en gran medida poco práctico. Esta impracticabilidad se deriva de la imposibilidad de recopilar y procesar tales anotaciones personalizadas a gran escala. Por lo tanto, los esfuerzos actuales deben basarse en anotadores expertos o algoritmos automatizados de detección de emociones para analizar y etiquetar las emociones expresadas en el texto. En este trabajo de investigación, hemos intentado superar algunos aspectos de estos desafíos de dominio. A continuación se presentan las principales contribuciones en este ámbito problemático44.
Por lo tanto, debemos confiar en expertos o anotadores y algoritmos de detección de emociones para analizar y etiquetar las emociones expresadas en el texto. Es imposible recopilar y procesar anotaciones tan personalizadas a gran escala. Por lo tanto, en este trabajo de investigación, hemos intentado superar algunos aspectos de este conocimiento de dominio. Las siguientes son las contribuciones clave en esta área problemática.
El marco funciona junto con métodos basados en reglas como el etiquetado de emociones, la detección de mezcla de códigos y la interpretación de emojis con técnicas de aprendizaje automático como Random Forest e incrustaciones de palabras, lo que mejora la precisión de las anotaciones y reduce el esfuerzo manual. El aprendizaje iterativo del clasificador emplea el aprendizaje activo y el aprendizaje por transferencia para priorizar muestras de características ambiguas, lo que reduce la necesidad de trabajo duro. Este enfoque redujo los costos operativos en un 40% en comparación con el etiquetado manual duro.
Para manejar los matices de Hinglish a un nivel granular, se desarrolló un método de tokenización personalizado sensible al contexto. Este enfoque procesa texto mixto de código teniendo en cuenta el cambio de idioma, la puntuación, los emojis y la segmentación de subpalabras, lo que permite una anotación de emociones más precisa en texto mixto hindi-inglés. A nivel granular, desarrollamos una tokenización sensible al contexto personalizada para el texto en hinglish. El marco aborda las complejidades del texto mezclado con código mediante la incorporación de diccionarios de emociones bilingües, tokenización de subpalabras y tokenización personalizada sensible al contexto. Las reglas léxicas resolvieron el 89% de las ambigüedades de cambio de código.
Nuestro trabajo se basa en teorías psicológicas establecidas de la emoción, como la Teoría de las Emociones Discretas y la Teoría de la Evaluación Cognitiva. La investigación demuestra la escalabilidad del enfoque para la respuesta a crisis y el monitoreo de redes sociales, proporcionando un modelo para aplicaciones de NLP multilingües de bajos recursos.
La Tabla 1 explica los estudios disponibles para el mismo dominio del problema. A partir de la encuesta bibliográfica y el resumen tabulado, se puede inferir que la mayoría de los estudios no pueden evitar hacer algún trabajo inicial sobre anotación utilizando métodos manuales. Pocos investigadores están siguiendo enfoques semiautomáticos41. Sin embargo, la verdadera diferencia en el rendimiento proviene del uso de un modelo de aprendizaje efectivo que puede automatizar el proceso de anotación. El contenido emocional de los tweets debe coincidir con las teorías que explican las vías de las emociones humanas y la organización de los sentimientos. La siguiente sección define el problema en función de las limitaciones de los enfoques existentes y los resultados empíricos de los artículos.
| Estudiar | Conjunto de datos | Emoción | Métodos | Dominio | Proceso de etiquetado | Boquetes | Alcance futuro |
| [31] | 9.000.000 de tuits | tensión, depresión, ira, vigor, fatiga, | Perfil de confusión de los estados de ánimo | Inglés | Sin etiquetado | El estudio pasa por alto diferencias emocionales sutiles como la sorpresa, la alegría o el miedo, lo que sugiere que el etiquetado de emociones puede mejorar la interpretabilidad y la granularidad de las tendencias de sentimientos, particularmente en relación con los eventos socioeconómicos. | Podría investigar cómo capturar y examinar mejor una variedad de expresiones emocionales en los datos de las redes sociales mediante el uso de métodos de categorización automatizados y taxonomías de emociones bien establecidas. |
| [32] | 7000 Tweets | ira, asco, miedo, alegría, amor, tristeza, | Máquina de vectores de soporte | Inglés | Manual | La generalización del conjunto de datos es limitada debido a su especificidad temática y a la falta de representatividad del uso general de Twitter. Debido a la interpretación subjetiva y al contexto mínimo, que se muestra en un modesto acuerdo entre anotadores, es un desafío anotar emociones en tweets breves e informales. | El trabajo futuro se centrará en el desarrollo de modelos mejorados de detección de emociones mediante la incorporación de distinciones entre estilos lingüísticos específicos de temas y específicos de emociones, lo que permitirá una clasificación más precisa en diversos contextos de tweets. |
| [33] | 21.000 Tweet | ira, asco, miedo, alegría, tristeza, sorpresa | Máquina de vectores de soporte | ------ | Uso de hashtags | Los corpus existentes etiquetados con emociones son limitados en tamaño y dominio, y carecen de conjuntos de datos grandes y diversos para microblogs. Los tweets son cortos, ruidosos y limitados por el contexto, lo que dificulta la detección y anotación precisa de emociones. | En el trabajo futuro, el estudio puede incluir la expansión del léxico de emociones con sinónimos y hashtags adicionales para mejorar la cobertura y la precisión de la detección. |
| [34] | 16485 Tweets | ira, asco, miedo, alegría, tristeza, sorpresa | Regresión de vectores de soporte | Chino | Manual | Los métodos tradicionales de clasificación de emociones a menudo pasan por alto la causa subyacente de las emociones, lo que limita la calidad de las características. Extraer con precisión las causas emocionales de las publicaciones breves e informales de microblog requiere sistemas sólidos basados en reglas y conocimiento del dominio.
| Una mayor exploración del análisis de la causa de las emociones puede mejorar los modelos de detección de emociones y abrir nuevas direcciones en la comprensión textual de las emociones. |
| [35] | 10,040 Tweet | Miedo, esperanza, alegría, ira, sorpresa, tristeza, disgusto | LDA, acuerdo entre evaluadores | Hinglish | Manual | Hay una falta de conjuntos de datos estructurados disponibles públicamente para Hinglish, especialmente aquellos que capturan matices pragmáticos y emocionales en el contenido relacionado con la crisis. El hinglish es un lenguaje no estándar, con código mixto, y las variaciones regionales complican el análisis y la anotación precisos de sentimientos.
| Para expandir conjuntos de datos multimodales, integre el análisis pragmático profundo con modelos de aprendizaje automático y aborde la escalabilidad para el seguimiento de emociones en tiempo real en el discurso de conflicto. |
| [36] | 134.000 tuits | activo, inactivo feliz, infeliz | Máquina de vectores de soporte y K-vecinos más cercanos | Hinglish | Uso de hashtags | El etiquetado manual de emociones de los tweets requiere mucha mano de obra y es inconsistente, lo que limita los esfuerzos de clasificación de emociones a gran escala Las anotaciones de crowdsourcing carecen de confiabilidad, especialmente en la identificación de los niveles de excitación de las emociones, destacando la subjetividad en la interpretación de las emociones.
| Concéntrese en refinar el etiquetado basado en hashtags y expandir los modelos de detección de emociones para mejorar la precisión y la generalización en diversos contextos emocionales. |
| [37] | 3.000 estudiantes, psicólogos y no psicólogos de 37 países | alegría, miedo, ira, tristeza, disgusto, vergüenza y culpa. | -- | ----- | Manual | Exploración limitada de cómo los factores culturales influyen en la regulación y expresión de emociones específicas en diversas sociedades. Equilibrar la evidencia de patrones emocionales universales con variaciones culturalmente específicas en la elicitación e interpretación de emociones sigue siendo complejo.
| Otros estudios deben investigar la interacción entre la universalidad biológica y el contexto cultural en la configuración de la experiencia emocional y la comunicación |
| [38] | 12000 | Felicidad, tristeza y enojo | Acuerdo entre evaluadores | Hindi+Inglés | Manual | La investigación actual carece de un conjunto de datos completo y anotado y modelos estandarizados para la detección de emociones Hinglish. La gramática irregular y la naturaleza mixta de los textos de las redes sociales dificultan la clasificación precisa de las emociones.
| El trabajo futuro se centrará en expandir las categorías de emociones y desarrollar conjuntos de datos de código mixto multilingües más grandes. |
| [39] | 2866 | felicidad, tristeza, ira, sorpresa y tristeza | Máquina de vectores de soporte | Hinglish (hindi + inglés) | Manual | Falta de conjuntos de datos mixtos de código anotados por emociones. La expresión de emociones en el texto mezclado con código varía según los idiomas y los alfabetos, lo que hace que la anotación y la clasificación sean complejas.
| El trabajo futuro podría expandir el corpus para incluir más diversidad emocional, integrar el etiquetado de partes del discurso y explorar contenido mixto de código en varios idiomas. |
| [40] | 13738 | --- | Traducción automática Traductor de Google | Hinglish | Manual | Los sistemas de traducción automática existentes carecen de precisión en los datos de redes sociales con código mixto debido a la ausencia de grandes corpus paralelos específicos del dominio. La alta variación ortográfica, la estructura informal y la ambigüedad en la identificación del idioma complican la traducción del texto romanizado hindi-inglés.
| El corpus puede admitir el desarrollo de sistemas de traducción de código mixto y extenderse a otros lenguajes de bajos recursos y tareas de NLP como el reconocimiento de entidades con nombre |
| [41] | 11527 | Positivo,Muy positivo y negativo,Muy negativo | Clasificación basada en kNN, representación BOW | Políticos franceses | Manual | Disponibilidad limitada de conjuntos de datos anotados de alta calidad para la minería de opiniones políticas en idiomas distintos del inglés. Equilibrar la reducción del ruido de las anotaciones con la retención de información y el manejo de la distribución desigual de etiquetas en conjuntos de datos de tweets a gran escala son dificultades clave.
| El trabajo futuro puede refinar los métodos de aprendizaje activo para preservar mejor el contenido crítico y minimizar el ruido de anotación en el discurso político multilingüe. |
| [42] | 764,416 | --- | Agrupación en clústeres de Kmeans, SVM | Inglés | Semi supervisado | El etiquetado en tiempo real y la actualización de modelos en el análisis de opiniones están limitados por la variabilidad del flujo de datos, el costo del etiquetado y la escalabilidad del sistema. | El trabajo futuro explorará la clasificación de sentimientos de varias clases, integrará estrategias de etiquetado adicionales y ampliará el control sobre la generación inicial del modelo |
Tabla 1: Estudios disponibles con los métodos de etiquetado correspondientes. La tabla proporciona una descripción comparativa completa de los estudios existentes, abordando la anotación de emociones y estableciendo el panorama metodológico y conceptualizando la contribución del presente trabajo dentro de la literatura existente.
Planteamiento del problema
Las emociones estudiadas con mayor frecuencia en anotación están fuertemente influenciadas por modelos psicológicos fundamentales como los de Ekman y Plutchik, centrándose principalmente en categorías centrales como la ira, el miedo, la felicidad, la tristeza, la sorpresa, etc.44 . Por lo tanto, en este trabajo de investigación, pretendemos trabajar sobre connotaciones bien establecidas de las emociones. El desafío es desarrollar un marco computacional dinámico, F, capaz de anotar con precisión instancias de texto hinglish (ti ) de un corpus T centrado en guerras y conflictos con etiquetas de emoción (ei) de un conjunto predefinido E = {e1, e2, ..., e8}. Este marco debe sintetizar los principios de la Teoría Construccionista de la Emoción, la Teoría de los Eventos Afectivos (AET), la Teoría de las Emociones Discretas y la Teoría de la Evaluación Cognitiva para modelar el paisaje emocional multifacético del discurso relacionado con el conflicto. Cada instancia de texto ti en T es lingüísticamente compleja, mezclando hindi (en escritura romana), inglés, emojis y símbolos, lo que requiere un enfoque de múltiples capas para capturar expresiones emocionales matizadas.
El modelo computacional de emociones relacionadas con la guerra (como estudio de caso) puede implicar un enfoque multifacético, comenzando con reglas léxicas que abordan los matices basados en Hinglish. La tokenización, denotada como T, abarca las escrituras romanas (hindi escrito en escritura romana), junto con emojis y puntuación, que forman la base del procesamiento del lenguaje. Los diccionarios de emociones, representados como D, asignan palabras en todos los idiomas a emociones específicas, como ira, alegría y otras, donde cada emotion_i ha asociado words_j en language_k. La descomposición de subpalabras, S, descompone los términos compuestos en sus subpalabras constituyentes, lo que permite una comprensión más profunda de expresiones complejas. Posteriormente, las técnicas de aprendizaje automático, M, utilizan incrustaciones, E, como Word2Vec/fastText, para transformar tokens en representaciones vectoriales, vector_v, facilitando el análisis numérico. Los clasificadores de conjuntos, C, como Random Forest, predicen las etiquetas de las emociones, emotion_label_p, a partir de estos conjuntos vectoriales. Para mejorar iterativamente el modelo de aprendizaje de anotaciones, se emplea un mecanismo de aprendizaje activo, AL. La retroalimentación de los expertos, F, refina los casos ambiguos, ambiguous_sample_q, asignando refined_label_r, proporcionando correcciones cruciales. La priorización de muestras, P, se centra en muestras de baja confianza, low_confidence_sample_s, asignándoles annotation_priority_t, optimizando así el proceso de anotación.
Al integrar estos componentes y teorías, este marco tiene como objetivo procesar dinámicamente el texto hinglish, unir los matices lingüísticos y culturales y refinar de manera adaptativa las anotaciones de emociones, ofreciendo una solución escalable para analizar las dimensiones afectivas en el discurso del conflicto.