GILTIA
GILTIA
Noticias | Prensa
Equipo
Eventos
Publicaciones
Contacto
Español
Español
English
Low-Resource Languages
Whisper-LM con léxico maya: corrección de transcripciones ASR de maya yucateco usando Gemini y un diccionario como referencia
Un pipeline en Google Colab que corrige transcripciones ruidosas de Whisper en maya yucateco combinando reglas morfológicas, un léxico de 2,988 entradas y Gemini 2.0 Flash como modelo corrector.
Jaziel A. Carballo Tadeo
The YUA-ES Communicative Contexts Corpus: An Open Parallel Dataset of Everyday Yucatec Maya–Spanish Phrases
An openly licensed parallel corpus of 14,332 aligned phrase pairs in Yucatec Maya and Spanish, organized into 31 everyday communicative contexts — the first open, phrase-aligned corpus of its kind.
Alejandro Molina Villegas
,
María Elisa Chavarrea-Chim
,
Samuel Canul-Yah
,
Sary Lorena Hau-Ucán
PDF
Citar
DOI
View on Research Square
Generating a Culturally and Linguistically Adapted Word Similarity Benchmark for Yucatec Maya
Un benchmark de similitud de palabras cultural y lingüísticamente adaptado al maya yucateco, construido a partir de una Lista de Swadesh filtrada, que muestra que la elección del benchmark pesa más que el ajuste de hiperparámetros al evaluar word embeddings.
Alejandro Molina Villegas
,
Joel Suro-Villalobos
,
Jorge Reyes-Magaña
,
Silvia Fernández-Sabido
DOI
Ver en Inteligencia Artificial
Mayasoundex: A Phonetically Grounded Algorithm for Information Retrieval in the Maya Language
Un algoritmo fonético tipo Soundex diseñado para la lengua maya, que genera códigos consistentes para palabras de sonido similar y permite una recuperación de información robusta frente a la variación ortográfica.
Alejandro Molina Villegas
PDF
Citar
×