Skip to main content

masalbench-benchmark-contextual-cross-cultural

Build cross-cultural figurative language benchmarks and evaluation pipelines for LLMs. Applies the MasalBench methodology to test whether models truly understand proverbs, idioms, and culturally-embedded expressions -- not just pattern-match surface text. Trigger phrases: 'evaluate LLM cultural understanding', 'benchmark figurative language', 'test proverb comprehension', 'cross-cultural NLP evaluation', 'build idiom benchmark', 'low-resource language evaluation'

Ir a la instalación

Datos de origen

Repositorio
ndpvt-web/arxiv-claude-skills
Última actividad en el origen
13 de febrero de 2026 a las 13:35
Idioma detectado de SKILL.md
inglés
Estrellas
14
Forks
3

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.