Polyvocal Semantic Infrastructure for TTRPG Research | Multimedia Play Data

This article introduces Multimedia Play Data and proposes a Polyvocal Semantic Infrastructure (PSI) for tabletop role-playing game research. Based on a scoping review of 35 studies, it examines how qualitative, multimodal, computational, and knowledge-organization methods analyze heterogeneous evidence from play. The proposed Semantic Atlas and Scope Ladder connect vocabularies, metadata, and provenance without collapsing disciplinary or community perspectives into a single ontology, providing a foundation for interoperable TTRPG research and future AI-assisted analysis
Graphic abstract showing how fragmented TTRPG multimedia play data are mapped across 35 studies to identify qualitative, computational, and knowledge-organization approaches and propose a Polyvocal Semantic Infrastructure for retrieval, comparison, provenance tracking, interoperability, and AI-assisted analysis.

New Article – Toward a Polyvocal Semantic Infrastructure for Tabletop Role-Playing Game Research: A Scoping Review of Multimedia Play Data

By Cristo Leon and Julian Marcone

Published in Multimedia, 2026, Volume 2, Issue 3, Article 16.

This open-access scoping review examines how tabletop role-playing game (TTRPG) research analyzes heterogeneous Multimedia Play Data, including speech, audiovisual recordings, character materials, maps, rules artifacts, platform traces, structured game states, annotations, metadata, and retrospective documentation. Reviewing 35 studies across qualitative, multimodal, computational, and knowledge-organization approaches, León and Marcone identify methodological fragmentation as a central challenge for interdisciplinary TTRPG research. The article proposes a Polyvocal Semantic Infrastructure (PSI), composed of a Semantic Atlas and Scope Ladder, to coordinate multiple vocabularies and interpretive perspectives while preserving provenance rather than imposing a universal ontology. The framework provides a conceptual foundation for semantic interoperability, metadata reuse, knowledge graphs, digital archives, and future provenance-aware AI analysis of tabletop role-playing game data.

Introduction: TTRPG Research Has a Data Infrastructure Problem

A tabletop role-playing game session produces far more than a story. It may generate speech, gesture, character sheets, maps, rule references, dice outcomes, audiovisual recordings, chat logs, virtual tabletop traces, digital assets, session notes, structured game states, annotations, and retrospective narratives.

These materials are not simply secondary records of play. They participate in how play is created, remembered, interpreted, documented, and reused. As tabletop role-playing game (TTRPG) research expands across game studies, multimedia research, education, digital humanities, artificial intelligence, libraries, archives, and computational research, these heterogeneous forms of evidence create an increasingly difficult methodological problem.

The challenge is not that TTRPG research lacks methods. Rather, existing methods remain distributed across disciplines, publication ecosystems, data types, analytical purposes, vocabularies, and levels of formalization. The richness of game-derived data has begun to exceed the methodological infrastructure available for connecting them.

What Is Multimedia Play Data?

To address this problem, the article introduces Multimedia Play Data as a way of conceptualizing the heterogeneous evidence generated through role-playing activity.

We define Multimedia Play Data as layered, situated, collaborative, and technically mediated evidence generated through role-playing activity. This includes speech, audiovisual media, rules artifacts, character materials, maps, platform traces, structured game states, annotations, metadata, and retrospective documentation.

The concept is important because the same artifact can occupy several analytical positions simultaneously. A recorded session can be understood as performance, conversational data, collaborative narrative, audiovisual evidence, a learning environment, or material for computational analysis. A character sheet can function as an identity document, rules interface, game-state record, narrative artifact, and computational data source.

Multimedia Play Data therefore shifts the question from simply what kind of artifact is this? toward how can multiple legitimate interpretations of the artifact be preserved, related, retrieved, and analyzed?

A Scoping Review of 35 Studies

The study conducts a scoping review of 35 sources examining computational, multimodal, multimedia, and knowledge-organization approaches to TTRPG-derived data. The review follows PRISMA-informed transparency practices and uses the SPIDER framework to specify the phenomenon of interest, evidence type, design logic, and research scope. The review protocol was also registered through the Open Science Framework to support procedural transparency and traceability.

The corpus reveals a broad methodological repertoire. Existing research employs qualitative interpretation, discourse and conversation analysis, player-experience evaluation, structured datasets, natural language processing, named-entity recognition, semantic annotation, AI-assisted generation, and controlled vocabularies.

The problem is therefore not methodological scarcity. It is methodological fragmentation. These approaches frequently operate through different disciplinary vocabularies, data models, publication ecosystems, and assumptions about what constitutes meaningful evidence.

From Fragmentation to a Polyvocal Semantic Infrastructure

The article responds to this fragmentation by proposing a Polyvocal Semantic Infrastructure (PSI).

PSI is defined as a provenance-aware knowledge-organization framework that coordinates multiple vocabularies, interpretive strata, and semantic mappings without reducing them to a single authoritative ontology.

This distinction is central to the proposal. Terms such as campaign, character, immersion, scenario, mechanic, player, actual play, and TTRPG can carry different meanings across player communities, game systems, libraries, educational research, computational studies, therapeutic settings, and game studies.

These differences should not automatically be treated as errors requiring normalization. They can represent legitimate differences in perspective, purpose, community, or disciplinary worldview.

PSI therefore does not attempt to construct a universal ontology of role-playing games. Its purpose is to make heterogeneous classifications traceable, comparable, retrievable, and reusable while preserving their provenance and interpretive differences.

The Semantic Atlas and the Scope Ladder

The proposed infrastructure is organized around two complementary components: the Semantic Atlas and the Scope Ladder.

The Semantic Atlas

The Semantic Atlas coordinates heterogeneous vocabularies, semantic mappings, interpretive strata, and provenance records. Rather than forcing every concept into a master taxonomy, it allows related concepts to be mapped while retaining information about where definitions originate and how they are being used.

The Scope Ladder

The Scope Ladder organizes concepts according to provenance, authority, and visibility. It distinguishes among review-scoped vocabularies, group-scoped vocabularies, terminology derived from individual source papers, and external named vocabularies or authority systems.

Together, these components provide a way to coordinate knowledge without requiring semantic uniformity. The objective is interoperability without epistemic collapse.

Metadata Becomes Data

One of the methodological implications of the study is a change in how metadata should be understood.

Descriptions, classifications, vocabulary choices, provenance records, semantic mappings, normalization decisions, and interpretive levels are often treated as administrative information surrounding research data. Within the PSI framework, they become analyzable evidence.

Metadata can reveal how different communities define, organize, classify, connect, retrieve, and reuse knowledge about role-playing games. Treating metadata as data therefore creates opportunities for conceptual auditing, methodological transparency, longitudinal comparison, and cumulative scholarship.

In this sense, a literature review need not remain a static synthesis. Its structured metadata can become part of an expandable research infrastructure.

Why This Matters for Artificial Intelligence

The semantic problem becomes particularly important when artificial intelligence and computational methods are introduced into TTRPG research. Computational systems require representations of entities, actions, rules, scenes, relationships, and context. Yet many TTRPG concepts are socially situated, historically variable, and dependent on the interpretive framework through which play is examined.

Without provenance, an AI system may treat a contested or context-dependent concept as though it were a universally stable category. A provenance-aware semantic infrastructure instead allows computational systems to retain information about where a concept originated, how it was defined, and within what analytical context it should be interpreted.

The PSI therefore offers a conceptual foundation for future AI-assisted retrieval, annotation, knowledge graphs, semantic search, and analysis of session transcripts, character sheets, campaign documentation, audiovisual recordings, and platform traces.

Contribution and Future Research

The article makes three interconnected contributions.

Theoretically, it reframes TTRPG-derived evidence as Multimedia Play Data connecting narrative, interaction, material artifacts, audiovisual evidence, platform traces, structured data, and retrospective interpretation.

Methodologically, it synthesizes how existing studies extract, classify, formalize, normalize, and interpret heterogeneous play-derived evidence.

Practically, it proposes requirements for semantic infrastructures capable of supporting comparison, retrieval, provenance tracking, reuse, and future AI-assisted analysis.

The PSI remains a conceptual and exploratory proposal rather than a fully implemented and empirically validated system. Future research must test it through prototype semantic atlases, comparative annotation studies, provenance-aware knowledge graphs, AI-assisted retrieval workflows, and longitudinal updates of TTRPG research corpora.

Ultimately, the objective is not to make TTRPG research speak with one voice. It is to develop an infrastructure through which its many voices can remain distinct while becoming more traceable, interoperable, and capable of communicating with one another.

Cite This Article

León, C., & Marcone, J. (2026). Toward a Polyvocal Semantic Infrastructure for Tabletop Role-Playing Game Research: A Scoping Review of Multimedia Play Data. Multimedia, 2(3), 16. https://doi.org/10.3390/multimedia2030016

Keywords: analog games; artificial intelligence; cataloging; controlled vocabularies; data curation; genre/form terms; interdisciplinary research; knowledge organization; metadata; multimodal analysis.

Interested in Exploring or Collaborating?

This research opens several directions for collaboration across tabletop role-playing game studies, multimedia research, artificial intelligence, digital humanities, knowledge organization, libraries and archives, educational research, and computational analysis.

Researchers interested in Multimedia Play Data, semantic infrastructure, provenance-aware AI, or the development and validation of the Polyvocal Semantic Infrastructure are welcome to connect, share this work, and explore opportunities for future research.

Copyright and Open Access

© 2026 by the authors. Published by MDPI in Multimedia. This article is distributed under the terms and conditions of the Creative Commons Attribution (CC BY) license.


Hacia una Infraestructura Semántica Polivocal para la Investigación de los Juegos de Rol de Mesa: Una Revisión de Alcance de los Datos Multimedia del Juego

Introducción: La investigación sobre TTRPG enfrenta un problema de infraestructura de datos

Una sesión de juego de rol de mesa produce mucho más que una historia. Puede generar habla, gestos, hojas de personaje, mapas, referencias a reglas, resultados de dados, grabaciones audiovisuales, registros de chat, trazas de mesas virtuales, activos digitales, notas de sesión, estados estructurados del juego, anotaciones y narrativas retrospectivas.

Estos materiales no son únicamente registros secundarios del juego. Participan en la manera en que el juego se produce, recuerda, interpreta, documenta y reutiliza. A medida que la investigación sobre juegos de rol de mesa (TTRPG) se expande hacia los estudios de juegos, la educación, las humanidades digitales, la inteligencia artificial, la investigación multimedia, las bibliotecas y los archivos, estas formas heterogéneas de evidencia plantean un problema metodológico cada vez más importante.

El problema no es la ausencia de métodos. El campo posee una amplia diversidad metodológica, pero sus métodos permanecen fragmentados entre disciplinas, ecosistemas de publicación, tipos de datos, vocabularios y diferentes niveles de formalización.

¿Qué son los Datos Multimedia del Juego?

El artículo propone el concepto de Multimedia Play Data (Datos Multimedia del Juego) para describir la evidencia estratificada, situada, colaborativa y técnicamente mediada que se genera mediante la actividad de juego de rol.

Esta categoría incluye habla, medios audiovisuales, artefactos de reglas, materiales de personajes, mapas, trazas de plataformas, estados estructurados del juego, anotaciones, metadatos y documentación retrospectiva.

Una característica fundamental de estos datos es que un mismo objeto puede ocupar múltiples posiciones analíticas. Una sesión grabada puede ser simultáneamente una actuación, un conjunto de datos conversacionales, una narrativa colaborativa, evidencia audiovisual y material para análisis computacional. Una hoja de personaje puede funcionar como interfaz de reglas, documento de identidad, registro del estado del juego, artefacto narrativo y fuente de datos estructurados.

Una revisión de alcance de 35 estudios

El estudio realiza una revisión de alcance de 35 fuentes relacionadas con aproximaciones computacionales, multimodales, multimedia y de organización del conocimiento aplicadas a datos derivados de TTRPG.

El corpus muestra una amplia diversidad metodológica que incluye interpretación cualitativa, análisis del discurso y la conversación, evaluación de la experiencia del jugador, conjuntos de datos estructurados, procesamiento del lenguaje natural, reconocimiento de entidades nombradas, anotación semántica, generación asistida por inteligencia artificial y vocabularios controlados.

Sin embargo, estos enfoques permanecen débilmente coordinados. El problema, por lo tanto, no es la falta de métodos, sino la ausencia de una infraestructura compartida capaz de conectarlos.

Infraestructura Semántica Polivocal (PSI)

Como respuesta, proponemos una Polyvocal Semantic Infrastructure (PSI), o Infraestructura Semántica Polivocal.

La PSI es un marco de organización del conocimiento consciente de la procedencia de los datos y conceptos, diseñado para coordinar múltiples vocabularios, estratos interpretativos y mapeos semánticos sin reducirlos a una única ontología autoritativa.

Este principio resulta especialmente importante para los juegos de rol. Conceptos como campaña, personaje, inmersión, escenario, mecánica o jugador pueden adquirir significados diferentes dependiendo de la comunidad, sistema de juego, disciplina académica, método o propósito analítico.

La PSI no intenta eliminar estas diferencias. Busca hacerlas visibles, trazables y comparables.

El Atlas Semántico y la Escalera de Alcance

La infraestructura propuesta se articula mediante dos componentes complementarios: el Semantic Atlas (Atlas Semántico) y la Scope Ladder (Escalera de Alcance).

El Atlas Semántico coordina vocabularios heterogéneos, estratos interpretativos, registros de procedencia y relaciones semánticas. Permite establecer conexiones entre conceptos sin obligarlos a integrarse en una taxonomía universal.

La Escalera de Alcance organiza los conceptos de acuerdo con su procedencia, autoridad y visibilidad, distinguiendo vocabularios definidos dentro de una revisión, vocabularios de grupos, términos provenientes de artículos individuales y vocabularios o sistemas de autoridad externos.

El objetivo es lograr interoperabilidad sin eliminar la pluralidad epistemológica.

Cuando los metadatos se convierten en datos

Una implicación metodológica importante del estudio es tratar los metadatos como evidencia analizable.

Las descripciones, clasificaciones, decisiones de normalización, vocabularios, registros de procedencia, mapeos semánticos y niveles interpretativos muestran cómo diferentes comunidades organizan, relacionan y recuperan conocimiento sobre los juegos de rol.

Formalizar esta información puede contribuir a la auditoría conceptual, la transparencia metodológica, la comparación longitudinal y la construcción acumulativa del conocimiento.

Implicaciones para la inteligencia artificial

Esta infraestructura adquiere especial relevancia cuando se incorporan sistemas de inteligencia artificial al análisis de los juegos de rol. Los sistemas computacionales necesitan representaciones estructuradas de entidades, acciones, reglas, escenas y contextos. Sin información sobre procedencia, una IA puede interpretar conceptos controvertidos o contextuales como categorías universales y estables.

Una infraestructura semántica consciente de la procedencia permite conservar información sobre quién definió un concepto, desde qué marco analítico se utilizó y dentro de qué contexto debe interpretarse.

La PSI ofrece así una base conceptual para futuros sistemas de recuperación asistida por IA, anotación semántica, grafos de conocimiento, búsqueda semántica y análisis de transcripciones, hojas de personaje, notas de campaña, grabaciones audiovisuales y trazas de plataformas.

Contribución y trabajo futuro

El artículo realiza una contribución teórica al conceptualizar la evidencia derivada de TTRPG como Datos Multimedia del Juego; una contribución metodológica al sintetizar cómo diferentes estudios extraen, clasifican, formalizan, normalizan e interpretan esta evidencia; y una contribución práctica al identificar los requisitos de futuras infraestructuras semánticas para la investigación sobre juegos de rol.

La PSI debe entenderse actualmente como una propuesta conceptual y exploratoria. Todavía requiere validación mediante prototipos, estudios comparativos de anotación, grafos de conocimiento conscientes de la procedencia, flujos de recuperación asistidos por IA y actualizaciones longitudinales de corpus.

El propósito final no es hacer que la investigación sobre juegos de rol hable con una sola voz. Es construir una infraestructura mediante la cual sus múltiples voces puedan permanecer diferenciadas y, al mismo tiempo, comunicarse.

Cómo citar este artículo

León, C., & Marcone, J. (2026). Toward a Polyvocal Semantic Infrastructure for Tabletop Role-Playing Game Research: A Scoping Review of Multimedia Play Data. Multimedia, 2(3), 16. https://doi.org/10.3390/multimedia2030016

¿Interesado en explorar o colaborar?

Este trabajo abre oportunidades de colaboración entre los estudios sobre juegos de rol de mesa, investigación multimedia, inteligencia artificial, humanidades digitales, organización del conocimiento, educación, bibliotecas, archivos y análisis computacional.

Investigadores interesados en Datos Multimedia del Juego, infraestructura semántica, IA consciente de la procedencia o en el desarrollo y validación de la Infraestructura Semántica Polivocal están invitados a compartir este trabajo y explorar futuras oportunidades de investigación.