Content interoperability as a prerequisite for re-using and re-purposing items of structured content as learning objects in eLearning – Seen under a standardisation perspective
Full text
6Christian Galinski, Interoperabilidad de contenidos como requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning previo para la reutilización y reutilización de elementos de contenido estructurado como objetos de aprendizaje en el aprendizaje electrónico […] Visto desde una perspectiva de normalización Christian Galinski, BLANCA STELLA GIRALDO PÉREZ (PPE). - (DE) Señor Presidente, señor Presidente de la Comisión, señor Presidente de la Comisión, señor Presidente de la Comisión, señor Presidente de la Comisión, señores diputados, señoras y señores, señorías, señores diputados, señores y señoras, Infoterm PLAYERDS: contenido estructurado y contenido no estructurado, representaciones verbales y no verbales, denominaciones, morfología y morfemas, fraseología y fraseomas, colocaciones y términos de varias palabras, objetos de aprendizaje de alta complejidad (HC-LO) y objetos de aprendizaje de baja complejidad (LC-LO), lenguaje para fines generales (LGP) y lenguaje para fines especiales (LSP), personas con discapacidad (PwD) y tecnologías de asistencia, normas y normalización, certificación, modelos de datos y modelado de datos, repositorios federados. 1. Contenido estructurado El "contenido" aquí se ve como contenido estructurado a nivel de la semántica léxica que comprende representaciones lingüísticas y no lingüísticas de conceptos (entendidos en la teoría de la ciencia como una especie de "objetos inmateriales"). Estas representaciones pueden ser designativas (como las designaciones en terminología: que comprenden términos, símbolos y denominaciones) o descriptivas (como varios tipos de definiciones, explicaciones o representaciones no verbales) o híbridas. Hasta ahora, las designaciones y representaciones no verbales de conceptos, así como las denominaciones (es decir, nombres propios que representan conceptos individuales) han estado subrepresentados en la teoría y metodología de la terminología. Pero pueden ser muy importantes para diseñar objetos de aprendizaje (LO) en ciertos dominios o campos de aplicación, por no hablar del aprendizaje de idiomas y la traducción. Igualmente importantes para el diseño de LO multilingües, multimodales y multiusos son: a) similitudes de las entradas de LGP y LSP: - La representación designativa de la entrada (lemma LGP o término LSP) puede ser una palabra, una palabra compuesta o una entidad de varias palabras; - La representación designativa verbal puede complementarse con una representación designativa no verbal (p. ej., gesto, imitación, Blisd) componentes de entidades de contenido estructurado, como los morfemas de las representaciones designativas verbales o los elementos de una definición, explicación, contexto, etc. Deben estar marcados con etiquetas para facilitar la referencia cruzada o la reutilización como otra LO (por ejemplo, prefijos y referencias cruzadas a los elementos pertinentes de la entidad respectiva). En este caso, cien símbolos básicos representan un concepto, que se pueden componer juntos para generar nuevos símbolos que representan
7Terminologija | 2012 | 19 símbolos1 etc.), o […] si es necesario […] incluso ser reemplazado por él (por ejemplo, gráficoical or other non-verbal symbol); - Each entry representing one concept has a unique entry identifier (que puede, por ejemplo, apuntar a ocurrencias en corpora de texto); En las entradas de LSP, cada representación designativa debe tener su propio identificador de elemento, que entre otras cosas haría posible rastrear el cambio conceptual a lo largo del tiempo; en las entradas de LGP, cada significado de una representación designativa debe tener su propio identificador de elemento, lo que hace que la representación entries possible, ° In analogy to termautonomy in terminology, representationautonomy multilingüe se aplique a LSP y LGP, así como a las representaciones no verbales; las representaciones descriptivas de LGP (incluidas las explicaciones, contextos, etc.) pueden ser tratadas en estricta analogía con las de LSP (explicacións, contextos, etc.), pero excluyen las definiciones en el sentido del concepto; puede haber campos adicionales para notas, ejemplos, etc. b) las pronunciaciones de los elementos verbales de las entidades de contenido estructurado, que deben preverse en cualquier entrada, al menos potencialmente. c) las representaciones designativas no verbales y las representaciones descriptivas no verbales, que deben preverse en cualquier entrada, al menos potencialmente, porque pueden ser […] dependiendo del dominio o campo de aplicación […] igualmente importantes para las representaciones verbales y, a veces, incluso preferidas. nuevos conceptos. Los símbolos de la bienaventuranza no corresponden en absoluto a los sonidos de ningún idioma hablado. suffixes in medical nomenclature). e) larger entities of structured content, such as idioms, LGP collocations or LSP phrasemes, as well as metaphors, which can be formally treated similar to verbal designative representations in LGP (with proper 1 Blissymbolics is an ideographic writing system for cognitively impaired persons. Each of the several
8Christian Galinski, Interoperabilidad de contenidos como requisito previo Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning para el nivel, la diferenciación más refinada de lo anterior es necesaria en la lingüística de corpus, pero probablemente no para LO. También puede ser de menor importancia, ya sea que el significado sea no compositivo o compositivo. Hay herramientas en la lingüística de corpus para identificar y extraer también tales entidades más grandes de contenido estructurado. f) la provisión de campos de marcador de lugar o enlaces a las respectivas representaciones designativas para las personas con discapacidad, como en Braille, lengua de señas o Blissymbolics. Los recursos de contenido estructurados a nivel de la semántica léxica hasta ahora se consideraban que comprendían principalmente datos lexicográficos, datos terminológicos y otros tipos de representaciones de conceptos, incluidas algunas no verbales, como símbolos visuales (por ejemplo, símbolos públicos). Pero también puede haber símbolos audibles acústicos, símbolos táctiles táctiles y otros, que, en la gestión de la terminología, podrían ocurrir como designaciones o incluso descripciones de conceptos (como las representaciones no verbales (ISO 10241-1:2011). Puede que se requiera más información […] y las respectivas categorías de datos […] para un enfoque sistemático en la gestión del contenido estructurado en general. A la luz de lo anterior, podemos diferenciar los tipos de contenido estructurado a nivel de la semántica léxica de la siguiente manera: - Datos lexicográficos, como: las entidades de las palabras (incluidos los compuestos, etc.), los morfemas (morfología), las colocaciones, las metáforas; - Terminologías y tipos similares de recursos lingüísticos y otros recursos de contenido, como: […] nomenclaturas, taxonomías, tipologías, glosarios, vocabularios, etc., […] morfemas terminológicos (morfología), […] fraseomas terminológicos (fraseología), […] nombres propios de todo tipo utilizados, por ejemplo, como elementos en diferentes kinds of directories, ° graphical symbols and other non-verbal designations, ° (product) properties, characteristics, attributes etc.; - Thesauri, classification schemes (ISO/DIS 22274:2011), keywords and other kinds of documentation languages (or controlled vocabularies); - Entradas enciclopédicas (conocimiento), que cubren, entre otras cosas: ° knowledge-enriched terminological entries,
9Terminologija | 2012 | 19 Nombres propios (explicados) y otros tipos de datos estrechamente relacionados con los nombres propios; - Ontologías, mapas temáticos y otros tipos de sistemas de estructuración del conocimiento. Al igual que en la terminología, cualquiera de los otros tipos de contenido estructurado enumerados anteriormente puede tener - (una o más) representaciones fonéticas, representaciones de la lengua de señas, etc. ; - representaciones designativas gráficas y otras no verbales, así como representaciones descriptivas no verbales (algunas además de una representación verbal, otras creadas como representaciones no verbales independientes de las verbales). Los tipos no verbales de contenido estructurado son particularmente significativos en aplicaciones como el aprendizaje electrónico y de vital importancia en la comunicación: - con y entre las personas con discapacidad (directamente o a través de dispositivos de TIC que funcionan como tecnologías de asistencia), - entre las personas con discapacidad y los dispositivos que utilizan, y - entre estos dispositivos. Los diseñadores de señales de tráfico están llamando a los elementos de las señales de tráfico "morfología" (en analogía con los morfemas en la lingüística). Lo mismo podría aplicarse a otras representaciones designativas no verbales. Ya se han desarrollado métodos de búsqueda para buscar representaciones gráficas de imágenes enteras por medio de elementos individuales contenidos en ellas. La siguiente figura muestra un ejemplo de la "morfología" de los símbolos gráficos (en este caso una señal de tráfico): (de la presentación de Schmitz en el TSTT 20062; véase Schmitz 2006) 2 3a Conferencia Internacional de Terminología, Estandarización y Transferencia de Tecnología (TSTT 2006), Beijing, China, 25-26 August 2006
10 Christian Galinski, Contentinteroperabilityasaprerequisitefor Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning En ciertos ámbitos (por ejemplo, en las nomenclaturas biológicas) incluso hay ejemplos de representaciones descriptivas no verbales que reemplazan definiciones largas u otras descripciones de conceptos, que también podrían ser útiles para fines de aprendizaje electrónico: (de Gonnissen y Mornie 1983, pájaro no 50) Sólo necesita una leyenda comparativamente corta con explicaciones para los símbolos (en varios idiomas) y la representación gráfica es fácilmente entendida por expertos, estudiantes o ornitólogos aficionados por igual. Todos los tipos de contenido estructurado mencionados anteriormente se están volviendo cada vez más accesibles digitalmente hoy en día (como eContent […] cada vez más también a través de dispositivos móviles) y pueden - ocurren en textos digitales (como en la documentación técnica, la escritura científico-técnica, etc.), - deben combinarse entre sí o integrarse entre sí, - deben tener elementos lingüísticos similares (letras, sonidos, morfemas, etc.) o diferentes (como las representaciones no verbales), - deben formar elementos de contenido complejos, - deben integrarse o hacerse interoperables con otros en ciertas aplicaciones. Sin embargo, en la actualidad, la mayoría de los repositorios existentes de contenido estructurado no son consistentes dentro de un repositorio y a veces incluso contradictorios entre diferentes repositorios. En su mayoría, no se basan en metadatos y métodos de modelado de datos adecuados y, por lo tanto, no son integrables, no son fiables y están llenos de deficiencias. Esto es inaceptable, por ejemplo, en aplicaciones que apoyan a las personas con discapacidad, particularmente en nuestras sociedades envejecidas,
11Terminologija | 2012 | 19 de where more and more people have – sometimes multiple – impairments. It further does not allow their efficient use for eLearning purposes – which nuevo está perjudicando a las personas con discapacidad. En contraste con el contenido estructurado, un corpus puede describirse como contenido no estructurado, a saber, "un cuerpo de lenguaje que ocurre naturalmente" (McEnery, Xiao, Tono 2006), distinguiendo así un corpus de listas de palabras, diccionarios, bases de datos. Del mismo modo, un corpus de habla (o corpus hablado) es un repositorio de archivos de audio de habla (y transcripciones de texto). Estas definiciones son insuficientes cuando se trata de elementos no lingüísticos en los textos (como en la documentación técnica) y con respecto a los elementos de la comunicación no verbal (como los gestos, las imitaciones, etc.) que necesariamente acompañan a los datos hablados en la vida real. Si miramos, donde se pueden encontrar los elementos de contenido estructurado, reconocemos que la mayoría de ellos no se desarrollan como un objetivo en sí mismo, sino que son elementos necesarios de contenido no estructurado, como corpora de texto, corpora de habla, etc. Por lo tanto, la relación entre el contenido estructurado y los corpora, especialmente con el fin de hacer que el contenido estructurado que se encuentra en el contenido no estructurado sea productivo, por ejemplo, para el aprendizaje electrónico en forma de LO, debería ser investigada más a fondo. Hoy en día, el corpus más grande del mundo es Internet. Sin embargo, en la mayoría de los casos necesita textos de calidad asegurada para extraer LO […], lo que es un desafío para clasificar y clasificar la calidad de los textos y etiquetarlos de manera apropiada. 2. Referencias a las cuestiones de normalización Contenido estructurado Los documentos normativos actuales no solo comprenden las normas técnicas en el sentido tradicional, sino también las normas para la terminología, las pruebas, los productos, los procesos, los servicios, las interfaces, los datos, etc. Algunas son normas básicas que tienen una amplia cobertura o contienen disposiciones generales para un campo en particular, otras son normas metodológicas. La terminología estandarizada de un campo dado puede considerarse como estándar básico. Por consiguiente, las normas metodológicas relativas a los principios y métodos del trabajo terminológico y la normalización terminológica son básicas para todo el trabajo terminológico y la normalización terminológica. Además, los tipos de normas mencionados anteriormente sólo se refieren a algunos tipos comunes, y no se excluyen mutuamente; Por ejemplo, una norma de producto en particular también puede ser
12 Christian Galinski, Interoperabilidad del contenido como requisito previo para ser Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning considerada como una norma de ensayo si proporciona métodos de ensayo para las características del producto en cuestión. Como el contenido hoy en día es necesario para casi todo en ciencia y tecnología, los estándares relacionados con el contenido pueden caer bajo cualquiera de los tipos de estándares mencionados anteriormente. De acuerdo con la Guía ISO/IEC 2:2001, la normalización es una actividad para establecer, con respecto a problemas reales o potenciales, los procesos de for commonandrepeateduse, aimed at the achievementoftheoptimum degreeoforderinagivencontext. In particular, the activity consists of the formulación, emisión e implementación de normas. Los beneficios importantes de la normalización son la mejora de la idoneidad de los productos, procesos y servicios para sus propósitos previstos, la prevención de las barreras al comercio y la facilitación de la cooperación tecnológica. La preparación de las normas se basa en el consenso, que es un acuerdo general, caracterizado por la ausencia de oposición sostenida a cuestiones sustanciales por parte de cualquier parte importante de los intereses interesados y por un proceso que implica tratar de tener en cuenta las opiniones de todas las partes interesadas (a saber, la industria, la investigación, la administración pública, los consumidores) y reconciliar cualquier argumento contradictorio. Los esfuerzos de normalización se rigen por enfoques altamente sistémicos. En particular, las normas metodológicas están orientadas a soluciones genéricas, que también son apropiadas en diferentes aplicaciones. Esto también se aplica a las normas metodológicas relativas al contenido estructurado, como las normas para la transcripción y la transliteración, los modelos de datos, los formatos de intercambio, los identificadores de fuentes (ISO 12615:2004), sin mencionar la gestión de proyectos. También se aplica a algunos tipos de contenido estructurado estandarizado, como los códigos de idiomas (serie ISO 639), los códigos de escritura (serie ISO 15924:2004) y los códigos de país (serie ISO 3166). En ity of structured content have become a major issue in many fields. Therefore, standards concerning data quality, data administration, content management and workflows are increasingly becoming imperative. There are several technical committees dealing with various – more or los últimos años, los aspectos de la interoperabilidad genérica no interoperable - ISO/TC 37 Terminologyandotherlanguageandcontentresources […] los aspectos de la interoperabilidad del contenido, por ejemplo: - ISO/IEC-JTC 1/SC 32 Gestión e intercambio de datos (especialmente su Grupo de Trabajo 2 Metadatos); - ISO-IEC-JTC 1/SC 36 Tecnología de la información para el aprendizaje, la educación andtraining;
13Terminologija | 2012 | 19 - ISO TC 184 Sistemas de automatización e integración (especialmente su SC 4 Datos industriales); y - ISO/TC 46 Información y documentación. Las normas desarrolladas por estos comités aún no tienen en cuenta los requisitos específicos del aprendizaje electrónico con respecto a la interoperabilidad del contenido de las entidades de contenido estructurado a nivel de la semántica léxica. El ISOTC 37 fue el primer comité en tener plenamente en cuenta el multilingüismo (de hecho, como uno de los principios básicos de todos sus esfuerzos de normalización, que está orientado al concepto, es decir, independiente del idioma o multilingüe desde el principio). Otros comités técnicos han seguido su ejemplo, pero a menudo no respetan suficientemente este principio en la práctica. Hoy en día, incluso la lexicografía ha dado un giro hacia la orientación conceptual (= multilingüismo), como se puede ver en los productos de varios editores de diccionarios y diccionarios en línea a gran escala accesibles en Internet. Esto también debería aplicarse a los objetos de aprendizaje (LO) a nivel de la semántica léxica. Dado el hecho de que la interoperabilidad de los contenidos solo puede lograrse sobre la base de normas comúnmente aceptadas, a saber, las normas internacionales, es necesaria la cooperación y la coordinación de las actividades de normalización más importantes con respecto a la interoperabilidad de los contenidos. Nuevas actividades de normalización para varios aspectos de la interoperabilidad de contenidos - están impulsadas por desarrollos técnicos en la dirección de la creación de contenidos cooperativos participativos basados en la web a través de las TIC (en forma de redes sociales, plataformas de cooperación, comunicación móvil, etc.) por una parte; - tendrá un gran impacto en los diversos tipos de gestión de contenidos y conocimientos (especialmente en aplicaciones electrónicas, como el aprendizaje electrónico, la accesibilidad y la inclusión electrónicas, la salud electrónica, la gestión multilingüe de datos de productos en el negocio electrónico, etc.). So far the standardization efforts in ISO/TC 37 Terminologyandother languageandcontentresources with respect to structured content focused on methodology standards related to - Data categories (not quite identical with metadata) used in the conceptual design of the entries of structured content; - Data models and data modelling methods;
14 Christian Galinski, Interoperabilidad de contenidos como requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning previo para - Metamodelos para hacer interoperables los modelos de datos competidores; - Aplicaciones de lo anterior; y, en cierta medida, en la estandarización de ese tipo de contenidos, que son relevantes para el TC. Si se incluyen las ontologías en el sentido de la representación del conocimiento, los metamodelos mencionados anteriormente deben extenderse hacia las metaontologías e incluso un lenguaje de metaontología (ISO/CD 17347:2012), para proporcionar la posibilidad de hacer que las ontologías sean interoperables. En este contexto, una ontología se ve como una "especificación formal y explícita de una conceptualización compartida" (Gruber, junio de 1993), que representa un vocabulario y una taxonomía compartidos que modelan un dominio, es decir, la definición de conceptos y otros objetos de información, así como sus propiedades y relaciones. Un lenguaje de ontología […] diferente de la mera representación del conocimiento […] proporciona un metamodelo para tales especificaciones formales y explícitas de una conceptualización compartida. Casi todos los TC de la ISO y la IEC estandarizan los términos y definiciones más importantes de su respectivo dominio o tema. Algunos también estandarizan otros tipos de recursos de lenguaje y contenido. 3. Volúmenes de contenido estructurado: terminología Según ELRA (Asociación Europea de Recursos Lingüísticos), los recursos lingüísticos son los siguientes: - cuerpos de texto, - cuerpos de habla, - (datos lexicográficos y) terminologías. En un artículo reciente (Galinski, Reineke 2011), se intentó cuantificar los volúmenes de entradas lexicográficas y terminológicas en unos 150 millones. El número de sustancias químicas identificables por sí solo ha superado la marca de 60 millones en 2011. A la luz de estas cifras, la increasing number of domains or subjects. The lexis of LGP in the highly developed languages may comprise up to 500,000 lexemes (including a considerable share of terminology). However, the total number of scientifictechnical concepts across all domains or subjects may well comprise ~100– interoperabilidad de los contenidos es un requisito previo para evitar una gran duplicación de esfuerzos; - El enfoque ISO/TC 37 se está volviendo cada vez más esencial; L6 定休日
21Terminología | 2012 | 19 En la figura anterior, el onyomi kyû (como L1 para K1 休) puede llevar cualquier significado de las lecturas kunyomi, pero kyû solo se puede usar para el kanji, si ocurre en combinaciones de kanji (o que es una excepción si el kanji se mantiene solo como una abreviatura). Kyû como LO sólo tendría sentido, si un aprendiz quiere aprender todos los kanji que tienen el onyomi kyû por alguna razón u otra. Hay muchos kanji, donde el onyomi representa uno o más conceptos y, por lo tanto, cada kanji+onyomi puede tomarse como un LO. L2 […]休む yasumu, L3 […]休まる yasumaru, L4 […]休める yasumeru, L5 […]休み yasumi representan diferentes […] aunque semánticamente relacionadas […] lecturas japonesas kunyomi del kanji en cuestión, que más allá de su naturaleza derivada tienen un significado idiomático que califica a cada uno de ellos como LC-LO individual propio. Sin embargo, si un LO de este tipo tiene más de un significado, cualquiera de estos representa en principio un LC-LO. 休 en las lecturas de kunyomi sólo significa el tallo yasu. Sin embargo, hay otros tallos que se leen yasu con un significado diferente escrito por diferentes kanji, como 安 en yasui 安い, que podría llevar al aprendiz a otros kanji LO que tienen la lectura japonesa yasu. teikyûbi, L7 一休みする hitoyasumi suru y L8 休日 kyûjitsu representan el significado de los compuestos de kanji (binomas, trinomas, etc. que tienen o no tienen terminaciones) con onyomi, kunyomi o lectura mixta. Por lo tanto, el elemento central del HC-LO K1 (休 kyû) de esta tarjeta flash kanji puede combinarse con dos o más otros kanji para formar LO lexicográficos, como L6 teikyûbi, L7 hitoyasumi suru y L8 kyûjitsu. Si alguno de ellos tiene más de un significado, tendría que considerarse como dos o más LO; - apunta a otros kanji HC-O, como K2 一, K3 定, K4 日; - estar vinculado a kanji parecidos, como K5 体 y K6 伏 u otros kanji de relevancia histórica u otra. Cualquiera de los tipos de LO mencionados anteriormente debería haber previsto un espacio reservado para: - pronunciación (o pronunciaciones, porque puede haber dos o más; si hay homófonos, los punteros deben conducir a la respectiva LO); - lenguaje de señas y otros tipos de medios de comunicación alternativa y aumentada (CAA). El lenguaje y la escritura japoneses altamente complicados se han elegido para ilustrar el método de composición y descomposición de LO a nivel de semántica léxica. Tomando japonés, un lenguaje complicado con un com-
22 Christian Galinski, Interoperabilidad de contenido como requisito previo Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning para el guión plicado, como base para diseñar los modelos de datos de LO para un repositorio de LO a nivel de semántica léxica tiene ventajas. Puede facilitar el tratamiento de fenómenos en el mundo de los símbolos no lingüísticos, como en la siguiente figura. En algunos países incluso hay variantes de la misma señal de tráfico, dependiendo de dónde se utilice en términos de posición en la carretera o si es una señal de tráfico tradicional o en una señal de mensaje variable (VMS) (Galinski 2011). La mayoría de los kanji japoneses aparecen, a menudo con lecturas irregulares, en denominaciones, es decir, nombres propios de personas, lugares, organizaciones, edificios y otros objetos. Especialmente en las lenguas con sistemas de escritura no latinos, la escritura y lectura correctas de los nombres propios a menudo plantean grandes dificultades al aprendiz. Por no hablar de la clasificación correcta de los nombres en tales sistemas de escritura. Volando sobre Siberia a China se puede leer en el monitor de vuelo el nombre chino de Novosibirsk que comienza con 新xin, que significa "nuevo", traduciendo el elemento de nombre novo al chino. El resto del nombre sibirsk=Siberia se transcribe con caracteres chinos. Por lo tanto, los nombres propios pueden tener que ser transcritos o (en parte o en su totalidad) "traducidos". En cualquier caso, los nombres propios, al igual que las entidades terminológicas y lexicográficas, pueden ser LO importantes y pueden tratarse con el mismo enfoque descrito anteriormente. El enfoque de la ISO/TC 37 puede servir de modelo para todo tipo de contenido estructurado. Pero, como ya se ha mencionado anteriormente, el Registro de Categorías de Datos para Recursos Lingüísticos (DCR) (ISO 12620:2009) de la ISO/TC 37 debería y de hecho puede extenderse a otros tipos de contenido estructurado más allá de los datos lexicográficos y terminológicos, así como a nuevas necesidades de aplicación electrónica, como para fines de aprendizaje electrónico y accesibilidad electrónica. Para aquellos que están asustados por la complejidad, puede haber una […] no tan nueva, pero en realidad rara vez aplicada […] salida: federación de recursos
23Terminologija | 2012 | 19 de contenido estructurado. Aplicando la filosofía de Dublin Core, un cierto estrato de categorías de datos (que son las mismas para diferentes tipos de contenido estructurado) debe estandarizarse e implementarse en cualquier recurso, garantizando así la interoperabilidad del contenido. El grado completo de complejidad no se implementa en un superrecurso, sino que se distribuye en varios recursos de diferentes tipos de contenido estructurado. Esta forma de garantizar la interoperabilidad de los contenidos que tienen la reutilización de entidades de estructura content in mind still needs further investigation. 6. FUTURE STANDARDIZATION NEEDS A la luz de lo anterior, la ISO/DCR puede necesitar categorías de datos adicionales. ISO/DCR contiene hoy las categorías de datos básicas y muchas categorías de datos extendidas para datos terminológicos y lexicográficos. El modelo de datos terminológicos, así como el modelo de datos lexicográficos, se basan en ellos. El uso de categorías de datos (no del todo lo mismo que los metadatos o los elementos de datos) parece ser muy apropiado para el LO at the level of lexical semantics in particular. Besides, data categories can be distinguished into primary data categocontenido estructurado en general y para las categorías de datos secundarios (ISO 10241-1:2011) (o incluso categorías de datos terciarios). Las categorías de datos primarios se refieren a los datos básicos, como el término, la definición, etc. Las categorías de datos secundarios se refieren, entre otros, a atributos, como preferido, admitido o obsoleto (término). Las categorías de datos terciarios se refieren a información adicional (si no se consideran categorías de datos secundarios), como las que se refieren a los elementos de la referencia a la fuente de los datos terminológicos (aplicable también a otro tipo de contenido estructurado) tal como se describe en la norma ISO 12615:2004 Referencias bibliográficas e identificadores de fuentes para el trabajo terminológico. Las categorías de datos primarios de acuerdo con la ISO 10241-1 adaptadas a las LO son (en comparación con el cuadro 1 del anexo 1): - número de entrada […] único para la entrada de la base de datos de las LO; - (categoría de metadatos:) representación designativa de contenido estructurado → es decir, términos, que también cubren sinónimos, homónimos, etc., que se ampliarán a cualquier tipo de representación designativa de contenido estructurado, cada uno de los cuales debería tener su propio ID de entidad, extendiendo así la autonomía del término a la autonomía de representación; - (categoría de metadatos:) representación descriptiva de contenido estructurado → es decir,
24 Christian Galinski, Contentinteroperabilityasaprerequisitefor Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning towards any kind of descriptive representation of structured content definiciones, explicaciones, contextos, etc. que se ampliarán incluyendo - (metadata category:) example → if necessary to be split up into difrepresentaciones descriptivas no verbales; tipos de ejemplos; - (categoría de metadatos:) nota → si es necesario dividirse en diferentes tipos de nota; - (metadata category:) source → if necessary to be split up into different types of source and their respective conditions for use. Si la entidad de representación designativa del contenido estructurado es verbal, se aplica la repetibilidad por idioma, así como la repetibilidad dentro del idioma en el caso de sinónimos (cada uno de los cuales también debe obtener su propio ID de entidad). Si la entidad de representación designativa del contenido estructurado no es verbal, se aplica la repetibilidad por campo de uso o aplicación. También puede haber un tipo de repetibilidad dentro del campo de aplicación de uso (como las señales de tráfico de límite de velocidad dependiendo de su ubicación a lo largo de la carretera o en el medio de una autopista en algunos países, o señales de tráfico del mismo significado que difieren en varios estados de los Estados Unidos). Hay variaciones de la lengua de señas dentro de la misma lengua de señas, así como de Blissymbols. Lo anterior muestra que la repetibilidad debe ser de acuerdo con la "comunidad de uso" (es decir, el lugar en la localización) en lugar de de acuerdo con el lenguaje. Por supuesto, la comunidad de uso también puede ser una comunidad lingüística, pero la repetibilidad por y dentro de los lugares proporciona más flexibilidad para cubrir todos los fenómenos encontrados en el contenido estructurado. 7. Conclusiones En los últimos diez años, las limitaciones de la interoperabilidad semántica desde la perspectiva de la informática se han vuelto obvias. Además de la interoperabilidad técnica (es decir, relacionada con el hardware y el software) y organizativa, la interoperabilidad semántica debe comprender la interoperabilidad sintáctica, conceptual y pragmática. La interoperabilidad de contenidos proporciona un enfoque aún más amplio y genérico con respecto a las representaciones comunicativas de la información y el conocimiento, y también tiene en cuenta la reutilizabilidad y la reutilización de entidades de diferentes tipos de contenido estructurado (Galinski, Van Isacker 2010). La reutilización puede incluir, por ejemplo, la adaptación de las entradas terminológicas existentes.
25Terminología | 2012 | 19 - como objetos de aprendizaje (LO) en el aprendizaje electrónico o - para ser utilizados por personas con discapacidad (PwD) para comunicaciones generales munication and of course also for learning purposes. International Standards for content interoperability are the prerequisite for: - avoiding a huge duplication of efforts, - developing methods (incl. certification) and devices to assure content quality, - introducir ampliamente la interoperabilidad de contenidos en los schemes, - enabling many eApplications to re-use and re-purpose existing contenidos estructurados de educación y formación. Cada vez más, todos los tipos de contenido estructurado deben ser reutilizables y reutilizables en todas las plataformas del sistema. Además, cada vez más métodos cooperativos y distribuidos basados en la web para el desarrollo de contenidos deben implementarse en cooperación con campos interrelacionados bajo un enfoque integrador. A este respecto, el uso intensivo de las tecnologías móviles tendrá un impacto enorme: el contenido electrónico se está convirtiendo en contenido móvil. (contenido móvil). En el curso de estos desarrollos, valdría la pena desarrollar relaciones metodológicas y de diseño de sistemas más fuertes entre la gestión de recursos de contenido y la lingüística de corpus para hacer un mejor uso de - corpora existentes y futuros con características mejoradas, por ejemplo, para extraer elementos individuales de contenido estructurado de manera sistemática (también teniendo en cuenta las frecuencias de ocurrencia dependiendo del dominio, el registro de nivel y la aplicación para mejorar la extracción de objetos de aprendizaje en contexto); - elementos de contenido estructurado en repositorios existentes y futuros con el fin de mejorar el procesamiento de corpora para nuevos propósitos adicionales, como la didáctica; - los métodos existentes y emergentes, así como las herramientas en campos que hasta ahora muestran un bajo grado de interrelación e integración metodológica, en aras de los beneficios mutuos; - crear y mantener sistemáticamente (y mediante esfuerzos participativos) objetos de aprendizaje, en particular para CLIL (aprendizaje integrado de contenido y lenguaje).
26 Christian Galinski, La interoperabilidad de contenidos como requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning Efforts in standardization (and cooperation in standardization) should be stepped up. The proper integration of AAC requirements in the data previo para el modelado de contenidos estructurados beneficiaría no sólo a los miembros de la sociedad que lo necesitan más urgentemente, sino en última instancia a todos. Esto requiere un mayor énfasis en las tecnologías de asistencia pertinentes en la educación y la formación relacionadas con las TIC lo antes posible. Los participantes en la Conferencia ICCHP 20103 confirmaron que la formación y los estudios formales existentes no son suficientes, incluso si están certificados en virtud de determinados sistemas de certificación y atestación, con respecto a las habilidades y cualificaciones necesarias para familiarizarse con las cuestiones relacionadas con la interoperabilidad global de contenidos y, en particular, con la accesibilidad y la inclusión electrónicas. La "Recomendación sobre los principios de desarrollo de software y contenidos 2010" (véase el anexo 2) fue formulada en un taller especial en el ICCHP 2010 y posteriormente aprobada por varios comités técnicos en el campo de la normalización, y en 2012 por el Grupo de Gestión (MoU/MG) del Memorando de Entendimiento ITU-ISO-IEC-UNECE sobre la normalización de negocios electrónicos. REFERENCES Galinski Ch. 2011: A sign equals thousand words. Consistency of traffic / road signs and verbal messages. – Infrastructureandsafetyinacollaborativeworld.Roadtrafficsafety. Evangelos Bekiaris, Marion Wiethoff, Evangelia Gaitanidou eds., Heidelberg, Dordrecht, London, New York: Springer, 263–284. Galinski Ch., Reineke D. 2011: Vor uns die Terminologieflut. – eDITion 2/2011, 8–12. Galinski Ch., Van Isacker K. 2010: Standards-based Content Resources: A Prerequisite for Content Integration and Content Interoperability. – Computershelpingpeoplewithspecialneeds.12thInternationalConference, ICCHP2010,Vienna,Austria,July2010.Proceedings, Part I., K. Miesenberger e.a. (eds.), Berlin, Heidelberg, New York: Springer, 573–579. Gonnissen L., Mornie G. 1983: Bestimmenunderkennenleichtgemacht.Vögel.Diewichtigstenheimischen Arten [Birds of Europe], translated from French by Sieglinde Summerer and Gerda Kurz, Zürich/Köln: Benziger Verlag. Gruber T. R., June 1993: A translation approach to portable ontology specifications (PDF). KnowledgeAcquisition5 (2), 199–220. – http://tomgruber.org/writing/ontolingua-kaj-1993.pdf. Hodges M., Okazaki T. Japanesekanjiflashcards. Series 2, volume 1, Tokyo: White Rabbit Press, s.a. Kitazawa T., Windhab R., Galinski Ch. 2007: UntersuchungvonFlashcardsystemen(elektronischeLernkarteien)fürCALL(computergestütztenSpracherwerb)undCASPLL(computergestütztenFachsprachenerwerb) aufAnfängerniveau.MitdemSchwerpunktaufJapanisch-LernenzumErwerbeinerhohenlexikalischen Sprachkompetenz–ohnedaslangfristigeZieleinermehrsprachigenFlashcard-Lernplattformzuvernachlässigen. McEnery T., Xiao R., Tono Y. 2006: Corpus-basedLanguageStudies:AnAdvancedResourceBook, London/ New York: Routledge. Schmitz K.-D. 2006: Data modeling: From terminology to other multilingual structured content. – TSTT 2006.InternationalConferenceonTerminology,StandardizationandTechnologyTransfer.Proceedings.Beijing,China,2006-08-25/26. Yuli Wang, Yu Wang, Ye Tian (eds.), Beijing: Encyclopedia of China Publishing House. 3 12th International conference on computers helping people with special needs (ICCHP 2010), Vienna, Austria, July 2010
27Terminologija | 2012 | 19 REFERENCED StaNDaRDS ISO/IEC Guide 2:2004 Standardizationandrelatedactivities–Generalvocabulary. ISO 639 (series) Codesfortherepresentationofnamesoflanguages. ISO/IEC 2382-36:2008 Informationtechnology–Vocabulary – Part 36: Learning,educationandtraining. ISO 3166 (series) Codesfortherepresentationofnamesofcountriesandtheirsubdivisions. ISO/TS 8000-1:2011 Dataquality – Part 1: Overview. ISO 10241-1:2011 Terminologicalentriesinstandards – Part 1: Generalrequirementsandexamplesofpresentation. ISO 10241-2:2012 Terminologicalentriesinstandards – Part 2: Adoptionofstandardizedterminologicalentries. ISO 12615:2004 Bibliographicreferencesandsourceidentifiersforterminologywork. ISO 12620:2009 Terminologyandotherlanguageandcontentresources–Specificationofdatacategoriesand managementofaDataCategoryRegistryforlanguageresources. ISO 15924:2004 Informationanddocumentation–Codesfortherepresentationofnamesofscripts. ISO/CD 17347:2012 OntologyIntegrationandInteroperability(OntoIOp)– Part 1: TheDistributedOntology Language(DOL). ISO/DIS 22274:2011 Systemstomanageterminology,knowledgeandcontent–Concept-relatedaspectsfordevelopingandinternationalizingclassificationsystems. IEEE (Institute of Electrical and Electronics Engineers, Inc.). LOM standard 1484.12.1-2002 DraftStandardforLearningObjectMetadata. tURINIO SVEIKUMO BŪtINYB NaUDOJANt StRUKtŪRIZUOtO TURINIO VIENETUS KaIP ELEKTRONINIO MOKYMOSI OBJEKTUS PaKaRtINAI aR PaGaLIt KOKI PaSKIRTEA Daug Viena turinio users' platform, siūlančių vartotojų daugelių arelio lių, bet vis darinio irinio metodologio, turgiotomo į gerinio atsižvelgo, etc. Tokių platformų skaičius augs ir toliau, nes vis daugiau išteklių kuriama ir naudojama aplicando nepakankamai veiksmingus metodus. Kad būtų užtikrinta turinio kokybė, o pirmiausiai patikimumas, reikalingas įvairių priemonių derinimas (standartai, informacinės ir komunikacinės technologijos, sertifikavimas ir kt.). Elektroniniam mokymuisi svarbus skirtumas tarp bendrosios kalbos (angl. LGP) ir specialiosios kalbos (angl. LSP). El lenguaje de la lengua es muy diferente de la lengua inglesa. Tam, kad būtų galima sukurti daugiakalbius, daugiamodalinius, daugelio paskirčių mokymosi objektų duomenų modelius, leksinės semantikos lygmeniu būtina tobulinti ribotas dabartinių duomenų bazių galimybes. Reikėtų daugiau dėmesio skirti: a) los datos presentados en las bases de la lengua bendrosa y del tipo de registro de la lengua especializada; b) los datos de los registros de los elementos verbales de las tarifas de los servicios; c) pateikimui nežodinių žymenų ir atvaizdų, kurie, atsižvelgiant į taikymo sritį, gali būti tokie pat svarbūs kaip žodiniai žymenys ir net labiau už juos pageidautini; las frases especiales del idioma; f) las comunicaciones no habilitadas a las necesidades. d) leksinių vienetų dėmenims, pavyzdžiui, morfologiniams elementams; e) didesniems leksiniams vienetams, pavyzdžiui, bendrosios kalbos kolokacijoms ar Straipsnyje pateikiami argumentai dėl žemiau išvardytų dalykų būtinumo: - estándares, en los que se deban presentar requisitos de garantía de la mundialización del turismo, incluidos los requisitos del mokymuisi keliamus electrónico;
28 Christian Galinski, Interoperabilidad de contenidos como requisito previo para la Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning coordinación de las estrategias, la aplicación de los estándares de los skatinancios (pavy, pasitelkiant sertifikavimą); - los instrumentos para garantizar el mantenimiento de los estándares de los sistemas de planificación. Estos estándares y medidas podrían ayudar a suvaldyti ya ahora más ar menos chaotišką turinio plėtrą (sukeliančią didžiulį veiklos dubliavimą) ar bent jau leistų aiškiai išskirti patikimo turinio saugyklas. Gauta el 20 de marzo de 2012 Christian Galinski. ¿Quién es usted? Centro Internacional de Información para la Terminología (Infoterm) Gymnasiumstrasse 50, 1190 Viena, Austria El correo electrónico es [email protected] Stella Blanca Giraldo Pérez (nacido en España) Centro Internacional de Información para la Terminología (Infoterm) Gymnasiumstrasse 50, 1190 Viena, Austria Envío de correo electrónico [correo electrónico protegido]
29Terminología | 2012 | 19 Anexo I, cuadro 1: Descripción general de las categorías de datos de una entrada terminológica normalizada de acuerdo con la norma ISO 10241-1 Primary data categoriesaSecondary data categoriesb (including administrative data and usage (información) Name Mandatory/optional; número de entrada repetible o no repetible ... Obligatorio; En el orden de las reglas del término o términos preferidos, el organismo repeatable de normalización admitido: término o términos, termc (or string of five halftérmino o términos obsoletos, por ejemplo, gramatical repetible parte del código de la ambos uso geográfico género, número, obligatorio; información lengua hablada o del código de escritura, o (por ejemplo, código de país) pronunciación símbolo de letra de estatus normativo ... Opcional (a menos que el código letra sea un código de ambos estandarizados); uso o símbolo de la lengua de la escritura internacional, o geográfico repetible (por ejemplo, código de país) símbolo gráfico de estado normativo ... Opcional (a menos geográfico esté estandarizado ejemplo, código de país); definición de estatus normativo que el símbolo gráfico de uso a nivel nacional entre (por repetible ... Obligatoria (a menos que se utilice un no dominio o representación verbal por tema respectivo); representación no verbal no repetible repetible ... Obligatoria tema, si es necesaria una convención dentro del dominio o
30 Christian Galinski, Interoperabilidad de contenidos como requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning Primary data categoriesaSecondary data categoriesb (including administrative data and usage previo para la información) Name Mandatory/optional; repeatable/non- (si existe […] complementando una definición o utilizada en convención dentro del ámbito o tema respectivo); ejemplo no repetible ... opcional; repetible […] nota de entrada (incluida la nota opcional); repetible […] a un término, un símbolo de letra, un lugar de una definición por símbolo gráfico, una definición, un contexto, una ejemplo, una sección lingüística determinada de una entrada terminológica multilingüe o toda la entrada terminológica) ... representación no verbal, por Opcional (a menos que la entrada terminológica de información adicional (incluida la entrada terminológica de número de cláusulas, la entrada terminológica no verbal) o cualquier sección lingüística externa autorizada código para los nombres de lengua de acuerdo con la norma ISO 639, si es necesario en combinación con aunque otras designaciones verbales, como cualquier término sinónimo existente, variantes, formas fuente o relacionada con la fuente, del término, el símbolo de la letra, una sección lingüística de un término, de una fuente múltiple); a Todas las categorías de datos primarios, excepto la categoría de datos "número códigos para los nombres de países de acuerdo con la norma ISO 3166 o códigos para los nombres de completas, formas abreviadas, homógrafos, antónimos, así como términos en otros idiomas se incluyen en como el número de página, el símbolo gráfico, la definición, la representación multilingüe, el contexto del de entrada", son repetibles por idioma y las categorías de datos primarios se complementarán con un escrituras de acuerdo con la norma ISO 15924. c Por simplicidad, solo se especifica "término" en el cuadro 1, este cuadro. therefore, apply to multilingual standards. Additional rules for terminological entries in a multilingual terminology standard are given in Clause 7. b All secondary data categories are optional except where they are crucial for disambiguation (…) and in cases where multilingual information is included in one terminological entry, in which case the