scieee AI-readable full text Open interactive document viewer

Content interoperability as a prerequisite for re-using and re-purposing items of structured content as learning objects in eLearning – Seen under a standardisation perspective

Christian Galinski; Blanca Stella Giraldo Pérez

Full text

6Christian Galinski, Interoperabilidade de conteúdos como pré-requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  para a Interoperabilidade de conteúdos como pré-requisito para a reutilização e reaproveitamento de itens de conteúdo estruturado como objetos de aprendizagem em eLearning […] Visto sob uma perspectiva de padronização CHRISTIAN GALINSKI, BLANCA STELLA GIRALDO PÉREZ (PPE). - (DE) Senhor Presidente, lembro que a Comissão já tinha apresentado uma proposta de directiva sobre a protecção dos trabalhadores em caso de acidentes de viação. Infoterm PALAVAS-CHAPELAS: conteúdo estruturado e conteúdo não estruturado, representações verbais e não verbais, denominações, morfologia e morfemas, fraseologia e fraseomas, colocações e termos de várias palavras, objetos de aprendizagem de alta complexidade (HC-LO) e objetos de aprendizagem de baixa complexidade (LC-LO), linguagem para fins gerais (LGP) e linguagem para fins especiais (LSP), pessoas com deficiência (PwD) e tecnologias de assistência, normas e normalização, certificação, modelos de dados e modelagem de dados. 1.Conteúdo estruturado O "conteúdo" aqui é visto como conteúdo estruturado no nível da semântica léxica que compreende representações linguísticas e não linguísticas de conceitos (entendidos na teoria da ciência como um tipo de "objetos imateriais"). Essas representações podem ser designativas (como designações em terminologia: compreendendo termos, símbolos e denominações) ou descritivas (como vários tipos de definições, explicações ou representações não verbais) ou híbridas. Até agora, as designações e representações não verbais de conceitos, bem como as denominações (ou seja, nomes próprios que representam conceitos individuais) têm sido subrepresentados na teoria e metodologia da terminologia. Mas podem ser muito importantes para a concepção de objetos de aprendizagem (LO) em certos domínios ou campos de aplicação - para não mencionar a aprendizagem de línguas e a tradução. Igualmente importantes para a concepção de LO multilíngues, multimodais e multiuso são: a) semelhanças entre as entradas LGP e LSP: - A representação designativa da entrada (lemma LGP ou termo LSP) pode ser uma palavra, uma palavra composta ou uma entidade de várias palavras; - A representação designativa verbal pode ser complementada por uma representação designativa não verbal (p. ex., gesto, imitação, Blisd) componentes de entidades de conteúdo estruturado, tais como os morfemas de representações designativas verbais ou elementos de uma definição, explicação, contexto, etc. Devem ser marcados para facilitar a referência cruzada ou a reutilização como outra LO (por exemplo, prefixos e referências cruzadas aos elementos relevantes da entidade respectiva). Neste caso, cem símbolos básicos representam um conceito, que podem ser compostos juntos para gerar novos símbolos que representam novos conceitos. Os blissymbols não 7Terminologija | 2012 | 19 symbolics1 etc.), ou […] se necessário […] até mesmo ser substituído por ele (p. ex., gráficoical or other non-verbal symbol); - Each entry representing one concept has a unique entry identifier (que pode, por exemplo, apontar para ocorrências em corpora de texto); Em entradas LSP, cada representação designativa deve ter seu próprio identificador de item, o que, entre outros, tornaria possível rastrear a mudança conceitual ao longo do tempo; em entradas LGP, cada significado de uma representação designativa deve ter seu próprio identificador de item, o que torna multilíngue se aplica a LSP e LGP, bem como a entries possible, ° In analogy to termautonomy in terminology, representationautonomy representações não verbais; representações LGP descritivas (incluindo explicações, contextos, etc.) podem ser tratadas de forma estrita em analogia com as de LSP (explicações, contextos, etc.), mas excluem definições no sentido do conceito; pode haver campos adicionais para notas, exemplos, etc. b) pronúncias de elementos verbais de entidades de conteúdo estruturado, que devem ser previstas em qualquer entrada, pelo menos potencialmente. c) representações designativas não verbais e representações descritivas não verbais, que devem ser previstas em qualquer entrada, pelo menos potencialmente, porque podem ser […] dependendo do domínio ou do campo de aplicação […] igualmente importantes para as representações verbais e, por vezes, até mesmo preferidas. correspondem de modo algum aos sons de qualquer língua falada. suffixes in medical nomenclature). e) larger entities of structured content, such as idioms, LGP collocations or LSP phrasemes, as well as metaphors, which can be formally treated similar to verbal designative representations in LGP (with proper 1 Blissymbolics is an ideographic writing system for cognitively impaired persons. Each of the several 8Christian Galinski, Interoperabilidade de conteúdo como pré-requisito para o Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  nível, a diferenciação mais refinada do acima é necessária na linguística de corpus, mas provavelmente não para LO. Também pode ser de menor importância, independentemente de o significado ser não-compositivo ou compositivo. Existem ferramentas na linguística de corpus para identificar e extrair também tais entidades maiores de conteúdo estruturado. f) o fornecimento de campos de reserva de lugar ou links para as respectivas representações designativas para PwD, como em Braille, linguagem de sinais ou Blissymbolics. Os recursos de conteúdo estruturados ao nível da semântica léxica até agora foram vistos como compreendendo principalmente dados lexicográficos, dados terminológicos e outros tipos de representações de conceitos, incluindo alguns não verbais, como símbolos visuais (por exemplo, símbolos públicos). Mas pode haver também símbolos acústicos audíveis, símbolos táctiles hápticos e outros, que, na gestão da terminologia, podem ocorrer como designações ou até mesmo descrições de conceitos (como representações não verbais (ISO 10241-1:2011). Podem ser necessárias informações adicionais […] e as respectivas categorias de dados […] para uma abordagem sistemática na gestão do conteúdo estruturado em geral. À luz do acima mencionado, podemos diferenciar os tipos de conteúdo estruturado no nível da semântica léxica da seguinte forma: - dados lexicográficos, tais como: […] entidades de palavras (incluindo compostos, etc.), […] morfemas (morfologia), […] colocações, metáforas; - Terminologias e tipos semelhantes de recursos linguísticos e outros recursos de conteúdo, tais como: […] nomenclaturas, taxonomias, tipologias, glossários, vocabulários, etc., […] morfemas terminológicos (morfologia), […] frases terminológicas (fraseologia), […] nomes próprios de todos os tipos utilizados, por exemplo, como itens em diferentes kinds of directories, ° graphical symbols and other non-verbal designations, ° (product) properties, characteristics, attributes etc.; - Thesauri, classification schemes (ISO/DIS 22274:2011), keywords and other kinds of documentation languages (or controlled vocabularies); - Entradas enciclopédicas (de conhecimento), que abrangem, entre outros: ° knowledge-enriched terminological entries, 9Terminologija | 2012 | 19 Nomes próprios (explicados) e outros tipos de dados estreitamente relacionados com nomes próprios; - Ontologias, mapas temáticos e outros tipos de sistemas de estruturação do conhecimento. Tal como na terminologia, qualquer um dos outros tipos de conteúdo estruturado listados acima pode ter - (uma ou mais) representações fonéticas, representações da linguagem de sinais, etc. ; - representações designativas gráficas e outras não verbais, bem como representações descritivas não verbais (algumas além de uma representação verbal, outras criadas como representações não verbais independentes das verbais). Os tipos não verbais de conteúdo estruturado são particularmente significativos em aplicações como o eLearning e de importância vital na comunicação: - com e entre PwD (diretamente ou através de dispositivos de TIC que funcionam como tecnologias de assistência), - entre PwD e os dispositivos que usam, e - entre estes dispositivos. Os projetistas de sinais de trânsito estão chamando os elementos dos sinais de trânsito de "morfologia" (em analogia com os morfemas na linguística). O mesmo poderia ser aplicado a outras representações designativas não verbais. Já foram desenvolvidos métodos de busca para procurar representações gráficas de imagens inteiras por meio de elementos individuais contidos nelas. A figura a seguir mostra um exemplo da "morfologia" de símbolos gráficos (neste caso, um sinal de trânsito): (de Schmitz[…] Presentation at TSTT 20062; ver Schmitz 2006) 2 3a Conferência Internacional de Terminologia, Padronização e Transferência de Tecnologia (TSTT 2006), Beijing, China, 25-26 August 2006 10 Christian Galinski, Contentinteroperabilityasaprerequisitefor Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  Em certos domínios (por exemplo, em nomenclaturas biológicas) existem até mesmo exemplos de representações descritivas não verbais que substituem longas definições ou outras descrições de conceitos, que poderiam ser úteis também para fins de eLearning: (de Gonnissen e Mornie 1983, ave no 50) Só precisa de uma legenda comparativamente curta com explicações para os símbolos (em várias línguas) e a representação gráfica é facilmente compreendida por especialistas, estudantes ou ornitólogos amadores. Todos os tipos de conteúdo estruturado acima mencionados estão se tornando cada vez mais acessíveis digitalmente hoje (como o eContent […] cada vez mais também através de dispositivos móveis) e podem - ocorrem em textos digitais (como na documentação técnica, na escrita científico-técnica, etc.), - devem ser combinados uns com os outros ou incorporados uns nos outros, - devem ter elementos linguísticos semelhantes (letras, sons, morfemas, etc.) ou diferentes (como representações não verbais), - devem formar elementos de conteúdo complexos, - devem ser integrados ou interoperáveis com outros em certas aplicações. Atualmente, no entanto, a maioria dos repositórios existentes de conteúdo estruturado não é consistente dentro de um repositório e, às vezes, até mesmo contraditória entre diferentes repositórios. Na sua maioria, não se baseiam em metadados e métodos de modelagem de dados adequados e, portanto, não são integráveis, não são fiáveis e estão cheias de deficiências. Isto é inaceitável, por exemplo, em aplicações que suportam PwD, particularmente nas nossas sociedades em envelhecimento, 11Terminologija | 2012 | 19 where more and more people have – sometimes multiple – impairments. It further does not allow their efficient use for eLearning purposes – which novamente está desvantajando PwD. Em contraste com o conteúdo estruturado, um corpus pode ser descrito como conteúdo não estruturado, ou seja, "um corpo de linguagem que ocorre naturalmente" (McEnery, Xiao, Tono 2006), distinguindo assim um corpus de listas de palavras, dicionários, bancos de dados. Da mesma forma, um corpus de fala (ou corpus falado) é um repositório de arquivos de áudio de fala (e transcrições de texto). Estas definições são insuficientes no que diz respeito a elementos não linguísticos em textos (como na documentação técnica) e no que diz respeito a elementos de comunicação não verbal (como gestos, imitações, etc.) que necessariamente acompanham os dados falados na vida real. Se olharmos para onde os itens de conteúdo estruturado podem ser encontrados, reconhecemos que a maioria deles não são desenvolvidos como um objetivo em si mesmo, mas são elementos necessários de conteúdo não estruturado, como corpora de texto, corpora de fala, etc. Por conseguinte, a relação entre o conteúdo estruturado e os corpora - especialmente com vista a tornar o conteúdo estruturado que ocorre no conteúdo não estruturado produtivo, por exemplo, para o eLearning na forma de LO - deve ser investigada mais a fundo. Hoje, o maior corpus do mundo é a Internet. No entanto, na maioria dos casos, precisa de textos de qualidade assegurada para extrair LO […], o que é um desafio para classificar e classificar a qualidade dos textos e marcá-los de forma apropriada. 2. Referências a questões de normalização Conteúdo estruturado Os documentos normativos de hoje não compreendem apenas normas técnicas no sentido tradicional, mas também normas para terminologia, ensaios, produtos, processos, serviços, interfaces, dados, etc. Algumas são normas básicas que têm uma ampla cobertura ou contêm disposições gerais para um domínio particular, outras são normas metodológicas. A terminologia padronizada de um determinado campo pode ser considerada como padrão básico. As normas metodológicas relativas aos princípios e métodos de trabalho terminológico e de normalização terminológica são, consequentemente, básicas para todo o trabalho terminológico e para a normalização terminológica. Além disso, os tipos de normas acima mencionados referem-se apenas a alguns tipos comuns e não são mutuamente exclusivos; Por exemplo, uma determinada norma de produto pode também ser 12 Christian Galinski, Interoperabilidade do conteúdo como pré-requisito para ser Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  considerada como uma norma de ensaio se fornecer métodos de ensaio para as características do produto em questão. Como o conteúdo hoje é necessário para quase tudo na ciência e na tecnologia, os padrões relacionados ao conteúdo podem se enquadrar em qualquer um dos tipos de padrões acima mencionados. De acordo com o Guia ISO/IEC 2:2001, a normalização é uma atividade para estabelecer, no que diz respeito a problemas reais ou potenciais, processos de formulação, emissão e for commonandrepeateduse, aimed at the achievementoftheoptimum degreeoforderinagivencontext. In particular, the activity consists of the implementação de normas. Os benefícios importantes da normalização são a melhoria da adequação de produtos, processos e serviços aos seus propósitos, a prevenção de barreiras ao comércio e a facilitação da cooperação tecnológica. A elaboração de normas baseia-se no consenso, que é um acordo geral, caracterizado pela ausência de oposição sustentada a questões substanciais por qualquer parte importante dos interesses em causa e por um processo que envolve a tentativa de ter em conta os pontos de vista de todas as partes interessadas (a saber, a indústria, a investigação, a administração pública, os consumidores) e de conciliar quaisquer argumentos conflitantes. Os esforços de normalização são regidos por abordagens altamente sistémicas. Em particular, as normas metodológicas visam soluções genéricas, que também são adequadas em diferentes aplicações. Isto aplica-se igualmente às normas metodológicas relativas ao conteúdo estruturado, tais como as normas para a transcrição e a transliteração, os modelos de dados, os formatos de intercâmbio, os identificadores de fonte (ISO 12615:2004), para não mencionar a gestão de projectos. Também se aplica a alguns tipos de conteúdo estruturado padronizado, como códigos de idiomas (série ISO 639), códigos de script (ISO 15924:2004) e códigos de país (série ISO 3166). Nos últimos anos, aspectos de ity of structured content have become a major issue in many fields. Therefore, standards concerning data quality, data administration, content management and workflows are increasingly becoming imperative. There are several technical committees dealing with various – more or genéricos não interoperáveis […] aspectos de interoperabilidade de conteúdos, - ISO/TC 37 Terminologyandotherlanguageandcontentresources por exemplo: - ISO/IEC-JTC 1/SC 32 Gestão e intercâmbio de dados (especialmente o seu WG 2 MetaData); - ISO/IEC-JTC 1/SC 36 Tecnologia da informação para a aprendizagem, a educação andtraining; 13Terminologija | 2012 | 19 - ISO/TC 184 Sistemas de automatização e integração (especialmente o seu SC 4 Dados industriais); - ISO/TC 46 Informações e documentação. As normas desenvolvidas por estes comités ainda não têm em conta os requisitos específicos do eLearning no que diz respeito à interoperabilidade de conteúdos de entidades de conteúdos estruturados a nível da semântica léxica. O ISOTC 37 foi o primeiro comité a ter plenamente em conta o multilinguismo (de facto, como um dos princípios básicos de todos os seus esforços de normalização, que é orientado para o conceito, ou seja, independente da língua = multilíngue desde o início) […] outros comités técnicos seguiram o exemplo, mas muitas vezes não respeitam suficientemente este princípio na prática. Hoje, mesmo a lexicografia tomou uma virada em direção à orientação conceitual (= multilingualidade), como pode ser visto a partir dos produtos de vários editores de dicionários e dicionários on-line em grande escala acessíveis na Internet. Isto também deve aplicar-se aos objetos de aprendizagem (LO) ao nível da semântica léxica. Tendo em conta o facto de a interoperabilidade dos conteúdos só poder ser alcançada com base em regras geralmente aceites, ou seja, normas internacionais, é necessária a cooperação e a coordenação das actividades de normalização mais importantes no que diz respeito à interoperabilidade dos conteúdos. Novas actividades de normalização para vários aspectos da interoperabilidade de conteúdos - são impulsionadas por desenvolvimentos técnicos na direcção da criação de conteúdos cooperativos participativos baseados na web através das TIC (na forma de redes sociais, plataformas de cooperação, comunicação móvel, etc.) por um lado; - terá um grande impacto nos vários tipos de gestão de conteúdos e conhecimentos (especialmente em aplicações eletrónicas, como eLearning, eAccessibility&eInclusion, eHealth, gestão multilingue de dados de produtos em negócios eletrónicos, etc.). So far the standardization efforts in ISO/TC 37 Terminologyandother languageandcontentresources with respect to structured content focused on methodology standards related to - Data categories (not quite identical with metadata) used in the conceptual design of the entries of structured content; - Data models and data modelling methods; 14 Christian Galinski, Interoperabilidade de conteúdos como pré-requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  para - Metamodelos para tornar os modelos de dados concorrentes interoperáveis; - Aplicações do acima mencionado; e, até certo ponto, na padronização dos tipos de conteúdos que são relevantes para o TC. Se as ontologias no sentido da representação do conhecimento forem incluídas, os metamodelos acima mencionados precisam ser estendidos para metaontologias e até mesmo para uma linguagem de metaontologia (ISO 17347:2012), a fim de fornecer a possibilidade de tornar as ontologias interoperáveis. Neste contexto, uma ontologia é vista como uma "especificação formal e explícita de uma conceitualização compartilhada" (Gruber, junho de 1993), que representa um vocabulário e uma taxonomia compartilhados que modelam um domínio, ou seja, a definição de conceitos e outros objetos de informação, bem como suas propriedades e relações. Uma linguagem de ontologia […] diferente da mera representação de conhecimento […] fornece um metamodelo para tais especificações formais e explícitas de uma conceitualização compartilhada. Quase todos os TCs da ISO e da IEC padronizam os termos e definições mais importantes do seu respectivo domínio ou assunto. Alguns também padronizam outros tipos de recursos de linguagem e conteúdo. 3. VÓLUMES DE CONTENTO Estruturado: Terminologia De acordo com a ELRA (Associação Europeia de Recursos Linguísticos), os recursos linguísticos são: - corpora de texto, - corpora de fala, - (dados lexicográficos e) terminologias. Em um artigo recente (Galinski, Reineke 2011), foi feita uma tentativa de quantificar os volumes de entradas lexicográficas e terminológicas em um total de 150 milhões. Só o número de substâncias químicas identificáveis ultrapassou a marca de 60 milhões em 2011. À luz increasing number of domains or subjects. The lexis of LGP in the highly developed languages may comprise up to 500,000 lexemes (including a considerable share of terminology). However, the total number of scientifictechnical concepts across all domains or subjects may well comprise ~100– destes números, a interoperabilidade dos conteúdos é um pré-requisito para evitar uma enorme duplicação de esforços; - A abordagem ISO/TC 37 está a tornar-se cada vez mais essencial; l6 定休日 21Terminologia | 2012 | 19 Na figura acima, o onyomi kyû (como L1 para K1 休) pode ter qualquer significado das leituras kunyomi, mas kyû só pode ser usado para o kanji, se ele ocorre em combinações de kanji (ou , que é uma exceção se o kanji fica sozinho como uma abreviação). Kyû como LO só faria sentido, se um aprendiz quiser aprender todos os kanji com o onyomi kyû por alguma razão ou outra. Existem muitos kanji, onde o onyomi representa um ou mais conceitos e, portanto, cada kanji+onyomi pode ser tomado como um LO. L2 […]休む yasumu, L3 […]休まる yasumaru, L4 […]休める yasumeru, L5 […]休み yasumi representam diferentes […] embora semanticamente relacionadas […] leituras japonesas kunyomi do kanji em questão, que além de sua natureza derivada têm um significado idiomático qualificando cada um deles como LC-LO individual próprio. No entanto, se um LO deste tipo tiver mais de um significado, qualquer um deles representa, em princípio, um LC-LO. 休 em leituras de kunyomi só significa o caule yasu. No entanto, existem outros stems lidos yasu com um significado diferente escrito por diferentes kanji, como 安 em yasui 安い, o que poderia levar o aprendiz a outros kanji LO com a leitura japonesa yasu. teikyûbi, L7 一休みする hitoyasumi suru e L8 休日 kyûjitsu representam o significado de compostos de kanji (binomos, trinomos, etc. com ou sem terminações) com onyomi, kunyomi ou leitura mista. Assim, o elemento central do HC-LO K1 (休 kyû) deste flashcard kanji pode ser combinado com dois ou mais outros kanji para formar LO lexicográfico, como L6 teikyûbi, L7 hitoyasumi suru e L8 kyûjitsu. Se qualquer um deles tiver mais de um significado, deverá ser considerado como duas ou mais LO; - apontar para outros kanji HC-O, como K2 一, K3 定, K4 日; - estar ligado a kanji semelhantes, como K5 体 e K6 伏 ou outros kanji de relevância histórica ou de outra natureza. Qualquer um dos tipos de LO acima mencionados deveria ter previsto um espaço reservado para: - pronúncia (ou pronúncias, porque podem haver duas ou mais; se houver homófonos, os ponteiros devem levar ao respectivo LO); - linguagem de sinais e outros tipos de meios de comunicação alternativa e aumentada. A linguagem e a escrita japonesas altamente complicadas foram escolhidas para ilustrar o método de composição e decomposição do LO no nível da semântica léxica. Tomar japonês, uma língua complicada com um com- 22 Christian Galinski, Interoperabilidade de conteúdo como pré-requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  para o script plicado, como base para a concepção dos modelos de dados de LO para um repositório de LO ao nível da semântica léxica tem vantagens. Pode tornar mais fácil lidar com fenômenos no mundo dos símbolos não linguísticos, como na figura abaixo. Em alguns países existem até variantes do mesmo sinal de trânsito, dependendo de onde ele é usado em termos de posição na estrada ou se como um sinal de trânsito tradicional ou em um sinal de mensagem variável (VMS) (Galinski 2011). A maioria dos kanji japoneses ocorre […] muitas vezes com leituras irregulares […] em denominações, ou seja, nomes próprios de pessoas, lugares, organizações, edifícios e outros objetos. Especialmente em línguas com sistemas de escrita não-latinos, a escrita e a leitura corretas de nomes próprios muitas vezes apresentam grandes dificuldades ao aprendiz. Sem mencionar a classificação correta dos nomes em tais sistemas de escrita. Voando sobre a Sibéria para a China, pode-se ler no monitor de voo o nome chinês para Novosibirsk começando com 新xin, que significa "novo", traduzindo o elemento nome novo para o chinês. O resto do nome sibirsk=Sibéria é transcrito por caracteres chineses. Assim, os nomes próprios podem ter que ser transcritos ou (parcialmente ou totalmente) "traduzidos". Em qualquer caso, os nomes próprios - tanto para entidades terminológicas como lexicográficas - podem ser LO importantes e podem ser tratados com a mesma abordagem descrita acima. A abordagem da ISO/TC 37 pode servir de modelo para todos os tipos de conteúdo estruturado. No entanto, como já mencionado acima, o Registro de Categorias de Dados para Recursos Linguísticos (DCR) (ISO 12620:2009) da ISO/TC 37 deve e, de facto, pode ser alargado a outros tipos de conteúdo estruturado, para além dos dados lexicográficos e terminológicos, bem como a novas necessidades de aplicações eletrónicas, como para fins de aprendizagem e acessibilidade eletrónica. Para aqueles que estão assustados com a complexidade, pode haver uma […] não tão nova, mas na realidade raramente aplicada […] saída: federação de recursos 23Terminologia | 2012 | 19 de conteúdo estruturado. Aplicando a filosofia do Dublin Core, um certo estrato de categorias de dados (sendo o mesmo para diferentes tipos de conteúdo estruturado) deve ser padronizado e implementado em qualquer recurso, garantindo assim a interoperabilidade do conteúdo. O grau completo de complexidade não é implementado em um super-recurso, mas distribuído em vários recursos de diferentes tipos de conteúdo estruturado. Esta forma de garantir a interoperabilidade dos conteúdos, tendo em conta a reutilização de entidades de content in mind still needs further investigation. 6. FUTURE STANDARDIZATION NEEDS Tendo em conta o que precede, a ISO/DCR pode precisar de categorias de dados adicionais. A ISO/DCR contém hoje as categorias de dados básicas e muitas categorias de dados estendidas para dados terminológicos e lexicográficos. O modelo de dados terminológicos, bem como o modelo de dados lexicográficos, baseiam-se neles. A utilização de categorias de dados (não exatamente a mesma que os metadados ou os elementos de dados) parece ser altamente adequada LO at the level of lexical semantics in particular. Besides, data categories can be distinguished into primary data categopara o conteúdo estruturado em geral e para as categorias de dados secundários (ISO 10241-1:2011) (ou mesmo categorias de dados terciários). As categorias de dados primários referem-se a dados básicos, tais como termos, definições, etc. As categorias de dados secundários referem-se, entre outros, a atributos, tais como preferidos, admitidos ou descontinuados (termo). As categorias de dados terciários referem-se a informações adicionais (se não forem consideradas categorias de dados secundários), tais como as que se referem aos elementos da referência de origem dos dados terminológicos (aplicáveis também a outros tipos de conteúdo estruturado), tal como descrito na ISO 12615:2004 Referências bibliográficas e identificadores de origem para trabalhos terminológicos. As categorias de dados primários de acordo com a ISO 10241-1 adaptadas ao LO são (em comparação com o quadro 1 do anexo 1): - número de entrada […] único para a entrada da base de dados do LO; - (categoria de metadados:) representação designativa de conteúdo estruturado → ou seja, termos, abrangendo também sinônimos, homônimos, etc., a serem estendidos a qualquer tipo de representação designativa de conteúdo estruturado, cada um dos quais deve ter seu próprio ID de entidade, estendendo assim a autonomia de termos para a autonomia de representação; - (categoria de metadados:) representação descritiva de conteúdo estruturado → ou seja, definições, explicações, contextos, 24 Christian Galinski, Contentinteroperabilityasaprerequisitefor Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  towards any kind of descriptive representation of structured content etc. a serem estendidos, incluindo representações descritivas não - (metadata category:) example → if necessary to be split up into difverbais; tipos de exemplos; - (categoria de metadados:) nota →, se necessário, a dividir em diferentes tipos de nota; - (metadata category:) source → if necessary to be split up into different types of source and their respective conditions for use. Se a entidade de representação designativa do conteúdo estruturado for verbal, aplica-se a repetibilidade por língua, bem como a repetibilidade dentro da língua no caso de sinônimos (cada um dos quais também deve obter o seu próprio ID de entidade). Se a entidade de representação designativa do conteúdo estruturado for não-verbal, aplica-se a repetibilidade por campo de utilização. Pode haver também um tipo de repetibilidade dentro do campo de aplicação de uso (como sinais de velocidade limitada dependendo de sua localização ao longo da estrada ou no meio de uma rodovia em alguns países, ou sinais de estrada do mesmo significado que diferem em vários estados dos EUA). Existem variações da linguagem de sinais dentro da mesma linguagem de sinais, bem como dos Blissymbols. O acima mostra que a repetibilidade deve ser de acordo com a "comunidade de uso" (ou seja, local na localização) e não de acordo com a linguagem. Naturalmente, a comunidade de uso também pode ser uma comunidade linguística, mas a repetibilidade por e dentro de locais fornece mais flexibilidade para cobrir todos os fenômenos encontrados no conteúdo estruturado. 7. Conclusões Nos últimos 10 anos, as limitações da interoperabilidade semântica sob uma perspectiva de ciência da computação tornaram-se óbvias. Além da interoperabilidade técnica (ou seja, relacionada com o hardware e o software) e organizacional, a interoperabilidade semântica deve incluir a interoperabilidade sintática, conceitual e pragmática. A interoperabilidade de conteúdos fornece uma abordagem ainda mais ampla e genérica no que diz respeito às representações comunicativas de informações e conhecimentos - também leva em conta a reutilização e a reutilização de entidades de diferentes tipos de conteúdo estruturado (Galinski, Van Isacker 2010). A reutilização pode incluir, por exemplo, a adaptação de entradas terminológicas existentes 25Terminologia | 2012 | 19 - como objetos de aprendizagem (LO) em eLearning ou - para serem usados por pessoas com deficiência (PwD) para comunicações gerais munication and of course also for learning purposes. International Standards for content interoperability are the prerequisite for: - avoiding a huge duplication of efforts, - developing methods (incl. certification) and devices to assure content quality, - introdução extensiva da interoperabilidade de conteúdos nos schemes, - enabling many eApplications to re-use and re-purpose existing conteúdos estruturados de educação e formação. Cada vez mais, todos os tipos de conteúdo estruturado devem ser reutilizáveis e reutilizáveis em todas as plataformas do sistema. Além disso, devem ser implementados cada vez mais métodos cooperativos e distribuídos baseados na web para o desenvolvimento de conteúdos, em cooperação com campos interrelacionados, no âmbito de uma abordagem integradora. A este respeito, a utilização intensiva de tecnologias móveis terá um impacto enorme: o eContent está a tornar-se mContent (conteúdo móvel). No decurso destes desenvolvimentos, valeria a pena desenvolver relações metodológicas e de concepção de sistemas mais fortes entre a gestão de recursos de conteúdos e a linguística de corpus, a fim de fazer melhor uso dos recursos linguísticos existentes. - corpora existentes e futuros com características melhoradas, por exemplo, para a extração de elementos individuais de conteúdo estruturado de forma sistemática (também tendo em conta as frequências de ocorrência em função do domínio, do registo de nível e da aplicação, de modo a melhorar a extração de objetos de aprendizagem em contexto); - itens de conteúdo estruturado em repositórios existentes e futuros, a fim de melhorar o processamento de corpora para novos fins adicionais, como a didática; - métodos existentes e emergentes, bem como ferramentas em domínios que, até agora, apresentam um baixo grau de interrelação e integração metodológica, em nome de benefícios mútuos; - criação e manutenção sistemática (e por esforços participativos) de objetos de aprendizagem, em particular para o CLIL (aprendizagem integrada de conteúdos e línguas). 26 Christian Galinski, Interoperabilidade de conteúdos como pré-requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  Efforts in standardization (and cooperation in standardization) should be stepped up. The proper integration of AAC requirements in the data para a modelagem de conteúdos estruturados beneficiaria não apenas aqueles da sociedade que precisam dela mais urgentemente, mas, em última análise, todos. Isto exige uma maior ênfase nas tecnologias de assistência pertinentes na educação e formação relacionadas com as TIC o mais cedo possível. Os participantes na Conferência ICCHP 20103 confirmaram que a formação e os estudos formais existentes não são suficientes - mesmo se certificados de acordo com determinados sistemas de certificação e atestação - no que diz respeito às competências e qualificações necessárias para se familiarizar com as questões envolvidas na interoperabilidade global de conteúdos e, em particular, na acessibilidade e inclusão eletrónica. A "Recomendação sobre os princípios de desenvolvimento de software e conteúdos 2010" (ver anexo 2) foi formulada num seminário especial no ICCHP 2010 e posteriormente endossada por vários comitês técnicos no domínio da normalização e, em 2012, pelo Grupo de Gestão (MoU/MG) do Memorando de Entendimento ITU-ISO-IEC-UNECE relativo à normalização do comércio eletrónico. REFERENCES Galinski Ch. 2011: A sign equals thousand words. Consistency of traffic / road signs and verbal messages. – Infrastructureandsafetyinacollaborativeworld.Roadtrafficsafety. Evangelos Bekiaris, Marion Wiethoff, Evangelia Gaitanidou eds., Heidelberg, Dordrecht, London, New York: Springer, 263–284. Galinski Ch., Reineke D. 2011: Vor uns die Terminologieflut. – eDITion 2/2011, 8–12. Galinski Ch., Van Isacker K. 2010: Standards-based Content Resources: A Prerequisite for Content Integration and Content Interoperability. – Computershelpingpeoplewithspecialneeds.12thInternationalConference, ICCHP2010,Vienna,Austria,July2010.Proceedings, Part I., K. Miesenberger e.a. (eds.), Berlin, Heidelberg, New York: Springer, 573–579. Gonnissen L., Mornie G. 1983: Bestimmenunderkennenleichtgemacht.Vögel.Diewichtigstenheimischen Arten [Birds of Europe], translated from French by Sieglinde Summerer and Gerda Kurz, Zürich/Köln: Benziger Verlag. Gruber T. R., June 1993: A translation approach to portable ontology specifications (PDF). KnowledgeAcquisition5 (2), 199–220. – http://tomgruber.org/writing/ontolingua-kaj-1993.pdf. Hodges M., Okazaki T. Japanesekanjiflashcards. Series 2, volume 1, Tokyo: White Rabbit Press, s.a. Kitazawa T., Windhab R., Galinski Ch. 2007: UntersuchungvonFlashcardsystemen(elektronischeLernkarteien)fürCALL(computergestütztenSpracherwerb)undCASPLL(computergestütztenFachsprachenerwerb) aufAnfängerniveau.MitdemSchwerpunktaufJapanisch-LernenzumErwerbeinerhohenlexikalischen Sprachkompetenz–ohnedaslangfristigeZieleinermehrsprachigenFlashcard-Lernplattformzuvernachlässigen. McEnery T., Xiao R., Tono Y. 2006: Corpus-basedLanguageStudies:AnAdvancedResourceBook, London/ New York: Routledge. Schmitz K.-D. 2006: Data modeling: From terminology to other multilingual structured content. – TSTT 2006.InternationalConferenceonTerminology,StandardizationandTechnologyTransfer.Proceedings.Beijing,China,2006-08-25/26. Yuli Wang, Yu Wang, Ye Tian (eds.), Beijing: Encyclopedia of China Publishing House. 3 12th International conference on computers helping people with special needs (ICCHP 2010), Vienna, Austria, July 2010 27Terminologija | 2012 | 19 REFERENCED StaNDaRDS ISO/IEC Guide 2:2004 Standardizationandrelatedactivities–Generalvocabulary. ISO 639 (series) Codesfortherepresentationofnamesoflanguages. ISO/IEC 2382-36:2008 Informationtechnology–Vocabulary – Part 36: Learning,educationandtraining. ISO 3166 (series) Codesfortherepresentationofnamesofcountriesandtheirsubdivisions. ISO/TS 8000-1:2011 Dataquality – Part 1: Overview. ISO 10241-1:2011 Terminologicalentriesinstandards – Part 1: Generalrequirementsandexamplesofpresentation. ISO 10241-2:2012 Terminologicalentriesinstandards – Part 2: Adoptionofstandardizedterminologicalentries. ISO 12615:2004 Bibliographicreferencesandsourceidentifiersforterminologywork. ISO 12620:2009 Terminologyandotherlanguageandcontentresources–Specificationofdatacategoriesand managementofaDataCategoryRegistryforlanguageresources. ISO 15924:2004 Informationanddocumentation–Codesfortherepresentationofnamesofscripts. ISO/CD 17347:2012 OntologyIntegrationandInteroperability(OntoIOp)– Part 1: TheDistributedOntology Language(DOL). ISO/DIS 22274:2011 Systemstomanageterminology,knowledgeandcontent–Concept-relatedaspectsfordevelopingandinternationalizingclassificationsystems. IEEE (Institute of Electrical and Electronics Engineers, Inc.). LOM standard 1484.12.1-2002 DraftStandardforLearningObjectMetadata. TURINIO SVEIKUMO BŪtINYB NaUDOJANT StRUKtŪRIZUOtO TURINIO VIENETUS KaIP ELEKTRONINIO MOKYMOSI OBJEKTUS PaKaRtINAI aR PaGaLIt KOKI PaSKIRT Daugėja turinio users' platform, siūlančių vartotojams internet ar mažai lių, bet vis darinio ir irinio, turinio į gerinio atsižvelga, tiekimo užtikrinimo, patirtis tokios teorijos. Tokių platformų skaičius augs ir toliau, nes vis daugiau išteklių kuriama ir naudojama taikant nepakankamai veiksmingus metodus. Kad būtų užtikrinta turinio kokybė, o pirmiausiai patikimumas, reikalingas įvairių priemonių derinimas (standartai, informacinės ir komunikacinės technologijos, sertifikavimas ir kt.). Elektroniniam mokymuisi svarbus skirtumas tarp bendrosios kalbos (angl. LGP) e specialiosios kalbos (angl. LSP). Tam, kad būtų galima sukurti daugiakalbius, daugiamodalinius, daugelio paskirčių mokymosi objektų duomenų modelius, leksinės semantikos lygmeniu būtina tobulinti ribotas dabartinių duomenų bazių galimybes. Reikėtų daugiau dėmesio skirti: a) dados apresentados nas bases das línguas de referência e dos registos de línguas especiais; b) dados bazių įrašų žodinių elementų tarimo nuorodoms; c) pateikimui nežodinių žymenų ir atvaizdų, kurie, atsižvelgiant į taikymo sritį, gali būti tokie pat svarbūs kaip žodiniai žymenys ir net labiau už juos pageidautini; frases de línguas especiais; f) para as comunicações não habilitadas. d) leksinių vienetų dėmenims, pavyzdžiui, morfologiniams elementams; e) didesniems leksiniams vienetams, pavyzdžiui, bendrosios kalbos kolokacijoms ar Straipsnyje pateikiami argumentai dėl žemiau išvardytų dalykų būtinumo: - normas, em que se apresentem requisitos de garantia e de orientação para o turismo internacional, incluindo requisitos eletrônicos de mokymuisi keliamus; 28 Christian Galinski, Interoperabilidade de conteúdos como pré-requisito para - Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  coordenação de estratégias, skatinanças de tais padrões de aplicação (pavykly, pasitelkiant sertifikavimą); - instrumentos de garantia dos padrões de laikymąsi sistemas de desenvolvimento. Estes padrões e instrumentos poderiam ajudar a suvaldyti já agora mais ar menos chaotišką turinio plėtrą (sukeliančią didžiulį veiklos dubliavimą) ar bent jau leistų aiškiai išskirti patikimo turinio saugyklas. Gauta 20 de março de 2012 Christian Galinski (em inglês) Centro Internacional de Informação em Terminologia (Infoterm) Gymnasiumstrasse 50, 1190 Viena, Áustria E-mail [email protected] Stella Blanca Giraldo Pérez (em inglês) Centro Internacional de Informação em Terminologia (Infoterm) Gymnasiumstrasse 50, 1190 Viena, Áustria E-mail [e-mail protegido] 29Terminologia | 2012 | 19 Anexo I, quadro 1 - Resumo das categorias de dados de uma entrada terminológica normalizada de acordo com a ISO 10241-1 Primary data categoriesaSecondary data categoriesb (including administrative data and usage Name Mandatory/optional; número de entrada repetível ou não repetível ... Obligatório; não-[…] pontos altos […][…][…][…] ou outro espaço de acordo com o signo do repeatable titular, ...) na ordem das regras do termo (s) termc (or string of five halfpreferido (s), organismo de normalização exemplo, gênero, número, obrigatório; código da língua falada ou do código da escrita, admitido: termo (s), termo (s) obsoleto (s), por Informação gramatical repetível parte do ou ambos o uso geográfico (por exemplo, código de país) pronúncia símbolo de letra de status normativo ... Opcional (a menos que o código ou seja um código de escrita padronizados); utilização símbolo da língua da letra internacional, ou ambos geográfica repetível (por exemplo, código de país) símbolo gráfico de estatuto normativo ... Opcional (a menos geográfico seja exemplo, código de país) padronizado a nível nacional); que o símbolo gráfico de uso internacionalmente (por definição de estatuto normativo repetível ... não-domínio ou assunto, se a necessária, seja utilizado por convenção dentro do respectivo domínio ou assunto); Obligatório (a menos que um representação verbal for 30 Christian Galinski, Interoperabilidade de conteúdos como pré-requisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning  Primary data categoriesaSecondary data categoriesb (including administrative data and usage para a informação) Name Mandatory/optional; repeatable/nonrepresentação não verbal não repetível repetível ... complementando uma definição ou utilizada em vez de uma definição por convenção dentro do respectivo domínio ou assunto); Exemplo não repetível ... Opcional; repetível […] nota de Obligatória (se existir […] entrada (incluindo a nota opcional); repetível […] a um símbolo gráfico, uma definição, um contexto, uma representação não verbal, por exemplo, uma determinada secção linguística de uma entrada terminológica multilingue ou a entrada terminológica inteira) ... termo, um símbolo de letra, um fonte da terminologia inteira Opcional (a menos que a entrada de informações adicionais (incluindo a entrada representação multilíngue, um contexto, um número de cláusulas, uma entrada terminológica não verbal) ou categorias de dados primários devem ser complementadas por um código para nomes de línguas de acordo especificado na tabela 1, embora outras designações verbais, tais como quaisquer termos sinônimos terminológica de origem ou relacionada com a fonte, de um termo, um símbolo de letra, uma seção qualquer seção linguística externa autorizada de uma fonte múltipla); Todas as categorias de dados com a ISO 639, se necessário em combinação com códigos para nomes de países de acordo com a ISO 3166 ou existentes, variantes, formas completas, formas abreviadas, homógrafos, antônimos. linguística de um termo, tal como o número de página, um símbolo gráfico, uma definição, uma primários, com excepção da categoria de dados "número de entrada", são repetíveis por língua e as códigos para nomes de escrituras de acordo com a ISO 15924 c. Por simplicidade, apenas "termo" é therefore, apply to multilingual standards. Additional rules for terminological entries in a multilingual terminology standard are given in Clause 7. b All secondary data categories are optional except where they are crucial for disambiguation (…) and in cases where multilingual information is included in one terminological entry, in which case the