Content interoperability as a prerequisite for re-using and re-purposing items of structured content as learning objects in eLearning – Seen under a standardisation perspective
Full text
6Christian Galinski, Interoperabilità dei contenuti come prerequisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning per l'interoperabilità dei contenuti come prerequisito per il riutilizzo e il riuso di elementi di contenuti strutturati come oggetti di apprendimento nell'eLearning […] Visto dal punto di vista della standardizzazione CHRISTIAN GALINSKI, BLANCA STELLA GIRALDO PÉREZ (PPE). - (IT) Signor Presidente, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi, onorevoli colleghi. Infoterm KEYWORDS: contenuto strutturato e contenuto non strutturato, rappresentazioni verbali e non verbali, denominazioni, morfologia e morfemi, fraseologia e frasemi, collocazioni e termini a più parole, oggetti di apprendimento di alta complessità (HC-LO) e oggetti di apprendimento di bassa complessità (LC-LO), linguaggio per scopi generali (LGP) e linguaggio per scopi speciali (LSP), persone con disabilità (PwD) e tecnologie di assistenza, norme e standardizzazione, certificazione, modelli di dati e modellazione di dati, repositori federati 1. Contenuto strutturato Il "contenuto" qui è visto come contenuto strutturato a livello di semantica lessicale che comprende rappresentazioni linguistiche e non linguistiche di concetti (intesi nella teoria della scienza come una sorta di "oggetti immateriali"). Queste rappresentazioni possono essere designative (come le designazioni in terminologia: che comprendono termini, simboli e denominazioni) o descrittive (come vari tipi di definizioni, spiegazioni o rappresentazioni non verbali) o ibride. Finora le designazioni e le rappresentazioni non verbali dei concetti, nonché le denominazioni (ovvero i nomi propri che rappresentano singoli concetti) sono stati sotto-rappresentati nella teoria e nella metodologia della terminologia. Ma possono essere molto importanti per la progettazione di oggetti di apprendimento (LO) in determinati domini o campi di applicazione, per non parlare dell'apprendimento delle lingue e della traduzione. Altrettanto importanti per la progettazione di LO multilingue, multimodali e multiuso sono: a) somiglianze tra le voci LGP e LSP: - la rappresentazione designativa della voce (lemma LGP o termine LSP) può essere una parola, una parola composta o un'entità di più parole; - La rappresentazione designativa verbale può essere integrata da una rappresentazione designativa non verbale (ad esempio gesto, mimica, Blisd) componenti di entità di contenuto strutturato, come i morfemi delle rappresentazioni designative verbali o elementi di una definizione, spiegazione, contesto ecc. Essi dovrebbero essere contrassegnati per facilitare il riferimento incrociato o il riutilizzo come un altro LO (ad esempio prefissi e riferimenti incrociati agli elementi pertinenti del rispettivo ente). A questo cento simboli di base rappresenta un concetto, che può essere composto insieme per generare nuovi simboli che rappresentano nuovi concetti. I simboli della felicità non corrispondono affatto ai suoni di nessuna lingua
7Terminologija | 2012 | 19 symbolics1 ecc.), o […] se richiesto […] anche essere sostituito da esso (ad esempio graficoical or other non-verbal symbol); - Each entry representing one concept has a unique entry identifier (che possono, ad esempio, indicare occorrenze nei corpus di testo); Nelle voci LSP ogni rappresentazione designativa dovrebbe avere il proprio identificatore di elemento, che tra l'altro renderebbe possibile tracciare il cambiamento concettuale nel tempo; Nelle voci LGP ogni significato di una rappresentazione designativa dovrebbe avere il proprio identificatore di elemento, che rende multilingue si applica a LSP e LGP entries possible, ° In analogy to termautonomy in terminology, representationautonomy così come a rappresentazioni non verbali; Le rappresentazioni descrittive LGP (incluse spiegazioni, contesti ecc.) possono essere trattate in stretta analogia a quelle in LSP (spiegamenti, contesti ecc.), ma escludono le definizioni nel senso del concetto; Ci possono essere campi aggiuntivi per note, esempi, ecc. b) pronuncia di elementi verbali di entità di contenuto strutturato, che dovrebbero essere previsti in qualsiasi voce almeno potenzialmente. c) rappresentazioni designative non verbali e rappresentazioni descrittive non verbali, che dovrebbero essere previste in qualsiasi voce almeno potenzialmente, poiché possono essere […] a seconda del dominio o del campo di applicazione […] altrettanto importanti delle rappresentazioni verbali e talvolta persino preferite. parlata. suffixes in medical nomenclature). e) larger entities of structured content, such as idioms, LGP collocations or LSP phrasemes, as well as metaphors, which can be formally treated similar to verbal designative representations in LGP (with proper 1 Blissymbolics is an ideographic writing system for cognitively impaired persons. Each of the several
8Christian Galinski, Interoperabilità dei contenuti come prerequisito per il Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning livello, l'ulteriore differenziazione raffinata di quanto sopra è necessaria nella linguistica dei corpus, ma probabilmente non per LO. Può anche essere di minore importanza, indipendentemente dal fatto che il significato sia non compositivo o compositivo. Esistono strumenti nella linguistica dei corpus per identificare ed estrarre anche tali entità più grandi di contenuto strutturato. f) la fornitura di campi di segnale o collegamenti alle rispettive rappresentazioni designative per le PWD, come in Braille, lingua dei segni o Blissymbolics. Le risorse di contenuto strutturate a livello di semantica lessicale finora sono state considerate come comprendenti principalmente dati lessicografici, dati terminologici e altri tipi di rappresentazioni di concetti, comprese alcune non verbali, come i simboli visivi (ad esempio i simboli pubblici). Ma possono esserci anche simboli acustici udibili, simboli tattili tattili e altri, che, nella gestione della terminologia, potrebbero verificarsi come designazioni o persino descrizioni di concetti (come le rappresentazioni non verbali (ISO 10241-1:2011). Potrebbero essere necessarie ulteriori informazioni […] e le rispettive categorie di dati […] per un approccio sistematico alla gestione del contenuto strutturato in generale. Alla luce di quanto sopra, possiamo differenziare i tipi di contenuto strutturato a livello di semantica lessicale come segue: - dati lessicografici, come: […] entità vocali (compresi i composti ecc.), […] morfemi (morfologia), […] collocazioni, metafore; - Terminologie e risorse linguistiche di tipo simile e altre risorse di contenuto, come: […] nomenclature, tassonomie, tipologie, glossari, vocabolari ecc., […] morfemi terminologici (morfologia), […] frasi terminologiche (fraseologia), […] nomi propri di ogni tipo utilizzati ad esempio come elementi in diversi kinds of directories, ° graphical symbols and other non-verbal designations, ° (product) properties, characteristics, attributes etc.; - Thesauri, classification schemes (ISO/DIS 22274:2011), keywords and other kinds of documentation languages (or controlled vocabularies); - voci enciclopediche (di conoscenza), che riguardano, tra l'altro: ° knowledge-enriched terminological entries,
9Terminologija | 2012 | 19 […] nomi propri (spiegati) e altri tipi di dati strettamente correlati ai nomi propri; - Ontologie, mappe tematiche e altri tipi di sistemi di strutturazione della conoscenza. Come nella terminologia, qualsiasi altro tipo di contenuto strutturato elencato sopra può avere - (una o più) rappresentazioni fonetiche, rappresentazioni della lingua dei segni, ecc. ; - rappresentazioni grafiche e altre rappresentazioni designative non verbali, nonché rappresentazioni descrittive non verbali (alcune in aggiunta a una rappresentazione verbale, altre create come rappresentazioni non verbali indipendenti da quelle verbali). I tipi non verbali di contenuti strutturati sono particolarmente significativi in applicazioni come l'eLearning e di importanza vitale nella comunicazione: - con e tra le persone con disabilità (direttamente o tramite dispositivi TIC che funzionano come tecnologie assistive), - tra le persone con disabilità e i dispositivi che utilizzano, e - tra questi dispositivi. I progettisti di segnali stradali chiamano gli elementi dei segnali stradali "morfologia" (in analogia con i morfemi in linguistica). Lo stesso potrebbe essere applicato ad altre rappresentazioni designative non verbali. Sono già stati sviluppati metodi di ricerca per cercare immagini intere rappresentazioni grafiche mediante singoli elementi contenuti in esse. La figura seguente mostra un esempio della "morfologia" dei simboli grafici (in questo caso un segnale stradale): (da Schmitz[…] Presentation at TSTT 20062; vedi Schmitz 2006) 2 3a Conferenza internazionale sulla terminologia, la standardizzazione e il trasferimento tecnologico (TSTT 2006), Beijing, China, 25-26 August 2006
10 Christian Galinski, Contentinteroperabilityasaprerequisitefor Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning In alcuni settori (ad esempio nelle nomenclature biologiche) ci sono persino esempi di rappresentazioni descrittive non verbali che sostituiscono lunghe definizioni o altre descrizioni di concetti, che potrebbero essere utili anche per scopi di eLearning: (da Gonnissen e Mornie 1983, uccello n. 50) Ha bisogno solo di una leggenda relativamente breve con spiegazioni per i simboli (in diverse lingue) e la rappresentazione grafica è facilmente compresa da esperti, studenti o ornitologi dilettanti. Tutti i tipi di contenuti strutturati di cui sopra stanno diventando sempre più accessibili digitalmente oggi (come eContent […] sempre più anche tramite dispositivi mobili) e possono - si trovano in testi digitali (come nella documentazione tecnica, nella scrittura scientifico-tecnica ecc.), - devono essere combinati tra loro o incorporati tra loro, - hanno elementi linguistici simili (lettere, suoni, morfemi ecc.) o diversi (come le rappresentazioni non verbali), - formano elementi di contenuto complessi, - devono essere integrati o resi interoperabili con altri in determinate applicazioni. Attualmente, tuttavia, la maggior parte dei repository esistenti di contenuti strutturati non sono coerenti all'interno di un repository e talvolta addirittura contraddittori tra diversi repository. Per lo più, non si basano su metadati e metodi di modellazione dei dati adeguati e, quindi, non sono integrabili, non sono affidabili e piene di carenze. Questo è inaccettabile, ad esempio, nelle applicazioni che supportano le PwD, in particolare nelle nostre società che invecchiano,
11Terminologija | 2012 | 19 di where more and more people have – sometimes multiple – impairments. It further does not allow their efficient use for eLearning purposes – which nuovo è svantaggiante per le persone con disabilità. A differenza del contenuto strutturato, un corpus può essere descritto come contenuto non strutturato, cioè "un corpo di linguaggio naturale" (McEnery, Xiao, Tono 2006), distinguendo così un corpus da elenchi di parole, dizionari, database. Allo stesso modo un corpus vocale (o corpus parlato) è un repository di file audio vocali (e trascrizioni di testo). Queste definizioni sono insufficienti per quanto riguarda gli elementi non linguistici nei testi (come nella documentazione tecnica) e per quanto riguarda gli elementi della comunicazione non verbale (come i gesti, le mimetiche ecc.) che accompagnano necessariamente i dati parlati nella vita reale. Se guardiamo, dove si possono trovare gli elementi di contenuto strutturato, riconosciamo che la maggior parte di loro non sono sviluppati come un obiettivo in sé, ma sono elementi necessari di contenuto non strutturato, come corpus di testo, corpus di discorso, ecc. Pertanto, la relazione tra i contenuti strutturati e i corpus […] in particolare al fine di rendere i contenuti strutturati che si trovano nei contenuti non strutturati produttivi, ad esempio per l'eLearning sotto forma di LO […], dovrebbe essere approfondita. Oggi, il più grande corpus al mondo è Internet. Tuttavia, nella maggior parte dei casi ha bisogno di testi di qualità assicurata per l'estrazione di LO […], il che rappresenta una sfida per la classificazione e la valutazione della qualità dei testi e la loro etichettatura appropriata. 2. Riferimento alle questioni di standardizzazione Contenuto strutturato I documenti normativi di oggi non comprendono solo norme tecniche in senso tradizionale, ma anche norme per la terminologia, i test, i prodotti, i processi, i servizi, le interfacce, i dati ecc. Alcune sono norme di base che hanno un'ampia copertura o contengono disposizioni generali per un particolare campo, altre sono norme metodologiche. La terminologia standardizzata di un dato campo può essere considerata come standard di base. Gli standard metodologici riguardanti i principi e i metodi del lavoro terminologico e la standardizzazione terminologica sono quindi fondamentali per tutto il lavoro terminologico e la standardizzazione terminologica. Inoltre, i tipi di norme sopra menzionati si riferiscono solo ad alcuni tipi comuni e non si escludono a vicenda; ad esempio, una particolare norma di prodotto può anche essere
12 Christian Galinski, Interoperabilità del contenuto come prerequisito per essere Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning considerata uno standard di prova se fornisce metodi di prova per le caratteristiche del prodotto in questione. Poiché il contenuto oggi è necessario per quasi tutto nella scienza e nella tecnologia, gli standard relativi al contenuto possono rientrare in uno qualsiasi dei tipi di standard sopra menzionati. Secondo la guida ISO/IEC 2:2001 la standardizzazione è un'attività per stabilire, in relazione a problemi effettivi o potenziali, i processi di formulazione, emissione e attuazione delle norme. I vantaggi for commonandrepeateduse, aimed at the achievementoftheoptimum degreeoforderinagivencontext. In particular, the activity consists of the importanti della standardizzazione sono il miglioramento dell'idoneità dei prodotti, dei processi e dei servizi ai loro scopi, la prevenzione degli ostacoli al commercio e la facilitazione della cooperazione tecnologica. L'elaborazione delle norme si basa sul consenso, che è un accordo generale, caratterizzato dall'assenza di opposizione sostenuta a questioni sostanziali da parte di qualsiasi parte importante degli interessi interessati e da un processo che comporta la ricerca di prendere in considerazione le opinioni di tutte le parti interessate (ovvero l'industria, la ricerca, la pubblica amministrazione, i consumatori) e di riconciliare eventuali argomenti contrastanti. Gli sforzi di standardizzazione sono governati da approcci altamente sistematici. In particolare, le norme metodologiche mirano a soluzioni generiche, che sono appropriate anche in applicazioni diverse. Ciò si applica anche alle norme metodologiche riguardanti i contenuti strutturati, come le norme per la trascrizione e la traslitterazione, i modelli di dati, i formati di interscambio, gli identificatori delle fonti (ISO 12615:2004), per non parlare della gestione dei progetti. Si applica anche ad alcuni tipi di contenuti strutturati standardizzati, come i codici delle lingue (serie ISO 639), i codici di scrittura (serie ISO 15924:2004) e i codici dei paesi (serie ISO 3166). Negli ultimi anni, gli aspetti dell'interoperabilità ity of structured content have become a major issue in many fields. Therefore, standards concerning data quality, data administration, content management and workflows are increasingly becoming imperative. There are several technical committees dealing with various – more or generica non interoperabile […] gli aspetti dell'interoperabilità dei contenuti, ad - ISO/TC 37 Terminologyandotherlanguageandcontentresources esempio: - ISO/IEC-JTC 1/SC 32 Gestione e scambio di dati (in particolare il suo WG 2 MetaData); - ISO-IEC-JTC 1/SC 36 Tecnologia dell'informazione per l'apprendimento, l'istruzione andtraining;
13Terminologija | 2012 | 19 - ISO/TC 184 Sistemi di automazione e integrazione (in particolare il suo SC 4 Dati industriali); - ISO/TC 46 Informazioni e documentazione. Gli standard sviluppati da questi comitati non tengono ancora conto dei requisiti specifici dell'eLearning per quanto riguarda l'interoperabilità dei contenuti di entità di contenuti strutturati a livello di semantica lessicale. ISOTC 37 è stato il primo comitato a prendere pienamente in considerazione il multilinguismo (di fatto come uno dei principi di base di tutti i suoi sforzi di standardizzazione, che è orientato ai concetti, cioè indipendente dalla lingua = multilingue fin dall'inizio) […] altri comitati tecnici hanno seguito l'esempio, ma spesso non rispettano sufficientemente questo principio in pratica. Oggi anche la lessicografia ha preso una svolta verso l'orientamento ai concetti (= multilingue), come si può vedere dai prodotti di diversi editori di dizionari e dai dizionari online su larga scala accessibili su Internet. Ciò dovrebbe applicarsi anche agli oggetti di apprendimento (LO) a livello di semantica lessicale. Tenendo conto del fatto che l'interoperabilità dei contenuti può essere raggiunta solo sulla base di regole comunemente accettate, vale a dire norme internazionali, è necessaria la cooperazione e il coordinamento delle attività di standardizzazione più importanti per quanto riguarda l'interoperabilità dei contenuti. Nuove attività di standardizzazione per vari aspetti dell'interoperabilità dei contenuti - sono guidate da sviluppi tecnici nella direzione della creazione di contenuti cooperativi e partecipativi basati sul web attraverso le TIC (sotto forma di reti sociali, piattaforme di cooperazione, comunicazione mobile ecc.) da un lato; - avrà un grande impatto sui vari tipi di gestione dei contenuti e delle conoscenze (specialmente nelle applicazioni elettroniche, come l'eLearning, l'eAccessibility&eInclusion, la eHealth, la gestione multilingue dei dati dei prodotti nel settore degli e-business ecc.). So far the standardization efforts in ISO/TC 37 Terminologyandother languageandcontentresources with respect to structured content focused on methodology standards related to - Data categories (not quite identical with metadata) used in the conceptual design of the entries of structured content; - Data models and data modelling methods;
14 Christian Galinski, Interoperabilità dei contenuti come prerequisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning per - Metamodelli per rendere interoperabili i modelli di dati concorrenti; - Applicazioni di quanto sopra; e, in una certa misura, sulla standardizzazione di quei tipi di contenuti che sono rilevanti per il TC. Se vengono incluse le ontologie nel senso della rappresentazione della conoscenza, i metamodelli sopra menzionati devono essere estesi verso le metaontologie e persino un linguaggio di metaontologia (ISO/CD 17347:2012), al fine di fornire la possibilità di rendere le ontologie interoperabili. A questo proposito, un'ontologia è vista come una "specificazione formale ed esplicita di una concettualizzazione condivisa" (Gruber, giugno 1993), che rappresenta un vocabolario e una tassonomia condivisi che modellano un dominio, cioè la definizione di concetti e altri oggetti di informazione, nonché le loro proprietà e relazioni. Un linguaggio ontologico […] diverso dalla semplice rappresentazione della conoscenza […] fornisce un metamodello per tali specifiche formali ed esplicite di una concettualizzazione condivisa. Quasi tutti i TC di ISO e IEC standardizzano i termini e le definizioni più importanti del loro rispettivo dominio o argomento. Alcuni standardizzano anche altri tipi di lingue e risorse di contenuti. 3. Volumi di contenuti strutturati: terminologia Secondo l'ELRA (European Language Resource Association) le risorse linguistiche sono: - corpus di testo, - corpus di discorso, - (dati lessicografici e) terminologie. In un recente articolo (Galinski, Reineke 2011) è stato fatto un tentativo di quantificare i volumi di voci lessicografiche e terminologiche in un totale di 150 milioni. Il solo numero di sostanze chimiche identificabili ha superato i 60 milioni nel 2011. Alla luce di queste cifre, l'interoperabilità dei contenuti è increasing number of domains or subjects. The lexis of LGP in the highly developed languages may comprise up to 500,000 lexemes (including a considerable share of terminology). However, the total number of scientifictechnical concepts across all domains or subjects may well comprise ~100– un prerequisito per evitare un'enorme duplicazione di sforzi; - L'approccio ISO/TC 37 sta diventando sempre più essenziale; L6 定休日 teikyûbi,
21Terminologia | 2012 | 19 Nella figura sopra, l'onyomi kyû (come L1 per K1 休) può portare qualsiasi significato delle letture kunyomi, ma kyû può essere utilizzato solo per il kanji, se si verifica in combinazioni di kanji (o che è un'eccezione se il kanji si trova da solo come abbreviazione). Kyû come LO avrebbe senso solo se uno studente vuole imparare tutti i kanji che hanno l'onyomi kyû per una ragione o l'altra. Ci sono molti kanji, in cui l'onyomi rappresenta uno o più concetti e, quindi, ogni kanji+onyomi può essere preso come un LO. L2 […]休む yasumu, L3 […]休まる yasumaru, L4 […]休める yasumeru, L5 […]休み yasumi rappresentano diverse […] sebbene semanticamente correlate […] letture giapponesi kunyomi del kanji in questione, che oltre la loro natura derivata hanno un significato idiomatico che qualifica ciascuno di loro come LC-LO individuale. Tuttavia, se un LO di questo tipo ha più di un significato, uno qualsiasi di questi rappresenta in linea di principio un LC-LO. 休 nelle letture kunyomi sta solo per il gambo yasu. Tuttavia, ci sono altri steli letti yasu con un significato diverso scritto da diversi kanji, come 安 in yasui 安い, che potrebbe portare l'allievo ad altri kanji LO con la lettura giapponese yasu. L7 一休みする hitoyasumi suru e L8 休日 kyûjitsu rappresentano il significato dei composti di kanji (binomi, trinomi ecc. con o senza finali) con onyomi, kunyomi o lettura mista. Pertanto, l'elemento principale dell'HC-LO K1 (休 kyû) di questa scheda kanji può essere combinato con due o più altri kanji per formare LO lessicografici, come L6 teikyûbi, L7 hitoyasumi suru e L8 kyûjitsu. Se uno di essi ha più di un significato, dovrebbe essere considerato come due o più LO; - indicare altri kanji HC-O, come K2 一, K3 定, K4 日; - essere collegato a kanji simili, come K5 体 e K6 伏 o altri kanji di rilevanza storica o di altro tipo. Qualsiasi tipo di LO sopra menzionato avrebbe dovuto prevedere uno slot per: - pronuncia (o pronunce, perché possono esserne due o più; se ci sono omofoni, i puntatori dovrebbero portare al rispettivo LO); - lingua dei segni e altri tipi di mezzi di comunicazione alternativa e aumentata. La lingua e l'alfabeto giapponesi altamente complicati sono stati scelti per illustrare il metodo di composizione e decomposizione di LO a livello di semantica lessicale. Prendere il giapponese, una lingua complicata con un com-
22 Christian Galinski, L'interoperabilità del contenuto come prerequisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning per lo script plicato, come base per la progettazione dei modelli di dati di LO per un repository LO a livello di semantica lessicale ha vantaggi. Può rendere più facile affrontare i fenomeni nel mondo dei simboli non linguistici, come nella figura seguente. In alcuni paesi esistono addirittura varianti dello stesso segnale stradale, a seconda di dove viene utilizzato in termini di posizione sulla strada o come segnale stradale tradizionale o in un segnale a messaggio variabile (VMS) (Galinski 2011). La maggior parte dei kanji giapponesi si trovano - spesso con letture irregolari - nelle denominazioni, cioè nei nomi propri di persone, luoghi, organizzazioni, edifici e altri oggetti. Soprattutto nelle lingue con sistemi di scrittura non latini, la corretta scrittura e lettura dei nomi propri rappresenta spesso grandi difficoltà per l'allievo. Per non parlare del corretto ordinamento dei nomi in tali sistemi di scrittura. Volando sopra la Siberia verso la Cina si può leggere sul monitor di volo il nome cinese per Novosibirsk che inizia con 新xin, che significa "nuovo", traducendo l'elemento nome novo in cinese. Il resto del nome sibirsk=Siberia è trascritto con caratteri cinesi. Pertanto, i nomi propri possono dover essere trascritti o (parzialmente o completamente) "tradotti". In ogni caso, i nomi propri […] allo stesso modo delle entità terminologiche e lessicografiche […] possono essere LO importanti e possono essere trattati con lo stesso approccio sopra descritto. L'approccio dell'ISO/TC 37 può servire da modello per tutti i tipi di contenuti strutturati. Ma, come già menzionato in precedenza, il Registro di categorie di dati per le risorse linguistiche (DCR) (ISO 12620:2009) dell'ISO/TC 37 dovrebbe e in effetti può essere esteso ad altri tipi di contenuti strutturati al di là dei dati lessicografici e terminologici, nonché alle nuove esigenze di eApplication, ad esempio per scopi di eLearning e eAccessibilità eInclusione. Per coloro che sono spaventati dalla complessità, potrebbe esserci una via d'uscita […] non così nuova, ma in realtà raramente applicata […]: la federazione delle risorse
23Terminologija | 2012 | 19 di contenuti strutturati. Applicando la filosofia di Dublin Core, un certo strato di categorie di dati (che sono uguali per diversi tipi di contenuti strutturati) dovrebbe essere standardizzato e implementato in qualsiasi risorsa garantendo così l'interoperabilità dei contenuti. Il pieno grado di complessità non è implementato in una super risorsa, ma distribuito su diverse risorse di diversi tipi di contenuti strutturati. Questo modo di garantire l'interoperabilità dei contenuti ha il ri-purposing di entità di strutturato content in mind still needs further investigation. 6. FUTURE STANDARDIZATION NEEDS Alla luce di quanto sopra, l'ISO/DCR potrebbe aver bisogno di categorie di dati aggiuntive. L'ISO/DCR contiene oggi le categorie di dati di base e molte categorie di dati estese per i dati terminologici e lessicografici. Il modello di dati terminologici e il modello di dati lessicografici si basano su di essi. L'uso di categorie di dati (non esattamente la stessa cosa dei metadati o degli elementi di dati) sembra essere molto appropriato per i contenuti strutturati in LO at the level of lexical semantics in particular. Besides, data categories can be distinguished into primary data categogenerale e per le categorie di dati ri e secondari (ISO 10241-1:2011) (o anche per le categorie di dati terziari). Le categorie di dati primari si riferiscono ai dati di base, come termini, definizioni ecc. Le categorie di dati secondari si riferiscono, tra l'altro, ad attributi come preferito, ammesso o obsoleto (termine). Le categorie di dati terziari si riferiscono a informazioni aggiuntive (se non sono considerate categorie di dati secondari), come quelle che si riferiscono agli elementi del riferimento alla fonte dei dati terminologici (applicabile anche ad altri tipi di contenuto strutturato) come descritto nella norma ISO 12615:2004 Riferimenti bibliografici e identificatori di fonte per il lavoro terminologico. Le categorie di dati primari conformemente alla norma ISO 10241-1 adattate alle LO sono (rispetto alla tabella 1 dell'allegato 1) le seguenti: - numero di iscrizione […] unico per l'iscrizione nella banca dati delle LO; - (categoria di metadati:) rappresentazione designativa di contenuti strutturati → cioè termini, che coprono anche sinonimi, omonimi ecc. da estendere a qualsiasi tipo di rappresentazione designativa di contenuti strutturati, ognuno dei quali dovrebbe avere il proprio ID di entità, estendendo così l'autonomia dei termini verso l'autonomia della rappresentazione; - (categoria di metadati:) rappresentazione descrittiva di contenuti strutturati → cioè definizioni, spiegazioni,
24 Christian Galinski, Contentinteroperabilityasaprerequisitefor Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning towards any kind of descriptive representation of structured content contesti ecc. da estendere includendo rappresentazioni descrittive non - (metadata category:) example → if necessary to be split up into difverbali; tipi di esempi; - (categoria di metadati:) nota → se necessario suddiviso in diversi tipi di nota; - (metadata category:) source → if necessary to be split up into different types of source and their respective conditions for use. Se l'entità di rappresentazione designativa del contenuto strutturato è verbale, si applica la ripetibilità per lingua, nonché la ripetibilità all'interno della lingua in caso di sinonimi (cadduno dei quali dovrebbe anche ottenere il proprio ID di entità). Se l'entità di rappresentazione designativa del contenuto strutturato è non verbale, si applica la ripetibilità per campo di utilizzo o applicazione. Può anche esserci un certo tipo di ripetibilità all'interno del campo di applicazione dell'uso (come i segnali stradali di limite di velocità a seconda della loro posizione lungo la strada o al centro di un'autostrada in alcuni paesi, o segnali stradali dello stesso significato diversi in vari stati degli Stati Uniti). Ci sono variazioni della lingua dei segni all'interno della stessa lingua dei segni così come dei Blissymbols. Ciò che è stato detto sopra dimostra che la ripetibilità dovrebbe essere in base alla "comunità di utilizzo" (ovvero locale in localizzazione) piuttosto che in base alla lingua. Naturalmente la comunità di utilizzo può anche essere una comunità linguistica, ma la ripetibilità da e all'interno dei luoghi fornisce più flessibilità per coprire tutti i fenomeni incontrati nel contenuto strutturato. 7. Conclusioni Negli ultimi dieci anni i limiti dell'interoperabilità semantica dal punto di vista dell'informatica sono diventati evidenti. Oltre all'interoperabilità tecnica (ovvero hardware e software) e organizzativa, l'interoperabilità semantica dovrebbe comprendere l'interoperabilità sintattica, concettuale e pragmatica. L'interoperabilità dei contenuti fornisce un approccio ancora più ampio e generico per quanto riguarda le rappresentazioni comunicative delle informazioni e delle conoscenze […] prende anche in considerazione la piena riutilizzazione e la riutilizzazione di entità di diversi tipi di contenuti strutturati (Galinski, Van Isacker 2010). La riutilizzazione può comprendere, ad esempio, l'adattamento delle voci terminologiche esistenti
25Terminologia | 2012 | 19 - come oggetti di apprendimento (LO) nell'eLearning o - per essere utilizzati da persone con disabilità (PwD) per la comunicazione generale munication and of course also for learning purposes. International Standards for content interoperability are the prerequisite for: - avoiding a huge duplication of efforts, - developing methods (incl. certification) and devices to assure content quality, - introdurre ampiamente l'interoperabilità dei contenuti nei schemes, - enabling many eApplications to re-use and re-purpose existing contenuti strutturati dell'istruzione e della formazione. Sempre più spesso, tutti i tipi di contenuti strutturati dovrebbero essere riutilizzabili e riutilizzabili su tutte le piattaforme del sistema. Inoltre, dovrebbero essere attuati sempre più metodi cooperativi e distribuiti basati sul web per lo sviluppo di contenuti in collaborazione con campi interconnessi in base a un approccio integrativo. A questo proposito, l'uso intensivo delle tecnologie mobili avrà un impatto enorme: eContent sta diventando mContent (contenuti per dispositivi mobili). Nel corso di questi sviluppi, sarebbe opportuno sviluppare relazioni metodologiche e di progettazione dei sistemi più forti tra la gestione delle risorse di contenuti e la linguistica dei corpus al fine di utilizzare meglio le conoscenze acquisite. - corpus esistenti e futuri con caratteristiche migliorate, ad esempio per l'estrazione di singoli elementi di contenuto strutturato in modo sistematico (tenendo anche in considerazione le frequenze di occorrenza a seconda del dominio, del registro di livello e dell'applicazione in modo da migliorare l'estrazione di oggetti di apprendimento nel contesto); - elementi di contenuto strutturato nei repository esistenti e futuri al fine di migliorare l'elaborazione dei corpus per ulteriori nuovi scopi, come la didattica; - metodi esistenti e emergenti, nonché strumenti in settori che finora mostrano un basso grado di interrelazione e integrazione metodologica, a beneficio reciproco; - creare e mantenere sistematicamente (e con sforzi partecipativi) oggetti di apprendimento, in particolare per il CLIL (apprendimento integrato di contenuti e lingua).
26 Christian Galinski, L'interoperabilità dei contenuti come prerequisito per Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning Efforts in standardization (and cooperation in standardization) should be stepped up. The proper integration of AAC requirements in the data la modellazione di contenuti strutturati andrebbe a beneficio non solo di coloro che nella società ne hanno bisogno più urgentemente, ma in definitiva di tutti. Ciò richiede una maggiore enfasi sulle pertinenti tecnologie assistive nell'istruzione e nella formazione relative alle TIC il prima possibile. I partecipanti alla conferenza ICCHP 20103 hanno confermato che la formazione e gli studi formali esistenti non sono sufficienti, anche se certificati in base a determinati sistemi di attestazione della certificazione, per quanto riguarda le competenze e le qualifiche necessarie per familiarizzare con le questioni coinvolte nell'interoperabilità globale dei contenuti e in particolare nell'accessibilità e l'inclusione. La "Recomandazione sui principi di sviluppo del software e dei contenuti 2010" (cfr. allegato 2) è stata formulata in un seminario speciale all'ICCHP 2010 e successivamente approvata da diversi comitati tecnici nel campo della standardizzazione e nel 2012 dal gruppo di gestione (MoU/MG) del memorandum di intesa ITU-ISO-IEC-UNECE sulla standardizzazione del commercio elettronico. REFERENCES Galinski Ch. 2011: A sign equals thousand words. Consistency of traffic / road signs and verbal messages. – Infrastructureandsafetyinacollaborativeworld.Roadtrafficsafety. Evangelos Bekiaris, Marion Wiethoff, Evangelia Gaitanidou eds., Heidelberg, Dordrecht, London, New York: Springer, 263–284. Galinski Ch., Reineke D. 2011: Vor uns die Terminologieflut. – eDITion 2/2011, 8–12. Galinski Ch., Van Isacker K. 2010: Standards-based Content Resources: A Prerequisite for Content Integration and Content Interoperability. – Computershelpingpeoplewithspecialneeds.12thInternationalConference, ICCHP2010,Vienna,Austria,July2010.Proceedings, Part I., K. Miesenberger e.a. (eds.), Berlin, Heidelberg, New York: Springer, 573–579. Gonnissen L., Mornie G. 1983: Bestimmenunderkennenleichtgemacht.Vögel.Diewichtigstenheimischen Arten [Birds of Europe], translated from French by Sieglinde Summerer and Gerda Kurz, Zürich/Köln: Benziger Verlag. Gruber T. R., June 1993: A translation approach to portable ontology specifications (PDF). KnowledgeAcquisition5 (2), 199–220. – http://tomgruber.org/writing/ontolingua-kaj-1993.pdf. Hodges M., Okazaki T. Japanesekanjiflashcards. Series 2, volume 1, Tokyo: White Rabbit Press, s.a. Kitazawa T., Windhab R., Galinski Ch. 2007: UntersuchungvonFlashcardsystemen(elektronischeLernkarteien)fürCALL(computergestütztenSpracherwerb)undCASPLL(computergestütztenFachsprachenerwerb) aufAnfängerniveau.MitdemSchwerpunktaufJapanisch-LernenzumErwerbeinerhohenlexikalischen Sprachkompetenz–ohnedaslangfristigeZieleinermehrsprachigenFlashcard-Lernplattformzuvernachlässigen. McEnery T., Xiao R., Tono Y. 2006: Corpus-basedLanguageStudies:AnAdvancedResourceBook, London/ New York: Routledge. Schmitz K.-D. 2006: Data modeling: From terminology to other multilingual structured content. – TSTT 2006.InternationalConferenceonTerminology,StandardizationandTechnologyTransfer.Proceedings.Beijing,China,2006-08-25/26. Yuli Wang, Yu Wang, Ye Tian (eds.), Beijing: Encyclopedia of China Publishing House. 3 12th International conference on computers helping people with special needs (ICCHP 2010), Vienna, Austria, July 2010
27Terminologija | 2012 | 19 REFERENCED StaNDaRDS ISO/IEC Guide 2:2004 Standardizationandrelatedactivities–Generalvocabulary. ISO 639 (series) Codesfortherepresentationofnamesoflanguages. ISO/IEC 2382-36:2008 Informationtechnology–Vocabulary – Part 36: Learning,educationandtraining. ISO 3166 (series) Codesfortherepresentationofnamesofcountriesandtheirsubdivisions. ISO/TS 8000-1:2011 Dataquality – Part 1: Overview. ISO 10241-1:2011 Terminologicalentriesinstandards – Part 1: Generalrequirementsandexamplesofpresentation. ISO 10241-2:2012 Terminologicalentriesinstandards – Part 2: Adoptionofstandardizedterminologicalentries. ISO 12615:2004 Bibliographicreferencesandsourceidentifiersforterminologywork. ISO 12620:2009 Terminologyandotherlanguageandcontentresources–Specificationofdatacategoriesand managementofaDataCategoryRegistryforlanguageresources. ISO 15924:2004 Informationanddocumentation–Codesfortherepresentationofnamesofscripts. ISO/CD 17347:2012 OntologyIntegrationandInteroperability(OntoIOp)– Part 1: TheDistributedOntology Language(DOL). ISO/DIS 22274:2011 Systemstomanageterminology,knowledgeandcontent–Concept-relatedaspectsfordevelopingandinternationalizingclassificationsystems. IEEE (Institute of Electrical and Electronics Engineers, Inc.). LOM standard 1484.12.1-2002 DraftStandardforLearningObjectMetadata. tURINIO SVEIKUMO BŪtINYB NaUDOJANt StRUKtŪRIZUOtOtO TURINIO VIENETUS KaIP ELEKTRONINIO MOKYMOSI OBJEKTUS PaKaRtINAI aR PaGaLIt KOKI PaSKIRtėja Daug Viena Turinio platformą, siūlančių vartotojams areli internet, bet vis darinio irinio metodologio, turgio ottimo gerinio, turinio są są są, atsižvelga, garantimo, teorimo, experience. Tokių platformų skaičius augs ir toliau, nes vis daugiau išteklių kuriama ir naudojama taikant nepakankamai veiksmingus metodus. Kad būtų užtikrinta turinio kokybė, o pirmiausiai patikimumas, reikalingas įvairių priemonių derinimas (standartai, informacinės ir komunikacinės technologijos, sertifikavimas ir kt.). Elektroniniam mokymuisi svarbus skirtumas tarp bendrosios kalbos (angl. LGP) ir specialiosios kalbos (angl. LSP). Tam, kad būtų galima sukurti daugiakalbius, daugiamodalinius, daugelio paskirčių mokymosi objektų duomenų modelius, leksinės semantikos lygmeniu būtina tobulinti ribotas dabartinių duomenų bazių galimybes. Reikėtų daugiau dėmesio skirti: a) dati presentati in basi di bendrosios kalbos ir specialiosios kalbos įrašų panašumui; b) dati bazių įrašų žodinių elementų tarimo nuorodoms; c) pateikimui nežodinių žymenų ir atvaizdų, kurie, atsižvelgiant į taikymo sritį, gali būti tokie pat svarbūs kaip žodiniai žymenys ir net labiau už juos pageidautini; frasi di lingua speciale; f) non sono in grado di comunicare con i colleghi. d) leksinių vienetų dėmenims, pavyzdžiui, morfologiniams elementams; e) didesniems leksiniams vienetams, pavyzdžiui, bendrosios kalbos kolokacijoms ar Straipsnyje pateikiami argumentai dėl žemiau išvardytų dalykų būtinumo: - standardų, kuriuose pateikti pasaulinio turinio sąveikumo užtikrinimo reikalavimai ir gairės, įskaitant elektroniniam mokymuisi keliamus reikalavimus;
28 Christian Galinski, Interoperabilità dei contenuti come prerequisito per - coordinato Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning strategijos, skatinančios tokių standartų taikymą (pavyškin, pasitelkiant sertifikavimą); - strumenti per assicurare la conformità degli standard con i sistemi in via di sviluppo. Queste norme e misure potrebbero contribuire a soddisfare già ora più o meno chaotich turinio plėtrą (sukeliančią didžiulį veiklos dubliavimą) o bent jau leistų aiškiai išskirti patikimo turinio saugyklas. Gauta 20 marzo 2012 Christian Galinski è stato nominato presidente della Commissione europea. Centro internazionale di informazione terminologica (Infoterm) Gymnasiumstrasse 50, 1190 Vienna, Austria E-mail [email protected] Stella Blanca Giraldo Pérez è stata nominata Centro internazionale di informazione terminologica (Infoterm) Gymnasiumstrasse 50, 1190 Vienna, Austria) E-mail [email protected]
29Terminologia | 2012 | 19 Allegato 1, tabella 1 […] Panoramica delle categorie di dati di una voce terminologica standardizzata conformemente alla norma ISO 10241-1 Primary data categoriesaSecondary data categoriesb (including administrative data and usage Name Mandatory/optional; numero di iscrizione ripetibile o non ripetibile ... obbligatorio; non […] punti alti […] […] […] […] o altro slot in conformità con il segno del repeatable titolare, ...) nell'ordine delle regole del termine termc (or string of five halfpreferito (s), organismo di normalizzazione ad esempio genere, numero, obbligatorio; codice della lingua orale o del codice della ammesso: termine (s), termine (s) obsoleto (s), informazione grammaticale ripetibile parte del scrittura, o entrambi uso geografico (ad esempio codice di paese) pronuncia simbolo di lettera di status normativo ... facoltativo (a meno che il della lettera non sia un codice entrambi standardizzati); uso codice o il simbolo della lingua di scrittura internazionale o geografico ripetibile (ad esempio codice di paese) simbolo grafico di stato normativo ... facoltativo (a meno geografico non sia nazionale tra (ad esempio codice di paese); definizione di status che il simbolo grafico di uso standardizzato a livello normativo ripetibile ... Obbligatorio (a meno che un rappresentazione verbale è convenzione all'interno del rispettivo dominio o soggetto); non ripetibile rappresentazione non-dominio o un soggetto, se la necessaria, sia utilizzato per
30 Christian Galinski, Interoperabilità dei contenuti come prerequisito Blanca Stella Giraldo Pérez re-usingandre-purposingitemsofstructured contentaslearningobjectsineLearning Primary data categoriesaSecondary data categoriesb (including administrative data and usage per l'informazione) Name Mandatory/optional; repeatable/nonnon verbale ripetibile ... Obbligatoria (se esiste […] che utilizzata al posto di una definizione per convenzione all'interno del rispettivo dominio o argomento); esempio non ripetibile ... facoltativo; ripetibile […] nota all'entrata completa una definizione o viene (compresa la nota facoltativa); ripetibile […] a un termine, a un grafico, a una definizione, a un contesto, a una rappresentazione non verbale, ad esempio, a una determinata sezione linguistica di una voce terminologica multilingue o all'intera voce terminologica) ... simbolo di lettera, a un simbolo fonte dell'intero terminolo-Facoltativo (a meno che l'iscrizione terminologica supplementare (compresa multilingue, il numero di clausola, il contesto, l'iscrizione non verbale) o qualsiasi sezione linguistica esterna per i nomi delle lingue conformemente alla norma ISO 639, se necessario in combinazione con codici per i nomi come eventuali termini sinonimi esistenti, varianti, forme complete, forme abbreviate, omografi, antonimi e l'iscrizione terminologica di origine o relativa alla fonte, del termine, del simbolo di lettera, di una sezione autorevole di una fonte multilingue); a Tutte le categorie di dati primari, ad eccezione della categoria di dati dei paesi conformemente alla norma ISO 3166 o codici per i nomi delle scritture conformemente alla norma termini equivalenti in altre lingue, siano incluse in questa categoria. linguistica di un termine come il numero di pagina, il simbolo grafico, la definizione, la rappresentazione "numero di inserimento", sono ripetibili per lingua e le categorie di dati primari sono completate da un codice ISO 15924. c Per semplicità, solo "termine" è specificato nella tabella 1, sebbene altre designazioni verbali, therefore, apply to multilingual standards. Additional rules for terminological entries in a multilingual terminology standard are given in Clause 7. b All secondary data categories are optional except where they are crucial for disambiguation (…) and in cases where multilingual information is included in one terminological entry, in which case the