Skip to main content

Organizace znalostí: klíčová témata (Ukázka, strana 99)

Page 1

v praxi nejsou tyto procesy vnímány jako oddělené a neprobíhají ve stanovené sekvenci. Z výše uvedených důvodů se omezíme na ilustrativní výčet nejtypičtějších podprocesů organizace znalostí a jejich stručnou charakteristiku. V kapitole 1.4 byly jako nejvýznamnější označeny procesy identifikace, obsahové analýzy a začlenění do kontextu. Identifikace spočívá v definování a odlišení organizované jednotky od ostatních. Principům identifikace se věnuje kapitola 3.1.1. Obsahová analýza (hloubková analýza) se zaměřuje na určení jednotek obsahu. Cílem je vyjádřit smysl sdělení obsaženého v informačním zdroji, typicky prostřednictvím nějakých jazykových výrazů. Problémům obsahové analýzy se věnuje kapitola 5. Začlenění do kontextu se děje s cílem vyjádřit vztah organizované jednotky k jiným entitám v témže nebo v jiném informačním zdroji: zařazením do nějaké skupiny (kategorizace, klasifikace) nebo začleněním do sémantické nebo citační sítě (odkazy, citační vazby). Problematice vztahů se věnuje kapitola 4. K dalším typickým podprocesům organizace zaznamenaných znalostí patří: ▪ Fyzické uspořádání, tj. umísťování, kolokace (přemísťování, oddělování a spojování) a řazení (například dokumentů ve skladišti, souborů na pevném disku počítače, ale i jmen nebo názvů). ▪ Popis (formální, povrchová analýza) – určení a označení jednotek formy či formálních vlastností zdroje. Popis typicky spočívá v rozpoznání vlastností popisovaného objektu a v určení jejich hodnoty. Účelem popisu je identifikace entity, tj. její odlišení od ostatních entit. Principům popisných procesů se věnuje detailně kapitola 3. ▪ Analýza struktury – určení vzájemného vztahu jednotek obsahu a jednotek formy. ▪ Explicitní vyjádření výsledků analýzy: jazykovými výrazy (indexace), schématem struktury, odkazy – mezi zdroji, příp. mezi zdroji a metadaty. ▪ Hodnocení (kvality, relevance) zdroje. ▪ Kategorizace – řeší logické uspořádání souvisejících jednotek do tříd ekvivalence. Principy kategorizace jsou popsány v kapitole 3.1.2. ▪ Klasifikace – kromě logického uspořádání souvisejících jednotek do tříd ještě určuje vzájemný vztah tříd. Principy klasifikace jsou popsány v kapitole 3.1.2. ▪ Reorganizace – opakované provedení organizace.

2.4.2 PROCES PŘÍSTUPU KE ZNALOSTEM Typologie přístupu ke znalostem ovlivňuje jednak způsob, jak budou znalosti organizovány, jednak výstupy z procesu organizace. Těsné sepětí a vzájemná závislost organizace a přístupu ke znalostem jsou naznačeny na obrázku 11, na němž je schematicky znázorněno pět možných alternativ přístupu – 98 –

Ukázka elektronické knihy, UID: KOS257396


softwarové algoritmy plnotextové vyhledávání

zdroj

formulování (vyjádření)

porovnání

výběr metadata reprezentace informačního zdroje zpracování (organizace)

Obr. 11: Alternativy přístupu ke znalostem

dotaz reprezentace informační potřeby

uvědomění informační potřeba

sociální sítě listování

uživatel znalosti

ke znalostem. V každé z variant se jedná o specifickou aplikaci Shannon-Weaverova lineárního komunikačního modelu na model přístupu k informacím a informačního chování. Směr šipek odlišuje dva typy přístupu lišící se způsobem interakce uživatele se zdrojem – aktivní a pasivní.187 Plné čáry označují tři typy přístupu s aktivním podílem uživatele, přerušovanými čarami jsou označeny dva způsoby přístupu, které aktivitu uživatele nevyžadují. Přístup s metadaty Předmětem zájmu odborníků je tradičně přístup ke znalostem prostřednictvím prohledávání předem organizovaných zdrojů, vyžadující aktivní roli zpracovatele (poskytovatele, autora, organizátora) i uživatele. Jedná se o přístup, který je vhodný pro tematicky orientovaný zpětný hloubkový průzkum. V digitálních knihovnách a podobných elektronických kolekcích se často označuje anglickým termínem resource discovery (doslova objevování zdrojů). Tuto alternativu by s ohledem na nezbytný produkt zpracování bylo možné nazvat přístup s metadaty. Před samotným vyhledáváním je informační zdroj podroben intelektuálnímu zpracování – organizaci založené na popisu a obsahové analýze organizovaného zdroje. Produktem zpracování jsou vysoce formálně i sémanticky strukturované údaje o daném zdroji (tj. metadata). Strukturovaná metadata jsou základem tzv. sekundárních zdrojů – katalogů, bibliografií, znalostních bází, rejstříků, indexových souborů a obvykle i dalších podpůrných nástrojů, nazývaných dnes systémy organizace znalostí (tezaury, klasifikace, soubory autorit). Stejný postup jako při zpracování zdroje absolvuje i uživatel – provede obsahovou analýzu své informační potřeby a vyjádří ji jazykem daného zdroje. V praxi se lze setkat s různými scénáři, v nichž se konkretizují a vzájemně kombinují jednotlivé organizační podprocesy v závislosti na specifických 187 Poznámka: Někdy se tyto způsoby interakce odlišují anglickými termíny push a pull, převzatými z nápisů na dveřích (tlačit–táhnout), přičemž push označuje interakci s aktivitou na straně zdroje a pull aktivitu na straně uživatele.   Systémový přístup k organizaci znalostí: cíl, prvky, procesy, kontext     – 99 –

Ukázka elektronické knihy, UID: KOS257396


vlastnostech pořádaných zdrojů a uživatelských potřeb. Příkladem takového scénáře mohou být postupy při organizaci a vyhledávání knihovních dokumentů s použitím systému organizace znalostí, kupříkladu Mezinárodního desetinného třídění – MDT. Proces má dva aktéry – indexátora, který zpracovává dokument, a uživatele, který hledá dokument určitého obsahu. Indexátor provede obsahovou analýzu dokumentu, pro výsledné pojmy vyhledá ekvivalenty mezi třídami MDT a tyto třídníky zařadí do metadatového selekčního obrazu dokumentu (typicky do záznamu v katalogu). Uživatel provede obsahovou analýzu své informační potřeby, výsledné pojmy vyjádří pomocí tříd MDT a tyto třídníky zařadí do svého dotazu. Vyhledávací program porovná třídníky zadané uživatelem s třídníky v selekčních obrazech dokumentů a zpřístupní uživateli množinu ekvivalentních záznamů dokumentů (hity). Vysoká náročnost na intelektuální zpracování (je nutno předem zpracovat dokumenty i dotazy), doprovázená rizikem vzniku šumů právě v důsledku těchto zpracovatelských procesů, je vyvážena možností vícenásobné použitelnosti takto vytvořených reprezentativních pojmových modelů (abstrakcí) obsahu, zbavených nepodstatných detailů a nezávislých na konkrétním jazykovém vyjádření. Umožňuje ovšem jen makroanalýzu na úrovni dokumentu jako celku, případná jemnější granularita je jen omezená (je možné například zpracování jednotlivé kapitoly z knihy, ale detailnější sémantické zpracování jednotlivých poznatků či faktů už nikoli). Tento způsob přístupu je použitelný pro jakýkoli typ i formát zdroje – analogový i digitální, textový i netextový. V případě netextových (např. obrazových) zdrojů je přístup prostřednictvím metadat prakticky jediným způsobem, jak umožnit jejich vyhledávání. Technologickým základem je metadatové schéma. Plnotextové vyhledávání Přístup ke znalostem prostřednictvím přímého prohledávání neorganizovaných zdrojů počítačovou technologií doplněnou o relevanční zpětnou vazbu je v zásadě opačným typem k vyhledávání s metadaty. Plnotextové vyhledávání v čisté podobě nepředpokládá žádnou intelektuální organizaci a porovnává texty dokumentů a dotazů v přirozeném jazyce. Technologickou podmínkou efektivního přístupu je samozřejmě indexový soubor (viz kapitola 3.2), který se ovšem vytváří automaticky. Metadata, jež jsou základním stavebním prvkem indexového souboru, jsou přebírána přímo ze zdroje, a jsou tedy jeho kopií, organizovanou tak, aby umožnila rychlé vyhledávání (obvykle se však provádí určitá redukce, například se odstraňuje interpunkce nebo nevýznamná slova). Tento typ přístupu je vhodný pro vyhledávání známého a nezastupitelný při vyhledávání detailů, například jednotlivých slov, jmen apod. Umožňuje mikroanalýzu na syntaktické (nikoli ovšem na sémantické) úrovni. Aktivní roli hraje uživatel, tento typ přístupu nevyžaduje aktivní roli zpracovatele (organizátora), neboť svěřuje zodpovědnost za vyhledávání plně algoritmizovaným počítačovým programům. Vychází z hypotézy, že veškerá informace o obsahu zdroje je obsažena v něm samém, a že je tedy možné se vyvarovat potenciálních – 100 –

Ukázka elektronické knihy, UID: KOS257396


Turn static files into dynamic content formats.

Create a flipbook
Organizace znalostí: klíčová témata (Ukázka, strana 99) by Kosmas-CZ - Issuu