LINUXSOFT.cz Přeskoč levou lištu
Uživatel: Heslo:  
   CZUKPL

> Programujeme s XML (1.) Document Object Model

Protože programování kolem XML je velmi dobře standardizované, rozhodl jsem se prozatím opustit původní téma Free Pascalu a zaměřit se více na XML.

26.5.2004 08:00 | Aleš Hakl | Články autora | přečteno 24690×

Podrobné ponoření do XML bych začal poněkud netradičně údajně složitější variantou API pro XML jménem Document Object Model. Osobně si totiž myslím, že ač DOM je možná složitější na pochopení, je rozhodně jednodušší pro programování. Jelikož se jedná o API nezávislé na programovacím jazyku, ukážeme si použití ve Free Pascalu, Pythonu a programovacím jazyku Java. Uvidíme, že jednotlivé varianty jsou velice podobné, a ačkoli se místy liší, z velké části odpovídají dané normě rozhraní DOM.

Na konci minulého století vznikl jako produkt standardizace skriptovacího jazyka JavaScript takzvaný Document Object Model, jedná se o standardizované API usnadňující zpracování dokumentů XML (a i jiných strukturovaných dokumentů, například HTML nebo i třeba definice rozhraní systému CORBA). Ač je původním určením tohoto rozhraní právě použití pro skriptovaní dynamických změn webových stránek, je velmi dobře použitelné i pro jiné úkoly a manipulace se strukturovanými dokumenty.

Rozhraní DOM je publikováno postupně, v částech označovaných "levels", DOM Level 1 obsahuje většinu manipulací se strukturou dokumentu, Level 2 přidává podporu jmenných prostorů a například užitečnou metodu getElementById. Bohužel aktuální implementace DOM ve FCL podporuje spolehlivě pouze DOM Level 1. Jazyk Python podporuje DOM Level 2 a pro jazyk Java, jenž je dnes v podstatě hlavním jazykem pro DOM a XML vůbec, je, pokud vím, dostupná i experimentální implementace čerstvě publikovaného DOM Level 3. Až bude tato nová verze šířeji dostupná, můžeme se těšit na standardizovaný mechanismus načítání a ukládání a podporu XML Schémat.

Jak již napovídá slovo Object v Document Obejct Model, rozhraní je plně objektové, a skládá se z přibližně dvaceti tříd (v terminologii W3C rozhraní, interface). Pokud pomineme třídu DOMImplementation, která zapouzdřuje celé rozhraní a umožňuje nám dotazovat se na jeho schopnosti, můžeme za kořenovou třídu považovat Document. Jak tedy dokument načteme ze souboru do instance třídy Document?

Python doc = xml.dom.ext.reader.Sax2.reader().fromStream(open("jmeno_souboru.xml")
Zde používáme třídu reader z modulu xml.dom.ext.reader.Sax2, jež obaluje událostmi řízený parser XML a na základě jím generovaných událostí vytváří DOM strom.
Free Pascal ReadXMLFile(doc,'jmeno_souboru.xml');
Funkce ReadXMLFile z jednotky xmlread nám zajistí jakési načtení DOM stromu ze souboru a v zájmu našeho duševního zdraví je, abychom příliš nepátrali po tom, jak to dělá.
Java doc = javax.xml.parsers.DocumentBuilderFactory.newInstance().newDocumentBuilder().parse(new File("jmeno_souboru.xml"));
A zde začíná chaos. Velmi složitou cestou přes factory třídu získáme v podstatě další factory třídu, jež umí vytvořit instanci třídy Document načtením ze souboru. Zní to složitě, ale je to vlastně jednoduché, a navíc to umožňuje, že se nemusíme starat o to, která implementace XML se použije.

A když už umíme načíst dokument ze souboru podívejme se, jak jej vytvořit prázdný:
Python doc = xml.dom.getDOMImplementation().createDocument("jmeny_prostor","korenovy-element",0)
Tímhle způsobem se mají dokumenty správně vytvářet v DOM Level 2 a v Pythonu to snad ani nejde jinak, rozhodně jsem nepřišel na to jak. Poslední parametr (0) určuje DTD, a pokud je 0 tak dokument žádné DTD nemá.
Free Pascal (dom) doc := TXMLDocument.Create;
Vytvoření instance třídy TXMLDocument , nic víc, nic míň.
Java doc = javax.xml.parsers.DocumentBuilderFactory.newInstance().newDocumentBuilder().newDocument());
Toto rozhodně není jediná možnost, samozřejmě můžeme jít přes DOMImplementation, ale u tohoto mám ověřenu funkčnost.

A nakonec se podíváme jak náš dokument zase někam uložit:
Python doc = xml.dom.ext.PrettyPrint(doc,open("jmeno_souboru.xml","w"))
Vcelku zajímavý přístup, funkce PrettyPrint() z modulu xml.dom.ext vypíše obsah DOM stromu (1. parametr) do proudu (2. nepovinný parmetr) jako XML dokument. Snad jedině dodám, že existuje též funkce Print(), která výstupní dokument neodsazuje.
Free Pascal (xmlwrite) WriteXMLFile(doc,'jmeno_souboru.xml');
Princip jako u ReadXMLDocument() výše, něco to dělá, funguje to (téměř), vnitřnosti nás radši nezajímají.
Java javax.xml.transform.TransformerFactory.newInstance().newTransformer().transform(new javax.xml.transform.dom.DOMSource(doc), new javax.xml.transform.stream.StreamResult(new File('jmeno_souboru.xml')));
Zde děláme poměrně zajímavou věc - prázdnou XSLT transformaci, výstupem je kopie vstupu, ovšem v našem případě v jiném formátu - rovnou jako XML dokument. Osobně mě tohle řešení přijde jako poněkud "přes ruku", ale dokumentace Javy toto uvádí jako doporučený postup. Jestli je možné dokument uložit i nějak jinak jsem nezjišťoval, tohle funguje.

Ovšem vstup, výstup a vytváření objektů postrádá smysl, pokud s nimi neumíme dále pracovat. Dále nás instance třídy Document obvykle příliš nezajímá a pracujeme s jednotlivými uzly (potomky třídy Node) uvnitř. Ale na to se podíváme až příště.

Verze pro tisk

pridej.cz

 

DISKUZE

Nejsou žádné diskuzní příspěvky u dané položky.



Příspívat do diskuze mohou pouze registrovaní uživatelé.
> Vyhledávání software
> Vyhledávání článků

5.3.2017 19:12 /Redakce Linuxsoft.cz
PR: 23. března proběhne v Praze konferenci na téma Cloud computing v praxi. Hlavními tématy jsou: Nejžhavější trendy v oblasti cloudu a cloudových řešení, Moderní cloudové služby, Infrastruktura současných cloudů, Efektivní využití cloudu, Nástrahy cloudových řešení a jak se jim vyhnout.
Přidat komentář

27.2.2017 22:12 /František Kučera
Pozvánka na 137. sraz OpenAlt – Praha: Tentokrát jsme si pro vás připravili neobvyklou akci. Ve středu 1.3. v 17:30 nás přivítá sdružení CZ.NIC ve svých prostorách v Milešovské ulici číslo 5 na Praze 3, kde si pro nás připravili krátkou prezentaci jejich činnosti. Následně navštívíme jejich datacentrum pod Žižkovskou věží. Provedou nás prostory, které jsou běžnému smrtelníkovi nedostupné!
Po ukončení prohlídky se všchni odebereme do hostince U vodoucha, Jagelonská 21, Praha 3 pochutnat si na některém z vybraných piv či dát si něco na zub. Rezervaci máme od 19:30, heslo je OpenAlt.
Ale pozor! Do prostor datového centra máme omezený přístup, dostane se tam pouze 10 lidí! Takže kdo přijde dříve, ten má přednost, a občanky s sebou! Kdo nebude chtít na prohlídku datového centra, může se pomalu přesunout do hostince U vodoucha a u nepřeberné nabídky piv počkat na ostatní.
Přidat komentář

18.1.2017 0:49 /František Kučera
Členové a příznivci spolku OpenAlt se pravidelně schází v Praze a Brně. Fotky z pražských srazů za uplynulý rok si můžete prohlédnout na stránkách spolku. Příští sraz se koná už 19. ledna – tentokrát je tématem ergonomie ovládání počítače – tzn. klávesnice, myši a další zařízení. Také budete mít příležitost si prohlédnout pražský hackerspace Brmlab.
Přidat komentář

8.1.2017 17:51 /František Kučera
Máš rád svobodný software a hardware nebo se o nich chceš něco dozvědět? Přijď na sraz spolku OpenAlt, který se bude konat ve čtvrtek 19. ledna od 18:30 v pražském hackerspacu Brmlab. Tentokrát je tématem srazu ergonomie ovládání počítače – tzn. klávesnice, myši a další zařízení. K vidění bude mechanická klávesnice dasKeyboard, trackball Logitech nebo grafický tablet (a velký touchpad) Wacom. Přineste i vy ukázat svoje zajímavé klávesnice a další HW. V 18:20 je sraz před budovou, v 18:30 jdeme společně dovnitř, je tedy dobré přijít včas. Podle zájmu se později přesuneme do nějaké restaurace v okolí.
Přidat komentář

1.12.2016 22:13 /František Kučera
Máš rád svobodný software a hardware nebo se o nich chceš něco dozvědět? Přijď na sraz spolku OpenAlt, který se bude konat ve čtvrtek 8. prosince od 18:00 v Radegastovně Perón (Stroupežnického 20, Praha 5). Sraz bude tentokrát tématický. Bude retro! K vidění budou přístroje jako Psion 5mx nebo Palm Z22. Ze svobodného hardwaru pak Openmoko nebo čtečka WikiReader. Přijďte se i vy pochlubit svými legendami, nebo alespoň na pivo. Moderní hardware má vstup samozřejmě také povolen.
Komentářů: 1

4.9.2016 20:13 /Pavel `Goldenfish' Kysilka
PR: Dne 22.9.2016 proběhne v Praze konference Cloud computing v praxi. Tématy bude např. nejnovější trendy v oblasti cloudu a cloudových řešení, provozování ERP v cloudu, o hostování různých typů softwaru, ale třeba i o zálohování dat nabízeném podnikům formou služby.
Přidat komentář

1.9.2016 11:27 /Honza Javorek
Česká konference o Pythonu, PyCon CZ, stále hledá přednášející skrz dobrovolné přihlášky. Máte-li zajímavé téma, neváhejte a zkuste jej přihlásit, uzávěrka je již 12. září. Konference letos přijímá i přednášky v češtině a nabízí pomoc s přípravou začínajícím speakerům. Řečníci mají navíc vstup zadarmo! Více na webu.
Přidat komentář

27.8.2016 8:55 /Delujek
Dnes po 4 letech komunitního vývoje vyšla diaspora 0.6.0.0
diaspora* je open-source, distribuovaná sociální síť s důrazem na soukromý
Více v oficiálním blog-postu
Přidat komentář

   Více ...   Přidat zprávičku

> Poslední diskuze

24.3.2017 11:54 / Hui
country cottages

16.3.2017 16:33 / BezvaDesign.cz
Re: Hledám grafika do teamu

9.3.2017 11:44 / Jaromir Obr
Re: chyba

18.1.2017 20:18 / martin horky
Spolupraca linuxu a microsoftu

17.1.2017 9:57 / Pavel Hrubeš
Re: Externí USB televizní karta

Více ...

ISSN 1801-3805 | Provozovatel: Pavel Kysilka, IČ: 72868490 (2003-2017) | mail at linuxsoft dot cz | Design: www.megadesign.cz | Textová verze