LINUXSOFT.cz Přeskoč levou lištu
Uživatel: Heslo:  
   CZUKPL

> Programujeme s XML (7.) - Simple API for XML

Simple API for XML neboli SAX je alternativní rozhraní XML parserů, osobně si myslím, že je pro běžného programátora užitečné jen ve velmi speciálních případech, a proto se u něj jen rychle teoreticky zastavíme.

13.7.2004 15:00 | Aleš Hakl | Články autora | přečteno 10606×

Simple API for XML neboli SAX na rozdíl od rozhraní DOM nenačítá dokument do stromu v paměti, ale pouze jej proudově čte a volá funkce/metody/signály, které si aplikace k tomuto účelu nastavila. Dle mého názoru to není příliš uživatelsky přívětivé, ale pokud pouze potřebujeme dokument rychle projít a nepotřebujeme funkcionalitu DOM, je to rozhodně rychlejší. Za zmínku jistě stojí, že většina implementací DOM používá SAX jako rozhraní k vlastnímu parseru.

Implementací SAXu je velmi mnoho, a protože se nejedná o žádný standard, ale spíše takovou úmluvu, je každá poněkud odlišná. Proto se nebudu zabývat konkrétními detaily a omezím se pouze na popis jednotlivých událostí, které jsou ve všech implementacím více méně identické.

characters

Tato událost je vyvolána pro znaková data ve vstupním proudu. Stejně jako textové uzly v DOM stromu může být vyvoláná několikrát po sobě. V případě SAXu je tato situace navíc daleko pravděpodobnější, jelikož k událostem často dochází již při načítání dokumentu, které se může zastavit uprostřed textu.

endDocument

Tato událost je, jak již název napovídá, vyvolána na konci dokumentu. Také je vyvolána v případě, že dojde k nějaké chybě během zpracování (dokument není well-formed a podobně).

endElement

Výskyt uzavírajícího tagu elementu vyvolá tuto událost, jako parametr dostaneme jméno elementu a v případě SAX2 (s podporou jmenných prostorů) také jeho lokální jméno (část za dvojtečkou) a URI jmenného prostoru.

endPrefixMapping

Tato událost dostupná pouze v SAX2 nás informuje o tom, že prefix jmenného prostoru pozbyl platnosti. Pro běžné zpracování dokumentu nepotřebujeme tuto událost nijak řešit.

ignorableWhitespace

Pokud by naše aplikace potřebovala zpracovávat mezery, nové řádky a podobné znaky, které se v XML slučují do jednoho, použijeme tuto událost.

processingInstruction

Událost processingInstruction je vyvolána při výskytu instrukce pro zpracování, jako parametry dostaneme cíl instrukce a vlastní obsah. Na rozdíl od události characters je vyvolána vždy pro celou instrukci.

skippedEntity

Pokud parser z nějakého důvodu přeskočí entitu, vyvolá tuto událost. Důvodem k přeskočení entity může být například to, že neví, za jaký obsah jí má nahradit.

startDocument

Toto je první skutečná událost, která je vyvolána při zpracování XML dokumentu. Je to vhodné místo pro přípravu datových struktur do kterých načítáme a podobně.

startElement

Otevírající tag elementu způsobí tuto událost. V parametrech nalezneme jeho jméno (a případně lokální jméno a URI jmenného prostoru) a atributy v podobě poměrně zajímavé datové struktury obsahující i různé další užitečné informace kromě hodnoty, ovšem právě v řešení této struktury se implementace často liší, například v PHP je použito běžné asociativní pole.

startPrefixMapping

Tato událost, jež je protějškem události endPrefixMapping, nám oznamuje, že parser vstoupil do rozsahu platnosti prefixu jmenného prostoru. V běžných aplikacích se nemusíme touto událostí znepokojovat, protože parametry události startElement a jiné jmennými prostory ovlivňované hodnoty jsou správně nastaveny a rozvinuty automaticky. Dokumentace SAX2 uvádí, že tato metoda je užitečná v případě výskytu prefixů jmenných prostorů v textu nebo hodnotách atributů, osobně jsem takový dokument ještě neviděl.

Při tvorbě tohoto popisu jsem vycházel z originální dokumentace javového SAX2 a SAX. Různé implementace se výrazně liší. Jistě se najdou aplikace, pro které je SAX vhodný, ale vzhledem k tomu, že se jedná o dost nízkoúrovňovou záležitost, myslím, že jako rychlý úvod tento článek stačil, a kdo má důvod SAX použít, jistě si sám potřebnou dokumentaci najde a nebo položí dotaz v diskuzi. Příště se, jak jsem již slíbil minule, podíváme na jazyk XSLT určený pro transformace XML dokumentů.

Verze pro tisk

pridej.cz

 

DISKUZE

Nejsou žádné diskuzní příspěvky u dané položky.



Příspívat do diskuze mohou pouze registrovaní uživatelé.
> Vyhledávání software
> Vyhledávání článků

15.4.2017 15:20 /František Kučera
Máš rád svobodný software a hardware nebo se o nich chceš něco dozvědět? Zajímá tě IoT a radiokomunikace? Přijď na sraz spolku OpenAlt, který se bude konat ve středu 19. dubna od 18:30 v Šenkovně (Sokolská 60, Praha 2).
Přidat komentář

5.3.2017 19:12 /Redakce Linuxsoft.cz
PR: 23. března proběhne v Praze konferenci na téma Cloud computing v praxi. Hlavními tématy jsou: Nejžhavější trendy v oblasti cloudu a cloudových řešení, Moderní cloudové služby, Infrastruktura současných cloudů, Efektivní využití cloudu, Nástrahy cloudových řešení a jak se jim vyhnout.
Přidat komentář

27.2.2017 22:12 /František Kučera
Pozvánka na 137. sraz OpenAlt – Praha: Tentokrát jsme si pro vás připravili neobvyklou akci. Ve středu 1.3. v 17:30 nás přivítá sdružení CZ.NIC ve svých prostorách v Milešovské ulici číslo 5 na Praze 3, kde si pro nás připravili krátkou prezentaci jejich činnosti. Následně navštívíme jejich datacentrum pod Žižkovskou věží. Provedou nás prostory, které jsou běžnému smrtelníkovi nedostupné!
Po ukončení prohlídky se všchni odebereme do hostince U vodoucha, Jagelonská 21, Praha 3 pochutnat si na některém z vybraných piv či dát si něco na zub. Rezervaci máme od 19:30, heslo je OpenAlt.
Ale pozor! Do prostor datového centra máme omezený přístup, dostane se tam pouze 10 lidí! Takže kdo přijde dříve, ten má přednost, a občanky s sebou! Kdo nebude chtít na prohlídku datového centra, může se pomalu přesunout do hostince U vodoucha a u nepřeberné nabídky piv počkat na ostatní.
Přidat komentář

18.1.2017 0:49 /František Kučera
Členové a příznivci spolku OpenAlt se pravidelně schází v Praze a Brně. Fotky z pražských srazů za uplynulý rok si můžete prohlédnout na stránkách spolku. Příští sraz se koná už 19. ledna – tentokrát je tématem ergonomie ovládání počítače – tzn. klávesnice, myši a další zařízení. Také budete mít příležitost si prohlédnout pražský hackerspace Brmlab.
Přidat komentář

8.1.2017 17:51 /František Kučera
Máš rád svobodný software a hardware nebo se o nich chceš něco dozvědět? Přijď na sraz spolku OpenAlt, který se bude konat ve čtvrtek 19. ledna od 18:30 v pražském hackerspacu Brmlab. Tentokrát je tématem srazu ergonomie ovládání počítače – tzn. klávesnice, myši a další zařízení. K vidění bude mechanická klávesnice dasKeyboard, trackball Logitech nebo grafický tablet (a velký touchpad) Wacom. Přineste i vy ukázat svoje zajímavé klávesnice a další HW. V 18:20 je sraz před budovou, v 18:30 jdeme společně dovnitř, je tedy dobré přijít včas. Podle zájmu se později přesuneme do nějaké restaurace v okolí.
Přidat komentář

1.12.2016 22:13 /František Kučera
Máš rád svobodný software a hardware nebo se o nich chceš něco dozvědět? Přijď na sraz spolku OpenAlt, který se bude konat ve čtvrtek 8. prosince od 18:00 v Radegastovně Perón (Stroupežnického 20, Praha 5). Sraz bude tentokrát tématický. Bude retro! K vidění budou přístroje jako Psion 5mx nebo Palm Z22. Ze svobodného hardwaru pak Openmoko nebo čtečka WikiReader. Přijďte se i vy pochlubit svými legendami, nebo alespoň na pivo. Moderní hardware má vstup samozřejmě také povolen.
Komentářů: 1

4.9.2016 20:13 /Pavel `Goldenfish' Kysilka
PR: Dne 22.9.2016 proběhne v Praze konference Cloud computing v praxi. Tématy bude např. nejnovější trendy v oblasti cloudu a cloudových řešení, provozování ERP v cloudu, o hostování různých typů softwaru, ale třeba i o zálohování dat nabízeném podnikům formou služby.
Přidat komentář

1.9.2016 11:27 /Honza Javorek
Česká konference o Pythonu, PyCon CZ, stále hledá přednášející skrz dobrovolné přihlášky. Máte-li zajímavé téma, neváhejte a zkuste jej přihlásit, uzávěrka je již 12. září. Konference letos přijímá i přednášky v češtině a nabízí pomoc s přípravou začínajícím speakerům. Řečníci mají navíc vstup zadarmo! Více na webu.
Přidat komentář

   Více ...   Přidat zprávičku

> Poslední diskuze

17.4.2017 19:15 / Jakub shoop
chyba

9.3.2017 11:44 / Jaromir Obr
Re: chyba

18.1.2017 20:18 / martin horky
Spolupraca linuxu a microsoftu

17.1.2017 9:57 / Pavel Hrubeš
Re: Externí USB televizní karta

4.12.2016 22:54 / František Kučera
Dárek

Více ...

ISSN 1801-3805 | Provozovatel: Pavel Kysilka, IČ: 72868490 (2003-2017) | mail at linuxsoft dot cz | Design: www.megadesign.cz | Textová verze