Nějakým zázrakem se mi podařilo v tomhle naprostém blázinci :‘-( odladit jeden malý program, který jsem si i dnes naprogramoval. Program nedělá nic jiného než že udělá jakési společné xml, tedy jeden element se všemi jeho podelementy které najde a u každého elementu pak jeho atributy.
Na jednoduchých 2 XML to funguje dobře, třeba z:
<shop>
<sale>
<item1 id="23">
<name>Some stuff</name>
<price>23.42</price>
</item1>
<item1 id2="42" id="32">
<name>Some other stuff</name>
<price currency="EUR">42.23</price>
</item1>
</sale>
</shop>a z:
<shop>
<stock>
<item2>
<amount>456</amount>
</item2>
<item4 id="42">
<amount>123</amount>
</item4>
</stock>
</shop>Vznikne toto:
<shop>
<sale>
<item1 id="23" id2="42">
<name>Some stuff</name>
<price currency="EUR">23.42</price>
</item1>
</sale>
<stock>
<item2>
<amount>456</amount>
</item2>
<item4 id="42">
<amount>123</amount>
</item4>
</stock>
</shop>Jak vidíte, druhé xml je úplně stejné (bylo tam jen abych si ověřil zda program umí spojování souborů), ale v prvním byly provedeny změny – všechny tagy a atributy byly sloučeny do jednoho elementu item1. Nicméně na složitějším XML, jako je částečný výpis mé FB zdi, kde je v originále 79556 řádků mi to ořezalo na pouhých 44908. Na vině je zřejmě jak se tak koukám hlavně fakt, že v <table class="walllink"> je různé html..
zkoušel jsem už to přeskočit ale moc tomu svému kódu nerozumím, neboť jsem se nedostal tam kde jsem chtěl. Tak jo, už na to kašlu, někdy to dodělám ať to zvládne cokoliv, a snad se poučím, že když je něco html, tak není radno to parsovat jako XML ! 🙂 Ještě přemýšlím co s tím kódem, někomu by se to mohlo hodit, ale myslím že to nikde dávat nebudu a počkám až si najdu čas to vyladit fáze, kdy to bude zvládat snad všechno.