Groups | Search | Server Info | Keyboard shortcuts | Login | Register [http] [https] [nntp] [nntps]


Groups > ger.ct > #338832 > unrolled thread

Mediawiki als HTML exportieren

Started byMichael Bode <m.g.bode@web.de>
First post2018-01-31 23:17 +0100
Last post2018-02-06 23:25 +0100
Articles 2 — 2 participants

Back to article view | Back to ger.ct


Contents

  Mediawiki als HTML exportieren Michael Bode <m.g.bode@web.de> - 2018-01-31 23:17 +0100
    Re: Mediawiki als HTML exportieren Peter Faust <peter.faust-solingen@t-online.de> - 2018-02-06 23:25 +0100

#338832 — Mediawiki als HTML exportieren

FromMichael Bode <m.g.bode@web.de>
Date2018-01-31 23:17 +0100
SubjectMediawiki als HTML exportieren
Message-ID<fdetjdFmolU1@mid.individual.net>
Hi,

Tschuldigung für On-Topic, aber kennt jemand eine Methode den Inhalt
eines Mediawiki als HTML Seiten zu exportieren, die auch wirklich
funktioniert? Ich hab diverse Beispiele im Web gefunden, wo das mit
Variationen von

wget -k -p -r -m https://wiki.domain/startseite

gemacht wurde, nur liefert mir das immer zwar ne Menge Mist wie die
Navigations-Links aber nur einen kleinen Teil des Inhalts.

[toc] | [next] | [standalone]


#339581

FromPeter Faust <peter.faust-solingen@t-online.de>
Date2018-02-06 23:25 +0100
Message-ID<12ea85d4-98a1-a5dd-0779-fba56b3b58c2@peter.faust-solingen.dialin.t-online.de>
In reply to#338832
Michael Bode wrote:

> Hi,
> 
> Tschuldigung für On-Topic, aber kennt jemand eine Methode den Inhalt
> eines Mediawiki als HTML Seiten zu exportieren, die auch wirklich
> funktioniert? Ich hab diverse Beispiele im Web gefunden, wo das mit
> Variationen von
> 
> wget -k -p -r -m https://wiki.domain/startseite
> 
> gemacht wurde, nur liefert mir das immer zwar ne Menge Mist wie die
> Navigations-Links aber nur einen kleinen Teil des Inhalts.

Bisher bin ich mit folgender Zeile gut gefahren:

wget -p -m -k -K -E https://wiki.ubuntuusers.de -a ./wgetlog -e robots=off

BTW: -K konvertiert alle Links auf das lokale Download-Verzeichnis.
BTW²: ./wgetlog nutze ich für downloads in der Nacht.
BTW³: -e robots=off ignoriert eventuelle robots.txt

index.html aufrufen, Seite lässt sich komplett lokal betrachten.
(incl. Bildern, Audio- und Videofiles)

HTH

-- 
"Ein lustiger Gefährte ist ein Rollwagen auf der Wanderschaft."
		-- Goethe, Maximen und Reflektionen, Nr. 280

[toc] | [prev] | [standalone]


Back to top | Article view | ger.ct


csiph-web