Groups | Search | Server Info | Keyboard shortcuts | Login | Register [http] [https] [nntp] [nntps]
Groups > ger.ct > #338832 > unrolled thread
| Started by | Michael Bode <m.g.bode@web.de> |
|---|---|
| First post | 2018-01-31 23:17 +0100 |
| Last post | 2018-02-06 23:25 +0100 |
| Articles | 2 — 2 participants |
Back to article view | Back to ger.ct
Mediawiki als HTML exportieren Michael Bode <m.g.bode@web.de> - 2018-01-31 23:17 +0100
Re: Mediawiki als HTML exportieren Peter Faust <peter.faust-solingen@t-online.de> - 2018-02-06 23:25 +0100
| From | Michael Bode <m.g.bode@web.de> |
|---|---|
| Date | 2018-01-31 23:17 +0100 |
| Subject | Mediawiki als HTML exportieren |
| Message-ID | <fdetjdFmolU1@mid.individual.net> |
Hi, Tschuldigung für On-Topic, aber kennt jemand eine Methode den Inhalt eines Mediawiki als HTML Seiten zu exportieren, die auch wirklich funktioniert? Ich hab diverse Beispiele im Web gefunden, wo das mit Variationen von wget -k -p -r -m https://wiki.domain/startseite gemacht wurde, nur liefert mir das immer zwar ne Menge Mist wie die Navigations-Links aber nur einen kleinen Teil des Inhalts.
[toc] | [next] | [standalone]
| From | Peter Faust <peter.faust-solingen@t-online.de> |
|---|---|
| Date | 2018-02-06 23:25 +0100 |
| Message-ID | <12ea85d4-98a1-a5dd-0779-fba56b3b58c2@peter.faust-solingen.dialin.t-online.de> |
| In reply to | #338832 |
Michael Bode wrote: > Hi, > > Tschuldigung für On-Topic, aber kennt jemand eine Methode den Inhalt > eines Mediawiki als HTML Seiten zu exportieren, die auch wirklich > funktioniert? Ich hab diverse Beispiele im Web gefunden, wo das mit > Variationen von > > wget -k -p -r -m https://wiki.domain/startseite > > gemacht wurde, nur liefert mir das immer zwar ne Menge Mist wie die > Navigations-Links aber nur einen kleinen Teil des Inhalts. Bisher bin ich mit folgender Zeile gut gefahren: wget -p -m -k -K -E https://wiki.ubuntuusers.de -a ./wgetlog -e robots=off BTW: -K konvertiert alle Links auf das lokale Download-Verzeichnis. BTW²: ./wgetlog nutze ich für downloads in der Nacht. BTW³: -e robots=off ignoriert eventuelle robots.txt index.html aufrufen, Seite lässt sich komplett lokal betrachten. (incl. Bildern, Audio- und Videofiles) HTH -- "Ein lustiger Gefährte ist ein Rollwagen auf der Wanderschaft." -- Goethe, Maximen und Reflektionen, Nr. 280
[toc] | [prev] | [standalone]
Back to top | Article view | ger.ct
csiph-web