Groups | Search | Server Info | Keyboard shortcuts | Login | Register [http] [https] [nntp] [nntps]


Groups > de.comp.os.unix.linux.misc > #114693 > unrolled thread

de_DE:utf8 oder de_DE.UTF-8?

Started byMarc Haber <mh+usenetspam1118@zugschl.us>
First post2021-02-08 10:18 +0100
Last post2021-02-14 12:25 +0100
Articles 16 on this page of 36 — 15 participants

Back to article view | Back to de.comp.os.unix.linux.misc


Contents

  de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 10:18 +0100
    Re: de_DE:utf8  oder de_DE.UTF-8? Ulli Horlacher <framstag@rus.uni-stuttgart.de> - 2021-02-08 10:03 +0000
    Re: de_DE:utf8  oder de_DE.UTF-8? Holger Schauer <Holger.Schauer@gmx.de> - 2021-02-08 12:00 +0100
      Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 14:20 +0100
        Re: de_DE:utf8  oder de_DE.UTF-8? Holger Schauer <Holger.Schauer@gmx.de> - 2021-02-08 15:37 +0100
          Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 16:15 +0100
            Re: de_DE:utf8  oder de_DE.UTF-8? Florian Weimer <fw@deneb.enyo.de> - 2021-02-08 18:17 +0100
    Re: de_DE:utf8  oder de_DE.UTF-8? Urs Janßen <urs@niko.tin.org> - 2021-02-08 11:23 +0000
      Re: de_DE:utf8  oder de_DE.UTF-8? Michael Bäuerle <michael.baeuerle@stz-e.de> - 2021-02-08 13:35 +0100
        Re: de_DE:utf8  oder de_DE.UTF-8? Urs Janßen <urs@niko.tin.org> - 2021-02-08 13:05 +0000
          Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 14:24 +0100
            Re: de_DE:utf8  oder de_DE.UTF-8? Michael Bäuerle <michael.baeuerle@stz-e.de> - 2021-02-08 16:32 +0100
            Re: de_DE:utf8  oder de_DE.UTF-8? Marcus Jodorf <trap@killfile.de> - 2021-02-09 01:24 +0100
              Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-09 07:24 +0100
                Re: de_DE:utf8  oder de_DE.UTF-8? Thomas Dorner <de.comp.os.unix.linux.misc.210209.dorner@spamgourmet.com> - 2021-02-09 19:49 +0100
                  Re: de_DE:utf8  oder de_DE.UTF-8? Marcus Jodorf <trap@killfile.de> - 2021-02-09 22:38 +0100
                  Re: de_DE:utf8  oder de_DE.UTF-8? Helmut Waitzmann <nn.throttle@xoxy.net> - 2021-02-09 22:37 +0100
                    Re: de_DE:utf8  oder de_DE.UTF-8? Thomas Dorner <de.comp.os.unix.linux.misc.210210.dorner@spamgourmet.com> - 2021-02-10 19:17 +0100
                      Re: de_DE:utf8  oder de_DE.UTF-8? Helmut Waitzmann <nn.throttle@xoxy.net> - 2021-02-10 22:02 +0100
                        Re: de_DE:utf8  oder de_DE.UTF-8? Thomas Dorner <de.comp.os.unix.linux.misc.210211.dorner@spamgourmet.com> - 2021-02-11 16:30 +0100
                          Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-11 20:49 +0100
              Re: de_DE:utf8  oder de_DE.UTF-8? Michael Bäuerle <michael.baeuerle@stz-e.de> - 2021-02-12 10:50 +0100
        Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 14:23 +0100
          Re: de_DE:utf8  oder de_DE.UTF-8? Andreas Kohlbach <ank@spamfence.net> - 2021-02-08 11:49 -0500
            Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 21:35 +0100
              Re: de_DE:utf8 oder de_DE.UTF-8? Claus Reibenstein <creibens@gmail.com> - 2021-02-08 22:09 +0100
                Re: de_DE:utf8 oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-09 07:24 +0100
                  Re: de_DE:utf8 oder de_DE.UTF-8? Başar Alabay <alabay@gmx.net> - 2021-02-09 07:20 +0000
      Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 14:22 +0100
        Re: de_DE:utf8  oder de_DE.UTF-8? Urs Janßen <urs@niko.tin.org> - 2021-02-08 13:56 +0000
          Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 15:28 +0100
            Re: de_DE:utf8  oder de_DE.UTF-8? Urs Janßen <urs@niko.tin.org> - 2021-02-08 15:20 +0000
              Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-08 16:33 +0100
                Re: de_DE:utf8  oder de_DE.UTF-8? Urs Janßen <urs@niko.tin.org> - 2021-02-08 16:22 +0000
    Re: de_DE:utf8  oder de_DE.UTF-8? Bastian Blank <usenet@waldi.eu.org> - 2021-02-13 12:03 +0000
      Re: de_DE:utf8  oder de_DE.UTF-8? Marc Haber <mh+usenetspam1118@zugschl.us> - 2021-02-14 12:25 +0100

Page 2 of 2 — ← Prev page 1 [2]


#114790

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-11 20:49 +0100
Message-ID<s041oc$62k$1@news1.tnib.de>
In reply to#114787
Thomas Dorner
<de.comp.os.unix.linux.misc.210211.dorner@spamgourmet.com> wrote:
>Und sobald die
>Ausgabe nicht zum erwarteten Ergebnis paßt (z.B. nicht mit de_DE
>anfängt)

Das tut sie eh nicht, da kommt nur UTF-8 raus.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114792

FromMichael Bäuerle <michael.baeuerle@stz-e.de>
Date2021-02-12 10:50 +0100
Message-ID<AABgJk9RAUQAAACh.A1.flnews@WStation5.stz-e.de>
In reply to#114730
Marcus Jodorf wrote:
> 
> [...]
> Wenn man die locale setzt, gibt man die zu verwendende charmap an.
> Das Format ist „LANG=<ll>_<CC>.<charmap><@modifiers>“
> Am besten verwendet man bei der charmap den canonical name des Systems.
> Bei meinem Debian:
> 
> bofh@foobar:~$ LC_ALL=de_DE.UTF-8 locale charmap
> UTF-8
> bofh@foobar:~$ LC_ALL=de_DE.utf8 locale charmap
> UTF-8
> 
> Canonical name ist hier offenbar „UTF-8“. Also verwendet man vorzugsweise
> das, wenn man LC_*, usw. setzt, weil manchmal Anwendungen nicht mit allen
> Aliasen klarkommen. Bei Xlib war das z.b. mal ein notorisches Problem.
> „utf8“ ist hier bei mir nur ein Alias.
> 
> Noch deutlicher vielleicht hiermit:
> bofh@foobar:~$ LC_ALL=de_DE.iso88591 locale charmap
> ISO-8859-1
> bofh@foobar:~$ LC_ALL=de_DE.iso8859-1 locale charmap
> ISO-8859-1
> bofh@foobar:~$ LC_ALL=de_DE.iso-8859-1 locale charmap
> ISO-8859-1
> bofh@foobar:~$ LC_ALL=de_DE.ISO-8859-1 locale charmap
> ISO-8859-1

Zum Vergleich das Verhalten bei NetBSD:

| $ LC_ALL=de_DE.UTF-8 locale charmap
| UTF-8
| $ LC_ALL=de_DE.utf8 locale charmap
| 646

| $ LC_ALL=de_DE.iso88591 locale charmap
| 646
| $ LC_ALL=de_DE.iso8859-1 locale charmap
| 646
| $ LC_ALL=de_DE.iso-8859-1 locale charmap
| 646
| $ LC_ALL=de_DE.ISO-8859-1 locale charmap
| 646

| $ LC_ALL=de_DE.ISO8859-1 locale charmap
| ISO8859-1

[toc] | [prev] | [next] | [standalone]


#114705

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-08 14:23 +0100
Message-ID<rvre0a$o3d$1@news1.tnib.de>
In reply to#114701
Michael Bäuerle <michael.baeuerle@stz-e.de> wrote:
>Doppelpunkt vor dem "codeset"-Feld, wie im Subject, passt aber nicht auf
>dieses Schema.

Das war ein unbemerkt gebliebener Tippfehler, es heißt de_DE.UTF8.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114717

FromAndreas Kohlbach <ank@spamfence.net>
Date2021-02-08 11:49 -0500
Message-ID<875z32sdwh.fsf@usenet.ankman.de>
In reply to#114705
On Mon, 08 Feb 2021 14:23:22 +0100, Marc Haber wrote:
>
> Michael Bäuerle <michael.baeuerle@stz-e.de> wrote:
>>Doppelpunkt vor dem "codeset"-Feld, wie im Subject, passt aber nicht auf
>>dieses Schema.
>
> Das war ein unbemerkt gebliebener Tippfehler, es heißt de_DE.UTF8.

Maus zum Copy'n Paste kaputt?
-- 
Andreas

[toc] | [prev] | [next] | [standalone]


#114722

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-08 21:35 +0100
Message-ID<rvs7b7$feq$1@news1.tnib.de>
In reply to#114717
Andreas Kohlbach <ank@spamfence.net> wrote:
>On Mon, 08 Feb 2021 14:23:22 +0100, Marc Haber wrote:
>>
>> Michael Bäuerle <michael.baeuerle@stz-e.de> wrote:
>>>Doppelpunkt vor dem "codeset"-Feld, wie im Subject, passt aber nicht auf
>>>dieses Schema.
>>
>> Das war ein unbemerkt gebliebener Tippfehler, es heißt de_DE.UTF8.
>
>Maus zum Copy'n Paste kaputt?

Bei so trivialen Dingen geht Tippen einfach schneller. Und meist
klappt das ja auch.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114724 — Re: de_DE:utf8 oder de_DE.UTF-8?

FromClaus Reibenstein <creibens@gmail.com>
Date2021-02-08 22:09 +0100
SubjectRe: de_DE:utf8 oder de_DE.UTF-8?
Message-ID<i8dnjeFdns8U2@mid.individual.net>
In reply to#114722
Marc Haber schrieb am 08.02.2021 um 21:35:

> Andreas Kohlbach <ank@spamfence.net> wrote:
>
>> Maus zum Copy'n Paste kaputt?
>
> Bei so trivialen Dingen geht Tippen einfach schneller. Und meist
> klappt das ja auch.

Tippen ist aber immer eine zusätzliche Fehlerquelle (wie man hier ja
gesehen hat), und die sollte man so weit als möglich vermeiden. Das
vermeidet lästige Rückfragen und verhindert Missverständnisse.

Gruß
Claus

[toc] | [prev] | [next] | [standalone]


#114734 — Re: de_DE:utf8 oder de_DE.UTF-8?

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-09 07:24 +0100
SubjectRe: de_DE:utf8 oder de_DE.UTF-8?
Message-ID<rvt9qt$k6v$1@news1.tnib.de>
In reply to#114724
Claus Reibenstein <creibens@gmail.com> wrote:
>Marc Haber schrieb am 08.02.2021 um 21:35:
>
>> Andreas Kohlbach <ank@spamfence.net> wrote:
>>
>>> Maus zum Copy'n Paste kaputt?
>>
>> Bei so trivialen Dingen geht Tippen einfach schneller. Und meist
>> klappt das ja auch.
>
>Tippen ist aber immer eine zusätzliche Fehlerquelle (wie man hier ja
>gesehen hat), und die sollte man so weit als möglich vermeiden. Das
>vermeidet lästige Rückfragen und verhindert Missverständnisse.

Völlig richtig. Und was machen wir jetzt?

-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114738 — Re: de_DE:utf8 oder de_DE.UTF-8?

FromBaşar Alabay <alabay@gmx.net>
Date2021-02-09 07:20 +0000
SubjectRe: de_DE:utf8 oder de_DE.UTF-8?
Message-ID<rvtd3h$gk0$1@dont-email.me>
In reply to#114734
Marc Haber schrieb:

> Claus Reibenstein <creibens@gmail.com> wrote:
>>Marc Haber schrieb am 08.02.2021 um 21:35:
>>
>>> Andreas Kohlbach <ank@spamfence.net> wrote:
>>>
>>>> Maus zum Copy'n Paste kaputt?
>>>
>>> Bei so trivialen Dingen geht Tippen einfach schneller. Und meist
>>> klappt das ja auch.
>>
>>Tippen ist aber immer eine zusätzliche Fehlerquelle (wie man hier ja
>>gesehen hat), und die sollte man so weit als möglich vermeiden. Das
>>vermeidet lästige Rückfragen und verhindert Missverständnisse.
> 
> Völlig richtig. Und was machen wir jetzt?

Alles superseden und nochmal von vorne!

B. Alabay

[toc] | [prev] | [next] | [standalone]


#114704

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-08 14:22 +0100
Message-ID<rvrdvb$o35$1@news1.tnib.de>
In reply to#114700
Urs Janßen <urs@niko.tin.org> wrote:
>In <rvqvl6$qj6$1@news1.tnib.de> on Mon, 08 Feb 2021 10:18:30, Marc Haber wrote:
>> 
>> Ich habe das auf Twitter und im IRC angesprochen, und da haben Leute
>> mit BSD-Hintergrund gesagt, ich solle nach /usr/share/locale gucken.
>> Da steht aber gar nichts über UTF8. Auf de_DE matcht nur
>> /usr/share/locale/de_DE, und in dem Verzeichnis gibt es nur ein
>> LC_MESSAGES und ein paar .mo Files. Auch in /usr/lib/locale habe ich
>> nur C.UTF-8 und locale-archive.
>
>/usr/share/i18n/SUPPORTED

Da stehen die .UTF-8 Varianten drin.

>/usr/share/X11/locale/locale.alias

Da stehen die .utf8 Varianten drin mit eine rechten Spalte auf die
.UTF-8 Variante.

Und wo bekommt locale -a die offensichtlich älteren Schreibweisen her?

Hintergrund: In meiner .bash_profile frage ich locale -a ab und setze
dann LANG und die LC-Variablen entsprechend, um auf Systemen, bei
denen z.B. de_DE.UTF-8 fehlt, kein ungültiges locale zu setzen. Dazu
bräuchte ich eine sichere Methode, die auf dem System vorhandenen
Locales zu erfahren.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114708

FromUrs Janßen <urs@niko.tin.org>
Date2021-02-08 13:56 +0000
Message-ID<rvrfva$mms$1@akk3-dmz.akk.uni-karlsruhe.de>
In reply to#114704
Marc Haber wrote:
> Und wo bekommt locale -a die offensichtlich älteren Schreibweisen her?

[locale(1)]
| FILES
|       /usr/lib/locale/locale-archive
|              Usual default locale archive location.

~> strace -e file locale -a 1>/dev/null 
[...]
openat(AT_FDCWD, "/usr/lib/locale/locale-archive", O_RDONLY|O_CLOEXEC) = 3

~ > strings /usr/lib/locale/locale-archive  | grep -i .utf
de_DE.utf8
[...]

[toc] | [prev] | [next] | [standalone]


#114709

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-08 15:28 +0100
Message-ID<rvrhqa$v47$1@news1.tnib.de>
In reply to#114708
Urs Janßen <urs@niko.tin.org> wrote:
>Marc Haber wrote:
>> Und wo bekommt locale -a die offensichtlich älteren Schreibweisen her?
>
>[locale(1)]
>| FILES
>|       /usr/lib/locale/locale-archive
>|              Usual default locale archive location.
>
>~> strace -e file locale -a 1>/dev/null 
>[...]
>openat(AT_FDCWD, "/usr/lib/locale/locale-archive", O_RDONLY|O_CLOEXEC) = 3
>
>~ > strings /usr/lib/locale/locale-archive  | grep -i .utf
>de_DE.utf8
>[...]

Schön zu sehen dass Du immer noch so drauf bist wie vor 25 Jahren. Das
hat mir irgendwie gefehlt.

Offensichtlich wird /usr/lib/locale-archive von locale.gen geschrieben
(eine Art Cache? Was sucht das in /usr?):

|[7/6181]mh@drop:~ $ date
|Mo 8. Feb 15:27:38 CET 2021
|[8/6182]mh@drop:~ $ ls -la /usr/lib/locale/locale-archive 
|-rw-r--r-- 1 root root 3,3M Feb  8 15:07 /usr/lib/locale/locale-archive
|[9/6183]mh@drop:~ $ sudo locale-gen
|[sudo] password for mh: 
|Generating locales (this might take a while)...
|  de_DE.UTF-8... done
|  en_GB.UTF-8... done
|  en_US.UTF-8... done
|Generation complete.
|[10/6184]mh@drop:~ $ ls -la /usr/lib/locale/locale-archive 
|-rw-r--r-- 1 root root 3,3M Feb  8 15:27 /usr/lib/locale/locale-archive
|[11/6185]mh@drop:~ $ 

Es bleibt ungeklärt, wo die Schreibweise mit .utf8 herkommt, und ob
sie richtig oder falsch ist.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114712

FromUrs Janßen <urs@niko.tin.org>
Date2021-02-08 15:20 +0000
Message-ID<rvrkrd$nhu$1@akk3-dmz.akk.uni-karlsruhe.de>
In reply to#114709
Marc Haber wrote:
> Offensichtlich wird /usr/lib/locale-archive von locale.gen geschrieben

~ > file /usr/sbin/locale-gen
/usr/sbin/locale-gen: POSIX shell script, ASCII text executable

> Es bleibt ungeklärt, wo die Schreibweise mit .utf8 herkommt,

aus _nl_normalize_codeset()

https://code.woboq.org/userspace/glibc/intl/l10nflist.c.html#_nl_normalize_codeset

[toc] | [prev] | [next] | [standalone]


#114714

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-08 16:33 +0100
Message-ID<rvrlke$6j9$1@news1.tnib.de>
In reply to#114712
Urs Janßen <urs@niko.tin.org> wrote:
>Marc Haber wrote:
>> Offensichtlich wird /usr/lib/locale-archive von locale.gen geschrieben
>
>~ > file /usr/sbin/locale-gen
>/usr/sbin/locale-gen: POSIX shell script, ASCII text executable
>
>> Es bleibt ungeklärt, wo die Schreibweise mit .utf8 herkommt,
>
>aus _nl_normalize_codeset()
>
>https://code.woboq.org/userspace/glibc/intl/l10nflist.c.html#_nl_normalize_codeset

Mein C ist ziemlich eingerostet; das sieht so aus als ob Buchstaben
lowercaset werden und alles was nicht alphanumerisch gelöscht wird und
ich damit also auch de_DE.U)/&T+#F.8 schreiben könnte.

Das würde für mich heißen, dass sowohl UTF-8 als auch utf8 korrekt
sind und die Software, die zwingend UTF-8 sehen möchte, fehlerhaft
ist.

Hätte es Dir wirklich einen Zacken aus der Krone gebrochen, Dein
vorhandenes Wissen etwas weniger von oben herab rüberzubringen? Wenn
Du meine Fragen als unter Deinem Niveau empfindest musst Du ja nicht
antworten.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [next] | [standalone]


#114716

FromUrs Janßen <urs@niko.tin.org>
Date2021-02-08 16:22 +0000
Message-ID<rvrogc$og4$1@akk3-dmz.akk.uni-karlsruhe.de>
In reply to#114714
Marc Haber wrote:
> Das würde für mich heißen, dass sowohl UTF-8 als auch utf8 korrekt
> sind und die Software, die zwingend UTF-8 sehen möchte, fehlerhaft
> ist.

_ich_ weurde fuer Linux eher sagen:
korrekt ist UTF-8 (locale -m), utf8 wird akzeptiert.

fuer andere OS gilt das nicht zwingend.

# .rc
LC_CTYPE=$(locale -a|grep -i en_US.UTF)

urs
-- 
LC_MESSAGES="et_EE.u:\)\&T-+#F.8" ls -ld /tmp/n 2>&1|cut -d: -f2
 /tmp/n ei saa kasutada

[toc] | [prev] | [next] | [standalone]


#114804

FromBastian Blank <usenet@waldi.eu.org>
Date2021-02-13 12:03 +0000
Message-ID<slrns2fg0l.6g8.usenet@mobilewave.waldi.eu.org>
In reply to#114693
Moin Marc

Marc Haber wrote:
> Nun habe ich hier ein Tool, debspawn, das eine Warnung wirft, wenn
> LANG nicht auf .UTF-8 matcht und sagt, dass das system kein Unicode
> könne. Das lässt mich daran zweifeln, ob .utf8 richtig ist.

Das ist sowieso kaputt, weil neue Locales immer UTF-8 sind, aber das
Suffix nicht bekommen. Erstes gefundenes Beispiel ist "aa_ER".

> Ist auf meinem System (und auf allen anderen meiner Systeme auch,
> dieses Verhalten zieht sich auf alle meine Kisten) irgendwas nicht ok?
> Wie ist es "richtig" auf einem "modernen" System?

UTF-8 und utf8 sind an einigen Stellen equivalent, was man auch hieran
sieht:

| openat(AT_FDCWD, "/usr/lib/locale/de_DE.UTF-8/LC_NUMERIC", O_RDONLY|O_CLOEXEC) = -1 ENOENT (No such file or directory)
| openat(AT_FDCWD, "/usr/lib/locale/de_DE.utf8/LC_NUMERIC", O_RDONLY|O_CLOEXEC) = 3

Wenn man etwas gräbt, kommt man auf eine Funktion _nl_normalize_codeset,
welche mit folgendem Kommentar versehen ist:

| Normalize codeset name.  There is no standard for the codeset
| names.  Normalization allows the user to use any of the common
| names.

Das ist also partiell beabsichtig.

Bastian

[toc] | [prev] | [next] | [standalone]


#114854

FromMarc Haber <mh+usenetspam1118@zugschl.us>
Date2021-02-14 12:25 +0100
Message-ID<s0b1bu$529$1@news1.tnib.de>
In reply to#114804
Bastian Blank <usenet@waldi.eu.org> wrote:
>Marc Haber wrote:
>> Nun habe ich hier ein Tool, debspawn, das eine Warnung wirft, wenn
>> LANG nicht auf .UTF-8 matcht und sagt, dass das system kein Unicode
>> könne. Das lässt mich daran zweifeln, ob .utf8 richtig ist.
>
>Das ist sowieso kaputt, weil neue Locales immer UTF-8 sind, aber das
>Suffix nicht bekommen. Erstes gefundenes Beispiel ist "aa_ER".

Damit kann ich jetzt einen Bugreport gegen debspawn aufmachen und muss
meine Scripts und mein funktionierendes Setup nicht ändern. Das ist
gut ;-)

Danke für diese Entdeckung.

>Das ist also partiell beabsichtig.

Aber ziemlich schlecht dokumentiert.

Grüße
Marc
-- 
-------------------------------------- !! No courtesy copies, please !! -----
Marc Haber         |   " Questions are the         | Mailadresse im Header
Mannheim, Germany  |     Beginning of Wisdom "     | 
Nordisch by Nature | Lt. Worf, TNG "Rightful Heir" | Fon: *49 621 72739834

[toc] | [prev] | [standalone]


Page 2 of 2 — ← Prev page 1 [2]

Back to top | Article view | de.comp.os.unix.linux.misc


csiph-web