Configuration pour index adapté à la typographie française

Bonjour à tous,

Herbert Voss a créé xindex, un générateur d’index compatibles avec l’Unicode écrit en Lua :

┌──── │ CTAN: Package xindex └────

Son comportement par défaut ne semble pas adapté au français, notamment en ce qui concerne les (sous-(sous-(sous-)))items : si un index comporte des ⟨(sous-(sous-(sous-)))entrée⟩s, elle apparaissent au niveau :

  • 0, ainsi : ⟨entrée⟩ (OK) ;
  • 1, ainsi : -,⟨sous-entrée⟩ (pas OK : tiret à supprimer, n’est-ce pas ?) ;
  • 2, ainsi : –,⟨sous-sous-entrée⟩ (pas OK : tiret à supprimer, n’est-ce pas ?) ;
  • 3, ainsi : —,⟨sous-sous-sous-entrée⟩ (pas OK : tiret à supprimer, n’est-ce pas ?).

Nous avons préparé, dans le dépôt framagit de l’association GUTenberg, ici :

┌──── │ Vérification que vous n'êtes pas un robot ! └────

un fichier de configuration de xindex adapté à la typographie française que nous nous proposons de soumettre à Herbert.

Les tirets ci-dessus y ont déjà été supprimés mais peut-être y a-t-il d’autres choses à modifier, notamment l’ordre dans lequel doivent être classés les caractères déclinés avec leurs accents (lignes 38 et suivantes). Nous sommes preneurs de toutes suggestions concernant ce fichier, soit ici-même, soit en ajoutant un commentaire à la page ci-dessus (ce qui nécessite d’avoir un compte sur framagit).

Un autre fichier est à examiner :

┌──── │ xindex-cfg-common.lua · master · GUTenberg / Xindex · GitLab └────

notamment en ce qui concerne les abréviations « sq. » et « sqq. » servant à indiquer que la référence se poursuit dans la ou les pages suivantes : sont-elles encore (les plus) usitées de nos jours ?

Merci d’avance à ceux qui prendront le temps de faire part de leurs remarques !

Bien cordialement.

Denis Bitouzé, secrétaire de l’association GUTenberg

Le 12/03/2022 à 13:43, Denis Bitouzé a écrit :
[…]

Nous avons préparé, dans le dépôt framagit de l’association GUTenberg,
ici :

┌────
Vérification que vous n'êtes pas un robot !
└────

un fichier de configuration de xindex adapté à la typographie
française que nous nous proposons de soumettre à Herbert.

Les tirets ci-dessus y ont déjà été supprimés mais peut-être y a-t-il
d’autres choses à modifier, notamment l’ordre dans lequel doivent être
classés les caractères déclinés avec leurs accents (lignes 38 et
suivantes). Nous sommes preneurs de toutes suggestions concernant ce
fichier, soit ici-même, soit en ajoutant un commentaire à la page
ci-dessus (ce qui nécessite d’avoir un compte sur framagit).

Pourquoi conserver la ligne 57: { ‘ss’, ‘ß’ } ?

Pourquoi conserver les caractères ‘ø’ (2 fois) et ‘Ø’ (2 fois aussi) et
d’autres comme ‘Ÿ’ ? Si c’est parce que ces caractères peuvent
apparaître dans des noms propres, il faudrait alors en ajouter bien
d’autres…

Cordialement,

 Paul Gaborit

(re)Salut Denis (j’ai oublié dans mon précédent message)

Le 12/03/2022 à 13:43, Denis Bitouzé a écrit :
[…]

Nous avons préparé, dans le dépôt framagit de l’association GUTenberg,
ici :

┌────
Vérification que vous n'êtes pas un robot !
└────

un fichier de configuration de xindex adapté à la typographie
française que nous nous proposons de soumettre à Herbert.

As-tu un fichier de test pour vérifier le comportement
en français ?

Cordialement,

 Paul Gaborit

Bonjour,

D’après mon expérience, on enseignait encore l’usage de « sq. » il y a dix ou quinze ans ; mais c’était pour nous dire de préférer l’indication des pages exactes à l’utilisation de cette abréviation. On trouve aussi « ss. ».

J’avoue que je suis assez étonné par la présentation des sous-entrées en arborescence. La présentation suivante en un seul paragraphe, tirée du premier livre qui me tombe sous la main, me paraît plus typique :

Ligues : 155, 281 (péloponnésienne) ; 172, 201, 285, 291 (béotienne) ; 172, 345, 445 (thessalienne) ; 483 (autres).

Mais il semblerait que ça puisse se régler en faisant des redéfinitions dans \g@addto@macro{\theindex}. Par contre, ne faudrait-il pas supprimer aussi les espaces fines si vous supprimez les tirets dans sublabels ?

Pour les intervalles (rangeSymbol), il me semble plus courant d’utiliser un trait d’union plutôt qu’un semi-quadratin.

Bien à vous,

Bastien Dumont

Le Saturday 12 March 2022 à 01:43:23PM, Denis Bitouzé a écrit :

Bonjour à tous,

Herbert Voss a créé xindex, un générateur d’index compatibles avec
l’Unicode écrit en Lua :

┌────
CTAN: Package xindex
└────

Son comportement par défaut ne semble pas adapté au français, notamment
en ce qui concerne les (sous-(sous-(sous-)))items : si un index comporte
des ⟨(sous-(sous-(sous-)))entrée⟩s, elle apparaissent au niveau :

  • 0, ainsi : ⟨entrée⟩ (OK) ;
  • 1, ainsi : -,⟨sous-entrée⟩ (pas OK : tiret à supprimer, n’est-ce
    pas ?) ;
  • 2, ainsi : –,⟨sous-sous-entrée⟩ (pas OK : tiret à supprimer,
    n’est-ce pas ?) ;
  • 3, ainsi : —,⟨sous-sous-sous-entrée⟩ (pas OK : tiret à supprimer,
    n’est-ce pas ?).

Nous avons préparé, dans le dépôt framagit de l’association GUTenberg,
ici :

┌────
Vérification que vous n'êtes pas un robot !
└────

un fichier de configuration de xindex adapté à la typographie
française que nous nous proposons de soumettre à Herbert.

Les tirets ci-dessus y ont déjà été supprimés mais peut-être y a-t-il
d’autres choses à modifier, notamment l’ordre dans lequel doivent être
classés les caractères déclinés avec leurs accents (lignes 38 et
suivantes). Nous sommes preneurs de toutes suggestions concernant ce
fichier, soit ici-même, soit en ajoutant un commentaire à la page
ci-dessus (ce qui nécessite d’avoir un compte sur framagit).

Un autre fichier est à examiner :

┌────
xindex-cfg-common.lua · master · GUTenberg / Xindex · GitLab
└────

notamment en ce qui concerne les abréviations « sq. » et « sqq. »
servant à indiquer que la référence se poursuit dans la ou les pages
suivantes : sont-elles encore (les plus) usitées de nos jours ?

Merci d’avance à ceux qui prendront le temps de faire part de leurs
remarques !

Bien cordialement.

Denis Bitouzé, secrétaire de l’association GUTenberg

Le 12/03/22 à 17h09, Paul Gaborit a écrit :

Pourquoi conserver la ligne 57: { “ss”, “ß” } ?

Pourquoi conserver les caractères “ø” (2 fois) et “Ø” (2 fois aussi) et d’autres comme “Ÿ” ? Si c’est parce que ces caractères peuvent apparaître dans des noms propres, il faudrait alors en ajouter bien d’autres…

Toutes ces remarques sont tout à fait pertinentes :slight_smile:

Pour ceux qui ne seraient abonnés à fctt, je reproduis ici un message que Daniel Flipo, l’auteur de babel-french, à ce sujet :

┌──── │ Je suis également en contact avec Herbert Voss et avec Michal Hoftig (lua-uca). │ │ Le tri des caractères accentués français requiert l’option -u de xindex qui │ force l’utilisation de l’algorithme UCA. La version lua de celui-ci, développée │ par Michal Hoftig, ne permet pas actuellement (v0.10) de classer les caractères │ accentués conformément à l’usage des dictionnaires français (sauf bien sûr │ utilisation de “@” sous xindex). │ │ Je pense pouvoir proposer à Michal sous quelques jours une implémentation │ /expérimentale/ des options [accents backward] et [alternate shifted] (pour les │ tirets, espaces, apostrophes) de l’algorithme UCA. └────

Cordialement.

Denis

Le 12/03/22 à 17h33, Paul Gaborit a écrit :

As-tu un fichier de test pour vérifier le comportement en français ?

Euh… non, j’avoue :slight_smile:

Cordialement.

Denis

Le 12/03/22 à 18h04, Bastien DUMONT a écrit :

Bonjour,

Bonjour,

D’après mon expérience, on enseignait encore l’usage de « sq. » il y a dix ou quinze ans ; mais c’était pour nous dire de préférer l’indication des pages exactes à l’utilisation de cette abréviation. On trouve aussi « ss. ».

Ah, OK. Vous préconisez donc de mettre dans ce fichier fCompress = false.

J’avoue que je suis assez étonné par la présentation des sous-entrées en arborescence. La présentation suivante en un seul paragraphe, tirée du premier livre qui me tombe sous la main, me paraît plus typique :

Ligues : 155, 281 (péloponnésienne) ; 172, 201, 285, 291 (béotienne) ; 172, 345, 445 (thessalienne) ; 483 (autres).

On ne doit pas lire les mêmes livres :slight_smile:

Ceci étant, l’index du « Lexique des règles typographiques […] » est présenté mi en arborescence, mi en un seul paragraphe : le paragraphe unique des sous-entrées est indenté.

Mais il semblerait que ça puisse se régler en faisant des redéfinitions dans \g@addto@macro{\theindex}.

Je n’ai pas eu le temps de me pencher sur la question.

Par contre, ne faudrait-il pas supprimer aussi les espaces fines si vous supprimez les tirets dans sublabels ?

Si bien sûr, j’ai omis de le préciser : merci.

Pour les intervalles (rangeSymbol), il me semble plus courant d’utiliser un trait d’union plutôt qu’un semi-quadratin.

Donc rangeSymbol = "-". OK.

Bien à vous.

Denis

Le 14/03/22 à 09h50, Denis Bitouzé a écrit :

Pour ceux qui ne seraient abonnés à fctt, je reproduis ici un message que Daniel Flipo, l’auteur de babel-french, à ce sujet :

[…]

Je signale que d’autres messages à ce sujet ont été postés sur fctt mais, afin de ne pas polluer cette liste, je me contente de donner une fois pour toutes un lien vers le fil de discussion :

┌──── │ https://groups.google.com/g/fr.comp.text.tex/c/1Z6PAnNI7cQ/ └────

et de, quand même, de mettre en exergue l’excellent document de Daniel Flipo qu’il annonce plus spécifiquement ici :

┌──── │ https://groups.google.com/g/fr.comp.text.tex/c/1Z6PAnNI7cQ/m/yRgK0utHBAAJ └────

Bonne soirée.

Denis