polytypo 1.4.0 → 1.4.1
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- checksums.yaml +4 -4
- data/lib/polytypo/data/README.md +15 -0
- data/lib/polytypo/data/locales/cs.json +37 -56
- data/lib/polytypo/data/locales/de-CH.json +34 -43
- data/lib/polytypo/data/locales/de-DE.json +32 -47
- data/lib/polytypo/data/locales/el.json +1 -51
- data/lib/polytypo/data/locales/en-GB.json +4 -56
- data/lib/polytypo/data/locales/en-US.json +4 -68
- data/lib/polytypo/data/locales/es.json +29 -66
- data/lib/polytypo/data/locales/fi.json +7 -77
- data/lib/polytypo/data/locales/fr-CA.json +36 -63
- data/lib/polytypo/data/locales/fr.json +41 -70
- data/lib/polytypo/data/locales/it.json +22 -65
- data/lib/polytypo/data/locales/nl.json +29 -61
- data/lib/polytypo/data/locales/pl.json +28 -61
- data/lib/polytypo/data/locales/pt-BR.json +28 -53
- data/lib/polytypo/data/locales/pt-PT.json +28 -55
- data/lib/polytypo/data/locales/ru.json +30 -45
- data/lib/polytypo/data/locales/sv.json +4 -63
- data/lib/polytypo/data/locales/uk.json +27 -55
- data/lib/polytypo/version.rb +1 -1
- metadata +1 -1
|
@@ -44,72 +44,35 @@
|
|
|
44
44
|
"q. e. p. d.",
|
|
45
45
|
"et al."
|
|
46
46
|
],
|
|
47
|
-
"beforeUnits": [
|
|
48
|
-
|
|
49
|
-
|
|
47
|
+
"beforeUnits": [
|
|
48
|
+
"%",
|
|
49
|
+
"‰",
|
|
50
|
+
"°C",
|
|
51
|
+
"km",
|
|
52
|
+
"cm",
|
|
53
|
+
"mm",
|
|
54
|
+
"kg",
|
|
55
|
+
"mg",
|
|
56
|
+
"mL",
|
|
57
|
+
"min",
|
|
58
|
+
"dB",
|
|
59
|
+
"kW",
|
|
60
|
+
"kWh"
|
|
61
|
+
],
|
|
62
|
+
"beforeNumber": [
|
|
63
|
+
"art.",
|
|
64
|
+
"cap.",
|
|
65
|
+
"núm.",
|
|
66
|
+
"nro.",
|
|
67
|
+
"pág.",
|
|
68
|
+
"págs."
|
|
69
|
+
],
|
|
70
|
+
"beforeWord": [
|
|
71
|
+
"Sr.",
|
|
72
|
+
"Sra.",
|
|
73
|
+
"Srta."
|
|
74
|
+
],
|
|
50
75
|
"afterSymbols": [],
|
|
51
76
|
"initialBinding": "chain"
|
|
52
|
-
}
|
|
53
|
-
"sources": [
|
|
54
|
-
{
|
|
55
|
-
"rule": "quotes",
|
|
56
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «comillas», apartado 1: «En los textos impresos, se recomienda utilizar en primera instancia las comillas angulares, reservando los otros tipos para cuando deban entrecomillarse partes de un texto ya entrecomillado. En este caso, las comillas simples se emplearán en último lugar»; «Las comillas inglesas y las simples se escriben en la parte alta del renglón, mientras que las angulares se escriben centradas»",
|
|
57
|
-
"url": "https://www.rae.es/dpd/comillas",
|
|
58
|
-
"note": "El DPD establece QUÉ CLASE de signo corresponde a cada nivel y el orden de anidamiento; no nombra ningún punto de código. La identidad U+201C/U+201D procede de Unicode, autoridad para eso y para nada más. Contra las comillas rectas de máquina de escribir el DPD aporta una descripción de trazado — «en la parte alta del renglón» — y locale.schema.json las prohíbe además por su cuenta. El tercer nivel que el DPD describe (‘ ’) no es expresable: el esquema tiene primary y secondary, no tres; límite del esquema, no laguna de la fuente, igual que en el. ADVERTENCIA DE OBTENCIÓN: rae.es devuelve HTTP 403 a un cliente automático — obstáculo técnico, no obra de pago — y el texto se leyó por un proxy de extracción sobre esta URL canónica; el mismo proxy devolvió la abreviatura de «número» de dos formas distintas en dos pasadas, por lo que ningún campo de este archivo afirma un punto de código no ASCII que no se haya podido fijar por otra vía. Consultado el 18.09.2026."
|
|
59
|
-
},
|
|
60
|
-
{
|
|
61
|
-
"rule": "quotes",
|
|
62
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «comillas», apartado 1: «Las comillas se escriben pegadas a la primera y la última palabra del periodo que enmarcan, y separadas por un espacio de las palabras o signos que las preceden o las siguen»",
|
|
63
|
-
"url": "https://www.rae.es/dpd/comillas",
|
|
64
|
-
"note": "Justifica innerSpace = \"none\" en los dos pares: «pegadas» excluye todo espacio interior, ni U+00A0 ni U+202F. El español no sigue aquí el uso francés. elisionIdioms queda vacío porque el español no tiene ningún modismo de la forma {left, elided, right}: la entrada «apóstrofo» del mismo DPD afirma que el signo «apenas se usa en el español actual» y lo limita a textos antiguos, al habla reproducida y a nombres de otras lenguas. Consultado el 18.09.2026."
|
|
65
|
-
},
|
|
66
|
-
{
|
|
67
|
-
"rule": "dashes",
|
|
68
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «raya», apartado 2: «Como el resto de los signos dobles, se escriben pegadas a la primera y a la última palabra del periodo que enmarcan, y separadas por un espacio de la palabra o signo que las precede o las sigue»",
|
|
69
|
-
"url": "https://www.rae.es/dpd/raya",
|
|
70
|
-
"note": "parenthetical = \"none\" POR UN LÍMITE DEL ESQUEMA, no por falta de fuente: la fuente es explícita y prescribe espacios ORDINARIOS FUERA del par y ninguno en los bordes interiores («Llegó —por fin— a casa»). El enum no expresa esa asimetría: \"em-spaced\" pone un espacio a cada lado de CADA raya, que es lo que la frase prohíbe, y \"em-tight\" suprime los exteriores que la frase exige. Mismo caso que el griego (dashes.md §6) y que el italiano de este mismo lote; al repetirse en tres idiomas independientes deja de ser una rareza y pasa a ser una carencia del esquema, registrada aparte para resolverse en su propia versión. Mientras tanto \"none\" es lo único que el archivo puede decir con verdad, y no autoriza a aproximar. Consultado el 18.09.2026."
|
|
71
|
-
},
|
|
72
|
-
{
|
|
73
|
-
"rule": "ranges",
|
|
74
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «guion», apartado 3 b): «Indica intervalos expresados tanto en números arábigos como en romanos: las páginas 23-45; durante los siglos x-xii»; apartado 1: «Signo ortográfico en forma de pequeña línea horizontal (-)»",
|
|
75
|
-
"url": "https://www.rae.es/dpd/guion",
|
|
76
|
-
"note": "range = \"none\" por una razón DISTINTA de la de parenthetical, y confundirlas tergiversaría las fuentes. El signo español del intervalo es el guion, U+002D — el carácter que el autor ya escribió —, y el enum solo ofrece em, en o none: «no sustituir nada» es aquí a la vez lo honesto y lo correcto, porque «23-45» ya está bien escrito. El enum sí podría expresar un valor equivocado: \"en-tight\" convertiría esa forma en una que el DPD no prescribe. Consultado el 18.09.2026."
|
|
77
|
-
},
|
|
78
|
-
{
|
|
79
|
-
"rule": "ellipsis",
|
|
80
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «puntos suspensivos», apartado 1: «Signo de puntuación formado por tres puntos consecutivos (…) ―y solo tres―»",
|
|
81
|
-
"url": "https://www.rae.es/dpd/puntos%20suspensivos",
|
|
82
|
-
"note": "Justifica abbreviatedAfterTerminal = false: «y solo tres» es una exigencia expresa de número, y el español no dispone en ningún apartado de la forma de dos puntos tras «?» o «!» que sí usa el ruso. El apartado 3.4 de la misma entrada regula el ORDEN de los signos, no su número. La fuente no se pronuncia sobre U+2026 frente a tres U+002E: esa elección es del motor y es igual en todas las locales. Consultado el 18.09.2026."
|
|
83
|
-
},
|
|
84
|
-
{
|
|
85
|
-
"rule": "hyphen",
|
|
86
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «guion», apartados 1, 2 y 3: el guion une palabras y segmentos, divide la palabra al final de línea, indica intervalos y separa grupos de cifras",
|
|
87
|
-
"url": "https://www.rae.es/dpd/guion",
|
|
88
|
-
"note": "Justifica las tres listas vacías. La entrada enumera los usos del guion y en ninguno define una clase cerrada de formas morfológicas cuyo guion no deba partirse al final de línea, que es lo único que consume esta regla; al contrario, en español el guion es el signo del propio corte de línea. Con las listas vacías la regla es un no-op total demostrable (hyphen.md §2), que es el caso normal y no una carencia. Consultado el 18.09.2026."
|
|
89
|
-
},
|
|
90
|
-
{
|
|
91
|
-
"rule": "nbsp",
|
|
92
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «signos de interrogación y exclamación», apartado 1: «Se escriben pegados a la primera y la última palabra del periodo que enmarcan, y separados por un espacio de las palabras que los preceden o los siguen»",
|
|
93
|
-
"url": "https://www.rae.es/dpd/signos%20de%20interrogaci%C3%B3n%20y%20exclamaci%C3%B3n",
|
|
94
|
-
"note": "Justifica beforePunctuation y narrowBeforePunctuation vacíos por dos motivos independientes. PRIMERO, la fuente: no hay espacio antes de «?» ni de «!», ni después de «¿» ni de «¡»; el uso francés queda descartado por la norma, no por silencio. SEGUNDO, y con independencia de lo anterior, el esquema no podría expresar lo contrario: la restricción Q-P exige que todo punto de código de estas listas pertenezca a CLOSEISH, y U+00BF y U+00A1 no lo son — son puntuación de APERTURA, y el único mecanismo de «espacio tras un signo de apertura» del esquema es quotes.innerSpace. NO ES EXPRESABLE, que es distinto de no estar atestiguado. afterShortWords queda vacío por una razón más débil y se dice cuál: ninguna fuente consultada exige que una palabra breve no quede al final de línea; lo resolvería el capítulo «División de palabras al final de línea» de la Ortografía, no consultado. afterSymbols vacío: ninguna fuente española consultada liga «§» a un número. Consultado el 18.09.2026."
|
|
95
|
-
},
|
|
96
|
-
{
|
|
97
|
-
"rule": "nbsp",
|
|
98
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «símbolo», apartado 5.4: «Los símbolos deben escribirse pospuestos a la cifra a la que acompañan y dejando un blanco de separación: 33 dB, 125 m², 4 H»; «se separa de ella y se pega al símbolo de la escala si esta se especifica: 27° (por veintisiete grados), pero 27 °C»; apartado 5.6: «No deben escribirse en líneas diferentes la cifra y el símbolo que la acompaña: ⊗3 / $, ⊗7 / km»",
|
|
99
|
-
"url": "https://www.rae.es/dpd/s%C3%ADmbolo",
|
|
100
|
-
"note": "Justifica beforeUnits, y el apartado 5.6 es además la base normativa de la INDIVISIBILIDAD, dicha por la RAE y en español. El apartado 5.4 impone una exclusión que el archivo respeta: «°» a secas NO figura, porque «27°» va pegado; solo «°C». Dos advertencias de alcance. (1) La lista es MÁS ESTRECHA QUE LA FUENTE: se omiten los símbolos de una sola letra (m, g, s, h, L, A, H), que no se desambiguan sin contexto — criterio de fr —, pese a que el ejemplo del propio apartado es «4 H». (2) No se incluye ningún símbolo monetario, y no por prudencia sino por cita: el apartado 5.5 distingue expresamente el uso de España («3 £», pospuesto y con blanco) del de América («£3», antepuesto y sin blanco), y esta locale no lleva subetiqueta de región. Ese apartado se cita también en POSITIVO: el DPD sabe marcar la divergencia regional donde existe, luego los campos sobre los que no la marca son seguros para un «es» regionalmente neutro. Consultado el 18.09.2026."
|
|
101
|
-
},
|
|
102
|
-
{
|
|
103
|
-
"rule": "nbsp",
|
|
104
|
-
"cite": "BIPM, The International System of Units (SI), 9th ed. (2019), concise summary: «A single space is always left between the number and the unit»",
|
|
105
|
-
"url": "https://www.bipm.org/documents/20126/41483022/SI-Brochure-9-concise-EN.pdf",
|
|
106
|
-
"note": "Autoridad sobre la COMPOSICIÓN de la lista de unidades, igual que en en-US, en-GB, fi y sv; el DPD «símbolo» 5.4 y 5.6 es la autoridad sobre la convención española y sobre la indivisibilidad. El BIPM no se invoca como autoridad sobre el español — no lo es —, sino sobre qué cadenas son símbolos de unidad del SI. Si ambas fuentes discreparan sobre el español mandaría la RAE; no discrepan. Consultado el 18.09.2026."
|
|
107
|
-
},
|
|
108
|
-
{
|
|
109
|
-
"rule": "nbsp",
|
|
110
|
-
"cite": "RAE y ASALE, Diccionario panhispánico de dudas, entrada «abreviatura»: «Tampoco deben aparecer en renglones diferentes la abreviatura y el término del que esta depende: ⊗15 / págs., ⊗Sr. / Pérez»; «Cuando la abreviatura corresponde a una expresión compleja, se separan mediante un espacio las letras que representan cada una de las palabras que la integran»; «Las iniciales de los componentes del nombre propio de una persona son también abreviaturas formadas por truncamiento»",
|
|
111
|
-
"url": "https://www.rae.es/dpd/abreviatura",
|
|
112
|
-
"note": "Una sola cita para cuatro campos, porque una sola regla los gobierna. abbreviations: la fuente exige el espacio interior y prohíbe partirlo; las formas listadas están atestiguadas en esta entrada o en la Lista de abreviaturas de El buen uso del español. beforeNumber y beforeWord: «⊗15 / págs.» y «⊗Sr. / Pérez» son los dos ejemplos de la propia fuente, uno en cada orden. beforeWord se limita a la clase cerrada de los tratamientos de cortesía: la regla vale para CUALQUIER abreviatura, pero enumerarlas todas dispararía falsos positivos en la subrregla de mayor riesgo del esquema (nbsp.md §3.12). NO SE INCLUYEN «n.º», «D.ª» ni «Sr.ª»: la RAE prescribe una «o volada», es decir un TRAZADO y no un punto de código, y el texto obtenido devolvió dos formas distintas en dos pasadas; adivinar sería peor que omitir. initialBinding = \"chain\" ES UNA DECISIÓN DEL OPERADOR (18.09.2026), NO UNA CITA: el DPD no contiene ninguna calificación de «dos o más» — enuncia la regla general y establece que las iniciales SON abreviaturas, lo que apunta más bien a \"single\" —, pero su único ejemplo con iniciales es «J. A. Pérez», de dos, y ante una fuente que no decide se eligió el valor mayoritario en este proyecto (en-US, de-DE, de-CH, ru) y el de menor superficie de falsos positivos, porque \"chain\" no liga una mayúscula con punto aislada. En «J. A. Pérez» ambos valores dan el mismo resultado; solo difieren ante un inicial suelto. Consultado el 18.09.2026."
|
|
113
|
-
}
|
|
114
|
-
]
|
|
77
|
+
}
|
|
115
78
|
}
|
|
@@ -34,7 +34,9 @@
|
|
|
34
34
|
"beforePunctuation": [],
|
|
35
35
|
"narrowBeforePunctuation": [],
|
|
36
36
|
"afterShortWords": [],
|
|
37
|
-
"abbreviations": [
|
|
37
|
+
"abbreviations": [
|
|
38
|
+
"fil. maist."
|
|
39
|
+
],
|
|
38
40
|
"beforeUnits": [
|
|
39
41
|
"%",
|
|
40
42
|
"‰",
|
|
@@ -60,81 +62,9 @@
|
|
|
60
62
|
],
|
|
61
63
|
"beforeNumber": [],
|
|
62
64
|
"beforeWord": [],
|
|
63
|
-
"afterSymbols": [
|
|
65
|
+
"afterSymbols": [
|
|
66
|
+
"§"
|
|
67
|
+
],
|
|
64
68
|
"initialBinding": "none"
|
|
65
|
-
}
|
|
66
|
-
"sources": [
|
|
67
|
-
{
|
|
68
|
-
"rule": "quotes",
|
|
69
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Lainausmerkit”",
|
|
70
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/lainausmerkit/",
|
|
71
|
-
"note": "Verbatim: “Suomenkielisessä tekstissä käytettävät kokolainausmerkit ovat kaarevat ”, ja ne ovat samanmuotoiset lainatun jakson alussa ja lopussa.” Both the opening and the closing mark are U+201D. The page notes that books and newspapers sometimes use angle marks (»…») as a design choice; the Kotus recommendation for Finnish text is ”…”."
|
|
72
|
-
},
|
|
73
|
-
{
|
|
74
|
-
"rule": "quotes",
|
|
75
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Puolilainausmerkki”",
|
|
76
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/puolilainausmerkki/",
|
|
77
|
-
"note": "Verbatim: “Puolilainausmerkkiä käytetään myös lainausmerkkinä kokolainausmerkkien sisällä”, and “Suomenkielisissä teksteissä käytettävä puolilainausmerkki on ’, ei ‛ eikä '.” The page gives the Windows input sequence Alt+0146, which is U+2019, confirming the code point for both the opening and the closing secondary mark."
|
|
78
|
-
},
|
|
79
|
-
{
|
|
80
|
-
"rule": "dashes",
|
|
81
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Ajatusviiva virkkeen välimerkkinä”",
|
|
82
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/ajatusviiva-virkkeen-valimerkkina/",
|
|
83
|
-
"note": "Verbatim: “Tällaisen virkkeen välimerkkinä käytetyn ajatusviivan molemmin puolin tulee välilyönti.” Hence `parenthetical: en-spaced` — Finnish uses the en dash (ajatusviiva, n-viiva), not an em dash."
|
|
84
|
-
},
|
|
85
|
-
{
|
|
86
|
-
"rule": "dashes",
|
|
87
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Ajanilmaukset: aikavälit (1.1.–31.1.)”, citing standard SFS 4175",
|
|
88
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/ajanilmaukset-aikavalit-1-1-31-1/",
|
|
89
|
-
"note": "Verbatim: “Numero- ja merkkistandardi SFS 4175 suosittaa rajakohdan merkkinä lyhempää ajatusviivaa eli ns. n-viivaa”, set tight against the endpoints (ma–pe). Known exception not expressible in this schema: when the endpoints are themselves multi-word, Kotus spaces the dash (“ma 10.4. – pe 21.4.”). `range: en-tight` therefore describes the numeric case only."
|
|
90
|
-
},
|
|
91
|
-
{
|
|
92
|
-
"rule": "ellipsis",
|
|
93
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Kolme pistettä”",
|
|
94
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/kolme-pistetta/",
|
|
95
|
-
"note": "`abbreviatedAfterTerminal` is false. Kotus describes the mark as three dots marking an unfinished sentence, a missing element or a continuing list; the two-dot form after `!`/`?` is a Russian convention and appears in no Kotus guidance."
|
|
96
|
-
},
|
|
97
|
-
{
|
|
98
|
-
"rule": "nbsp",
|
|
99
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Prosenttimerkki (%)”",
|
|
100
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/prosenttimerkki/",
|
|
101
|
-
"note": "Finnish writes a space between the numeral and the percent sign (10,5 %), unlike English, which sets it closed up. This attests membership: `%` is a Finnish unit-like sign that follows a numeral after a space, which is what `beforeUnits` expresses. `‰` is included on the same reading."
|
|
102
|
-
},
|
|
103
|
-
{
|
|
104
|
-
"rule": "nbsp",
|
|
105
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Pykälät ja pykälämerkki (§)”",
|
|
106
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/pykalat-ja-pykalamerkki/",
|
|
107
|
-
"note": "Kotus gives **three** notations as alternatives, not two: `6. §` (general language, with the ordinal full stop), `§ 6`, and `6 §` (legal language, where the ordinal stop is conventionally dropped). An earlier revision of this note named only the last two and read as though Finnish never sets the sign before the number; that was wrong. A space separates the number and the sign in all three. Because Kotus attests both orders, `§` is a member of **both** lists: `beforeUnits` covers `6 §` (N5, binds to a preceding number) and `afterSymbols` covers `§ 6` (N6, binds to a following number). The two sub-rules are disjoint by their own left/right tests, so the double membership is safe rather than contradictory. The third form, `6. §`, binds under neither — N5 requires a digit immediately before the space and there is an ordinal full stop there — which is an algorithmic gap held with the spec author, not something this file can express. Contrast Finnish with Swedish, where Språkrådet’s example is `§ 7` and only the sign-first order is attested."
|
|
108
|
-
},
|
|
109
|
-
{
|
|
110
|
-
"rule": "nbsp",
|
|
111
|
-
"cite": "Oikeusministeriö, Lainkirjoittajan opas §24.4 “Merkeistä ja taivutusmuodoista lakikielessä”",
|
|
112
|
-
"url": "https://lainkirjoittaja.finlex.fi/24-lakikieli/24-4/",
|
|
113
|
-
"note": "Second source for the legal form: statutory drafting sets `2 §` and inflects it with a colon (`3–5 §:ssä`). Corroborates the number-first notation Kotus gives, and with it `§`’s membership of `beforeUnits`."
|
|
114
|
-
},
|
|
115
|
-
{
|
|
116
|
-
"rule": "nbsp",
|
|
117
|
-
"cite": "BIPM, The International System of Units (SI), 9th ed. (2019), concise summary, “The language of science: using the SI to express the values of quantities”; Kotus, Kielitoimiston ohjepankki: “Prosenttimerkki (%)” and “Pykälät ja pykälämerkki (§)”",
|
|
118
|
-
"url": "https://www.bipm.org/documents/20126/41483022/SI-Brochure-9-concise-EN.pdf",
|
|
119
|
-
"note": "Membership claim, per nbsp.md §2.1: these tokens are units of measurement in Finnish and are written after a numeral with a space. BIPM verbatim: “A single space is always left between the number and the unit.” Kotus supplies the Finnish-specific members that SI does not cover — the percent sign takes a space (10,5 %), unlike English, and the section sign follows the number (6 §). That is the whole of what this list can express: which tokens are units. Whether the space is then made non-breaking is N5’s mechanism, fixed for every locale by the rule and not variable per locale, so no citation is owed for it. **Correction kept on the record, because it was real:** an earlier revision of this file justified the list with the sentence “Numeron ja lyhenteen väliin tulee välilyönti”, attributed to the Kotus page on numeroiden ryhmittely. That sentence is not on that page — it came from a search-engine summary and was never checked against the source. What that page’s “Sitova välilyönti” section actually says is “Tekstinkäsittelyohjelmissa pitkät luvut saa pysymään samalla rivillä käyttämällä sitovaa eli yhdistävää välilyöntiä”, which is about holding the digit groups of one long number together (100 000) — the class nbsp.md §7.11 declines to implement — and not about a number and a following unit. The page is no longer cited here. Kielikello and the rest of the ohjepankki were searched for a Finnish number+unit line-breaking statement and none was found; SFS 4175 may contain one, but it is a paid standard whose text was not read, and it is not cited on the strength of a secondary summary."
|
|
120
|
-
},
|
|
121
|
-
{
|
|
122
|
-
"rule": "nbsp",
|
|
123
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Lyhenteet: pisteelliset”",
|
|
124
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/lyhenteet-pisteelliset/",
|
|
125
|
-
"note": "Verbatim: “Yhdyssanan lyhennettyjen osien väliin ei tule välilyöntiä, toisin kuin sanaliiton osien väliin” — a compound word abbreviates closed up (sos.dem., dipl.ins.) while a word-group abbreviation keeps the space (fil. maist.). The `abbreviations` list is therefore deliberately minimal: only the one form quoted verbatim on that page is included. Kotus’s full Lyhenneluettelo contains further space-bearing academic-title abbreviations (fil. tri, valt. maist. and similar); they are omitted rather than guessed at, and should be added by whoever can transcribe that list directly. The membership claim here is precise: `fil. maist.` is **one abbreviation that contains a space**, and Kotus states its internal shape directly. A form that a source merely shows adjacent to another token would not qualify."
|
|
126
|
-
},
|
|
127
|
-
{
|
|
128
|
-
"rule": "nbsp",
|
|
129
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: välimerkit and lyhenteet, read for membership in each remaining list",
|
|
130
|
-
"url": "https://kielitoimistonohjepankki.fi/asiasana/valimerkit/",
|
|
131
|
-
"note": "`beforePunctuation` and `narrowBeforePunctuation` are empty because Finnish sets no space before a punctuation mark — there are no members to list. `afterShortWords` is empty because Finnish has no closed class of short words that may not end a line; its function words are inflectional suffixes rather than separate particles, so the list has no candidates. `beforeWord` is empty for want of an attested membership claim: no Kotus page shows titles such as hra or prof. as forms that bind to a following name. `beforeNumber` is a genuine open question rather than a settled empty: Kotus does write s. 12 and kuva 3, which under nbsp.md §2.1 is a membership claim of the right shape, and the earlier justification for leaving it empty (that Kotus does not require the space to be non-breaking) is no longer a valid reason. It is left empty here only because populating it is a live behaviour change that belongs in its own round with N9’s false-positive surface reviewed. `initialBinding` is \"none\" (spec 0.6.0: the field used to be the boolean bindInitials, false), and §2.1 makes plain that this field is unciteable in principle — it expresses nothing but mechanism, and no typographic authority states it in terms of a code point. Kotus attests the space in J. K. Paasikivi and says nothing further. The value is therefore a judgement, held at \"none\" to match the same call made for en-GB, and it should be settled by the operator across all locales at once rather than per file."
|
|
132
|
-
},
|
|
133
|
-
{
|
|
134
|
-
"rule": "hyphen",
|
|
135
|
-
"cite": "Kotimaisten kielten keskus (Kotus), Kielitoimiston ohjepankki: “Yhdysmerkki eli yhdysviiva”",
|
|
136
|
-
"url": "https://kielitoimistonohjepankki.fi/ohje/yhdysmerkki-eli-yhdysviiva/",
|
|
137
|
-
"note": "`prefixes`, `suffixes` and `compounds` are empty. Kotus’s hyphen guidance is entirely about when to write a hyphen (compounds with numerals or abbreviations, identical adjoining vowels, word-group compounds such as “avaimet käteen -sopimus”), never about forbidding a line break at one. Finnish compounding is productive, so there is no closed normative list to encode — unlike Russian, where кое-, -таки and из-под are a fixed inventory. Nothing here, and no Kotus page found, prescribes U+2011."
|
|
138
|
-
}
|
|
139
|
-
]
|
|
69
|
+
}
|
|
140
70
|
}
|
|
@@ -45,70 +45,43 @@
|
|
|
45
45
|
"compounds": []
|
|
46
46
|
},
|
|
47
47
|
"nbsp": {
|
|
48
|
-
"beforePunctuation": [
|
|
48
|
+
"beforePunctuation": [
|
|
49
|
+
":"
|
|
50
|
+
],
|
|
49
51
|
"narrowBeforePunctuation": [],
|
|
50
52
|
"afterShortWords": [],
|
|
51
|
-
"abbreviations": [
|
|
52
|
-
|
|
53
|
-
|
|
54
|
-
"
|
|
55
|
-
|
|
53
|
+
"abbreviations": [
|
|
54
|
+
"p. ex."
|
|
55
|
+
],
|
|
56
|
+
"beforeUnits": [
|
|
57
|
+
"%",
|
|
58
|
+
"‰",
|
|
59
|
+
"€",
|
|
60
|
+
"°C",
|
|
61
|
+
"km",
|
|
62
|
+
"cm",
|
|
63
|
+
"mm",
|
|
64
|
+
"kg",
|
|
65
|
+
"km/h",
|
|
66
|
+
"kWh"
|
|
67
|
+
],
|
|
68
|
+
"beforeNumber": [
|
|
69
|
+
"art.",
|
|
70
|
+
"fig.",
|
|
71
|
+
"n°",
|
|
72
|
+
"N°"
|
|
73
|
+
],
|
|
74
|
+
"beforeWord": [
|
|
75
|
+
"M.",
|
|
76
|
+
"MM.",
|
|
77
|
+
"Mme",
|
|
78
|
+
"Mmes",
|
|
79
|
+
"Mlle",
|
|
80
|
+
"Mlles"
|
|
81
|
+
],
|
|
82
|
+
"afterSymbols": [
|
|
83
|
+
"§"
|
|
84
|
+
],
|
|
56
85
|
"initialBinding": "single"
|
|
57
|
-
}
|
|
58
|
-
"sources": [
|
|
59
|
-
{
|
|
60
|
-
"rule": "nbsp",
|
|
61
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Espacement avant et après les signes de ponctuation et les symboles » : « L'Office québécois de la langue française opte pour l'absence d'espace devant le point-virgule, le point d'exclamation et le point d'interrogation », l'espace fine restant admise « lorsqu'elle est disponible » ; le deux-points est précédé d'une espace insécable",
|
|
62
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/22039/la-typographie/espacement/espacement-avant-et-apres-les-signes-de-ponctuation-et-les-symboles",
|
|
63
|
-
"note": "C'est le point qui distingue fr-CA de fr (France) : l'usage de France, documenté dans spec/locales/fr.json à partir de Jacques André, insère une espace fine insécable (U+202F) avant « ; », « ! » et « ? ». L'OQLF choisit explicitement l'absence d'espace pour l'usage québécois ; l'espace fine n'est mentionnée que comme variante disponible, pas comme la règle par défaut. Le champ narrowBeforePunctuation est donc vide : la règle « spaces » retire toute espace ordinaire tapée devant ces signes (comportement indépendant de la locale, spec/rules/spaces.md), et aucune espace n'est réinsérée ici — le résultat net est « Bonjour! », sans espace, ce qui correspond au choix explicite de l'OQLF plutôt qu'à un oubli. Le deux-points reste précédé d'une espace insécable ordinaire (U+00A0), comme en France : les deux sources OQLF consultées s'accordent sur ce point avec Jacques André."
|
|
64
|
-
},
|
|
65
|
-
{
|
|
66
|
-
"rule": "nbsp",
|
|
67
|
-
"cite": "Jacques André, Petites leçons de typographie, éd. du jobet, § 5.1.3 « Autres emplois de l'espace insécable » — voir spec/locales/fr.json pour la citation complète",
|
|
68
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
69
|
-
"note": "beforeUnits, beforeNumber, beforeWord, abbreviations et initialBinding (spec 0.6.0 : le champ s'appelait auparavant le booléen bindInitials ; fr conserve \"single\", cité au § 5.1.3 d'André pour « N. Bourbaki ») sont repris tels quels de spec/locales/fr.json : aucune source spécifiquement québécoise n'a été consultée pour ces cas (seuls le point-virgule/point d'exclamation/point d'interrogation et le deux-points ont été vérifiés séparément auprès de l'OQLF, voir l'entrée précédente). L'OQLF confirme par ailleurs, sur la même page que l'entrée précédente, une espace insécable devant les symboles d'unités SI et le pourcentage, ce qui corrobore — sans le prouver intégralement — le maintien de ces listes pour fr-CA."
|
|
70
|
-
},
|
|
71
|
-
{
|
|
72
|
-
"rule": "quotes",
|
|
73
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Généralités sur les guillemets » : « Les guillemets français (« »), appelés chevrons à cause de leur forme, sont ceux que l'on utilise normalement dans un texte français » ; « Une espace insécable sépare les guillemets ouvrants et fermants du texte » ; pour une citation à l'intérieur d'une citation, « on utilise successivement les guillemets anglais doubles, puis anglais simples »",
|
|
74
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/23363/la-ponctuation/guillemets/generalites-sur-les-guillemets",
|
|
75
|
-
"note": "Chevrons, second niveau et espace intérieure identiques à fr (France) ; aucun écart québécois trouvé. La largeur exacte de l'espace intérieure (U+00A0 ordinaire vs U+202F fine) n'est pas non plus tranchée ici — l'OQLF emploie le terme générique « espace insécable » ; la valeur « nbsp » est reprise de fr.json en attendant que ce point soit résolu pour les deux locales."
|
|
76
|
-
},
|
|
77
|
-
{
|
|
78
|
-
"rule": "dashes",
|
|
79
|
-
"cite": "Jacques André, Petites leçons de typographie, § 2.2 et tableau 1 — voir spec/locales/fr.json pour la citation complète ; corroboré par l'OQLF, « Tiret : mise en valeur » : « Les tirets sont précédés et suivis d'un espacement. »",
|
|
80
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/index.php?id=23378",
|
|
81
|
-
"note": "Repris de fr : tiret cadratin espacé pour l'incise, aucune valeur de plage vérifiée (range: none). L'OQLF confirme l'espacement mais ne distingue pas le cadratin du demi-cadratin ; aucun écart québécois trouvé sur ce point."
|
|
82
|
-
},
|
|
83
|
-
{
|
|
84
|
-
"rule": "ellipsis",
|
|
85
|
-
"cite": "Jacques André, Petites leçons de typographie, § 5.1.2 et tableau 2 — voir spec/locales/fr.json pour la citation complète",
|
|
86
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
87
|
-
"note": "Repris tel quel de fr ; aucune source québécoise consultée séparément pour ce point, aucun écart identifié dans les sources OQLF lues."
|
|
88
|
-
},
|
|
89
|
-
{
|
|
90
|
-
"rule": "hyphen",
|
|
91
|
-
"cite": "Jacques André, Petites leçons de typographie, tableau 1 — voir spec/locales/fr.json pour la citation complète",
|
|
92
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
93
|
-
"note": "Repris tel quel de fr : aucune source consultée n'impose un trait d'union insécable pour une classe fermée de formes morphologiques françaises, en France comme au Québec."
|
|
94
|
-
},
|
|
95
|
-
{
|
|
96
|
-
"rule": "nbsp",
|
|
97
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Abréviation de numéro » : « L'abréviation courante du nom numéro est no ou No, avec la lettre o minuscule en exposant » ; « On n'abrège le mot numéro que s'il suit immédiatement le nom qu'il détermine » ; exemple : « C'est le billet no 852410 qui a valu le gros lot à sa détentrice »",
|
|
98
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/25450/les-abreviations-et-les-symboles/les-abreviations/cas-particuliers-dabreviations/abreviation-de-numero",
|
|
99
|
-
"note": "Deux choses distinctes, et il faut les tenir séparées. Ce que la source établit : « n° » est une abréviation, pas un symbole, d'où beforeNumber et non afterSymbols — l'argument est aussi mécanique, un « ° » seul placé dans afterSymbols serait inerte puisque N6 exige que le code point précédent ne soit pas ALNUM, or c'est la lettre « n » (nbsp.md §3.8). Ce que la source n'établit pas : la séquence exacte de code points. L'OQLF prescrit un o minuscule en exposant, un tracé et non un code point, et ne nomme nulle part le signe de degré ni la ligature « numéro » (U+2116). Pour la France, rien : le § 5.1.3 de Jacques André, relu intégralement, ne mentionne ni « numéro » ni « no », et le Lexique de l'Imprimerie nationale est un ouvrage imprimé qui n'a pas pu être consulté. Décision de l'opérateur (18.09.2026) : quand la règle est derrière une source payante, polytypo retient l'usage le plus répandu et l'applique de la même façon partout, l'uniformité primant la conformité au canon, et la décision est signalée comme telle au lieu d'être présentée comme une citation. L'usage le plus répandu est « n » + U+00B0, c'est ce que l'on tape et ce que l'on trouve dans les textes en ligne ; N9 n'ayant aucune tolérance de casse, « n° » et « N° » sont deux entrées. La phrase « on ne sépare pas les numéros par des espacements » de la même page vise les tranches de chiffres à l'intérieur du nombre (« billet no 852410 »), pas l'espace entre l'abréviation et le nombre."
|
|
100
|
-
},
|
|
101
|
-
{
|
|
102
|
-
"rule": "quotes",
|
|
103
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Cas où l'élision est obligatoire » (dernière mise à jour : 2015) : « L'élision ne touche que des mots grammaticaux, habituellement courts, et que les voyelles a, e et i. » L'élision est obligatoire pour le déterminant et le pronom la et le, pour les pronoms je, me, te, se et ce placés devant le verbe, pour si devant il(s), pour que et les conjonctions qui le contiennent, pour jusque, pour la préposition de et pour l'adverbe de négation ne",
|
|
104
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/21737/lorthographe/elision-et-apostrophe/elision-obligatoire",
|
|
105
|
-
"note": "Justifie dix des treize entrées de quotes.elisionClitics.before : l (la, le), j (je), m (me), t (te), s (se et si), c (ce), qu (que), jusqu (jusque), d (de), n (ne). Chaque entrée est la plage de lettres maximale à gauche de la marque, d'où jusqu et non qu pour « jusqu'à » : sous une comparaison par plage maximale, une entrée qu ne peut pas apparier « jusqu' ». presqu (presqu'île) et quelqu (quelqu'un) sont volontairement exclus, faute d'attestation dans les articles relus, et l'exclusion est sans coût : dans les deux mots la marque a une lettre de chaque côté. La liste after est vide — la BDL définit l'élision comme l'effacement de la voyelle finale d'un mot, donc la marque suit toujours le mot élidé, et l'enclise française prend le trait d'union (donne-moi, y a-t-il), jamais l'apostrophe. Le cas porté par cette liste est l'élision devant un élément en ligne, l'<em>idée</em> : sans elle, quotes appariait la marque comme une citation et invertissait la paire englobante (issue #53). L'OQLF est l'autorité du Québec : pour fr-CA la citation est directe, pour fr elle tient lieu de substitut, le Lexique de l'Imprimerie nationale et Le Bon Usage n'étant pas consultables en ligne — même lacune que celle déjà signalée ailleurs dans ce fichier. quotes.md §3.2's span-boundary elision veto (spec 1.4.0) reads this list only when the mark's other literal neighbour is modes.md §3.2's inline span boundary, so every entry is matched against the maximal LETTER run on one side of the mark and nothing else. The list is decline-only: the worst it can do is refuse a pairing quotes would otherwise have formed."
|
|
106
|
-
},
|
|
107
|
-
{
|
|
108
|
-
"rule": "quotes",
|
|
109
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Élision de lorsque, puisque et quoique » (2020) : « les conjonctions lorsque, puisque et quoique s'élident obligatoirement devant il(s), elle(s), on, un et une, et aussi devant la préposition en » ; l'élision généralisée devant tout mot commençant par une voyelle ou un h muet « demeure facultative »",
|
|
110
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/23623/lorthographe/elision-et-apostrophe/elision-de-lorsque-puisque-et-quoique",
|
|
111
|
-
"note": "Justifie les trois entrées lorsqu, puisqu, quoiqu. L'élision obligatoire devant il(s), elle(s), on, un, une et en suffit à l'appartenance : la liste étant uniquement restrictive, le caractère facultatif de l'élision généralisée ne change rien. Là encore la plage maximale impose des entrées distinctes : qu n'apparie pas « lorsqu' ». quotes.md §3.2's span-boundary elision veto (spec 1.4.0) reads this list only when the mark's other literal neighbour is modes.md §3.2's inline span boundary, so every entry is matched against the maximal LETTER run on one side of the mark and nothing else. The list is decline-only: the worst it can do is refuse a pairing quotes would otherwise have formed."
|
|
112
|
-
}
|
|
113
|
-
]
|
|
86
|
+
}
|
|
114
87
|
}
|
|
@@ -45,76 +45,47 @@
|
|
|
45
45
|
"compounds": []
|
|
46
46
|
},
|
|
47
47
|
"nbsp": {
|
|
48
|
-
"beforePunctuation": [
|
|
49
|
-
|
|
48
|
+
"beforePunctuation": [
|
|
49
|
+
":"
|
|
50
|
+
],
|
|
51
|
+
"narrowBeforePunctuation": [
|
|
52
|
+
";",
|
|
53
|
+
"!",
|
|
54
|
+
"?"
|
|
55
|
+
],
|
|
50
56
|
"afterShortWords": [],
|
|
51
|
-
"abbreviations": [
|
|
52
|
-
|
|
53
|
-
|
|
54
|
-
"
|
|
55
|
-
|
|
57
|
+
"abbreviations": [
|
|
58
|
+
"p. ex."
|
|
59
|
+
],
|
|
60
|
+
"beforeUnits": [
|
|
61
|
+
"%",
|
|
62
|
+
"‰",
|
|
63
|
+
"€",
|
|
64
|
+
"°C",
|
|
65
|
+
"km",
|
|
66
|
+
"cm",
|
|
67
|
+
"mm",
|
|
68
|
+
"kg",
|
|
69
|
+
"km/h",
|
|
70
|
+
"kWh"
|
|
71
|
+
],
|
|
72
|
+
"beforeNumber": [
|
|
73
|
+
"art.",
|
|
74
|
+
"fig.",
|
|
75
|
+
"n°",
|
|
76
|
+
"N°"
|
|
77
|
+
],
|
|
78
|
+
"beforeWord": [
|
|
79
|
+
"M.",
|
|
80
|
+
"MM.",
|
|
81
|
+
"Mme",
|
|
82
|
+
"Mmes",
|
|
83
|
+
"Mlle",
|
|
84
|
+
"Mlles"
|
|
85
|
+
],
|
|
86
|
+
"afterSymbols": [
|
|
87
|
+
"§"
|
|
88
|
+
],
|
|
56
89
|
"initialBinding": "single"
|
|
57
|
-
}
|
|
58
|
-
"sources": [
|
|
59
|
-
{
|
|
60
|
-
"rule": "nbsp",
|
|
61
|
-
"cite": "Jacques André, Petites leçons de typographie, éd. du jobet, révision du 1er juin 2025, § 5.1.1 note 21 et § 5.2.3 : l'espace insécable employée devant les ponctuations doubles « c'est la fine des typographes, en première approximation (contre-exemple : l'espace avant le deux-points est en fait une espace normale insécable) » ; « il faut une espace fine insécable avant le point-virgule »",
|
|
62
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
63
|
-
"note": "C'est le point qui tranche la question posée par docs/PLAN.md §7 : « ; », « ! » et « ? » prennent U+202F ; « : » prend U+00A0. La distinction est donc confirmée, et non simplement répétée. Le tableau 1 (p. 32) donne la saisie complète des signes. Recoupé avec l'article « Espace fine insécable » de la Wikipédia francophone, qui attribue la même règle au Lexique des règles typographiques en usage à l'Imprimerie nationale, 3e éd., 2002 (fine devant ; ? !, « sauf devant deux-points, en France »)."
|
|
64
|
-
},
|
|
65
|
-
{
|
|
66
|
-
"rule": "nbsp",
|
|
67
|
-
"cite": "Jacques André, Petites leçons de typographie, § 2.5 et § 5.1.3 « Autres emplois de l'espace insécable » : espace insécable entre un prénom abrégé et le nom (« N. Bourbaki »), entre une abréviation et le mot qui la suit (« Mme Hugo », « le R.P. Durand »), entre un nombre et ce qu'il quantifie (« 14 francs », « 2 € », « 98 % », « art. 237 »)",
|
|
68
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
69
|
-
"note": "La liste beforeUnits est volontairement courte et exclut les symboles d'une seule lettre (m, g, l, s, A), qui ne peuvent pas être désambiguïsés sans contexte. La liaison « abréviation + mot suivant » (M. Dupont, Mme Hugo) n'est pas exprimable dans ce schéma : afterSymbols lie un symbole à un NOMBRE suivant, pas à un mot ; elle passe par nbsp.initialBinding = \"single\" (spec 0.6.0 : le champ s'appelait auparavant le booléen bindInitials), qui conserve la liaison sur une seule initiale citée ici (« N. Bourbaki »). Contrairement à \"chain\" (en-US, de-DE, de-CH, ru — Chicago exige « two or more initials »), \"single\" ne peut pas distinguer structurellement un prénom abrégé authentique d'une collision de fin de phrase (une initiale isolée suivie d'un mot capitalisé qui commence en fait une nouvelle phrase) ; voir spec/rules/nbsp.md §7."
|
|
70
|
-
},
|
|
71
|
-
{
|
|
72
|
-
"rule": "quotes",
|
|
73
|
-
"cite": "Imprimerie nationale, Lexique des règles typographiques en usage à l'Imprimerie nationale, 3e éd., 2002, entrée « Guillemets » : les guillemets français « … » sont séparés du texte qu'ils encadrent par une espace insécable",
|
|
74
|
-
"url": "https://fr.wikipedia.org/wiki/Espace_fine_ins%C3%A9cable",
|
|
75
|
-
"note": "Le Lexique n'est pas consultable en ligne ; la règle a été vérifiée par recoupement de deux articles de la Wikipédia francophone qui la citent (« Espace fine insécable » : « à l'intérieur des guillemets français […] il est recommandé d'insérer des espaces insécables », attribué au Lexique 2002 ; « Ponctuation », tableau des espacements) et du tableau 1 de Jacques André, qui note une insécable après « « » et avant « » ». Désaccord assumé avec docs/PLAN.md §7, qui annonçait U+202F à l'intérieur des guillemets : la source normative dit espace insécable (U+00A0). L'usage web contemporain, et JoliTypo, emploient souvent U+202F ; le choix retenu ici est celui de la citation, pas celui de l'usage."
|
|
76
|
-
},
|
|
77
|
-
{
|
|
78
|
-
"rule": "quotes",
|
|
79
|
-
"cite": "Jacques André, Petites leçons de typographie, § 2.2 : « en français, les guillemets sont les doubles chevrons « … » et non les (double-)quotes anglaises “…” ni ‘…’ » ; les guillemets anglais “ ” servent de guillemets de second niveau",
|
|
80
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
81
|
-
"note": "Le second niveau est le point le moins solidement établi de ce fichier : l'usage français admet aussi la répétition des chevrons ou les chevrons simples ‹ ›. Les guillemets anglais sont retenus parce qu'ils sont la solution la plus couramment attribuée au Lexique, mais cette ligne mérite d'être revue si la 3e édition papier dit autre chose."
|
|
82
|
-
},
|
|
83
|
-
{
|
|
84
|
-
"rule": "dashes",
|
|
85
|
-
"cite": "Jacques André, Petites leçons de typographie, § 2.2 et tableau 1 (p. 32) : le tiret marquant les incises est le tiret cadratin « — », précédé et suivi d'une espace (« mmm —_mmm … mmm_— mmm »)",
|
|
86
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
87
|
-
"note": "Le même paragraphe signale que « la tendance est d'utiliser à sa place le tiret moyen « – » ». La valeur em-spaced suit la règle citée, pas la tendance ; docs/PLAN.md §7 supposait en-spaced. Aucune valeur de plage n'est vérifiée : les exemples de l'Imprimerie nationale et de Jacques André impriment un trait d'union dans les intervalles de pages (« p. 123-125 »), et l'énumération se fait plutôt « de … à … ». Le schéma a donc reçu la valeur « none » (ne rien substituer), retenue ici tant que le point n'est pas tranché sur le Lexique papier — une citation manquante n'autorise jamais à deviner."
|
|
88
|
-
},
|
|
89
|
-
{
|
|
90
|
-
"rule": "nbsp",
|
|
91
|
-
"cite": "Jacques André, Petites leçons de typographie, § 5.1.3 « Autres emplois de l'espace insécable », liste « Coupure entre les mots » : « entre une abréviation et le mot qui la suit, exemples : “Mme_Hugo, D._Knuth, le R.P._Durand” » ; « entre un nombre et ce qu'il quantifie, par exemple : “14_francs, 2_€, 1_A, t._vii, art._237, fig._3, pages_23 à_25, 98_%” » — le caractère « _ » note l'espace insécable",
|
|
92
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
93
|
-
"note": "Texte relu directement dans le PDF. Cette entrée lève la limitation signalée plus haut dans ce fichier (« la liaison abréviation + mot suivant n'est pas exprimable dans ce schéma ») : le schéma a depuis reçu beforeNumber et beforeWord. beforeNumber ne retient que « art. » et « fig. », cités littéralement devant un nombre ; « t. vii » est suivi d'un chiffre romain et n'a pas été retenu. beforeWord est volontairement réduit à la classe fermée des titres de civilité : la règle citée vaut pour toute abréviation, mais l'énumérer intégralement produirait des faux positifs (« etc. », « p. ex. », « cf. »). « Mme » est cité mot pour mot ; « M., MM., Mmes, Mlle, Mlles » sont les autres membres de la même classe et relèvent donc de la même règle, ce qui reste une inférence de classe et non une citation littérale. Un « M. » qui serait en réalité une initiale de prénom reçoit de toute façon l'espace insécable prescrite au § 5.1.3 pour « N. Bourbaki » : la liaison est correcte dans les deux lectures."
|
|
94
|
-
},
|
|
95
|
-
{
|
|
96
|
-
"rule": "hyphen",
|
|
97
|
-
"cite": "Jacques André, Petites leçons de typographie, tableau 1 (p. 32), ligne « trait d'union » : la saisie est « mmm-mmm », sans espace ni marque d'insécabilité, alors que le même tableau note explicitement l'insécable pour les ponctuations doubles, les guillemets et les tirets d'incise",
|
|
98
|
-
"url": "http://jacques-andre.fr/faqtypo/lessons.pdf",
|
|
99
|
-
"note": "Justification des trois listes vides. Aucune source normative consultée n'impose un trait d'union insécable pour une classe fermée de formes morphologiques françaises ; le § 5.1.3, qui énumère les cas d'insécabilité, ne mentionne aucun trait d'union. Le champ hyphen est donc sans objet en français."
|
|
100
|
-
},
|
|
101
|
-
{
|
|
102
|
-
"rule": "nbsp",
|
|
103
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Abréviation de numéro » : « L'abréviation courante du nom numéro est no ou No, avec la lettre o minuscule en exposant » ; « On n'abrège le mot numéro que s'il suit immédiatement le nom qu'il détermine » ; exemple : « C'est le billet no 852410 qui a valu le gros lot à sa détentrice »",
|
|
104
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/25450/les-abreviations-et-les-symboles/les-abreviations/cas-particuliers-dabreviations/abreviation-de-numero",
|
|
105
|
-
"note": "Deux choses distinctes, et il faut les tenir séparées. Ce que la source établit : « n° » est une abréviation, pas un symbole, d'où beforeNumber et non afterSymbols — l'argument est aussi mécanique, un « ° » seul placé dans afterSymbols serait inerte puisque N6 exige que le code point précédent ne soit pas ALNUM, or c'est la lettre « n » (nbsp.md §3.8). Ce que la source n'établit pas : la séquence exacte de code points. L'OQLF prescrit un o minuscule en exposant, un tracé et non un code point, et ne nomme nulle part le signe de degré ni la ligature « numéro » (U+2116). Pour la France, rien : le § 5.1.3 de Jacques André, relu intégralement, ne mentionne ni « numéro » ni « no », et le Lexique de l'Imprimerie nationale est un ouvrage imprimé qui n'a pas pu être consulté. Décision de l'opérateur (18.09.2026) : quand la règle est derrière une source payante, polytypo retient l'usage le plus répandu et l'applique de la même façon partout, l'uniformité primant la conformité au canon, et la décision est signalée comme telle au lieu d'être présentée comme une citation. L'usage le plus répandu est « n » + U+00B0, c'est ce que l'on tape et ce que l'on trouve dans les textes en ligne ; N9 n'ayant aucune tolérance de casse, « n° » et « N° » sont deux entrées. La phrase « on ne sépare pas les numéros par des espacements » de la même page vise les tranches de chiffres à l'intérieur du nombre (« billet no 852410 »), pas l'espace entre l'abréviation et le nombre."
|
|
106
|
-
},
|
|
107
|
-
{
|
|
108
|
-
"rule": "quotes",
|
|
109
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Cas où l'élision est obligatoire » (dernière mise à jour : 2015) : « L'élision ne touche que des mots grammaticaux, habituellement courts, et que les voyelles a, e et i. » L'élision est obligatoire pour le déterminant et le pronom la et le, pour les pronoms je, me, te, se et ce placés devant le verbe, pour si devant il(s), pour que et les conjonctions qui le contiennent, pour jusque, pour la préposition de et pour l'adverbe de négation ne",
|
|
110
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/21737/lorthographe/elision-et-apostrophe/elision-obligatoire",
|
|
111
|
-
"note": "Justifie dix des treize entrées de quotes.elisionClitics.before : l (la, le), j (je), m (me), t (te), s (se et si), c (ce), qu (que), jusqu (jusque), d (de), n (ne). Chaque entrée est la plage de lettres maximale à gauche de la marque, d'où jusqu et non qu pour « jusqu'à » : sous une comparaison par plage maximale, une entrée qu ne peut pas apparier « jusqu' ». presqu (presqu'île) et quelqu (quelqu'un) sont volontairement exclus, faute d'attestation dans les articles relus, et l'exclusion est sans coût : dans les deux mots la marque a une lettre de chaque côté. La liste after est vide — la BDL définit l'élision comme l'effacement de la voyelle finale d'un mot, donc la marque suit toujours le mot élidé, et l'enclise française prend le trait d'union (donne-moi, y a-t-il), jamais l'apostrophe. Le cas porté par cette liste est l'élision devant un élément en ligne, l'<em>idée</em> : sans elle, quotes appariait la marque comme une citation et invertissait la paire englobante (issue #53). L'OQLF est l'autorité du Québec : pour fr-CA la citation est directe, pour fr elle tient lieu de substitut, le Lexique de l'Imprimerie nationale et Le Bon Usage n'étant pas consultables en ligne — même lacune que celle déjà signalée ailleurs dans ce fichier. quotes.md §3.2's span-boundary elision veto (spec 1.4.0) reads this list only when the mark's other literal neighbour is modes.md §3.2's inline span boundary, so every entry is matched against the maximal LETTER run on one side of the mark and nothing else. The list is decline-only: the worst it can do is refuse a pairing quotes would otherwise have formed."
|
|
112
|
-
},
|
|
113
|
-
{
|
|
114
|
-
"rule": "quotes",
|
|
115
|
-
"cite": "Office québécois de la langue française, Banque de dépannage linguistique, « Élision de lorsque, puisque et quoique » (2020) : « les conjonctions lorsque, puisque et quoique s'élident obligatoirement devant il(s), elle(s), on, un et une, et aussi devant la préposition en » ; l'élision généralisée devant tout mot commençant par une voyelle ou un h muet « demeure facultative »",
|
|
116
|
-
"url": "https://vitrinelinguistique.oqlf.gouv.qc.ca/23623/lorthographe/elision-et-apostrophe/elision-de-lorsque-puisque-et-quoique",
|
|
117
|
-
"note": "Justifie les trois entrées lorsqu, puisqu, quoiqu. L'élision obligatoire devant il(s), elle(s), on, un, une et en suffit à l'appartenance : la liste étant uniquement restrictive, le caractère facultatif de l'élision généralisée ne change rien. Là encore la plage maximale impose des entrées distinctes : qu n'apparie pas « lorsqu' ». quotes.md §3.2's span-boundary elision veto (spec 1.4.0) reads this list only when the mark's other literal neighbour is modes.md §3.2's inline span boundary, so every entry is matched against the maximal LETTER run on one side of the mark and nothing else. The list is decline-only: the worst it can do is refuse a pairing quotes would otherwise have formed."
|
|
118
|
-
}
|
|
119
|
-
]
|
|
90
|
+
}
|
|
120
91
|
}
|
|
@@ -14,7 +14,11 @@
|
|
|
14
14
|
},
|
|
15
15
|
"elisionIdioms": [],
|
|
16
16
|
"elisionClitics": {
|
|
17
|
-
"before": [
|
|
17
|
+
"before": [
|
|
18
|
+
"l",
|
|
19
|
+
"un",
|
|
20
|
+
"d"
|
|
21
|
+
],
|
|
18
22
|
"after": []
|
|
19
23
|
}
|
|
20
24
|
},
|
|
@@ -35,71 +39,24 @@
|
|
|
35
39
|
"narrowBeforePunctuation": [],
|
|
36
40
|
"afterShortWords": [],
|
|
37
41
|
"abbreviations": [],
|
|
38
|
-
"beforeUnits": [
|
|
39
|
-
|
|
42
|
+
"beforeUnits": [
|
|
43
|
+
"%",
|
|
44
|
+
"‰",
|
|
45
|
+
"€",
|
|
46
|
+
"°C",
|
|
47
|
+
"km",
|
|
48
|
+
"cm",
|
|
49
|
+
"mm",
|
|
50
|
+
"kg",
|
|
51
|
+
"km/h",
|
|
52
|
+
"kWh"
|
|
53
|
+
],
|
|
54
|
+
"beforeNumber": [
|
|
55
|
+
"n.",
|
|
56
|
+
"pag."
|
|
57
|
+
],
|
|
40
58
|
"beforeWord": [],
|
|
41
59
|
"afterSymbols": [],
|
|
42
60
|
"initialBinding": "none"
|
|
43
|
-
}
|
|
44
|
-
"sources": [
|
|
45
|
-
{
|
|
46
|
-
"rule": "quotes",
|
|
47
|
-
"cite": "Ufficio delle pubblicazioni dell'Unione europea, Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), punto 4.2.3, riquadro «Virgolette»: «Nella lingua italiana esistono tre livelli di virgolette […]: livello 1 (citazione principale) «…» (Alt 0171/Alt 0187); livello 2 (citazione nella citazione) “…” (Alt 0147/Alt 0148); livello 3 (citazione nella citazione nella citazione) ‘…’ (Alt 0145/Alt 0146)»",
|
|
48
|
-
"url": "https://op.europa.eu/it/publication-detail/-/publication/e774ea2a-ef84-4bf6-be92-c9ebebf91c1b",
|
|
49
|
-
"note": "L'attribuzione è per LIVELLO DI ANNIDAMENTO, cioè esattamente la forma che lo schema sa esprimere. Il terzo livello non è rappresentabile: lo schema prevede primary e secondary, non tre — limite dello schema, non lacuna della fonte, come già in el. INFERENZA DICHIARATA sull'identità dei code point: la guida fornisce un «codice alfanumerico» per Windows, non un code point Unicode; Alt 0171/0187/0147/0148 sono CP1252 0xAB/0xBB/0x93/0x94, da cui U+00AB/U+00BB/U+201C/U+201D. Riscontro indipendente: Treccani, Enciclopedia dell'Italiano (2011), voce «Virgolette» (Luca Cignetti): «è consuetudine fare ricorso a tipi diversi di virgoletta, solitamente bassa per la prima citazione e alta per gli altri usi». POSIZIONE CONTRARIA, registrata: l'Accademia della Crusca («La punteggiatura», 16 luglio 2004) rifiuta di ordinare i due segni al primo livello — «Alte e basse si usano indifferentemente» — ma non tratta l'annidamento, quindi non c'è conflitto: la scelta del segno di primo livello è una variante permessa che questo file compie, l'ordine dei livelli è ciò che le altre due fonti stabiliscono. Consultati il 18.09.2026."
|
|
50
|
-
},
|
|
51
|
-
{
|
|
52
|
-
"rule": "quotes",
|
|
53
|
-
"cite": "Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), Parte quarta, punto 10.1.7 «Virgolette»: «Le virgolette non richiedono spazio né in apertura né in chiusura»",
|
|
54
|
-
"url": "https://op.europa.eu/it/publication-detail/-/publication/e774ea2a-ef84-4bf6-be92-c9ebebf91c1b",
|
|
55
|
-
"note": "Giustifica innerSpace = \"none\" su entrambe le coppie, ed è il punto che separa l'italiano dal francese. LETTURA DICHIARATA COME TALE: «né in apertura né in chiusura» va inteso come «né dal lato di apertura né dal lato di chiusura del testo racchiuso», cioè nessuno spazio interno; la lettura alternativa è impossibile, perché lo spazio fra la parola precedente e il segno di apertura non è facoltativo. La tabella del punto 6.4 disambiguerebbe la frase ma NON è invocata: il suo preambolo la qualifica come accordo interistituzionale adottato «a vantaggio di una convenzione comune» al posto dei codici tipografici nazionali divergenti, cioè prassi editoriale e non norma italiana — la stessa lettura già applicata in el.json. Conseguenza pratica: l'elisione italiana è al sicuro, perché dell'«amico» non richiede spazio interno. elisionIdioms resta vuoto: l'elisione italiana è un fenomeno clitico, non un idioma della forma {left, elided, right}. Consultati il 18.09.2026."
|
|
56
|
-
},
|
|
57
|
-
{
|
|
58
|
-
"rule": "dashes",
|
|
59
|
-
"cite": "Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), punto 4.2.3, riquadro «Trattini»: «In italiano utilizzare il trattino lungo come eventuale alternativa alle parentesi»; Parte quarta, punto 10.1.10 «Lineetta», con l'esempio stampato «La casa — se casa si poteva definire quel rudere — sorgeva ai piedi del colle»",
|
|
60
|
-
"url": "https://op.europa.eu/it/publication-detail/-/publication/e774ea2a-ef84-4bf6-be92-c9ebebf91c1b",
|
|
61
|
-
"note": "Giustifica dash.parenthetical = \"em-spaced\": U+2014 con uno spazio ordinario su CIASCUN lato di CIASCUNA lineetta. La spaziatura è simmetrica, quindi — a differenza dello spagnolo e del greco — l'enum la esprime senza forzature. INFERENZA DICHIARATA sul code point: Alt 0151 è CP1252 0x97, da cui U+2014. Riscontro sulla SPAZIATURA, non sul code point: Treccani, «Trattino [prontuario]» (Stefano Telve, 2011), che del trattino breve scrive «A differenza della lineetta, non è preceduto né seguito da spazi». COSTO ACCETTATO, verificato sul motore e registrato qui perché non venga riscoperto come bug: il punto 10.1.11 prescrive il trattino spaziato per collegare due date di mesi diversi («25 maggio - 10 giugno 1985»), e la guardia P1 di dashes.md §3.2 converte qualunque trattino isolato e spaziato fra parole, quindi il motore produce una lineetta lì. Non è una particolarità italiana: fr, ru, de-DE e en-GB, già pubblicate, si comportano allo stesso modo sulla stessa stringa. Consultati il 18.09.2026."
|
|
62
|
-
},
|
|
63
|
-
{
|
|
64
|
-
"rule": "ranges",
|
|
65
|
-
"cite": "Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), Parte quarta, punto 10.3.1 «Numeri arabi»: «I numeri arabi non richiedono la lineetta (lineato) bensì il trattino (divisione)», con l'esempio stampato «la sessione del 15-19 giugno 1985»; punto 10.1.11: «Il trattino è anche impiegato, senza alcuno spazio, per collegare due anni civili o due date di uno stesso mese: 1971-1972, 10-15 settembre 1985»",
|
|
66
|
-
"url": "https://op.europa.eu/it/publication-detail/-/publication/e774ea2a-ef84-4bf6-be92-c9ebebf91c1b",
|
|
67
|
-
"note": "Giustifica dash.range = \"none\", e lo fa in POSITIVO, non per assenza di citazione: la fonte prescrive il trattino U+002D — il carattere che l'autore ha già digitato — ed esclude la lineetta per nome. L'enum non ha un valore «trattino»: \"none\" è la codifica esatta di ciò che la fonte richiede. Riscontro: Treccani, «Trattino [prontuario]» (Telve 2011), esempi «il fascicolo del 2-3 luglio», «anno accademico 2010-2011». Voce separata da quella di dashes benché entrambe le regole leggano il campo dash: la citazione è distinta e più forte. Consultati il 18.09.2026."
|
|
68
|
-
},
|
|
69
|
-
{
|
|
70
|
-
"rule": "ellipsis",
|
|
71
|
-
"cite": "Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), Parte quarta, punto 10.1.8 «Punti di sospensione»: «Segno d'interpunzione costituito da tre punti»; Accademia della Crusca, Consulenza linguistica, «La punteggiatura» (Mara Marzullo, 16 luglio 2004): «I puntini di sospensione si usano sempre nel numero di tre»",
|
|
72
|
-
"url": "https://accademiadellacrusca.it/it/consulenza/la-punteggiatura/143",
|
|
73
|
-
"note": "Giustifica abbreviatedAfterTerminal = false. Due fonti indipendenti affermano che i puntini sono sempre tre, e nessuna prevede la forma a due punti dopo U+003F o U+0021 che usa il russo: il ramo russo di ellipsis.md resta spento per l'italiano. Nessuna delle due si pronuncia su U+2026 contro tre U+002E; quella scelta è del motore ed è identica in ogni locale. DIVERGENZA NOTA, registrata: gli esempi stampati del Manuale non lasciano spazio prima dei puntini, mentre spaces.md §3.4 conserva in ogni locale lo spazio che precede una sequenza di punti; è deliberata e argomentata in spaces.md §7.9, identica a quella già registrata per el. Il Manuale è consultabile all'indirizzo op.europa.eu (cfr. le altre voci di questo file); l'url di questa voce punta alla fonte Crusca, poiché lo schema ne ammette uno solo. Consultati il 18.09.2026."
|
|
74
|
-
},
|
|
75
|
-
{
|
|
76
|
-
"rule": "hyphen",
|
|
77
|
-
"cite": "Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), Parte quarta, punto 10.1.11 «Trattino»: «Il trattino («divisione» in linguaggio tipografico) […] si impiega principalmente per dividere la parola in fin di riga»; «Si può anche usare per unire due parole contraendo la prima: trattato italo-francese»",
|
|
78
|
-
"url": "https://op.europa.eu/it/publication-detail/-/publication/e774ea2a-ef84-4bf6-be92-c9ebebf91c1b",
|
|
79
|
-
"note": "Giustifica le tre liste vuote. La fonte enumera gli impieghi del trattino — e il primo che nomina è l'OPPOSTO dell'insecabilità — senza definire alcuna classe chiusa di forme morfologiche il cui trattino debba resistere all'andata a capo, che è l'unica cosa che questa regola consuma. Riscontro: Treccani, «Trattino [prontuario]» (Telve 2011), che elenca le funzioni di unione (afro-cubano, porta-finestra, maxi-schermo) senza definire neppure essa un elenco chiuso. La famiglia di prefissi (ex-, anti-, maxi-) è stata verificata espressamente perché è l'unica che lo schema saprebbe contenere: le fonti la trattano come schema produttivo e aperto, e un insieme aperto non è esprimibile in wordList. Consultati il 18.09.2026."
|
|
80
|
-
},
|
|
81
|
-
{
|
|
82
|
-
"rule": "nbsp",
|
|
83
|
-
"cite": "BIPM, The International System of Units (SI), 9th ed. (2019), concise summary: «A single space is always left between the number and the unit»",
|
|
84
|
-
"url": "https://www.bipm.org/documents/20126/41483022/SI-Brochure-9-concise-EN.pdf",
|
|
85
|
-
"note": "Autorità per l'ELENCO delle unità, non per il legame: che lo spazio sia insecabile e che sia U+00A0 è deciso da nbsp.md §2.1, che una locale non può variare. Stessa impostazione di en-US, en-GB, fi e sv. L'elenco segue la forma prudente di fr e de-DE ed esclude deliberatamente i simboli di una sola lettera (m, g, l, s, A), che non si possono disambiguare senza contesto. La tabella del punto 6.4 del Manuale darebbe lo stesso risultato per «%» e «°C» ma non è invocata, per la ragione detta nella voce quotes. Consultati il 18.09.2026."
|
|
86
|
-
},
|
|
87
|
-
{
|
|
88
|
-
"rule": "nbsp",
|
|
89
|
-
"cite": "Manuale interistituzionale di convenzioni redazionali, ed. 2011 (IT), punto 4.2.3, riquadro «Spazi vuoti protetti»: «Consentono di evitare la troncatura a fine riga di elementi che devono rimanere uniti»; «Da usare solo nei casi seguenti […]: n.• JO L• 10•000 / pag.• JO C• C.•M. Dupont», dove «•» indica lo spazio fisso",
|
|
90
|
-
"url": "https://op.europa.eu/it/publication-detail/-/publication/e774ea2a-ef84-4bf6-be92-c9ebebf91c1b",
|
|
91
|
-
"note": "INFERENZA DICHIARATA, accettata per decisione dell'operatore il 18.09.2026, non citazione piena — ed è esattamente la distinzione che questo campo esiste per non far sparire. I riquadri «Virgolette» e «Trattini» dello stesso punto 4.2.3 dicono «Nella lingua italiana» e «In italiano»: questo riquadro NON lo dice, ed è in parte non adattato, poiché «JO L» e «JO C» sono il Journal officiel francese e «Dupont» è un cognome francese, in un'edizione italiana il cui testo originale era in francese. Ciò che l'italiano c'è davvero: «pag.» è italiano (il francese scrive «p.») e «n.» è uso italiano corrente, quindi il riquadro è stato localizzato almeno in parte — su questo poggia beforeNumber. La sequenza «C.•M. Dupont» non contiene invece alcun materiale italiano, e initialBinding resta perciò \"none\", il valore pulito da citazione. Nessuna tolleranza di caso: N9 non ne ha, e sono stampate solo le forme minuscole «n.» e «pag.». «10•000» è raggruppamento delle migliaia e «JO L•» una serie della Gazzetta ufficiale: nessuno dei due è esprimibile in questo schema. Consultati il 18.09.2026."
|
|
92
|
-
},
|
|
93
|
-
{
|
|
94
|
-
"rule": "nbsp",
|
|
95
|
-
"cite": "Nessuna fonte normativa italiana esaminata prescrive uno spazio prima di un segno d'interpunzione, né un legame per abbreviazioni con spazio interno, simboli o parole seguenti; liste deliberatamente vuote",
|
|
96
|
-
"note": "beforePunctuation e narrowBeforePunctuation sono vuote, e va detto con esattezza su che cosa poggiano: sull'ASSENZA di una fonte italiana che richieda quello spazio, NON su una fonte che lo neghi. A differenza del capitolo greco, che respinge la prassi francese nominandola, la Parte quarta italiana non la nomina mai: i punti 10.1.3 e 10.1.4 descrivono la funzione dei segni e tacciono sulla spaziatura. Il vincolo Q-P rende comunque la lista vuota la scelta strutturalmente sicura. afterShortWords, abbreviations, beforeWord e afterSymbols sono vuote per la stessa ragione: nessuna fonte esaminata le attesta per l'italiano. SEGNALAZIONE ALL'OPERATORE, non risolta qui: la Parte quarta si apre, al punto 10.1, con «Per la spaziatura dei segni d'interpunzione, cfr. punto 6.4», cioè il capitolo squalificato come prassi editoriale in el.json; se quel rinvio si leggesse come un'adozione, la tabella diventerebbe evidenza italiana e rafforzerebbe queste liste vuote. Consultati il 18.09.2026."
|
|
97
|
-
},
|
|
98
|
-
{
|
|
99
|
-
"rule": "quotes",
|
|
100
|
-
"cite": "Accademia della Crusca, Consulenza linguistica : Vera Gheno, « L'articolo indeterminativo » (30 settembre 2002), sulla forma femminile « un' (nei casi in cui si userebbe l'articolo determinativo l', ma l'elisione non è obbligatoria) [...] va usata davanti a parole che iniziano per vocale » ; Raffaella Setti, « Elisione e troncamento nell'italiano contemporaneo » (14 marzo 2008) : con di l'elisione è spesso applicata e in alcuni casi obbligatoria (d'accordo, d'oro), mentre con mi, ti, la, vi, si « l'apostrofo è del tutto facoltativo » e « non c'è nessun obbligo di elidere, ma è opportuno valutare caso per caso »",
|
|
101
|
-
"url": "https://accademiadellacrusca.it/it/consulenza/elisione-e-troncamento-nellitaliano-contemporaneo/174",
|
|
102
|
-
"note": "Italian elision is not a closed set — the Accademia states in terms that it is optional and to be judged case by case — so this entry evidences membership per fragment, exactly as quotes.md §3.2 requires of each elisionIdioms triple, and not the completeness of the list. Three fragments are named literally and are all that is listed: l (definite article l'), un (feminine indefinite un' — Crusca is categorical that masculine un takes no apostrophe, and the mechanism cannot tell the two apart, which is harmless because it only ever declines a pairing), and d (di, with d'accordo and d'oro given as obligatory). dell, nell, all, sull and dall are deliberately absent, being unattested by the consulenze read here; under maximal-run matching an l entry does not cover dell'arte either way, since the run there is dell. after is empty: Italian has no enclitic written with an apostrophe. quotes.md §3.2's span-boundary elision veto (spec 1.4.0) reads this list only when the mark's other literal neighbour is modes.md §3.2's inline span boundary, so every entry is matched against the maximal LETTER run on one side of the mark and nothing else. The list is decline-only: the worst it can do is refuse a pairing quotes would otherwise have formed."
|
|
103
|
-
}
|
|
104
|
-
]
|
|
61
|
+
}
|
|
105
62
|
}
|