@stll/anonymize 1.2.0 → 1.3.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (58) hide show
  1. package/dist/address-boundaries.mjs +113 -5
  2. package/dist/address-stop-keywords.mjs +137 -0
  3. package/dist/address-stop-keywords.mjs.map +1 -0
  4. package/dist/address-stopwords.mjs +81 -0
  5. package/dist/address-stopwords.mjs.map +1 -0
  6. package/dist/address-street-types.mjs +67 -4
  7. package/dist/clause-noun-heads.mjs +75 -0
  8. package/dist/clause-noun-heads.mjs.map +1 -0
  9. package/dist/coreference.es.mjs +22 -0
  10. package/dist/coreference.es.mjs.map +1 -0
  11. package/dist/coreference.fr.mjs +32 -0
  12. package/dist/coreference.fr.mjs.map +1 -0
  13. package/dist/coreference.it.mjs +27 -0
  14. package/dist/coreference.it.mjs.map +1 -0
  15. package/dist/coreference.pl.mjs +27 -0
  16. package/dist/coreference.pl.mjs.map +1 -0
  17. package/dist/coreference.pt-br.mjs +14 -0
  18. package/dist/coreference.pt-br.mjs.map +1 -0
  19. package/dist/coreference.sk.mjs +22 -5
  20. package/dist/generic-roles.mjs +179 -1
  21. package/dist/hotword-rules.mjs +7 -3
  22. package/dist/index.d.mts +56 -3
  23. package/dist/index.mjs +2368 -1350
  24. package/dist/index.mjs.map +1 -1
  25. package/dist/legal-forms.mjs +3 -0
  26. package/dist/legal-role-heads.cs.mjs +42 -0
  27. package/dist/legal-role-heads.cs.mjs.map +1 -0
  28. package/dist/legal-role-heads.de.mjs +33 -0
  29. package/dist/legal-role-heads.de.mjs.map +1 -0
  30. package/dist/legal-role-heads.en.mjs +37 -0
  31. package/dist/legal-role-heads.en.mjs.map +1 -0
  32. package/dist/legal-role-heads.es.mjs +54 -0
  33. package/dist/legal-role-heads.es.mjs.map +1 -0
  34. package/dist/legal-role-heads.fr.mjs +72 -0
  35. package/dist/legal-role-heads.fr.mjs.map +1 -0
  36. package/dist/legal-role-heads.it.mjs +68 -0
  37. package/dist/legal-role-heads.it.mjs.map +1 -0
  38. package/dist/legal-role-heads.pl.mjs +84 -0
  39. package/dist/legal-role-heads.pl.mjs.map +1 -0
  40. package/dist/legal-role-heads.pt-br.mjs +63 -0
  41. package/dist/legal-role-heads.pt-br.mjs.map +1 -0
  42. package/dist/legal-role-heads.sk.mjs +80 -0
  43. package/dist/legal-role-heads.sk.mjs.map +1 -0
  44. package/dist/manifest.mjs +21 -8
  45. package/dist/names-exclusions.mjs +21 -1
  46. package/dist/person-stopwords.mjs +121 -1
  47. package/dist/section-headings.mjs +15 -3
  48. package/dist/sentence-verb-indicators.mjs +223 -0
  49. package/dist/sentence-verb-indicators.mjs.map +1 -0
  50. package/dist/triggers.cs.mjs +107 -3
  51. package/dist/triggers.es.mjs +43 -4
  52. package/dist/triggers.fr.mjs +206 -7
  53. package/dist/triggers.it.mjs +26 -4
  54. package/dist/triggers.pl.mjs +191 -4
  55. package/dist/triggers.pt-br.mjs +193 -0
  56. package/dist/triggers.pt-br.mjs.map +1 -0
  57. package/dist/triggers.sk.mjs +493 -0
  58. package/package.json +7 -6
@@ -0,0 +1,27 @@
1
+ //#region src/data/coreference.it.json
2
+ var coreference_it_default = [
3
+ {
4
+ "label": "(in seguito \"X\") or (di seguito \"X\")",
5
+ "pattern": "\\((?:in\\s+seguito|di\\s+seguito|qui\\s+di\\s+seguito|nel\\s+seguito)\\s+(?:denominata|denominato|detta|detto|indicata|indicato|anche|la|il)?\\s*[\"'“”«»‘’‚]([^\"'“”«»‘’‚]+)[\"'“”«»‘’‚]\\)",
6
+ "flags": "gi"
7
+ },
8
+ {
9
+ "label": "(denominato/denominata \"X\")",
10
+ "pattern": "\\((?:denominata|denominato|qui\\s+di\\s+seguito\\s+denominata|qui\\s+di\\s+seguito\\s+denominato)\\s+[\"'“”«»‘’‚]([^\"'“”«»‘’‚]+)[\"'“”«»‘’‚]\\)",
11
+ "flags": "gi"
12
+ },
13
+ {
14
+ "label": "(la/il \"X\")",
15
+ "pattern": "\\((?:la|il|lo|le|gli|l')\\s*[\"'“”«»‘’‚]([^\"'“”«»‘’‚]+)[\"'“”«»‘’‚]\\)",
16
+ "flags": "gi"
17
+ },
18
+ {
19
+ "label": "denominata/denominato \"X\" without parens",
20
+ "pattern": "(?:in\\s+seguito|di\\s+seguito)\\s+(?:denominata|denominato|detta|detto|indicata|indicato)\\s+[\"'“”«»‘’‚]([^\"'“”«»‘’‚]+)[\"'“”«»‘’‚]",
21
+ "flags": "gi"
22
+ }
23
+ ];
24
+ //#endregion
25
+ export { coreference_it_default as default };
26
+
27
+ //# sourceMappingURL=coreference.it.mjs.map
@@ -0,0 +1 @@
1
+ {"version":3,"file":"coreference.it.mjs","names":[],"sources":["../src/data/coreference.it.json"],"sourcesContent":[""],"mappings":""}
@@ -0,0 +1,27 @@
1
+ //#region src/data/coreference.pl.json
2
+ var coreference_pl_default = [
3
+ {
4
+ "label": "(zwana/y dalej \"X\") parenthetical define-term",
5
+ "pattern": "zwan(?:ego|emu|ymi|ym|ej|[ayąei])?\\s+dalej\\s+[\"„‚']([^\"”’']+)[\"”’']",
6
+ "flags": "gi"
7
+ },
8
+ {
9
+ "label": "dalej zwana/y \"X\"",
10
+ "pattern": "dalej\\s+zwan(?:ego|emu|ymi|ym|ej|[ayąei])?\\s+[\"„‚']([^\"”’']+)[\"”’']",
11
+ "flags": "gi"
12
+ },
13
+ {
14
+ "label": "(\"X\") parenthetical define-term",
15
+ "pattern": "\\(\\s*[\"„‚']([^\"”’']+)[\"”’']\\s*\\)",
16
+ "flags": "gi"
17
+ },
18
+ {
19
+ "label": "zwanymi dalej łącznie \"X\"",
20
+ "pattern": "zwanymi\\s+dalej\\s+(?:łącznie\\s+)?[\"„‚']([^\"”’']+)[\"”’']",
21
+ "flags": "gi"
22
+ }
23
+ ];
24
+ //#endregion
25
+ export { coreference_pl_default as default };
26
+
27
+ //# sourceMappingURL=coreference.pl.mjs.map
@@ -0,0 +1 @@
1
+ {"version":3,"file":"coreference.pl.mjs","names":[],"sources":["../src/data/coreference.pl.json"],"sourcesContent":[""],"mappings":""}
@@ -0,0 +1,14 @@
1
+ //#region src/data/coreference.pt-br.json
2
+ var coreference_pt_br_default = [{
3
+ "label": "(doravante denominada \"X\") / (doravante denominado \"X\")",
4
+ "pattern": "doravante\\s+denominad[ao]s?(?:\\s+simplesmente)?\\s+[\"'“”„‟‚‘’]?([^\"'“”„‟‚‘’,;.\\n)]+?)[\"'“”„‟‚‘’,;.\\n)]",
5
+ "flags": "gi"
6
+ }, {
7
+ "label": "doravante referida como \"X\"",
8
+ "pattern": "doravante\\s+(?:referid[ao]|design[ao]d[ao])s?(?:\\s+como)?\\s+[\"'“”„‟‚‘’]?([^\"'“”„‟‚‘’,;.\\n)]+?)[\"'“”„‟‚‘’,;.\\n)]",
9
+ "flags": "gi"
10
+ }];
11
+ //#endregion
12
+ export { coreference_pt_br_default as default };
13
+
14
+ //# sourceMappingURL=coreference.pt-br.mjs.map
@@ -0,0 +1 @@
1
+ {"version":3,"file":"coreference.pt-br.mjs","names":[],"sources":["../src/data/coreference.pt-br.json"],"sourcesContent":[""],"mappings":""}
@@ -1,9 +1,26 @@
1
1
  //#region src/data/coreference.sk.json
2
- var coreference_sk_default = [{
3
- "label": "(dalej len \"X\")",
4
- "pattern": "\\(ďalej\\s+len\\s+[„\"'‚]([^\"'\"\"]+)[\"\"']\\)",
5
- "flags": "gi"
6
- }];
2
+ var coreference_sk_default = [
3
+ {
4
+ "label": "(ďalej len \"X\") in parentheses",
5
+ "pattern": "\\(ďalej\\s+len\\s+[„\"'‚,]*([^\"'„“,;.\\n)]+?)[\"'„“,;.]*\\s*\\)",
6
+ "flags": "gi"
7
+ },
8
+ {
9
+ "label": "ďalej len \"X\" without parens",
10
+ "pattern": "ďalej\\s+len\\s+[„\"'‚,]([^\"'„“,;.\\n]+?)[\"'„“]",
11
+ "flags": "gi"
12
+ },
13
+ {
14
+ "label": "(ďalej spolu ako \"X\")",
15
+ "pattern": "\\(ďalej\\s+spolu\\s+(?:len|ako)\\s+[„\"'‚,]*([^\"'„“,;.\\n)]+?)[\"'„“,;.]*\\s*\\)",
16
+ "flags": "gi"
17
+ },
18
+ {
19
+ "label": "(ďalej tiež \"X\")",
20
+ "pattern": "\\(ďalej\\s+tiež\\s+[„\"'‚,]*([^\"'„“,;.\\n)]+?)[\"'„“,;.]*\\s*\\)",
21
+ "flags": "gi"
22
+ }
23
+ ];
7
24
  //#endregion
8
25
  export { coreference_sk_default as default };
9
26
 
@@ -1,59 +1,237 @@
1
1
  //#region src/data/generic-roles.json
2
2
  var _comment = "Generic legal/business role terms that are not PII. Used to filter false positives from name detection.";
3
3
  var roles = [
4
+ "acreedor",
5
+ "acreedora",
6
+ "adjudicatario",
7
+ "adjudicataria",
4
8
  "arbeitgeber",
5
9
  "arbeitnehmer",
10
+ "arrendador",
11
+ "arrendadora",
12
+ "arrendatario",
13
+ "arrendataria",
6
14
  "auftraggeber",
7
15
  "auftragnehmer",
8
16
  "bonus",
9
17
  "borrower",
10
18
  "buyer",
19
+ "capitán",
20
+ "cedente",
11
21
  "cena",
22
+ "cesionario",
23
+ "cesionaria",
12
24
  "client",
25
+ "cliente",
26
+ "comprador",
27
+ "compradora",
13
28
  "committee",
14
29
  "company",
15
30
  "contractor",
31
+ "contratante",
32
+ "contratista",
33
+ "coronel",
16
34
  "customer",
17
35
  "darlehensgeber",
18
36
  "darlehensnehmer",
37
+ "deudor",
38
+ "deudora",
19
39
  "dlužník",
40
+ "dlžník",
20
41
  "dodavatel",
42
+ "dodávateľ",
43
+ "dostawca",
44
+ "dostawcą",
45
+ "dostawcy",
46
+ "empleado",
47
+ "empleador",
48
+ "empleadora",
49
+ "empleada",
50
+ "empresa",
51
+ "empresario",
52
+ "empresaria",
21
53
  "employee",
22
54
  "employer",
23
55
  "fax",
56
+ "fiador",
57
+ "fiadora",
24
58
  "gesellschaft",
25
59
  "guarantor",
26
60
  "kupující",
61
+ "kupujúci",
27
62
  "käufer",
28
63
  "landlord",
64
+ "licitador",
65
+ "licitadora",
29
66
  "lender",
30
67
  "licensee",
31
68
  "licensor",
32
69
  "mieter",
33
70
  "nájemce",
71
+ "nájomca",
34
72
  "objednatel",
73
+ "objednávateľ",
35
74
  "odběratel",
75
+ "odberateľ",
76
+ "otorgante",
77
+ "otorgado",
78
+ "otorgada",
79
+ "parte",
80
+ "partes",
36
81
  "parties",
37
82
  "party",
38
83
  "plátce",
84
+ "poskytovateľ",
85
+ "prestador",
86
+ "prestadora",
87
+ "prestatario",
88
+ "prestataria",
89
+ "prijímateľ",
39
90
  "prodávající",
91
+ "predávajúci",
40
92
  "pronajímatel",
93
+ "prenajímateľ",
94
+ "proveedor",
95
+ "proveedora",
41
96
  "příjemce",
42
97
  "seller",
98
+ "sociedad",
99
+ "spoločnosť",
43
100
  "společnost",
44
101
  "strana",
45
102
  "strany",
46
103
  "supplier",
47
104
  "tenant",
105
+ "vendedor",
106
+ "vendedora",
48
107
  "vendor",
49
108
  "vermieter",
50
109
  "verkäufer",
51
110
  "věřitel",
111
+ "veriteľ",
52
112
  "uchazeč",
113
+ "ubytovateľ",
114
+ "usporiadateľ",
53
115
  "zadavatel",
116
+ "zamawiający",
117
+ "zamawiającego",
118
+ "zamawiającym",
54
119
  "zaměstnanec",
120
+ "zamestnanec",
55
121
  "zaměstnavatel",
56
- "zhotovitel"
122
+ "zamestnávateľ",
123
+ "zhotovitel",
124
+ "zhotoviteľ",
125
+ "acquirente",
126
+ "amministrazione",
127
+ "appaltatore",
128
+ "appaltatrice",
129
+ "cedente",
130
+ "cessionario",
131
+ "cliente",
132
+ "committente",
133
+ "compratore",
134
+ "compratrice",
135
+ "concedente",
136
+ "concessionario",
137
+ "conduttore",
138
+ "conduttrice",
139
+ "creditore",
140
+ "datore",
141
+ "debitore",
142
+ "denominazione",
143
+ "dipendente",
144
+ "fideiussore",
145
+ "fornitore",
146
+ "fornitrice",
147
+ "garante",
148
+ "lavoratore",
149
+ "lavoratrice",
150
+ "licenziante",
151
+ "licenziatario",
152
+ "locatario",
153
+ "locataria",
154
+ "locatore",
155
+ "locatrice",
156
+ "mandante",
157
+ "mandatario",
158
+ "mandataria",
159
+ "mutuante",
160
+ "mutuatario",
161
+ "parte",
162
+ "parti",
163
+ "stazione",
164
+ "subappaltatore",
165
+ "venditore",
166
+ "venditrice",
167
+ "zleceniodawca",
168
+ "zleceniodawcą",
169
+ "zleceniodawcy",
170
+ "zleceniobiorca",
171
+ "zleceniobiorcą",
172
+ "zleceniobiorcy",
173
+ "wykonawca",
174
+ "wykonawcą",
175
+ "wykonawcy",
176
+ "wynajmujący",
177
+ "wynajmująca",
178
+ "wynajmującym",
179
+ "wynajmującej",
180
+ "najemca",
181
+ "najemcy",
182
+ "sprzedawca",
183
+ "sprzedawcy",
184
+ "sprzedawcą",
185
+ "sprzedający",
186
+ "kupujący",
187
+ "kupującego",
188
+ "pracodawca",
189
+ "pracodawcą",
190
+ "pracownik",
191
+ "pracownikiem",
192
+ "pożyczkodawca",
193
+ "pożyczkodawcą",
194
+ "pożyczkobiorca",
195
+ "pożyczkobiorcą",
196
+ "odbiorca",
197
+ "odbiorcą",
198
+ "acheteur",
199
+ "acheteuse",
200
+ "acquéreur",
201
+ "acquéreuse",
202
+ "bailleresse",
203
+ "bailleur",
204
+ "cédant",
205
+ "cédante",
206
+ "cessionnaire",
207
+ "concédant",
208
+ "concédante",
209
+ "concessionnaire",
210
+ "donneur d'ordre",
211
+ "emprunteur",
212
+ "emprunteuse",
213
+ "employé",
214
+ "employée",
215
+ "employeur",
216
+ "employeuse",
217
+ "fournisseur",
218
+ "fournisseuse",
219
+ "garant",
220
+ "garante",
221
+ "locataire",
222
+ "mandant",
223
+ "mandante",
224
+ "mandataire",
225
+ "preneur",
226
+ "preneuse",
227
+ "prestataire",
228
+ "prêteur",
229
+ "prêteuse",
230
+ "salarié",
231
+ "salariée",
232
+ "société",
233
+ "vendeur",
234
+ "vendeuse"
57
235
  ];
58
236
  var generic_roles_default = {
59
237
  _comment,
@@ -7,7 +7,7 @@ var rules = [
7
7
  "birth number",
8
8
  "Geburtsnummer"
9
9
  ],
10
- "targetLabels": ["czech birth number"],
10
+ "targetLabels": ["birth number"],
11
11
  "scoreAdjustment": .25,
12
12
  "proximityBefore": 60,
13
13
  "proximityAfter": 60
@@ -87,7 +87,8 @@ var rules = [
87
87
  "hotwords": [
88
88
  "e-mail",
89
89
  "email",
90
- "E-Mail"
90
+ "E-Mail",
91
+ "pec"
91
92
  ],
92
93
  "targetLabels": ["email address"],
93
94
  "scoreAdjustment": .1,
@@ -101,7 +102,10 @@ var rules = [
101
102
  "sídlem",
102
103
  "bytem",
103
104
  "Adresse",
104
- "address"
105
+ "address",
106
+ "indirizzo",
107
+ "sede legale",
108
+ "sede"
105
109
  ],
106
110
  "targetLabels": ["address"],
107
111
  "scoreAdjustment": .15,
package/dist/index.d.mts CHANGED
@@ -62,6 +62,16 @@ type GazetteerEntry = {
62
62
  /** Extraction strategy — closed discriminated union. */
63
63
  type TriggerStrategy = {
64
64
  type: "to-next-comma";
65
+ /**
66
+ * Optional list of lowercase keywords that terminate
67
+ * the value scan, in addition to commas/newlines. Useful
68
+ * for triggers like court names that may continue past
69
+ * a missing comma into adjacent clause text ("Městským
70
+ * soudem v Praze dne 1. 1. 2020"); listing `"dne"` here
71
+ * stops the scan at the date boundary. Matched on a
72
+ * word-boundary, case-insensitive.
73
+ */
74
+ stopWords?: string[];
65
75
  } | {
66
76
  type: "to-end-of-line";
67
77
  } | {
@@ -72,6 +82,19 @@ type TriggerStrategy = {
72
82
  } | {
73
83
  type: "address";
74
84
  maxChars?: number;
85
+ } | {
86
+ /**
87
+ * Extract the first regex match in the value text.
88
+ * Useful for shape-bounded values that follow a
89
+ * label on the same line as other fields, where
90
+ * `to-end-of-line` would over-capture. The pattern
91
+ * is anchored to the start of the (already
92
+ * leading-whitespace-stripped) value, so use
93
+ * `(?:.*?)` prefix only when intentional.
94
+ */
95
+ type: "match-pattern";
96
+ pattern: string;
97
+ flags?: string;
75
98
  };
76
99
  /** Validation rules — closed discriminated union. */
77
100
  type TriggerValidation = {
@@ -90,7 +113,21 @@ type TriggerValidation = {
90
113
  type: "matches-pattern";
91
114
  pattern: string;
92
115
  flags?: string;
116
+ }
117
+ /**
118
+ * Run a named stdnum validator (checksum + length)
119
+ * against the captured value. Keeps the trigger
120
+ * path symmetrical with the formatted-regex
121
+ * detectors so e.g. `CPF nº 00000000000` does not
122
+ * survive as a tax-ID entity.
123
+ */
124
+ | {
125
+ type: "valid-id";
126
+ validator: ValidIdValidator;
93
127
  };
128
+ /** Built-in stdnum validators that can be referenced
129
+ * by `valid-id` validations. */
130
+ type ValidIdValidator = "br.cpf" | "br.cnpj";
94
131
  /** Auto-generated trigger variants — closed set. */
95
132
  type TriggerExtension = "add-colon" | "add-trailing-space" | "add-colon-space" | "normalize-spaces";
96
133
  /** V2 trigger config entry (JSON shape). */
@@ -124,6 +161,9 @@ type CompiledValidation = {
124
161
  } | {
125
162
  type: "matches-pattern";
126
163
  re: RegExp;
164
+ } | {
165
+ type: "valid-id";
166
+ check: (value: string) => boolean;
127
167
  };
128
168
  /**
129
169
  * Runtime rule — one per trigger string after
@@ -310,7 +350,7 @@ type PipelineConfig = {
310
350
  * every pipeline run and never persisted to the database.
311
351
  * Renaming a label here requires no migration.
312
352
  */
313
- declare const DEFAULT_ENTITY_LABELS: readonly ["person", "organization", "phone number", "address", "email address", "date", "date of birth", "bank account number", "iban", "tax identification number", "identity card number", "registration number", "credit card number", "passport number", "monetary amount", "land parcel"];
353
+ declare const DEFAULT_ENTITY_LABELS: readonly ["person", "organization", "phone number", "address", "email address", "date", "date of birth", "bank account number", "iban", "tax identification number", "identity card number", "birth number", "national identification number", "social security number", "registration number", "credit card number", "passport number", "monetary amount", "land parcel", "misc"];
314
354
  //#endregion
315
355
  //#region src/detectors/regex.d.ts
316
356
  type RegexMeta = {
@@ -502,7 +542,9 @@ type PipelineContext = {
502
542
  allowList: ReadonlySet<string> | null;
503
543
  allowListPromise: Promise<ReadonlySet<string>> | null;
504
544
  personStopwords: ReadonlySet<string> | null;
505
- personStopwordsPromise: Promise<ReadonlySet<string>> | null; /** First-name exclusions for stopword filtering. */
545
+ personStopwordsPromise: Promise<ReadonlySet<string>> | null;
546
+ addressStopwords: ReadonlySet<string> | null;
547
+ addressStopwordsPromise: Promise<ReadonlySet<string>> | null; /** First-name exclusions for stopword filtering. */
506
548
  firstNameExclusions: ReadonlySet<string> | null;
507
549
  firstNameExclusionCorpusLen: number;
508
550
  genericRoles: ReadonlySet<string> | null;
@@ -627,6 +669,7 @@ declare const DEFAULT_OPERATOR_CONFIG: OperatorConfig;
627
669
  declare const resolveOperator: (config: OperatorConfig, label: string) => OperatorType;
628
670
  //#endregion
629
671
  //#region src/detectors/legal-forms.d.ts
672
+ declare const warmLegalRoleHeads: () => Promise<void>;
630
673
  /**
631
674
  * Build legal form regex pattern strings.
632
675
  * Returns an array of regex strings for the unified
@@ -638,6 +681,14 @@ declare const buildLegalFormPatterns: () => Promise<string[]>;
638
681
  * Process legal form matches from the unified search.
639
682
  * Receives all matches; filters to the legal forms
640
683
  * slice via sliceStart/sliceEnd.
684
+ *
685
+ * The role-head trimming step reads per-language data from
686
+ * a cache that `runPipeline` warms via `warmLegalRoleHeads()`
687
+ * before calling this. Callers that invoke
688
+ * `processLegalFormMatches` directly (without going through
689
+ * `runPipeline`) must `await warmLegalRoleHeads()` first;
690
+ * otherwise the trim falls back to a no-op and sentence-
691
+ * fragment fixes do not apply.
641
692
  */
642
693
  declare const processLegalFormMatches: (allMatches: Match[], sliceStart: number, sliceEnd: number, fullText?: string) => Entity[];
643
694
  //#endregion
@@ -819,6 +870,8 @@ type CountryCode = NonNullRegion[keyof NonNullRegion][number];
819
870
  declare const resolveCountries: (regions?: string[], countries?: string[]) => Set<string> | null;
820
871
  //#endregion
821
872
  //#region src/filters/false-positives.d.ts
873
+ /** Ensure street-type vocabulary is loaded. */
874
+ declare const initAddressComponents: () => Promise<void>;
822
875
  /**
823
876
  * Filter out entities that are likely false positives:
824
877
  * template placeholders, clause/section numbers,
@@ -1035,5 +1088,5 @@ declare const levenshtein: (rawA: string, rawB: string) => number;
1035
1088
  */
1036
1089
  declare const normalizeForSearch: (text: string) => string;
1037
1090
  //#endregion
1038
- export { type AnonymisationOperator, CURRENCY_PATTERN_META, type CountryCode, type CustomDenyListEntry, type CustomRegexPattern, DATE_PATTERN_META, DEFAULT_ENTITY_LABELS, DEFAULT_OPERATOR_CONFIG, DETECTION_SOURCES, DETECTOR_PRIORITY, type DefinitionPattern, type DenyListCategory, type DenyListData, type DetectionSource, type Dictionaries, type DictionaryMeta, type DocumentZone, type Entity, type EntityResult, type GazetteerData, type GazetteerEntry, type HotwordRule, type NameCorpusData, type NerInferenceFn, OPERATOR_REGISTRY, OPERATOR_TYPES, type OperatorConfig, type OperatorType, type PipelineConfig, type PipelineContext, type PipelineOptions, REGEX_META, REGEX_PATTERNS, REGIONS, type RawInferenceResult, type RedactionResult, type RegexMeta, type RegionId, type ReviewDecision, type ReviewedEntity, type TriggerExtension, type TriggerGroupConfig, type TriggerRule, type TriggerStrategy, type TriggerValidation, type UnifiedResult, type UnifiedSearchInstance, ZONE_SCORE_ADJUSTMENTS, type ZoneSpan, applyHotwordRules, applyZoneAdjustments, boostNearMissEntities, buildDenyList, buildGazetteerPatterns, buildLegalFormPatterns, buildPlaceholderMap, buildStreetTypePatterns, buildTriggerPatterns, buildUnifiedSearch, chunkText, classifyZones, computeChunkOffsets, corefKey, createPipelineContext, deanonymise, decodeSpans, decodeTokenSpans, detectNameCorpus, ensureDenyListData, exportRedactionKey, extractDefinedTerms, filterFalsePositives, findCoreferenceSpans, getCurrencyPatterns, getDatePatterns, initHotwordRules, initNameCorpus, initZoneClassifier, levenshtein, mergeAndDedup, mergeChunkEntities, normalizeForSearch, prepareBatch, processAddressSeeds, processDenyListMatches, processGazetteerMatches, processLegalFormMatches, processRegexMatches, processTriggerMatches, propagateOrgNames, redactText, resolveCountries, resolveOperator, runPipeline, runUnifiedSearch, sanitizeEntities, tokenizeText };
1091
+ export { type AnonymisationOperator, CURRENCY_PATTERN_META, type CountryCode, type CustomDenyListEntry, type CustomRegexPattern, DATE_PATTERN_META, DEFAULT_ENTITY_LABELS, DEFAULT_OPERATOR_CONFIG, DETECTION_SOURCES, DETECTOR_PRIORITY, type DefinitionPattern, type DenyListCategory, type DenyListData, type DetectionSource, type Dictionaries, type DictionaryMeta, type DocumentZone, type Entity, type EntityResult, type GazetteerData, type GazetteerEntry, type HotwordRule, type NameCorpusData, type NerInferenceFn, OPERATOR_REGISTRY, OPERATOR_TYPES, type OperatorConfig, type OperatorType, type PipelineConfig, type PipelineContext, type PipelineOptions, REGEX_META, REGEX_PATTERNS, REGIONS, type RawInferenceResult, type RedactionResult, type RegexMeta, type RegionId, type ReviewDecision, type ReviewedEntity, type TriggerExtension, type TriggerGroupConfig, type TriggerRule, type TriggerStrategy, type TriggerValidation, type UnifiedResult, type UnifiedSearchInstance, ZONE_SCORE_ADJUSTMENTS, type ZoneSpan, applyHotwordRules, applyZoneAdjustments, boostNearMissEntities, buildDenyList, buildGazetteerPatterns, buildLegalFormPatterns, buildPlaceholderMap, buildStreetTypePatterns, buildTriggerPatterns, buildUnifiedSearch, chunkText, classifyZones, computeChunkOffsets, corefKey, createPipelineContext, deanonymise, decodeSpans, decodeTokenSpans, detectNameCorpus, ensureDenyListData, exportRedactionKey, extractDefinedTerms, filterFalsePositives, findCoreferenceSpans, getCurrencyPatterns, getDatePatterns, initAddressComponents, initHotwordRules, initNameCorpus, initZoneClassifier, levenshtein, mergeAndDedup, mergeChunkEntities, normalizeForSearch, prepareBatch, processAddressSeeds, processDenyListMatches, processGazetteerMatches, processLegalFormMatches, processRegexMatches, processTriggerMatches, propagateOrgNames, redactText, resolveCountries, resolveOperator, runPipeline, runUnifiedSearch, sanitizeEntities, tokenizeText, warmLegalRoleHeads };
1039
1092
  //# sourceMappingURL=index.d.mts.map