@helloao/tools 0.0.9 → 0.0.10

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (40) hide show
  1. package/dist/cjs/generation/api.cjs +126 -0
  2. package/dist/cjs/generation/api.cjs.map +2 -2
  3. package/dist/cjs/generation/common-types.cjs.map +1 -1
  4. package/dist/cjs/generation/dataset.cjs +159 -79
  5. package/dist/cjs/generation/dataset.cjs.map +2 -2
  6. package/dist/cjs/parser/codex-parser.cjs +77 -66
  7. package/dist/cjs/parser/codex-parser.cjs.map +2 -2
  8. package/dist/cjs/parser/commentary-csv-parser.cjs +133 -0
  9. package/dist/cjs/parser/commentary-csv-parser.cjs.map +7 -0
  10. package/dist/cjs/parser/index.cjs +3 -1
  11. package/dist/cjs/parser/index.cjs.map +2 -2
  12. package/dist/cjs/parser/types.cjs.map +1 -1
  13. package/dist/cjs/parser/usx-parser.cjs +13 -1
  14. package/dist/cjs/parser/usx-parser.cjs.map +2 -2
  15. package/dist/cjs/utils.cjs +155 -3
  16. package/dist/cjs/utils.cjs.map +3 -3
  17. package/dist/esm/generation/api.js +122 -0
  18. package/dist/esm/generation/api.js.map +2 -2
  19. package/dist/esm/generation/dataset.js +159 -79
  20. package/dist/esm/generation/dataset.js.map +2 -2
  21. package/dist/esm/parser/codex-parser.js +71 -64
  22. package/dist/esm/parser/codex-parser.js.map +2 -2
  23. package/dist/esm/parser/commentary-csv-parser.js +107 -0
  24. package/dist/esm/parser/commentary-csv-parser.js.map +7 -0
  25. package/dist/esm/parser/index.js +1 -0
  26. package/dist/esm/parser/index.js.map +2 -2
  27. package/dist/esm/parser/usx-parser.js +13 -1
  28. package/dist/esm/parser/usx-parser.js.map +2 -2
  29. package/dist/esm/utils.js +153 -3
  30. package/dist/esm/utils.js.map +3 -3
  31. package/dist/types/generation/api.d.ts +147 -1
  32. package/dist/types/generation/common-types.d.ts +121 -24
  33. package/dist/types/generation/dataset.d.ts +23 -1
  34. package/dist/types/parser/codex-parser.d.ts +50 -7
  35. package/dist/types/parser/commentary-csv-parser.d.ts +12 -0
  36. package/dist/types/parser/index.d.ts +1 -0
  37. package/dist/types/parser/types.d.ts +28 -1
  38. package/dist/types/parser/usx-parser.d.ts +1 -1
  39. package/dist/types/utils.d.ts +6 -0
  40. package/package.json +3 -2
@@ -27,14 +27,18 @@ var import_book_order = require("./book-order.js");
27
27
  var import_lodash = require("lodash");
28
28
  var import_audio = require("./audio.js");
29
29
  var import_codex_parser = require("../parser/codex-parser.js");
30
+ var import_commentary_csv_parser = require("../parser/commentary-csv-parser.js");
30
31
  function generateDataset(files, parser = new globalThis.DOMParser()) {
31
32
  let output = {
32
- translations: []
33
+ translations: [],
34
+ commentaries: []
33
35
  };
34
36
  let usfmParser = new import_usfm_parser.UsfmParser();
35
37
  let usxParser = new import_usx_parser.USXParser(parser);
36
38
  let codexParser = new import_codex_parser.CodexParser();
39
+ let csvCommentaryParser = new import_commentary_csv_parser.CommentaryCsvParser();
37
40
  let parsedTranslations = /* @__PURE__ */ new Map();
41
+ let parsedCommentaries = /* @__PURE__ */ new Map();
38
42
  const unknownLanguages = /* @__PURE__ */ new Set();
39
43
  for (let file of files) {
40
44
  try {
@@ -45,6 +49,8 @@ function generateDataset(files, parser = new globalThis.DOMParser()) {
45
49
  parser2 = usxParser;
46
50
  } else if (file.fileType === "json") {
47
51
  parser2 = codexParser;
52
+ } else if (file.fileType === "commentary/csv") {
53
+ parser2 = csvCommentaryParser;
48
54
  } else {
49
55
  console.warn(
50
56
  "[generate] File does not have a valid type!",
@@ -53,101 +59,175 @@ function generateDataset(files, parser = new globalThis.DOMParser()) {
53
59
  continue;
54
60
  }
55
61
  const parsed = parser2.parse(file.content);
56
- const id = parsed.id;
57
- if (!id) {
58
- console.warn(
59
- "[generate] File does not have a valid book ID!",
60
- file.name,
61
- id
62
- );
63
- continue;
64
- }
65
- const order = import_book_order.bookOrderMap.get(id);
66
- if (typeof order !== "number") {
67
- console.warn("[generate] Book does not have an order!", id);
68
- continue;
69
- }
70
- const bookMap = import_book_order.bookIdMap.get(file.metadata.translation.language);
71
- if (!bookMap) {
72
- if (!unknownLanguages.has(file.metadata.translation.language)) {
73
- console.warn(
74
- "[generate] File does not have a known language!",
75
- file.name,
76
- file.metadata.translation.language
77
- );
78
- unknownLanguages.add(file.metadata.translation.language);
79
- }
62
+ if (parsed.type === "root") {
63
+ addTranslationTree(file, parsed);
64
+ } else {
65
+ addCommentaryTree(file, parsed);
80
66
  }
81
- const bookName = bookMap?.get(id);
82
- if (!!bookMap && !bookName) {
67
+ } catch (err) {
68
+ console.error(
69
+ `[generate] Error occurred while parsing ${file.name}`,
70
+ err
71
+ );
72
+ }
73
+ }
74
+ function addTranslationTree(file, parsed) {
75
+ const id = parsed.id;
76
+ if (!id) {
77
+ console.warn(
78
+ "[generate] File does not have a valid book ID!",
79
+ file.name,
80
+ id
81
+ );
82
+ return;
83
+ }
84
+ const order = import_book_order.bookOrderMap.get(id);
85
+ if (typeof order !== "number") {
86
+ console.warn("[generate] Book does not have an order!", id);
87
+ return;
88
+ }
89
+ const bookMap = import_book_order.bookIdMap.get(file.metadata.language);
90
+ if (!bookMap) {
91
+ if (!unknownLanguages.has(file.metadata.language)) {
83
92
  console.warn(
84
- "[generate] Book name not found for ID!",
93
+ "[generate] File does not have a known language!",
85
94
  file.name,
86
- id
95
+ file.metadata.language
87
96
  );
97
+ unknownLanguages.add(file.metadata.language);
88
98
  }
89
- let translation = parsedTranslations.get(
90
- file.metadata.translation.id
99
+ }
100
+ const bookName = bookMap?.get(id);
101
+ if (!!bookMap && !bookName) {
102
+ console.warn(
103
+ "[generate] Book name not found for ID!",
104
+ file.name,
105
+ id
91
106
  );
92
- if (!translation) {
93
- translation = {
94
- ...(0, import_lodash.omit)(file.metadata.translation, "direction"),
95
- textDirection: file.metadata.translation.direction,
96
- books: []
97
- };
98
- output.translations.push(translation);
99
- parsedTranslations.set(
100
- file.metadata.translation.id,
101
- translation
102
- );
107
+ }
108
+ let translation = parsedTranslations.get(file.metadata.id);
109
+ if (!translation) {
110
+ translation = {
111
+ ...(0, import_lodash.omit)(file.metadata, "direction"),
112
+ textDirection: file.metadata.direction,
113
+ books: []
114
+ };
115
+ output.translations.push(translation);
116
+ parsedTranslations.set(file.metadata.id, translation);
117
+ }
118
+ const name = parsed.header ?? bookName?.commonName ?? parsed.title;
119
+ if (!name) {
120
+ console.warn(
121
+ "[generate] Book does not have a name!",
122
+ file.name,
123
+ id
124
+ );
125
+ return;
126
+ }
127
+ const commonName = bookName?.commonName ?? parsed.header ?? parsed.title ?? id;
128
+ const book = {
129
+ id,
130
+ name,
131
+ commonName,
132
+ title: parsed.title ?? null,
133
+ order,
134
+ chapters: []
135
+ };
136
+ for (let content of parsed.content) {
137
+ if (content.type === "chapter") {
138
+ book.chapters.push({
139
+ chapter: {
140
+ number: content.number,
141
+ content: content.content,
142
+ footnotes: content.footnotes
143
+ },
144
+ thisChapterAudioLinks: (0, import_audio.getAudioUrlsForChapter)(
145
+ translation.id,
146
+ id,
147
+ content.number
148
+ )
149
+ });
103
150
  }
104
- const name = parsed.header ?? bookName?.commonName ?? parsed.title;
105
- if (!name) {
151
+ }
152
+ book.chapters = (0, import_lodash.sortBy)(book.chapters, (c) => c.chapter.number);
153
+ const index = (0, import_lodash.sortedIndexBy)(translation.books, book, (b) => b.order);
154
+ translation.books.splice(index, 0, book);
155
+ }
156
+ function addCommentaryTree(file, parsed) {
157
+ let commentary = parsedCommentaries.get(file.metadata.id);
158
+ if (!commentary) {
159
+ commentary = {
160
+ ...(0, import_lodash.omit)(file.metadata, "direction"),
161
+ textDirection: file.metadata.direction,
162
+ books: []
163
+ };
164
+ output.commentaries.push(commentary);
165
+ parsedCommentaries.set(file.metadata.id, commentary);
166
+ }
167
+ for (let parsedBook of parsed.books) {
168
+ let book = commentary.books.find((b) => b.id === parsedBook.book);
169
+ if (book && book.introduction) {
106
170
  console.warn(
107
- "[generate] Book does not have a name!",
171
+ "[generate] Book already exists in commentary!",
108
172
  file.name,
109
- id
173
+ parsedBook.book
110
174
  );
111
175
  continue;
112
176
  }
113
- const commonName = bookName?.commonName ?? parsed.header ?? parsed.title ?? id;
114
- const book = {
115
- id,
116
- name,
117
- commonName,
118
- title: parsed.title ?? null,
119
- order,
120
- chapters: []
121
- };
122
- for (let content of parsed.content) {
123
- if (content.type === "chapter") {
124
- book.chapters.push({
125
- chapter: {
126
- number: content.number,
127
- content: content.content,
128
- footnotes: content.footnotes
129
- },
130
- thisChapterAudioLinks: (0, import_audio.getAudioUrlsForChapter)(
131
- translation.id,
132
- id,
133
- content.number
134
- )
135
- });
177
+ if (!book) {
178
+ const name = getBookNames(file, file.metadata, parsedBook.book);
179
+ book = {
180
+ id: parsedBook.book,
181
+ order: import_book_order.bookOrderMap.get(parsedBook.book) ?? -1,
182
+ commonName: name?.bookName?.commonName ?? parsedBook.book,
183
+ name: name?.bookName?.commonName ?? parsedBook.book,
184
+ chapters: []
185
+ };
186
+ }
187
+ if (parsedBook.introduction) {
188
+ book.introduction = parsedBook.introduction;
189
+ }
190
+ for (let chapter of parsedBook.chapters) {
191
+ let data = {
192
+ number: chapter.number,
193
+ content: chapter.verses
194
+ };
195
+ if (chapter.introduction) {
196
+ data.introduction = chapter.introduction;
136
197
  }
198
+ book.chapters.push({
199
+ chapter: data
200
+ });
137
201
  }
138
202
  book.chapters = (0, import_lodash.sortBy)(book.chapters, (c) => c.chapter.number);
139
- const index = (0, import_lodash.sortedIndexBy)(
140
- translation.books,
141
- book,
142
- (b) => b.order
143
- );
144
- translation.books.splice(index, 0, book);
145
- } catch (err) {
146
- console.error(
147
- `[generate] Error occurred while parsing ${file.name}`,
148
- err
203
+ commentary.books.push(book);
204
+ }
205
+ commentary.books = (0, import_lodash.sortBy)(commentary.books, (b) => b.order);
206
+ }
207
+ function getBookNames(file, metadata, id) {
208
+ const bookMap = import_book_order.bookIdMap.get(metadata.language);
209
+ if (!bookMap) {
210
+ if (!unknownLanguages.has(metadata.language)) {
211
+ console.warn(
212
+ "[generate] File does not have a known language!",
213
+ file.name,
214
+ metadata.language
215
+ );
216
+ unknownLanguages.add(metadata.language);
217
+ }
218
+ }
219
+ const bookName = bookMap?.get(id);
220
+ if (!!bookMap && !bookName) {
221
+ console.warn(
222
+ "[generate] Book name not found for ID!",
223
+ file.name,
224
+ id
149
225
  );
226
+ return null;
150
227
  }
228
+ return {
229
+ bookName
230
+ };
151
231
  }
152
232
  return output;
153
233
  }
@@ -1,7 +1,7 @@
1
1
  {
2
2
  "version": 3,
3
3
  "sources": ["../../../generation/dataset.ts"],
4
- "sourcesContent": ["import { UsfmParser } from '../parser/usfm-parser.js';\r\nimport { USXParser } from '../parser/usx-parser.js';\r\nimport {\r\n InputFile,\r\n Translation,\r\n TranslationBook,\r\n TranslationBookChapter,\r\n} from './common-types.js';\r\nimport { bookIdMap, bookOrderMap } from './book-order.js';\r\nimport { omit, sortBy, sortedIndexBy } from 'lodash';\r\nimport { getAudioUrlsForChapter } from './audio.js';\r\nimport { CodexParser } from '../parser/codex-parser.js';\r\n\r\n/**\r\n * Defines an interface that contains generated dataset info.\r\n */\r\nexport interface DatasetOutput {\r\n /**\r\n * The list of translations that are available in the dataset.\r\n */\r\n translations: DatasetTranslation[];\r\n}\r\n\r\n/**\r\n * Defines a translation that is used in the dataset.\r\n */\r\nexport interface DatasetTranslation extends Translation {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetTranslationBook[];\r\n}\r\n\r\n/**\r\n * Defines a translation book that is used in the dataset.\r\n */\r\nexport interface DatasetTranslationBook extends TranslationBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: TranslationBookChapter[];\r\n}\r\n\r\n/**\r\n * Generates a list of output files from the given list of input files.\r\n * @param file The list of files.\r\n */\r\nexport function generateDataset(\r\n files: InputFile[],\r\n parser: DOMParser = new globalThis.DOMParser()\r\n): DatasetOutput {\r\n let output: DatasetOutput = {\r\n translations: [],\r\n };\r\n\r\n let usfmParser = new UsfmParser();\r\n let usxParser = new USXParser(parser);\r\n let codexParser = new CodexParser();\r\n\r\n let parsedTranslations = new Map<string, DatasetTranslation>();\r\n\r\n const unknownLanguages = new Set<string>();\r\n for (let file of files) {\r\n try {\r\n let parser: UsfmParser | USXParser | CodexParser;\r\n if (file.fileType === 'usfm') {\r\n parser = usfmParser;\r\n } else if (file.fileType === 'usx') {\r\n parser = usxParser;\r\n } else if (file.fileType === 'json') {\r\n parser = codexParser;\r\n } else {\r\n console.warn(\r\n '[generate] File does not have a valid type!',\r\n file.name\r\n );\r\n continue;\r\n }\r\n\r\n const parsed = parser.parse(file.content);\r\n const id = parsed.id;\r\n\r\n if (!id) {\r\n console.warn(\r\n '[generate] File does not have a valid book ID!',\r\n file.name,\r\n id\r\n );\r\n continue;\r\n }\r\n\r\n const order = bookOrderMap.get(id);\r\n\r\n if (typeof order !== 'number') {\r\n console.warn('[generate] Book does not have an order!', id);\r\n continue;\r\n }\r\n\r\n const bookMap = bookIdMap.get(file.metadata.translation.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(file.metadata.translation.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n file.metadata.translation.language\r\n );\r\n unknownLanguages.add(file.metadata.translation.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n }\r\n\r\n let translation = parsedTranslations.get(\r\n file.metadata.translation.id\r\n );\r\n\r\n if (!translation) {\r\n translation = {\r\n ...omit(file.metadata.translation, 'direction'),\r\n textDirection: file.metadata.translation.direction,\r\n books: [],\r\n };\r\n output.translations.push(translation);\r\n parsedTranslations.set(\r\n file.metadata.translation.id,\r\n translation\r\n );\r\n }\r\n\r\n const name = parsed.header ?? bookName?.commonName ?? parsed.title;\r\n\r\n if (!name) {\r\n console.warn(\r\n '[generate] Book does not have a name!',\r\n file.name,\r\n id\r\n );\r\n continue;\r\n }\r\n\r\n const commonName =\r\n bookName?.commonName ?? parsed.header ?? parsed.title ?? id;\r\n\r\n const book: DatasetTranslationBook = {\r\n id: id,\r\n name,\r\n commonName,\r\n title: parsed.title ?? null,\r\n order,\r\n chapters: [],\r\n };\r\n\r\n for (let content of parsed.content) {\r\n if (content.type === 'chapter') {\r\n book.chapters.push({\r\n chapter: {\r\n number: content.number,\r\n content: content.content,\r\n footnotes: content.footnotes,\r\n },\r\n thisChapterAudioLinks: getAudioUrlsForChapter(\r\n translation.id,\r\n id,\r\n content.number\r\n ),\r\n });\r\n }\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n\r\n const index = sortedIndexBy(\r\n translation.books,\r\n book,\r\n (b) => b.order\r\n );\r\n translation.books.splice(index, 0, book);\r\n } catch (err) {\r\n console.error(\r\n `[generate] Error occurred while parsing ${file.name}`,\r\n err\r\n );\r\n }\r\n }\r\n\r\n return output;\r\n}\r\n"],
5
- "mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,yBAA2B;AAC3B,wBAA0B;AAO1B,wBAAwC;AACxC,oBAA4C;AAC5C,mBAAuC;AACvC,0BAA4B;AAoCrB,SAAS,gBACZ,OACA,SAAoB,IAAI,WAAW,UAAU,GAChC;AACb,MAAI,SAAwB;AAAA,IACxB,cAAc,CAAC;AAAA,EACnB;AAEA,MAAI,aAAa,IAAI,8BAAW;AAChC,MAAI,YAAY,IAAI,4BAAU,MAAM;AACpC,MAAI,cAAc,IAAI,gCAAY;AAElC,MAAI,qBAAqB,oBAAI,IAAgC;AAE7D,QAAM,mBAAmB,oBAAI,IAAY;AACzC,WAAS,QAAQ,OAAO;AACpB,QAAI;AACA,UAAIA;AACJ,UAAI,KAAK,aAAa,QAAQ;AAC1B,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,OAAO;AAChC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,QAAQ;AACjC,QAAAA,UAAS;AAAA,MACb,OAAO;AACH,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,QACT;AACA;AAAA,MACJ;AAEA,YAAM,SAASA,QAAO,MAAM,KAAK,OAAO;AACxC,YAAM,KAAK,OAAO;AAElB,UAAI,CAAC,IAAI;AACL,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL;AAAA,QACJ;AACA;AAAA,MACJ;AAEA,YAAM,QAAQ,+BAAa,IAAI,EAAE;AAEjC,UAAI,OAAO,UAAU,UAAU;AAC3B,gBAAQ,KAAK,2CAA2C,EAAE;AAC1D;AAAA,MACJ;AAEA,YAAM,UAAU,4BAAU,IAAI,KAAK,SAAS,YAAY,QAAQ;AAEhE,UAAI,CAAC,SAAS;AACV,YAAI,CAAC,iBAAiB,IAAI,KAAK,SAAS,YAAY,QAAQ,GAAG;AAC3D,kBAAQ;AAAA,YACJ;AAAA,YACA,KAAK;AAAA,YACL,KAAK,SAAS,YAAY;AAAA,UAC9B;AACA,2BAAiB,IAAI,KAAK,SAAS,YAAY,QAAQ;AAAA,QAC3D;AAAA,MACJ;AAEA,YAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,UAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL;AAAA,QACJ;AAAA,MACJ;AAEA,UAAI,cAAc,mBAAmB;AAAA,QACjC,KAAK,SAAS,YAAY;AAAA,MAC9B;AAEA,UAAI,CAAC,aAAa;AACd,sBAAc;AAAA,UACV,OAAG,oBAAK,KAAK,SAAS,aAAa,WAAW;AAAA,UAC9C,eAAe,KAAK,SAAS,YAAY;AAAA,UACzC,OAAO,CAAC;AAAA,QACZ;AACA,eAAO,aAAa,KAAK,WAAW;AACpC,2BAAmB;AAAA,UACf,KAAK,SAAS,YAAY;AAAA,UAC1B;AAAA,QACJ;AAAA,MACJ;AAEA,YAAM,OAAO,OAAO,UAAU,UAAU,cAAc,OAAO;AAE7D,UAAI,CAAC,MAAM;AACP,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL;AAAA,QACJ;AACA;AAAA,MACJ;AAEA,YAAM,aACF,UAAU,cAAc,OAAO,UAAU,OAAO,SAAS;AAE7D,YAAM,OAA+B;AAAA,QACjC;AAAA,QACA;AAAA,QACA;AAAA,QACA,OAAO,OAAO,SAAS;AAAA,QACvB;AAAA,QACA,UAAU,CAAC;AAAA,MACf;AAEA,eAAS,WAAW,OAAO,SAAS;AAChC,YAAI,QAAQ,SAAS,WAAW;AAC5B,eAAK,SAAS,KAAK;AAAA,YACf,SAAS;AAAA,cACL,QAAQ,QAAQ;AAAA,cAChB,SAAS,QAAQ;AAAA,cACjB,WAAW,QAAQ;AAAA,YACvB;AAAA,YACA,2BAAuB;AAAA,cACnB,YAAY;AAAA,cACZ;AAAA,cACA,QAAQ;AAAA,YACZ;AAAA,UACJ,CAAC;AAAA,QACL;AAAA,MACJ;AAEA,WAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAE7D,YAAM,YAAQ;AAAA,QACV,YAAY;AAAA,QACZ;AAAA,QACA,CAAC,MAAM,EAAE;AAAA,MACb;AACA,kBAAY,MAAM,OAAO,OAAO,GAAG,IAAI;AAAA,IAC3C,SAAS,KAAK;AACV,cAAQ;AAAA,QACJ,2CAA2C,KAAK,IAAI;AAAA,QACpD;AAAA,MACJ;AAAA,IACJ;AAAA,EACJ;AAEA,SAAO;AACX;",
4
+ "sourcesContent": ["import { UsfmParser } from '../parser/usfm-parser.js';\r\nimport { USXParser } from '../parser/usx-parser.js';\r\nimport {\r\n Commentary,\r\n CommentaryBook,\r\n CommentaryBookChapter,\r\n CommentaryChapterData,\r\n InputCommentaryFile,\r\n InputFile,\r\n InputFileBase,\r\n InputTranslationFile,\r\n MetadataBase,\r\n Translation,\r\n TranslationBook,\r\n TranslationBookChapter,\r\n} from './common-types.js';\r\nimport { bookIdMap, bookOrderMap } from './book-order.js';\r\nimport { omit, sortBy, sortedIndexBy } from 'lodash';\r\nimport { getAudioUrlsForChapter } from './audio.js';\r\nimport { CodexParser } from '../parser/codex-parser.js';\r\nimport { CommentaryCsvParser } from '../parser/commentary-csv-parser.js';\r\nimport { CommentaryParseTree, ParseTree } from '../parser/types.js';\r\n\r\n/**\r\n * Defines an interface that contains generated dataset info.\r\n */\r\nexport interface DatasetOutput {\r\n /**\r\n * The list of translations that are available in the dataset.\r\n */\r\n translations: DatasetTranslation[];\r\n\r\n /**\r\n * The list of commentaries that are available in the dataset.\r\n */\r\n commentaries: DatasetCommentary[];\r\n}\r\n\r\n/**\r\n * Defines a translation that is used in the dataset.\r\n */\r\nexport interface DatasetTranslation extends Translation {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetTranslationBook[];\r\n}\r\n\r\n/**\r\n * Defines a commentary that is used in the dataset.\r\n */\r\nexport interface DatasetCommentary extends Commentary {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetCommentaryBook[];\r\n}\r\n\r\n/**\r\n * Defines a translation book that is used in the dataset.\r\n */\r\nexport interface DatasetTranslationBook extends TranslationBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: TranslationBookChapter[];\r\n}\r\n\r\n/**\r\n * Defines a commentary book that is used in the dataset.\r\n */\r\nexport interface DatasetCommentaryBook extends CommentaryBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: CommentaryBookChapter[];\r\n}\r\n\r\n/**\r\n * Generates a list of output files from the given list of input files.\r\n * @param file The list of files.\r\n */\r\nexport function generateDataset(\r\n files: InputFile[],\r\n parser: DOMParser = new globalThis.DOMParser()\r\n): DatasetOutput {\r\n let output: DatasetOutput = {\r\n translations: [],\r\n commentaries: [],\r\n };\r\n\r\n let usfmParser = new UsfmParser();\r\n let usxParser = new USXParser(parser);\r\n let codexParser = new CodexParser();\r\n let csvCommentaryParser = new CommentaryCsvParser();\r\n\r\n let parsedTranslations = new Map<string, DatasetTranslation>();\r\n let parsedCommentaries = new Map<string, DatasetCommentary>();\r\n\r\n const unknownLanguages = new Set<string>();\r\n for (let file of files) {\r\n try {\r\n let parser:\r\n | UsfmParser\r\n | USXParser\r\n | CodexParser\r\n | CommentaryCsvParser;\r\n if (file.fileType === 'usfm') {\r\n parser = usfmParser;\r\n } else if (file.fileType === 'usx') {\r\n parser = usxParser;\r\n } else if (file.fileType === 'json') {\r\n parser = codexParser;\r\n } else if (file.fileType === 'commentary/csv') {\r\n parser = csvCommentaryParser;\r\n } else {\r\n console.warn(\r\n '[generate] File does not have a valid type!',\r\n file.name\r\n );\r\n continue;\r\n }\r\n\r\n const parsed = parser.parse(file.content);\r\n\r\n if (parsed.type === 'root') {\r\n addTranslationTree(file as InputTranslationFile, parsed);\r\n } else {\r\n addCommentaryTree(file as InputCommentaryFile, parsed);\r\n }\r\n } catch (err) {\r\n console.error(\r\n `[generate] Error occurred while parsing ${file.name}`,\r\n err\r\n );\r\n }\r\n }\r\n\r\n function addTranslationTree(file: InputTranslationFile, parsed: ParseTree) {\r\n const id = parsed.id;\r\n\r\n if (!id) {\r\n console.warn(\r\n '[generate] File does not have a valid book ID!',\r\n file.name,\r\n id\r\n );\r\n return;\r\n }\r\n\r\n const order = bookOrderMap.get(id);\r\n\r\n if (typeof order !== 'number') {\r\n console.warn('[generate] Book does not have an order!', id);\r\n return;\r\n }\r\n\r\n const bookMap = bookIdMap.get(file.metadata.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(file.metadata.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n file.metadata.language\r\n );\r\n unknownLanguages.add(file.metadata.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n }\r\n\r\n let translation = parsedTranslations.get(file.metadata.id);\r\n\r\n if (!translation) {\r\n translation = {\r\n ...omit(file.metadata, 'direction'),\r\n textDirection: file.metadata.direction,\r\n books: [],\r\n };\r\n output.translations.push(translation);\r\n parsedTranslations.set(file.metadata.id, translation);\r\n }\r\n\r\n const name = parsed.header ?? bookName?.commonName ?? parsed.title;\r\n\r\n if (!name) {\r\n console.warn(\r\n '[generate] Book does not have a name!',\r\n file.name,\r\n id\r\n );\r\n return;\r\n }\r\n\r\n const commonName =\r\n bookName?.commonName ?? parsed.header ?? parsed.title ?? id;\r\n\r\n const book: DatasetTranslationBook = {\r\n id: id,\r\n name,\r\n commonName,\r\n title: parsed.title ?? null,\r\n order,\r\n chapters: [],\r\n };\r\n\r\n for (let content of parsed.content) {\r\n if (content.type === 'chapter') {\r\n book.chapters.push({\r\n chapter: {\r\n number: content.number,\r\n content: content.content,\r\n footnotes: content.footnotes,\r\n },\r\n thisChapterAudioLinks: getAudioUrlsForChapter(\r\n translation.id,\r\n id,\r\n content.number\r\n ),\r\n });\r\n }\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n\r\n const index = sortedIndexBy(translation.books, book, (b) => b.order);\r\n translation.books.splice(index, 0, book);\r\n }\r\n\r\n function addCommentaryTree(\r\n file: InputCommentaryFile,\r\n parsed: CommentaryParseTree\r\n ) {\r\n let commentary = parsedCommentaries.get(file.metadata.id);\r\n\r\n if (!commentary) {\r\n commentary = {\r\n ...omit(file.metadata, 'direction'),\r\n textDirection: file.metadata.direction,\r\n books: [],\r\n };\r\n output.commentaries.push(commentary);\r\n parsedCommentaries.set(file.metadata.id, commentary);\r\n }\r\n\r\n for (let parsedBook of parsed.books) {\r\n let book = commentary.books.find((b) => b.id === parsedBook.book);\r\n if (book && book.introduction) {\r\n console.warn(\r\n '[generate] Book already exists in commentary!',\r\n file.name,\r\n parsedBook.book\r\n );\r\n continue;\r\n }\r\n\r\n if (!book) {\r\n const name = getBookNames(file, file.metadata, parsedBook.book);\r\n book = {\r\n id: parsedBook.book,\r\n order: bookOrderMap.get(parsedBook.book) ?? -1,\r\n commonName: name?.bookName?.commonName ?? parsedBook.book,\r\n name: name?.bookName?.commonName ?? parsedBook.book,\r\n chapters: [],\r\n };\r\n }\r\n\r\n if (parsedBook.introduction) {\r\n book.introduction = parsedBook.introduction;\r\n }\r\n\r\n for (let chapter of parsedBook.chapters) {\r\n let data: CommentaryChapterData = {\r\n number: chapter.number,\r\n content: chapter.verses,\r\n };\r\n\r\n if (chapter.introduction) {\r\n data.introduction = chapter.introduction;\r\n }\r\n\r\n book.chapters.push({\r\n chapter: data,\r\n });\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n commentary.books.push(book);\r\n }\r\n\r\n commentary.books = sortBy(commentary.books, (b) => b.order);\r\n }\r\n\r\n function getBookNames(\r\n file: InputFileBase,\r\n metadata: MetadataBase,\r\n id: string\r\n ) {\r\n const bookMap = bookIdMap.get(metadata.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(metadata.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n metadata.language\r\n );\r\n unknownLanguages.add(metadata.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n return null;\r\n }\r\n\r\n return {\r\n bookName,\r\n };\r\n }\r\n\r\n return output;\r\n}\r\n"],
5
+ "mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,yBAA2B;AAC3B,wBAA0B;AAe1B,wBAAwC;AACxC,oBAA4C;AAC5C,mBAAuC;AACvC,0BAA4B;AAC5B,mCAAoC;AA8D7B,SAAS,gBACZ,OACA,SAAoB,IAAI,WAAW,UAAU,GAChC;AACb,MAAI,SAAwB;AAAA,IACxB,cAAc,CAAC;AAAA,IACf,cAAc,CAAC;AAAA,EACnB;AAEA,MAAI,aAAa,IAAI,8BAAW;AAChC,MAAI,YAAY,IAAI,4BAAU,MAAM;AACpC,MAAI,cAAc,IAAI,gCAAY;AAClC,MAAI,sBAAsB,IAAI,iDAAoB;AAElD,MAAI,qBAAqB,oBAAI,IAAgC;AAC7D,MAAI,qBAAqB,oBAAI,IAA+B;AAE5D,QAAM,mBAAmB,oBAAI,IAAY;AACzC,WAAS,QAAQ,OAAO;AACpB,QAAI;AACA,UAAIA;AAKJ,UAAI,KAAK,aAAa,QAAQ;AAC1B,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,OAAO;AAChC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,QAAQ;AACjC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,kBAAkB;AAC3C,QAAAA,UAAS;AAAA,MACb,OAAO;AACH,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,QACT;AACA;AAAA,MACJ;AAEA,YAAM,SAASA,QAAO,MAAM,KAAK,OAAO;AAExC,UAAI,OAAO,SAAS,QAAQ;AACxB,2BAAmB,MAA8B,MAAM;AAAA,MAC3D,OAAO;AACH,0BAAkB,MAA6B,MAAM;AAAA,MACzD;AAAA,IACJ,SAAS,KAAK;AACV,cAAQ;AAAA,QACJ,2CAA2C,KAAK,IAAI;AAAA,QACpD;AAAA,MACJ;AAAA,IACJ;AAAA,EACJ;AAEA,WAAS,mBAAmB,MAA4B,QAAmB;AACvE,UAAM,KAAK,OAAO;AAElB,QAAI,CAAC,IAAI;AACL,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA;AAAA,IACJ;AAEA,UAAM,QAAQ,+BAAa,IAAI,EAAE;AAEjC,QAAI,OAAO,UAAU,UAAU;AAC3B,cAAQ,KAAK,2CAA2C,EAAE;AAC1D;AAAA,IACJ;AAEA,UAAM,UAAU,4BAAU,IAAI,KAAK,SAAS,QAAQ;AAEpD,QAAI,CAAC,SAAS;AACV,UAAI,CAAC,iBAAiB,IAAI,KAAK,SAAS,QAAQ,GAAG;AAC/C,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,KAAK,SAAS;AAAA,QAClB;AACA,yBAAiB,IAAI,KAAK,SAAS,QAAQ;AAAA,MAC/C;AAAA,IACJ;AAEA,UAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,QAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AAAA,IACJ;AAEA,QAAI,cAAc,mBAAmB,IAAI,KAAK,SAAS,EAAE;AAEzD,QAAI,CAAC,aAAa;AACd,oBAAc;AAAA,QACV,OAAG,oBAAK,KAAK,UAAU,WAAW;AAAA,QAClC,eAAe,KAAK,SAAS;AAAA,QAC7B,OAAO,CAAC;AAAA,MACZ;AACA,aAAO,aAAa,KAAK,WAAW;AACpC,yBAAmB,IAAI,KAAK,SAAS,IAAI,WAAW;AAAA,IACxD;AAEA,UAAM,OAAO,OAAO,UAAU,UAAU,cAAc,OAAO;AAE7D,QAAI,CAAC,MAAM;AACP,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA;AAAA,IACJ;AAEA,UAAM,aACF,UAAU,cAAc,OAAO,UAAU,OAAO,SAAS;AAE7D,UAAM,OAA+B;AAAA,MACjC;AAAA,MACA;AAAA,MACA;AAAA,MACA,OAAO,OAAO,SAAS;AAAA,MACvB;AAAA,MACA,UAAU,CAAC;AAAA,IACf;AAEA,aAAS,WAAW,OAAO,SAAS;AAChC,UAAI,QAAQ,SAAS,WAAW;AAC5B,aAAK,SAAS,KAAK;AAAA,UACf,SAAS;AAAA,YACL,QAAQ,QAAQ;AAAA,YAChB,SAAS,QAAQ;AAAA,YACjB,WAAW,QAAQ;AAAA,UACvB;AAAA,UACA,2BAAuB;AAAA,YACnB,YAAY;AAAA,YACZ;AAAA,YACA,QAAQ;AAAA,UACZ;AAAA,QACJ,CAAC;AAAA,MACL;AAAA,IACJ;AAEA,SAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAE7D,UAAM,YAAQ,6BAAc,YAAY,OAAO,MAAM,CAAC,MAAM,EAAE,KAAK;AACnE,gBAAY,MAAM,OAAO,OAAO,GAAG,IAAI;AAAA,EAC3C;AAEA,WAAS,kBACL,MACA,QACF;AACE,QAAI,aAAa,mBAAmB,IAAI,KAAK,SAAS,EAAE;AAExD,QAAI,CAAC,YAAY;AACb,mBAAa;AAAA,QACT,OAAG,oBAAK,KAAK,UAAU,WAAW;AAAA,QAClC,eAAe,KAAK,SAAS;AAAA,QAC7B,OAAO,CAAC;AAAA,MACZ;AACA,aAAO,aAAa,KAAK,UAAU;AACnC,yBAAmB,IAAI,KAAK,SAAS,IAAI,UAAU;AAAA,IACvD;AAEA,aAAS,cAAc,OAAO,OAAO;AACjC,UAAI,OAAO,WAAW,MAAM,KAAK,CAAC,MAAM,EAAE,OAAO,WAAW,IAAI;AAChE,UAAI,QAAQ,KAAK,cAAc;AAC3B,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,WAAW;AAAA,QACf;AACA;AAAA,MACJ;AAEA,UAAI,CAAC,MAAM;AACP,cAAM,OAAO,aAAa,MAAM,KAAK,UAAU,WAAW,IAAI;AAC9D,eAAO;AAAA,UACH,IAAI,WAAW;AAAA,UACf,OAAO,+BAAa,IAAI,WAAW,IAAI,KAAK;AAAA,UAC5C,YAAY,MAAM,UAAU,cAAc,WAAW;AAAA,UACrD,MAAM,MAAM,UAAU,cAAc,WAAW;AAAA,UAC/C,UAAU,CAAC;AAAA,QACf;AAAA,MACJ;AAEA,UAAI,WAAW,cAAc;AACzB,aAAK,eAAe,WAAW;AAAA,MACnC;AAEA,eAAS,WAAW,WAAW,UAAU;AACrC,YAAI,OAA8B;AAAA,UAC9B,QAAQ,QAAQ;AAAA,UAChB,SAAS,QAAQ;AAAA,QACrB;AAEA,YAAI,QAAQ,cAAc;AACtB,eAAK,eAAe,QAAQ;AAAA,QAChC;AAEA,aAAK,SAAS,KAAK;AAAA,UACf,SAAS;AAAA,QACb,CAAC;AAAA,MACL;AAEA,WAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAC7D,iBAAW,MAAM,KAAK,IAAI;AAAA,IAC9B;AAEA,eAAW,YAAQ,sBAAO,WAAW,OAAO,CAAC,MAAM,EAAE,KAAK;AAAA,EAC9D;AAEA,WAAS,aACL,MACA,UACA,IACF;AACE,UAAM,UAAU,4BAAU,IAAI,SAAS,QAAQ;AAE/C,QAAI,CAAC,SAAS;AACV,UAAI,CAAC,iBAAiB,IAAI,SAAS,QAAQ,GAAG;AAC1C,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,SAAS;AAAA,QACb;AACA,yBAAiB,IAAI,SAAS,QAAQ;AAAA,MAC1C;AAAA,IACJ;AAEA,UAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,QAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA,aAAO;AAAA,IACX;AAEA,WAAO;AAAA,MACH;AAAA,IACJ;AAAA,EACJ;AAEA,SAAO;AACX;",
6
6
  "names": ["parser"]
7
7
  }
@@ -21,7 +21,9 @@ __export(codex_parser_exports, {
21
21
  CodexParser: () => CodexParser,
22
22
  chapterHeadingSchema: () => chapterHeadingSchema,
23
23
  codexSchema: () => codexSchema,
24
- metadataSchema: () => metadataSchema
24
+ metadataSchema: () => metadataSchema,
25
+ paratextSchema: () => paratextSchema,
26
+ verseSchema: () => verseSchema
25
27
  });
26
28
  module.exports = __toCommonJS(codex_parser_exports);
27
29
  var import_zod = require("zod");
@@ -32,14 +34,24 @@ const chapterHeadingSchema = import_zod.z.object({
32
34
  chapter: import_zod.z.coerce.number().int()
33
35
  })
34
36
  });
37
+ const verseSchema = import_zod.z.object({
38
+ type: import_zod.z.literal("text"),
39
+ id: import_zod.z.string()
40
+ });
41
+ const paratextSchema = import_zod.z.object({
42
+ type: import_zod.z.literal("paratext"),
43
+ id: import_zod.z.string()
44
+ });
35
45
  const metadataSchema = import_zod.z.discriminatedUnion("type", [
36
- chapterHeadingSchema
46
+ chapterHeadingSchema,
47
+ verseSchema,
48
+ paratextSchema
37
49
  ]);
38
50
  const codexSchema = import_zod.z.object({
39
51
  cells: import_zod.z.array(
40
52
  import_zod.z.object({
41
- // kind: z.number().int(),
42
- language: import_zod.z.string(),
53
+ kind: import_zod.z.number(),
54
+ languageId: import_zod.z.string(),
43
55
  value: import_zod.z.string(),
44
56
  metadata: import_zod.z.object({
45
57
  type: import_zod.z.string()
@@ -55,9 +67,9 @@ class CodexParser {
55
67
  // preserveMarkdown: boolean = true;
56
68
  _noteCounter = 0;
57
69
  /**
58
- * Parses the specified USX content.
70
+ * Parses the specified codex content.
59
71
  *
60
- * @param usx The USX content to parse.
72
+ * @param codex The codex content to parse.
61
73
  * @returns The parse tree that was generated.
62
74
  */
63
75
  parse(codex) {
@@ -92,70 +104,67 @@ class CodexParser {
92
104
  }
93
105
  ]);
94
106
  }
107
+ function stripHTML(value) {
108
+ return value.replace(/<[^>]*>/g, "");
109
+ }
110
+ function toHeading(content) {
111
+ return {
112
+ type: "heading",
113
+ content: [content]
114
+ };
115
+ }
95
116
  for (let cell of data.cells) {
96
- if (cell.language === "scripture") {
97
- const lines = cell.value.split("\n");
98
- const references = lines.map(
99
- (l) => (0, import_utils.parseVerseReference)(l) ?? l
100
- );
101
- let currentRef = null;
102
- let content = [];
103
- for (let i = 0; i < references.length; i++) {
104
- const ref = references[i];
105
- const nextRef = references[i + 1];
106
- if (typeof ref === "string") {
107
- if (ref === "") {
108
- if (typeof nextRef === "object") {
109
- if (currentRef && currentRef.chapter === nextRef.chapter) {
110
- addChapterContent(currentRef.chapter, [
111
- {
112
- type: "line_break"
113
- }
114
- ]);
115
- } else {
116
- }
117
- } else {
118
- content.push({
117
+ if (cell.languageId === "html") {
118
+ if (!cell.metadata) continue;
119
+ const metadata = metadataSchema.parse(cell.metadata);
120
+ if (metadata.type === "text") {
121
+ const reference = (0, import_utils.parseVerseReference)(metadata.id);
122
+ if (!reference)
123
+ throw new Error("Could not find verse reference.");
124
+ if (!root.id) root.id = reference.book;
125
+ const content = stripHTML(cell.value);
126
+ const lines = content.split("\n").reduce((prev, current) => {
127
+ if (prev.length === 0) return [current];
128
+ else
129
+ return [
130
+ ...prev,
131
+ {
119
132
  lineBreak: true
133
+ },
134
+ current
135
+ ];
136
+ }, []);
137
+ addReference(reference, lines);
138
+ } else if (metadata.type === "paratext") {
139
+ const reference = (0, import_utils.parseVerseReference)(`${metadata.id}:1`);
140
+ if (reference) {
141
+ const content = stripHTML(cell.value);
142
+ const lines = content.split("\n").reduce((prev, current) => {
143
+ if (prev.length === 0)
144
+ return [toHeading(current)];
145
+ else
146
+ return [
147
+ ...prev,
148
+ {
149
+ type: "line_break"
150
+ },
151
+ toHeading(current)
152
+ ];
153
+ }, []);
154
+ lines.forEach(
155
+ (line) => addChapterContent(reference.chapter, [line])
156
+ );
157
+ } else {
158
+ const content = stripHTML(cell.value);
159
+ if (!cell.metadata) {
160
+ if (lastChapter) {
161
+ lastChapter.footnotes.push({
162
+ noteId: this._noteCounter++,
163
+ text: content,
164
+ caller: null
120
165
  });
121
166
  }
122
- } else if (ref) {
123
- content.push(ref);
124
- }
125
- } else {
126
- if (!root.id) {
127
- root.id = ref.book;
128
- }
129
- if (currentRef) {
130
- currentRef = null;
131
- content = [];
132
167
  }
133
- currentRef = ref;
134
- if (ref.content) {
135
- content.push(ref.content);
136
- }
137
- addReference(ref, content);
138
- }
139
- }
140
- } else if (cell.language === "markdown") {
141
- if (cell.metadata) {
142
- if (cell.metadata.type === "chapter-heading") {
143
- const metadata = metadataSchema.parse(cell.metadata);
144
- const chapter = metadata.data.chapter;
145
- addChapterContent(chapter, [
146
- {
147
- type: "heading",
148
- content: [cell.value]
149
- }
150
- ]);
151
- }
152
- } else {
153
- if (lastChapter) {
154
- lastChapter.footnotes.push({
155
- noteId: this._noteCounter++,
156
- text: cell.value,
157
- caller: null
158
- });
159
168
  }
160
169
  }
161
170
  }
@@ -171,6 +180,8 @@ class CodexParser {
171
180
  CodexParser,
172
181
  chapterHeadingSchema,
173
182
  codexSchema,
174
- metadataSchema
183
+ metadataSchema,
184
+ paratextSchema,
185
+ verseSchema
175
186
  });
176
187
  //# sourceMappingURL=codex-parser.cjs.map
@@ -1,7 +1,7 @@
1
1
  {
2
2
  "version": 3,
3
3
  "sources": ["../../../parser/codex-parser.ts"],
4
- "sourcesContent": ["import { z } from 'zod';\r\nimport {\r\n Chapter,\r\n ChapterContent,\r\n ParseTree,\r\n Verse,\r\n VerseContent,\r\n} from './types.js';\r\nimport { parseVerseReference, VerseRef } from '../utils.js';\r\n\r\nexport const chapterHeadingSchema = z.object({\r\n type: z.literal('chapter-heading'),\r\n data: z.object({\r\n chapter: z.coerce.number().int(),\r\n }),\r\n});\r\n\r\nexport const metadataSchema = z.discriminatedUnion('type', [\r\n chapterHeadingSchema,\r\n]);\r\n\r\nexport const codexSchema = z.object({\r\n cells: z.array(\r\n z.object({\r\n // kind: z.number().int(),\r\n language: z.string(),\r\n value: z.string(),\r\n metadata: z\r\n .object({\r\n type: z.string(),\r\n })\r\n .passthrough()\r\n .nullable()\r\n .optional(),\r\n })\r\n ),\r\n});\r\n\r\n/**\r\n * Defines a parser for codex files.\r\n */\r\nexport class CodexParser {\r\n // TODO:\r\n // /**\r\n // * Whether to preserve markdown in the parsed content.\r\n // */\r\n // preserveMarkdown: boolean = true;\r\n\r\n private _noteCounter: number = 0;\r\n\r\n /**\r\n * Parses the specified USX content.\r\n *\r\n * @param usx The USX content to parse.\r\n * @returns The parse tree that was generated.\r\n */\r\n public parse(codex: string): ParseTree {\r\n const json = JSON.parse(codex);\r\n const data = codexSchema.parse(json);\r\n\r\n let root: ParseTree = {\r\n type: 'root',\r\n content: [],\r\n };\r\n\r\n let chapters: Map<number, Chapter> = new Map();\r\n let lastChapter: Chapter | null = null;\r\n\r\n function addChapterContent(\r\n chapterNumber: number,\r\n content: ChapterContent[]\r\n ) {\r\n let chapter = chapters.get(chapterNumber);\r\n if (!chapter) {\r\n chapter = {\r\n type: 'chapter',\r\n number: chapterNumber,\r\n content: [],\r\n footnotes: [],\r\n };\r\n lastChapter = chapter;\r\n chapters.set(chapterNumber, chapter);\r\n }\r\n\r\n chapter.content.push(...content);\r\n }\r\n\r\n function addReference(ref: VerseRef, content: Verse['content']) {\r\n addChapterContent(ref.chapter, [\r\n {\r\n type: 'verse',\r\n number: ref.verse,\r\n content: content,\r\n },\r\n ]);\r\n }\r\n\r\n for (let cell of data.cells) {\r\n if (cell.language === 'scripture') {\r\n const lines = cell.value.split('\\n');\r\n const references = lines.map(\r\n (l) => parseVerseReference(l) ?? l\r\n );\r\n let currentRef: VerseRef | null = null;\r\n let content: Verse['content'] = [];\r\n for (let i = 0; i < references.length; i++) {\r\n const ref = references[i];\r\n const nextRef = references[i + 1];\r\n\r\n if (typeof ref === 'string') {\r\n // continuation on existing verse\r\n // or line break between verses\r\n\r\n if (ref === '') {\r\n // line break\r\n\r\n if (typeof nextRef === 'object') {\r\n // between verses\r\n\r\n if (\r\n currentRef &&\r\n currentRef.chapter === nextRef.chapter\r\n ) {\r\n // in same chapter\r\n addChapterContent(currentRef.chapter, [\r\n {\r\n type: 'line_break',\r\n },\r\n ]);\r\n } else {\r\n // do nothing since line breaks between chapters are ignored\r\n }\r\n } else {\r\n // inside verse\r\n content.push({\r\n lineBreak: true,\r\n });\r\n }\r\n } else if (ref) {\r\n content.push(ref);\r\n }\r\n } else {\r\n if (!root.id) {\r\n root.id = ref.book;\r\n }\r\n\r\n // new verse\r\n if (currentRef) {\r\n // finish previous verse\r\n currentRef = null;\r\n content = [];\r\n }\r\n\r\n currentRef = ref;\r\n\r\n if (ref.content) {\r\n content.push(ref.content);\r\n }\r\n\r\n addReference(ref, content);\r\n }\r\n }\r\n } else if (cell.language === 'markdown') {\r\n if (cell.metadata) {\r\n if (cell.metadata.type === 'chapter-heading') {\r\n const metadata = metadataSchema.parse(cell.metadata);\r\n\r\n const chapter = metadata.data.chapter;\r\n addChapterContent(chapter, [\r\n {\r\n type: 'heading',\r\n content: [cell.value],\r\n },\r\n ]);\r\n }\r\n } else {\r\n if (lastChapter) {\r\n (lastChapter as Chapter).footnotes.push({\r\n noteId: this._noteCounter++,\r\n text: cell.value,\r\n caller: null,\r\n });\r\n }\r\n }\r\n }\r\n }\r\n\r\n for (let chapter of chapters.values()) {\r\n root.content.push(chapter);\r\n }\r\n\r\n return root;\r\n }\r\n}\r\n"],
5
- "mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,iBAAkB;AAQlB,mBAA8C;AAEvC,MAAM,uBAAuB,aAAE,OAAO;AAAA,EACzC,MAAM,aAAE,QAAQ,iBAAiB;AAAA,EACjC,MAAM,aAAE,OAAO;AAAA,IACX,SAAS,aAAE,OAAO,OAAO,EAAE,IAAI;AAAA,EACnC,CAAC;AACL,CAAC;AAEM,MAAM,iBAAiB,aAAE,mBAAmB,QAAQ;AAAA,EACvD;AACJ,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,OAAO,aAAE;AAAA,IACL,aAAE,OAAO;AAAA;AAAA,MAEL,UAAU,aAAE,OAAO;AAAA,MACnB,OAAO,aAAE,OAAO;AAAA,MAChB,UAAU,aACL,OAAO;AAAA,QACJ,MAAM,aAAE,OAAO;AAAA,MACnB,CAAC,EACA,YAAY,EACZ,SAAS,EACT,SAAS;AAAA,IAClB,CAAC;AAAA,EACL;AACJ,CAAC;AAKM,MAAM,YAAY;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAOb,eAAuB;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAQxB,MAAM,OAA0B;AACnC,UAAM,OAAO,KAAK,MAAM,KAAK;AAC7B,UAAM,OAAO,YAAY,MAAM,IAAI;AAEnC,QAAI,OAAkB;AAAA,MAClB,MAAM;AAAA,MACN,SAAS,CAAC;AAAA,IACd;AAEA,QAAI,WAAiC,oBAAI,IAAI;AAC7C,QAAI,cAA8B;AAElC,aAAS,kBACL,eACA,SACF;AACE,UAAI,UAAU,SAAS,IAAI,aAAa;AACxC,UAAI,CAAC,SAAS;AACV,kBAAU;AAAA,UACN,MAAM;AAAA,UACN,QAAQ;AAAA,UACR,SAAS,CAAC;AAAA,UACV,WAAW,CAAC;AAAA,QAChB;AACA,sBAAc;AACd,iBAAS,IAAI,eAAe,OAAO;AAAA,MACvC;AAEA,cAAQ,QAAQ,KAAK,GAAG,OAAO;AAAA,IACnC;AAEA,aAAS,aAAa,KAAe,SAA2B;AAC5D,wBAAkB,IAAI,SAAS;AAAA,QAC3B;AAAA,UACI,MAAM;AAAA,UACN,QAAQ,IAAI;AAAA,UACZ;AAAA,QACJ;AAAA,MACJ,CAAC;AAAA,IACL;AAEA,aAAS,QAAQ,KAAK,OAAO;AACzB,UAAI,KAAK,aAAa,aAAa;AAC/B,cAAM,QAAQ,KAAK,MAAM,MAAM,IAAI;AACnC,cAAM,aAAa,MAAM;AAAA,UACrB,CAAC,UAAM,kCAAoB,CAAC,KAAK;AAAA,QACrC;AACA,YAAI,aAA8B;AAClC,YAAI,UAA4B,CAAC;AACjC,iBAAS,IAAI,GAAG,IAAI,WAAW,QAAQ,KAAK;AACxC,gBAAM,MAAM,WAAW,CAAC;AACxB,gBAAM,UAAU,WAAW,IAAI,CAAC;AAEhC,cAAI,OAAO,QAAQ,UAAU;AAIzB,gBAAI,QAAQ,IAAI;AAGZ,kBAAI,OAAO,YAAY,UAAU;AAG7B,oBACI,cACA,WAAW,YAAY,QAAQ,SACjC;AAEE,oCAAkB,WAAW,SAAS;AAAA,oBAClC;AAAA,sBACI,MAAM;AAAA,oBACV;AAAA,kBACJ,CAAC;AAAA,gBACL,OAAO;AAAA,gBAEP;AAAA,cACJ,OAAO;AAEH,wBAAQ,KAAK;AAAA,kBACT,WAAW;AAAA,gBACf,CAAC;AAAA,cACL;AAAA,YACJ,WAAW,KAAK;AACZ,sBAAQ,KAAK,GAAG;AAAA,YACpB;AAAA,UACJ,OAAO;AACH,gBAAI,CAAC,KAAK,IAAI;AACV,mBAAK,KAAK,IAAI;AAAA,YAClB;AAGA,gBAAI,YAAY;AAEZ,2BAAa;AACb,wBAAU,CAAC;AAAA,YACf;AAEA,yBAAa;AAEb,gBAAI,IAAI,SAAS;AACb,sBAAQ,KAAK,IAAI,OAAO;AAAA,YAC5B;AAEA,yBAAa,KAAK,OAAO;AAAA,UAC7B;AAAA,QACJ;AAAA,MACJ,WAAW,KAAK,aAAa,YAAY;AACrC,YAAI,KAAK,UAAU;AACf,cAAI,KAAK,SAAS,SAAS,mBAAmB;AAC1C,kBAAM,WAAW,eAAe,MAAM,KAAK,QAAQ;AAEnD,kBAAM,UAAU,SAAS,KAAK;AAC9B,8BAAkB,SAAS;AAAA,cACvB;AAAA,gBACI,MAAM;AAAA,gBACN,SAAS,CAAC,KAAK,KAAK;AAAA,cACxB;AAAA,YACJ,CAAC;AAAA,UACL;AAAA,QACJ,OAAO;AACH,cAAI,aAAa;AACb,YAAC,YAAwB,UAAU,KAAK;AAAA,cACpC,QAAQ,KAAK;AAAA,cACb,MAAM,KAAK;AAAA,cACX,QAAQ;AAAA,YACZ,CAAC;AAAA,UACL;AAAA,QACJ;AAAA,MACJ;AAAA,IACJ;AAEA,aAAS,WAAW,SAAS,OAAO,GAAG;AACnC,WAAK,QAAQ,KAAK,OAAO;AAAA,IAC7B;AAEA,WAAO;AAAA,EACX;AACJ;",
4
+ "sourcesContent": ["import { z } from 'zod';\r\nimport {\r\n Chapter,\r\n ChapterContent,\r\n ParseTree,\r\n Verse,\r\n VerseContent,\r\n} from './types.js';\r\nimport { parseVerseReference, VerseRef } from '../utils.js';\r\n\r\nexport const chapterHeadingSchema = z.object({\r\n type: z.literal('chapter-heading'),\r\n data: z.object({\r\n chapter: z.coerce.number().int(),\r\n }),\r\n});\r\n\r\nexport const verseSchema = z.object({\r\n type: z.literal('text'),\r\n id: z.string(),\r\n});\r\n\r\nexport const paratextSchema = z.object({\r\n type: z.literal('paratext'),\r\n id: z.string(),\r\n});\r\n\r\nexport const metadataSchema = z.discriminatedUnion('type', [\r\n chapterHeadingSchema,\r\n verseSchema,\r\n paratextSchema,\r\n]);\r\n\r\nexport const codexSchema = z.object({\r\n cells: z.array(\r\n z.object({\r\n kind: z.number(),\r\n languageId: z.string(),\r\n value: z.string(),\r\n metadata: z\r\n .object({\r\n type: z.string(),\r\n })\r\n .passthrough()\r\n .nullable()\r\n .optional(),\r\n })\r\n ),\r\n});\r\n\r\n/**\r\n * Defines a parser for codex files.\r\n */\r\nexport class CodexParser {\r\n // TODO:\r\n // /**\r\n // * Whether to preserve markdown in the parsed content.\r\n // */\r\n // preserveMarkdown: boolean = true;\r\n\r\n private _noteCounter: number = 0;\r\n\r\n /**\r\n * Parses the specified codex content.\r\n *\r\n * @param codex The codex content to parse.\r\n * @returns The parse tree that was generated.\r\n */\r\n public parse(codex: string): ParseTree {\r\n const json = JSON.parse(codex);\r\n const data = codexSchema.parse(json);\r\n\r\n let root: ParseTree = {\r\n type: 'root',\r\n content: [],\r\n };\r\n\r\n let chapters: Map<number, Chapter> = new Map();\r\n let lastChapter: Chapter | null = null;\r\n\r\n function addChapterContent(\r\n chapterNumber: number,\r\n content: ChapterContent[]\r\n ) {\r\n let chapter = chapters.get(chapterNumber);\r\n if (!chapter) {\r\n chapter = {\r\n type: 'chapter',\r\n number: chapterNumber,\r\n content: [],\r\n footnotes: [],\r\n };\r\n lastChapter = chapter;\r\n chapters.set(chapterNumber, chapter);\r\n }\r\n\r\n chapter.content.push(...content);\r\n }\r\n\r\n function addReference(ref: VerseRef, content: Verse['content']) {\r\n addChapterContent(ref.chapter, [\r\n {\r\n type: 'verse',\r\n number: ref.verse,\r\n content: content,\r\n },\r\n ]);\r\n }\r\n\r\n function stripHTML(value: string) {\r\n return value.replace(/<[^>]*>/g, '');\r\n }\r\n\r\n function toHeading(content: string) {\r\n return {\r\n type: 'heading',\r\n content: [content],\r\n } satisfies ChapterContent;\r\n }\r\n\r\n for (let cell of data.cells) {\r\n if (cell.languageId === 'html') {\r\n if (!cell.metadata) continue; // ignore html cells without metadata\r\n const metadata = metadataSchema.parse(cell.metadata);\r\n if (metadata.type === 'text') {\r\n const reference = parseVerseReference(metadata.id);\r\n if (!reference)\r\n throw new Error('Could not find verse reference.');\r\n\r\n if (!root.id) root.id = reference.book; // set book id if not already set\r\n\r\n const content = stripHTML(cell.value);\r\n\r\n // add line breaks in heading if there are multiple lines\r\n const lines = content\r\n .split('\\n')\r\n .reduce((prev, current) => {\r\n if (prev.length === 0) return [current];\r\n else\r\n return [\r\n ...prev,\r\n {\r\n lineBreak: true,\r\n },\r\n current,\r\n ] satisfies Verse['content'];\r\n }, [] as Verse['content']);\r\n\r\n addReference(reference, lines);\r\n } else if (metadata.type === 'paratext') {\r\n const reference = parseVerseReference(`${metadata.id}:1`); // chapter headings do not have a verse reference always default to 1\r\n if (reference) {\r\n const content = stripHTML(cell.value);\r\n\r\n // add line breaks in heading if there are multiple lines\r\n const lines = content\r\n .split('\\n')\r\n .reduce<ChapterContent[]>((prev, current) => {\r\n if (prev.length === 0)\r\n return [toHeading(current)];\r\n else\r\n return [\r\n ...prev,\r\n {\r\n type: 'line_break',\r\n },\r\n toHeading(current),\r\n ] satisfies ChapterContent[];\r\n }, []);\r\n\r\n lines.forEach((line) =>\r\n addChapterContent(reference.chapter, [line])\r\n );\r\n } else {\r\n // parse paratext that isn't a chapter reference as footnote\r\n const content = stripHTML(cell.value);\r\n if (!cell.metadata) {\r\n if (lastChapter) {\r\n (lastChapter as Chapter).footnotes.push({\r\n noteId: this._noteCounter++,\r\n text: content,\r\n caller: null,\r\n });\r\n }\r\n }\r\n }\r\n }\r\n }\r\n }\r\n\r\n for (let chapter of chapters.values()) {\r\n root.content.push(chapter);\r\n }\r\n\r\n return root;\r\n }\r\n}\r\n"],
5
+ "mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,iBAAkB;AAQlB,mBAA8C;AAEvC,MAAM,uBAAuB,aAAE,OAAO;AAAA,EACzC,MAAM,aAAE,QAAQ,iBAAiB;AAAA,EACjC,MAAM,aAAE,OAAO;AAAA,IACX,SAAS,aAAE,OAAO,OAAO,EAAE,IAAI;AAAA,EACnC,CAAC;AACL,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,MAAM,aAAE,QAAQ,MAAM;AAAA,EACtB,IAAI,aAAE,OAAO;AACjB,CAAC;AAEM,MAAM,iBAAiB,aAAE,OAAO;AAAA,EACnC,MAAM,aAAE,QAAQ,UAAU;AAAA,EAC1B,IAAI,aAAE,OAAO;AACjB,CAAC;AAEM,MAAM,iBAAiB,aAAE,mBAAmB,QAAQ;AAAA,EACvD;AAAA,EACA;AAAA,EACA;AACJ,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,OAAO,aAAE;AAAA,IACL,aAAE,OAAO;AAAA,MACL,MAAM,aAAE,OAAO;AAAA,MACf,YAAY,aAAE,OAAO;AAAA,MACrB,OAAO,aAAE,OAAO;AAAA,MAChB,UAAU,aACL,OAAO;AAAA,QACJ,MAAM,aAAE,OAAO;AAAA,MACnB,CAAC,EACA,YAAY,EACZ,SAAS,EACT,SAAS;AAAA,IAClB,CAAC;AAAA,EACL;AACJ,CAAC;AAKM,MAAM,YAAY;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAOb,eAAuB;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAQxB,MAAM,OAA0B;AACnC,UAAM,OAAO,KAAK,MAAM,KAAK;AAC7B,UAAM,OAAO,YAAY,MAAM,IAAI;AAEnC,QAAI,OAAkB;AAAA,MAClB,MAAM;AAAA,MACN,SAAS,CAAC;AAAA,IACd;AAEA,QAAI,WAAiC,oBAAI,IAAI;AAC7C,QAAI,cAA8B;AAElC,aAAS,kBACL,eACA,SACF;AACE,UAAI,UAAU,SAAS,IAAI,aAAa;AACxC,UAAI,CAAC,SAAS;AACV,kBAAU;AAAA,UACN,MAAM;AAAA,UACN,QAAQ;AAAA,UACR,SAAS,CAAC;AAAA,UACV,WAAW,CAAC;AAAA,QAChB;AACA,sBAAc;AACd,iBAAS,IAAI,eAAe,OAAO;AAAA,MACvC;AAEA,cAAQ,QAAQ,KAAK,GAAG,OAAO;AAAA,IACnC;AAEA,aAAS,aAAa,KAAe,SAA2B;AAC5D,wBAAkB,IAAI,SAAS;AAAA,QAC3B;AAAA,UACI,MAAM;AAAA,UACN,QAAQ,IAAI;AAAA,UACZ;AAAA,QACJ;AAAA,MACJ,CAAC;AAAA,IACL;AAEA,aAAS,UAAU,OAAe;AAC9B,aAAO,MAAM,QAAQ,YAAY,EAAE;AAAA,IACvC;AAEA,aAAS,UAAU,SAAiB;AAChC,aAAO;AAAA,QACH,MAAM;AAAA,QACN,SAAS,CAAC,OAAO;AAAA,MACrB;AAAA,IACJ;AAEA,aAAS,QAAQ,KAAK,OAAO;AACzB,UAAI,KAAK,eAAe,QAAQ;AAC5B,YAAI,CAAC,KAAK,SAAU;AACpB,cAAM,WAAW,eAAe,MAAM,KAAK,QAAQ;AACnD,YAAI,SAAS,SAAS,QAAQ;AAC1B,gBAAM,gBAAY,kCAAoB,SAAS,EAAE;AACjD,cAAI,CAAC;AACD,kBAAM,IAAI,MAAM,iCAAiC;AAErD,cAAI,CAAC,KAAK,GAAI,MAAK,KAAK,UAAU;AAElC,gBAAM,UAAU,UAAU,KAAK,KAAK;AAGpC,gBAAM,QAAQ,QACT,MAAM,IAAI,EACV,OAAO,CAAC,MAAM,YAAY;AACvB,gBAAI,KAAK,WAAW,EAAG,QAAO,CAAC,OAAO;AAAA;AAElC,qBAAO;AAAA,gBACH,GAAG;AAAA,gBACH;AAAA,kBACI,WAAW;AAAA,gBACf;AAAA,gBACA;AAAA,cACJ;AAAA,UACR,GAAG,CAAC,CAAqB;AAE7B,uBAAa,WAAW,KAAK;AAAA,QACjC,WAAW,SAAS,SAAS,YAAY;AACrC,gBAAM,gBAAY,kCAAoB,GAAG,SAAS,EAAE,IAAI;AACxD,cAAI,WAAW;AACX,kBAAM,UAAU,UAAU,KAAK,KAAK;AAGpC,kBAAM,QAAQ,QACT,MAAM,IAAI,EACV,OAAyB,CAAC,MAAM,YAAY;AACzC,kBAAI,KAAK,WAAW;AAChB,uBAAO,CAAC,UAAU,OAAO,CAAC;AAAA;AAE1B,uBAAO;AAAA,kBACH,GAAG;AAAA,kBACH;AAAA,oBACI,MAAM;AAAA,kBACV;AAAA,kBACA,UAAU,OAAO;AAAA,gBACrB;AAAA,YACR,GAAG,CAAC,CAAC;AAET,kBAAM;AAAA,cAAQ,CAAC,SACX,kBAAkB,UAAU,SAAS,CAAC,IAAI,CAAC;AAAA,YAC/C;AAAA,UACJ,OAAO;AAEH,kBAAM,UAAU,UAAU,KAAK,KAAK;AACpC,gBAAI,CAAC,KAAK,UAAU;AAChB,kBAAI,aAAa;AACb,gBAAC,YAAwB,UAAU,KAAK;AAAA,kBACpC,QAAQ,KAAK;AAAA,kBACb,MAAM;AAAA,kBACN,QAAQ;AAAA,gBACZ,CAAC;AAAA,cACL;AAAA,YACJ;AAAA,UACJ;AAAA,QACJ;AAAA,MACJ;AAAA,IACJ;AAEA,aAAS,WAAW,SAAS,OAAO,GAAG;AACnC,WAAK,QAAQ,KAAK,OAAO;AAAA,IAC7B;AAEA,WAAO;AAAA,EACX;AACJ;",
6
6
  "names": []
7
7
  }