@helloao/tools 0.0.9 → 0.0.10
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/cjs/generation/api.cjs +126 -0
- package/dist/cjs/generation/api.cjs.map +2 -2
- package/dist/cjs/generation/common-types.cjs.map +1 -1
- package/dist/cjs/generation/dataset.cjs +159 -79
- package/dist/cjs/generation/dataset.cjs.map +2 -2
- package/dist/cjs/parser/codex-parser.cjs +77 -66
- package/dist/cjs/parser/codex-parser.cjs.map +2 -2
- package/dist/cjs/parser/commentary-csv-parser.cjs +133 -0
- package/dist/cjs/parser/commentary-csv-parser.cjs.map +7 -0
- package/dist/cjs/parser/index.cjs +3 -1
- package/dist/cjs/parser/index.cjs.map +2 -2
- package/dist/cjs/parser/types.cjs.map +1 -1
- package/dist/cjs/parser/usx-parser.cjs +13 -1
- package/dist/cjs/parser/usx-parser.cjs.map +2 -2
- package/dist/cjs/utils.cjs +155 -3
- package/dist/cjs/utils.cjs.map +3 -3
- package/dist/esm/generation/api.js +122 -0
- package/dist/esm/generation/api.js.map +2 -2
- package/dist/esm/generation/dataset.js +159 -79
- package/dist/esm/generation/dataset.js.map +2 -2
- package/dist/esm/parser/codex-parser.js +71 -64
- package/dist/esm/parser/codex-parser.js.map +2 -2
- package/dist/esm/parser/commentary-csv-parser.js +107 -0
- package/dist/esm/parser/commentary-csv-parser.js.map +7 -0
- package/dist/esm/parser/index.js +1 -0
- package/dist/esm/parser/index.js.map +2 -2
- package/dist/esm/parser/usx-parser.js +13 -1
- package/dist/esm/parser/usx-parser.js.map +2 -2
- package/dist/esm/utils.js +153 -3
- package/dist/esm/utils.js.map +3 -3
- package/dist/types/generation/api.d.ts +147 -1
- package/dist/types/generation/common-types.d.ts +121 -24
- package/dist/types/generation/dataset.d.ts +23 -1
- package/dist/types/parser/codex-parser.d.ts +50 -7
- package/dist/types/parser/commentary-csv-parser.d.ts +12 -0
- package/dist/types/parser/index.d.ts +1 -0
- package/dist/types/parser/types.d.ts +28 -1
- package/dist/types/parser/usx-parser.d.ts +1 -1
- package/dist/types/utils.d.ts +6 -0
- package/package.json +3 -2
|
@@ -27,14 +27,18 @@ var import_book_order = require("./book-order.js");
|
|
|
27
27
|
var import_lodash = require("lodash");
|
|
28
28
|
var import_audio = require("./audio.js");
|
|
29
29
|
var import_codex_parser = require("../parser/codex-parser.js");
|
|
30
|
+
var import_commentary_csv_parser = require("../parser/commentary-csv-parser.js");
|
|
30
31
|
function generateDataset(files, parser = new globalThis.DOMParser()) {
|
|
31
32
|
let output = {
|
|
32
|
-
translations: []
|
|
33
|
+
translations: [],
|
|
34
|
+
commentaries: []
|
|
33
35
|
};
|
|
34
36
|
let usfmParser = new import_usfm_parser.UsfmParser();
|
|
35
37
|
let usxParser = new import_usx_parser.USXParser(parser);
|
|
36
38
|
let codexParser = new import_codex_parser.CodexParser();
|
|
39
|
+
let csvCommentaryParser = new import_commentary_csv_parser.CommentaryCsvParser();
|
|
37
40
|
let parsedTranslations = /* @__PURE__ */ new Map();
|
|
41
|
+
let parsedCommentaries = /* @__PURE__ */ new Map();
|
|
38
42
|
const unknownLanguages = /* @__PURE__ */ new Set();
|
|
39
43
|
for (let file of files) {
|
|
40
44
|
try {
|
|
@@ -45,6 +49,8 @@ function generateDataset(files, parser = new globalThis.DOMParser()) {
|
|
|
45
49
|
parser2 = usxParser;
|
|
46
50
|
} else if (file.fileType === "json") {
|
|
47
51
|
parser2 = codexParser;
|
|
52
|
+
} else if (file.fileType === "commentary/csv") {
|
|
53
|
+
parser2 = csvCommentaryParser;
|
|
48
54
|
} else {
|
|
49
55
|
console.warn(
|
|
50
56
|
"[generate] File does not have a valid type!",
|
|
@@ -53,101 +59,175 @@ function generateDataset(files, parser = new globalThis.DOMParser()) {
|
|
|
53
59
|
continue;
|
|
54
60
|
}
|
|
55
61
|
const parsed = parser2.parse(file.content);
|
|
56
|
-
|
|
57
|
-
|
|
58
|
-
|
|
59
|
-
|
|
60
|
-
file.name,
|
|
61
|
-
id
|
|
62
|
-
);
|
|
63
|
-
continue;
|
|
64
|
-
}
|
|
65
|
-
const order = import_book_order.bookOrderMap.get(id);
|
|
66
|
-
if (typeof order !== "number") {
|
|
67
|
-
console.warn("[generate] Book does not have an order!", id);
|
|
68
|
-
continue;
|
|
69
|
-
}
|
|
70
|
-
const bookMap = import_book_order.bookIdMap.get(file.metadata.translation.language);
|
|
71
|
-
if (!bookMap) {
|
|
72
|
-
if (!unknownLanguages.has(file.metadata.translation.language)) {
|
|
73
|
-
console.warn(
|
|
74
|
-
"[generate] File does not have a known language!",
|
|
75
|
-
file.name,
|
|
76
|
-
file.metadata.translation.language
|
|
77
|
-
);
|
|
78
|
-
unknownLanguages.add(file.metadata.translation.language);
|
|
79
|
-
}
|
|
62
|
+
if (parsed.type === "root") {
|
|
63
|
+
addTranslationTree(file, parsed);
|
|
64
|
+
} else {
|
|
65
|
+
addCommentaryTree(file, parsed);
|
|
80
66
|
}
|
|
81
|
-
|
|
82
|
-
|
|
67
|
+
} catch (err) {
|
|
68
|
+
console.error(
|
|
69
|
+
`[generate] Error occurred while parsing ${file.name}`,
|
|
70
|
+
err
|
|
71
|
+
);
|
|
72
|
+
}
|
|
73
|
+
}
|
|
74
|
+
function addTranslationTree(file, parsed) {
|
|
75
|
+
const id = parsed.id;
|
|
76
|
+
if (!id) {
|
|
77
|
+
console.warn(
|
|
78
|
+
"[generate] File does not have a valid book ID!",
|
|
79
|
+
file.name,
|
|
80
|
+
id
|
|
81
|
+
);
|
|
82
|
+
return;
|
|
83
|
+
}
|
|
84
|
+
const order = import_book_order.bookOrderMap.get(id);
|
|
85
|
+
if (typeof order !== "number") {
|
|
86
|
+
console.warn("[generate] Book does not have an order!", id);
|
|
87
|
+
return;
|
|
88
|
+
}
|
|
89
|
+
const bookMap = import_book_order.bookIdMap.get(file.metadata.language);
|
|
90
|
+
if (!bookMap) {
|
|
91
|
+
if (!unknownLanguages.has(file.metadata.language)) {
|
|
83
92
|
console.warn(
|
|
84
|
-
"[generate]
|
|
93
|
+
"[generate] File does not have a known language!",
|
|
85
94
|
file.name,
|
|
86
|
-
|
|
95
|
+
file.metadata.language
|
|
87
96
|
);
|
|
97
|
+
unknownLanguages.add(file.metadata.language);
|
|
88
98
|
}
|
|
89
|
-
|
|
90
|
-
|
|
99
|
+
}
|
|
100
|
+
const bookName = bookMap?.get(id);
|
|
101
|
+
if (!!bookMap && !bookName) {
|
|
102
|
+
console.warn(
|
|
103
|
+
"[generate] Book name not found for ID!",
|
|
104
|
+
file.name,
|
|
105
|
+
id
|
|
91
106
|
);
|
|
92
|
-
|
|
93
|
-
|
|
94
|
-
|
|
95
|
-
|
|
96
|
-
|
|
97
|
-
|
|
98
|
-
|
|
99
|
-
|
|
100
|
-
|
|
101
|
-
|
|
102
|
-
|
|
107
|
+
}
|
|
108
|
+
let translation = parsedTranslations.get(file.metadata.id);
|
|
109
|
+
if (!translation) {
|
|
110
|
+
translation = {
|
|
111
|
+
...(0, import_lodash.omit)(file.metadata, "direction"),
|
|
112
|
+
textDirection: file.metadata.direction,
|
|
113
|
+
books: []
|
|
114
|
+
};
|
|
115
|
+
output.translations.push(translation);
|
|
116
|
+
parsedTranslations.set(file.metadata.id, translation);
|
|
117
|
+
}
|
|
118
|
+
const name = parsed.header ?? bookName?.commonName ?? parsed.title;
|
|
119
|
+
if (!name) {
|
|
120
|
+
console.warn(
|
|
121
|
+
"[generate] Book does not have a name!",
|
|
122
|
+
file.name,
|
|
123
|
+
id
|
|
124
|
+
);
|
|
125
|
+
return;
|
|
126
|
+
}
|
|
127
|
+
const commonName = bookName?.commonName ?? parsed.header ?? parsed.title ?? id;
|
|
128
|
+
const book = {
|
|
129
|
+
id,
|
|
130
|
+
name,
|
|
131
|
+
commonName,
|
|
132
|
+
title: parsed.title ?? null,
|
|
133
|
+
order,
|
|
134
|
+
chapters: []
|
|
135
|
+
};
|
|
136
|
+
for (let content of parsed.content) {
|
|
137
|
+
if (content.type === "chapter") {
|
|
138
|
+
book.chapters.push({
|
|
139
|
+
chapter: {
|
|
140
|
+
number: content.number,
|
|
141
|
+
content: content.content,
|
|
142
|
+
footnotes: content.footnotes
|
|
143
|
+
},
|
|
144
|
+
thisChapterAudioLinks: (0, import_audio.getAudioUrlsForChapter)(
|
|
145
|
+
translation.id,
|
|
146
|
+
id,
|
|
147
|
+
content.number
|
|
148
|
+
)
|
|
149
|
+
});
|
|
103
150
|
}
|
|
104
|
-
|
|
105
|
-
|
|
151
|
+
}
|
|
152
|
+
book.chapters = (0, import_lodash.sortBy)(book.chapters, (c) => c.chapter.number);
|
|
153
|
+
const index = (0, import_lodash.sortedIndexBy)(translation.books, book, (b) => b.order);
|
|
154
|
+
translation.books.splice(index, 0, book);
|
|
155
|
+
}
|
|
156
|
+
function addCommentaryTree(file, parsed) {
|
|
157
|
+
let commentary = parsedCommentaries.get(file.metadata.id);
|
|
158
|
+
if (!commentary) {
|
|
159
|
+
commentary = {
|
|
160
|
+
...(0, import_lodash.omit)(file.metadata, "direction"),
|
|
161
|
+
textDirection: file.metadata.direction,
|
|
162
|
+
books: []
|
|
163
|
+
};
|
|
164
|
+
output.commentaries.push(commentary);
|
|
165
|
+
parsedCommentaries.set(file.metadata.id, commentary);
|
|
166
|
+
}
|
|
167
|
+
for (let parsedBook of parsed.books) {
|
|
168
|
+
let book = commentary.books.find((b) => b.id === parsedBook.book);
|
|
169
|
+
if (book && book.introduction) {
|
|
106
170
|
console.warn(
|
|
107
|
-
"[generate] Book
|
|
171
|
+
"[generate] Book already exists in commentary!",
|
|
108
172
|
file.name,
|
|
109
|
-
|
|
173
|
+
parsedBook.book
|
|
110
174
|
);
|
|
111
175
|
continue;
|
|
112
176
|
}
|
|
113
|
-
|
|
114
|
-
|
|
115
|
-
|
|
116
|
-
|
|
117
|
-
|
|
118
|
-
|
|
119
|
-
|
|
120
|
-
|
|
121
|
-
|
|
122
|
-
|
|
123
|
-
|
|
124
|
-
|
|
125
|
-
|
|
126
|
-
|
|
127
|
-
|
|
128
|
-
|
|
129
|
-
|
|
130
|
-
|
|
131
|
-
|
|
132
|
-
|
|
133
|
-
content.number
|
|
134
|
-
)
|
|
135
|
-
});
|
|
177
|
+
if (!book) {
|
|
178
|
+
const name = getBookNames(file, file.metadata, parsedBook.book);
|
|
179
|
+
book = {
|
|
180
|
+
id: parsedBook.book,
|
|
181
|
+
order: import_book_order.bookOrderMap.get(parsedBook.book) ?? -1,
|
|
182
|
+
commonName: name?.bookName?.commonName ?? parsedBook.book,
|
|
183
|
+
name: name?.bookName?.commonName ?? parsedBook.book,
|
|
184
|
+
chapters: []
|
|
185
|
+
};
|
|
186
|
+
}
|
|
187
|
+
if (parsedBook.introduction) {
|
|
188
|
+
book.introduction = parsedBook.introduction;
|
|
189
|
+
}
|
|
190
|
+
for (let chapter of parsedBook.chapters) {
|
|
191
|
+
let data = {
|
|
192
|
+
number: chapter.number,
|
|
193
|
+
content: chapter.verses
|
|
194
|
+
};
|
|
195
|
+
if (chapter.introduction) {
|
|
196
|
+
data.introduction = chapter.introduction;
|
|
136
197
|
}
|
|
198
|
+
book.chapters.push({
|
|
199
|
+
chapter: data
|
|
200
|
+
});
|
|
137
201
|
}
|
|
138
202
|
book.chapters = (0, import_lodash.sortBy)(book.chapters, (c) => c.chapter.number);
|
|
139
|
-
|
|
140
|
-
|
|
141
|
-
|
|
142
|
-
|
|
143
|
-
|
|
144
|
-
|
|
145
|
-
|
|
146
|
-
|
|
147
|
-
|
|
148
|
-
|
|
203
|
+
commentary.books.push(book);
|
|
204
|
+
}
|
|
205
|
+
commentary.books = (0, import_lodash.sortBy)(commentary.books, (b) => b.order);
|
|
206
|
+
}
|
|
207
|
+
function getBookNames(file, metadata, id) {
|
|
208
|
+
const bookMap = import_book_order.bookIdMap.get(metadata.language);
|
|
209
|
+
if (!bookMap) {
|
|
210
|
+
if (!unknownLanguages.has(metadata.language)) {
|
|
211
|
+
console.warn(
|
|
212
|
+
"[generate] File does not have a known language!",
|
|
213
|
+
file.name,
|
|
214
|
+
metadata.language
|
|
215
|
+
);
|
|
216
|
+
unknownLanguages.add(metadata.language);
|
|
217
|
+
}
|
|
218
|
+
}
|
|
219
|
+
const bookName = bookMap?.get(id);
|
|
220
|
+
if (!!bookMap && !bookName) {
|
|
221
|
+
console.warn(
|
|
222
|
+
"[generate] Book name not found for ID!",
|
|
223
|
+
file.name,
|
|
224
|
+
id
|
|
149
225
|
);
|
|
226
|
+
return null;
|
|
150
227
|
}
|
|
228
|
+
return {
|
|
229
|
+
bookName
|
|
230
|
+
};
|
|
151
231
|
}
|
|
152
232
|
return output;
|
|
153
233
|
}
|
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
{
|
|
2
2
|
"version": 3,
|
|
3
3
|
"sources": ["../../../generation/dataset.ts"],
|
|
4
|
-
"sourcesContent": ["import { UsfmParser } from '../parser/usfm-parser.js';\r\nimport { USXParser } from '../parser/usx-parser.js';\r\nimport {\r\n InputFile,\r\n Translation,\r\n TranslationBook,\r\n TranslationBookChapter,\r\n} from './common-types.js';\r\nimport { bookIdMap, bookOrderMap } from './book-order.js';\r\nimport { omit, sortBy, sortedIndexBy } from 'lodash';\r\nimport { getAudioUrlsForChapter } from './audio.js';\r\nimport { CodexParser } from '../parser/codex-parser.js';\r\n\r\n/**\r\n * Defines an interface that contains generated dataset info.\r\n */\r\nexport interface DatasetOutput {\r\n /**\r\n * The list of translations that are available in the dataset.\r\n */\r\n translations: DatasetTranslation[];\r\n}\r\n\r\n/**\r\n * Defines a translation that is used in the dataset.\r\n */\r\nexport interface DatasetTranslation extends Translation {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetTranslationBook[];\r\n}\r\n\r\n/**\r\n * Defines a translation book that is used in the dataset.\r\n */\r\nexport interface DatasetTranslationBook extends TranslationBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: TranslationBookChapter[];\r\n}\r\n\r\n/**\r\n * Generates a list of output files from the given list of input files.\r\n * @param file The list of files.\r\n */\r\nexport function generateDataset(\r\n files: InputFile[],\r\n parser: DOMParser = new globalThis.DOMParser()\r\n): DatasetOutput {\r\n let output: DatasetOutput = {\r\n translations: [],\r\n };\r\n\r\n let usfmParser = new UsfmParser();\r\n let usxParser = new USXParser(parser);\r\n let codexParser = new CodexParser();\r\n\r\n let parsedTranslations = new Map<string, DatasetTranslation>();\r\n\r\n const unknownLanguages = new Set<string>();\r\n for (let file of files) {\r\n try {\r\n let parser: UsfmParser | USXParser | CodexParser;\r\n if (file.fileType === 'usfm') {\r\n parser = usfmParser;\r\n } else if (file.fileType === 'usx') {\r\n parser = usxParser;\r\n } else if (file.fileType === 'json') {\r\n parser = codexParser;\r\n } else {\r\n console.warn(\r\n '[generate] File does not have a valid type!',\r\n file.name\r\n );\r\n continue;\r\n }\r\n\r\n const parsed = parser.parse(file.content);\r\n const id = parsed.id;\r\n\r\n if (!id) {\r\n console.warn(\r\n '[generate] File does not have a valid book ID!',\r\n file.name,\r\n id\r\n );\r\n continue;\r\n }\r\n\r\n const order = bookOrderMap.get(id);\r\n\r\n if (typeof order !== 'number') {\r\n console.warn('[generate] Book does not have an order!', id);\r\n continue;\r\n }\r\n\r\n const bookMap = bookIdMap.get(file.metadata.translation.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(file.metadata.translation.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n file.metadata.translation.language\r\n );\r\n unknownLanguages.add(file.metadata.translation.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n }\r\n\r\n let translation = parsedTranslations.get(\r\n file.metadata.translation.id\r\n );\r\n\r\n if (!translation) {\r\n translation = {\r\n ...omit(file.metadata.translation, 'direction'),\r\n textDirection: file.metadata.translation.direction,\r\n books: [],\r\n };\r\n output.translations.push(translation);\r\n parsedTranslations.set(\r\n file.metadata.translation.id,\r\n translation\r\n );\r\n }\r\n\r\n const name = parsed.header ?? bookName?.commonName ?? parsed.title;\r\n\r\n if (!name) {\r\n console.warn(\r\n '[generate] Book does not have a name!',\r\n file.name,\r\n id\r\n );\r\n continue;\r\n }\r\n\r\n const commonName =\r\n bookName?.commonName ?? parsed.header ?? parsed.title ?? id;\r\n\r\n const book: DatasetTranslationBook = {\r\n id: id,\r\n name,\r\n commonName,\r\n title: parsed.title ?? null,\r\n order,\r\n chapters: [],\r\n };\r\n\r\n for (let content of parsed.content) {\r\n if (content.type === 'chapter') {\r\n book.chapters.push({\r\n chapter: {\r\n number: content.number,\r\n content: content.content,\r\n footnotes: content.footnotes,\r\n },\r\n thisChapterAudioLinks: getAudioUrlsForChapter(\r\n translation.id,\r\n id,\r\n content.number\r\n ),\r\n });\r\n }\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n\r\n const index = sortedIndexBy(\r\n translation.books,\r\n book,\r\n (b) => b.order\r\n );\r\n translation.books.splice(index, 0, book);\r\n } catch (err) {\r\n console.error(\r\n `[generate] Error occurred while parsing ${file.name}`,\r\n err\r\n );\r\n }\r\n }\r\n\r\n return output;\r\n}\r\n"],
|
|
5
|
-
"mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,yBAA2B;AAC3B,wBAA0B;
|
|
4
|
+
"sourcesContent": ["import { UsfmParser } from '../parser/usfm-parser.js';\r\nimport { USXParser } from '../parser/usx-parser.js';\r\nimport {\r\n Commentary,\r\n CommentaryBook,\r\n CommentaryBookChapter,\r\n CommentaryChapterData,\r\n InputCommentaryFile,\r\n InputFile,\r\n InputFileBase,\r\n InputTranslationFile,\r\n MetadataBase,\r\n Translation,\r\n TranslationBook,\r\n TranslationBookChapter,\r\n} from './common-types.js';\r\nimport { bookIdMap, bookOrderMap } from './book-order.js';\r\nimport { omit, sortBy, sortedIndexBy } from 'lodash';\r\nimport { getAudioUrlsForChapter } from './audio.js';\r\nimport { CodexParser } from '../parser/codex-parser.js';\r\nimport { CommentaryCsvParser } from '../parser/commentary-csv-parser.js';\r\nimport { CommentaryParseTree, ParseTree } from '../parser/types.js';\r\n\r\n/**\r\n * Defines an interface that contains generated dataset info.\r\n */\r\nexport interface DatasetOutput {\r\n /**\r\n * The list of translations that are available in the dataset.\r\n */\r\n translations: DatasetTranslation[];\r\n\r\n /**\r\n * The list of commentaries that are available in the dataset.\r\n */\r\n commentaries: DatasetCommentary[];\r\n}\r\n\r\n/**\r\n * Defines a translation that is used in the dataset.\r\n */\r\nexport interface DatasetTranslation extends Translation {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetTranslationBook[];\r\n}\r\n\r\n/**\r\n * Defines a commentary that is used in the dataset.\r\n */\r\nexport interface DatasetCommentary extends Commentary {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetCommentaryBook[];\r\n}\r\n\r\n/**\r\n * Defines a translation book that is used in the dataset.\r\n */\r\nexport interface DatasetTranslationBook extends TranslationBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: TranslationBookChapter[];\r\n}\r\n\r\n/**\r\n * Defines a commentary book that is used in the dataset.\r\n */\r\nexport interface DatasetCommentaryBook extends CommentaryBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: CommentaryBookChapter[];\r\n}\r\n\r\n/**\r\n * Generates a list of output files from the given list of input files.\r\n * @param file The list of files.\r\n */\r\nexport function generateDataset(\r\n files: InputFile[],\r\n parser: DOMParser = new globalThis.DOMParser()\r\n): DatasetOutput {\r\n let output: DatasetOutput = {\r\n translations: [],\r\n commentaries: [],\r\n };\r\n\r\n let usfmParser = new UsfmParser();\r\n let usxParser = new USXParser(parser);\r\n let codexParser = new CodexParser();\r\n let csvCommentaryParser = new CommentaryCsvParser();\r\n\r\n let parsedTranslations = new Map<string, DatasetTranslation>();\r\n let parsedCommentaries = new Map<string, DatasetCommentary>();\r\n\r\n const unknownLanguages = new Set<string>();\r\n for (let file of files) {\r\n try {\r\n let parser:\r\n | UsfmParser\r\n | USXParser\r\n | CodexParser\r\n | CommentaryCsvParser;\r\n if (file.fileType === 'usfm') {\r\n parser = usfmParser;\r\n } else if (file.fileType === 'usx') {\r\n parser = usxParser;\r\n } else if (file.fileType === 'json') {\r\n parser = codexParser;\r\n } else if (file.fileType === 'commentary/csv') {\r\n parser = csvCommentaryParser;\r\n } else {\r\n console.warn(\r\n '[generate] File does not have a valid type!',\r\n file.name\r\n );\r\n continue;\r\n }\r\n\r\n const parsed = parser.parse(file.content);\r\n\r\n if (parsed.type === 'root') {\r\n addTranslationTree(file as InputTranslationFile, parsed);\r\n } else {\r\n addCommentaryTree(file as InputCommentaryFile, parsed);\r\n }\r\n } catch (err) {\r\n console.error(\r\n `[generate] Error occurred while parsing ${file.name}`,\r\n err\r\n );\r\n }\r\n }\r\n\r\n function addTranslationTree(file: InputTranslationFile, parsed: ParseTree) {\r\n const id = parsed.id;\r\n\r\n if (!id) {\r\n console.warn(\r\n '[generate] File does not have a valid book ID!',\r\n file.name,\r\n id\r\n );\r\n return;\r\n }\r\n\r\n const order = bookOrderMap.get(id);\r\n\r\n if (typeof order !== 'number') {\r\n console.warn('[generate] Book does not have an order!', id);\r\n return;\r\n }\r\n\r\n const bookMap = bookIdMap.get(file.metadata.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(file.metadata.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n file.metadata.language\r\n );\r\n unknownLanguages.add(file.metadata.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n }\r\n\r\n let translation = parsedTranslations.get(file.metadata.id);\r\n\r\n if (!translation) {\r\n translation = {\r\n ...omit(file.metadata, 'direction'),\r\n textDirection: file.metadata.direction,\r\n books: [],\r\n };\r\n output.translations.push(translation);\r\n parsedTranslations.set(file.metadata.id, translation);\r\n }\r\n\r\n const name = parsed.header ?? bookName?.commonName ?? parsed.title;\r\n\r\n if (!name) {\r\n console.warn(\r\n '[generate] Book does not have a name!',\r\n file.name,\r\n id\r\n );\r\n return;\r\n }\r\n\r\n const commonName =\r\n bookName?.commonName ?? parsed.header ?? parsed.title ?? id;\r\n\r\n const book: DatasetTranslationBook = {\r\n id: id,\r\n name,\r\n commonName,\r\n title: parsed.title ?? null,\r\n order,\r\n chapters: [],\r\n };\r\n\r\n for (let content of parsed.content) {\r\n if (content.type === 'chapter') {\r\n book.chapters.push({\r\n chapter: {\r\n number: content.number,\r\n content: content.content,\r\n footnotes: content.footnotes,\r\n },\r\n thisChapterAudioLinks: getAudioUrlsForChapter(\r\n translation.id,\r\n id,\r\n content.number\r\n ),\r\n });\r\n }\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n\r\n const index = sortedIndexBy(translation.books, book, (b) => b.order);\r\n translation.books.splice(index, 0, book);\r\n }\r\n\r\n function addCommentaryTree(\r\n file: InputCommentaryFile,\r\n parsed: CommentaryParseTree\r\n ) {\r\n let commentary = parsedCommentaries.get(file.metadata.id);\r\n\r\n if (!commentary) {\r\n commentary = {\r\n ...omit(file.metadata, 'direction'),\r\n textDirection: file.metadata.direction,\r\n books: [],\r\n };\r\n output.commentaries.push(commentary);\r\n parsedCommentaries.set(file.metadata.id, commentary);\r\n }\r\n\r\n for (let parsedBook of parsed.books) {\r\n let book = commentary.books.find((b) => b.id === parsedBook.book);\r\n if (book && book.introduction) {\r\n console.warn(\r\n '[generate] Book already exists in commentary!',\r\n file.name,\r\n parsedBook.book\r\n );\r\n continue;\r\n }\r\n\r\n if (!book) {\r\n const name = getBookNames(file, file.metadata, parsedBook.book);\r\n book = {\r\n id: parsedBook.book,\r\n order: bookOrderMap.get(parsedBook.book) ?? -1,\r\n commonName: name?.bookName?.commonName ?? parsedBook.book,\r\n name: name?.bookName?.commonName ?? parsedBook.book,\r\n chapters: [],\r\n };\r\n }\r\n\r\n if (parsedBook.introduction) {\r\n book.introduction = parsedBook.introduction;\r\n }\r\n\r\n for (let chapter of parsedBook.chapters) {\r\n let data: CommentaryChapterData = {\r\n number: chapter.number,\r\n content: chapter.verses,\r\n };\r\n\r\n if (chapter.introduction) {\r\n data.introduction = chapter.introduction;\r\n }\r\n\r\n book.chapters.push({\r\n chapter: data,\r\n });\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n commentary.books.push(book);\r\n }\r\n\r\n commentary.books = sortBy(commentary.books, (b) => b.order);\r\n }\r\n\r\n function getBookNames(\r\n file: InputFileBase,\r\n metadata: MetadataBase,\r\n id: string\r\n ) {\r\n const bookMap = bookIdMap.get(metadata.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(metadata.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n metadata.language\r\n );\r\n unknownLanguages.add(metadata.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n return null;\r\n }\r\n\r\n return {\r\n bookName,\r\n };\r\n }\r\n\r\n return output;\r\n}\r\n"],
|
|
5
|
+
"mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,yBAA2B;AAC3B,wBAA0B;AAe1B,wBAAwC;AACxC,oBAA4C;AAC5C,mBAAuC;AACvC,0BAA4B;AAC5B,mCAAoC;AA8D7B,SAAS,gBACZ,OACA,SAAoB,IAAI,WAAW,UAAU,GAChC;AACb,MAAI,SAAwB;AAAA,IACxB,cAAc,CAAC;AAAA,IACf,cAAc,CAAC;AAAA,EACnB;AAEA,MAAI,aAAa,IAAI,8BAAW;AAChC,MAAI,YAAY,IAAI,4BAAU,MAAM;AACpC,MAAI,cAAc,IAAI,gCAAY;AAClC,MAAI,sBAAsB,IAAI,iDAAoB;AAElD,MAAI,qBAAqB,oBAAI,IAAgC;AAC7D,MAAI,qBAAqB,oBAAI,IAA+B;AAE5D,QAAM,mBAAmB,oBAAI,IAAY;AACzC,WAAS,QAAQ,OAAO;AACpB,QAAI;AACA,UAAIA;AAKJ,UAAI,KAAK,aAAa,QAAQ;AAC1B,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,OAAO;AAChC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,QAAQ;AACjC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,kBAAkB;AAC3C,QAAAA,UAAS;AAAA,MACb,OAAO;AACH,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,QACT;AACA;AAAA,MACJ;AAEA,YAAM,SAASA,QAAO,MAAM,KAAK,OAAO;AAExC,UAAI,OAAO,SAAS,QAAQ;AACxB,2BAAmB,MAA8B,MAAM;AAAA,MAC3D,OAAO;AACH,0BAAkB,MAA6B,MAAM;AAAA,MACzD;AAAA,IACJ,SAAS,KAAK;AACV,cAAQ;AAAA,QACJ,2CAA2C,KAAK,IAAI;AAAA,QACpD;AAAA,MACJ;AAAA,IACJ;AAAA,EACJ;AAEA,WAAS,mBAAmB,MAA4B,QAAmB;AACvE,UAAM,KAAK,OAAO;AAElB,QAAI,CAAC,IAAI;AACL,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA;AAAA,IACJ;AAEA,UAAM,QAAQ,+BAAa,IAAI,EAAE;AAEjC,QAAI,OAAO,UAAU,UAAU;AAC3B,cAAQ,KAAK,2CAA2C,EAAE;AAC1D;AAAA,IACJ;AAEA,UAAM,UAAU,4BAAU,IAAI,KAAK,SAAS,QAAQ;AAEpD,QAAI,CAAC,SAAS;AACV,UAAI,CAAC,iBAAiB,IAAI,KAAK,SAAS,QAAQ,GAAG;AAC/C,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,KAAK,SAAS;AAAA,QAClB;AACA,yBAAiB,IAAI,KAAK,SAAS,QAAQ;AAAA,MAC/C;AAAA,IACJ;AAEA,UAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,QAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AAAA,IACJ;AAEA,QAAI,cAAc,mBAAmB,IAAI,KAAK,SAAS,EAAE;AAEzD,QAAI,CAAC,aAAa;AACd,oBAAc;AAAA,QACV,OAAG,oBAAK,KAAK,UAAU,WAAW;AAAA,QAClC,eAAe,KAAK,SAAS;AAAA,QAC7B,OAAO,CAAC;AAAA,MACZ;AACA,aAAO,aAAa,KAAK,WAAW;AACpC,yBAAmB,IAAI,KAAK,SAAS,IAAI,WAAW;AAAA,IACxD;AAEA,UAAM,OAAO,OAAO,UAAU,UAAU,cAAc,OAAO;AAE7D,QAAI,CAAC,MAAM;AACP,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA;AAAA,IACJ;AAEA,UAAM,aACF,UAAU,cAAc,OAAO,UAAU,OAAO,SAAS;AAE7D,UAAM,OAA+B;AAAA,MACjC;AAAA,MACA;AAAA,MACA;AAAA,MACA,OAAO,OAAO,SAAS;AAAA,MACvB;AAAA,MACA,UAAU,CAAC;AAAA,IACf;AAEA,aAAS,WAAW,OAAO,SAAS;AAChC,UAAI,QAAQ,SAAS,WAAW;AAC5B,aAAK,SAAS,KAAK;AAAA,UACf,SAAS;AAAA,YACL,QAAQ,QAAQ;AAAA,YAChB,SAAS,QAAQ;AAAA,YACjB,WAAW,QAAQ;AAAA,UACvB;AAAA,UACA,2BAAuB;AAAA,YACnB,YAAY;AAAA,YACZ;AAAA,YACA,QAAQ;AAAA,UACZ;AAAA,QACJ,CAAC;AAAA,MACL;AAAA,IACJ;AAEA,SAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAE7D,UAAM,YAAQ,6BAAc,YAAY,OAAO,MAAM,CAAC,MAAM,EAAE,KAAK;AACnE,gBAAY,MAAM,OAAO,OAAO,GAAG,IAAI;AAAA,EAC3C;AAEA,WAAS,kBACL,MACA,QACF;AACE,QAAI,aAAa,mBAAmB,IAAI,KAAK,SAAS,EAAE;AAExD,QAAI,CAAC,YAAY;AACb,mBAAa;AAAA,QACT,OAAG,oBAAK,KAAK,UAAU,WAAW;AAAA,QAClC,eAAe,KAAK,SAAS;AAAA,QAC7B,OAAO,CAAC;AAAA,MACZ;AACA,aAAO,aAAa,KAAK,UAAU;AACnC,yBAAmB,IAAI,KAAK,SAAS,IAAI,UAAU;AAAA,IACvD;AAEA,aAAS,cAAc,OAAO,OAAO;AACjC,UAAI,OAAO,WAAW,MAAM,KAAK,CAAC,MAAM,EAAE,OAAO,WAAW,IAAI;AAChE,UAAI,QAAQ,KAAK,cAAc;AAC3B,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,WAAW;AAAA,QACf;AACA;AAAA,MACJ;AAEA,UAAI,CAAC,MAAM;AACP,cAAM,OAAO,aAAa,MAAM,KAAK,UAAU,WAAW,IAAI;AAC9D,eAAO;AAAA,UACH,IAAI,WAAW;AAAA,UACf,OAAO,+BAAa,IAAI,WAAW,IAAI,KAAK;AAAA,UAC5C,YAAY,MAAM,UAAU,cAAc,WAAW;AAAA,UACrD,MAAM,MAAM,UAAU,cAAc,WAAW;AAAA,UAC/C,UAAU,CAAC;AAAA,QACf;AAAA,MACJ;AAEA,UAAI,WAAW,cAAc;AACzB,aAAK,eAAe,WAAW;AAAA,MACnC;AAEA,eAAS,WAAW,WAAW,UAAU;AACrC,YAAI,OAA8B;AAAA,UAC9B,QAAQ,QAAQ;AAAA,UAChB,SAAS,QAAQ;AAAA,QACrB;AAEA,YAAI,QAAQ,cAAc;AACtB,eAAK,eAAe,QAAQ;AAAA,QAChC;AAEA,aAAK,SAAS,KAAK;AAAA,UACf,SAAS;AAAA,QACb,CAAC;AAAA,MACL;AAEA,WAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAC7D,iBAAW,MAAM,KAAK,IAAI;AAAA,IAC9B;AAEA,eAAW,YAAQ,sBAAO,WAAW,OAAO,CAAC,MAAM,EAAE,KAAK;AAAA,EAC9D;AAEA,WAAS,aACL,MACA,UACA,IACF;AACE,UAAM,UAAU,4BAAU,IAAI,SAAS,QAAQ;AAE/C,QAAI,CAAC,SAAS;AACV,UAAI,CAAC,iBAAiB,IAAI,SAAS,QAAQ,GAAG;AAC1C,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,SAAS;AAAA,QACb;AACA,yBAAiB,IAAI,SAAS,QAAQ;AAAA,MAC1C;AAAA,IACJ;AAEA,UAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,QAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA,aAAO;AAAA,IACX;AAEA,WAAO;AAAA,MACH;AAAA,IACJ;AAAA,EACJ;AAEA,SAAO;AACX;",
|
|
6
6
|
"names": ["parser"]
|
|
7
7
|
}
|
|
@@ -21,7 +21,9 @@ __export(codex_parser_exports, {
|
|
|
21
21
|
CodexParser: () => CodexParser,
|
|
22
22
|
chapterHeadingSchema: () => chapterHeadingSchema,
|
|
23
23
|
codexSchema: () => codexSchema,
|
|
24
|
-
metadataSchema: () => metadataSchema
|
|
24
|
+
metadataSchema: () => metadataSchema,
|
|
25
|
+
paratextSchema: () => paratextSchema,
|
|
26
|
+
verseSchema: () => verseSchema
|
|
25
27
|
});
|
|
26
28
|
module.exports = __toCommonJS(codex_parser_exports);
|
|
27
29
|
var import_zod = require("zod");
|
|
@@ -32,14 +34,24 @@ const chapterHeadingSchema = import_zod.z.object({
|
|
|
32
34
|
chapter: import_zod.z.coerce.number().int()
|
|
33
35
|
})
|
|
34
36
|
});
|
|
37
|
+
const verseSchema = import_zod.z.object({
|
|
38
|
+
type: import_zod.z.literal("text"),
|
|
39
|
+
id: import_zod.z.string()
|
|
40
|
+
});
|
|
41
|
+
const paratextSchema = import_zod.z.object({
|
|
42
|
+
type: import_zod.z.literal("paratext"),
|
|
43
|
+
id: import_zod.z.string()
|
|
44
|
+
});
|
|
35
45
|
const metadataSchema = import_zod.z.discriminatedUnion("type", [
|
|
36
|
-
chapterHeadingSchema
|
|
46
|
+
chapterHeadingSchema,
|
|
47
|
+
verseSchema,
|
|
48
|
+
paratextSchema
|
|
37
49
|
]);
|
|
38
50
|
const codexSchema = import_zod.z.object({
|
|
39
51
|
cells: import_zod.z.array(
|
|
40
52
|
import_zod.z.object({
|
|
41
|
-
|
|
42
|
-
|
|
53
|
+
kind: import_zod.z.number(),
|
|
54
|
+
languageId: import_zod.z.string(),
|
|
43
55
|
value: import_zod.z.string(),
|
|
44
56
|
metadata: import_zod.z.object({
|
|
45
57
|
type: import_zod.z.string()
|
|
@@ -55,9 +67,9 @@ class CodexParser {
|
|
|
55
67
|
// preserveMarkdown: boolean = true;
|
|
56
68
|
_noteCounter = 0;
|
|
57
69
|
/**
|
|
58
|
-
* Parses the specified
|
|
70
|
+
* Parses the specified codex content.
|
|
59
71
|
*
|
|
60
|
-
* @param
|
|
72
|
+
* @param codex The codex content to parse.
|
|
61
73
|
* @returns The parse tree that was generated.
|
|
62
74
|
*/
|
|
63
75
|
parse(codex) {
|
|
@@ -92,70 +104,67 @@ class CodexParser {
|
|
|
92
104
|
}
|
|
93
105
|
]);
|
|
94
106
|
}
|
|
107
|
+
function stripHTML(value) {
|
|
108
|
+
return value.replace(/<[^>]*>/g, "");
|
|
109
|
+
}
|
|
110
|
+
function toHeading(content) {
|
|
111
|
+
return {
|
|
112
|
+
type: "heading",
|
|
113
|
+
content: [content]
|
|
114
|
+
};
|
|
115
|
+
}
|
|
95
116
|
for (let cell of data.cells) {
|
|
96
|
-
if (cell.
|
|
97
|
-
|
|
98
|
-
const
|
|
99
|
-
|
|
100
|
-
|
|
101
|
-
|
|
102
|
-
|
|
103
|
-
|
|
104
|
-
const
|
|
105
|
-
const
|
|
106
|
-
|
|
107
|
-
|
|
108
|
-
|
|
109
|
-
|
|
110
|
-
|
|
111
|
-
{
|
|
112
|
-
type: "line_break"
|
|
113
|
-
}
|
|
114
|
-
]);
|
|
115
|
-
} else {
|
|
116
|
-
}
|
|
117
|
-
} else {
|
|
118
|
-
content.push({
|
|
117
|
+
if (cell.languageId === "html") {
|
|
118
|
+
if (!cell.metadata) continue;
|
|
119
|
+
const metadata = metadataSchema.parse(cell.metadata);
|
|
120
|
+
if (metadata.type === "text") {
|
|
121
|
+
const reference = (0, import_utils.parseVerseReference)(metadata.id);
|
|
122
|
+
if (!reference)
|
|
123
|
+
throw new Error("Could not find verse reference.");
|
|
124
|
+
if (!root.id) root.id = reference.book;
|
|
125
|
+
const content = stripHTML(cell.value);
|
|
126
|
+
const lines = content.split("\n").reduce((prev, current) => {
|
|
127
|
+
if (prev.length === 0) return [current];
|
|
128
|
+
else
|
|
129
|
+
return [
|
|
130
|
+
...prev,
|
|
131
|
+
{
|
|
119
132
|
lineBreak: true
|
|
133
|
+
},
|
|
134
|
+
current
|
|
135
|
+
];
|
|
136
|
+
}, []);
|
|
137
|
+
addReference(reference, lines);
|
|
138
|
+
} else if (metadata.type === "paratext") {
|
|
139
|
+
const reference = (0, import_utils.parseVerseReference)(`${metadata.id}:1`);
|
|
140
|
+
if (reference) {
|
|
141
|
+
const content = stripHTML(cell.value);
|
|
142
|
+
const lines = content.split("\n").reduce((prev, current) => {
|
|
143
|
+
if (prev.length === 0)
|
|
144
|
+
return [toHeading(current)];
|
|
145
|
+
else
|
|
146
|
+
return [
|
|
147
|
+
...prev,
|
|
148
|
+
{
|
|
149
|
+
type: "line_break"
|
|
150
|
+
},
|
|
151
|
+
toHeading(current)
|
|
152
|
+
];
|
|
153
|
+
}, []);
|
|
154
|
+
lines.forEach(
|
|
155
|
+
(line) => addChapterContent(reference.chapter, [line])
|
|
156
|
+
);
|
|
157
|
+
} else {
|
|
158
|
+
const content = stripHTML(cell.value);
|
|
159
|
+
if (!cell.metadata) {
|
|
160
|
+
if (lastChapter) {
|
|
161
|
+
lastChapter.footnotes.push({
|
|
162
|
+
noteId: this._noteCounter++,
|
|
163
|
+
text: content,
|
|
164
|
+
caller: null
|
|
120
165
|
});
|
|
121
166
|
}
|
|
122
|
-
} else if (ref) {
|
|
123
|
-
content.push(ref);
|
|
124
|
-
}
|
|
125
|
-
} else {
|
|
126
|
-
if (!root.id) {
|
|
127
|
-
root.id = ref.book;
|
|
128
|
-
}
|
|
129
|
-
if (currentRef) {
|
|
130
|
-
currentRef = null;
|
|
131
|
-
content = [];
|
|
132
167
|
}
|
|
133
|
-
currentRef = ref;
|
|
134
|
-
if (ref.content) {
|
|
135
|
-
content.push(ref.content);
|
|
136
|
-
}
|
|
137
|
-
addReference(ref, content);
|
|
138
|
-
}
|
|
139
|
-
}
|
|
140
|
-
} else if (cell.language === "markdown") {
|
|
141
|
-
if (cell.metadata) {
|
|
142
|
-
if (cell.metadata.type === "chapter-heading") {
|
|
143
|
-
const metadata = metadataSchema.parse(cell.metadata);
|
|
144
|
-
const chapter = metadata.data.chapter;
|
|
145
|
-
addChapterContent(chapter, [
|
|
146
|
-
{
|
|
147
|
-
type: "heading",
|
|
148
|
-
content: [cell.value]
|
|
149
|
-
}
|
|
150
|
-
]);
|
|
151
|
-
}
|
|
152
|
-
} else {
|
|
153
|
-
if (lastChapter) {
|
|
154
|
-
lastChapter.footnotes.push({
|
|
155
|
-
noteId: this._noteCounter++,
|
|
156
|
-
text: cell.value,
|
|
157
|
-
caller: null
|
|
158
|
-
});
|
|
159
168
|
}
|
|
160
169
|
}
|
|
161
170
|
}
|
|
@@ -171,6 +180,8 @@ class CodexParser {
|
|
|
171
180
|
CodexParser,
|
|
172
181
|
chapterHeadingSchema,
|
|
173
182
|
codexSchema,
|
|
174
|
-
metadataSchema
|
|
183
|
+
metadataSchema,
|
|
184
|
+
paratextSchema,
|
|
185
|
+
verseSchema
|
|
175
186
|
});
|
|
176
187
|
//# sourceMappingURL=codex-parser.cjs.map
|
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
{
|
|
2
2
|
"version": 3,
|
|
3
3
|
"sources": ["../../../parser/codex-parser.ts"],
|
|
4
|
-
"sourcesContent": ["import { z } from 'zod';\r\nimport {\r\n Chapter,\r\n ChapterContent,\r\n ParseTree,\r\n Verse,\r\n VerseContent,\r\n} from './types.js';\r\nimport { parseVerseReference, VerseRef } from '../utils.js';\r\n\r\nexport const chapterHeadingSchema = z.object({\r\n type: z.literal('chapter-heading'),\r\n data: z.object({\r\n chapter: z.coerce.number().int(),\r\n }),\r\n});\r\n\r\nexport const metadataSchema = z.discriminatedUnion('type', [\r\n chapterHeadingSchema,\r\n]);\r\n\r\nexport const codexSchema = z.object({\r\n cells: z.array(\r\n z.object({\r\n
|
|
5
|
-
"mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,iBAAkB;AAQlB,mBAA8C;AAEvC,MAAM,uBAAuB,aAAE,OAAO;AAAA,EACzC,MAAM,aAAE,QAAQ,iBAAiB;AAAA,EACjC,MAAM,aAAE,OAAO;AAAA,IACX,SAAS,aAAE,OAAO,OAAO,EAAE,IAAI;AAAA,EACnC,CAAC;AACL,CAAC;AAEM,MAAM,iBAAiB,aAAE,mBAAmB,QAAQ;AAAA,EACvD;AACJ,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,OAAO,aAAE;AAAA,IACL,aAAE,OAAO;AAAA;AAAA,
|
|
4
|
+
"sourcesContent": ["import { z } from 'zod';\r\nimport {\r\n Chapter,\r\n ChapterContent,\r\n ParseTree,\r\n Verse,\r\n VerseContent,\r\n} from './types.js';\r\nimport { parseVerseReference, VerseRef } from '../utils.js';\r\n\r\nexport const chapterHeadingSchema = z.object({\r\n type: z.literal('chapter-heading'),\r\n data: z.object({\r\n chapter: z.coerce.number().int(),\r\n }),\r\n});\r\n\r\nexport const verseSchema = z.object({\r\n type: z.literal('text'),\r\n id: z.string(),\r\n});\r\n\r\nexport const paratextSchema = z.object({\r\n type: z.literal('paratext'),\r\n id: z.string(),\r\n});\r\n\r\nexport const metadataSchema = z.discriminatedUnion('type', [\r\n chapterHeadingSchema,\r\n verseSchema,\r\n paratextSchema,\r\n]);\r\n\r\nexport const codexSchema = z.object({\r\n cells: z.array(\r\n z.object({\r\n kind: z.number(),\r\n languageId: z.string(),\r\n value: z.string(),\r\n metadata: z\r\n .object({\r\n type: z.string(),\r\n })\r\n .passthrough()\r\n .nullable()\r\n .optional(),\r\n })\r\n ),\r\n});\r\n\r\n/**\r\n * Defines a parser for codex files.\r\n */\r\nexport class CodexParser {\r\n // TODO:\r\n // /**\r\n // * Whether to preserve markdown in the parsed content.\r\n // */\r\n // preserveMarkdown: boolean = true;\r\n\r\n private _noteCounter: number = 0;\r\n\r\n /**\r\n * Parses the specified codex content.\r\n *\r\n * @param codex The codex content to parse.\r\n * @returns The parse tree that was generated.\r\n */\r\n public parse(codex: string): ParseTree {\r\n const json = JSON.parse(codex);\r\n const data = codexSchema.parse(json);\r\n\r\n let root: ParseTree = {\r\n type: 'root',\r\n content: [],\r\n };\r\n\r\n let chapters: Map<number, Chapter> = new Map();\r\n let lastChapter: Chapter | null = null;\r\n\r\n function addChapterContent(\r\n chapterNumber: number,\r\n content: ChapterContent[]\r\n ) {\r\n let chapter = chapters.get(chapterNumber);\r\n if (!chapter) {\r\n chapter = {\r\n type: 'chapter',\r\n number: chapterNumber,\r\n content: [],\r\n footnotes: [],\r\n };\r\n lastChapter = chapter;\r\n chapters.set(chapterNumber, chapter);\r\n }\r\n\r\n chapter.content.push(...content);\r\n }\r\n\r\n function addReference(ref: VerseRef, content: Verse['content']) {\r\n addChapterContent(ref.chapter, [\r\n {\r\n type: 'verse',\r\n number: ref.verse,\r\n content: content,\r\n },\r\n ]);\r\n }\r\n\r\n function stripHTML(value: string) {\r\n return value.replace(/<[^>]*>/g, '');\r\n }\r\n\r\n function toHeading(content: string) {\r\n return {\r\n type: 'heading',\r\n content: [content],\r\n } satisfies ChapterContent;\r\n }\r\n\r\n for (let cell of data.cells) {\r\n if (cell.languageId === 'html') {\r\n if (!cell.metadata) continue; // ignore html cells without metadata\r\n const metadata = metadataSchema.parse(cell.metadata);\r\n if (metadata.type === 'text') {\r\n const reference = parseVerseReference(metadata.id);\r\n if (!reference)\r\n throw new Error('Could not find verse reference.');\r\n\r\n if (!root.id) root.id = reference.book; // set book id if not already set\r\n\r\n const content = stripHTML(cell.value);\r\n\r\n // add line breaks in heading if there are multiple lines\r\n const lines = content\r\n .split('\\n')\r\n .reduce((prev, current) => {\r\n if (prev.length === 0) return [current];\r\n else\r\n return [\r\n ...prev,\r\n {\r\n lineBreak: true,\r\n },\r\n current,\r\n ] satisfies Verse['content'];\r\n }, [] as Verse['content']);\r\n\r\n addReference(reference, lines);\r\n } else if (metadata.type === 'paratext') {\r\n const reference = parseVerseReference(`${metadata.id}:1`); // chapter headings do not have a verse reference always default to 1\r\n if (reference) {\r\n const content = stripHTML(cell.value);\r\n\r\n // add line breaks in heading if there are multiple lines\r\n const lines = content\r\n .split('\\n')\r\n .reduce<ChapterContent[]>((prev, current) => {\r\n if (prev.length === 0)\r\n return [toHeading(current)];\r\n else\r\n return [\r\n ...prev,\r\n {\r\n type: 'line_break',\r\n },\r\n toHeading(current),\r\n ] satisfies ChapterContent[];\r\n }, []);\r\n\r\n lines.forEach((line) =>\r\n addChapterContent(reference.chapter, [line])\r\n );\r\n } else {\r\n // parse paratext that isn't a chapter reference as footnote\r\n const content = stripHTML(cell.value);\r\n if (!cell.metadata) {\r\n if (lastChapter) {\r\n (lastChapter as Chapter).footnotes.push({\r\n noteId: this._noteCounter++,\r\n text: content,\r\n caller: null,\r\n });\r\n }\r\n }\r\n }\r\n }\r\n }\r\n }\r\n\r\n for (let chapter of chapters.values()) {\r\n root.content.push(chapter);\r\n }\r\n\r\n return root;\r\n }\r\n}\r\n"],
|
|
5
|
+
"mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,iBAAkB;AAQlB,mBAA8C;AAEvC,MAAM,uBAAuB,aAAE,OAAO;AAAA,EACzC,MAAM,aAAE,QAAQ,iBAAiB;AAAA,EACjC,MAAM,aAAE,OAAO;AAAA,IACX,SAAS,aAAE,OAAO,OAAO,EAAE,IAAI;AAAA,EACnC,CAAC;AACL,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,MAAM,aAAE,QAAQ,MAAM;AAAA,EACtB,IAAI,aAAE,OAAO;AACjB,CAAC;AAEM,MAAM,iBAAiB,aAAE,OAAO;AAAA,EACnC,MAAM,aAAE,QAAQ,UAAU;AAAA,EAC1B,IAAI,aAAE,OAAO;AACjB,CAAC;AAEM,MAAM,iBAAiB,aAAE,mBAAmB,QAAQ;AAAA,EACvD;AAAA,EACA;AAAA,EACA;AACJ,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,OAAO,aAAE;AAAA,IACL,aAAE,OAAO;AAAA,MACL,MAAM,aAAE,OAAO;AAAA,MACf,YAAY,aAAE,OAAO;AAAA,MACrB,OAAO,aAAE,OAAO;AAAA,MAChB,UAAU,aACL,OAAO;AAAA,QACJ,MAAM,aAAE,OAAO;AAAA,MACnB,CAAC,EACA,YAAY,EACZ,SAAS,EACT,SAAS;AAAA,IAClB,CAAC;AAAA,EACL;AACJ,CAAC;AAKM,MAAM,YAAY;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAOb,eAAuB;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAQxB,MAAM,OAA0B;AACnC,UAAM,OAAO,KAAK,MAAM,KAAK;AAC7B,UAAM,OAAO,YAAY,MAAM,IAAI;AAEnC,QAAI,OAAkB;AAAA,MAClB,MAAM;AAAA,MACN,SAAS,CAAC;AAAA,IACd;AAEA,QAAI,WAAiC,oBAAI,IAAI;AAC7C,QAAI,cAA8B;AAElC,aAAS,kBACL,eACA,SACF;AACE,UAAI,UAAU,SAAS,IAAI,aAAa;AACxC,UAAI,CAAC,SAAS;AACV,kBAAU;AAAA,UACN,MAAM;AAAA,UACN,QAAQ;AAAA,UACR,SAAS,CAAC;AAAA,UACV,WAAW,CAAC;AAAA,QAChB;AACA,sBAAc;AACd,iBAAS,IAAI,eAAe,OAAO;AAAA,MACvC;AAEA,cAAQ,QAAQ,KAAK,GAAG,OAAO;AAAA,IACnC;AAEA,aAAS,aAAa,KAAe,SAA2B;AAC5D,wBAAkB,IAAI,SAAS;AAAA,QAC3B;AAAA,UACI,MAAM;AAAA,UACN,QAAQ,IAAI;AAAA,UACZ;AAAA,QACJ;AAAA,MACJ,CAAC;AAAA,IACL;AAEA,aAAS,UAAU,OAAe;AAC9B,aAAO,MAAM,QAAQ,YAAY,EAAE;AAAA,IACvC;AAEA,aAAS,UAAU,SAAiB;AAChC,aAAO;AAAA,QACH,MAAM;AAAA,QACN,SAAS,CAAC,OAAO;AAAA,MACrB;AAAA,IACJ;AAEA,aAAS,QAAQ,KAAK,OAAO;AACzB,UAAI,KAAK,eAAe,QAAQ;AAC5B,YAAI,CAAC,KAAK,SAAU;AACpB,cAAM,WAAW,eAAe,MAAM,KAAK,QAAQ;AACnD,YAAI,SAAS,SAAS,QAAQ;AAC1B,gBAAM,gBAAY,kCAAoB,SAAS,EAAE;AACjD,cAAI,CAAC;AACD,kBAAM,IAAI,MAAM,iCAAiC;AAErD,cAAI,CAAC,KAAK,GAAI,MAAK,KAAK,UAAU;AAElC,gBAAM,UAAU,UAAU,KAAK,KAAK;AAGpC,gBAAM,QAAQ,QACT,MAAM,IAAI,EACV,OAAO,CAAC,MAAM,YAAY;AACvB,gBAAI,KAAK,WAAW,EAAG,QAAO,CAAC,OAAO;AAAA;AAElC,qBAAO;AAAA,gBACH,GAAG;AAAA,gBACH;AAAA,kBACI,WAAW;AAAA,gBACf;AAAA,gBACA;AAAA,cACJ;AAAA,UACR,GAAG,CAAC,CAAqB;AAE7B,uBAAa,WAAW,KAAK;AAAA,QACjC,WAAW,SAAS,SAAS,YAAY;AACrC,gBAAM,gBAAY,kCAAoB,GAAG,SAAS,EAAE,IAAI;AACxD,cAAI,WAAW;AACX,kBAAM,UAAU,UAAU,KAAK,KAAK;AAGpC,kBAAM,QAAQ,QACT,MAAM,IAAI,EACV,OAAyB,CAAC,MAAM,YAAY;AACzC,kBAAI,KAAK,WAAW;AAChB,uBAAO,CAAC,UAAU,OAAO,CAAC;AAAA;AAE1B,uBAAO;AAAA,kBACH,GAAG;AAAA,kBACH;AAAA,oBACI,MAAM;AAAA,kBACV;AAAA,kBACA,UAAU,OAAO;AAAA,gBACrB;AAAA,YACR,GAAG,CAAC,CAAC;AAET,kBAAM;AAAA,cAAQ,CAAC,SACX,kBAAkB,UAAU,SAAS,CAAC,IAAI,CAAC;AAAA,YAC/C;AAAA,UACJ,OAAO;AAEH,kBAAM,UAAU,UAAU,KAAK,KAAK;AACpC,gBAAI,CAAC,KAAK,UAAU;AAChB,kBAAI,aAAa;AACb,gBAAC,YAAwB,UAAU,KAAK;AAAA,kBACpC,QAAQ,KAAK;AAAA,kBACb,MAAM;AAAA,kBACN,QAAQ;AAAA,gBACZ,CAAC;AAAA,cACL;AAAA,YACJ;AAAA,UACJ;AAAA,QACJ;AAAA,MACJ;AAAA,IACJ;AAEA,aAAS,WAAW,SAAS,OAAO,GAAG;AACnC,WAAK,QAAQ,KAAK,OAAO;AAAA,IAC7B;AAEA,WAAO;AAAA,EACX;AACJ;",
|
|
6
6
|
"names": []
|
|
7
7
|
}
|