@helloao/tools 0.0.6 → 0.0.10
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/cjs/generation/api.cjs +366 -0
- package/dist/cjs/generation/api.cjs.map +7 -0
- package/dist/cjs/generation/audio.cjs +83 -0
- package/dist/cjs/generation/audio.cjs.map +7 -0
- package/dist/cjs/generation/book-order.cjs +508 -0
- package/dist/cjs/generation/book-order.cjs.map +7 -0
- package/dist/cjs/generation/common-types.cjs +17 -0
- package/dist/cjs/generation/common-types.cjs.map +7 -0
- package/dist/cjs/generation/dataset.cjs +238 -0
- package/dist/cjs/generation/dataset.cjs.map +7 -0
- package/dist/cjs/generation/index.cjs +51 -0
- package/dist/cjs/generation/index.cjs.map +7 -0
- package/dist/cjs/index.cjs +45 -0
- package/dist/cjs/index.cjs.map +7 -0
- package/dist/cjs/parser/codex-parser.cjs +187 -0
- package/dist/cjs/parser/codex-parser.cjs.map +7 -0
- package/dist/cjs/parser/commentary-csv-parser.cjs +133 -0
- package/dist/cjs/parser/commentary-csv-parser.cjs.map +7 -0
- package/dist/cjs/parser/index.cjs +50 -0
- package/dist/cjs/parser/index.cjs.map +7 -0
- package/dist/cjs/parser/iterators.cjs +204 -0
- package/dist/cjs/parser/iterators.cjs.map +7 -0
- package/dist/cjs/parser/types.cjs +17 -0
- package/dist/cjs/parser/types.cjs.map +7 -0
- package/dist/cjs/parser/usfm-parser.cjs +791 -0
- package/dist/cjs/parser/usfm-parser.cjs.map +7 -0
- package/dist/cjs/parser/usx-parser.cjs +483 -0
- package/dist/cjs/parser/usx-parser.cjs.map +7 -0
- package/dist/cjs/utils.cjs +237 -0
- package/dist/cjs/utils.cjs.map +7 -0
- package/dist/esm/generation/api.js +320 -0
- package/dist/esm/generation/api.js.map +7 -0
- package/dist/esm/generation/audio.js +53 -0
- package/dist/esm/generation/audio.js.map +7 -0
- package/dist/esm/generation/book-order.js +478 -0
- package/dist/esm/generation/book-order.js.map +7 -0
- package/dist/esm/generation/common-types.js +2 -0
- package/dist/esm/generation/common-types.js.map +7 -0
- package/dist/esm/generation/dataset.js +212 -0
- package/dist/esm/generation/dataset.js.map +7 -0
- package/dist/esm/generation/index.js +8 -0
- package/dist/esm/generation/index.js.map +7 -0
- package/dist/esm/index.js +6 -0
- package/dist/esm/index.js.map +7 -0
- package/dist/esm/parser/codex-parser.js +151 -0
- package/dist/esm/parser/codex-parser.js.map +7 -0
- package/dist/esm/parser/commentary-csv-parser.js +107 -0
- package/dist/esm/parser/commentary-csv-parser.js.map +7 -0
- package/dist/esm/parser/index.js +9 -0
- package/dist/esm/parser/index.js.map +7 -0
- package/dist/esm/parser/iterators.js +152 -0
- package/dist/esm/parser/iterators.js.map +7 -0
- package/dist/esm/parser/types.js +2 -0
- package/dist/esm/parser/types.js.map +7 -0
- package/dist/esm/parser/usfm-parser.js +749 -0
- package/dist/esm/parser/usfm-parser.js.map +7 -0
- package/dist/esm/parser/usx-parser.js +459 -0
- package/dist/esm/parser/usx-parser.js.map +7 -0
- package/dist/esm/utils.js +201 -0
- package/dist/esm/utils.js.map +7 -0
- package/{generation → dist/types/generation}/api.d.ts +148 -2
- package/{generation → dist/types/generation}/audio.d.ts +1 -1
- package/{generation → dist/types/generation}/common-types.d.ts +121 -24
- package/{generation → dist/types/generation}/dataset.d.ts +23 -1
- package/dist/types/generation/index.d.ts +7 -0
- package/dist/types/index.d.ts +5 -0
- package/{parser → dist/types/parser}/codex-parser.d.ts +51 -8
- package/dist/types/parser/commentary-csv-parser.d.ts +12 -0
- package/dist/types/parser/index.d.ts +8 -0
- package/{parser → dist/types/parser}/types.d.ts +28 -1
- package/{parser → dist/types/parser}/usfm-parser.d.ts +1 -1
- package/{parser → dist/types/parser}/usx-parser.d.ts +3 -3
- package/{utils.d.ts → dist/types/utils.d.ts} +6 -0
- package/package.json +27 -4
- package/generation/api.js +0 -187
- package/generation/api.spec.d.ts +0 -2
- package/generation/api.spec.js +0 -620
- package/generation/audio.js +0 -60
- package/generation/audio.spec.d.ts +0 -2
- package/generation/audio.spec.js +0 -36
- package/generation/book-order.js +0 -494
- package/generation/book-order.spec.d.ts +0 -2
- package/generation/book-order.spec.js +0 -8
- package/generation/common-types.js +0 -2
- package/generation/dataset.js +0 -106
- package/generation/index.d.ts +0 -7
- package/generation/index.js +0 -38
- package/index.d.ts +0 -5
- package/index.js +0 -32
- package/parser/codex-parser.js +0 -160
- package/parser/codex-parser.spec.d.ts +0 -2
- package/parser/codex-parser.spec.js +0 -645
- package/parser/index.d.ts +0 -7
- package/parser/index.js +0 -35
- package/parser/iterators.js +0 -222
- package/parser/iterators.spec.d.ts +0 -2
- package/parser/iterators.spec.js +0 -174
- package/parser/types.js +0 -2
- package/parser/usfm-parser.js +0 -840
- package/parser/usfm-parser.spec.d.ts +0 -2
- package/parser/usfm-parser.spec.js +0 -1593
- package/parser/usx-parser.js +0 -486
- package/parser/usx-parser.spec.d.ts +0 -2
- package/parser/usx-parser.spec.js +0 -1260
- package/utils.js +0 -73
- package/utils.spec.d.ts +0 -2
- package/utils.spec.js +0 -42
- /package/{generation → dist/types/generation}/book-order.d.ts +0 -0
- /package/{parser → dist/types/parser}/iterators.d.ts +0 -0
|
@@ -0,0 +1,238 @@
|
|
|
1
|
+
"use strict";
|
|
2
|
+
var __defProp = Object.defineProperty;
|
|
3
|
+
var __getOwnPropDesc = Object.getOwnPropertyDescriptor;
|
|
4
|
+
var __getOwnPropNames = Object.getOwnPropertyNames;
|
|
5
|
+
var __hasOwnProp = Object.prototype.hasOwnProperty;
|
|
6
|
+
var __export = (target, all) => {
|
|
7
|
+
for (var name in all)
|
|
8
|
+
__defProp(target, name, { get: all[name], enumerable: true });
|
|
9
|
+
};
|
|
10
|
+
var __copyProps = (to, from, except, desc) => {
|
|
11
|
+
if (from && typeof from === "object" || typeof from === "function") {
|
|
12
|
+
for (let key of __getOwnPropNames(from))
|
|
13
|
+
if (!__hasOwnProp.call(to, key) && key !== except)
|
|
14
|
+
__defProp(to, key, { get: () => from[key], enumerable: !(desc = __getOwnPropDesc(from, key)) || desc.enumerable });
|
|
15
|
+
}
|
|
16
|
+
return to;
|
|
17
|
+
};
|
|
18
|
+
var __toCommonJS = (mod) => __copyProps(__defProp({}, "__esModule", { value: true }), mod);
|
|
19
|
+
var dataset_exports = {};
|
|
20
|
+
__export(dataset_exports, {
|
|
21
|
+
generateDataset: () => generateDataset
|
|
22
|
+
});
|
|
23
|
+
module.exports = __toCommonJS(dataset_exports);
|
|
24
|
+
var import_usfm_parser = require("../parser/usfm-parser.js");
|
|
25
|
+
var import_usx_parser = require("../parser/usx-parser.js");
|
|
26
|
+
var import_book_order = require("./book-order.js");
|
|
27
|
+
var import_lodash = require("lodash");
|
|
28
|
+
var import_audio = require("./audio.js");
|
|
29
|
+
var import_codex_parser = require("../parser/codex-parser.js");
|
|
30
|
+
var import_commentary_csv_parser = require("../parser/commentary-csv-parser.js");
|
|
31
|
+
function generateDataset(files, parser = new globalThis.DOMParser()) {
|
|
32
|
+
let output = {
|
|
33
|
+
translations: [],
|
|
34
|
+
commentaries: []
|
|
35
|
+
};
|
|
36
|
+
let usfmParser = new import_usfm_parser.UsfmParser();
|
|
37
|
+
let usxParser = new import_usx_parser.USXParser(parser);
|
|
38
|
+
let codexParser = new import_codex_parser.CodexParser();
|
|
39
|
+
let csvCommentaryParser = new import_commentary_csv_parser.CommentaryCsvParser();
|
|
40
|
+
let parsedTranslations = /* @__PURE__ */ new Map();
|
|
41
|
+
let parsedCommentaries = /* @__PURE__ */ new Map();
|
|
42
|
+
const unknownLanguages = /* @__PURE__ */ new Set();
|
|
43
|
+
for (let file of files) {
|
|
44
|
+
try {
|
|
45
|
+
let parser2;
|
|
46
|
+
if (file.fileType === "usfm") {
|
|
47
|
+
parser2 = usfmParser;
|
|
48
|
+
} else if (file.fileType === "usx") {
|
|
49
|
+
parser2 = usxParser;
|
|
50
|
+
} else if (file.fileType === "json") {
|
|
51
|
+
parser2 = codexParser;
|
|
52
|
+
} else if (file.fileType === "commentary/csv") {
|
|
53
|
+
parser2 = csvCommentaryParser;
|
|
54
|
+
} else {
|
|
55
|
+
console.warn(
|
|
56
|
+
"[generate] File does not have a valid type!",
|
|
57
|
+
file.name
|
|
58
|
+
);
|
|
59
|
+
continue;
|
|
60
|
+
}
|
|
61
|
+
const parsed = parser2.parse(file.content);
|
|
62
|
+
if (parsed.type === "root") {
|
|
63
|
+
addTranslationTree(file, parsed);
|
|
64
|
+
} else {
|
|
65
|
+
addCommentaryTree(file, parsed);
|
|
66
|
+
}
|
|
67
|
+
} catch (err) {
|
|
68
|
+
console.error(
|
|
69
|
+
`[generate] Error occurred while parsing ${file.name}`,
|
|
70
|
+
err
|
|
71
|
+
);
|
|
72
|
+
}
|
|
73
|
+
}
|
|
74
|
+
function addTranslationTree(file, parsed) {
|
|
75
|
+
const id = parsed.id;
|
|
76
|
+
if (!id) {
|
|
77
|
+
console.warn(
|
|
78
|
+
"[generate] File does not have a valid book ID!",
|
|
79
|
+
file.name,
|
|
80
|
+
id
|
|
81
|
+
);
|
|
82
|
+
return;
|
|
83
|
+
}
|
|
84
|
+
const order = import_book_order.bookOrderMap.get(id);
|
|
85
|
+
if (typeof order !== "number") {
|
|
86
|
+
console.warn("[generate] Book does not have an order!", id);
|
|
87
|
+
return;
|
|
88
|
+
}
|
|
89
|
+
const bookMap = import_book_order.bookIdMap.get(file.metadata.language);
|
|
90
|
+
if (!bookMap) {
|
|
91
|
+
if (!unknownLanguages.has(file.metadata.language)) {
|
|
92
|
+
console.warn(
|
|
93
|
+
"[generate] File does not have a known language!",
|
|
94
|
+
file.name,
|
|
95
|
+
file.metadata.language
|
|
96
|
+
);
|
|
97
|
+
unknownLanguages.add(file.metadata.language);
|
|
98
|
+
}
|
|
99
|
+
}
|
|
100
|
+
const bookName = bookMap?.get(id);
|
|
101
|
+
if (!!bookMap && !bookName) {
|
|
102
|
+
console.warn(
|
|
103
|
+
"[generate] Book name not found for ID!",
|
|
104
|
+
file.name,
|
|
105
|
+
id
|
|
106
|
+
);
|
|
107
|
+
}
|
|
108
|
+
let translation = parsedTranslations.get(file.metadata.id);
|
|
109
|
+
if (!translation) {
|
|
110
|
+
translation = {
|
|
111
|
+
...(0, import_lodash.omit)(file.metadata, "direction"),
|
|
112
|
+
textDirection: file.metadata.direction,
|
|
113
|
+
books: []
|
|
114
|
+
};
|
|
115
|
+
output.translations.push(translation);
|
|
116
|
+
parsedTranslations.set(file.metadata.id, translation);
|
|
117
|
+
}
|
|
118
|
+
const name = parsed.header ?? bookName?.commonName ?? parsed.title;
|
|
119
|
+
if (!name) {
|
|
120
|
+
console.warn(
|
|
121
|
+
"[generate] Book does not have a name!",
|
|
122
|
+
file.name,
|
|
123
|
+
id
|
|
124
|
+
);
|
|
125
|
+
return;
|
|
126
|
+
}
|
|
127
|
+
const commonName = bookName?.commonName ?? parsed.header ?? parsed.title ?? id;
|
|
128
|
+
const book = {
|
|
129
|
+
id,
|
|
130
|
+
name,
|
|
131
|
+
commonName,
|
|
132
|
+
title: parsed.title ?? null,
|
|
133
|
+
order,
|
|
134
|
+
chapters: []
|
|
135
|
+
};
|
|
136
|
+
for (let content of parsed.content) {
|
|
137
|
+
if (content.type === "chapter") {
|
|
138
|
+
book.chapters.push({
|
|
139
|
+
chapter: {
|
|
140
|
+
number: content.number,
|
|
141
|
+
content: content.content,
|
|
142
|
+
footnotes: content.footnotes
|
|
143
|
+
},
|
|
144
|
+
thisChapterAudioLinks: (0, import_audio.getAudioUrlsForChapter)(
|
|
145
|
+
translation.id,
|
|
146
|
+
id,
|
|
147
|
+
content.number
|
|
148
|
+
)
|
|
149
|
+
});
|
|
150
|
+
}
|
|
151
|
+
}
|
|
152
|
+
book.chapters = (0, import_lodash.sortBy)(book.chapters, (c) => c.chapter.number);
|
|
153
|
+
const index = (0, import_lodash.sortedIndexBy)(translation.books, book, (b) => b.order);
|
|
154
|
+
translation.books.splice(index, 0, book);
|
|
155
|
+
}
|
|
156
|
+
function addCommentaryTree(file, parsed) {
|
|
157
|
+
let commentary = parsedCommentaries.get(file.metadata.id);
|
|
158
|
+
if (!commentary) {
|
|
159
|
+
commentary = {
|
|
160
|
+
...(0, import_lodash.omit)(file.metadata, "direction"),
|
|
161
|
+
textDirection: file.metadata.direction,
|
|
162
|
+
books: []
|
|
163
|
+
};
|
|
164
|
+
output.commentaries.push(commentary);
|
|
165
|
+
parsedCommentaries.set(file.metadata.id, commentary);
|
|
166
|
+
}
|
|
167
|
+
for (let parsedBook of parsed.books) {
|
|
168
|
+
let book = commentary.books.find((b) => b.id === parsedBook.book);
|
|
169
|
+
if (book && book.introduction) {
|
|
170
|
+
console.warn(
|
|
171
|
+
"[generate] Book already exists in commentary!",
|
|
172
|
+
file.name,
|
|
173
|
+
parsedBook.book
|
|
174
|
+
);
|
|
175
|
+
continue;
|
|
176
|
+
}
|
|
177
|
+
if (!book) {
|
|
178
|
+
const name = getBookNames(file, file.metadata, parsedBook.book);
|
|
179
|
+
book = {
|
|
180
|
+
id: parsedBook.book,
|
|
181
|
+
order: import_book_order.bookOrderMap.get(parsedBook.book) ?? -1,
|
|
182
|
+
commonName: name?.bookName?.commonName ?? parsedBook.book,
|
|
183
|
+
name: name?.bookName?.commonName ?? parsedBook.book,
|
|
184
|
+
chapters: []
|
|
185
|
+
};
|
|
186
|
+
}
|
|
187
|
+
if (parsedBook.introduction) {
|
|
188
|
+
book.introduction = parsedBook.introduction;
|
|
189
|
+
}
|
|
190
|
+
for (let chapter of parsedBook.chapters) {
|
|
191
|
+
let data = {
|
|
192
|
+
number: chapter.number,
|
|
193
|
+
content: chapter.verses
|
|
194
|
+
};
|
|
195
|
+
if (chapter.introduction) {
|
|
196
|
+
data.introduction = chapter.introduction;
|
|
197
|
+
}
|
|
198
|
+
book.chapters.push({
|
|
199
|
+
chapter: data
|
|
200
|
+
});
|
|
201
|
+
}
|
|
202
|
+
book.chapters = (0, import_lodash.sortBy)(book.chapters, (c) => c.chapter.number);
|
|
203
|
+
commentary.books.push(book);
|
|
204
|
+
}
|
|
205
|
+
commentary.books = (0, import_lodash.sortBy)(commentary.books, (b) => b.order);
|
|
206
|
+
}
|
|
207
|
+
function getBookNames(file, metadata, id) {
|
|
208
|
+
const bookMap = import_book_order.bookIdMap.get(metadata.language);
|
|
209
|
+
if (!bookMap) {
|
|
210
|
+
if (!unknownLanguages.has(metadata.language)) {
|
|
211
|
+
console.warn(
|
|
212
|
+
"[generate] File does not have a known language!",
|
|
213
|
+
file.name,
|
|
214
|
+
metadata.language
|
|
215
|
+
);
|
|
216
|
+
unknownLanguages.add(metadata.language);
|
|
217
|
+
}
|
|
218
|
+
}
|
|
219
|
+
const bookName = bookMap?.get(id);
|
|
220
|
+
if (!!bookMap && !bookName) {
|
|
221
|
+
console.warn(
|
|
222
|
+
"[generate] Book name not found for ID!",
|
|
223
|
+
file.name,
|
|
224
|
+
id
|
|
225
|
+
);
|
|
226
|
+
return null;
|
|
227
|
+
}
|
|
228
|
+
return {
|
|
229
|
+
bookName
|
|
230
|
+
};
|
|
231
|
+
}
|
|
232
|
+
return output;
|
|
233
|
+
}
|
|
234
|
+
// Annotate the CommonJS export names for ESM import in node:
|
|
235
|
+
0 && (module.exports = {
|
|
236
|
+
generateDataset
|
|
237
|
+
});
|
|
238
|
+
//# sourceMappingURL=dataset.cjs.map
|
|
@@ -0,0 +1,7 @@
|
|
|
1
|
+
{
|
|
2
|
+
"version": 3,
|
|
3
|
+
"sources": ["../../../generation/dataset.ts"],
|
|
4
|
+
"sourcesContent": ["import { UsfmParser } from '../parser/usfm-parser.js';\r\nimport { USXParser } from '../parser/usx-parser.js';\r\nimport {\r\n Commentary,\r\n CommentaryBook,\r\n CommentaryBookChapter,\r\n CommentaryChapterData,\r\n InputCommentaryFile,\r\n InputFile,\r\n InputFileBase,\r\n InputTranslationFile,\r\n MetadataBase,\r\n Translation,\r\n TranslationBook,\r\n TranslationBookChapter,\r\n} from './common-types.js';\r\nimport { bookIdMap, bookOrderMap } from './book-order.js';\r\nimport { omit, sortBy, sortedIndexBy } from 'lodash';\r\nimport { getAudioUrlsForChapter } from './audio.js';\r\nimport { CodexParser } from '../parser/codex-parser.js';\r\nimport { CommentaryCsvParser } from '../parser/commentary-csv-parser.js';\r\nimport { CommentaryParseTree, ParseTree } from '../parser/types.js';\r\n\r\n/**\r\n * Defines an interface that contains generated dataset info.\r\n */\r\nexport interface DatasetOutput {\r\n /**\r\n * The list of translations that are available in the dataset.\r\n */\r\n translations: DatasetTranslation[];\r\n\r\n /**\r\n * The list of commentaries that are available in the dataset.\r\n */\r\n commentaries: DatasetCommentary[];\r\n}\r\n\r\n/**\r\n * Defines a translation that is used in the dataset.\r\n */\r\nexport interface DatasetTranslation extends Translation {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetTranslationBook[];\r\n}\r\n\r\n/**\r\n * Defines a commentary that is used in the dataset.\r\n */\r\nexport interface DatasetCommentary extends Commentary {\r\n /**\r\n * The list of books that are available for the translation.\r\n */\r\n books: DatasetCommentaryBook[];\r\n}\r\n\r\n/**\r\n * Defines a translation book that is used in the dataset.\r\n */\r\nexport interface DatasetTranslationBook extends TranslationBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: TranslationBookChapter[];\r\n}\r\n\r\n/**\r\n * Defines a commentary book that is used in the dataset.\r\n */\r\nexport interface DatasetCommentaryBook extends CommentaryBook {\r\n /**\r\n * The list of chapters that are available for the book.\r\n */\r\n chapters: CommentaryBookChapter[];\r\n}\r\n\r\n/**\r\n * Generates a list of output files from the given list of input files.\r\n * @param file The list of files.\r\n */\r\nexport function generateDataset(\r\n files: InputFile[],\r\n parser: DOMParser = new globalThis.DOMParser()\r\n): DatasetOutput {\r\n let output: DatasetOutput = {\r\n translations: [],\r\n commentaries: [],\r\n };\r\n\r\n let usfmParser = new UsfmParser();\r\n let usxParser = new USXParser(parser);\r\n let codexParser = new CodexParser();\r\n let csvCommentaryParser = new CommentaryCsvParser();\r\n\r\n let parsedTranslations = new Map<string, DatasetTranslation>();\r\n let parsedCommentaries = new Map<string, DatasetCommentary>();\r\n\r\n const unknownLanguages = new Set<string>();\r\n for (let file of files) {\r\n try {\r\n let parser:\r\n | UsfmParser\r\n | USXParser\r\n | CodexParser\r\n | CommentaryCsvParser;\r\n if (file.fileType === 'usfm') {\r\n parser = usfmParser;\r\n } else if (file.fileType === 'usx') {\r\n parser = usxParser;\r\n } else if (file.fileType === 'json') {\r\n parser = codexParser;\r\n } else if (file.fileType === 'commentary/csv') {\r\n parser = csvCommentaryParser;\r\n } else {\r\n console.warn(\r\n '[generate] File does not have a valid type!',\r\n file.name\r\n );\r\n continue;\r\n }\r\n\r\n const parsed = parser.parse(file.content);\r\n\r\n if (parsed.type === 'root') {\r\n addTranslationTree(file as InputTranslationFile, parsed);\r\n } else {\r\n addCommentaryTree(file as InputCommentaryFile, parsed);\r\n }\r\n } catch (err) {\r\n console.error(\r\n `[generate] Error occurred while parsing ${file.name}`,\r\n err\r\n );\r\n }\r\n }\r\n\r\n function addTranslationTree(file: InputTranslationFile, parsed: ParseTree) {\r\n const id = parsed.id;\r\n\r\n if (!id) {\r\n console.warn(\r\n '[generate] File does not have a valid book ID!',\r\n file.name,\r\n id\r\n );\r\n return;\r\n }\r\n\r\n const order = bookOrderMap.get(id);\r\n\r\n if (typeof order !== 'number') {\r\n console.warn('[generate] Book does not have an order!', id);\r\n return;\r\n }\r\n\r\n const bookMap = bookIdMap.get(file.metadata.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(file.metadata.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n file.metadata.language\r\n );\r\n unknownLanguages.add(file.metadata.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n }\r\n\r\n let translation = parsedTranslations.get(file.metadata.id);\r\n\r\n if (!translation) {\r\n translation = {\r\n ...omit(file.metadata, 'direction'),\r\n textDirection: file.metadata.direction,\r\n books: [],\r\n };\r\n output.translations.push(translation);\r\n parsedTranslations.set(file.metadata.id, translation);\r\n }\r\n\r\n const name = parsed.header ?? bookName?.commonName ?? parsed.title;\r\n\r\n if (!name) {\r\n console.warn(\r\n '[generate] Book does not have a name!',\r\n file.name,\r\n id\r\n );\r\n return;\r\n }\r\n\r\n const commonName =\r\n bookName?.commonName ?? parsed.header ?? parsed.title ?? id;\r\n\r\n const book: DatasetTranslationBook = {\r\n id: id,\r\n name,\r\n commonName,\r\n title: parsed.title ?? null,\r\n order,\r\n chapters: [],\r\n };\r\n\r\n for (let content of parsed.content) {\r\n if (content.type === 'chapter') {\r\n book.chapters.push({\r\n chapter: {\r\n number: content.number,\r\n content: content.content,\r\n footnotes: content.footnotes,\r\n },\r\n thisChapterAudioLinks: getAudioUrlsForChapter(\r\n translation.id,\r\n id,\r\n content.number\r\n ),\r\n });\r\n }\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n\r\n const index = sortedIndexBy(translation.books, book, (b) => b.order);\r\n translation.books.splice(index, 0, book);\r\n }\r\n\r\n function addCommentaryTree(\r\n file: InputCommentaryFile,\r\n parsed: CommentaryParseTree\r\n ) {\r\n let commentary = parsedCommentaries.get(file.metadata.id);\r\n\r\n if (!commentary) {\r\n commentary = {\r\n ...omit(file.metadata, 'direction'),\r\n textDirection: file.metadata.direction,\r\n books: [],\r\n };\r\n output.commentaries.push(commentary);\r\n parsedCommentaries.set(file.metadata.id, commentary);\r\n }\r\n\r\n for (let parsedBook of parsed.books) {\r\n let book = commentary.books.find((b) => b.id === parsedBook.book);\r\n if (book && book.introduction) {\r\n console.warn(\r\n '[generate] Book already exists in commentary!',\r\n file.name,\r\n parsedBook.book\r\n );\r\n continue;\r\n }\r\n\r\n if (!book) {\r\n const name = getBookNames(file, file.metadata, parsedBook.book);\r\n book = {\r\n id: parsedBook.book,\r\n order: bookOrderMap.get(parsedBook.book) ?? -1,\r\n commonName: name?.bookName?.commonName ?? parsedBook.book,\r\n name: name?.bookName?.commonName ?? parsedBook.book,\r\n chapters: [],\r\n };\r\n }\r\n\r\n if (parsedBook.introduction) {\r\n book.introduction = parsedBook.introduction;\r\n }\r\n\r\n for (let chapter of parsedBook.chapters) {\r\n let data: CommentaryChapterData = {\r\n number: chapter.number,\r\n content: chapter.verses,\r\n };\r\n\r\n if (chapter.introduction) {\r\n data.introduction = chapter.introduction;\r\n }\r\n\r\n book.chapters.push({\r\n chapter: data,\r\n });\r\n }\r\n\r\n book.chapters = sortBy(book.chapters, (c) => c.chapter.number);\r\n commentary.books.push(book);\r\n }\r\n\r\n commentary.books = sortBy(commentary.books, (b) => b.order);\r\n }\r\n\r\n function getBookNames(\r\n file: InputFileBase,\r\n metadata: MetadataBase,\r\n id: string\r\n ) {\r\n const bookMap = bookIdMap.get(metadata.language);\r\n\r\n if (!bookMap) {\r\n if (!unknownLanguages.has(metadata.language)) {\r\n console.warn(\r\n '[generate] File does not have a known language!',\r\n file.name,\r\n metadata.language\r\n );\r\n unknownLanguages.add(metadata.language);\r\n }\r\n }\r\n\r\n const bookName = bookMap?.get(id);\r\n\r\n if (!!bookMap && !bookName) {\r\n console.warn(\r\n '[generate] Book name not found for ID!',\r\n file.name,\r\n id\r\n );\r\n return null;\r\n }\r\n\r\n return {\r\n bookName,\r\n };\r\n }\r\n\r\n return output;\r\n}\r\n"],
|
|
5
|
+
"mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,yBAA2B;AAC3B,wBAA0B;AAe1B,wBAAwC;AACxC,oBAA4C;AAC5C,mBAAuC;AACvC,0BAA4B;AAC5B,mCAAoC;AA8D7B,SAAS,gBACZ,OACA,SAAoB,IAAI,WAAW,UAAU,GAChC;AACb,MAAI,SAAwB;AAAA,IACxB,cAAc,CAAC;AAAA,IACf,cAAc,CAAC;AAAA,EACnB;AAEA,MAAI,aAAa,IAAI,8BAAW;AAChC,MAAI,YAAY,IAAI,4BAAU,MAAM;AACpC,MAAI,cAAc,IAAI,gCAAY;AAClC,MAAI,sBAAsB,IAAI,iDAAoB;AAElD,MAAI,qBAAqB,oBAAI,IAAgC;AAC7D,MAAI,qBAAqB,oBAAI,IAA+B;AAE5D,QAAM,mBAAmB,oBAAI,IAAY;AACzC,WAAS,QAAQ,OAAO;AACpB,QAAI;AACA,UAAIA;AAKJ,UAAI,KAAK,aAAa,QAAQ;AAC1B,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,OAAO;AAChC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,QAAQ;AACjC,QAAAA,UAAS;AAAA,MACb,WAAW,KAAK,aAAa,kBAAkB;AAC3C,QAAAA,UAAS;AAAA,MACb,OAAO;AACH,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,QACT;AACA;AAAA,MACJ;AAEA,YAAM,SAASA,QAAO,MAAM,KAAK,OAAO;AAExC,UAAI,OAAO,SAAS,QAAQ;AACxB,2BAAmB,MAA8B,MAAM;AAAA,MAC3D,OAAO;AACH,0BAAkB,MAA6B,MAAM;AAAA,MACzD;AAAA,IACJ,SAAS,KAAK;AACV,cAAQ;AAAA,QACJ,2CAA2C,KAAK,IAAI;AAAA,QACpD;AAAA,MACJ;AAAA,IACJ;AAAA,EACJ;AAEA,WAAS,mBAAmB,MAA4B,QAAmB;AACvE,UAAM,KAAK,OAAO;AAElB,QAAI,CAAC,IAAI;AACL,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA;AAAA,IACJ;AAEA,UAAM,QAAQ,+BAAa,IAAI,EAAE;AAEjC,QAAI,OAAO,UAAU,UAAU;AAC3B,cAAQ,KAAK,2CAA2C,EAAE;AAC1D;AAAA,IACJ;AAEA,UAAM,UAAU,4BAAU,IAAI,KAAK,SAAS,QAAQ;AAEpD,QAAI,CAAC,SAAS;AACV,UAAI,CAAC,iBAAiB,IAAI,KAAK,SAAS,QAAQ,GAAG;AAC/C,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,KAAK,SAAS;AAAA,QAClB;AACA,yBAAiB,IAAI,KAAK,SAAS,QAAQ;AAAA,MAC/C;AAAA,IACJ;AAEA,UAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,QAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AAAA,IACJ;AAEA,QAAI,cAAc,mBAAmB,IAAI,KAAK,SAAS,EAAE;AAEzD,QAAI,CAAC,aAAa;AACd,oBAAc;AAAA,QACV,OAAG,oBAAK,KAAK,UAAU,WAAW;AAAA,QAClC,eAAe,KAAK,SAAS;AAAA,QAC7B,OAAO,CAAC;AAAA,MACZ;AACA,aAAO,aAAa,KAAK,WAAW;AACpC,yBAAmB,IAAI,KAAK,SAAS,IAAI,WAAW;AAAA,IACxD;AAEA,UAAM,OAAO,OAAO,UAAU,UAAU,cAAc,OAAO;AAE7D,QAAI,CAAC,MAAM;AACP,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA;AAAA,IACJ;AAEA,UAAM,aACF,UAAU,cAAc,OAAO,UAAU,OAAO,SAAS;AAE7D,UAAM,OAA+B;AAAA,MACjC;AAAA,MACA;AAAA,MACA;AAAA,MACA,OAAO,OAAO,SAAS;AAAA,MACvB;AAAA,MACA,UAAU,CAAC;AAAA,IACf;AAEA,aAAS,WAAW,OAAO,SAAS;AAChC,UAAI,QAAQ,SAAS,WAAW;AAC5B,aAAK,SAAS,KAAK;AAAA,UACf,SAAS;AAAA,YACL,QAAQ,QAAQ;AAAA,YAChB,SAAS,QAAQ;AAAA,YACjB,WAAW,QAAQ;AAAA,UACvB;AAAA,UACA,2BAAuB;AAAA,YACnB,YAAY;AAAA,YACZ;AAAA,YACA,QAAQ;AAAA,UACZ;AAAA,QACJ,CAAC;AAAA,MACL;AAAA,IACJ;AAEA,SAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAE7D,UAAM,YAAQ,6BAAc,YAAY,OAAO,MAAM,CAAC,MAAM,EAAE,KAAK;AACnE,gBAAY,MAAM,OAAO,OAAO,GAAG,IAAI;AAAA,EAC3C;AAEA,WAAS,kBACL,MACA,QACF;AACE,QAAI,aAAa,mBAAmB,IAAI,KAAK,SAAS,EAAE;AAExD,QAAI,CAAC,YAAY;AACb,mBAAa;AAAA,QACT,OAAG,oBAAK,KAAK,UAAU,WAAW;AAAA,QAClC,eAAe,KAAK,SAAS;AAAA,QAC7B,OAAO,CAAC;AAAA,MACZ;AACA,aAAO,aAAa,KAAK,UAAU;AACnC,yBAAmB,IAAI,KAAK,SAAS,IAAI,UAAU;AAAA,IACvD;AAEA,aAAS,cAAc,OAAO,OAAO;AACjC,UAAI,OAAO,WAAW,MAAM,KAAK,CAAC,MAAM,EAAE,OAAO,WAAW,IAAI;AAChE,UAAI,QAAQ,KAAK,cAAc;AAC3B,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,WAAW;AAAA,QACf;AACA;AAAA,MACJ;AAEA,UAAI,CAAC,MAAM;AACP,cAAM,OAAO,aAAa,MAAM,KAAK,UAAU,WAAW,IAAI;AAC9D,eAAO;AAAA,UACH,IAAI,WAAW;AAAA,UACf,OAAO,+BAAa,IAAI,WAAW,IAAI,KAAK;AAAA,UAC5C,YAAY,MAAM,UAAU,cAAc,WAAW;AAAA,UACrD,MAAM,MAAM,UAAU,cAAc,WAAW;AAAA,UAC/C,UAAU,CAAC;AAAA,QACf;AAAA,MACJ;AAEA,UAAI,WAAW,cAAc;AACzB,aAAK,eAAe,WAAW;AAAA,MACnC;AAEA,eAAS,WAAW,WAAW,UAAU;AACrC,YAAI,OAA8B;AAAA,UAC9B,QAAQ,QAAQ;AAAA,UAChB,SAAS,QAAQ;AAAA,QACrB;AAEA,YAAI,QAAQ,cAAc;AACtB,eAAK,eAAe,QAAQ;AAAA,QAChC;AAEA,aAAK,SAAS,KAAK;AAAA,UACf,SAAS;AAAA,QACb,CAAC;AAAA,MACL;AAEA,WAAK,eAAW,sBAAO,KAAK,UAAU,CAAC,MAAM,EAAE,QAAQ,MAAM;AAC7D,iBAAW,MAAM,KAAK,IAAI;AAAA,IAC9B;AAEA,eAAW,YAAQ,sBAAO,WAAW,OAAO,CAAC,MAAM,EAAE,KAAK;AAAA,EAC9D;AAEA,WAAS,aACL,MACA,UACA,IACF;AACE,UAAM,UAAU,4BAAU,IAAI,SAAS,QAAQ;AAE/C,QAAI,CAAC,SAAS;AACV,UAAI,CAAC,iBAAiB,IAAI,SAAS,QAAQ,GAAG;AAC1C,gBAAQ;AAAA,UACJ;AAAA,UACA,KAAK;AAAA,UACL,SAAS;AAAA,QACb;AACA,yBAAiB,IAAI,SAAS,QAAQ;AAAA,MAC1C;AAAA,IACJ;AAEA,UAAM,WAAW,SAAS,IAAI,EAAE;AAEhC,QAAI,CAAC,CAAC,WAAW,CAAC,UAAU;AACxB,cAAQ;AAAA,QACJ;AAAA,QACA,KAAK;AAAA,QACL;AAAA,MACJ;AACA,aAAO;AAAA,IACX;AAEA,WAAO;AAAA,MACH;AAAA,IACJ;AAAA,EACJ;AAEA,SAAO;AACX;",
|
|
6
|
+
"names": ["parser"]
|
|
7
|
+
}
|
|
@@ -0,0 +1,51 @@
|
|
|
1
|
+
"use strict";
|
|
2
|
+
var __create = Object.create;
|
|
3
|
+
var __defProp = Object.defineProperty;
|
|
4
|
+
var __getOwnPropDesc = Object.getOwnPropertyDescriptor;
|
|
5
|
+
var __getOwnPropNames = Object.getOwnPropertyNames;
|
|
6
|
+
var __getProtoOf = Object.getPrototypeOf;
|
|
7
|
+
var __hasOwnProp = Object.prototype.hasOwnProperty;
|
|
8
|
+
var __export = (target, all) => {
|
|
9
|
+
for (var name in all)
|
|
10
|
+
__defProp(target, name, { get: all[name], enumerable: true });
|
|
11
|
+
};
|
|
12
|
+
var __copyProps = (to, from, except, desc) => {
|
|
13
|
+
if (from && typeof from === "object" || typeof from === "function") {
|
|
14
|
+
for (let key of __getOwnPropNames(from))
|
|
15
|
+
if (!__hasOwnProp.call(to, key) && key !== except)
|
|
16
|
+
__defProp(to, key, { get: () => from[key], enumerable: !(desc = __getOwnPropDesc(from, key)) || desc.enumerable });
|
|
17
|
+
}
|
|
18
|
+
return to;
|
|
19
|
+
};
|
|
20
|
+
var __reExport = (target, mod, secondTarget) => (__copyProps(target, mod, "default"), secondTarget && __copyProps(secondTarget, mod, "default"));
|
|
21
|
+
var __toESM = (mod, isNodeMode, target) => (target = mod != null ? __create(__getProtoOf(mod)) : {}, __copyProps(
|
|
22
|
+
// If the importer is in node compatibility mode or this is not an ESM
|
|
23
|
+
// file that has been converted to a CommonJS file using a Babel-
|
|
24
|
+
// compatible transform (i.e. "__esModule" has not been set), then set
|
|
25
|
+
// "default" to the CommonJS "module.exports" for node compatibility.
|
|
26
|
+
isNodeMode || !mod || !mod.__esModule ? __defProp(target, "default", { value: mod, enumerable: true }) : target,
|
|
27
|
+
mod
|
|
28
|
+
));
|
|
29
|
+
var __toCommonJS = (mod) => __copyProps(__defProp({}, "__esModule", { value: true }), mod);
|
|
30
|
+
var generation_exports = {};
|
|
31
|
+
__export(generation_exports, {
|
|
32
|
+
api: () => api,
|
|
33
|
+
audio: () => audio,
|
|
34
|
+
bookOrder: () => bookOrder,
|
|
35
|
+
dataset: () => dataset
|
|
36
|
+
});
|
|
37
|
+
module.exports = __toCommonJS(generation_exports);
|
|
38
|
+
var api = __toESM(require("./api.js"));
|
|
39
|
+
var audio = __toESM(require("./audio.js"));
|
|
40
|
+
var dataset = __toESM(require("./dataset.js"));
|
|
41
|
+
var bookOrder = __toESM(require("./book-order.js"));
|
|
42
|
+
__reExport(generation_exports, require("./common-types.js"), module.exports);
|
|
43
|
+
// Annotate the CommonJS export names for ESM import in node:
|
|
44
|
+
0 && (module.exports = {
|
|
45
|
+
api,
|
|
46
|
+
audio,
|
|
47
|
+
bookOrder,
|
|
48
|
+
dataset,
|
|
49
|
+
...require("./common-types.js")
|
|
50
|
+
});
|
|
51
|
+
//# sourceMappingURL=index.cjs.map
|
|
@@ -0,0 +1,7 @@
|
|
|
1
|
+
{
|
|
2
|
+
"version": 3,
|
|
3
|
+
"sources": ["../../../generation/index.ts"],
|
|
4
|
+
"sourcesContent": ["import * as api from './api.js';\r\nimport * as audio from './audio.js';\r\nimport * as dataset from './dataset.js';\r\nimport * as bookOrder from './book-order.js';\r\nexport * from './common-types.js';\r\n\r\nexport { api, audio, dataset, bookOrder };\r\n"],
|
|
5
|
+
"mappings": ";;;;;;;;;;;;;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,UAAqB;AACrB,YAAuB;AACvB,cAAyB;AACzB,gBAA2B;AAC3B,+BAAc,8BAJd;",
|
|
6
|
+
"names": []
|
|
7
|
+
}
|
|
@@ -0,0 +1,45 @@
|
|
|
1
|
+
"use strict";
|
|
2
|
+
var __create = Object.create;
|
|
3
|
+
var __defProp = Object.defineProperty;
|
|
4
|
+
var __getOwnPropDesc = Object.getOwnPropertyDescriptor;
|
|
5
|
+
var __getOwnPropNames = Object.getOwnPropertyNames;
|
|
6
|
+
var __getProtoOf = Object.getPrototypeOf;
|
|
7
|
+
var __hasOwnProp = Object.prototype.hasOwnProperty;
|
|
8
|
+
var __export = (target, all) => {
|
|
9
|
+
for (var name in all)
|
|
10
|
+
__defProp(target, name, { get: all[name], enumerable: true });
|
|
11
|
+
};
|
|
12
|
+
var __copyProps = (to, from, except, desc) => {
|
|
13
|
+
if (from && typeof from === "object" || typeof from === "function") {
|
|
14
|
+
for (let key of __getOwnPropNames(from))
|
|
15
|
+
if (!__hasOwnProp.call(to, key) && key !== except)
|
|
16
|
+
__defProp(to, key, { get: () => from[key], enumerable: !(desc = __getOwnPropDesc(from, key)) || desc.enumerable });
|
|
17
|
+
}
|
|
18
|
+
return to;
|
|
19
|
+
};
|
|
20
|
+
var __toESM = (mod, isNodeMode, target) => (target = mod != null ? __create(__getProtoOf(mod)) : {}, __copyProps(
|
|
21
|
+
// If the importer is in node compatibility mode or this is not an ESM
|
|
22
|
+
// file that has been converted to a CommonJS file using a Babel-
|
|
23
|
+
// compatible transform (i.e. "__esModule" has not been set), then set
|
|
24
|
+
// "default" to the CommonJS "module.exports" for node compatibility.
|
|
25
|
+
isNodeMode || !mod || !mod.__esModule ? __defProp(target, "default", { value: mod, enumerable: true }) : target,
|
|
26
|
+
mod
|
|
27
|
+
));
|
|
28
|
+
var __toCommonJS = (mod) => __copyProps(__defProp({}, "__esModule", { value: true }), mod);
|
|
29
|
+
var helloao_tools_exports = {};
|
|
30
|
+
__export(helloao_tools_exports, {
|
|
31
|
+
generation: () => generation,
|
|
32
|
+
parser: () => parser,
|
|
33
|
+
utils: () => utils
|
|
34
|
+
});
|
|
35
|
+
module.exports = __toCommonJS(helloao_tools_exports);
|
|
36
|
+
var utils = __toESM(require("./utils.js"));
|
|
37
|
+
var generation = __toESM(require("./generation/index.js"));
|
|
38
|
+
var parser = __toESM(require("./parser/index.js"));
|
|
39
|
+
// Annotate the CommonJS export names for ESM import in node:
|
|
40
|
+
0 && (module.exports = {
|
|
41
|
+
generation,
|
|
42
|
+
parser,
|
|
43
|
+
utils
|
|
44
|
+
});
|
|
45
|
+
//# sourceMappingURL=index.cjs.map
|
|
@@ -0,0 +1,7 @@
|
|
|
1
|
+
{
|
|
2
|
+
"version": 3,
|
|
3
|
+
"sources": ["../../index.ts"],
|
|
4
|
+
"sourcesContent": ["import * as utils from './utils.js';\r\nimport * as generation from './generation/index.js';\r\nimport * as parser from './parser/index.js';\r\n\r\nexport { utils, generation, parser };\r\n"],
|
|
5
|
+
"mappings": ";;;;;;;;;;;;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,YAAuB;AACvB,iBAA4B;AAC5B,aAAwB;",
|
|
6
|
+
"names": []
|
|
7
|
+
}
|
|
@@ -0,0 +1,187 @@
|
|
|
1
|
+
"use strict";
|
|
2
|
+
var __defProp = Object.defineProperty;
|
|
3
|
+
var __getOwnPropDesc = Object.getOwnPropertyDescriptor;
|
|
4
|
+
var __getOwnPropNames = Object.getOwnPropertyNames;
|
|
5
|
+
var __hasOwnProp = Object.prototype.hasOwnProperty;
|
|
6
|
+
var __export = (target, all) => {
|
|
7
|
+
for (var name in all)
|
|
8
|
+
__defProp(target, name, { get: all[name], enumerable: true });
|
|
9
|
+
};
|
|
10
|
+
var __copyProps = (to, from, except, desc) => {
|
|
11
|
+
if (from && typeof from === "object" || typeof from === "function") {
|
|
12
|
+
for (let key of __getOwnPropNames(from))
|
|
13
|
+
if (!__hasOwnProp.call(to, key) && key !== except)
|
|
14
|
+
__defProp(to, key, { get: () => from[key], enumerable: !(desc = __getOwnPropDesc(from, key)) || desc.enumerable });
|
|
15
|
+
}
|
|
16
|
+
return to;
|
|
17
|
+
};
|
|
18
|
+
var __toCommonJS = (mod) => __copyProps(__defProp({}, "__esModule", { value: true }), mod);
|
|
19
|
+
var codex_parser_exports = {};
|
|
20
|
+
__export(codex_parser_exports, {
|
|
21
|
+
CodexParser: () => CodexParser,
|
|
22
|
+
chapterHeadingSchema: () => chapterHeadingSchema,
|
|
23
|
+
codexSchema: () => codexSchema,
|
|
24
|
+
metadataSchema: () => metadataSchema,
|
|
25
|
+
paratextSchema: () => paratextSchema,
|
|
26
|
+
verseSchema: () => verseSchema
|
|
27
|
+
});
|
|
28
|
+
module.exports = __toCommonJS(codex_parser_exports);
|
|
29
|
+
var import_zod = require("zod");
|
|
30
|
+
var import_utils = require("../utils.js");
|
|
31
|
+
const chapterHeadingSchema = import_zod.z.object({
|
|
32
|
+
type: import_zod.z.literal("chapter-heading"),
|
|
33
|
+
data: import_zod.z.object({
|
|
34
|
+
chapter: import_zod.z.coerce.number().int()
|
|
35
|
+
})
|
|
36
|
+
});
|
|
37
|
+
const verseSchema = import_zod.z.object({
|
|
38
|
+
type: import_zod.z.literal("text"),
|
|
39
|
+
id: import_zod.z.string()
|
|
40
|
+
});
|
|
41
|
+
const paratextSchema = import_zod.z.object({
|
|
42
|
+
type: import_zod.z.literal("paratext"),
|
|
43
|
+
id: import_zod.z.string()
|
|
44
|
+
});
|
|
45
|
+
const metadataSchema = import_zod.z.discriminatedUnion("type", [
|
|
46
|
+
chapterHeadingSchema,
|
|
47
|
+
verseSchema,
|
|
48
|
+
paratextSchema
|
|
49
|
+
]);
|
|
50
|
+
const codexSchema = import_zod.z.object({
|
|
51
|
+
cells: import_zod.z.array(
|
|
52
|
+
import_zod.z.object({
|
|
53
|
+
kind: import_zod.z.number(),
|
|
54
|
+
languageId: import_zod.z.string(),
|
|
55
|
+
value: import_zod.z.string(),
|
|
56
|
+
metadata: import_zod.z.object({
|
|
57
|
+
type: import_zod.z.string()
|
|
58
|
+
}).passthrough().nullable().optional()
|
|
59
|
+
})
|
|
60
|
+
)
|
|
61
|
+
});
|
|
62
|
+
class CodexParser {
|
|
63
|
+
// TODO:
|
|
64
|
+
// /**
|
|
65
|
+
// * Whether to preserve markdown in the parsed content.
|
|
66
|
+
// */
|
|
67
|
+
// preserveMarkdown: boolean = true;
|
|
68
|
+
_noteCounter = 0;
|
|
69
|
+
/**
|
|
70
|
+
* Parses the specified codex content.
|
|
71
|
+
*
|
|
72
|
+
* @param codex The codex content to parse.
|
|
73
|
+
* @returns The parse tree that was generated.
|
|
74
|
+
*/
|
|
75
|
+
parse(codex) {
|
|
76
|
+
const json = JSON.parse(codex);
|
|
77
|
+
const data = codexSchema.parse(json);
|
|
78
|
+
let root = {
|
|
79
|
+
type: "root",
|
|
80
|
+
content: []
|
|
81
|
+
};
|
|
82
|
+
let chapters = /* @__PURE__ */ new Map();
|
|
83
|
+
let lastChapter = null;
|
|
84
|
+
function addChapterContent(chapterNumber, content) {
|
|
85
|
+
let chapter = chapters.get(chapterNumber);
|
|
86
|
+
if (!chapter) {
|
|
87
|
+
chapter = {
|
|
88
|
+
type: "chapter",
|
|
89
|
+
number: chapterNumber,
|
|
90
|
+
content: [],
|
|
91
|
+
footnotes: []
|
|
92
|
+
};
|
|
93
|
+
lastChapter = chapter;
|
|
94
|
+
chapters.set(chapterNumber, chapter);
|
|
95
|
+
}
|
|
96
|
+
chapter.content.push(...content);
|
|
97
|
+
}
|
|
98
|
+
function addReference(ref, content) {
|
|
99
|
+
addChapterContent(ref.chapter, [
|
|
100
|
+
{
|
|
101
|
+
type: "verse",
|
|
102
|
+
number: ref.verse,
|
|
103
|
+
content
|
|
104
|
+
}
|
|
105
|
+
]);
|
|
106
|
+
}
|
|
107
|
+
function stripHTML(value) {
|
|
108
|
+
return value.replace(/<[^>]*>/g, "");
|
|
109
|
+
}
|
|
110
|
+
function toHeading(content) {
|
|
111
|
+
return {
|
|
112
|
+
type: "heading",
|
|
113
|
+
content: [content]
|
|
114
|
+
};
|
|
115
|
+
}
|
|
116
|
+
for (let cell of data.cells) {
|
|
117
|
+
if (cell.languageId === "html") {
|
|
118
|
+
if (!cell.metadata) continue;
|
|
119
|
+
const metadata = metadataSchema.parse(cell.metadata);
|
|
120
|
+
if (metadata.type === "text") {
|
|
121
|
+
const reference = (0, import_utils.parseVerseReference)(metadata.id);
|
|
122
|
+
if (!reference)
|
|
123
|
+
throw new Error("Could not find verse reference.");
|
|
124
|
+
if (!root.id) root.id = reference.book;
|
|
125
|
+
const content = stripHTML(cell.value);
|
|
126
|
+
const lines = content.split("\n").reduce((prev, current) => {
|
|
127
|
+
if (prev.length === 0) return [current];
|
|
128
|
+
else
|
|
129
|
+
return [
|
|
130
|
+
...prev,
|
|
131
|
+
{
|
|
132
|
+
lineBreak: true
|
|
133
|
+
},
|
|
134
|
+
current
|
|
135
|
+
];
|
|
136
|
+
}, []);
|
|
137
|
+
addReference(reference, lines);
|
|
138
|
+
} else if (metadata.type === "paratext") {
|
|
139
|
+
const reference = (0, import_utils.parseVerseReference)(`${metadata.id}:1`);
|
|
140
|
+
if (reference) {
|
|
141
|
+
const content = stripHTML(cell.value);
|
|
142
|
+
const lines = content.split("\n").reduce((prev, current) => {
|
|
143
|
+
if (prev.length === 0)
|
|
144
|
+
return [toHeading(current)];
|
|
145
|
+
else
|
|
146
|
+
return [
|
|
147
|
+
...prev,
|
|
148
|
+
{
|
|
149
|
+
type: "line_break"
|
|
150
|
+
},
|
|
151
|
+
toHeading(current)
|
|
152
|
+
];
|
|
153
|
+
}, []);
|
|
154
|
+
lines.forEach(
|
|
155
|
+
(line) => addChapterContent(reference.chapter, [line])
|
|
156
|
+
);
|
|
157
|
+
} else {
|
|
158
|
+
const content = stripHTML(cell.value);
|
|
159
|
+
if (!cell.metadata) {
|
|
160
|
+
if (lastChapter) {
|
|
161
|
+
lastChapter.footnotes.push({
|
|
162
|
+
noteId: this._noteCounter++,
|
|
163
|
+
text: content,
|
|
164
|
+
caller: null
|
|
165
|
+
});
|
|
166
|
+
}
|
|
167
|
+
}
|
|
168
|
+
}
|
|
169
|
+
}
|
|
170
|
+
}
|
|
171
|
+
}
|
|
172
|
+
for (let chapter of chapters.values()) {
|
|
173
|
+
root.content.push(chapter);
|
|
174
|
+
}
|
|
175
|
+
return root;
|
|
176
|
+
}
|
|
177
|
+
}
|
|
178
|
+
// Annotate the CommonJS export names for ESM import in node:
|
|
179
|
+
0 && (module.exports = {
|
|
180
|
+
CodexParser,
|
|
181
|
+
chapterHeadingSchema,
|
|
182
|
+
codexSchema,
|
|
183
|
+
metadataSchema,
|
|
184
|
+
paratextSchema,
|
|
185
|
+
verseSchema
|
|
186
|
+
});
|
|
187
|
+
//# sourceMappingURL=codex-parser.cjs.map
|
|
@@ -0,0 +1,7 @@
|
|
|
1
|
+
{
|
|
2
|
+
"version": 3,
|
|
3
|
+
"sources": ["../../../parser/codex-parser.ts"],
|
|
4
|
+
"sourcesContent": ["import { z } from 'zod';\r\nimport {\r\n Chapter,\r\n ChapterContent,\r\n ParseTree,\r\n Verse,\r\n VerseContent,\r\n} from './types.js';\r\nimport { parseVerseReference, VerseRef } from '../utils.js';\r\n\r\nexport const chapterHeadingSchema = z.object({\r\n type: z.literal('chapter-heading'),\r\n data: z.object({\r\n chapter: z.coerce.number().int(),\r\n }),\r\n});\r\n\r\nexport const verseSchema = z.object({\r\n type: z.literal('text'),\r\n id: z.string(),\r\n});\r\n\r\nexport const paratextSchema = z.object({\r\n type: z.literal('paratext'),\r\n id: z.string(),\r\n});\r\n\r\nexport const metadataSchema = z.discriminatedUnion('type', [\r\n chapterHeadingSchema,\r\n verseSchema,\r\n paratextSchema,\r\n]);\r\n\r\nexport const codexSchema = z.object({\r\n cells: z.array(\r\n z.object({\r\n kind: z.number(),\r\n languageId: z.string(),\r\n value: z.string(),\r\n metadata: z\r\n .object({\r\n type: z.string(),\r\n })\r\n .passthrough()\r\n .nullable()\r\n .optional(),\r\n })\r\n ),\r\n});\r\n\r\n/**\r\n * Defines a parser for codex files.\r\n */\r\nexport class CodexParser {\r\n // TODO:\r\n // /**\r\n // * Whether to preserve markdown in the parsed content.\r\n // */\r\n // preserveMarkdown: boolean = true;\r\n\r\n private _noteCounter: number = 0;\r\n\r\n /**\r\n * Parses the specified codex content.\r\n *\r\n * @param codex The codex content to parse.\r\n * @returns The parse tree that was generated.\r\n */\r\n public parse(codex: string): ParseTree {\r\n const json = JSON.parse(codex);\r\n const data = codexSchema.parse(json);\r\n\r\n let root: ParseTree = {\r\n type: 'root',\r\n content: [],\r\n };\r\n\r\n let chapters: Map<number, Chapter> = new Map();\r\n let lastChapter: Chapter | null = null;\r\n\r\n function addChapterContent(\r\n chapterNumber: number,\r\n content: ChapterContent[]\r\n ) {\r\n let chapter = chapters.get(chapterNumber);\r\n if (!chapter) {\r\n chapter = {\r\n type: 'chapter',\r\n number: chapterNumber,\r\n content: [],\r\n footnotes: [],\r\n };\r\n lastChapter = chapter;\r\n chapters.set(chapterNumber, chapter);\r\n }\r\n\r\n chapter.content.push(...content);\r\n }\r\n\r\n function addReference(ref: VerseRef, content: Verse['content']) {\r\n addChapterContent(ref.chapter, [\r\n {\r\n type: 'verse',\r\n number: ref.verse,\r\n content: content,\r\n },\r\n ]);\r\n }\r\n\r\n function stripHTML(value: string) {\r\n return value.replace(/<[^>]*>/g, '');\r\n }\r\n\r\n function toHeading(content: string) {\r\n return {\r\n type: 'heading',\r\n content: [content],\r\n } satisfies ChapterContent;\r\n }\r\n\r\n for (let cell of data.cells) {\r\n if (cell.languageId === 'html') {\r\n if (!cell.metadata) continue; // ignore html cells without metadata\r\n const metadata = metadataSchema.parse(cell.metadata);\r\n if (metadata.type === 'text') {\r\n const reference = parseVerseReference(metadata.id);\r\n if (!reference)\r\n throw new Error('Could not find verse reference.');\r\n\r\n if (!root.id) root.id = reference.book; // set book id if not already set\r\n\r\n const content = stripHTML(cell.value);\r\n\r\n // add line breaks in heading if there are multiple lines\r\n const lines = content\r\n .split('\\n')\r\n .reduce((prev, current) => {\r\n if (prev.length === 0) return [current];\r\n else\r\n return [\r\n ...prev,\r\n {\r\n lineBreak: true,\r\n },\r\n current,\r\n ] satisfies Verse['content'];\r\n }, [] as Verse['content']);\r\n\r\n addReference(reference, lines);\r\n } else if (metadata.type === 'paratext') {\r\n const reference = parseVerseReference(`${metadata.id}:1`); // chapter headings do not have a verse reference always default to 1\r\n if (reference) {\r\n const content = stripHTML(cell.value);\r\n\r\n // add line breaks in heading if there are multiple lines\r\n const lines = content\r\n .split('\\n')\r\n .reduce<ChapterContent[]>((prev, current) => {\r\n if (prev.length === 0)\r\n return [toHeading(current)];\r\n else\r\n return [\r\n ...prev,\r\n {\r\n type: 'line_break',\r\n },\r\n toHeading(current),\r\n ] satisfies ChapterContent[];\r\n }, []);\r\n\r\n lines.forEach((line) =>\r\n addChapterContent(reference.chapter, [line])\r\n );\r\n } else {\r\n // parse paratext that isn't a chapter reference as footnote\r\n const content = stripHTML(cell.value);\r\n if (!cell.metadata) {\r\n if (lastChapter) {\r\n (lastChapter as Chapter).footnotes.push({\r\n noteId: this._noteCounter++,\r\n text: content,\r\n caller: null,\r\n });\r\n }\r\n }\r\n }\r\n }\r\n }\r\n }\r\n\r\n for (let chapter of chapters.values()) {\r\n root.content.push(chapter);\r\n }\r\n\r\n return root;\r\n }\r\n}\r\n"],
|
|
5
|
+
"mappings": ";;;;;;;;;;;;;;;;;;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,iBAAkB;AAQlB,mBAA8C;AAEvC,MAAM,uBAAuB,aAAE,OAAO;AAAA,EACzC,MAAM,aAAE,QAAQ,iBAAiB;AAAA,EACjC,MAAM,aAAE,OAAO;AAAA,IACX,SAAS,aAAE,OAAO,OAAO,EAAE,IAAI;AAAA,EACnC,CAAC;AACL,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,MAAM,aAAE,QAAQ,MAAM;AAAA,EACtB,IAAI,aAAE,OAAO;AACjB,CAAC;AAEM,MAAM,iBAAiB,aAAE,OAAO;AAAA,EACnC,MAAM,aAAE,QAAQ,UAAU;AAAA,EAC1B,IAAI,aAAE,OAAO;AACjB,CAAC;AAEM,MAAM,iBAAiB,aAAE,mBAAmB,QAAQ;AAAA,EACvD;AAAA,EACA;AAAA,EACA;AACJ,CAAC;AAEM,MAAM,cAAc,aAAE,OAAO;AAAA,EAChC,OAAO,aAAE;AAAA,IACL,aAAE,OAAO;AAAA,MACL,MAAM,aAAE,OAAO;AAAA,MACf,YAAY,aAAE,OAAO;AAAA,MACrB,OAAO,aAAE,OAAO;AAAA,MAChB,UAAU,aACL,OAAO;AAAA,QACJ,MAAM,aAAE,OAAO;AAAA,MACnB,CAAC,EACA,YAAY,EACZ,SAAS,EACT,SAAS;AAAA,IAClB,CAAC;AAAA,EACL;AACJ,CAAC;AAKM,MAAM,YAAY;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAOb,eAAuB;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA;AAAA,EAQxB,MAAM,OAA0B;AACnC,UAAM,OAAO,KAAK,MAAM,KAAK;AAC7B,UAAM,OAAO,YAAY,MAAM,IAAI;AAEnC,QAAI,OAAkB;AAAA,MAClB,MAAM;AAAA,MACN,SAAS,CAAC;AAAA,IACd;AAEA,QAAI,WAAiC,oBAAI,IAAI;AAC7C,QAAI,cAA8B;AAElC,aAAS,kBACL,eACA,SACF;AACE,UAAI,UAAU,SAAS,IAAI,aAAa;AACxC,UAAI,CAAC,SAAS;AACV,kBAAU;AAAA,UACN,MAAM;AAAA,UACN,QAAQ;AAAA,UACR,SAAS,CAAC;AAAA,UACV,WAAW,CAAC;AAAA,QAChB;AACA,sBAAc;AACd,iBAAS,IAAI,eAAe,OAAO;AAAA,MACvC;AAEA,cAAQ,QAAQ,KAAK,GAAG,OAAO;AAAA,IACnC;AAEA,aAAS,aAAa,KAAe,SAA2B;AAC5D,wBAAkB,IAAI,SAAS;AAAA,QAC3B;AAAA,UACI,MAAM;AAAA,UACN,QAAQ,IAAI;AAAA,UACZ;AAAA,QACJ;AAAA,MACJ,CAAC;AAAA,IACL;AAEA,aAAS,UAAU,OAAe;AAC9B,aAAO,MAAM,QAAQ,YAAY,EAAE;AAAA,IACvC;AAEA,aAAS,UAAU,SAAiB;AAChC,aAAO;AAAA,QACH,MAAM;AAAA,QACN,SAAS,CAAC,OAAO;AAAA,MACrB;AAAA,IACJ;AAEA,aAAS,QAAQ,KAAK,OAAO;AACzB,UAAI,KAAK,eAAe,QAAQ;AAC5B,YAAI,CAAC,KAAK,SAAU;AACpB,cAAM,WAAW,eAAe,MAAM,KAAK,QAAQ;AACnD,YAAI,SAAS,SAAS,QAAQ;AAC1B,gBAAM,gBAAY,kCAAoB,SAAS,EAAE;AACjD,cAAI,CAAC;AACD,kBAAM,IAAI,MAAM,iCAAiC;AAErD,cAAI,CAAC,KAAK,GAAI,MAAK,KAAK,UAAU;AAElC,gBAAM,UAAU,UAAU,KAAK,KAAK;AAGpC,gBAAM,QAAQ,QACT,MAAM,IAAI,EACV,OAAO,CAAC,MAAM,YAAY;AACvB,gBAAI,KAAK,WAAW,EAAG,QAAO,CAAC,OAAO;AAAA;AAElC,qBAAO;AAAA,gBACH,GAAG;AAAA,gBACH;AAAA,kBACI,WAAW;AAAA,gBACf;AAAA,gBACA;AAAA,cACJ;AAAA,UACR,GAAG,CAAC,CAAqB;AAE7B,uBAAa,WAAW,KAAK;AAAA,QACjC,WAAW,SAAS,SAAS,YAAY;AACrC,gBAAM,gBAAY,kCAAoB,GAAG,SAAS,EAAE,IAAI;AACxD,cAAI,WAAW;AACX,kBAAM,UAAU,UAAU,KAAK,KAAK;AAGpC,kBAAM,QAAQ,QACT,MAAM,IAAI,EACV,OAAyB,CAAC,MAAM,YAAY;AACzC,kBAAI,KAAK,WAAW;AAChB,uBAAO,CAAC,UAAU,OAAO,CAAC;AAAA;AAE1B,uBAAO;AAAA,kBACH,GAAG;AAAA,kBACH;AAAA,oBACI,MAAM;AAAA,kBACV;AAAA,kBACA,UAAU,OAAO;AAAA,gBACrB;AAAA,YACR,GAAG,CAAC,CAAC;AAET,kBAAM;AAAA,cAAQ,CAAC,SACX,kBAAkB,UAAU,SAAS,CAAC,IAAI,CAAC;AAAA,YAC/C;AAAA,UACJ,OAAO;AAEH,kBAAM,UAAU,UAAU,KAAK,KAAK;AACpC,gBAAI,CAAC,KAAK,UAAU;AAChB,kBAAI,aAAa;AACb,gBAAC,YAAwB,UAAU,KAAK;AAAA,kBACpC,QAAQ,KAAK;AAAA,kBACb,MAAM;AAAA,kBACN,QAAQ;AAAA,gBACZ,CAAC;AAAA,cACL;AAAA,YACJ;AAAA,UACJ;AAAA,QACJ;AAAA,MACJ;AAAA,IACJ;AAEA,aAAS,WAAW,SAAS,OAAO,GAAG;AACnC,WAAK,QAAQ,KAAK,OAAO;AAAA,IAC7B;AAEA,WAAO;AAAA,EACX;AACJ;",
|
|
6
|
+
"names": []
|
|
7
|
+
}
|