xbintsc 0.1.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +21 -0
- package/README.md +191 -0
- package/bin/xbintsc.js +26 -0
- package/dist/src/ast/factory.d.ts +11 -0
- package/dist/src/ast/factory.js +36 -0
- package/dist/src/ast/factory.js.map +1 -0
- package/dist/src/ast/nodes.d.ts +848 -0
- package/dist/src/ast/nodes.js +247 -0
- package/dist/src/ast/nodes.js.map +1 -0
- package/dist/src/ast/visitor.d.ts +18 -0
- package/dist/src/ast/visitor.js +52 -0
- package/dist/src/ast/visitor.js.map +1 -0
- package/dist/src/binder/binder.d.ts +82 -0
- package/dist/src/binder/binder.js +443 -0
- package/dist/src/binder/binder.js.map +1 -0
- package/dist/src/cli/main.d.ts +16 -0
- package/dist/src/cli/main.js +191 -0
- package/dist/src/cli/main.js.map +1 -0
- package/dist/src/codegen/llvm.d.ts +31 -0
- package/dist/src/codegen/llvm.js +1178 -0
- package/dist/src/codegen/llvm.js.map +1 -0
- package/dist/src/codegen/values.d.ts +23 -0
- package/dist/src/codegen/values.js +32 -0
- package/dist/src/codegen/values.js.map +1 -0
- package/dist/src/diagnostics/diagnostic.d.ts +69 -0
- package/dist/src/diagnostics/diagnostic.js +104 -0
- package/dist/src/diagnostics/diagnostic.js.map +1 -0
- package/dist/src/diagnostics/source.d.ts +43 -0
- package/dist/src/diagnostics/source.js +73 -0
- package/dist/src/diagnostics/source.js.map +1 -0
- package/dist/src/driver/cache.d.ts +37 -0
- package/dist/src/driver/cache.js +82 -0
- package/dist/src/driver/cache.js.map +1 -0
- package/dist/src/driver/compiler.d.ts +41 -0
- package/dist/src/driver/compiler.js +128 -0
- package/dist/src/driver/compiler.js.map +1 -0
- package/dist/src/driver/index.d.ts +4 -0
- package/dist/src/driver/index.js +5 -0
- package/dist/src/driver/index.js.map +1 -0
- package/dist/src/driver/paths.d.ts +4 -0
- package/dist/src/driver/paths.js +22 -0
- package/dist/src/driver/paths.js.map +1 -0
- package/dist/src/driver/toolchain.d.ts +43 -0
- package/dist/src/driver/toolchain.js +76 -0
- package/dist/src/driver/toolchain.js.map +1 -0
- package/dist/src/extensions/node.d.ts +9 -0
- package/dist/src/extensions/node.js +20 -0
- package/dist/src/extensions/node.js.map +1 -0
- package/dist/src/extensions/registry.d.ts +45 -0
- package/dist/src/extensions/registry.js +76 -0
- package/dist/src/extensions/registry.js.map +1 -0
- package/dist/src/index.d.ts +18 -0
- package/dist/src/index.js +19 -0
- package/dist/src/index.js.map +1 -0
- package/dist/src/lexer/scanner.d.ts +48 -0
- package/dist/src/lexer/scanner.js +650 -0
- package/dist/src/lexer/scanner.js.map +1 -0
- package/dist/src/lexer/token.d.ts +170 -0
- package/dist/src/lexer/token.js +250 -0
- package/dist/src/lexer/token.js.map +1 -0
- package/dist/src/parser/parser.d.ts +127 -0
- package/dist/src/parser/parser.js +2334 -0
- package/dist/src/parser/parser.js.map +1 -0
- package/dist/tests/binder/binder.test.d.ts +1 -0
- package/dist/tests/binder/binder.test.js +89 -0
- package/dist/tests/binder/binder.test.js.map +1 -0
- package/dist/tests/cli/main.test.d.ts +1 -0
- package/dist/tests/cli/main.test.js +68 -0
- package/dist/tests/cli/main.test.js.map +1 -0
- package/dist/tests/cli/process.test.d.ts +9 -0
- package/dist/tests/cli/process.test.js +57 -0
- package/dist/tests/cli/process.test.js.map +1 -0
- package/dist/tests/codegen/llvm.test.d.ts +1 -0
- package/dist/tests/codegen/llvm.test.js +93 -0
- package/dist/tests/codegen/llvm.test.js.map +1 -0
- package/dist/tests/driver/cache.test.d.ts +1 -0
- package/dist/tests/driver/cache.test.js +66 -0
- package/dist/tests/driver/cache.test.js.map +1 -0
- package/dist/tests/driver/compiler.test.d.ts +1 -0
- package/dist/tests/driver/compiler.test.js +80 -0
- package/dist/tests/driver/compiler.test.js.map +1 -0
- package/dist/tests/driver/toolchain.test.d.ts +1 -0
- package/dist/tests/driver/toolchain.test.js +60 -0
- package/dist/tests/driver/toolchain.test.js.map +1 -0
- package/dist/tests/e2e/compile.test.d.ts +5 -0
- package/dist/tests/e2e/compile.test.js +93 -0
- package/dist/tests/e2e/compile.test.js.map +1 -0
- package/dist/tests/extensions/registry.test.d.ts +1 -0
- package/dist/tests/extensions/registry.test.js +47 -0
- package/dist/tests/extensions/registry.test.js.map +1 -0
- package/dist/tests/helpers.d.ts +23 -0
- package/dist/tests/helpers.js +41 -0
- package/dist/tests/helpers.js.map +1 -0
- package/dist/tests/lexer/scanner.test.d.ts +1 -0
- package/dist/tests/lexer/scanner.test.js +95 -0
- package/dist/tests/lexer/scanner.test.js.map +1 -0
- package/dist/tests/parser/parser.test.d.ts +1 -0
- package/dist/tests/parser/parser.test.js +137 -0
- package/dist/tests/parser/parser.test.js.map +1 -0
- package/package.json +49 -0
- package/runtime/ext_node.c +42 -0
- package/runtime/rt.h +177 -0
- package/runtime/xt_runtime.c +682 -0
- package/scripts/build-runtime.mjs +34 -0
- package/src/ast/factory.ts +37 -0
- package/src/ast/nodes.ts +1111 -0
- package/src/ast/visitor.ts +60 -0
- package/src/binder/binder.ts +549 -0
- package/src/cli/main.ts +210 -0
- package/src/codegen/llvm.ts +1324 -0
- package/src/codegen/values.ts +36 -0
- package/src/diagnostics/diagnostic.ts +132 -0
- package/src/diagnostics/source.ts +97 -0
- package/src/driver/cache.ts +96 -0
- package/src/driver/compiler.ts +197 -0
- package/src/driver/index.ts +4 -0
- package/src/driver/paths.ts +24 -0
- package/src/driver/toolchain.ts +103 -0
- package/src/extensions/node.ts +23 -0
- package/src/extensions/registry.ts +101 -0
- package/src/index.ts +33 -0
- package/src/lexer/scanner.ts +650 -0
- package/src/lexer/token.ts +266 -0
- package/src/parser/parser.ts +2396 -0
|
@@ -0,0 +1,650 @@
|
|
|
1
|
+
import { DiagnosticBag, DiagnosticCode } from "../diagnostics/diagnostic.js";
|
|
2
|
+
import type { SourceFile } from "../diagnostics/source.js";
|
|
3
|
+
import { KEYWORDS, Token, TokenKind } from "./token.js";
|
|
4
|
+
|
|
5
|
+
const enum Char {
|
|
6
|
+
Null = 0,
|
|
7
|
+
Tab = 9,
|
|
8
|
+
LineFeed = 10,
|
|
9
|
+
VerticalTab = 11,
|
|
10
|
+
FormFeed = 12,
|
|
11
|
+
CarriageReturn = 13,
|
|
12
|
+
Space = 32,
|
|
13
|
+
Exclamation = 33,
|
|
14
|
+
DoubleQuote = 34,
|
|
15
|
+
Hash = 35,
|
|
16
|
+
Dollar = 36,
|
|
17
|
+
Percent = 37,
|
|
18
|
+
Ampersand = 38,
|
|
19
|
+
SingleQuote = 39,
|
|
20
|
+
OpenParen = 40,
|
|
21
|
+
CloseParen = 41,
|
|
22
|
+
Asterisk = 42,
|
|
23
|
+
Plus = 43,
|
|
24
|
+
Comma = 44,
|
|
25
|
+
Minus = 45,
|
|
26
|
+
Dot = 46,
|
|
27
|
+
Slash = 47,
|
|
28
|
+
Zero = 48,
|
|
29
|
+
Nine = 57,
|
|
30
|
+
Colon = 58,
|
|
31
|
+
Semicolon = 59,
|
|
32
|
+
LessThan = 60,
|
|
33
|
+
Equals = 61,
|
|
34
|
+
GreaterThan = 62,
|
|
35
|
+
Question = 63,
|
|
36
|
+
At = 64,
|
|
37
|
+
UpperA = 65,
|
|
38
|
+
UpperB = 66,
|
|
39
|
+
UpperE = 69,
|
|
40
|
+
UpperF = 70,
|
|
41
|
+
UpperO = 79,
|
|
42
|
+
UpperX = 88,
|
|
43
|
+
UpperZ = 90,
|
|
44
|
+
OpenBracket = 91,
|
|
45
|
+
Backslash = 92,
|
|
46
|
+
CloseBracket = 93,
|
|
47
|
+
Caret = 94,
|
|
48
|
+
Underscore = 95,
|
|
49
|
+
Backtick = 96,
|
|
50
|
+
LowerA = 97,
|
|
51
|
+
LowerB = 98,
|
|
52
|
+
LowerE = 101,
|
|
53
|
+
LowerF = 102,
|
|
54
|
+
LowerN = 110,
|
|
55
|
+
LowerO = 111,
|
|
56
|
+
LowerR = 114,
|
|
57
|
+
LowerT = 116,
|
|
58
|
+
LowerU = 117,
|
|
59
|
+
LowerX = 120,
|
|
60
|
+
LowerZ = 122,
|
|
61
|
+
OpenBrace = 123,
|
|
62
|
+
Bar = 124,
|
|
63
|
+
CloseBrace = 125,
|
|
64
|
+
Tilde = 126,
|
|
65
|
+
NonBreakingSpace = 0xa0,
|
|
66
|
+
LineSeparator = 0x2028,
|
|
67
|
+
ParagraphSeparator = 0x2029,
|
|
68
|
+
ByteOrderMark = 0xfeff,
|
|
69
|
+
}
|
|
70
|
+
|
|
71
|
+
function isLineBreak(ch: number): boolean {
|
|
72
|
+
return ch === Char.LineFeed || ch === Char.CarriageReturn || ch === Char.LineSeparator || ch === Char.ParagraphSeparator;
|
|
73
|
+
}
|
|
74
|
+
|
|
75
|
+
function isWhiteSpace(ch: number): boolean {
|
|
76
|
+
return (
|
|
77
|
+
ch === Char.Space ||
|
|
78
|
+
ch === Char.Tab ||
|
|
79
|
+
ch === Char.VerticalTab ||
|
|
80
|
+
ch === Char.FormFeed ||
|
|
81
|
+
ch === Char.NonBreakingSpace ||
|
|
82
|
+
ch === Char.ByteOrderMark ||
|
|
83
|
+
(ch > 0x1680 && WHITESPACE_UNICODE.has(ch))
|
|
84
|
+
);
|
|
85
|
+
}
|
|
86
|
+
|
|
87
|
+
const WHITESPACE_UNICODE = new Set<number>([
|
|
88
|
+
0x1680, 0x2000, 0x2001, 0x2002, 0x2003, 0x2004, 0x2005, 0x2006, 0x2007, 0x2008, 0x2009, 0x200a, 0x202f, 0x205f,
|
|
89
|
+
0x3000,
|
|
90
|
+
]);
|
|
91
|
+
|
|
92
|
+
function isDigit(ch: number): boolean {
|
|
93
|
+
return ch >= Char.Zero && ch <= Char.Nine;
|
|
94
|
+
}
|
|
95
|
+
|
|
96
|
+
function isHexDigit(ch: number): boolean {
|
|
97
|
+
return isDigit(ch) || (ch >= Char.LowerA && ch <= Char.LowerF) || (ch >= Char.UpperA && ch <= Char.UpperF);
|
|
98
|
+
}
|
|
99
|
+
|
|
100
|
+
function isIdentifierStart(ch: number): boolean {
|
|
101
|
+
return (
|
|
102
|
+
(ch >= Char.LowerA && ch <= Char.LowerZ) ||
|
|
103
|
+
(ch >= Char.UpperA && ch <= Char.UpperZ) ||
|
|
104
|
+
ch === Char.Dollar ||
|
|
105
|
+
ch === Char.Underscore ||
|
|
106
|
+
ch > 0x7f
|
|
107
|
+
);
|
|
108
|
+
}
|
|
109
|
+
|
|
110
|
+
function isIdentifierPart(ch: number): boolean {
|
|
111
|
+
return isIdentifierStart(ch) || isDigit(ch) || ch === Char.Backslash || ch > 0x7f;
|
|
112
|
+
}
|
|
113
|
+
|
|
114
|
+
/**
|
|
115
|
+
* Hand-written scanner for the TypeScript language. It produces a flat token
|
|
116
|
+
* stream consumed by the parser. Comments and trivia are skipped, but line
|
|
117
|
+
* breaks are tracked so the parser can implement ASI (automatic semicolon
|
|
118
|
+
* insertion) correctly.
|
|
119
|
+
*/
|
|
120
|
+
export class Scanner {
|
|
121
|
+
private readonly text: string;
|
|
122
|
+
private pos = 0;
|
|
123
|
+
private readonly diagnostics: DiagnosticBag;
|
|
124
|
+
private readonly source: SourceFile;
|
|
125
|
+
private _token: Token = {
|
|
126
|
+
kind: TokenKind.EndOfFile,
|
|
127
|
+
start: 0,
|
|
128
|
+
end: 0,
|
|
129
|
+
text: "",
|
|
130
|
+
precededByLineBreak: false,
|
|
131
|
+
};
|
|
132
|
+
|
|
133
|
+
constructor(source: SourceFile, diagnostics: DiagnosticBag) {
|
|
134
|
+
this.source = source;
|
|
135
|
+
this.text = source.text;
|
|
136
|
+
this.diagnostics = diagnostics;
|
|
137
|
+
}
|
|
138
|
+
|
|
139
|
+
get token(): Token {
|
|
140
|
+
return this._token;
|
|
141
|
+
}
|
|
142
|
+
|
|
143
|
+
get position(): number {
|
|
144
|
+
return this.pos;
|
|
145
|
+
}
|
|
146
|
+
|
|
147
|
+
/**
|
|
148
|
+
* Reset the scanner read head. Used by the parser to re-scan the `}` that
|
|
149
|
+
* terminates a template substitution as template text instead of a brace.
|
|
150
|
+
*/
|
|
151
|
+
seek(offset: number): void {
|
|
152
|
+
this.pos = Math.max(0, Math.min(offset, this.text.length));
|
|
153
|
+
}
|
|
154
|
+
|
|
155
|
+
/** Advance to the next token. */
|
|
156
|
+
nextToken(): Token {
|
|
157
|
+
this._token = this.scan();
|
|
158
|
+
return this._token;
|
|
159
|
+
}
|
|
160
|
+
|
|
161
|
+
/** Scan everything, useful for lexer tests. */
|
|
162
|
+
tokenize(): Token[] {
|
|
163
|
+
const tokens: Token[] = [];
|
|
164
|
+
for (;;) {
|
|
165
|
+
const token = this.nextToken();
|
|
166
|
+
tokens.push(token);
|
|
167
|
+
if (token.kind === TokenKind.EndOfFile) break;
|
|
168
|
+
}
|
|
169
|
+
return tokens;
|
|
170
|
+
}
|
|
171
|
+
|
|
172
|
+
private error(code: DiagnosticCode, message: string, start: number, end = this.pos): void {
|
|
173
|
+
this.diagnostics.error(code, message, { start, end }, this.source.fileName);
|
|
174
|
+
}
|
|
175
|
+
|
|
176
|
+
private scan(): Token {
|
|
177
|
+
let precededByLineBreak = false;
|
|
178
|
+
// Skip trivia.
|
|
179
|
+
for (;;) {
|
|
180
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
181
|
+
if (Number.isNaN(ch)) break; // EOF
|
|
182
|
+
if (ch === Char.LineFeed || ch === Char.CarriageReturn) {
|
|
183
|
+
precededByLineBreak = true;
|
|
184
|
+
this.pos++;
|
|
185
|
+
continue;
|
|
186
|
+
}
|
|
187
|
+
if (isLineBreak(ch)) {
|
|
188
|
+
precededByLineBreak = true;
|
|
189
|
+
this.pos++;
|
|
190
|
+
continue;
|
|
191
|
+
}
|
|
192
|
+
if (isWhiteSpace(ch)) {
|
|
193
|
+
this.pos++;
|
|
194
|
+
continue;
|
|
195
|
+
}
|
|
196
|
+
if (ch === Char.Slash && this.text.charCodeAt(this.pos + 1) === Char.Slash) {
|
|
197
|
+
this.pos += 2;
|
|
198
|
+
while (this.pos < this.text.length && !isLineBreak(this.text.charCodeAt(this.pos))) this.pos++;
|
|
199
|
+
continue;
|
|
200
|
+
}
|
|
201
|
+
if (ch === Char.Slash && this.text.charCodeAt(this.pos + 1) === Char.Asterisk) {
|
|
202
|
+
const start = this.pos;
|
|
203
|
+
this.pos += 2;
|
|
204
|
+
let closed = false;
|
|
205
|
+
while (this.pos < this.text.length) {
|
|
206
|
+
if (this.text.charCodeAt(this.pos) === Char.Asterisk && this.text.charCodeAt(this.pos + 1) === Char.Slash) {
|
|
207
|
+
this.pos += 2;
|
|
208
|
+
closed = true;
|
|
209
|
+
break;
|
|
210
|
+
}
|
|
211
|
+
if (isLineBreak(this.text.charCodeAt(this.pos))) precededByLineBreak = true;
|
|
212
|
+
this.pos++;
|
|
213
|
+
}
|
|
214
|
+
if (!closed) this.error(DiagnosticCode.UnterminatedComment, "Unterminated block comment", start);
|
|
215
|
+
continue;
|
|
216
|
+
}
|
|
217
|
+
break;
|
|
218
|
+
}
|
|
219
|
+
|
|
220
|
+
const start = this.pos;
|
|
221
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
222
|
+
|
|
223
|
+
if (Number.isNaN(ch)) {
|
|
224
|
+
return this.makeToken(TokenKind.EndOfFile, start, start, "", precededByLineBreak);
|
|
225
|
+
}
|
|
226
|
+
|
|
227
|
+
// Identifiers / keywords.
|
|
228
|
+
if (isIdentifierStart(ch)) {
|
|
229
|
+
return this.scanIdentifier(start, precededByLineBreak);
|
|
230
|
+
}
|
|
231
|
+
|
|
232
|
+
// Numeric literals.
|
|
233
|
+
if (isDigit(ch)) {
|
|
234
|
+
return this.scanNumber(start, precededByLineBreak);
|
|
235
|
+
}
|
|
236
|
+
if (ch === Char.Dot && isDigit(this.text.charCodeAt(this.pos + 1))) {
|
|
237
|
+
return this.scanNumber(start, precededByLineBreak);
|
|
238
|
+
}
|
|
239
|
+
|
|
240
|
+
// String literals.
|
|
241
|
+
if (ch === Char.SingleQuote || ch === Char.DoubleQuote) {
|
|
242
|
+
return this.scanString(start, precededByLineBreak, ch);
|
|
243
|
+
}
|
|
244
|
+
|
|
245
|
+
// Template literals.
|
|
246
|
+
if (ch === Char.Backtick) {
|
|
247
|
+
return this.scanTemplate(start, precededByLineBreak, /* isHead */ true);
|
|
248
|
+
}
|
|
249
|
+
|
|
250
|
+
if (ch === Char.Hash) {
|
|
251
|
+
this.pos++;
|
|
252
|
+
const name = this.scanIdentifier(this.pos, precededByLineBreak);
|
|
253
|
+
return this.makeToken(TokenKind.PrivateIdentifier, start, name.end, this.text.slice(start, name.end), precededByLineBreak);
|
|
254
|
+
}
|
|
255
|
+
|
|
256
|
+
return this.scanPunctuation(start, precededByLineBreak);
|
|
257
|
+
}
|
|
258
|
+
|
|
259
|
+
private makeToken(
|
|
260
|
+
kind: TokenKind,
|
|
261
|
+
start: number,
|
|
262
|
+
end: number,
|
|
263
|
+
text: string,
|
|
264
|
+
precededByLineBreak: boolean,
|
|
265
|
+
value?: string | number | bigint,
|
|
266
|
+
): Token {
|
|
267
|
+
return { kind, start, end, text, value, precededByLineBreak };
|
|
268
|
+
}
|
|
269
|
+
|
|
270
|
+
private scanIdentifier(start: number, precededByLineBreak: boolean): Token {
|
|
271
|
+
this.pos++;
|
|
272
|
+
while (this.pos < this.text.length) {
|
|
273
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
274
|
+
if (isIdentifierPart(ch)) {
|
|
275
|
+
this.pos++;
|
|
276
|
+
} else if (ch === Char.Backslash && this.text.charCodeAt(this.pos + 1) === Char.LowerU) {
|
|
277
|
+
this.pos += 2;
|
|
278
|
+
const hex = this.text.slice(this.pos, this.pos + 4);
|
|
279
|
+
this.pos += 4;
|
|
280
|
+
if (!/^[0-9a-fA-F]{4}$/.test(hex)) {
|
|
281
|
+
this.error(DiagnosticCode.InvalidEscape, "Invalid unicode escape in identifier", this.pos - 4, this.pos);
|
|
282
|
+
}
|
|
283
|
+
} else {
|
|
284
|
+
break;
|
|
285
|
+
}
|
|
286
|
+
}
|
|
287
|
+
const text = this.text.slice(start, this.pos);
|
|
288
|
+
const keyword = KEYWORDS.get(text);
|
|
289
|
+
const kind = keyword ?? TokenKind.Identifier;
|
|
290
|
+
return this.makeToken(kind, start, this.pos, text, precededByLineBreak);
|
|
291
|
+
}
|
|
292
|
+
|
|
293
|
+
private scanNumber(start: number, precededByLineBreak: boolean): Token {
|
|
294
|
+
const text = this.text;
|
|
295
|
+
let isBigInt = false;
|
|
296
|
+
// Radix prefixes.
|
|
297
|
+
if (text.charCodeAt(this.pos) === Char.Zero) {
|
|
298
|
+
const next = text.charCodeAt(this.pos + 1);
|
|
299
|
+
if (next === Char.LowerX || next === Char.UpperX) {
|
|
300
|
+
this.pos += 2;
|
|
301
|
+
while (isHexDigit(text.charCodeAt(this.pos)) || text.charCodeAt(this.pos) === Char.Underscore) this.pos++;
|
|
302
|
+
isBigInt = text.charCodeAt(this.pos) === Char.LowerN;
|
|
303
|
+
if (isBigInt) this.pos++;
|
|
304
|
+
return this.finishNumber(start, precededByLineBreak, isBigInt);
|
|
305
|
+
}
|
|
306
|
+
if (next === Char.LowerO || next === Char.UpperO || next === Char.LowerB || next === Char.UpperB) {
|
|
307
|
+
this.pos += 2;
|
|
308
|
+
while (isDigit(text.charCodeAt(this.pos)) || text.charCodeAt(this.pos) === Char.Underscore) this.pos++;
|
|
309
|
+
isBigInt = text.charCodeAt(this.pos) === Char.LowerN;
|
|
310
|
+
if (isBigInt) this.pos++;
|
|
311
|
+
return this.finishNumber(start, precededByLineBreak, isBigInt);
|
|
312
|
+
}
|
|
313
|
+
}
|
|
314
|
+
|
|
315
|
+
while (isDigit(text.charCodeAt(this.pos)) || text.charCodeAt(this.pos) === Char.Underscore) this.pos++;
|
|
316
|
+
if (text.charCodeAt(this.pos) === Char.Dot) {
|
|
317
|
+
this.pos++;
|
|
318
|
+
while (isDigit(text.charCodeAt(this.pos)) || text.charCodeAt(this.pos) === Char.Underscore) this.pos++;
|
|
319
|
+
}
|
|
320
|
+
const e = text.charCodeAt(this.pos);
|
|
321
|
+
if (e === Char.LowerE || e === Char.UpperE) {
|
|
322
|
+
const save = this.pos;
|
|
323
|
+
this.pos++;
|
|
324
|
+
const sign = text.charCodeAt(this.pos);
|
|
325
|
+
if (sign === Char.Plus || sign === Char.Minus) this.pos++;
|
|
326
|
+
if (isDigit(text.charCodeAt(this.pos))) {
|
|
327
|
+
while (isDigit(text.charCodeAt(this.pos)) || text.charCodeAt(this.pos) === Char.Underscore) this.pos++;
|
|
328
|
+
} else {
|
|
329
|
+
// Not an exponent, roll back.
|
|
330
|
+
this.pos = save;
|
|
331
|
+
}
|
|
332
|
+
}
|
|
333
|
+
isBigInt = text.charCodeAt(this.pos) === Char.LowerN;
|
|
334
|
+
if (isBigInt) this.pos++;
|
|
335
|
+
return this.finishNumber(start, precededByLineBreak, isBigInt);
|
|
336
|
+
}
|
|
337
|
+
|
|
338
|
+
private finishNumber(start: number, precededByLineBreak: boolean, isBigInt: boolean): Token {
|
|
339
|
+
let raw = this.text.slice(start, this.pos);
|
|
340
|
+
const cleaned = raw.replace(/_/g, "");
|
|
341
|
+
if (isBigInt) {
|
|
342
|
+
raw = raw.slice(0, -1).replace(/_/g, "");
|
|
343
|
+
try {
|
|
344
|
+
return this.makeToken(TokenKind.BigIntLiteral, start, this.pos, raw, precededByLineBreak, BigInt(raw));
|
|
345
|
+
} catch {
|
|
346
|
+
this.error(DiagnosticCode.InvalidNumber, `Invalid BigInt literal '${raw}'`, start, this.pos);
|
|
347
|
+
return this.makeToken(TokenKind.BigIntLiteral, start, this.pos, raw, precededByLineBreak, 0n);
|
|
348
|
+
}
|
|
349
|
+
}
|
|
350
|
+
let value: number;
|
|
351
|
+
if (/^0[xX]/.test(cleaned)) value = parseInt(cleaned.slice(2), 16);
|
|
352
|
+
else if (/^0[oO]/.test(cleaned)) value = parseInt(cleaned.slice(2), 8);
|
|
353
|
+
else if (/^0[bB]/.test(cleaned)) value = parseInt(cleaned.slice(2), 2);
|
|
354
|
+
else value = Number(cleaned);
|
|
355
|
+
if (Number.isNaN(value)) {
|
|
356
|
+
this.error(DiagnosticCode.InvalidNumber, `Invalid numeric literal '${raw}'`, start, this.pos);
|
|
357
|
+
value = 0;
|
|
358
|
+
}
|
|
359
|
+
return this.makeToken(TokenKind.NumericLiteral, start, this.pos, raw, precededByLineBreak, value);
|
|
360
|
+
}
|
|
361
|
+
|
|
362
|
+
private scanString(start: number, precededByLineBreak: boolean, quote: number): Token {
|
|
363
|
+
this.pos++;
|
|
364
|
+
let result = "";
|
|
365
|
+
while (this.pos < this.text.length) {
|
|
366
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
367
|
+
if (ch === quote) {
|
|
368
|
+
this.pos++;
|
|
369
|
+
return this.makeToken(TokenKind.StringLiteral, start, this.pos, this.text.slice(start, this.pos), precededByLineBreak, result);
|
|
370
|
+
}
|
|
371
|
+
if (ch === Char.Backslash) {
|
|
372
|
+
result += this.scanEscapeSequence();
|
|
373
|
+
continue;
|
|
374
|
+
}
|
|
375
|
+
if (isLineBreak(ch)) {
|
|
376
|
+
this.error(DiagnosticCode.UnterminatedString, "Unterminated string literal", start);
|
|
377
|
+
break;
|
|
378
|
+
}
|
|
379
|
+
result += this.text[this.pos];
|
|
380
|
+
this.pos++;
|
|
381
|
+
}
|
|
382
|
+
this.error(DiagnosticCode.UnterminatedString, "Unterminated string literal", start);
|
|
383
|
+
return this.makeToken(TokenKind.StringLiteral, start, this.pos, this.text.slice(start, this.pos), precededByLineBreak, result);
|
|
384
|
+
}
|
|
385
|
+
|
|
386
|
+
private scanEscapeSequence(): string {
|
|
387
|
+
this.pos++; // backslash
|
|
388
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
389
|
+
switch (ch) {
|
|
390
|
+
case Char.LowerN:
|
|
391
|
+
this.pos++;
|
|
392
|
+
return "\n";
|
|
393
|
+
case Char.LowerT:
|
|
394
|
+
this.pos++;
|
|
395
|
+
return "\t";
|
|
396
|
+
case Char.LowerR:
|
|
397
|
+
this.pos++;
|
|
398
|
+
return "\r";
|
|
399
|
+
case Char.LowerB:
|
|
400
|
+
this.pos++;
|
|
401
|
+
return "\b";
|
|
402
|
+
case Char.LowerF:
|
|
403
|
+
this.pos++;
|
|
404
|
+
return "\f";
|
|
405
|
+
case Char.LowerU:
|
|
406
|
+
this.pos++;
|
|
407
|
+
if (this.text.charCodeAt(this.pos) === Char.OpenBrace) {
|
|
408
|
+
const close = this.text.indexOf("}", this.pos);
|
|
409
|
+
const hex = this.text.slice(this.pos + 1, close);
|
|
410
|
+
this.pos = close + 1;
|
|
411
|
+
return String.fromCodePoint(parseInt(hex, 16) || 0);
|
|
412
|
+
} else {
|
|
413
|
+
const hex = this.text.slice(this.pos, this.pos + 4);
|
|
414
|
+
this.pos += 4;
|
|
415
|
+
return String.fromCharCode(parseInt(hex, 16) || 0);
|
|
416
|
+
}
|
|
417
|
+
case Char.LowerX: {
|
|
418
|
+
const hex = this.text.slice(this.pos + 1, this.pos + 3);
|
|
419
|
+
this.pos += 3;
|
|
420
|
+
return String.fromCharCode(parseInt(hex, 16) || 0);
|
|
421
|
+
}
|
|
422
|
+
case Char.Zero:
|
|
423
|
+
// \0 is only a null escape when not followed by a digit.
|
|
424
|
+
if (!isDigit(this.text.charCodeAt(this.pos + 1))) {
|
|
425
|
+
this.pos++;
|
|
426
|
+
return "\0";
|
|
427
|
+
}
|
|
428
|
+
this.pos++;
|
|
429
|
+
return "\0";
|
|
430
|
+
default:
|
|
431
|
+
this.pos++;
|
|
432
|
+
return this.text[this.pos - 1] ?? "";
|
|
433
|
+
}
|
|
434
|
+
}
|
|
435
|
+
|
|
436
|
+
/** Scans a template literal chunk starting at a backtick or after `}`. */
|
|
437
|
+
scanTemplate(start: number, precededByLineBreak: boolean, isHead: boolean): Token {
|
|
438
|
+
if (isHead) this.pos++; // opening backtick
|
|
439
|
+
let result = "";
|
|
440
|
+
for (;;) {
|
|
441
|
+
if (this.pos >= this.text.length) {
|
|
442
|
+
this.error(DiagnosticCode.UnterminatedTemplate, "Unterminated template literal", start);
|
|
443
|
+
return this.makeToken(TokenKind.NoSubstitutionTemplateLiteral, start, this.pos, this.text.slice(start, this.pos), precededByLineBreak, result);
|
|
444
|
+
}
|
|
445
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
446
|
+
if (ch === Char.Backtick) {
|
|
447
|
+
this.pos++;
|
|
448
|
+
return this.makeToken(TokenKind.NoSubstitutionTemplateLiteral, start, this.pos, this.text.slice(start, this.pos), precededByLineBreak, result);
|
|
449
|
+
}
|
|
450
|
+
if (ch === Char.Dollar && this.text.charCodeAt(this.pos + 1) === Char.OpenBrace) {
|
|
451
|
+
this.pos += 2;
|
|
452
|
+
return this.makeToken(TokenKind.TemplateHead, start, this.pos, this.text.slice(start, this.pos), precededByLineBreak, result);
|
|
453
|
+
}
|
|
454
|
+
if (ch === Char.Backslash) {
|
|
455
|
+
result += this.scanEscapeSequence();
|
|
456
|
+
continue;
|
|
457
|
+
}
|
|
458
|
+
result += this.text[this.pos];
|
|
459
|
+
this.pos++;
|
|
460
|
+
}
|
|
461
|
+
}
|
|
462
|
+
|
|
463
|
+
/** Called by the parser after a template substitution expression. */
|
|
464
|
+
continueTemplate(offset: number): Token {
|
|
465
|
+
this.pos = Math.max(0, Math.min(offset, this.text.length));
|
|
466
|
+
this._token = this.scanTemplate(offset, false, /* isHead */ false);
|
|
467
|
+
return this._token;
|
|
468
|
+
}
|
|
469
|
+
|
|
470
|
+
/**
|
|
471
|
+
* True when a `/` in this position starts a regular expression rather than a
|
|
472
|
+
* division. The decision is made from the previous significant token.
|
|
473
|
+
*/
|
|
474
|
+
private regexAllowed(): boolean {
|
|
475
|
+
switch (this._token.kind) {
|
|
476
|
+
case TokenKind.Identifier:
|
|
477
|
+
case TokenKind.PrivateIdentifier:
|
|
478
|
+
case TokenKind.NumericLiteral:
|
|
479
|
+
case TokenKind.BigIntLiteral:
|
|
480
|
+
case TokenKind.StringLiteral:
|
|
481
|
+
case TokenKind.NoSubstitutionTemplateLiteral:
|
|
482
|
+
case TokenKind.TemplateTail:
|
|
483
|
+
case TokenKind.RegularExpressionLiteral:
|
|
484
|
+
case TokenKind.CloseParen:
|
|
485
|
+
case TokenKind.CloseBracket:
|
|
486
|
+
case TokenKind.TrueKeyword:
|
|
487
|
+
case TokenKind.FalseKeyword:
|
|
488
|
+
case TokenKind.NullKeyword:
|
|
489
|
+
case TokenKind.UndefinedKeyword:
|
|
490
|
+
case TokenKind.ThisKeyword:
|
|
491
|
+
case TokenKind.PlusPlus:
|
|
492
|
+
case TokenKind.MinusMinus:
|
|
493
|
+
return false;
|
|
494
|
+
default:
|
|
495
|
+
return true;
|
|
496
|
+
}
|
|
497
|
+
}
|
|
498
|
+
|
|
499
|
+
/** Scan a `/pattern/flags` literal, starting at the leading slash. */
|
|
500
|
+
private scanRegex(start: number, precededByLineBreak: boolean): Token {
|
|
501
|
+
this.pos++; // opening slash
|
|
502
|
+
let inClass = false;
|
|
503
|
+
for (;;) {
|
|
504
|
+
if (this.pos >= this.text.length) {
|
|
505
|
+
this.error(DiagnosticCode.InvalidCharacter, "Unterminated regular expression", start);
|
|
506
|
+
break;
|
|
507
|
+
}
|
|
508
|
+
const ch = this.text.charCodeAt(this.pos);
|
|
509
|
+
if (ch === Char.Backslash) {
|
|
510
|
+
this.pos += 2;
|
|
511
|
+
continue;
|
|
512
|
+
}
|
|
513
|
+
if (ch === Char.LineFeed || ch === Char.CarriageReturn) break;
|
|
514
|
+
if (ch === 91 /* [ */) inClass = true;
|
|
515
|
+
else if (ch === 93 /* ] */) inClass = false;
|
|
516
|
+
else if (ch === Char.Slash && !inClass) {
|
|
517
|
+
this.pos++;
|
|
518
|
+
break;
|
|
519
|
+
}
|
|
520
|
+
this.pos++;
|
|
521
|
+
}
|
|
522
|
+
// Flags.
|
|
523
|
+
while (this.pos < this.text.length && isIdentifierPart(this.text.charCodeAt(this.pos))) this.pos++;
|
|
524
|
+
return this.makeToken(
|
|
525
|
+
TokenKind.RegularExpressionLiteral,
|
|
526
|
+
start,
|
|
527
|
+
this.pos,
|
|
528
|
+
this.text.slice(start, this.pos),
|
|
529
|
+
precededByLineBreak,
|
|
530
|
+
);
|
|
531
|
+
}
|
|
532
|
+
|
|
533
|
+
private scanPunctuation(start: number, precededByLineBreak: boolean): Token {
|
|
534
|
+
const text = this.text;
|
|
535
|
+
const ch = text.charCodeAt(this.pos);
|
|
536
|
+
const next = text.charCodeAt(this.pos + 1);
|
|
537
|
+
const third = text.charCodeAt(this.pos + 2);
|
|
538
|
+
const fourth = text.charCodeAt(this.pos + 3);
|
|
539
|
+
|
|
540
|
+
const emit = (kind: TokenKind, length: number): Token => {
|
|
541
|
+
this.pos += length;
|
|
542
|
+
return this.makeToken(kind, start, this.pos, text.slice(start, this.pos), precededByLineBreak);
|
|
543
|
+
};
|
|
544
|
+
|
|
545
|
+
switch (ch) {
|
|
546
|
+
case Char.OpenBrace:
|
|
547
|
+
return emit(TokenKind.OpenBrace, 1);
|
|
548
|
+
case Char.CloseBrace:
|
|
549
|
+
return emit(TokenKind.CloseBrace, 1);
|
|
550
|
+
case Char.OpenParen:
|
|
551
|
+
return emit(TokenKind.OpenParen, 1);
|
|
552
|
+
case Char.CloseParen:
|
|
553
|
+
return emit(TokenKind.CloseParen, 1);
|
|
554
|
+
case Char.OpenBracket:
|
|
555
|
+
return emit(TokenKind.OpenBracket, 1);
|
|
556
|
+
case Char.CloseBracket:
|
|
557
|
+
return emit(TokenKind.CloseBracket, 1);
|
|
558
|
+
case Char.Semicolon:
|
|
559
|
+
return emit(TokenKind.Semicolon, 1);
|
|
560
|
+
case Char.Comma:
|
|
561
|
+
return emit(TokenKind.Comma, 1);
|
|
562
|
+
case Char.At:
|
|
563
|
+
return emit(TokenKind.At, 1);
|
|
564
|
+
case Char.Tilde:
|
|
565
|
+
return emit(TokenKind.Tilde, 1);
|
|
566
|
+
case Char.Colon:
|
|
567
|
+
return emit(TokenKind.Colon, 1);
|
|
568
|
+
case Char.Dot:
|
|
569
|
+
if (next === Char.Dot && third === Char.Dot) return emit(TokenKind.DotDotDot, 3);
|
|
570
|
+
return emit(TokenKind.Dot, 1);
|
|
571
|
+
case Char.Question:
|
|
572
|
+
if (next === Char.Question) {
|
|
573
|
+
if (third === Char.Equals) return emit(TokenKind.QuestionQuestionEquals, 3);
|
|
574
|
+
return emit(TokenKind.QuestionQuestion, 2);
|
|
575
|
+
}
|
|
576
|
+
if (next === Char.Dot && !isDigit(third)) return emit(TokenKind.QuestionDot, 2);
|
|
577
|
+
return emit(TokenKind.Question, 1);
|
|
578
|
+
case Char.Equals:
|
|
579
|
+
if (next === Char.Equals && third === Char.Equals) return emit(TokenKind.EqualsEqualsEquals, 3);
|
|
580
|
+
if (next === Char.Equals) return emit(TokenKind.EqualsEquals, 2);
|
|
581
|
+
if (next === Char.GreaterThan) return emit(TokenKind.EqualsGreaterThan, 2);
|
|
582
|
+
return emit(TokenKind.Equals, 1);
|
|
583
|
+
case Char.Exclamation:
|
|
584
|
+
if (next === Char.Equals && third === Char.Equals) return emit(TokenKind.ExclamationEqualsEquals, 3);
|
|
585
|
+
if (next === Char.Equals) return emit(TokenKind.ExclamationEquals, 2);
|
|
586
|
+
return emit(TokenKind.Exclamation, 1);
|
|
587
|
+
case Char.Plus:
|
|
588
|
+
if (next === Char.Plus) return emit(TokenKind.PlusPlus, 2);
|
|
589
|
+
if (next === Char.Equals) return emit(TokenKind.PlusEquals, 2);
|
|
590
|
+
return emit(TokenKind.Plus, 1);
|
|
591
|
+
case Char.Minus:
|
|
592
|
+
if (next === Char.Minus) return emit(TokenKind.MinusMinus, 2);
|
|
593
|
+
if (next === Char.Equals) return emit(TokenKind.MinusEquals, 2);
|
|
594
|
+
return emit(TokenKind.Minus, 1);
|
|
595
|
+
case Char.Asterisk:
|
|
596
|
+
if (next === Char.Asterisk) {
|
|
597
|
+
if (third === Char.Equals) return emit(TokenKind.AsteriskAsteriskEquals, 3);
|
|
598
|
+
return emit(TokenKind.AsteriskAsterisk, 2);
|
|
599
|
+
}
|
|
600
|
+
if (next === Char.Equals) return emit(TokenKind.AsteriskEquals, 2);
|
|
601
|
+
return emit(TokenKind.Asterisk, 1);
|
|
602
|
+
case Char.Slash:
|
|
603
|
+
if (next === Char.Equals) return emit(TokenKind.SlashEquals, 2);
|
|
604
|
+
if (this.regexAllowed()) return this.scanRegex(start, precededByLineBreak);
|
|
605
|
+
return emit(TokenKind.Slash, 1);
|
|
606
|
+
case Char.Percent:
|
|
607
|
+
if (next === Char.Equals) return emit(TokenKind.PercentEquals, 2);
|
|
608
|
+
return emit(TokenKind.Percent, 1);
|
|
609
|
+
case Char.LessThan:
|
|
610
|
+
if (next === Char.LessThan) {
|
|
611
|
+
if (third === Char.Equals) return emit(TokenKind.LessThanLessThanEquals, 3);
|
|
612
|
+
return emit(TokenKind.LessThanLessThan, 2);
|
|
613
|
+
}
|
|
614
|
+
if (next === Char.Equals) return emit(TokenKind.LessThanEquals, 2);
|
|
615
|
+
return emit(TokenKind.LessThan, 1);
|
|
616
|
+
case Char.GreaterThan:
|
|
617
|
+
if (next === Char.GreaterThan) {
|
|
618
|
+
if (third === Char.GreaterThan) {
|
|
619
|
+
if (fourth === Char.Equals) return emit(TokenKind.GreaterThanGreaterThanGreaterThanEquals, 4);
|
|
620
|
+
return emit(TokenKind.GreaterThanGreaterThanGreaterThan, 3);
|
|
621
|
+
}
|
|
622
|
+
if (third === Char.Equals) return emit(TokenKind.GreaterThanGreaterThanEquals, 3);
|
|
623
|
+
return emit(TokenKind.GreaterThanGreaterThan, 2);
|
|
624
|
+
}
|
|
625
|
+
if (next === Char.Equals) return emit(TokenKind.GreaterThanEquals, 2);
|
|
626
|
+
return emit(TokenKind.GreaterThan, 1);
|
|
627
|
+
case Char.Ampersand:
|
|
628
|
+
if (next === Char.Ampersand) {
|
|
629
|
+
if (third === Char.Equals) return emit(TokenKind.AmpersandAmpersandEquals, 3);
|
|
630
|
+
return emit(TokenKind.AmpersandAmpersand, 2);
|
|
631
|
+
}
|
|
632
|
+
if (next === Char.Equals) return emit(TokenKind.AmpersandEquals, 2);
|
|
633
|
+
return emit(TokenKind.Ampersand, 1);
|
|
634
|
+
case Char.Bar:
|
|
635
|
+
if (next === Char.Bar) {
|
|
636
|
+
if (third === Char.Equals) return emit(TokenKind.BarBarEquals, 3);
|
|
637
|
+
return emit(TokenKind.BarBar, 2);
|
|
638
|
+
}
|
|
639
|
+
if (next === Char.Equals) return emit(TokenKind.BarEquals, 2);
|
|
640
|
+
return emit(TokenKind.Bar, 1);
|
|
641
|
+
case Char.Caret:
|
|
642
|
+
if (next === Char.Equals) return emit(TokenKind.CaretEquals, 2);
|
|
643
|
+
return emit(TokenKind.Caret, 1);
|
|
644
|
+
default:
|
|
645
|
+
this.pos++;
|
|
646
|
+
this.error(DiagnosticCode.InvalidCharacter, `Invalid character '${text[start]}'`, start, this.pos);
|
|
647
|
+
return this.makeToken(TokenKind.Identifier, start, this.pos, text[start] ?? "", precededByLineBreak);
|
|
648
|
+
}
|
|
649
|
+
}
|
|
650
|
+
}
|