@lvce-editor/shared-process 0.0.37 → 0.0.38
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/extensions/builtin.language-basics-c/README.md +14 -0
- package/extensions/builtin.language-basics-c/extension.json +12 -0
- package/extensions/builtin.language-basics-c/src/tokenizeC.js +180 -0
- package/extensions/builtin.language-basics-editorconfig/README.md +14 -0
- package/extensions/builtin.language-basics-editorconfig/extension.json +12 -0
- package/extensions/builtin.language-basics-editorconfig/src/tokenizeEditorConfig.js +122 -0
- package/extensions/builtin.language-basics-html/src/tokenizeHtml.js +57 -35
- package/extensions/builtin.language-basics-json/extension.json +24 -1
- package/extensions/builtin.language-basics-powershell/src/tokenizePowershell.js +122 -14
- package/extensions/builtin.language-basics-toml/README.md +14 -0
- package/extensions/builtin.language-basics-toml/extension.json +12 -0
- package/extensions/builtin.language-basics-toml/src/tokenizeToml.js +122 -0
- package/extensions/builtin.language-basics-xml/src/tokenizeXml.js +279 -14
- package/extensions/builtin.language-basics-yaml/extension.json +1 -1
- package/extensions/builtin.language-basics-yaml/src/tokenizeYaml.js +103 -14
- package/package.json +3 -3
|
@@ -0,0 +1,14 @@
|
|
|
1
|
+
# Language Basics C
|
|
2
|
+
|
|
3
|
+
## Contributing
|
|
4
|
+
|
|
5
|
+
```sh
|
|
6
|
+
git clone git@github.com:lvce-editor/language-basics-c.git &&
|
|
7
|
+
cd language-basics-c &&
|
|
8
|
+
npm ci &&
|
|
9
|
+
npm test
|
|
10
|
+
```
|
|
11
|
+
|
|
12
|
+
## Gitpod
|
|
13
|
+
|
|
14
|
+
[](https://gitpod.io/#https://github.com/lvce-editor/language-basics-c)
|
|
@@ -0,0 +1,12 @@
|
|
|
1
|
+
{
|
|
2
|
+
"id": "builtin.language-basics-c",
|
|
3
|
+
"name": "Language Basics C",
|
|
4
|
+
"description": "Provides syntax highlighting and bracket matching in C files.",
|
|
5
|
+
"languages": [
|
|
6
|
+
{
|
|
7
|
+
"id": "c",
|
|
8
|
+
"extensions": [".c"],
|
|
9
|
+
"tokenize": "src/tokenizeC.js"
|
|
10
|
+
}
|
|
11
|
+
]
|
|
12
|
+
}
|
|
@@ -0,0 +1,180 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* @enum number
|
|
3
|
+
*/
|
|
4
|
+
export const State = {
|
|
5
|
+
TopLevelContent: 1,
|
|
6
|
+
AfterInclude: 2,
|
|
7
|
+
InsideLineComment: 3,
|
|
8
|
+
InsideDoubleQuoteString: 4,
|
|
9
|
+
}
|
|
10
|
+
|
|
11
|
+
export const StateMap = {
|
|
12
|
+
[State.TopLevelContent]: 'TopLevelContent',
|
|
13
|
+
[State.AfterInclude]: 'AfterInclude',
|
|
14
|
+
[State.InsideLineComment]: 'InsideLineComment',
|
|
15
|
+
[State.InsideDoubleQuoteString]: 'InsideDoubleQuoteString',
|
|
16
|
+
}
|
|
17
|
+
|
|
18
|
+
/**
|
|
19
|
+
* @enum number
|
|
20
|
+
*/
|
|
21
|
+
export const TokenType = {
|
|
22
|
+
Whitespace: 2,
|
|
23
|
+
Punctuation: 3,
|
|
24
|
+
CurlyOpen: 6,
|
|
25
|
+
CurlyClose: 7,
|
|
26
|
+
PropertyColon: 8,
|
|
27
|
+
VariableName: 10,
|
|
28
|
+
None: 57,
|
|
29
|
+
Unknown: 881,
|
|
30
|
+
Numeric: 883,
|
|
31
|
+
NewLine: 884,
|
|
32
|
+
Include: 885,
|
|
33
|
+
Import: 886,
|
|
34
|
+
Keyword: 887,
|
|
35
|
+
Comment: 888,
|
|
36
|
+
PunctuationString: 889,
|
|
37
|
+
String: 890,
|
|
38
|
+
PlainText: 891,
|
|
39
|
+
}
|
|
40
|
+
|
|
41
|
+
export const TokenMap = {
|
|
42
|
+
[TokenType.Whitespace]: 'Whitespace',
|
|
43
|
+
[TokenType.Punctuation]: 'Punctuation',
|
|
44
|
+
[TokenType.CurlyOpen]: 'Punctuation',
|
|
45
|
+
[TokenType.PropertyColon]: 'Punctuation',
|
|
46
|
+
[TokenType.VariableName]: 'VariableName',
|
|
47
|
+
[TokenType.None]: 'None',
|
|
48
|
+
[TokenType.Unknown]: 'Unknown',
|
|
49
|
+
[TokenType.Numeric]: 'Numeric',
|
|
50
|
+
[TokenType.NewLine]: 'NewLine',
|
|
51
|
+
[TokenType.Include]: 'Include',
|
|
52
|
+
[TokenType.Import]: 'Import',
|
|
53
|
+
[TokenType.Keyword]: 'Keyword',
|
|
54
|
+
[TokenType.Comment]: 'Comment',
|
|
55
|
+
[TokenType.PunctuationString]: 'PunctuationString',
|
|
56
|
+
[TokenType.String]: 'String',
|
|
57
|
+
[TokenType.PlainText]: 'PlainText',
|
|
58
|
+
}
|
|
59
|
+
|
|
60
|
+
const RE_SELECTOR = /^[\.a-zA-Z\d\-\:>]+/
|
|
61
|
+
const RE_WHITESPACE = /^ +/
|
|
62
|
+
const RE_CURLY_OPEN = /^\{/
|
|
63
|
+
const RE_CURLY_CLOSE = /^\}/
|
|
64
|
+
const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
|
|
65
|
+
const RE_COLON = /^:/
|
|
66
|
+
const RE_PROPERTY_VALUE = /^[^;]+/
|
|
67
|
+
const RE_SEMICOLON = /^;/
|
|
68
|
+
const RE_COMMA = /^,/
|
|
69
|
+
const RE_ANYTHING = /^.*/
|
|
70
|
+
const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
|
|
71
|
+
const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
|
|
72
|
+
const RE_INCLUDE = /^#include\b/
|
|
73
|
+
const RE_IMPORT = /^<[^>]*>/
|
|
74
|
+
const RE_KEYWORD =
|
|
75
|
+
/^(?:while|volatile|void|unsigned|union|typedef|switch|struct|static|sizeof|signed|short|return|register|long|int|if|goto|for|float|extern|enum|else|double|do|default|continue|const|char|case|break|auto)\b/
|
|
76
|
+
const RE_LINE_COMMENT_START = /^\/\//
|
|
77
|
+
const RE_ANYTHING_UNTIL_END = /^.+/s
|
|
78
|
+
const RE_VARIABLE_NAME = /^[a-zA-Z][a-zA-Z\d\_]*/
|
|
79
|
+
const RE_PUNCTUATION = /^[\(\)=\+\-><\.:\/\{\};,\[\]\*]/
|
|
80
|
+
const RE_DOUBLE_QUOTE = /^"/
|
|
81
|
+
const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
|
|
82
|
+
|
|
83
|
+
export const initialLineState = {
|
|
84
|
+
state: State.TopLevelContent,
|
|
85
|
+
tokens: [],
|
|
86
|
+
}
|
|
87
|
+
|
|
88
|
+
export const isEqualLineState = (lineStateA, lineStateB) => {
|
|
89
|
+
return lineStateA.state === lineStateB.state
|
|
90
|
+
}
|
|
91
|
+
|
|
92
|
+
/**
|
|
93
|
+
* @param {string} line
|
|
94
|
+
*/
|
|
95
|
+
export const tokenizeLine = (line, lineState) => {
|
|
96
|
+
let next = null
|
|
97
|
+
let index = 0
|
|
98
|
+
let tokens = []
|
|
99
|
+
let token = TokenType.None
|
|
100
|
+
let state = lineState.state
|
|
101
|
+
while (index < line.length) {
|
|
102
|
+
const part = line.slice(index)
|
|
103
|
+
switch (state) {
|
|
104
|
+
case State.TopLevelContent:
|
|
105
|
+
if ((next = part.match(RE_KEYWORD))) {
|
|
106
|
+
token = TokenType.Keyword
|
|
107
|
+
state = State.TopLevelContent
|
|
108
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
109
|
+
token = TokenType.Whitespace
|
|
110
|
+
state = State.TopLevelContent
|
|
111
|
+
} else if ((next = part.match(RE_VARIABLE_NAME))) {
|
|
112
|
+
token = TokenType.VariableName
|
|
113
|
+
state = State.TopLevelContent
|
|
114
|
+
} else if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
115
|
+
token = TokenType.PunctuationString
|
|
116
|
+
state = State.InsideDoubleQuoteString
|
|
117
|
+
} else if ((next = part.match(RE_INCLUDE))) {
|
|
118
|
+
token = TokenType.Include
|
|
119
|
+
state = State.AfterInclude
|
|
120
|
+
} else if ((next = part.match(RE_LINE_COMMENT_START))) {
|
|
121
|
+
token = TokenType.Comment
|
|
122
|
+
state = State.InsideLineComment
|
|
123
|
+
} else if ((next = part.match(RE_PUNCTUATION))) {
|
|
124
|
+
token = TokenType.Punctuation
|
|
125
|
+
state = State.TopLevelContent
|
|
126
|
+
} else if ((next = part.match(RE_NUMERIC))) {
|
|
127
|
+
token = TokenType.Numeric
|
|
128
|
+
state = State.TopLevelContent
|
|
129
|
+
} else if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
|
|
130
|
+
token = TokenType.PlainText
|
|
131
|
+
state = State.TopLevelContent
|
|
132
|
+
} else {
|
|
133
|
+
part //?
|
|
134
|
+
throw new Error('no')
|
|
135
|
+
}
|
|
136
|
+
break
|
|
137
|
+
case State.AfterInclude:
|
|
138
|
+
if ((next = part.match(RE_WHITESPACE))) {
|
|
139
|
+
token = TokenType.Whitespace
|
|
140
|
+
state = State.AfterInclude
|
|
141
|
+
} else if ((next = part.match(RE_IMPORT))) {
|
|
142
|
+
token = TokenType.Import
|
|
143
|
+
state = State.TopLevelContent
|
|
144
|
+
} else {
|
|
145
|
+
throw new Error('no')
|
|
146
|
+
}
|
|
147
|
+
break
|
|
148
|
+
case State.InsideLineComment:
|
|
149
|
+
if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
|
|
150
|
+
token = TokenType.Comment
|
|
151
|
+
state = State.TopLevelContent
|
|
152
|
+
} else {
|
|
153
|
+
throw new Error('no')
|
|
154
|
+
}
|
|
155
|
+
break
|
|
156
|
+
case State.InsideDoubleQuoteString:
|
|
157
|
+
if ((next = part.match(RE_STRING_DOUBLE_QUOTE_CONTENT))) {
|
|
158
|
+
token = TokenType.String
|
|
159
|
+
state = State.InsideDoubleQuoteString
|
|
160
|
+
} else if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
161
|
+
token = TokenType.PunctuationString
|
|
162
|
+
state = State.TopLevelContent
|
|
163
|
+
} else {
|
|
164
|
+
throw new Error('no')
|
|
165
|
+
}
|
|
166
|
+
break
|
|
167
|
+
default:
|
|
168
|
+
throw new Error('no')
|
|
169
|
+
}
|
|
170
|
+
index += next[0].length
|
|
171
|
+
tokens.push({
|
|
172
|
+
type: token,
|
|
173
|
+
length: next[0].length,
|
|
174
|
+
})
|
|
175
|
+
}
|
|
176
|
+
return {
|
|
177
|
+
state,
|
|
178
|
+
tokens,
|
|
179
|
+
}
|
|
180
|
+
}
|
|
@@ -0,0 +1,14 @@
|
|
|
1
|
+
# Language Basics Editorconfig
|
|
2
|
+
|
|
3
|
+
## Contributing
|
|
4
|
+
|
|
5
|
+
```sh
|
|
6
|
+
git clone git@github.com:lvce-editor/language-basics-editorconfig.git &&
|
|
7
|
+
cd language-basics-editorconfig &&
|
|
8
|
+
npm ci &&
|
|
9
|
+
npm test
|
|
10
|
+
```
|
|
11
|
+
|
|
12
|
+
## Gitpod
|
|
13
|
+
|
|
14
|
+
[](https://gitpod.io/#https://github.com/lvce-editor/language-basics-editorconfig)
|
|
@@ -0,0 +1,12 @@
|
|
|
1
|
+
{
|
|
2
|
+
"id": "builtin.language-basics-editorconfig",
|
|
3
|
+
"name": "Language Basics Editorconfig",
|
|
4
|
+
"description": "Provides syntax highlighting and bracket matching in Editorconfig files.",
|
|
5
|
+
"languages": [
|
|
6
|
+
{
|
|
7
|
+
"id": "editorconfig",
|
|
8
|
+
"extensions": [".editorconfig"],
|
|
9
|
+
"tokenize": "src/tokenizeEditorConfig.js"
|
|
10
|
+
}
|
|
11
|
+
]
|
|
12
|
+
}
|
|
@@ -0,0 +1,122 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* @enum number
|
|
3
|
+
*/
|
|
4
|
+
export const State = {
|
|
5
|
+
TopLevelContent: 1,
|
|
6
|
+
InsideLineComment: 2,
|
|
7
|
+
}
|
|
8
|
+
|
|
9
|
+
export const StateMap = {
|
|
10
|
+
[State.TopLevelContent]: 'TopLevelContent',
|
|
11
|
+
[State.InsideLineComment]: 'InsideLineComment',
|
|
12
|
+
}
|
|
13
|
+
|
|
14
|
+
/**
|
|
15
|
+
* @enum number
|
|
16
|
+
*/
|
|
17
|
+
export const TokenType = {
|
|
18
|
+
CssSelector: 1,
|
|
19
|
+
Whitespace: 2,
|
|
20
|
+
None: 57,
|
|
21
|
+
Unknown: 881,
|
|
22
|
+
NewLine: 884,
|
|
23
|
+
Comment: 885,
|
|
24
|
+
Query: 886,
|
|
25
|
+
Text: 887,
|
|
26
|
+
}
|
|
27
|
+
|
|
28
|
+
export const TokenMap = {
|
|
29
|
+
[TokenType.CssSelector]: 'CssSelector',
|
|
30
|
+
[TokenType.Whitespace]: 'Whitespace',
|
|
31
|
+
[TokenType.None]: 'None',
|
|
32
|
+
[TokenType.Unknown]: 'Unknown',
|
|
33
|
+
[TokenType.NewLine]: 'NewLine',
|
|
34
|
+
[TokenType.Comment]: 'Comment',
|
|
35
|
+
[TokenType.Query]: 'Query',
|
|
36
|
+
[TokenType.Text]: 'Text',
|
|
37
|
+
}
|
|
38
|
+
|
|
39
|
+
const RE_LINE_COMMENT_START = /^#/
|
|
40
|
+
const RE_WHITESPACE = /^ +/
|
|
41
|
+
const RE_CURLY_OPEN = /^\{/
|
|
42
|
+
const RE_CURLY_CLOSE = /^\}/
|
|
43
|
+
const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
|
|
44
|
+
const RE_COLON = /^:/
|
|
45
|
+
const RE_PROPERTY_VALUE = /^[^;\}]+/
|
|
46
|
+
const RE_SEMICOLON = /^;/
|
|
47
|
+
const RE_COMMA = /^,/
|
|
48
|
+
const RE_ANYTHING = /^.*/
|
|
49
|
+
const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
|
|
50
|
+
const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
|
|
51
|
+
const RE_BLOCK_COMMENT_START = /^\/\*/
|
|
52
|
+
const RE_BLOCK_COMMENT_END = /^\*\//
|
|
53
|
+
const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
|
|
54
|
+
const RE_ROUND_OPEN = /^\(/
|
|
55
|
+
const RE_ROUND_CLOSE = /^\)/
|
|
56
|
+
const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
|
|
57
|
+
const RE_SQUARE_OPEN = /^\[/
|
|
58
|
+
const RE_SQUARE_CLOSE = /^\]/
|
|
59
|
+
const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
|
|
60
|
+
const RE_QUERY = /^@[a-z\-]+/
|
|
61
|
+
const RE_STAR = /^\*/
|
|
62
|
+
const RE_QUERY_NAME = /^[a-z\-]+/
|
|
63
|
+
const RE_QUERY_CONTENT = /^[^\)]+/
|
|
64
|
+
const RE_COMBINATOR = /^[\+\>\~]/
|
|
65
|
+
|
|
66
|
+
export const initialLineState = {
|
|
67
|
+
state: State.TopLevelContent,
|
|
68
|
+
tokens: [],
|
|
69
|
+
stack: [],
|
|
70
|
+
}
|
|
71
|
+
|
|
72
|
+
/**
|
|
73
|
+
* @param {string} line
|
|
74
|
+
* @param {any} lineState
|
|
75
|
+
*/
|
|
76
|
+
export const tokenizeLine = (line, lineState) => {
|
|
77
|
+
let next = null
|
|
78
|
+
let index = 0
|
|
79
|
+
let tokens = []
|
|
80
|
+
let token = TokenType.None
|
|
81
|
+
let state = lineState.state
|
|
82
|
+
while (index < line.length) {
|
|
83
|
+
const part = line.slice(index)
|
|
84
|
+
switch (state) {
|
|
85
|
+
case State.TopLevelContent:
|
|
86
|
+
if ((next = part.match(RE_LINE_COMMENT_START))) {
|
|
87
|
+
token = TokenType.Comment
|
|
88
|
+
state = State.InsideLineComment
|
|
89
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
90
|
+
token = TokenType.Whitespace
|
|
91
|
+
state = State.TopLevelContent
|
|
92
|
+
} else if ((next = part.match(RE_ANYTHING))) {
|
|
93
|
+
token = TokenType.Text
|
|
94
|
+
state = State.TopLevelContent
|
|
95
|
+
} else {
|
|
96
|
+
part //?
|
|
97
|
+
throw new Error('no')
|
|
98
|
+
}
|
|
99
|
+
break
|
|
100
|
+
case State.InsideLineComment:
|
|
101
|
+
if ((next = part.match(RE_ANYTHING))) {
|
|
102
|
+
token = TokenType.Comment
|
|
103
|
+
state = State.TopLevelContent
|
|
104
|
+
} else {
|
|
105
|
+
throw new Error('no')
|
|
106
|
+
}
|
|
107
|
+
break
|
|
108
|
+
default:
|
|
109
|
+
console.log({ state, line })
|
|
110
|
+
throw new Error('no')
|
|
111
|
+
}
|
|
112
|
+
index += next[0].length
|
|
113
|
+
tokens.push({
|
|
114
|
+
type: token,
|
|
115
|
+
length: next[0].length,
|
|
116
|
+
})
|
|
117
|
+
}
|
|
118
|
+
return {
|
|
119
|
+
state,
|
|
120
|
+
tokens,
|
|
121
|
+
}
|
|
122
|
+
}
|
|
@@ -13,7 +13,8 @@ const State = {
|
|
|
13
13
|
InsideAttributeDoubleQuote: 9,
|
|
14
14
|
InsideBlockComment: 10,
|
|
15
15
|
None: 11,
|
|
16
|
-
|
|
16
|
+
InsideDoubleQuoteString: 12,
|
|
17
|
+
InsideSingleQuoteString: 13,
|
|
17
18
|
}
|
|
18
19
|
|
|
19
20
|
export const StateMap = {}
|
|
@@ -52,43 +53,57 @@ export const TokenMap = {
|
|
|
52
53
|
[TokenType.PunctuationString]: 'PunctuationString',
|
|
53
54
|
}
|
|
54
55
|
|
|
55
|
-
const RE_WHITESPACE = /^\s+/
|
|
56
|
-
const RE_DOUBLE_QUOTE = /^"/
|
|
57
|
-
const RE_NEWLINE_WHITESPACE = /^\n\s*/
|
|
58
|
-
const RE_BLOCK_COMMENT_START = /^<!--/
|
|
59
|
-
const RE_BLOCK_COMMENT_CONTENT = /^.(?:.*?)(?=-->|$)/s
|
|
60
|
-
const RE_BLOCK_COMMENT_END = /^-->/
|
|
61
|
-
const RE_ANGLE_BRACKET_OPEN_TAG = /^<(?!\s)/
|
|
62
56
|
const RE_ANGLE_BRACKET_CLOSE = /^>/
|
|
63
|
-
const
|
|
64
|
-
const
|
|
57
|
+
const RE_ANGLE_BRACKET_ONLY = /^</
|
|
58
|
+
const RE_ANGLE_BRACKET_OPEN = /^</
|
|
59
|
+
const RE_ANGLE_BRACKET_OPEN_TAG = /^<(?!\s)/
|
|
65
60
|
const RE_ANY_TEXT = /^[^\n]+/
|
|
66
|
-
const RE_SLASH = /^\//
|
|
67
61
|
const RE_ATTRIBUTE_NAME = /^[a-zA-Z\d\-]+/
|
|
62
|
+
const RE_BLOCK_COMMENT_CONTENT = /^.(?:.*?)(?=-->|$)/s
|
|
63
|
+
const RE_BLOCK_COMMENT_END = /^-->/
|
|
64
|
+
const RE_BLOCK_COMMENT_START = /^<!--/
|
|
65
|
+
const RE_DASH_DASH = /^\-\-/
|
|
66
|
+
const RE_DOUBLE_QUOTE = /^"/
|
|
68
67
|
const RE_EQUAL_SIGN = /^=/
|
|
69
|
-
const
|
|
70
|
-
const RE_PUNCTUATION_SELF_CLOSING = /^\/>/
|
|
71
|
-
const RE_INVALID_INSIDE_OPENING_TAG = /^[^a-zA-Z>]/
|
|
68
|
+
const RE_EXCLAMATION_MARK = /^!/
|
|
72
69
|
const RE_INVALID_INSIDE_ClOSING_TAG = /^[^a-zA-Z>]/
|
|
73
|
-
const
|
|
74
|
-
const RE_NOT_TAGNAME = /^[^a-zA-Z\d]+/
|
|
75
|
-
const RE_WORD = /^[^\s]+/
|
|
76
|
-
const RE_ANGLE_BRACKET_ONLY = /^</
|
|
70
|
+
const RE_INVALID_INSIDE_OPENING_TAG = /^[^a-zA-Z>]/
|
|
77
71
|
const RE_NEWLINE = /^\n/
|
|
78
|
-
const
|
|
72
|
+
const RE_NEWLINE_WHITESPACE = /^\n\s*/
|
|
73
|
+
const RE_NOT_TAGNAME = /^[^a-zA-Z\d]+/
|
|
74
|
+
const RE_PUNCTUATION = /^[<;'".,]/
|
|
75
|
+
const RE_PUNCTUATION_SELF_CLOSING = /^\/>/
|
|
79
76
|
const RE_SELF_CLOSING = /^\/>/
|
|
80
|
-
const
|
|
77
|
+
const RE_SINGLE_QUOTE = /^'/
|
|
78
|
+
const RE_SLASH = /^\//
|
|
79
|
+
const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
|
|
80
|
+
const RE_STRING_SINGLE_QUOTE_CONTENT = /^[^']+/
|
|
81
81
|
const RE_TAG_TEXT = /^[^\s>]+/
|
|
82
|
-
const
|
|
82
|
+
const RE_TAGNAME = /^[!\w]+/
|
|
83
|
+
const RE_TEXT = /^[^<>\n]+/
|
|
84
|
+
const RE_WHITESPACE = /^\s+/
|
|
85
|
+
const RE_WORD = /^[^\s]+/
|
|
83
86
|
|
|
84
87
|
export const initialLineState = {
|
|
85
88
|
state: State.TopLevelContent,
|
|
86
89
|
}
|
|
87
90
|
|
|
91
|
+
/**
|
|
92
|
+
*
|
|
93
|
+
* @param {any} lineStateA
|
|
94
|
+
* @param {any} lineStateB
|
|
95
|
+
* @returns
|
|
96
|
+
*/
|
|
88
97
|
export const isLineStateEqual = (lineStateA, lineStateB) => {
|
|
89
98
|
return lineStateA.state === lineStateB.state
|
|
90
99
|
}
|
|
91
100
|
|
|
101
|
+
/**
|
|
102
|
+
*
|
|
103
|
+
* @param {string} line
|
|
104
|
+
* @param {any} lineState
|
|
105
|
+
* @returns
|
|
106
|
+
*/
|
|
92
107
|
export const tokenizeLine = (line, lineState) => {
|
|
93
108
|
let next = null
|
|
94
109
|
let index = 0
|
|
@@ -205,7 +220,10 @@ export const tokenizeLine = (line, lineState) => {
|
|
|
205
220
|
state = State.AfterAttributeEqualSign
|
|
206
221
|
} else if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
207
222
|
token = TokenType.PunctuationString
|
|
208
|
-
state = State.
|
|
223
|
+
state = State.InsideDoubleQuoteString
|
|
224
|
+
} else if ((next = part.match(RE_SINGLE_QUOTE))) {
|
|
225
|
+
token = TokenType.PunctuationString
|
|
226
|
+
state = State.InsideSingleQuoteString
|
|
209
227
|
} else if ((next = part.match(RE_TAG_TEXT))) {
|
|
210
228
|
token = TokenType.Text
|
|
211
229
|
state = State.InsideOpeningTag
|
|
@@ -221,7 +239,10 @@ export const tokenizeLine = (line, lineState) => {
|
|
|
221
239
|
case State.AfterAttributeEqualSign:
|
|
222
240
|
if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
223
241
|
token = TokenType.PunctuationString
|
|
224
|
-
state = State.
|
|
242
|
+
state = State.InsideDoubleQuoteString
|
|
243
|
+
} else if ((next = part.match(RE_SINGLE_QUOTE))) {
|
|
244
|
+
token = TokenType.PunctuationString
|
|
245
|
+
state = State.InsideSingleQuoteString
|
|
225
246
|
} else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
226
247
|
token = TokenType.PunctuationTag
|
|
227
248
|
state = State.TopLevelContent
|
|
@@ -229,13 +250,24 @@ export const tokenizeLine = (line, lineState) => {
|
|
|
229
250
|
throw new Error('no')
|
|
230
251
|
}
|
|
231
252
|
break
|
|
232
|
-
case State.
|
|
253
|
+
case State.InsideDoubleQuoteString:
|
|
233
254
|
if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
234
255
|
token = TokenType.PunctuationString
|
|
235
256
|
state = State.InsideOpeningTag
|
|
236
257
|
} else if ((next = part.match(RE_STRING_DOUBLE_QUOTE_CONTENT))) {
|
|
237
258
|
token = TokenType.String
|
|
238
|
-
state = State.
|
|
259
|
+
state = State.InsideDoubleQuoteString
|
|
260
|
+
} else {
|
|
261
|
+
throw new Error('no')
|
|
262
|
+
}
|
|
263
|
+
break
|
|
264
|
+
case State.InsideSingleQuoteString:
|
|
265
|
+
if ((next = part.match(RE_SINGLE_QUOTE))) {
|
|
266
|
+
token = TokenType.PunctuationString
|
|
267
|
+
state = State.InsideOpeningTag
|
|
268
|
+
} else if ((next = part.match(RE_STRING_SINGLE_QUOTE_CONTENT))) {
|
|
269
|
+
token = TokenType.String
|
|
270
|
+
state = State.InsideSingleQuoteString
|
|
239
271
|
} else {
|
|
240
272
|
throw new Error('no')
|
|
241
273
|
}
|
|
@@ -266,13 +298,3 @@ export const tokenizeLine = (line, lineState) => {
|
|
|
266
298
|
tokens,
|
|
267
299
|
}
|
|
268
300
|
}
|
|
269
|
-
|
|
270
|
-
// tokenizeLine(initialContext, ' <h1$0></h1>') //?
|
|
271
|
-
// tokenizeLine(initialContext, `<<`)
|
|
272
|
-
|
|
273
|
-
// tokenizeLine(initialContext, `<h1><//`) //?
|
|
274
|
-
// tokenizeLine(initialContext, `<h1 class=></h1>`) //?
|
|
275
|
-
|
|
276
|
-
// tokenizeLine(initialLineState, `<h1234567 class""=></h1234567>`)
|
|
277
|
-
|
|
278
|
-
tokenizeLine('<input disabled autofocus>', initialLineState) //?
|
|
@@ -5,7 +5,30 @@
|
|
|
5
5
|
"languages": [
|
|
6
6
|
{
|
|
7
7
|
"id": "json",
|
|
8
|
-
"extensions": [
|
|
8
|
+
"extensions": [
|
|
9
|
+
".json",
|
|
10
|
+
".bowerrc",
|
|
11
|
+
".jscsrc",
|
|
12
|
+
".webmanifest",
|
|
13
|
+
".js.map",
|
|
14
|
+
".css.map",
|
|
15
|
+
".ts.map",
|
|
16
|
+
".har",
|
|
17
|
+
".jslintrc",
|
|
18
|
+
".jsonld",
|
|
19
|
+
".geojson",
|
|
20
|
+
".ipynb",
|
|
21
|
+
".jsonc",
|
|
22
|
+
".eslintrc",
|
|
23
|
+
".eslintrc.json",
|
|
24
|
+
".jsfmtrc",
|
|
25
|
+
".jshintrc",
|
|
26
|
+
".swcrc",
|
|
27
|
+
".hintrc",
|
|
28
|
+
".babelrc",
|
|
29
|
+
".prettierrc"
|
|
30
|
+
],
|
|
31
|
+
"filenames": ["composer.lock", ".watchmanconfig"],
|
|
9
32
|
"tokenize": "src/tokenizeJson.js"
|
|
10
33
|
}
|
|
11
34
|
]
|
|
@@ -1,33 +1,141 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* @enum number
|
|
3
|
+
*/
|
|
4
|
+
export const State = {
|
|
5
|
+
TopLevelContent: 1,
|
|
6
|
+
InsideLineComment: 2,
|
|
7
|
+
InsideBlockComment: 3,
|
|
8
|
+
}
|
|
9
|
+
|
|
10
|
+
export const StateMap = {
|
|
11
|
+
[State.TopLevelContent]: 'TopLevelContent',
|
|
12
|
+
[State.InsideLineComment]: 'InsideLineComment',
|
|
13
|
+
[State.InsideBlockComment]: 'InsideBlockComment',
|
|
14
|
+
}
|
|
15
|
+
|
|
1
16
|
/**
|
|
2
17
|
* @enum number
|
|
3
18
|
*/
|
|
4
19
|
export const TokenType = {
|
|
5
|
-
|
|
6
|
-
|
|
20
|
+
CssSelector: 1,
|
|
21
|
+
Whitespace: 2,
|
|
22
|
+
None: 57,
|
|
23
|
+
Unknown: 881,
|
|
24
|
+
NewLine: 884,
|
|
25
|
+
Comment: 885,
|
|
26
|
+
Query: 886,
|
|
27
|
+
Text: 887,
|
|
7
28
|
}
|
|
8
29
|
|
|
9
30
|
export const TokenMap = {
|
|
31
|
+
[TokenType.CssSelector]: 'CssSelector',
|
|
32
|
+
[TokenType.Whitespace]: 'Whitespace',
|
|
33
|
+
[TokenType.None]: 'None',
|
|
34
|
+
[TokenType.Unknown]: 'Unknown',
|
|
35
|
+
[TokenType.NewLine]: 'NewLine',
|
|
36
|
+
[TokenType.Comment]: 'Comment',
|
|
37
|
+
[TokenType.Query]: 'Query',
|
|
10
38
|
[TokenType.Text]: 'Text',
|
|
11
39
|
}
|
|
12
40
|
|
|
41
|
+
const RE_LINE_COMMENT_START = /^#/
|
|
42
|
+
const RE_BLOCK_COMMENT_START = /^<#/
|
|
43
|
+
const RE_WHITESPACE = /^ +/
|
|
44
|
+
const RE_CURLY_OPEN = /^\{/
|
|
45
|
+
const RE_CURLY_CLOSE = /^\}/
|
|
46
|
+
const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
|
|
47
|
+
const RE_COLON = /^:/
|
|
48
|
+
const RE_PROPERTY_VALUE = /^[^;\}]+/
|
|
49
|
+
const RE_SEMICOLON = /^;/
|
|
50
|
+
const RE_COMMA = /^,/
|
|
51
|
+
const RE_ANYTHING_UNTIL_END = /^.+/s
|
|
52
|
+
const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
|
|
53
|
+
const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
|
|
54
|
+
const RE_BLOCK_COMMENT_END = /^\*\//
|
|
55
|
+
const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
|
|
56
|
+
const RE_ROUND_OPEN = /^\(/
|
|
57
|
+
const RE_ROUND_CLOSE = /^\)/
|
|
58
|
+
const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
|
|
59
|
+
const RE_SQUARE_OPEN = /^\[/
|
|
60
|
+
const RE_SQUARE_CLOSE = /^\]/
|
|
61
|
+
const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
|
|
62
|
+
const RE_QUERY = /^@[a-z\-]+/
|
|
63
|
+
const RE_STAR = /^\*/
|
|
64
|
+
const RE_QUERY_NAME = /^[a-z\-]+/
|
|
65
|
+
const RE_QUERY_CONTENT = /^[^\)]+/
|
|
66
|
+
const RE_COMBINATOR = /^[\+\>\~]/
|
|
67
|
+
|
|
13
68
|
export const initialLineState = {
|
|
14
|
-
state:
|
|
69
|
+
state: State.TopLevelContent,
|
|
70
|
+
tokens: [],
|
|
71
|
+
stack: [],
|
|
15
72
|
}
|
|
16
73
|
|
|
74
|
+
/**
|
|
75
|
+
* @param {string} line
|
|
76
|
+
* @param {any} lineState
|
|
77
|
+
*/
|
|
17
78
|
export const tokenizeLine = (line, lineState) => {
|
|
18
|
-
|
|
19
|
-
|
|
20
|
-
|
|
21
|
-
|
|
79
|
+
let next = null
|
|
80
|
+
let index = 0
|
|
81
|
+
let tokens = []
|
|
82
|
+
let token = TokenType.None
|
|
83
|
+
let state = lineState.state
|
|
84
|
+
while (index < line.length) {
|
|
85
|
+
const part = line.slice(index)
|
|
86
|
+
switch (state) {
|
|
87
|
+
case State.TopLevelContent:
|
|
88
|
+
if ((next = part.match(RE_LINE_COMMENT_START))) {
|
|
89
|
+
token = TokenType.Comment
|
|
90
|
+
state = State.InsideLineComment
|
|
91
|
+
} else if ((next = part.match(RE_BLOCK_COMMENT_START))) {
|
|
92
|
+
token = TokenType.Comment
|
|
93
|
+
state = State.InsideBlockComment
|
|
94
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
95
|
+
token = TokenType.Whitespace
|
|
96
|
+
state = State.TopLevelContent
|
|
97
|
+
} else if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
|
|
98
|
+
token = TokenType.Text
|
|
99
|
+
state = State.TopLevelContent
|
|
100
|
+
} else {
|
|
101
|
+
part //?
|
|
102
|
+
throw new Error('no')
|
|
103
|
+
}
|
|
104
|
+
break
|
|
105
|
+
case State.InsideLineComment:
|
|
106
|
+
if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
|
|
107
|
+
token = TokenType.Comment
|
|
108
|
+
state = State.TopLevelContent
|
|
109
|
+
} else {
|
|
110
|
+
throw new Error('no')
|
|
111
|
+
}
|
|
112
|
+
break
|
|
113
|
+
case State.InsideBlockComment:
|
|
114
|
+
if ((next = part.match(RE_BLOCK_COMMENT_CONTENT))) {
|
|
115
|
+
token = TokenType.Comment
|
|
116
|
+
state = State.InsideBlockComment
|
|
117
|
+
} else if ((next = part.match(RE_BLOCK_COMMENT_END))) {
|
|
118
|
+
token = TokenType.Comment
|
|
119
|
+
state = State.TopLevelContent
|
|
120
|
+
} else if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
|
|
121
|
+
token = TokenType.Comment
|
|
122
|
+
state = State.InsideBlockComment
|
|
123
|
+
} else {
|
|
124
|
+
throw new Error('no')
|
|
125
|
+
}
|
|
126
|
+
break
|
|
127
|
+
default:
|
|
128
|
+
console.log({ state, line })
|
|
129
|
+
throw new Error('no')
|
|
22
130
|
}
|
|
131
|
+
index += next[0].length
|
|
132
|
+
tokens.push({
|
|
133
|
+
type: token,
|
|
134
|
+
length: next[0].length,
|
|
135
|
+
})
|
|
23
136
|
}
|
|
24
137
|
return {
|
|
25
|
-
state
|
|
26
|
-
tokens
|
|
27
|
-
{
|
|
28
|
-
type: TokenType.Text,
|
|
29
|
-
length: line.length,
|
|
30
|
-
},
|
|
31
|
-
],
|
|
138
|
+
state,
|
|
139
|
+
tokens,
|
|
32
140
|
}
|
|
33
141
|
}
|
|
@@ -0,0 +1,14 @@
|
|
|
1
|
+
# Language Basics Toml
|
|
2
|
+
|
|
3
|
+
## Contributing
|
|
4
|
+
|
|
5
|
+
```sh
|
|
6
|
+
git clone git@github.com:lvce-editor/language-basics-toml.git &&
|
|
7
|
+
cd language-basics-toml &&
|
|
8
|
+
npm ci &&
|
|
9
|
+
npm test
|
|
10
|
+
```
|
|
11
|
+
|
|
12
|
+
## Gitpod
|
|
13
|
+
|
|
14
|
+
[](https://gitpod.io/#https://github.com/lvce-editor/language-basics-toml)
|
|
@@ -0,0 +1,12 @@
|
|
|
1
|
+
{
|
|
2
|
+
"id": "builtin.language-basics-toml",
|
|
3
|
+
"name": "Language Basics Toml",
|
|
4
|
+
"description": "Provides syntax highlighting and bracket matching in Toml files.",
|
|
5
|
+
"languages": [
|
|
6
|
+
{
|
|
7
|
+
"id": "toml",
|
|
8
|
+
"extensions": [".toml"],
|
|
9
|
+
"tokenize": "src/tokenizeToml.js"
|
|
10
|
+
}
|
|
11
|
+
]
|
|
12
|
+
}
|
|
@@ -0,0 +1,122 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* @enum number
|
|
3
|
+
*/
|
|
4
|
+
export const State = {
|
|
5
|
+
TopLevelContent: 1,
|
|
6
|
+
InsideLineComment: 2,
|
|
7
|
+
}
|
|
8
|
+
|
|
9
|
+
export const StateMap = {
|
|
10
|
+
[State.TopLevelContent]: 'TopLevelContent',
|
|
11
|
+
[State.InsideLineComment]: 'InsideLineComment',
|
|
12
|
+
}
|
|
13
|
+
|
|
14
|
+
/**
|
|
15
|
+
* @enum number
|
|
16
|
+
*/
|
|
17
|
+
export const TokenType = {
|
|
18
|
+
CssSelector: 1,
|
|
19
|
+
Whitespace: 2,
|
|
20
|
+
None: 57,
|
|
21
|
+
Unknown: 881,
|
|
22
|
+
NewLine: 884,
|
|
23
|
+
Comment: 885,
|
|
24
|
+
Query: 886,
|
|
25
|
+
Text: 887,
|
|
26
|
+
}
|
|
27
|
+
|
|
28
|
+
export const TokenMap = {
|
|
29
|
+
[TokenType.CssSelector]: 'CssSelector',
|
|
30
|
+
[TokenType.Whitespace]: 'Whitespace',
|
|
31
|
+
[TokenType.None]: 'None',
|
|
32
|
+
[TokenType.Unknown]: 'Unknown',
|
|
33
|
+
[TokenType.NewLine]: 'NewLine',
|
|
34
|
+
[TokenType.Comment]: 'Comment',
|
|
35
|
+
[TokenType.Query]: 'Query',
|
|
36
|
+
[TokenType.Text]: 'Text',
|
|
37
|
+
}
|
|
38
|
+
|
|
39
|
+
const RE_LINE_COMMENT_START = /^#/
|
|
40
|
+
const RE_WHITESPACE = /^ +/
|
|
41
|
+
const RE_CURLY_OPEN = /^\{/
|
|
42
|
+
const RE_CURLY_CLOSE = /^\}/
|
|
43
|
+
const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
|
|
44
|
+
const RE_COLON = /^:/
|
|
45
|
+
const RE_PROPERTY_VALUE = /^[^;\}]+/
|
|
46
|
+
const RE_SEMICOLON = /^;/
|
|
47
|
+
const RE_COMMA = /^,/
|
|
48
|
+
const RE_ANYTHING = /^.*/
|
|
49
|
+
const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
|
|
50
|
+
const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
|
|
51
|
+
const RE_BLOCK_COMMENT_START = /^\/\*/
|
|
52
|
+
const RE_BLOCK_COMMENT_END = /^\*\//
|
|
53
|
+
const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
|
|
54
|
+
const RE_ROUND_OPEN = /^\(/
|
|
55
|
+
const RE_ROUND_CLOSE = /^\)/
|
|
56
|
+
const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
|
|
57
|
+
const RE_SQUARE_OPEN = /^\[/
|
|
58
|
+
const RE_SQUARE_CLOSE = /^\]/
|
|
59
|
+
const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
|
|
60
|
+
const RE_QUERY = /^@[a-z\-]+/
|
|
61
|
+
const RE_STAR = /^\*/
|
|
62
|
+
const RE_QUERY_NAME = /^[a-z\-]+/
|
|
63
|
+
const RE_QUERY_CONTENT = /^[^\)]+/
|
|
64
|
+
const RE_COMBINATOR = /^[\+\>\~]/
|
|
65
|
+
|
|
66
|
+
export const initialLineState = {
|
|
67
|
+
state: State.TopLevelContent,
|
|
68
|
+
tokens: [],
|
|
69
|
+
stack: [],
|
|
70
|
+
}
|
|
71
|
+
|
|
72
|
+
/**
|
|
73
|
+
* @param {string} line
|
|
74
|
+
* @param {any} lineState
|
|
75
|
+
*/
|
|
76
|
+
export const tokenizeLine = (line, lineState) => {
|
|
77
|
+
let next = null
|
|
78
|
+
let index = 0
|
|
79
|
+
let tokens = []
|
|
80
|
+
let token = TokenType.None
|
|
81
|
+
let state = lineState.state
|
|
82
|
+
while (index < line.length) {
|
|
83
|
+
const part = line.slice(index)
|
|
84
|
+
switch (state) {
|
|
85
|
+
case State.TopLevelContent:
|
|
86
|
+
if ((next = part.match(RE_LINE_COMMENT_START))) {
|
|
87
|
+
token = TokenType.Comment
|
|
88
|
+
state = State.InsideLineComment
|
|
89
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
90
|
+
token = TokenType.Whitespace
|
|
91
|
+
state = State.TopLevelContent
|
|
92
|
+
} else if ((next = part.match(RE_ANYTHING))) {
|
|
93
|
+
token = TokenType.Text
|
|
94
|
+
state = State.TopLevelContent
|
|
95
|
+
} else {
|
|
96
|
+
part //?
|
|
97
|
+
throw new Error('no')
|
|
98
|
+
}
|
|
99
|
+
break
|
|
100
|
+
case State.InsideLineComment:
|
|
101
|
+
if ((next = part.match(RE_ANYTHING))) {
|
|
102
|
+
token = TokenType.Comment
|
|
103
|
+
state = State.TopLevelContent
|
|
104
|
+
} else {
|
|
105
|
+
throw new Error('no')
|
|
106
|
+
}
|
|
107
|
+
break
|
|
108
|
+
default:
|
|
109
|
+
console.log({ state, line })
|
|
110
|
+
throw new Error('no')
|
|
111
|
+
}
|
|
112
|
+
index += next[0].length
|
|
113
|
+
tokens.push({
|
|
114
|
+
type: token,
|
|
115
|
+
length: next[0].length,
|
|
116
|
+
})
|
|
117
|
+
}
|
|
118
|
+
return {
|
|
119
|
+
state,
|
|
120
|
+
tokens,
|
|
121
|
+
}
|
|
122
|
+
}
|
|
@@ -1,33 +1,298 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* @enum number
|
|
3
|
+
*/
|
|
4
|
+
const State = {
|
|
5
|
+
TopLevelContent: 1,
|
|
6
|
+
AfterOpeningAngleBracket: 2,
|
|
7
|
+
InsideOpeningTag: 3,
|
|
8
|
+
InsideOpeningTagAndHasSeenWhitespace: 4,
|
|
9
|
+
AfterClosingTagAngleBrackets: 5,
|
|
10
|
+
AfterClosingTagName: 6,
|
|
11
|
+
AfterAttributeName: 7,
|
|
12
|
+
AfterAttributeEqualSign: 8,
|
|
13
|
+
InsideAttributeDoubleQuote: 9,
|
|
14
|
+
InsideBlockComment: 10,
|
|
15
|
+
None: 11,
|
|
16
|
+
InsideDoubleQuoteString: 12,
|
|
17
|
+
InsideSingleQuoteString: 13,
|
|
18
|
+
}
|
|
19
|
+
|
|
20
|
+
export const StateMap = {}
|
|
21
|
+
|
|
1
22
|
/**
|
|
2
23
|
* @enum number
|
|
3
24
|
*/
|
|
4
25
|
export const TokenType = {
|
|
5
|
-
|
|
6
|
-
|
|
26
|
+
None: 99999999,
|
|
27
|
+
Numeric: 30,
|
|
28
|
+
String: 50,
|
|
29
|
+
Whitespace: 0,
|
|
30
|
+
Comment: 60,
|
|
31
|
+
Text: 117,
|
|
32
|
+
PunctuationTag: 228,
|
|
33
|
+
TagName: 118,
|
|
34
|
+
AttributeName: 119,
|
|
35
|
+
Punctuation: 10,
|
|
36
|
+
Error: 141,
|
|
37
|
+
PunctuationString: 11,
|
|
38
|
+
NewLine: 891,
|
|
7
39
|
}
|
|
8
40
|
|
|
9
41
|
export const TokenMap = {
|
|
42
|
+
[TokenType.None]: 'None',
|
|
43
|
+
[TokenType.Numeric]: 'Numeric',
|
|
44
|
+
[TokenType.String]: 'String',
|
|
45
|
+
[TokenType.Whitespace]: 'Whitespace',
|
|
46
|
+
[TokenType.Comment]: 'Comment',
|
|
10
47
|
[TokenType.Text]: 'Text',
|
|
48
|
+
[TokenType.PunctuationTag]: 'PunctuationTag',
|
|
49
|
+
[TokenType.TagName]: 'TagName',
|
|
50
|
+
[TokenType.AttributeName]: 'AttributeName',
|
|
51
|
+
[TokenType.Punctuation]: 'Punctuation',
|
|
52
|
+
[TokenType.Error]: 'Error',
|
|
53
|
+
[TokenType.PunctuationString]: 'PunctuationString',
|
|
11
54
|
}
|
|
12
55
|
|
|
56
|
+
const RE_ANGLE_BRACKET_CLOSE = /^>/
|
|
57
|
+
const RE_ANGLE_BRACKET_ONLY = /^</
|
|
58
|
+
const RE_ANGLE_BRACKET_OPEN = /^</
|
|
59
|
+
const RE_ANGLE_BRACKET_OPEN_TAG = /^<(?!\s)/
|
|
60
|
+
const RE_ANY_TEXT = /^[^\n]+/
|
|
61
|
+
const RE_ATTRIBUTE_NAME = /^[a-zA-Z\d\-]+/
|
|
62
|
+
const RE_BLOCK_COMMENT_CONTENT = /^.(?:.*?)(?=-->|$)/s
|
|
63
|
+
const RE_BLOCK_COMMENT_END = /^-->/
|
|
64
|
+
const RE_BLOCK_COMMENT_START = /^<!--/
|
|
65
|
+
const RE_DASH_DASH = /^\-\-/
|
|
66
|
+
const RE_DOUBLE_QUOTE = /^"/
|
|
67
|
+
const RE_EQUAL_SIGN = /^=/
|
|
68
|
+
const RE_EXCLAMATION_MARK = /^!/
|
|
69
|
+
const RE_INVALID_INSIDE_ClOSING_TAG = /^[^a-zA-Z>]/
|
|
70
|
+
const RE_INVALID_INSIDE_OPENING_TAG = /^[^a-zA-Z>]/
|
|
71
|
+
const RE_NEWLINE = /^\n/
|
|
72
|
+
const RE_NEWLINE_WHITESPACE = /^\n\s*/
|
|
73
|
+
const RE_NOT_TAGNAME = /^[^a-zA-Z\d]+/
|
|
74
|
+
const RE_PUNCTUATION = /^[<;'".,]/
|
|
75
|
+
const RE_PUNCTUATION_SELF_CLOSING = /^\/>/
|
|
76
|
+
const RE_SELF_CLOSING = /^\/>/
|
|
77
|
+
const RE_SINGLE_QUOTE = /^'/
|
|
78
|
+
const RE_SLASH = /^\//
|
|
79
|
+
const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
|
|
80
|
+
const RE_STRING_SINGLE_QUOTE_CONTENT = /^[^']+/
|
|
81
|
+
const RE_TAG_TEXT = /^[^\s>]+/
|
|
82
|
+
const RE_TAGNAME = /^[!\w]+/
|
|
83
|
+
const RE_TEXT = /^[^<>\n]+/
|
|
84
|
+
const RE_WHITESPACE = /^\s+/
|
|
85
|
+
const RE_WORD = /^[^\s]+/
|
|
86
|
+
|
|
13
87
|
export const initialLineState = {
|
|
14
|
-
state:
|
|
88
|
+
state: State.TopLevelContent,
|
|
15
89
|
}
|
|
16
90
|
|
|
91
|
+
/**
|
|
92
|
+
*
|
|
93
|
+
* @param {any} lineStateA
|
|
94
|
+
* @param {any} lineStateB
|
|
95
|
+
* @returns
|
|
96
|
+
*/
|
|
97
|
+
export const isLineStateEqual = (lineStateA, lineStateB) => {
|
|
98
|
+
return lineStateA.state === lineStateB.state
|
|
99
|
+
}
|
|
100
|
+
|
|
101
|
+
/**
|
|
102
|
+
*
|
|
103
|
+
* @param {string} line
|
|
104
|
+
* @param {any} lineState
|
|
105
|
+
* @returns
|
|
106
|
+
*/
|
|
17
107
|
export const tokenizeLine = (line, lineState) => {
|
|
18
|
-
|
|
19
|
-
|
|
20
|
-
|
|
21
|
-
|
|
108
|
+
let next = null
|
|
109
|
+
let index = 0
|
|
110
|
+
let tokens = []
|
|
111
|
+
let token = TokenType.None
|
|
112
|
+
let state = lineState.state
|
|
113
|
+
while (index < line.length) {
|
|
114
|
+
const part = line.slice(index)
|
|
115
|
+
switch (state) {
|
|
116
|
+
case State.TopLevelContent:
|
|
117
|
+
if ((next = part.match(RE_ANGLE_BRACKET_OPEN_TAG))) {
|
|
118
|
+
token = TokenType.PunctuationTag
|
|
119
|
+
state = State.AfterOpeningAngleBracket
|
|
120
|
+
} else if ((next = part.match(RE_TEXT))) {
|
|
121
|
+
token = TokenType.Text
|
|
122
|
+
state = State.TopLevelContent
|
|
123
|
+
} else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
124
|
+
token = TokenType.Text
|
|
125
|
+
state = State.TopLevelContent
|
|
126
|
+
} else if ((next = part.match(RE_ANGLE_BRACKET_OPEN))) {
|
|
127
|
+
token = TokenType.Text
|
|
128
|
+
state = State.TopLevelContent
|
|
129
|
+
} else {
|
|
130
|
+
part //?
|
|
131
|
+
throw new Error('no')
|
|
132
|
+
}
|
|
133
|
+
break
|
|
134
|
+
case State.AfterOpeningAngleBracket:
|
|
135
|
+
if ((next = part.match(RE_TAGNAME))) {
|
|
136
|
+
token = TokenType.TagName
|
|
137
|
+
state = State.InsideOpeningTag
|
|
138
|
+
} else if ((next = part.match(RE_SLASH))) {
|
|
139
|
+
token = TokenType.PunctuationTag
|
|
140
|
+
state = State.AfterClosingTagAngleBrackets
|
|
141
|
+
} else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
142
|
+
token = TokenType.PunctuationTag
|
|
143
|
+
state = State.TopLevelContent
|
|
144
|
+
} else if ((next = part.match(RE_ANY_TEXT))) {
|
|
145
|
+
token = TokenType.Text
|
|
146
|
+
state = State.TopLevelContent
|
|
147
|
+
} else {
|
|
148
|
+
part //?
|
|
149
|
+
throw new Error('no')
|
|
150
|
+
}
|
|
151
|
+
break
|
|
152
|
+
case State.InsideOpeningTag:
|
|
153
|
+
if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
154
|
+
token = TokenType.PunctuationTag
|
|
155
|
+
state = State.TopLevelContent
|
|
156
|
+
} else if ((next = part.match(RE_EXCLAMATION_MARK))) {
|
|
157
|
+
token = TokenType.PunctuationTag
|
|
158
|
+
state = State.InsideOpeningTag
|
|
159
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
160
|
+
token = TokenType.Whitespace
|
|
161
|
+
state = State.InsideOpeningTagAndHasSeenWhitespace
|
|
162
|
+
} else if ((next = part.match(RE_DASH_DASH))) {
|
|
163
|
+
token = TokenType.Comment
|
|
164
|
+
state = State.InsideBlockComment
|
|
165
|
+
} else if ((next = part.match(RE_TAG_TEXT))) {
|
|
166
|
+
token = TokenType.Text
|
|
167
|
+
state = State.InsideOpeningTag
|
|
168
|
+
} else {
|
|
169
|
+
part //?
|
|
170
|
+
throw new Error('no')
|
|
171
|
+
}
|
|
172
|
+
break
|
|
173
|
+
case State.AfterClosingTagAngleBrackets:
|
|
174
|
+
if ((next = part.match(RE_TAGNAME))) {
|
|
175
|
+
token = TokenType.TagName
|
|
176
|
+
state = State.AfterClosingTagName
|
|
177
|
+
} else if ((next = part.match(RE_ANY_TEXT))) {
|
|
178
|
+
token = TokenType.Text
|
|
179
|
+
state = State.TopLevelContent
|
|
180
|
+
} else {
|
|
181
|
+
part //?
|
|
182
|
+
throw new Error('no')
|
|
183
|
+
}
|
|
184
|
+
break
|
|
185
|
+
case State.AfterClosingTagName:
|
|
186
|
+
if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
187
|
+
token = TokenType.PunctuationTag
|
|
188
|
+
state = State.TopLevelContent
|
|
189
|
+
} else if ((next = part.match(RE_TEXT))) {
|
|
190
|
+
token = TokenType.Text
|
|
191
|
+
state = State.TopLevelContent
|
|
192
|
+
} else {
|
|
193
|
+
throw new Error('no')
|
|
194
|
+
}
|
|
195
|
+
break
|
|
196
|
+
case State.InsideOpeningTagAndHasSeenWhitespace:
|
|
197
|
+
if ((next = part.match(RE_ATTRIBUTE_NAME))) {
|
|
198
|
+
token = TokenType.AttributeName
|
|
199
|
+
state = State.AfterAttributeName
|
|
200
|
+
} else if ((next = part.match(RE_SELF_CLOSING))) {
|
|
201
|
+
token = TokenType.PunctuationTag
|
|
202
|
+
state = State.TopLevelContent
|
|
203
|
+
} else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
204
|
+
token = TokenType.PunctuationTag
|
|
205
|
+
state = State.TopLevelContent
|
|
206
|
+
} else if ((next = part.match(RE_TAG_TEXT))) {
|
|
207
|
+
token = TokenType.Text
|
|
208
|
+
state = State.TopLevelContent
|
|
209
|
+
} else {
|
|
210
|
+
part //?
|
|
211
|
+
throw new Error('no')
|
|
212
|
+
}
|
|
213
|
+
break
|
|
214
|
+
case State.AfterAttributeName:
|
|
215
|
+
if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
216
|
+
token = TokenType.PunctuationTag
|
|
217
|
+
state = State.TopLevelContent
|
|
218
|
+
} else if ((next = part.match(RE_EQUAL_SIGN))) {
|
|
219
|
+
token = TokenType.Punctuation
|
|
220
|
+
state = State.AfterAttributeEqualSign
|
|
221
|
+
} else if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
222
|
+
token = TokenType.PunctuationString
|
|
223
|
+
state = State.InsideDoubleQuoteString
|
|
224
|
+
} else if ((next = part.match(RE_SINGLE_QUOTE))) {
|
|
225
|
+
token = TokenType.PunctuationString
|
|
226
|
+
state = State.InsideSingleQuoteString
|
|
227
|
+
} else if ((next = part.match(RE_TAG_TEXT))) {
|
|
228
|
+
token = TokenType.Text
|
|
229
|
+
state = State.InsideOpeningTag
|
|
230
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
231
|
+
token = TokenType.Whitespace
|
|
232
|
+
state = State.InsideOpeningTagAndHasSeenWhitespace
|
|
233
|
+
} else {
|
|
234
|
+
throw new Error('no')
|
|
235
|
+
}
|
|
236
|
+
break
|
|
237
|
+
case State.AfterAttributeEqualSign:
|
|
238
|
+
if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
239
|
+
token = TokenType.PunctuationString
|
|
240
|
+
state = State.InsideDoubleQuoteString
|
|
241
|
+
} else if ((next = part.match(RE_SINGLE_QUOTE))) {
|
|
242
|
+
token = TokenType.PunctuationString
|
|
243
|
+
state = State.InsideSingleQuoteString
|
|
244
|
+
} else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
|
|
245
|
+
token = TokenType.PunctuationTag
|
|
246
|
+
state = State.TopLevelContent
|
|
247
|
+
} else {
|
|
248
|
+
throw new Error('no')
|
|
249
|
+
}
|
|
250
|
+
break
|
|
251
|
+
case State.InsideDoubleQuoteString:
|
|
252
|
+
if ((next = part.match(RE_DOUBLE_QUOTE))) {
|
|
253
|
+
token = TokenType.PunctuationString
|
|
254
|
+
state = State.InsideOpeningTag
|
|
255
|
+
} else if ((next = part.match(RE_STRING_DOUBLE_QUOTE_CONTENT))) {
|
|
256
|
+
token = TokenType.String
|
|
257
|
+
state = State.InsideDoubleQuoteString
|
|
258
|
+
} else {
|
|
259
|
+
throw new Error('no')
|
|
260
|
+
}
|
|
261
|
+
break
|
|
262
|
+
case State.InsideSingleQuoteString:
|
|
263
|
+
if ((next = part.match(RE_SINGLE_QUOTE))) {
|
|
264
|
+
token = TokenType.PunctuationString
|
|
265
|
+
state = State.InsideOpeningTag
|
|
266
|
+
} else if ((next = part.match(RE_STRING_SINGLE_QUOTE_CONTENT))) {
|
|
267
|
+
token = TokenType.String
|
|
268
|
+
state = State.InsideSingleQuoteString
|
|
269
|
+
} else {
|
|
270
|
+
throw new Error('no')
|
|
271
|
+
}
|
|
272
|
+
break
|
|
273
|
+
case State.InsideBlockComment:
|
|
274
|
+
if ((next = part.match(RE_BLOCK_COMMENT_CONTENT))) {
|
|
275
|
+
token = TokenType.Comment
|
|
276
|
+
state = State.InsideBlockComment
|
|
277
|
+
} else if ((next = part.match(RE_BLOCK_COMMENT_END))) {
|
|
278
|
+
token = TokenType.Comment
|
|
279
|
+
state = State.TopLevelContent
|
|
280
|
+
} else {
|
|
281
|
+
throw new Error('no')
|
|
282
|
+
}
|
|
283
|
+
break
|
|
284
|
+
default:
|
|
285
|
+
state
|
|
286
|
+
throw new Error('no')
|
|
22
287
|
}
|
|
288
|
+
index += next[0].length
|
|
289
|
+
tokens.push({
|
|
290
|
+
type: token,
|
|
291
|
+
length: next[0].length,
|
|
292
|
+
})
|
|
23
293
|
}
|
|
24
294
|
return {
|
|
25
|
-
state
|
|
26
|
-
tokens
|
|
27
|
-
{
|
|
28
|
-
type: TokenType.Text,
|
|
29
|
-
length: line.length,
|
|
30
|
-
},
|
|
31
|
-
],
|
|
295
|
+
state,
|
|
296
|
+
tokens,
|
|
32
297
|
}
|
|
33
298
|
}
|
|
@@ -1,33 +1,122 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* @enum number
|
|
3
|
+
*/
|
|
4
|
+
export const State = {
|
|
5
|
+
TopLevelContent: 1,
|
|
6
|
+
InsideLineComment: 2,
|
|
7
|
+
}
|
|
8
|
+
|
|
9
|
+
export const StateMap = {
|
|
10
|
+
[State.TopLevelContent]: 'TopLevelContent',
|
|
11
|
+
[State.InsideLineComment]: 'InsideLineComment',
|
|
12
|
+
}
|
|
13
|
+
|
|
1
14
|
/**
|
|
2
15
|
* @enum number
|
|
3
16
|
*/
|
|
4
17
|
export const TokenType = {
|
|
5
|
-
|
|
6
|
-
|
|
18
|
+
CssSelector: 1,
|
|
19
|
+
Whitespace: 2,
|
|
20
|
+
None: 57,
|
|
21
|
+
Unknown: 881,
|
|
22
|
+
NewLine: 884,
|
|
23
|
+
Comment: 885,
|
|
24
|
+
Query: 886,
|
|
25
|
+
Text: 887,
|
|
7
26
|
}
|
|
8
27
|
|
|
9
28
|
export const TokenMap = {
|
|
29
|
+
[TokenType.CssSelector]: 'CssSelector',
|
|
30
|
+
[TokenType.Whitespace]: 'Whitespace',
|
|
31
|
+
[TokenType.None]: 'None',
|
|
32
|
+
[TokenType.Unknown]: 'Unknown',
|
|
33
|
+
[TokenType.NewLine]: 'NewLine',
|
|
34
|
+
[TokenType.Comment]: 'Comment',
|
|
35
|
+
[TokenType.Query]: 'Query',
|
|
10
36
|
[TokenType.Text]: 'Text',
|
|
11
37
|
}
|
|
12
38
|
|
|
39
|
+
const RE_LINE_COMMENT_START = /^#/
|
|
40
|
+
const RE_WHITESPACE = /^ +/
|
|
41
|
+
const RE_CURLY_OPEN = /^\{/
|
|
42
|
+
const RE_CURLY_CLOSE = /^\}/
|
|
43
|
+
const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
|
|
44
|
+
const RE_COLON = /^:/
|
|
45
|
+
const RE_PROPERTY_VALUE = /^[^;\}]+/
|
|
46
|
+
const RE_SEMICOLON = /^;/
|
|
47
|
+
const RE_COMMA = /^,/
|
|
48
|
+
const RE_ANYTHING = /^.*/
|
|
49
|
+
const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
|
|
50
|
+
const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
|
|
51
|
+
const RE_BLOCK_COMMENT_START = /^\/\*/
|
|
52
|
+
const RE_BLOCK_COMMENT_END = /^\*\//
|
|
53
|
+
const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
|
|
54
|
+
const RE_ROUND_OPEN = /^\(/
|
|
55
|
+
const RE_ROUND_CLOSE = /^\)/
|
|
56
|
+
const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
|
|
57
|
+
const RE_SQUARE_OPEN = /^\[/
|
|
58
|
+
const RE_SQUARE_CLOSE = /^\]/
|
|
59
|
+
const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
|
|
60
|
+
const RE_QUERY = /^@[a-z\-]+/
|
|
61
|
+
const RE_STAR = /^\*/
|
|
62
|
+
const RE_QUERY_NAME = /^[a-z\-]+/
|
|
63
|
+
const RE_QUERY_CONTENT = /^[^\)]+/
|
|
64
|
+
const RE_COMBINATOR = /^[\+\>\~]/
|
|
65
|
+
|
|
13
66
|
export const initialLineState = {
|
|
14
|
-
state:
|
|
67
|
+
state: State.TopLevelContent,
|
|
68
|
+
tokens: [],
|
|
69
|
+
stack: [],
|
|
15
70
|
}
|
|
16
71
|
|
|
72
|
+
/**
|
|
73
|
+
* @param {string} line
|
|
74
|
+
* @param {any} lineState
|
|
75
|
+
*/
|
|
17
76
|
export const tokenizeLine = (line, lineState) => {
|
|
18
|
-
|
|
19
|
-
|
|
20
|
-
|
|
21
|
-
|
|
77
|
+
let next = null
|
|
78
|
+
let index = 0
|
|
79
|
+
let tokens = []
|
|
80
|
+
let token = TokenType.None
|
|
81
|
+
let state = lineState.state
|
|
82
|
+
while (index < line.length) {
|
|
83
|
+
const part = line.slice(index)
|
|
84
|
+
switch (state) {
|
|
85
|
+
case State.TopLevelContent:
|
|
86
|
+
if ((next = part.match(RE_LINE_COMMENT_START))) {
|
|
87
|
+
token = TokenType.Comment
|
|
88
|
+
state = State.InsideLineComment
|
|
89
|
+
} else if ((next = part.match(RE_WHITESPACE))) {
|
|
90
|
+
token = TokenType.Whitespace
|
|
91
|
+
state = State.TopLevelContent
|
|
92
|
+
} else if ((next = part.match(RE_ANYTHING))) {
|
|
93
|
+
token = TokenType.Text
|
|
94
|
+
state = State.TopLevelContent
|
|
95
|
+
} else {
|
|
96
|
+
part //?
|
|
97
|
+
throw new Error('no')
|
|
98
|
+
}
|
|
99
|
+
break
|
|
100
|
+
case State.InsideLineComment:
|
|
101
|
+
if ((next = part.match(RE_ANYTHING))) {
|
|
102
|
+
token = TokenType.Comment
|
|
103
|
+
state = State.TopLevelContent
|
|
104
|
+
} else {
|
|
105
|
+
throw new Error('no')
|
|
106
|
+
}
|
|
107
|
+
break
|
|
108
|
+
default:
|
|
109
|
+
console.log({ state, line })
|
|
110
|
+
throw new Error('no')
|
|
22
111
|
}
|
|
112
|
+
index += next[0].length
|
|
113
|
+
tokens.push({
|
|
114
|
+
type: token,
|
|
115
|
+
length: next[0].length,
|
|
116
|
+
})
|
|
23
117
|
}
|
|
24
118
|
return {
|
|
25
|
-
state
|
|
26
|
-
tokens
|
|
27
|
-
{
|
|
28
|
-
type: TokenType.Text,
|
|
29
|
-
length: line.length,
|
|
30
|
-
},
|
|
31
|
-
],
|
|
119
|
+
state,
|
|
120
|
+
tokens,
|
|
32
121
|
}
|
|
33
122
|
}
|
package/package.json
CHANGED
|
@@ -1,6 +1,6 @@
|
|
|
1
1
|
{
|
|
2
2
|
"name": "@lvce-editor/shared-process",
|
|
3
|
-
"version": "0.0.
|
|
3
|
+
"version": "0.0.38",
|
|
4
4
|
"description": "",
|
|
5
5
|
"main": "index.js",
|
|
6
6
|
"type": "module",
|
|
@@ -38,8 +38,8 @@
|
|
|
38
38
|
"verror": "^1.10.1",
|
|
39
39
|
"ws": "^8.8.1",
|
|
40
40
|
"xdg-basedir": "^5.1.0",
|
|
41
|
-
"@lvce-editor/pty-host": "0.0.
|
|
42
|
-
"@lvce-editor/extension-host": "0.0.
|
|
41
|
+
"@lvce-editor/pty-host": "0.0.38",
|
|
42
|
+
"@lvce-editor/extension-host": "0.0.38"
|
|
43
43
|
},
|
|
44
44
|
"optionalDependencies": {
|
|
45
45
|
"electron-clipboard-ex": "^1.3.3",
|