@lvce-editor/shared-process 0.0.37 → 0.0.38

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -0,0 +1,14 @@
1
+ # Language Basics C
2
+
3
+ ## Contributing
4
+
5
+ ```sh
6
+ git clone git@github.com:lvce-editor/language-basics-c.git &&
7
+ cd language-basics-c &&
8
+ npm ci &&
9
+ npm test
10
+ ```
11
+
12
+ ## Gitpod
13
+
14
+ [![Open in Gitpod](https://gitpod.io/button/open-in-gitpod.svg)](https://gitpod.io/#https://github.com/lvce-editor/language-basics-c)
@@ -0,0 +1,12 @@
1
+ {
2
+ "id": "builtin.language-basics-c",
3
+ "name": "Language Basics C",
4
+ "description": "Provides syntax highlighting and bracket matching in C files.",
5
+ "languages": [
6
+ {
7
+ "id": "c",
8
+ "extensions": [".c"],
9
+ "tokenize": "src/tokenizeC.js"
10
+ }
11
+ ]
12
+ }
@@ -0,0 +1,180 @@
1
+ /**
2
+ * @enum number
3
+ */
4
+ export const State = {
5
+ TopLevelContent: 1,
6
+ AfterInclude: 2,
7
+ InsideLineComment: 3,
8
+ InsideDoubleQuoteString: 4,
9
+ }
10
+
11
+ export const StateMap = {
12
+ [State.TopLevelContent]: 'TopLevelContent',
13
+ [State.AfterInclude]: 'AfterInclude',
14
+ [State.InsideLineComment]: 'InsideLineComment',
15
+ [State.InsideDoubleQuoteString]: 'InsideDoubleQuoteString',
16
+ }
17
+
18
+ /**
19
+ * @enum number
20
+ */
21
+ export const TokenType = {
22
+ Whitespace: 2,
23
+ Punctuation: 3,
24
+ CurlyOpen: 6,
25
+ CurlyClose: 7,
26
+ PropertyColon: 8,
27
+ VariableName: 10,
28
+ None: 57,
29
+ Unknown: 881,
30
+ Numeric: 883,
31
+ NewLine: 884,
32
+ Include: 885,
33
+ Import: 886,
34
+ Keyword: 887,
35
+ Comment: 888,
36
+ PunctuationString: 889,
37
+ String: 890,
38
+ PlainText: 891,
39
+ }
40
+
41
+ export const TokenMap = {
42
+ [TokenType.Whitespace]: 'Whitespace',
43
+ [TokenType.Punctuation]: 'Punctuation',
44
+ [TokenType.CurlyOpen]: 'Punctuation',
45
+ [TokenType.PropertyColon]: 'Punctuation',
46
+ [TokenType.VariableName]: 'VariableName',
47
+ [TokenType.None]: 'None',
48
+ [TokenType.Unknown]: 'Unknown',
49
+ [TokenType.Numeric]: 'Numeric',
50
+ [TokenType.NewLine]: 'NewLine',
51
+ [TokenType.Include]: 'Include',
52
+ [TokenType.Import]: 'Import',
53
+ [TokenType.Keyword]: 'Keyword',
54
+ [TokenType.Comment]: 'Comment',
55
+ [TokenType.PunctuationString]: 'PunctuationString',
56
+ [TokenType.String]: 'String',
57
+ [TokenType.PlainText]: 'PlainText',
58
+ }
59
+
60
+ const RE_SELECTOR = /^[\.a-zA-Z\d\-\:>]+/
61
+ const RE_WHITESPACE = /^ +/
62
+ const RE_CURLY_OPEN = /^\{/
63
+ const RE_CURLY_CLOSE = /^\}/
64
+ const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
65
+ const RE_COLON = /^:/
66
+ const RE_PROPERTY_VALUE = /^[^;]+/
67
+ const RE_SEMICOLON = /^;/
68
+ const RE_COMMA = /^,/
69
+ const RE_ANYTHING = /^.*/
70
+ const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
71
+ const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
72
+ const RE_INCLUDE = /^#include\b/
73
+ const RE_IMPORT = /^<[^>]*>/
74
+ const RE_KEYWORD =
75
+ /^(?:while|volatile|void|unsigned|union|typedef|switch|struct|static|sizeof|signed|short|return|register|long|int|if|goto|for|float|extern|enum|else|double|do|default|continue|const|char|case|break|auto)\b/
76
+ const RE_LINE_COMMENT_START = /^\/\//
77
+ const RE_ANYTHING_UNTIL_END = /^.+/s
78
+ const RE_VARIABLE_NAME = /^[a-zA-Z][a-zA-Z\d\_]*/
79
+ const RE_PUNCTUATION = /^[\(\)=\+\-><\.:\/\{\};,\[\]\*]/
80
+ const RE_DOUBLE_QUOTE = /^"/
81
+ const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
82
+
83
+ export const initialLineState = {
84
+ state: State.TopLevelContent,
85
+ tokens: [],
86
+ }
87
+
88
+ export const isEqualLineState = (lineStateA, lineStateB) => {
89
+ return lineStateA.state === lineStateB.state
90
+ }
91
+
92
+ /**
93
+ * @param {string} line
94
+ */
95
+ export const tokenizeLine = (line, lineState) => {
96
+ let next = null
97
+ let index = 0
98
+ let tokens = []
99
+ let token = TokenType.None
100
+ let state = lineState.state
101
+ while (index < line.length) {
102
+ const part = line.slice(index)
103
+ switch (state) {
104
+ case State.TopLevelContent:
105
+ if ((next = part.match(RE_KEYWORD))) {
106
+ token = TokenType.Keyword
107
+ state = State.TopLevelContent
108
+ } else if ((next = part.match(RE_WHITESPACE))) {
109
+ token = TokenType.Whitespace
110
+ state = State.TopLevelContent
111
+ } else if ((next = part.match(RE_VARIABLE_NAME))) {
112
+ token = TokenType.VariableName
113
+ state = State.TopLevelContent
114
+ } else if ((next = part.match(RE_DOUBLE_QUOTE))) {
115
+ token = TokenType.PunctuationString
116
+ state = State.InsideDoubleQuoteString
117
+ } else if ((next = part.match(RE_INCLUDE))) {
118
+ token = TokenType.Include
119
+ state = State.AfterInclude
120
+ } else if ((next = part.match(RE_LINE_COMMENT_START))) {
121
+ token = TokenType.Comment
122
+ state = State.InsideLineComment
123
+ } else if ((next = part.match(RE_PUNCTUATION))) {
124
+ token = TokenType.Punctuation
125
+ state = State.TopLevelContent
126
+ } else if ((next = part.match(RE_NUMERIC))) {
127
+ token = TokenType.Numeric
128
+ state = State.TopLevelContent
129
+ } else if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
130
+ token = TokenType.PlainText
131
+ state = State.TopLevelContent
132
+ } else {
133
+ part //?
134
+ throw new Error('no')
135
+ }
136
+ break
137
+ case State.AfterInclude:
138
+ if ((next = part.match(RE_WHITESPACE))) {
139
+ token = TokenType.Whitespace
140
+ state = State.AfterInclude
141
+ } else if ((next = part.match(RE_IMPORT))) {
142
+ token = TokenType.Import
143
+ state = State.TopLevelContent
144
+ } else {
145
+ throw new Error('no')
146
+ }
147
+ break
148
+ case State.InsideLineComment:
149
+ if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
150
+ token = TokenType.Comment
151
+ state = State.TopLevelContent
152
+ } else {
153
+ throw new Error('no')
154
+ }
155
+ break
156
+ case State.InsideDoubleQuoteString:
157
+ if ((next = part.match(RE_STRING_DOUBLE_QUOTE_CONTENT))) {
158
+ token = TokenType.String
159
+ state = State.InsideDoubleQuoteString
160
+ } else if ((next = part.match(RE_DOUBLE_QUOTE))) {
161
+ token = TokenType.PunctuationString
162
+ state = State.TopLevelContent
163
+ } else {
164
+ throw new Error('no')
165
+ }
166
+ break
167
+ default:
168
+ throw new Error('no')
169
+ }
170
+ index += next[0].length
171
+ tokens.push({
172
+ type: token,
173
+ length: next[0].length,
174
+ })
175
+ }
176
+ return {
177
+ state,
178
+ tokens,
179
+ }
180
+ }
@@ -0,0 +1,14 @@
1
+ # Language Basics Editorconfig
2
+
3
+ ## Contributing
4
+
5
+ ```sh
6
+ git clone git@github.com:lvce-editor/language-basics-editorconfig.git &&
7
+ cd language-basics-editorconfig &&
8
+ npm ci &&
9
+ npm test
10
+ ```
11
+
12
+ ## Gitpod
13
+
14
+ [![Open in Gitpod](https://gitpod.io/button/open-in-gitpod.svg)](https://gitpod.io/#https://github.com/lvce-editor/language-basics-editorconfig)
@@ -0,0 +1,12 @@
1
+ {
2
+ "id": "builtin.language-basics-editorconfig",
3
+ "name": "Language Basics Editorconfig",
4
+ "description": "Provides syntax highlighting and bracket matching in Editorconfig files.",
5
+ "languages": [
6
+ {
7
+ "id": "editorconfig",
8
+ "extensions": [".editorconfig"],
9
+ "tokenize": "src/tokenizeEditorConfig.js"
10
+ }
11
+ ]
12
+ }
@@ -0,0 +1,122 @@
1
+ /**
2
+ * @enum number
3
+ */
4
+ export const State = {
5
+ TopLevelContent: 1,
6
+ InsideLineComment: 2,
7
+ }
8
+
9
+ export const StateMap = {
10
+ [State.TopLevelContent]: 'TopLevelContent',
11
+ [State.InsideLineComment]: 'InsideLineComment',
12
+ }
13
+
14
+ /**
15
+ * @enum number
16
+ */
17
+ export const TokenType = {
18
+ CssSelector: 1,
19
+ Whitespace: 2,
20
+ None: 57,
21
+ Unknown: 881,
22
+ NewLine: 884,
23
+ Comment: 885,
24
+ Query: 886,
25
+ Text: 887,
26
+ }
27
+
28
+ export const TokenMap = {
29
+ [TokenType.CssSelector]: 'CssSelector',
30
+ [TokenType.Whitespace]: 'Whitespace',
31
+ [TokenType.None]: 'None',
32
+ [TokenType.Unknown]: 'Unknown',
33
+ [TokenType.NewLine]: 'NewLine',
34
+ [TokenType.Comment]: 'Comment',
35
+ [TokenType.Query]: 'Query',
36
+ [TokenType.Text]: 'Text',
37
+ }
38
+
39
+ const RE_LINE_COMMENT_START = /^#/
40
+ const RE_WHITESPACE = /^ +/
41
+ const RE_CURLY_OPEN = /^\{/
42
+ const RE_CURLY_CLOSE = /^\}/
43
+ const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
44
+ const RE_COLON = /^:/
45
+ const RE_PROPERTY_VALUE = /^[^;\}]+/
46
+ const RE_SEMICOLON = /^;/
47
+ const RE_COMMA = /^,/
48
+ const RE_ANYTHING = /^.*/
49
+ const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
50
+ const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
51
+ const RE_BLOCK_COMMENT_START = /^\/\*/
52
+ const RE_BLOCK_COMMENT_END = /^\*\//
53
+ const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
54
+ const RE_ROUND_OPEN = /^\(/
55
+ const RE_ROUND_CLOSE = /^\)/
56
+ const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
57
+ const RE_SQUARE_OPEN = /^\[/
58
+ const RE_SQUARE_CLOSE = /^\]/
59
+ const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
60
+ const RE_QUERY = /^@[a-z\-]+/
61
+ const RE_STAR = /^\*/
62
+ const RE_QUERY_NAME = /^[a-z\-]+/
63
+ const RE_QUERY_CONTENT = /^[^\)]+/
64
+ const RE_COMBINATOR = /^[\+\>\~]/
65
+
66
+ export const initialLineState = {
67
+ state: State.TopLevelContent,
68
+ tokens: [],
69
+ stack: [],
70
+ }
71
+
72
+ /**
73
+ * @param {string} line
74
+ * @param {any} lineState
75
+ */
76
+ export const tokenizeLine = (line, lineState) => {
77
+ let next = null
78
+ let index = 0
79
+ let tokens = []
80
+ let token = TokenType.None
81
+ let state = lineState.state
82
+ while (index < line.length) {
83
+ const part = line.slice(index)
84
+ switch (state) {
85
+ case State.TopLevelContent:
86
+ if ((next = part.match(RE_LINE_COMMENT_START))) {
87
+ token = TokenType.Comment
88
+ state = State.InsideLineComment
89
+ } else if ((next = part.match(RE_WHITESPACE))) {
90
+ token = TokenType.Whitespace
91
+ state = State.TopLevelContent
92
+ } else if ((next = part.match(RE_ANYTHING))) {
93
+ token = TokenType.Text
94
+ state = State.TopLevelContent
95
+ } else {
96
+ part //?
97
+ throw new Error('no')
98
+ }
99
+ break
100
+ case State.InsideLineComment:
101
+ if ((next = part.match(RE_ANYTHING))) {
102
+ token = TokenType.Comment
103
+ state = State.TopLevelContent
104
+ } else {
105
+ throw new Error('no')
106
+ }
107
+ break
108
+ default:
109
+ console.log({ state, line })
110
+ throw new Error('no')
111
+ }
112
+ index += next[0].length
113
+ tokens.push({
114
+ type: token,
115
+ length: next[0].length,
116
+ })
117
+ }
118
+ return {
119
+ state,
120
+ tokens,
121
+ }
122
+ }
@@ -13,7 +13,8 @@ const State = {
13
13
  InsideAttributeDoubleQuote: 9,
14
14
  InsideBlockComment: 10,
15
15
  None: 11,
16
- InsideString: 12,
16
+ InsideDoubleQuoteString: 12,
17
+ InsideSingleQuoteString: 13,
17
18
  }
18
19
 
19
20
  export const StateMap = {}
@@ -52,43 +53,57 @@ export const TokenMap = {
52
53
  [TokenType.PunctuationString]: 'PunctuationString',
53
54
  }
54
55
 
55
- const RE_WHITESPACE = /^\s+/
56
- const RE_DOUBLE_QUOTE = /^"/
57
- const RE_NEWLINE_WHITESPACE = /^\n\s*/
58
- const RE_BLOCK_COMMENT_START = /^<!--/
59
- const RE_BLOCK_COMMENT_CONTENT = /^.(?:.*?)(?=-->|$)/s
60
- const RE_BLOCK_COMMENT_END = /^-->/
61
- const RE_ANGLE_BRACKET_OPEN_TAG = /^<(?!\s)/
62
56
  const RE_ANGLE_BRACKET_CLOSE = /^>/
63
- const RE_TAGNAME = /^[!\w]+/
64
- const RE_TEXT = /^[^<>\n]+/
57
+ const RE_ANGLE_BRACKET_ONLY = /^</
58
+ const RE_ANGLE_BRACKET_OPEN = /^</
59
+ const RE_ANGLE_BRACKET_OPEN_TAG = /^<(?!\s)/
65
60
  const RE_ANY_TEXT = /^[^\n]+/
66
- const RE_SLASH = /^\//
67
61
  const RE_ATTRIBUTE_NAME = /^[a-zA-Z\d\-]+/
62
+ const RE_BLOCK_COMMENT_CONTENT = /^.(?:.*?)(?=-->|$)/s
63
+ const RE_BLOCK_COMMENT_END = /^-->/
64
+ const RE_BLOCK_COMMENT_START = /^<!--/
65
+ const RE_DASH_DASH = /^\-\-/
66
+ const RE_DOUBLE_QUOTE = /^"/
68
67
  const RE_EQUAL_SIGN = /^=/
69
- const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
70
- const RE_PUNCTUATION_SELF_CLOSING = /^\/>/
71
- const RE_INVALID_INSIDE_OPENING_TAG = /^[^a-zA-Z>]/
68
+ const RE_EXCLAMATION_MARK = /^!/
72
69
  const RE_INVALID_INSIDE_ClOSING_TAG = /^[^a-zA-Z>]/
73
- const RE_PUNCTUATION = /^[<;'".,]/
74
- const RE_NOT_TAGNAME = /^[^a-zA-Z\d]+/
75
- const RE_WORD = /^[^\s]+/
76
- const RE_ANGLE_BRACKET_ONLY = /^</
70
+ const RE_INVALID_INSIDE_OPENING_TAG = /^[^a-zA-Z>]/
77
71
  const RE_NEWLINE = /^\n/
78
- const RE_EXCLAMATION_MARK = /^!/
72
+ const RE_NEWLINE_WHITESPACE = /^\n\s*/
73
+ const RE_NOT_TAGNAME = /^[^a-zA-Z\d]+/
74
+ const RE_PUNCTUATION = /^[<;'".,]/
75
+ const RE_PUNCTUATION_SELF_CLOSING = /^\/>/
79
76
  const RE_SELF_CLOSING = /^\/>/
80
- const RE_DASH_DASH = /^\-\-/
77
+ const RE_SINGLE_QUOTE = /^'/
78
+ const RE_SLASH = /^\//
79
+ const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
80
+ const RE_STRING_SINGLE_QUOTE_CONTENT = /^[^']+/
81
81
  const RE_TAG_TEXT = /^[^\s>]+/
82
- const RE_ANGLE_BRACKET_OPEN = /^</
82
+ const RE_TAGNAME = /^[!\w]+/
83
+ const RE_TEXT = /^[^<>\n]+/
84
+ const RE_WHITESPACE = /^\s+/
85
+ const RE_WORD = /^[^\s]+/
83
86
 
84
87
  export const initialLineState = {
85
88
  state: State.TopLevelContent,
86
89
  }
87
90
 
91
+ /**
92
+ *
93
+ * @param {any} lineStateA
94
+ * @param {any} lineStateB
95
+ * @returns
96
+ */
88
97
  export const isLineStateEqual = (lineStateA, lineStateB) => {
89
98
  return lineStateA.state === lineStateB.state
90
99
  }
91
100
 
101
+ /**
102
+ *
103
+ * @param {string} line
104
+ * @param {any} lineState
105
+ * @returns
106
+ */
92
107
  export const tokenizeLine = (line, lineState) => {
93
108
  let next = null
94
109
  let index = 0
@@ -205,7 +220,10 @@ export const tokenizeLine = (line, lineState) => {
205
220
  state = State.AfterAttributeEqualSign
206
221
  } else if ((next = part.match(RE_DOUBLE_QUOTE))) {
207
222
  token = TokenType.PunctuationString
208
- state = State.InsideString
223
+ state = State.InsideDoubleQuoteString
224
+ } else if ((next = part.match(RE_SINGLE_QUOTE))) {
225
+ token = TokenType.PunctuationString
226
+ state = State.InsideSingleQuoteString
209
227
  } else if ((next = part.match(RE_TAG_TEXT))) {
210
228
  token = TokenType.Text
211
229
  state = State.InsideOpeningTag
@@ -221,7 +239,10 @@ export const tokenizeLine = (line, lineState) => {
221
239
  case State.AfterAttributeEqualSign:
222
240
  if ((next = part.match(RE_DOUBLE_QUOTE))) {
223
241
  token = TokenType.PunctuationString
224
- state = State.InsideString
242
+ state = State.InsideDoubleQuoteString
243
+ } else if ((next = part.match(RE_SINGLE_QUOTE))) {
244
+ token = TokenType.PunctuationString
245
+ state = State.InsideSingleQuoteString
225
246
  } else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
226
247
  token = TokenType.PunctuationTag
227
248
  state = State.TopLevelContent
@@ -229,13 +250,24 @@ export const tokenizeLine = (line, lineState) => {
229
250
  throw new Error('no')
230
251
  }
231
252
  break
232
- case State.InsideString:
253
+ case State.InsideDoubleQuoteString:
233
254
  if ((next = part.match(RE_DOUBLE_QUOTE))) {
234
255
  token = TokenType.PunctuationString
235
256
  state = State.InsideOpeningTag
236
257
  } else if ((next = part.match(RE_STRING_DOUBLE_QUOTE_CONTENT))) {
237
258
  token = TokenType.String
238
- state = State.InsideString
259
+ state = State.InsideDoubleQuoteString
260
+ } else {
261
+ throw new Error('no')
262
+ }
263
+ break
264
+ case State.InsideSingleQuoteString:
265
+ if ((next = part.match(RE_SINGLE_QUOTE))) {
266
+ token = TokenType.PunctuationString
267
+ state = State.InsideOpeningTag
268
+ } else if ((next = part.match(RE_STRING_SINGLE_QUOTE_CONTENT))) {
269
+ token = TokenType.String
270
+ state = State.InsideSingleQuoteString
239
271
  } else {
240
272
  throw new Error('no')
241
273
  }
@@ -266,13 +298,3 @@ export const tokenizeLine = (line, lineState) => {
266
298
  tokens,
267
299
  }
268
300
  }
269
-
270
- // tokenizeLine(initialContext, ' <h1$0></h1>') //?
271
- // tokenizeLine(initialContext, `<<`)
272
-
273
- // tokenizeLine(initialContext, `<h1><//`) //?
274
- // tokenizeLine(initialContext, `<h1 class=></h1>`) //?
275
-
276
- // tokenizeLine(initialLineState, `<h1234567 class""=></h1234567>`)
277
-
278
- tokenizeLine('<input disabled autofocus>', initialLineState) //?
@@ -5,7 +5,30 @@
5
5
  "languages": [
6
6
  {
7
7
  "id": "json",
8
- "extensions": [".json"],
8
+ "extensions": [
9
+ ".json",
10
+ ".bowerrc",
11
+ ".jscsrc",
12
+ ".webmanifest",
13
+ ".js.map",
14
+ ".css.map",
15
+ ".ts.map",
16
+ ".har",
17
+ ".jslintrc",
18
+ ".jsonld",
19
+ ".geojson",
20
+ ".ipynb",
21
+ ".jsonc",
22
+ ".eslintrc",
23
+ ".eslintrc.json",
24
+ ".jsfmtrc",
25
+ ".jshintrc",
26
+ ".swcrc",
27
+ ".hintrc",
28
+ ".babelrc",
29
+ ".prettierrc"
30
+ ],
31
+ "filenames": ["composer.lock", ".watchmanconfig"],
9
32
  "tokenize": "src/tokenizeJson.js"
10
33
  }
11
34
  ]
@@ -1,33 +1,141 @@
1
+ /**
2
+ * @enum number
3
+ */
4
+ export const State = {
5
+ TopLevelContent: 1,
6
+ InsideLineComment: 2,
7
+ InsideBlockComment: 3,
8
+ }
9
+
10
+ export const StateMap = {
11
+ [State.TopLevelContent]: 'TopLevelContent',
12
+ [State.InsideLineComment]: 'InsideLineComment',
13
+ [State.InsideBlockComment]: 'InsideBlockComment',
14
+ }
15
+
1
16
  /**
2
17
  * @enum number
3
18
  */
4
19
  export const TokenType = {
5
- Text: 0,
6
- NewLine: 1,
20
+ CssSelector: 1,
21
+ Whitespace: 2,
22
+ None: 57,
23
+ Unknown: 881,
24
+ NewLine: 884,
25
+ Comment: 885,
26
+ Query: 886,
27
+ Text: 887,
7
28
  }
8
29
 
9
30
  export const TokenMap = {
31
+ [TokenType.CssSelector]: 'CssSelector',
32
+ [TokenType.Whitespace]: 'Whitespace',
33
+ [TokenType.None]: 'None',
34
+ [TokenType.Unknown]: 'Unknown',
35
+ [TokenType.NewLine]: 'NewLine',
36
+ [TokenType.Comment]: 'Comment',
37
+ [TokenType.Query]: 'Query',
10
38
  [TokenType.Text]: 'Text',
11
39
  }
12
40
 
41
+ const RE_LINE_COMMENT_START = /^#/
42
+ const RE_BLOCK_COMMENT_START = /^<#/
43
+ const RE_WHITESPACE = /^ +/
44
+ const RE_CURLY_OPEN = /^\{/
45
+ const RE_CURLY_CLOSE = /^\}/
46
+ const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
47
+ const RE_COLON = /^:/
48
+ const RE_PROPERTY_VALUE = /^[^;\}]+/
49
+ const RE_SEMICOLON = /^;/
50
+ const RE_COMMA = /^,/
51
+ const RE_ANYTHING_UNTIL_END = /^.+/s
52
+ const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
53
+ const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
54
+ const RE_BLOCK_COMMENT_END = /^\*\//
55
+ const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
56
+ const RE_ROUND_OPEN = /^\(/
57
+ const RE_ROUND_CLOSE = /^\)/
58
+ const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
59
+ const RE_SQUARE_OPEN = /^\[/
60
+ const RE_SQUARE_CLOSE = /^\]/
61
+ const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
62
+ const RE_QUERY = /^@[a-z\-]+/
63
+ const RE_STAR = /^\*/
64
+ const RE_QUERY_NAME = /^[a-z\-]+/
65
+ const RE_QUERY_CONTENT = /^[^\)]+/
66
+ const RE_COMBINATOR = /^[\+\>\~]/
67
+
13
68
  export const initialLineState = {
14
- state: 1,
69
+ state: State.TopLevelContent,
70
+ tokens: [],
71
+ stack: [],
15
72
  }
16
73
 
74
+ /**
75
+ * @param {string} line
76
+ * @param {any} lineState
77
+ */
17
78
  export const tokenizeLine = (line, lineState) => {
18
- if (line.length === 0) {
19
- return {
20
- state: 1,
21
- tokens: [],
79
+ let next = null
80
+ let index = 0
81
+ let tokens = []
82
+ let token = TokenType.None
83
+ let state = lineState.state
84
+ while (index < line.length) {
85
+ const part = line.slice(index)
86
+ switch (state) {
87
+ case State.TopLevelContent:
88
+ if ((next = part.match(RE_LINE_COMMENT_START))) {
89
+ token = TokenType.Comment
90
+ state = State.InsideLineComment
91
+ } else if ((next = part.match(RE_BLOCK_COMMENT_START))) {
92
+ token = TokenType.Comment
93
+ state = State.InsideBlockComment
94
+ } else if ((next = part.match(RE_WHITESPACE))) {
95
+ token = TokenType.Whitespace
96
+ state = State.TopLevelContent
97
+ } else if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
98
+ token = TokenType.Text
99
+ state = State.TopLevelContent
100
+ } else {
101
+ part //?
102
+ throw new Error('no')
103
+ }
104
+ break
105
+ case State.InsideLineComment:
106
+ if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
107
+ token = TokenType.Comment
108
+ state = State.TopLevelContent
109
+ } else {
110
+ throw new Error('no')
111
+ }
112
+ break
113
+ case State.InsideBlockComment:
114
+ if ((next = part.match(RE_BLOCK_COMMENT_CONTENT))) {
115
+ token = TokenType.Comment
116
+ state = State.InsideBlockComment
117
+ } else if ((next = part.match(RE_BLOCK_COMMENT_END))) {
118
+ token = TokenType.Comment
119
+ state = State.TopLevelContent
120
+ } else if ((next = part.match(RE_ANYTHING_UNTIL_END))) {
121
+ token = TokenType.Comment
122
+ state = State.InsideBlockComment
123
+ } else {
124
+ throw new Error('no')
125
+ }
126
+ break
127
+ default:
128
+ console.log({ state, line })
129
+ throw new Error('no')
22
130
  }
131
+ index += next[0].length
132
+ tokens.push({
133
+ type: token,
134
+ length: next[0].length,
135
+ })
23
136
  }
24
137
  return {
25
- state: 1,
26
- tokens: [
27
- {
28
- type: TokenType.Text,
29
- length: line.length,
30
- },
31
- ],
138
+ state,
139
+ tokens,
32
140
  }
33
141
  }
@@ -0,0 +1,14 @@
1
+ # Language Basics Toml
2
+
3
+ ## Contributing
4
+
5
+ ```sh
6
+ git clone git@github.com:lvce-editor/language-basics-toml.git &&
7
+ cd language-basics-toml &&
8
+ npm ci &&
9
+ npm test
10
+ ```
11
+
12
+ ## Gitpod
13
+
14
+ [![Open in Gitpod](https://gitpod.io/button/open-in-gitpod.svg)](https://gitpod.io/#https://github.com/lvce-editor/language-basics-toml)
@@ -0,0 +1,12 @@
1
+ {
2
+ "id": "builtin.language-basics-toml",
3
+ "name": "Language Basics Toml",
4
+ "description": "Provides syntax highlighting and bracket matching in Toml files.",
5
+ "languages": [
6
+ {
7
+ "id": "toml",
8
+ "extensions": [".toml"],
9
+ "tokenize": "src/tokenizeToml.js"
10
+ }
11
+ ]
12
+ }
@@ -0,0 +1,122 @@
1
+ /**
2
+ * @enum number
3
+ */
4
+ export const State = {
5
+ TopLevelContent: 1,
6
+ InsideLineComment: 2,
7
+ }
8
+
9
+ export const StateMap = {
10
+ [State.TopLevelContent]: 'TopLevelContent',
11
+ [State.InsideLineComment]: 'InsideLineComment',
12
+ }
13
+
14
+ /**
15
+ * @enum number
16
+ */
17
+ export const TokenType = {
18
+ CssSelector: 1,
19
+ Whitespace: 2,
20
+ None: 57,
21
+ Unknown: 881,
22
+ NewLine: 884,
23
+ Comment: 885,
24
+ Query: 886,
25
+ Text: 887,
26
+ }
27
+
28
+ export const TokenMap = {
29
+ [TokenType.CssSelector]: 'CssSelector',
30
+ [TokenType.Whitespace]: 'Whitespace',
31
+ [TokenType.None]: 'None',
32
+ [TokenType.Unknown]: 'Unknown',
33
+ [TokenType.NewLine]: 'NewLine',
34
+ [TokenType.Comment]: 'Comment',
35
+ [TokenType.Query]: 'Query',
36
+ [TokenType.Text]: 'Text',
37
+ }
38
+
39
+ const RE_LINE_COMMENT_START = /^#/
40
+ const RE_WHITESPACE = /^ +/
41
+ const RE_CURLY_OPEN = /^\{/
42
+ const RE_CURLY_CLOSE = /^\}/
43
+ const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
44
+ const RE_COLON = /^:/
45
+ const RE_PROPERTY_VALUE = /^[^;\}]+/
46
+ const RE_SEMICOLON = /^;/
47
+ const RE_COMMA = /^,/
48
+ const RE_ANYTHING = /^.*/
49
+ const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
50
+ const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
51
+ const RE_BLOCK_COMMENT_START = /^\/\*/
52
+ const RE_BLOCK_COMMENT_END = /^\*\//
53
+ const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
54
+ const RE_ROUND_OPEN = /^\(/
55
+ const RE_ROUND_CLOSE = /^\)/
56
+ const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
57
+ const RE_SQUARE_OPEN = /^\[/
58
+ const RE_SQUARE_CLOSE = /^\]/
59
+ const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
60
+ const RE_QUERY = /^@[a-z\-]+/
61
+ const RE_STAR = /^\*/
62
+ const RE_QUERY_NAME = /^[a-z\-]+/
63
+ const RE_QUERY_CONTENT = /^[^\)]+/
64
+ const RE_COMBINATOR = /^[\+\>\~]/
65
+
66
+ export const initialLineState = {
67
+ state: State.TopLevelContent,
68
+ tokens: [],
69
+ stack: [],
70
+ }
71
+
72
+ /**
73
+ * @param {string} line
74
+ * @param {any} lineState
75
+ */
76
+ export const tokenizeLine = (line, lineState) => {
77
+ let next = null
78
+ let index = 0
79
+ let tokens = []
80
+ let token = TokenType.None
81
+ let state = lineState.state
82
+ while (index < line.length) {
83
+ const part = line.slice(index)
84
+ switch (state) {
85
+ case State.TopLevelContent:
86
+ if ((next = part.match(RE_LINE_COMMENT_START))) {
87
+ token = TokenType.Comment
88
+ state = State.InsideLineComment
89
+ } else if ((next = part.match(RE_WHITESPACE))) {
90
+ token = TokenType.Whitespace
91
+ state = State.TopLevelContent
92
+ } else if ((next = part.match(RE_ANYTHING))) {
93
+ token = TokenType.Text
94
+ state = State.TopLevelContent
95
+ } else {
96
+ part //?
97
+ throw new Error('no')
98
+ }
99
+ break
100
+ case State.InsideLineComment:
101
+ if ((next = part.match(RE_ANYTHING))) {
102
+ token = TokenType.Comment
103
+ state = State.TopLevelContent
104
+ } else {
105
+ throw new Error('no')
106
+ }
107
+ break
108
+ default:
109
+ console.log({ state, line })
110
+ throw new Error('no')
111
+ }
112
+ index += next[0].length
113
+ tokens.push({
114
+ type: token,
115
+ length: next[0].length,
116
+ })
117
+ }
118
+ return {
119
+ state,
120
+ tokens,
121
+ }
122
+ }
@@ -1,33 +1,298 @@
1
+ /**
2
+ * @enum number
3
+ */
4
+ const State = {
5
+ TopLevelContent: 1,
6
+ AfterOpeningAngleBracket: 2,
7
+ InsideOpeningTag: 3,
8
+ InsideOpeningTagAndHasSeenWhitespace: 4,
9
+ AfterClosingTagAngleBrackets: 5,
10
+ AfterClosingTagName: 6,
11
+ AfterAttributeName: 7,
12
+ AfterAttributeEqualSign: 8,
13
+ InsideAttributeDoubleQuote: 9,
14
+ InsideBlockComment: 10,
15
+ None: 11,
16
+ InsideDoubleQuoteString: 12,
17
+ InsideSingleQuoteString: 13,
18
+ }
19
+
20
+ export const StateMap = {}
21
+
1
22
  /**
2
23
  * @enum number
3
24
  */
4
25
  export const TokenType = {
5
- Text: 0,
6
- NewLine: 1,
26
+ None: 99999999,
27
+ Numeric: 30,
28
+ String: 50,
29
+ Whitespace: 0,
30
+ Comment: 60,
31
+ Text: 117,
32
+ PunctuationTag: 228,
33
+ TagName: 118,
34
+ AttributeName: 119,
35
+ Punctuation: 10,
36
+ Error: 141,
37
+ PunctuationString: 11,
38
+ NewLine: 891,
7
39
  }
8
40
 
9
41
  export const TokenMap = {
42
+ [TokenType.None]: 'None',
43
+ [TokenType.Numeric]: 'Numeric',
44
+ [TokenType.String]: 'String',
45
+ [TokenType.Whitespace]: 'Whitespace',
46
+ [TokenType.Comment]: 'Comment',
10
47
  [TokenType.Text]: 'Text',
48
+ [TokenType.PunctuationTag]: 'PunctuationTag',
49
+ [TokenType.TagName]: 'TagName',
50
+ [TokenType.AttributeName]: 'AttributeName',
51
+ [TokenType.Punctuation]: 'Punctuation',
52
+ [TokenType.Error]: 'Error',
53
+ [TokenType.PunctuationString]: 'PunctuationString',
11
54
  }
12
55
 
56
+ const RE_ANGLE_BRACKET_CLOSE = /^>/
57
+ const RE_ANGLE_BRACKET_ONLY = /^</
58
+ const RE_ANGLE_BRACKET_OPEN = /^</
59
+ const RE_ANGLE_BRACKET_OPEN_TAG = /^<(?!\s)/
60
+ const RE_ANY_TEXT = /^[^\n]+/
61
+ const RE_ATTRIBUTE_NAME = /^[a-zA-Z\d\-]+/
62
+ const RE_BLOCK_COMMENT_CONTENT = /^.(?:.*?)(?=-->|$)/s
63
+ const RE_BLOCK_COMMENT_END = /^-->/
64
+ const RE_BLOCK_COMMENT_START = /^<!--/
65
+ const RE_DASH_DASH = /^\-\-/
66
+ const RE_DOUBLE_QUOTE = /^"/
67
+ const RE_EQUAL_SIGN = /^=/
68
+ const RE_EXCLAMATION_MARK = /^!/
69
+ const RE_INVALID_INSIDE_ClOSING_TAG = /^[^a-zA-Z>]/
70
+ const RE_INVALID_INSIDE_OPENING_TAG = /^[^a-zA-Z>]/
71
+ const RE_NEWLINE = /^\n/
72
+ const RE_NEWLINE_WHITESPACE = /^\n\s*/
73
+ const RE_NOT_TAGNAME = /^[^a-zA-Z\d]+/
74
+ const RE_PUNCTUATION = /^[<;'".,]/
75
+ const RE_PUNCTUATION_SELF_CLOSING = /^\/>/
76
+ const RE_SELF_CLOSING = /^\/>/
77
+ const RE_SINGLE_QUOTE = /^'/
78
+ const RE_SLASH = /^\//
79
+ const RE_STRING_DOUBLE_QUOTE_CONTENT = /^[^"]+/
80
+ const RE_STRING_SINGLE_QUOTE_CONTENT = /^[^']+/
81
+ const RE_TAG_TEXT = /^[^\s>]+/
82
+ const RE_TAGNAME = /^[!\w]+/
83
+ const RE_TEXT = /^[^<>\n]+/
84
+ const RE_WHITESPACE = /^\s+/
85
+ const RE_WORD = /^[^\s]+/
86
+
13
87
  export const initialLineState = {
14
- state: 1,
88
+ state: State.TopLevelContent,
15
89
  }
16
90
 
91
+ /**
92
+ *
93
+ * @param {any} lineStateA
94
+ * @param {any} lineStateB
95
+ * @returns
96
+ */
97
+ export const isLineStateEqual = (lineStateA, lineStateB) => {
98
+ return lineStateA.state === lineStateB.state
99
+ }
100
+
101
+ /**
102
+ *
103
+ * @param {string} line
104
+ * @param {any} lineState
105
+ * @returns
106
+ */
17
107
  export const tokenizeLine = (line, lineState) => {
18
- if (line.length === 0) {
19
- return {
20
- state: 1,
21
- tokens: [],
108
+ let next = null
109
+ let index = 0
110
+ let tokens = []
111
+ let token = TokenType.None
112
+ let state = lineState.state
113
+ while (index < line.length) {
114
+ const part = line.slice(index)
115
+ switch (state) {
116
+ case State.TopLevelContent:
117
+ if ((next = part.match(RE_ANGLE_BRACKET_OPEN_TAG))) {
118
+ token = TokenType.PunctuationTag
119
+ state = State.AfterOpeningAngleBracket
120
+ } else if ((next = part.match(RE_TEXT))) {
121
+ token = TokenType.Text
122
+ state = State.TopLevelContent
123
+ } else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
124
+ token = TokenType.Text
125
+ state = State.TopLevelContent
126
+ } else if ((next = part.match(RE_ANGLE_BRACKET_OPEN))) {
127
+ token = TokenType.Text
128
+ state = State.TopLevelContent
129
+ } else {
130
+ part //?
131
+ throw new Error('no')
132
+ }
133
+ break
134
+ case State.AfterOpeningAngleBracket:
135
+ if ((next = part.match(RE_TAGNAME))) {
136
+ token = TokenType.TagName
137
+ state = State.InsideOpeningTag
138
+ } else if ((next = part.match(RE_SLASH))) {
139
+ token = TokenType.PunctuationTag
140
+ state = State.AfterClosingTagAngleBrackets
141
+ } else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
142
+ token = TokenType.PunctuationTag
143
+ state = State.TopLevelContent
144
+ } else if ((next = part.match(RE_ANY_TEXT))) {
145
+ token = TokenType.Text
146
+ state = State.TopLevelContent
147
+ } else {
148
+ part //?
149
+ throw new Error('no')
150
+ }
151
+ break
152
+ case State.InsideOpeningTag:
153
+ if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
154
+ token = TokenType.PunctuationTag
155
+ state = State.TopLevelContent
156
+ } else if ((next = part.match(RE_EXCLAMATION_MARK))) {
157
+ token = TokenType.PunctuationTag
158
+ state = State.InsideOpeningTag
159
+ } else if ((next = part.match(RE_WHITESPACE))) {
160
+ token = TokenType.Whitespace
161
+ state = State.InsideOpeningTagAndHasSeenWhitespace
162
+ } else if ((next = part.match(RE_DASH_DASH))) {
163
+ token = TokenType.Comment
164
+ state = State.InsideBlockComment
165
+ } else if ((next = part.match(RE_TAG_TEXT))) {
166
+ token = TokenType.Text
167
+ state = State.InsideOpeningTag
168
+ } else {
169
+ part //?
170
+ throw new Error('no')
171
+ }
172
+ break
173
+ case State.AfterClosingTagAngleBrackets:
174
+ if ((next = part.match(RE_TAGNAME))) {
175
+ token = TokenType.TagName
176
+ state = State.AfterClosingTagName
177
+ } else if ((next = part.match(RE_ANY_TEXT))) {
178
+ token = TokenType.Text
179
+ state = State.TopLevelContent
180
+ } else {
181
+ part //?
182
+ throw new Error('no')
183
+ }
184
+ break
185
+ case State.AfterClosingTagName:
186
+ if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
187
+ token = TokenType.PunctuationTag
188
+ state = State.TopLevelContent
189
+ } else if ((next = part.match(RE_TEXT))) {
190
+ token = TokenType.Text
191
+ state = State.TopLevelContent
192
+ } else {
193
+ throw new Error('no')
194
+ }
195
+ break
196
+ case State.InsideOpeningTagAndHasSeenWhitespace:
197
+ if ((next = part.match(RE_ATTRIBUTE_NAME))) {
198
+ token = TokenType.AttributeName
199
+ state = State.AfterAttributeName
200
+ } else if ((next = part.match(RE_SELF_CLOSING))) {
201
+ token = TokenType.PunctuationTag
202
+ state = State.TopLevelContent
203
+ } else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
204
+ token = TokenType.PunctuationTag
205
+ state = State.TopLevelContent
206
+ } else if ((next = part.match(RE_TAG_TEXT))) {
207
+ token = TokenType.Text
208
+ state = State.TopLevelContent
209
+ } else {
210
+ part //?
211
+ throw new Error('no')
212
+ }
213
+ break
214
+ case State.AfterAttributeName:
215
+ if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
216
+ token = TokenType.PunctuationTag
217
+ state = State.TopLevelContent
218
+ } else if ((next = part.match(RE_EQUAL_SIGN))) {
219
+ token = TokenType.Punctuation
220
+ state = State.AfterAttributeEqualSign
221
+ } else if ((next = part.match(RE_DOUBLE_QUOTE))) {
222
+ token = TokenType.PunctuationString
223
+ state = State.InsideDoubleQuoteString
224
+ } else if ((next = part.match(RE_SINGLE_QUOTE))) {
225
+ token = TokenType.PunctuationString
226
+ state = State.InsideSingleQuoteString
227
+ } else if ((next = part.match(RE_TAG_TEXT))) {
228
+ token = TokenType.Text
229
+ state = State.InsideOpeningTag
230
+ } else if ((next = part.match(RE_WHITESPACE))) {
231
+ token = TokenType.Whitespace
232
+ state = State.InsideOpeningTagAndHasSeenWhitespace
233
+ } else {
234
+ throw new Error('no')
235
+ }
236
+ break
237
+ case State.AfterAttributeEqualSign:
238
+ if ((next = part.match(RE_DOUBLE_QUOTE))) {
239
+ token = TokenType.PunctuationString
240
+ state = State.InsideDoubleQuoteString
241
+ } else if ((next = part.match(RE_SINGLE_QUOTE))) {
242
+ token = TokenType.PunctuationString
243
+ state = State.InsideSingleQuoteString
244
+ } else if ((next = part.match(RE_ANGLE_BRACKET_CLOSE))) {
245
+ token = TokenType.PunctuationTag
246
+ state = State.TopLevelContent
247
+ } else {
248
+ throw new Error('no')
249
+ }
250
+ break
251
+ case State.InsideDoubleQuoteString:
252
+ if ((next = part.match(RE_DOUBLE_QUOTE))) {
253
+ token = TokenType.PunctuationString
254
+ state = State.InsideOpeningTag
255
+ } else if ((next = part.match(RE_STRING_DOUBLE_QUOTE_CONTENT))) {
256
+ token = TokenType.String
257
+ state = State.InsideDoubleQuoteString
258
+ } else {
259
+ throw new Error('no')
260
+ }
261
+ break
262
+ case State.InsideSingleQuoteString:
263
+ if ((next = part.match(RE_SINGLE_QUOTE))) {
264
+ token = TokenType.PunctuationString
265
+ state = State.InsideOpeningTag
266
+ } else if ((next = part.match(RE_STRING_SINGLE_QUOTE_CONTENT))) {
267
+ token = TokenType.String
268
+ state = State.InsideSingleQuoteString
269
+ } else {
270
+ throw new Error('no')
271
+ }
272
+ break
273
+ case State.InsideBlockComment:
274
+ if ((next = part.match(RE_BLOCK_COMMENT_CONTENT))) {
275
+ token = TokenType.Comment
276
+ state = State.InsideBlockComment
277
+ } else if ((next = part.match(RE_BLOCK_COMMENT_END))) {
278
+ token = TokenType.Comment
279
+ state = State.TopLevelContent
280
+ } else {
281
+ throw new Error('no')
282
+ }
283
+ break
284
+ default:
285
+ state
286
+ throw new Error('no')
22
287
  }
288
+ index += next[0].length
289
+ tokens.push({
290
+ type: token,
291
+ length: next[0].length,
292
+ })
23
293
  }
24
294
  return {
25
- state: 1,
26
- tokens: [
27
- {
28
- type: TokenType.Text,
29
- length: line.length,
30
- },
31
- ],
295
+ state,
296
+ tokens,
32
297
  }
33
298
  }
@@ -5,7 +5,7 @@
5
5
  "languages": [
6
6
  {
7
7
  "id": "yaml",
8
- "extensions": [".yml"],
8
+ "extensions": [".yml", ".eyaml", ".eyml", ".yaml", ".cff"],
9
9
  "tokenize": "src/tokenizeYaml.js"
10
10
  }
11
11
  ]
@@ -1,33 +1,122 @@
1
+ /**
2
+ * @enum number
3
+ */
4
+ export const State = {
5
+ TopLevelContent: 1,
6
+ InsideLineComment: 2,
7
+ }
8
+
9
+ export const StateMap = {
10
+ [State.TopLevelContent]: 'TopLevelContent',
11
+ [State.InsideLineComment]: 'InsideLineComment',
12
+ }
13
+
1
14
  /**
2
15
  * @enum number
3
16
  */
4
17
  export const TokenType = {
5
- Text: 0,
6
- NewLine: 1,
18
+ CssSelector: 1,
19
+ Whitespace: 2,
20
+ None: 57,
21
+ Unknown: 881,
22
+ NewLine: 884,
23
+ Comment: 885,
24
+ Query: 886,
25
+ Text: 887,
7
26
  }
8
27
 
9
28
  export const TokenMap = {
29
+ [TokenType.CssSelector]: 'CssSelector',
30
+ [TokenType.Whitespace]: 'Whitespace',
31
+ [TokenType.None]: 'None',
32
+ [TokenType.Unknown]: 'Unknown',
33
+ [TokenType.NewLine]: 'NewLine',
34
+ [TokenType.Comment]: 'Comment',
35
+ [TokenType.Query]: 'Query',
10
36
  [TokenType.Text]: 'Text',
11
37
  }
12
38
 
39
+ const RE_LINE_COMMENT_START = /^#/
40
+ const RE_WHITESPACE = /^ +/
41
+ const RE_CURLY_OPEN = /^\{/
42
+ const RE_CURLY_CLOSE = /^\}/
43
+ const RE_PROPERTY_NAME = /^[a-zA-Z\-]+\b/
44
+ const RE_COLON = /^:/
45
+ const RE_PROPERTY_VALUE = /^[^;\}]+/
46
+ const RE_SEMICOLON = /^;/
47
+ const RE_COMMA = /^,/
48
+ const RE_ANYTHING = /^.*/
49
+ const RE_NUMERIC = /^(([0-9]+\.?[0-9]*)|(\.[0-9]+))/
50
+ const RE_ANYTHING_UNTIL_CLOSE_BRACE = /^[^\}]+/
51
+ const RE_BLOCK_COMMENT_START = /^\/\*/
52
+ const RE_BLOCK_COMMENT_END = /^\*\//
53
+ const RE_BLOCK_COMMENT_CONTENT = /^.+?(?=\*\/|$)/s
54
+ const RE_ROUND_OPEN = /^\(/
55
+ const RE_ROUND_CLOSE = /^\)/
56
+ const RE_PSEUDO_SELECTOR_CONTENT = /^[^\)]+/
57
+ const RE_SQUARE_OPEN = /^\[/
58
+ const RE_SQUARE_CLOSE = /^\]/
59
+ const RE_ATTRIBUTE_SELECTOR_CONTENT = /^[^\]]+/
60
+ const RE_QUERY = /^@[a-z\-]+/
61
+ const RE_STAR = /^\*/
62
+ const RE_QUERY_NAME = /^[a-z\-]+/
63
+ const RE_QUERY_CONTENT = /^[^\)]+/
64
+ const RE_COMBINATOR = /^[\+\>\~]/
65
+
13
66
  export const initialLineState = {
14
- state: 1,
67
+ state: State.TopLevelContent,
68
+ tokens: [],
69
+ stack: [],
15
70
  }
16
71
 
72
+ /**
73
+ * @param {string} line
74
+ * @param {any} lineState
75
+ */
17
76
  export const tokenizeLine = (line, lineState) => {
18
- if (line.length === 0) {
19
- return {
20
- state: 1,
21
- tokens: [],
77
+ let next = null
78
+ let index = 0
79
+ let tokens = []
80
+ let token = TokenType.None
81
+ let state = lineState.state
82
+ while (index < line.length) {
83
+ const part = line.slice(index)
84
+ switch (state) {
85
+ case State.TopLevelContent:
86
+ if ((next = part.match(RE_LINE_COMMENT_START))) {
87
+ token = TokenType.Comment
88
+ state = State.InsideLineComment
89
+ } else if ((next = part.match(RE_WHITESPACE))) {
90
+ token = TokenType.Whitespace
91
+ state = State.TopLevelContent
92
+ } else if ((next = part.match(RE_ANYTHING))) {
93
+ token = TokenType.Text
94
+ state = State.TopLevelContent
95
+ } else {
96
+ part //?
97
+ throw new Error('no')
98
+ }
99
+ break
100
+ case State.InsideLineComment:
101
+ if ((next = part.match(RE_ANYTHING))) {
102
+ token = TokenType.Comment
103
+ state = State.TopLevelContent
104
+ } else {
105
+ throw new Error('no')
106
+ }
107
+ break
108
+ default:
109
+ console.log({ state, line })
110
+ throw new Error('no')
22
111
  }
112
+ index += next[0].length
113
+ tokens.push({
114
+ type: token,
115
+ length: next[0].length,
116
+ })
23
117
  }
24
118
  return {
25
- state: 1,
26
- tokens: [
27
- {
28
- type: TokenType.Text,
29
- length: line.length,
30
- },
31
- ],
119
+ state,
120
+ tokens,
32
121
  }
33
122
  }
package/package.json CHANGED
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "name": "@lvce-editor/shared-process",
3
- "version": "0.0.37",
3
+ "version": "0.0.38",
4
4
  "description": "",
5
5
  "main": "index.js",
6
6
  "type": "module",
@@ -38,8 +38,8 @@
38
38
  "verror": "^1.10.1",
39
39
  "ws": "^8.8.1",
40
40
  "xdg-basedir": "^5.1.0",
41
- "@lvce-editor/pty-host": "0.0.37",
42
- "@lvce-editor/extension-host": "0.0.37"
41
+ "@lvce-editor/pty-host": "0.0.38",
42
+ "@lvce-editor/extension-host": "0.0.38"
43
43
  },
44
44
  "optionalDependencies": {
45
45
  "electron-clipboard-ex": "^1.3.3",