@bendyline/gilde 0.1.29 → 0.1.31

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (126) hide show
  1. package/authoring/chat-models/btl4-35b-q4.json +4 -5
  2. package/authoring/chat-models/btl4-compact-iq2.json +4 -5
  3. package/authoring/chat-models/deepseek-r1-8b-q4.json +2 -2
  4. package/authoring/chat-models/gemma4-12b-q4.json +2 -3
  5. package/authoring/chat-models/gemma4-12b-q8.json +2 -3
  6. package/authoring/chat-models/gemma4-26b-q4.json +2 -3
  7. package/authoring/chat-models/gemma4-31b-q4.json +2 -3
  8. package/authoring/chat-models/gemma4-e2b-q4.json +2 -3
  9. package/authoring/chat-models/gemma4-e4b-q4.json +2 -3
  10. package/authoring/chat-models/gpt-oss-20b-q4.json +2 -2
  11. package/authoring/chat-models/laguna-s-2.1-118b-q4.json +4 -6
  12. package/authoring/chat-models/laguna-s-2.1-118b-q6.json +3 -4
  13. package/authoring/chat-models/laguna-s-2.1-118b-q8.json +4 -6
  14. package/authoring/chat-models/lfm2.5-2.6b-q4.json +2 -2
  15. package/authoring/chat-models/llama3.2-3b-q4.json +2 -2
  16. package/authoring/chat-models/mistral-7b-q4.json +2 -2
  17. package/authoring/chat-models/mistral-medium-3.5-128b-q4.json +2 -2
  18. package/authoring/chat-models/muse-glimmer-30b-q4.json +4 -5
  19. package/authoring/chat-models/nemotron3-nano-30b-q4.json +3 -3
  20. package/authoring/chat-models/nemotron3-super-120b-q4.json +3 -3
  21. package/authoring/chat-models/nemotron3.5-lightning-30b-q4.json +5 -7
  22. package/authoring/chat-models/nemotron3.5-lightning-30b-q8.json +5 -7
  23. package/authoring/chat-models/ornith-35b-q4.json +5 -7
  24. package/authoring/chat-models/ornith-35b-q8.json +5 -7
  25. package/authoring/chat-models/ornith-9b-q4.json +5 -7
  26. package/authoring/chat-models/qwen3.5-122b-a10b-q4.json +3 -5
  27. package/authoring/chat-models/qwen3.5-2b-q4.json +3 -4
  28. package/authoring/chat-models/qwen3.5-4b-q4.json +3 -4
  29. package/authoring/chat-models/qwen3.5-9b-q4.json +3 -4
  30. package/authoring/chat-models/qwen3.6-27b-q4.json +3 -4
  31. package/authoring/chat-models/qwen3.6-27b-q8.json +3 -4
  32. package/authoring/chat-models/qwen3.6-35b-a3b-q4.json +3 -4
  33. package/authoring/chat-models/qwen3.6-35b-a3b-q8.json +3 -4
  34. package/authoring/chat-models/qwen3.8-27b-q4.json +22 -9
  35. package/authoring/chat-models/qwen3.8-27b-q6.json +190 -0
  36. package/authoring/chat-models/qwen3.8-27b-q8.json +184 -0
  37. package/authoring/chat-models/talkie-1930-13b-q4.json +3 -4
  38. package/authoring/chat-models/ternary-bonsai-27b-q2.json +3 -4
  39. package/data/chat-models/bt/btl4-35b-q4/manifest.json +4 -5
  40. package/data/chat-models/bt/btl4-35b-q4/versions/1.0.1/manifest.json +15 -0
  41. package/data/chat-models/bt/btl4-compact-iq2/manifest.json +4 -5
  42. package/data/chat-models/bt/btl4-compact-iq2/versions/1.0.2/manifest.json +15 -0
  43. package/data/chat-models/de/deepseek-r1-8b-q4/manifest.json +4 -6
  44. package/data/chat-models/de/deepseek-r1-8b-q4/versions/1.1.1/manifest.json +61 -0
  45. package/data/chat-models/ge/gemma4-12b-q4/manifest.json +2 -3
  46. package/data/chat-models/ge/gemma4-12b-q4/versions/1.1.3/manifest.json +78 -0
  47. package/data/chat-models/ge/gemma4-12b-q8/manifest.json +2 -3
  48. package/data/chat-models/ge/gemma4-12b-q8/versions/1.0.3/manifest.json +78 -0
  49. package/data/chat-models/ge/gemma4-26b-q4/manifest.json +2 -3
  50. package/data/chat-models/ge/gemma4-26b-q4/versions/1.2.2/manifest.json +80 -0
  51. package/data/chat-models/ge/gemma4-31b-q4/manifest.json +2 -3
  52. package/data/chat-models/ge/gemma4-31b-q4/versions/1.2.2/manifest.json +95 -0
  53. package/data/chat-models/ge/gemma4-e2b-q4/manifest.json +2 -3
  54. package/data/chat-models/ge/gemma4-e2b-q4/versions/1.2.1/manifest.json +71 -0
  55. package/data/chat-models/ge/gemma4-e4b-q4/manifest.json +2 -3
  56. package/data/chat-models/ge/gemma4-e4b-q4/versions/1.2.1/manifest.json +76 -0
  57. package/data/chat-models/gp/gpt-oss-20b-q4/manifest.json +4 -6
  58. package/data/chat-models/gp/gpt-oss-20b-q4/versions/1.1.1/manifest.json +71 -0
  59. package/data/chat-models/index.json +1 -1
  60. package/data/chat-models/la/laguna-s-2.1-118b-q4/manifest.json +4 -6
  61. package/data/chat-models/la/laguna-s-2.1-118b-q4/versions/1.0.2/manifest.json +123 -0
  62. package/data/chat-models/la/laguna-s-2.1-118b-q6/manifest.json +3 -4
  63. package/data/chat-models/la/laguna-s-2.1-118b-q6/versions/1.0.1/manifest.json +145 -0
  64. package/data/chat-models/la/laguna-s-2.1-118b-q8/manifest.json +4 -6
  65. package/data/chat-models/la/laguna-s-2.1-118b-q8/versions/1.0.2/manifest.json +173 -0
  66. package/data/chat-models/lf/lfm2.5-2.6b-q4/manifest.json +4 -6
  67. package/data/chat-models/lf/lfm2.5-2.6b-q4/versions/1.0.1/manifest.json +58 -0
  68. package/data/chat-models/ll/llama3.2-3b-q4/manifest.json +4 -6
  69. package/data/chat-models/ll/llama3.2-3b-q4/versions/1.1.1/manifest.json +56 -0
  70. package/data/chat-models/mi/mistral-7b-q4/manifest.json +4 -6
  71. package/data/chat-models/mi/mistral-7b-q4/versions/1.1.1/manifest.json +61 -0
  72. package/data/chat-models/mi/mistral-medium-3.5-128b-q4/manifest.json +2 -2
  73. package/data/chat-models/mi/mistral-medium-3.5-128b-q4/versions/1.0.1/manifest.json +153 -0
  74. package/data/chat-models/mu/muse-glimmer-30b-q4/manifest.json +4 -5
  75. package/data/chat-models/mu/muse-glimmer-30b-q4/versions/1.0.1/manifest.json +20 -0
  76. package/data/chat-models/ne/nemotron3-nano-30b-q4/manifest.json +3 -3
  77. package/data/chat-models/ne/nemotron3-nano-30b-q4/versions/1.0.1/manifest.json +94 -0
  78. package/data/chat-models/ne/nemotron3-nano-30b-q4/versions/1.0.2/manifest.json +93 -0
  79. package/data/chat-models/ne/nemotron3-super-120b-q4/manifest.json +3 -3
  80. package/data/chat-models/ne/nemotron3-super-120b-q4/versions/1.0.1/manifest.json +30 -0
  81. package/data/chat-models/ne/nemotron3.5-lightning-30b-q4/manifest.json +5 -7
  82. package/data/chat-models/ne/nemotron3.5-lightning-30b-q4/versions/1.0.1/manifest.json +73 -0
  83. package/data/chat-models/ne/nemotron3.5-lightning-30b-q8/manifest.json +5 -7
  84. package/data/chat-models/ne/nemotron3.5-lightning-30b-q8/versions/1.0.1/manifest.json +88 -0
  85. package/data/chat-models/or/ornith-35b-q4/manifest.json +5 -7
  86. package/data/chat-models/or/ornith-35b-q4/versions/1.0.1/manifest.json +93 -0
  87. package/data/chat-models/or/ornith-35b-q8/manifest.json +5 -7
  88. package/data/chat-models/or/ornith-35b-q8/versions/1.0.1/manifest.json +113 -0
  89. package/data/chat-models/or/ornith-9b-q4/manifest.json +5 -7
  90. package/data/chat-models/or/ornith-9b-q4/versions/1.0.1/manifest.json +83 -0
  91. package/data/chat-models/qw/qwen3.5-122b-a10b-q4/manifest.json +3 -5
  92. package/data/chat-models/qw/qwen3.5-122b-a10b-q4/versions/1.0.2/manifest.json +164 -0
  93. package/data/chat-models/qw/qwen3.5-122b-a10b-q4/versions/1.0.3/manifest.json +163 -0
  94. package/data/chat-models/qw/qwen3.5-2b-q4/manifest.json +3 -4
  95. package/data/chat-models/qw/qwen3.5-2b-q4/versions/1.1.3/manifest.json +76 -0
  96. package/data/chat-models/qw/qwen3.5-4b-q4/manifest.json +3 -4
  97. package/data/chat-models/qw/qwen3.5-4b-q4/versions/1.1.3/manifest.json +76 -0
  98. package/data/chat-models/qw/qwen3.5-9b-q4/manifest.json +3 -4
  99. package/data/chat-models/qw/qwen3.5-9b-q4/versions/1.1.3/manifest.json +81 -0
  100. package/data/chat-models/qw/qwen3.6-27b-q4/manifest.json +3 -4
  101. package/data/chat-models/qw/qwen3.6-27b-q4/versions/1.1.5/manifest.json +91 -0
  102. package/data/chat-models/qw/qwen3.6-27b-q8/manifest.json +3 -4
  103. package/data/chat-models/qw/qwen3.6-27b-q8/versions/1.0.3/manifest.json +103 -0
  104. package/data/chat-models/qw/qwen3.6-35b-a3b-q4/manifest.json +3 -4
  105. package/data/chat-models/qw/qwen3.6-35b-a3b-q4/versions/1.0.2/manifest.json +93 -0
  106. package/data/chat-models/qw/qwen3.6-35b-a3b-q8/manifest.json +3 -4
  107. package/data/chat-models/qw/qwen3.6-35b-a3b-q8/versions/1.0.2/manifest.json +113 -0
  108. package/data/chat-models/qw/qwen3.8-27b-q4/manifest.json +94 -12
  109. package/data/chat-models/qw/qwen3.8-27b-q4/versions/1.0.1/manifest.json +93 -0
  110. package/data/chat-models/qw/qwen3.8-27b-q6/manifest.json +195 -0
  111. package/data/chat-models/qw/qwen3.8-27b-q6/versions/1.0.0/manifest.json +20 -0
  112. package/data/chat-models/qw/qwen3.8-27b-q8/manifest.json +278 -0
  113. package/data/chat-models/qw/qwen3.8-27b-q8/versions/1.0.0/manifest.json +113 -0
  114. package/data/chat-models/qw/qwen3.8-27b-q8/versions/1.0.1/manifest.json +113 -0
  115. package/data/chat-models/ta/talkie-1930-13b-q4/manifest.json +3 -4
  116. package/data/chat-models/ta/talkie-1930-13b-q4/versions/1.0.1/manifest.json +15 -0
  117. package/data/chat-models/te/ternary-bonsai-27b-q2/manifest.json +3 -4
  118. package/data/chat-models/te/ternary-bonsai-27b-q2/versions/1.0.1/manifest.json +70 -0
  119. package/data/craftbook-templates/index.json +1 -1
  120. package/data/craftbook-templates/pu/pull-request-review/versions/1.5.0/craftbook.json +188 -0
  121. package/data/craftbook-templates/pu/pull-request-review/versions/1.5.0/test.json +123 -0
  122. package/data/gezel-templates/bu/builder/manifest.json +1 -1
  123. package/data/gezel-templates/bu/builder/versions/1.4.0/about.md +34 -0
  124. package/data/gezel-templates/bu/builder/versions/1.4.0/manifest.json +9 -0
  125. package/data/gezel-templates/index.json +1 -1
  126. package/package.json +1 -1
@@ -0,0 +1,56 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.1.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 2019377696,
6
+ "ollama": {
7
+ "tag": "llama3.2"
8
+ },
9
+ "llamaCpp": {
10
+ "huggingfaceRepo": "bartowski/Llama-3.2-3B-Instruct-GGUF",
11
+ "revision": "5ab33fa94d1d04e903623ae72c95d1696f09f9e8",
12
+ "filename": "Llama-3.2-3B-Instruct-Q4_K_M.gguf",
13
+ "sha256": "6c1a2b41161032677be168d354123594c0e6e67d2b9227c84f296ad037c728ff",
14
+ "approxSizeBytes": 2019377696,
15
+ "quantization": "Q4_K_M"
16
+ },
17
+ "mlx": {
18
+ "huggingfaceRepo": "mlx-community/Llama-3.2-3B-Instruct-4bit",
19
+ "revision": "7f0dc925e0d0afb0322d96f9255cfddf2ba5636e",
20
+ "quantization": "4bit",
21
+ "approxSizeBytes": 1824807894,
22
+ "files": [
23
+ {
24
+ "name": "config.json",
25
+ "sha256": "c546925585e48f43890d9dc5150df4fec73dd3780d92961c5ace451934cc4cd6",
26
+ "sizeBytes": 1122
27
+ },
28
+ {
29
+ "name": "model.safetensors",
30
+ "sha256": "d75e1ee0ea653cc5b76191ec934c7c0d568e94d4e47846619f1f4bc715b7b265",
31
+ "sizeBytes": 1807496278
32
+ },
33
+ {
34
+ "name": "model.safetensors.index.json",
35
+ "sha256": "2ef31fa0b9dcda01f87835851d5e1d5a39ab6258ae618af6ea864c3747e556e4",
36
+ "sizeBytes": 45720
37
+ },
38
+ {
39
+ "name": "special_tokens_map.json",
40
+ "sha256": "6f38c73729248f6c127296386e3cdde96e254636cc58b4169d3fd32328d9a8ec",
41
+ "sizeBytes": 296
42
+ },
43
+ {
44
+ "name": "tokenizer.json",
45
+ "sha256": "6b9e4e7fb171f92fd137b777cc2714bf87d11576700a1dcd7a399e7bbe39537b",
46
+ "sizeBytes": 17209920
47
+ },
48
+ {
49
+ "name": "tokenizer_config.json",
50
+ "sha256": "022d5ae3df4737998ab97d8f31ac2bcb4c06dd8ebe5a8aba2b4aceef1e5ea7d3",
51
+ "sizeBytes": 54558
52
+ }
53
+ ]
54
+ },
55
+ "minGezelVersion": "1.26227"
56
+ }
@@ -13,8 +13,8 @@
13
13
  "name": "Mistral AI",
14
14
  "url": "https://ollama.com/library/mistral"
15
15
  },
16
- "version": "1.1.0",
17
- "updatedAt": "2026-04-26T00:00:00Z",
16
+ "version": "1.1.1",
17
+ "updatedAt": "2026-08-15T00:00:00Z",
18
18
  "license": "Apache-2.0",
19
19
  "licenseClass": "open",
20
20
  "licenseShortName": "Apache 2.0",
@@ -46,8 +46,7 @@
46
46
  "filename": "Mistral-7B-Instruct-v0.3-Q4_K_M.gguf",
47
47
  "sha256": "1270d22c0fbb3d092fb725d4d96c457b7b687a5f5a715abe1e818da303e562b6",
48
48
  "approxSizeBytes": 4372812000,
49
- "quantization": "Q4_K_M",
50
- "residentBytes": 5247374400
49
+ "quantization": "Q4_K_M"
51
50
  },
52
51
  "mlx": {
53
52
  "huggingfaceRepo": "mlx-community/Mistral-7B-Instruct-v0.3-4bit",
@@ -90,8 +89,7 @@
90
89
  "sha256": "e8fbcfef34d855dba2c7f1d91a2c5470cf493d00ecfd06488ce21e45325bc8ae",
91
90
  "sizeBytes": 138039
92
91
  }
93
- ],
94
- "residentBytes": 5304286939
92
+ ]
95
93
  },
96
94
  "tuning": {
97
95
  "engine": {
@@ -0,0 +1,61 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.1.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 4372812000,
6
+ "ollama": {
7
+ "tag": "mistral:7b"
8
+ },
9
+ "llamaCpp": {
10
+ "huggingfaceRepo": "bartowski/Mistral-7B-Instruct-v0.3-GGUF",
11
+ "revision": "61fd4167fff3ab01ee1cfe0da183fa27a944db48",
12
+ "filename": "Mistral-7B-Instruct-v0.3-Q4_K_M.gguf",
13
+ "sha256": "1270d22c0fbb3d092fb725d4d96c457b7b687a5f5a715abe1e818da303e562b6",
14
+ "approxSizeBytes": 4372812000,
15
+ "quantization": "Q4_K_M"
16
+ },
17
+ "mlx": {
18
+ "huggingfaceRepo": "mlx-community/Mistral-7B-Instruct-v0.3-4bit",
19
+ "revision": "a4b8f870474b0eb527f466a03fbc187830d271f5",
20
+ "quantization": "4bit",
21
+ "approxSizeBytes": 4080220722,
22
+ "files": [
23
+ {
24
+ "name": "config.json",
25
+ "sha256": "efc145d2f53d6d6ef2639be0556b4ecf6faac6cf8a7199ad2b7bb5ebcf443bdd",
26
+ "sizeBytes": 721
27
+ },
28
+ {
29
+ "name": "model.safetensors",
30
+ "sha256": "d7182d886f93a9efa73d6d556ee33ffe839a4e09e15965eeef46f295ab5b503d",
31
+ "sizeBytes": 4077480215
32
+ },
33
+ {
34
+ "name": "model.safetensors.index.json",
35
+ "sha256": "525940738b16d210fdfd692a24752d050c15a50cbe208dd82b06204d640d687b",
36
+ "sizeBytes": 52381
37
+ },
38
+ {
39
+ "name": "special_tokens_map.json",
40
+ "sha256": "6fa06efa2785e450051989a6f8fb4416b10149ded485ddd3f127a40734f5cfd0",
41
+ "sizeBytes": 414
42
+ },
43
+ {
44
+ "name": "tokenizer.json",
45
+ "sha256": "e553af6fff7d7ad76e830608b218c5c0b0822998d5a1a96099a74cd3c1cb1a49",
46
+ "sizeBytes": 1961548
47
+ },
48
+ {
49
+ "name": "tokenizer.model",
50
+ "sha256": "37f00374dea48658ee8f5d0f21895b9bc55cb0103939607c8185bfd1c6ca1f89",
51
+ "sizeBytes": 587404
52
+ },
53
+ {
54
+ "name": "tokenizer_config.json",
55
+ "sha256": "e8fbcfef34d855dba2c7f1d91a2c5470cf493d00ecfd06488ce21e45325bc8ae",
56
+ "sizeBytes": 138039
57
+ }
58
+ ]
59
+ },
60
+ "minGezelVersion": "1.26227"
61
+ }
@@ -16,8 +16,8 @@
16
16
  "name": "Mistral AI",
17
17
  "url": "https://huggingface.co/mistralai/Mistral-Medium-3.5-128B"
18
18
  },
19
- "version": "1.0.0",
20
- "updatedAt": "2026-05-22T00:00:00Z",
19
+ "version": "1.0.1",
20
+ "updatedAt": "2026-08-15T00:00:00Z",
21
21
  "license": "MIT-Modified",
22
22
  "licenseClass": "custom-restricted",
23
23
  "licenseShortName": "MIT-Modified",
@@ -0,0 +1,153 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 74897139136,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "unsloth/Mistral-Medium-3.5-128B-GGUF",
8
+ "revision": "c8f5b1477e1b22cd2d819157d450f001f7047298",
9
+ "shards": [
10
+ {
11
+ "name": "Q4_K_M/Mistral-Medium-3.5-128B-Q4_K_M-00001-of-00003.gguf",
12
+ "sha256": "94bf2dd90d80f41b1dfb1f94b569d11fd78fd302a79ae9fdf828f8082d1dfeaa",
13
+ "sizeBytes": 7875456
14
+ },
15
+ {
16
+ "name": "Q4_K_M/Mistral-Medium-3.5-128B-Q4_K_M-00002-of-00003.gguf",
17
+ "sha256": "8396392f4b9eafac69e59355b569b6603f42d103505988e26939db7f5bfecb95",
18
+ "sizeBytes": 49927945056
19
+ },
20
+ {
21
+ "name": "Q4_K_M/Mistral-Medium-3.5-128B-Q4_K_M-00003-of-00003.gguf",
22
+ "sha256": "3f4ddc0284d522e6f1a020eaa731eaf851d6708a26431773de7bba504227c2e5",
23
+ "sizeBytes": 24961318624
24
+ }
25
+ ],
26
+ "approxSizeBytes": 74897139136,
27
+ "quantization": "Q4_K_M"
28
+ },
29
+ "mlx": {
30
+ "huggingfaceRepo": "mlx-community/Mistral-Medium-3.5-128B-4bit",
31
+ "revision": "5a7b6b72ca9eb2324a90bdb5e6079789dae68348",
32
+ "quantization": "4bit",
33
+ "approxSizeBytes": 78019864102,
34
+ "files": [
35
+ {
36
+ "name": "chat_template.jinja",
37
+ "sha256": "07ef40663bd181457c9c2a823296c83b33dc4f09e5d5f11478c219f7fb4f5633",
38
+ "sizeBytes": 13479
39
+ },
40
+ {
41
+ "name": "config.json",
42
+ "sha256": "915a6627d7cef04adf8efbb7c8befa1f09833d038eeddd80958aa88f5ae5dabb",
43
+ "sizeBytes": 2127
44
+ },
45
+ {
46
+ "name": "consolidated.safetensors.index.json",
47
+ "sha256": "abf847cd7a832d633fc800945dabf54fad3fca04a853c7d53eefa1e9b90fd8d0",
48
+ "sizeBytes": 217908
49
+ },
50
+ {
51
+ "name": "generation_config.json",
52
+ "sha256": "a107bf29bb85bd142694b293f41f5984176c598c8c3a3bc47f1f5ac8008bf89e",
53
+ "sizeBytes": 131
54
+ },
55
+ {
56
+ "name": "model-00001-of-00015.safetensors",
57
+ "sha256": "595e23a7aaf89c392165e653cb8d4cf862aa596f6cbfb1d03ed671330f72d0de",
58
+ "sizeBytes": 5356508226
59
+ },
60
+ {
61
+ "name": "model-00002-of-00015.safetensors",
62
+ "sha256": "59db0909274c1464a058fb6d98ba5ed39280bf96ed34f81867b27351e1c9154d",
63
+ "sizeBytes": 5368448119
64
+ },
65
+ {
66
+ "name": "model-00003-of-00015.safetensors",
67
+ "sha256": "91e857ebe77e1020f7e90742ee643290f71a67cccd56ba81250daeb2e2876e64",
68
+ "sizeBytes": 5263167745
69
+ },
70
+ {
71
+ "name": "model-00004-of-00015.safetensors",
72
+ "sha256": "dfa77b77d40ff44aa27a8be3d1a611e177a9e29b7fcf47d99959643b115bb435",
73
+ "sizeBytes": 5252157665
74
+ },
75
+ {
76
+ "name": "model-00005-of-00015.safetensors",
77
+ "sha256": "0b62abf4d755c9a882e513f74cfebcffb7cce94fe6746aff4912eb411174a962",
78
+ "sizeBytes": 5365403842
79
+ },
80
+ {
81
+ "name": "model-00006-of-00015.safetensors",
82
+ "sha256": "fc241be9252defbe6bd44c1ec3c2c1cc7e3cbfef3c710025944aa45c91e63477",
83
+ "sizeBytes": 5351247306
84
+ },
85
+ {
86
+ "name": "model-00007-of-00015.safetensors",
87
+ "sha256": "95ba57e62c4979b6dcc23dc4d4d199c7ac6c71b5f9a96d20ebf99e231202fe36",
88
+ "sizeBytes": 5252108242
89
+ },
90
+ {
91
+ "name": "model-00008-of-00015.safetensors",
92
+ "sha256": "574edc0a63b23874258610a132a69c648520dbd8db2a6a68929ead73872c8d67",
93
+ "sizeBytes": 5252157663
94
+ },
95
+ {
96
+ "name": "model-00009-of-00015.safetensors",
97
+ "sha256": "dab1076222d40b7777d8fe09285cb804188ad8a10af1d5232ba19b842d34cec3",
98
+ "sizeBytes": 5252157629
99
+ },
100
+ {
101
+ "name": "model-00010-of-00015.safetensors",
102
+ "sha256": "1c7836f1b077dbffa6a54a3458dd66879f343f4f8e648d74e7f21e2642ecf48c",
103
+ "sizeBytes": 5365403830
104
+ },
105
+ {
106
+ "name": "model-00011-of-00015.safetensors",
107
+ "sha256": "13402c3ceccea8af794bec72d841885c7f63a7fba534a1b9c6d7f722d028c7d5",
108
+ "sizeBytes": 5351247296
109
+ },
110
+ {
111
+ "name": "model-00012-of-00015.safetensors",
112
+ "sha256": "b2f988520b06cc34a9f9b0c4f71b1cc0fbd465b7c45a20ead3911fe1ca434d5a",
113
+ "sizeBytes": 5252108278
114
+ },
115
+ {
116
+ "name": "model-00013-of-00015.safetensors",
117
+ "sha256": "97f3bb3f7b2486db4d4912d5a3620b5ae8d34b8f55ce23c17b7a553c19dc6a1f",
118
+ "sizeBytes": 5252157667
119
+ },
120
+ {
121
+ "name": "model-00014-of-00015.safetensors",
122
+ "sha256": "7a1f12144046d582ff6997eeefd29f025060586f5cf23880be3416bb630adce5",
123
+ "sizeBytes": 5252157631
124
+ },
125
+ {
126
+ "name": "model-00015-of-00015.safetensors",
127
+ "sha256": "e03cd427f534273d586bad3d9f7ff24d3eb838572dc5be7bc4bc98cdeba86d92",
128
+ "sizeBytes": 3815843471
129
+ },
130
+ {
131
+ "name": "model.safetensors.index.json",
132
+ "sha256": "7dd3ad9ef87bae38057d528bd92342bd6dadae4112113c2b55c8ee6ef67a85b4",
133
+ "sizeBytes": 256576
134
+ },
135
+ {
136
+ "name": "processor_config.json",
137
+ "sha256": "c64dadda906c723a428eedfe6263485a343c35adb64d24295a9b408c372aba31",
138
+ "sizeBytes": 661
139
+ },
140
+ {
141
+ "name": "tokenizer.json",
142
+ "sha256": "2ba5b3330fd84d5376fcca797cfb3b42eee6241ce23e3271e6fb2a115a8751bd",
143
+ "sizeBytes": 17077420
144
+ },
145
+ {
146
+ "name": "tokenizer_config.json",
147
+ "sha256": "776dd712367ab3da3e79c5008c6141b1f8912c74310410c4ed49827299b856d1",
148
+ "sizeBytes": 21190
149
+ }
150
+ ]
151
+ },
152
+ "minGezelVersion": "1.26227"
153
+ }
@@ -4,7 +4,7 @@
4
4
  "minGezelVersion": "1.26223",
5
5
  "id": "muse-glimmer-30b-q4",
6
6
  "name": "Muse Glimmer (30B, Q4)",
7
- "description": "Meta Superintelligence Labs' Muse family, distilled from the larger Muse Spark down to 30B: a dense agentic model (29.6B language model plus a ~1.8B ViT-G/14 perception encoder) built for long-horizon tool use on consumer hardware. A new architecture rather than a Llama derivative — its own chat format and tool-call grammar. Multimodal (text + image), 131K native context, native tool calling, and a reasoning strength dial from low to xhigh. Meta's own calibrated K-quant build, sized to fit 24GB of VRAM.",
7
+ "description": "Meta Superintelligence Labs' Muse Glimmer at 30B parameters, distilled from the larger Muse Spark and built for long-horizon tool use on everyday hardware. Multimodal (text + image), 131K context, native tool calling, and adjustable reasoning effort. Meta's own build, sized for machines with 24GB+ memory.",
8
8
  "tags": [
9
9
  "meta",
10
10
  "agentic",
@@ -19,8 +19,8 @@
19
19
  "name": "Meta Superintelligence Labs",
20
20
  "url": "https://huggingface.co/meta-models/Muse-Glimmer-30B"
21
21
  },
22
- "version": "1.0.0",
23
- "updatedAt": "2026-08-10T00:00:00Z",
22
+ "version": "1.0.1",
23
+ "updatedAt": "2026-08-15T00:00:00Z",
24
24
  "license": "Apache-2.0",
25
25
  "licenseClass": "open",
26
26
  "licenseShortName": "Apache 2.0",
@@ -129,7 +129,6 @@
129
129
  "filename": "mmproj-kquant.gguf",
130
130
  "sha256": "f48b452316f9b213758e8659444029b961a24a07f99a1abb2a9f88b06f7c00c6",
131
131
  "sizeBytes": 1400328928
132
- },
133
- "residentBytes": 21416116224
132
+ }
134
133
  }
135
134
  }
@@ -0,0 +1,20 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 16756681056,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "meta-models/Muse-Glimmer-30B-GGUF",
8
+ "revision": "93769bc7ab5ad1e9cd22d857e3138cf5d977ae81",
9
+ "filename": "muse-glimmer-30B-kquant-17gb.gguf",
10
+ "sha256": "7e9b74b7c8875e9e265695df9613bf6290f2392e479ce740495a129019c488d8",
11
+ "approxSizeBytes": 16756681056,
12
+ "quantization": "K-Quant-17GB",
13
+ "mmproj": {
14
+ "filename": "mmproj-kquant.gguf",
15
+ "sha256": "f48b452316f9b213758e8659444029b961a24a07f99a1abb2a9f88b06f7c00c6",
16
+ "sizeBytes": 1400328928
17
+ }
18
+ },
19
+ "minGezelVersion": "1.26227"
20
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "nemotron3-nano-30b-q4",
5
5
  "name": "Nemotron-3 Nano (30B, MoE Reasoning)",
6
- "description": "NVIDIA's Nemotron-3 Nano Omni 30B-parameter hybrid Mamba/Transformer Mixture-of-Experts (~3B active per token) tuned for reasoning. Native function-calling, 128K context, multimodal (text + image + audio + video).",
6
+ "description": "NVIDIA's Nemotron-3 Nano Omni at 30B parameters, tuned for reasoning. Multimodal (text + image + audio + video), 128K context, native tool calling. Capable-tier on-device option for machines with 32GB+ memory.",
7
7
  "tags": [
8
8
  "nvidia",
9
9
  "reasoning",
@@ -20,8 +20,8 @@
20
20
  "name": "NVIDIA",
21
21
  "url": "https://huggingface.co/nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning"
22
22
  },
23
- "version": "1.0.0",
24
- "updatedAt": "2026-05-17T00:00:00Z",
23
+ "version": "1.0.2",
24
+ "updatedAt": "2026-08-15T00:00:00Z",
25
25
  "license": "NVIDIA Open Model License",
26
26
  "licenseClass": "custom-restricted",
27
27
  "licenseShortName": "NVIDIA Open Model",
@@ -0,0 +1,94 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 24515129536,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF",
8
+ "revision": "49a5b1ae335e30e775d4eb03f822b52a63ea4271",
9
+ "filename": "Nemotron-3-Nano-Omni-30B-A3B-Reasoning-Q4_K_M.gguf",
10
+ "sha256": "e3efd3f173538eef6a422cfb20f273413348adfd75e14b846acf36943894ef43",
11
+ "approxSizeBytes": 24515129536,
12
+ "residentBytes": 29418155443,
13
+ "quantization": "Q4_K_M",
14
+ "mmproj": {
15
+ "filename": "mmproj-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16.gguf",
16
+ "sha256": "0e46f4126eb65732c645262d78b2ac41955ced3de4643dddfa9892f68d08c9e9",
17
+ "sizeBytes": 1589506176
18
+ }
19
+ },
20
+ "mlx": {
21
+ "huggingfaceRepo": "mlx-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-nvfp4",
22
+ "revision": "3f65bc48c603081c6ba89b63fdc23400ea087e38",
23
+ "quantization": "nvfp4",
24
+ "approxSizeBytes": 19650740662,
25
+ "files": [
26
+ {
27
+ "name": "chat_template.jinja",
28
+ "sha256": "41428e0c65e312c359df2495ef5284769a9520b15a693deda4c34a1538208faa",
29
+ "sizeBytes": 14277
30
+ },
31
+ {
32
+ "name": "config.json",
33
+ "sha256": "1fb89f29105b9fb455ee8e1dc88de963b95a631c7cc6a68d7e17d4aa24570aac",
34
+ "sizeBytes": 9459
35
+ },
36
+ {
37
+ "name": "generation_config.json",
38
+ "sha256": "dbe3dfa851ad1462c45beed3a9a35f02e24af5311d79e8b9de5a41428b3a8e7a",
39
+ "sizeBytes": 309
40
+ },
41
+ {
42
+ "name": "model-00001-of-00004.safetensors",
43
+ "sha256": "128a189c3e20c23b5199394b0c84f1dae226405f82081e5d559e3fb2c980b343",
44
+ "sizeBytes": 5118626596
45
+ },
46
+ {
47
+ "name": "model-00002-of-00004.safetensors",
48
+ "sha256": "a2097eb987352e665992af87edd101047e713a1f80cc34555254179033f00fe6",
49
+ "sizeBytes": 5291563052
50
+ },
51
+ {
52
+ "name": "model-00003-of-00004.safetensors",
53
+ "sha256": "1c77e0cb0d69884a9bb01e540fa43818c10f106bb447edbef5fe7a80b5a4f38b",
54
+ "sizeBytes": 5291563074
55
+ },
56
+ {
57
+ "name": "model-00004-of-00004.safetensors",
58
+ "sha256": "903b1ecdef13e3a80fe430a28143ffd4062337c6cd5e78ba9986a127fbd78a25",
59
+ "sizeBytes": 3931693211
60
+ },
61
+ {
62
+ "name": "model.safetensors.index.json",
63
+ "sha256": "09a169e3c52670cfe7ea95930139f17abed38144d2d220db5057e2e0ba000f13",
64
+ "sizeBytes": 191231
65
+ },
66
+ {
67
+ "name": "preprocessor_config.json",
68
+ "sha256": "e53c54889896ad6104a031f58831cf237e1416bfb16612d856213ce94a91df17",
69
+ "sizeBytes": 342
70
+ },
71
+ {
72
+ "name": "processor_config.json",
73
+ "sha256": "f7de807026c387af42011cc85058253b7cf39ddb5cb8cedf8927d7d2eb2c6ce7",
74
+ "sizeBytes": 743
75
+ },
76
+ {
77
+ "name": "special_tokens_map.json",
78
+ "sha256": "e3a4f63da745f02317a45e00e6476c17fc66ac41faf14bb1b0be1f3211b0ca53",
79
+ "sizeBytes": 420
80
+ },
81
+ {
82
+ "name": "tokenizer.json",
83
+ "sha256": "d0432ad8b1c2984a2e2dca82e1933e3fd5628df6e95c51fba4c3ee9950dce299",
84
+ "sizeBytes": 17077366
85
+ },
86
+ {
87
+ "name": "tokenizer_config.json",
88
+ "sha256": "1293fc27661bc2989b8c3b42db6ffbdfad87e35144b9b686eab2538b4c56c60e",
89
+ "sizeBytes": 582
90
+ }
91
+ ]
92
+ },
93
+ "minGezelVersion": "1.26227"
94
+ }
@@ -0,0 +1,93 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.2",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 24515129536,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF",
8
+ "revision": "49a5b1ae335e30e775d4eb03f822b52a63ea4271",
9
+ "filename": "Nemotron-3-Nano-Omni-30B-A3B-Reasoning-Q4_K_M.gguf",
10
+ "sha256": "e3efd3f173538eef6a422cfb20f273413348adfd75e14b846acf36943894ef43",
11
+ "approxSizeBytes": 24515129536,
12
+ "quantization": "Q4_K_M",
13
+ "mmproj": {
14
+ "filename": "mmproj-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16.gguf",
15
+ "sha256": "0e46f4126eb65732c645262d78b2ac41955ced3de4643dddfa9892f68d08c9e9",
16
+ "sizeBytes": 1589506176
17
+ }
18
+ },
19
+ "mlx": {
20
+ "huggingfaceRepo": "mlx-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-nvfp4",
21
+ "revision": "3f65bc48c603081c6ba89b63fdc23400ea087e38",
22
+ "quantization": "nvfp4",
23
+ "approxSizeBytes": 19650740662,
24
+ "files": [
25
+ {
26
+ "name": "chat_template.jinja",
27
+ "sha256": "41428e0c65e312c359df2495ef5284769a9520b15a693deda4c34a1538208faa",
28
+ "sizeBytes": 14277
29
+ },
30
+ {
31
+ "name": "config.json",
32
+ "sha256": "1fb89f29105b9fb455ee8e1dc88de963b95a631c7cc6a68d7e17d4aa24570aac",
33
+ "sizeBytes": 9459
34
+ },
35
+ {
36
+ "name": "generation_config.json",
37
+ "sha256": "dbe3dfa851ad1462c45beed3a9a35f02e24af5311d79e8b9de5a41428b3a8e7a",
38
+ "sizeBytes": 309
39
+ },
40
+ {
41
+ "name": "model-00001-of-00004.safetensors",
42
+ "sha256": "128a189c3e20c23b5199394b0c84f1dae226405f82081e5d559e3fb2c980b343",
43
+ "sizeBytes": 5118626596
44
+ },
45
+ {
46
+ "name": "model-00002-of-00004.safetensors",
47
+ "sha256": "a2097eb987352e665992af87edd101047e713a1f80cc34555254179033f00fe6",
48
+ "sizeBytes": 5291563052
49
+ },
50
+ {
51
+ "name": "model-00003-of-00004.safetensors",
52
+ "sha256": "1c77e0cb0d69884a9bb01e540fa43818c10f106bb447edbef5fe7a80b5a4f38b",
53
+ "sizeBytes": 5291563074
54
+ },
55
+ {
56
+ "name": "model-00004-of-00004.safetensors",
57
+ "sha256": "903b1ecdef13e3a80fe430a28143ffd4062337c6cd5e78ba9986a127fbd78a25",
58
+ "sizeBytes": 3931693211
59
+ },
60
+ {
61
+ "name": "model.safetensors.index.json",
62
+ "sha256": "09a169e3c52670cfe7ea95930139f17abed38144d2d220db5057e2e0ba000f13",
63
+ "sizeBytes": 191231
64
+ },
65
+ {
66
+ "name": "preprocessor_config.json",
67
+ "sha256": "e53c54889896ad6104a031f58831cf237e1416bfb16612d856213ce94a91df17",
68
+ "sizeBytes": 342
69
+ },
70
+ {
71
+ "name": "processor_config.json",
72
+ "sha256": "f7de807026c387af42011cc85058253b7cf39ddb5cb8cedf8927d7d2eb2c6ce7",
73
+ "sizeBytes": 743
74
+ },
75
+ {
76
+ "name": "special_tokens_map.json",
77
+ "sha256": "e3a4f63da745f02317a45e00e6476c17fc66ac41faf14bb1b0be1f3211b0ca53",
78
+ "sizeBytes": 420
79
+ },
80
+ {
81
+ "name": "tokenizer.json",
82
+ "sha256": "d0432ad8b1c2984a2e2dca82e1933e3fd5628df6e95c51fba4c3ee9950dce299",
83
+ "sizeBytes": 17077366
84
+ },
85
+ {
86
+ "name": "tokenizer_config.json",
87
+ "sha256": "1293fc27661bc2989b8c3b42db6ffbdfad87e35144b9b686eab2538b4c56c60e",
88
+ "sizeBytes": 582
89
+ }
90
+ ]
91
+ },
92
+ "minGezelVersion": "1.26227"
93
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "nemotron3-super-120b-q4",
5
5
  "name": "Nemotron-3 Super (120B-A12B)",
6
- "description": "NVIDIA's flagship Nemotron-3 Super 120B-parameter hybrid Mamba/Transformer Mixture-of-Experts (~12B active per token). Native function-calling, 128K context. Frontier-tier on-device reasoning for workstations and Mac Studio-class hardware — needs ~100GB of usable memory for Q4_K_M. MLX path is held until mlx-community publishes a build that doesn't require trust_remote_code; for now this is llama-only.",
6
+ "description": "NVIDIA's flagship Nemotron-3 Super at 120B parameters, tuned for reasoning. Native tool calling, 128K context. Frontier-tier on-device reasoning for workstations and Mac Studio-class hardware — needs ~100GB of usable memory. No Apple Silicon build yet.",
7
7
  "tags": [
8
8
  "nvidia",
9
9
  "reasoning",
@@ -17,8 +17,8 @@
17
17
  "name": "NVIDIA",
18
18
  "url": "https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16"
19
19
  },
20
- "version": "1.0.0",
21
- "updatedAt": "2026-05-17T00:00:00Z",
20
+ "version": "1.0.1",
21
+ "updatedAt": "2026-08-15T00:00:00Z",
22
22
  "license": "NVIDIA Open Model License",
23
23
  "licenseClass": "custom-restricted",
24
24
  "licenseShortName": "NVIDIA Open Model",
@@ -0,0 +1,30 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 86051079584,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "lmstudio-community/NVIDIA-Nemotron-3-Super-120B-A12B-GGUF",
8
+ "revision": "16410500b9bdc62081c34cc2dff52471e001f970",
9
+ "shards": [
10
+ {
11
+ "name": "NVIDIA-Nemotron-3-Super-120B-A12B-Q4_K_M-00001-of-00003.gguf",
12
+ "sha256": "2cf8e99b9b71babc5932eb594b1fe1f9b9e407a460a5b49b0625f0c25e0ba799",
13
+ "sizeBytes": 39205633408
14
+ },
15
+ {
16
+ "name": "NVIDIA-Nemotron-3-Super-120B-A12B-Q4_K_M-00002-of-00003.gguf",
17
+ "sha256": "770b505e6fe3b19b422b5b0dd06201b07218d0af99e72e69086208983fe54219",
18
+ "sizeBytes": 39720681760
19
+ },
20
+ {
21
+ "name": "NVIDIA-Nemotron-3-Super-120B-A12B-Q4_K_M-00003-of-00003.gguf",
22
+ "sha256": "7420107ccfc77230deaf57971ae84a58a18c4e6e035aa99cf0e25fbbc4c7614a",
23
+ "sizeBytes": 7124764416
24
+ }
25
+ ],
26
+ "approxSizeBytes": 86051079584,
27
+ "quantization": "Q4_K_M"
28
+ },
29
+ "minGezelVersion": "1.26227"
30
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "nemotron3.5-lightning-30b-q4",
5
5
  "name": "Nemotron 3.5 Lightning (30B-A3B, Q4)",
6
- "description": "NVIDIA's Nemotron 3.5 Lightning a text-only 30B-parameter hybrid Mamba-2/Transformer Mixture-of-Experts model with about 3B active parameters per token, native reasoning and tool calling, and a 256K context window. The llama.cpp source is ggml-org's Q4_K_M build (about 25.4GB); Apple Silicon uses mlx-community's matching 4-bit affine conversion (about 17.8GB).",
6
+ "description": "NVIDIA's Nemotron 3.5 Lightning at 30B parameters text-only, with native reasoning, native tool calling, and a 256K context window. Capable-tier on-device option: about 25GB of memory on most machines, about 18GB on Apple Silicon.",
7
7
  "tags": [
8
8
  "nvidia",
9
9
  "reasoning",
@@ -22,8 +22,8 @@
22
22
  "name": "NVIDIA",
23
23
  "url": "https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16"
24
24
  },
25
- "version": "1.0.0",
26
- "updatedAt": "2026-08-11T00:00:00Z",
25
+ "version": "1.0.1",
26
+ "updatedAt": "2026-08-15T00:00:00Z",
27
27
  "minGezelVersion": "1.26223",
28
28
  "license": "OpenMDW-1.1",
29
29
  "licenseClass": "open",
@@ -129,8 +129,7 @@
129
129
  "filename": "NVIDIA-Nemotron-3.5-Lightning-30B-A3B-Q4_K_M.gguf",
130
130
  "sha256": "6110e2e2e6cd324e6ee69ddced5a6b34fad6c94ca9827222a1e420fb92e3c90b",
131
131
  "approxSizeBytes": 25430738944,
132
- "quantization": "Q4_K_M",
133
- "residentBytes": 30516886733
132
+ "quantization": "Q4_K_M"
134
133
  },
135
134
  "mlx": {
136
135
  "huggingfaceRepo": "mlx-community/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-4bit",
@@ -188,7 +187,6 @@
188
187
  "sha256": "ec380f0a6c0c2e294eb2435f5ec521fb2121cfc970e6ebf023d06829714a4eaa",
189
188
  "sizeBytes": 430
190
189
  }
191
- ],
192
- "residentBytes": 23130356200
190
+ ]
193
191
  }
194
192
  }