@bendyline/gilde 0.1.30 → 0.1.31

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (121) hide show
  1. package/authoring/chat-models/btl4-35b-q4.json +4 -5
  2. package/authoring/chat-models/btl4-compact-iq2.json +4 -5
  3. package/authoring/chat-models/deepseek-r1-8b-q4.json +2 -2
  4. package/authoring/chat-models/gemma4-12b-q4.json +2 -3
  5. package/authoring/chat-models/gemma4-12b-q8.json +2 -3
  6. package/authoring/chat-models/gemma4-26b-q4.json +2 -3
  7. package/authoring/chat-models/gemma4-31b-q4.json +2 -3
  8. package/authoring/chat-models/gemma4-e2b-q4.json +2 -3
  9. package/authoring/chat-models/gemma4-e4b-q4.json +2 -3
  10. package/authoring/chat-models/gpt-oss-20b-q4.json +2 -2
  11. package/authoring/chat-models/laguna-s-2.1-118b-q4.json +4 -6
  12. package/authoring/chat-models/laguna-s-2.1-118b-q6.json +3 -4
  13. package/authoring/chat-models/laguna-s-2.1-118b-q8.json +4 -6
  14. package/authoring/chat-models/lfm2.5-2.6b-q4.json +2 -2
  15. package/authoring/chat-models/llama3.2-3b-q4.json +2 -2
  16. package/authoring/chat-models/mistral-7b-q4.json +2 -2
  17. package/authoring/chat-models/mistral-medium-3.5-128b-q4.json +2 -2
  18. package/authoring/chat-models/muse-glimmer-30b-q4.json +4 -5
  19. package/authoring/chat-models/nemotron3-nano-30b-q4.json +3 -3
  20. package/authoring/chat-models/nemotron3-super-120b-q4.json +3 -3
  21. package/authoring/chat-models/nemotron3.5-lightning-30b-q4.json +5 -7
  22. package/authoring/chat-models/nemotron3.5-lightning-30b-q8.json +5 -7
  23. package/authoring/chat-models/ornith-35b-q4.json +5 -7
  24. package/authoring/chat-models/ornith-35b-q8.json +5 -7
  25. package/authoring/chat-models/ornith-9b-q4.json +5 -7
  26. package/authoring/chat-models/qwen3.5-122b-a10b-q4.json +3 -5
  27. package/authoring/chat-models/qwen3.5-2b-q4.json +3 -4
  28. package/authoring/chat-models/qwen3.5-4b-q4.json +3 -4
  29. package/authoring/chat-models/qwen3.5-9b-q4.json +3 -4
  30. package/authoring/chat-models/qwen3.6-27b-q4.json +3 -4
  31. package/authoring/chat-models/qwen3.6-27b-q8.json +3 -4
  32. package/authoring/chat-models/qwen3.6-35b-a3b-q4.json +3 -4
  33. package/authoring/chat-models/qwen3.6-35b-a3b-q8.json +3 -4
  34. package/authoring/chat-models/qwen3.8-27b-q4.json +11 -2
  35. package/authoring/chat-models/qwen3.8-27b-q6.json +190 -0
  36. package/authoring/chat-models/qwen3.8-27b-q8.json +1 -2
  37. package/authoring/chat-models/talkie-1930-13b-q4.json +3 -4
  38. package/authoring/chat-models/ternary-bonsai-27b-q2.json +3 -4
  39. package/data/chat-models/bt/btl4-35b-q4/manifest.json +4 -5
  40. package/data/chat-models/bt/btl4-35b-q4/versions/1.0.1/manifest.json +15 -0
  41. package/data/chat-models/bt/btl4-compact-iq2/manifest.json +4 -5
  42. package/data/chat-models/bt/btl4-compact-iq2/versions/1.0.2/manifest.json +15 -0
  43. package/data/chat-models/de/deepseek-r1-8b-q4/manifest.json +4 -6
  44. package/data/chat-models/de/deepseek-r1-8b-q4/versions/1.1.1/manifest.json +61 -0
  45. package/data/chat-models/ge/gemma4-12b-q4/manifest.json +2 -3
  46. package/data/chat-models/ge/gemma4-12b-q4/versions/1.1.3/manifest.json +78 -0
  47. package/data/chat-models/ge/gemma4-12b-q8/manifest.json +2 -3
  48. package/data/chat-models/ge/gemma4-12b-q8/versions/1.0.3/manifest.json +78 -0
  49. package/data/chat-models/ge/gemma4-26b-q4/manifest.json +2 -3
  50. package/data/chat-models/ge/gemma4-26b-q4/versions/1.2.2/manifest.json +80 -0
  51. package/data/chat-models/ge/gemma4-31b-q4/manifest.json +2 -3
  52. package/data/chat-models/ge/gemma4-31b-q4/versions/1.2.2/manifest.json +95 -0
  53. package/data/chat-models/ge/gemma4-e2b-q4/manifest.json +2 -3
  54. package/data/chat-models/ge/gemma4-e2b-q4/versions/1.2.1/manifest.json +71 -0
  55. package/data/chat-models/ge/gemma4-e4b-q4/manifest.json +2 -3
  56. package/data/chat-models/ge/gemma4-e4b-q4/versions/1.2.1/manifest.json +76 -0
  57. package/data/chat-models/gp/gpt-oss-20b-q4/manifest.json +4 -6
  58. package/data/chat-models/gp/gpt-oss-20b-q4/versions/1.1.1/manifest.json +71 -0
  59. package/data/chat-models/index.json +1 -1
  60. package/data/chat-models/la/laguna-s-2.1-118b-q4/manifest.json +4 -6
  61. package/data/chat-models/la/laguna-s-2.1-118b-q4/versions/1.0.2/manifest.json +123 -0
  62. package/data/chat-models/la/laguna-s-2.1-118b-q6/manifest.json +3 -4
  63. package/data/chat-models/la/laguna-s-2.1-118b-q6/versions/1.0.1/manifest.json +145 -0
  64. package/data/chat-models/la/laguna-s-2.1-118b-q8/manifest.json +4 -6
  65. package/data/chat-models/la/laguna-s-2.1-118b-q8/versions/1.0.2/manifest.json +173 -0
  66. package/data/chat-models/lf/lfm2.5-2.6b-q4/manifest.json +4 -6
  67. package/data/chat-models/lf/lfm2.5-2.6b-q4/versions/1.0.1/manifest.json +58 -0
  68. package/data/chat-models/ll/llama3.2-3b-q4/manifest.json +4 -6
  69. package/data/chat-models/ll/llama3.2-3b-q4/versions/1.1.1/manifest.json +56 -0
  70. package/data/chat-models/mi/mistral-7b-q4/manifest.json +4 -6
  71. package/data/chat-models/mi/mistral-7b-q4/versions/1.1.1/manifest.json +61 -0
  72. package/data/chat-models/mi/mistral-medium-3.5-128b-q4/manifest.json +2 -2
  73. package/data/chat-models/mi/mistral-medium-3.5-128b-q4/versions/1.0.1/manifest.json +153 -0
  74. package/data/chat-models/mu/muse-glimmer-30b-q4/manifest.json +4 -5
  75. package/data/chat-models/mu/muse-glimmer-30b-q4/versions/1.0.1/manifest.json +20 -0
  76. package/data/chat-models/ne/nemotron3-nano-30b-q4/manifest.json +3 -3
  77. package/data/chat-models/ne/nemotron3-nano-30b-q4/versions/1.0.1/manifest.json +94 -0
  78. package/data/chat-models/ne/nemotron3-nano-30b-q4/versions/1.0.2/manifest.json +93 -0
  79. package/data/chat-models/ne/nemotron3-super-120b-q4/manifest.json +3 -3
  80. package/data/chat-models/ne/nemotron3-super-120b-q4/versions/1.0.1/manifest.json +30 -0
  81. package/data/chat-models/ne/nemotron3.5-lightning-30b-q4/manifest.json +5 -7
  82. package/data/chat-models/ne/nemotron3.5-lightning-30b-q4/versions/1.0.1/manifest.json +73 -0
  83. package/data/chat-models/ne/nemotron3.5-lightning-30b-q8/manifest.json +5 -7
  84. package/data/chat-models/ne/nemotron3.5-lightning-30b-q8/versions/1.0.1/manifest.json +88 -0
  85. package/data/chat-models/or/ornith-35b-q4/manifest.json +5 -7
  86. package/data/chat-models/or/ornith-35b-q4/versions/1.0.1/manifest.json +93 -0
  87. package/data/chat-models/or/ornith-35b-q8/manifest.json +5 -7
  88. package/data/chat-models/or/ornith-35b-q8/versions/1.0.1/manifest.json +113 -0
  89. package/data/chat-models/or/ornith-9b-q4/manifest.json +5 -7
  90. package/data/chat-models/or/ornith-9b-q4/versions/1.0.1/manifest.json +83 -0
  91. package/data/chat-models/qw/qwen3.5-122b-a10b-q4/manifest.json +3 -5
  92. package/data/chat-models/qw/qwen3.5-122b-a10b-q4/versions/1.0.2/manifest.json +164 -0
  93. package/data/chat-models/qw/qwen3.5-122b-a10b-q4/versions/1.0.3/manifest.json +163 -0
  94. package/data/chat-models/qw/qwen3.5-2b-q4/manifest.json +3 -4
  95. package/data/chat-models/qw/qwen3.5-2b-q4/versions/1.1.3/manifest.json +76 -0
  96. package/data/chat-models/qw/qwen3.5-4b-q4/manifest.json +3 -4
  97. package/data/chat-models/qw/qwen3.5-4b-q4/versions/1.1.3/manifest.json +76 -0
  98. package/data/chat-models/qw/qwen3.5-9b-q4/manifest.json +3 -4
  99. package/data/chat-models/qw/qwen3.5-9b-q4/versions/1.1.3/manifest.json +81 -0
  100. package/data/chat-models/qw/qwen3.6-27b-q4/manifest.json +3 -4
  101. package/data/chat-models/qw/qwen3.6-27b-q4/versions/1.1.5/manifest.json +91 -0
  102. package/data/chat-models/qw/qwen3.6-27b-q8/manifest.json +3 -4
  103. package/data/chat-models/qw/qwen3.6-27b-q8/versions/1.0.3/manifest.json +103 -0
  104. package/data/chat-models/qw/qwen3.6-35b-a3b-q4/manifest.json +3 -4
  105. package/data/chat-models/qw/qwen3.6-35b-a3b-q4/versions/1.0.2/manifest.json +93 -0
  106. package/data/chat-models/qw/qwen3.6-35b-a3b-q8/manifest.json +3 -4
  107. package/data/chat-models/qw/qwen3.6-35b-a3b-q8/versions/1.0.2/manifest.json +113 -0
  108. package/data/chat-models/qw/qwen3.8-27b-q4/manifest.json +11 -2
  109. package/data/chat-models/qw/qwen3.8-27b-q6/manifest.json +195 -0
  110. package/data/chat-models/qw/qwen3.8-27b-q6/versions/1.0.0/manifest.json +20 -0
  111. package/data/chat-models/qw/qwen3.8-27b-q8/manifest.json +1 -2
  112. package/data/chat-models/qw/qwen3.8-27b-q8/versions/1.0.1/manifest.json +113 -0
  113. package/data/chat-models/ta/talkie-1930-13b-q4/manifest.json +3 -4
  114. package/data/chat-models/ta/talkie-1930-13b-q4/versions/1.0.1/manifest.json +15 -0
  115. package/data/chat-models/te/ternary-bonsai-27b-q2/manifest.json +3 -4
  116. package/data/chat-models/te/ternary-bonsai-27b-q2/versions/1.0.1/manifest.json +70 -0
  117. package/data/gezel-templates/bu/builder/manifest.json +1 -1
  118. package/data/gezel-templates/bu/builder/versions/1.4.0/about.md +34 -0
  119. package/data/gezel-templates/bu/builder/versions/1.4.0/manifest.json +9 -0
  120. package/data/gezel-templates/index.json +1 -1
  121. package/package.json +1 -1
@@ -0,0 +1,73 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 25430738944,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "ggml-org/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF",
8
+ "revision": "88d7ce0b0fa385c5108866ce5d33690927531a37",
9
+ "filename": "NVIDIA-Nemotron-3.5-Lightning-30B-A3B-Q4_K_M.gguf",
10
+ "sha256": "6110e2e2e6cd324e6ee69ddced5a6b34fad6c94ca9827222a1e420fb92e3c90b",
11
+ "approxSizeBytes": 25430738944,
12
+ "quantization": "Q4_K_M"
13
+ },
14
+ "mlx": {
15
+ "huggingfaceRepo": "mlx-community/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-4bit",
16
+ "revision": "55ac8c89261109b36c04371cd3f479a4594208c8",
17
+ "quantization": "4bit",
18
+ "approxSizeBytes": 17792581692,
19
+ "files": [
20
+ {
21
+ "name": "chat_template.jinja",
22
+ "sha256": "58933db77d3099b4f78c55a38347a72e1ea05b97d6bd8f38775303dc0194e0a9",
23
+ "sizeBytes": 9867
24
+ },
25
+ {
26
+ "name": "config.json",
27
+ "sha256": "2d4bdc543efd8ccd68fccbf1231b1d1216ab2a0482229ea5638d448127973b27",
28
+ "sizeBytes": 2932
29
+ },
30
+ {
31
+ "name": "generation_config.json",
32
+ "sha256": "0ed94823ae737b507aef6af01e837041b7aa2fb0306793a310cd201d89a31ff4",
33
+ "sizeBytes": 210
34
+ },
35
+ {
36
+ "name": "model-00001-of-00004.safetensors",
37
+ "sha256": "12e2ba8a7f0990b7e34ddb25cf4043fe39b105215fe61a0b7dc1447be6b247b3",
38
+ "sizeBytes": 5118631442
39
+ },
40
+ {
41
+ "name": "model-00002-of-00004.safetensors",
42
+ "sha256": "a095b11193a9d58e2c67c83bc2aff0eedde8f76b77ff8ee4781fe08f6c3f5363",
43
+ "sizeBytes": 5291568433
44
+ },
45
+ {
46
+ "name": "model-00003-of-00004.safetensors",
47
+ "sha256": "c55808e0cf33a6b957d34ab57caf4185c4aed49c6ef15c7c69683e7af7e892cc",
48
+ "sizeBytes": 5291568429
49
+ },
50
+ {
51
+ "name": "model-00004-of-00004.safetensors",
52
+ "sha256": "9c541daef892060fffb831afb9e20251ff18c492df7bacd0bfee4d8e43124d89",
53
+ "sizeBytes": 2073657055
54
+ },
55
+ {
56
+ "name": "model.safetensors.index.json",
57
+ "sha256": "4c12ae32746441ec65e94d8cf312462ac10ab0d3c80513bba3d1c1ca3f2ed9ca",
58
+ "sizeBytes": 65410
59
+ },
60
+ {
61
+ "name": "tokenizer.json",
62
+ "sha256": "623c34567aebb18582765289fbe23d901c62704d6518d71866e0e58db892b5b7",
63
+ "sizeBytes": 17077484
64
+ },
65
+ {
66
+ "name": "tokenizer_config.json",
67
+ "sha256": "ec380f0a6c0c2e294eb2435f5ec521fb2121cfc970e6ebf023d06829714a4eaa",
68
+ "sizeBytes": 430
69
+ }
70
+ ]
71
+ },
72
+ "minGezelVersion": "1.26227"
73
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "nemotron3.5-lightning-30b-q8",
5
5
  "name": "Nemotron 3.5 Lightning (30B-A3B, Q8)",
6
- "description": "NVIDIA's Nemotron 3.5 Lightning a text-only 30B-parameter hybrid Mamba-2/Transformer Mixture-of-Experts model with about 3B active parameters per token, native reasoning and tool calling, and a 256K context window. This higher-fidelity variant uses ggml-org's Q8_0 llama.cpp build (about 35GB) or mlx-community's matching 8-bit affine conversion (about 33.6GB).",
6
+ "description": "NVIDIA's Nemotron 3.5 Lightning at 30B parameters text-only, with native reasoning, native tool calling, and a 256K context window. 8-bit quantization for higher fidelity than the Q4 build, at roughly a third more memory (about 35GB, or 34GB on Apple Silicon).",
7
7
  "tags": [
8
8
  "nvidia",
9
9
  "reasoning",
@@ -22,8 +22,8 @@
22
22
  "name": "NVIDIA",
23
23
  "url": "https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16"
24
24
  },
25
- "version": "1.0.0",
26
- "updatedAt": "2026-08-11T00:00:00Z",
25
+ "version": "1.0.1",
26
+ "updatedAt": "2026-08-15T00:00:00Z",
27
27
  "minGezelVersion": "1.26223",
28
28
  "license": "OpenMDW-1.1",
29
29
  "licenseClass": "open",
@@ -129,8 +129,7 @@
129
129
  "filename": "NVIDIA-Nemotron-3.5-Lightning-30B-A3B-Q8_0.gguf",
130
130
  "sha256": "8544826247d087745baf4e7540f6911608a61caba7a16702314946af5e4235ae",
131
131
  "approxSizeBytes": 35004642304,
132
- "quantization": "Q8_0",
133
- "residentBytes": 42005570765
132
+ "quantization": "Q8_0"
134
133
  },
135
134
  "mlx": {
136
135
  "huggingfaceRepo": "mlx-community/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-8bit",
@@ -203,7 +202,6 @@
203
202
  "sha256": "ec380f0a6c0c2e294eb2435f5ec521fb2121cfc970e6ebf023d06829714a4eaa",
204
203
  "sizeBytes": 430
205
204
  }
206
- ],
207
- "residentBytes": 43650255848
205
+ ]
208
206
  }
209
207
  }
@@ -0,0 +1,88 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 35004642304,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "ggml-org/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF",
8
+ "revision": "88d7ce0b0fa385c5108866ce5d33690927531a37",
9
+ "filename": "NVIDIA-Nemotron-3.5-Lightning-30B-A3B-Q8_0.gguf",
10
+ "sha256": "8544826247d087745baf4e7540f6911608a61caba7a16702314946af5e4235ae",
11
+ "approxSizeBytes": 35004642304,
12
+ "quantization": "Q8_0"
13
+ },
14
+ "mlx": {
15
+ "huggingfaceRepo": "mlx-community/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-8bit",
16
+ "revision": "881a85f9e84dac5ab1a61d4493739b5ef67efeaa",
17
+ "quantization": "8bit",
18
+ "approxSizeBytes": 33577119883,
19
+ "files": [
20
+ {
21
+ "name": "chat_template.jinja",
22
+ "sha256": "58933db77d3099b4f78c55a38347a72e1ea05b97d6bd8f38775303dc0194e0a9",
23
+ "sizeBytes": 9867
24
+ },
25
+ {
26
+ "name": "config.json",
27
+ "sha256": "a1b0135c0973322d188a836c86746e69ea07c02b241e1f26681bf5123345359b",
28
+ "sizeBytes": 2932
29
+ },
30
+ {
31
+ "name": "generation_config.json",
32
+ "sha256": "0ed94823ae737b507aef6af01e837041b7aa2fb0306793a310cd201d89a31ff4",
33
+ "sizeBytes": 210
34
+ },
35
+ {
36
+ "name": "model-00001-of-00007.safetensors",
37
+ "sha256": "7ce9d0b7b01bb133ebf089a65dbcce23dcf35d73eb28dfa20b639a21e86711f3",
38
+ "sizeBytes": 5359226316
39
+ },
40
+ {
41
+ "name": "model-00002-of-00007.safetensors",
42
+ "sha256": "ad229b96564455b865364db16918a557d55f21199e4ff7a9d0e0952e56c5c9e0",
43
+ "sizeBytes": 5046688726
44
+ },
45
+ {
46
+ "name": "model-00003-of-00007.safetensors",
47
+ "sha256": "a2c01a7ae42cc9881768fc3f4c1820a86c00766f8f88f154fd17e32d10ed1a46",
48
+ "sizeBytes": 4963631598
49
+ },
50
+ {
51
+ "name": "model-00004-of-00007.safetensors",
52
+ "sha256": "f9afcd3cedfc7e107b7e199fea995d105ee2ad56929fd3dd017ce6dd24ea9f55",
53
+ "sizeBytes": 5051598289
54
+ },
55
+ {
56
+ "name": "model-00005-of-00007.safetensors",
57
+ "sha256": "bf8ef73665e3d894d5badd01cef18a99e7da7dcc3a21c52c80a298976499420c",
58
+ "sizeBytes": 4938766121
59
+ },
60
+ {
61
+ "name": "model-00006-of-00007.safetensors",
62
+ "sha256": "bbd2d487828c3e2434ca181673023a1489699a6739c2725250ac0c91d5eb1e17",
63
+ "sizeBytes": 5026732862
64
+ },
65
+ {
66
+ "name": "model-00007-of-00007.safetensors",
67
+ "sha256": "01b0ace9963a901962e9bbe492d66faa5a0ed47b09ade9da5529375694fa770e",
68
+ "sizeBytes": 3173319638
69
+ },
70
+ {
71
+ "name": "model.safetensors.index.json",
72
+ "sha256": "14f9c8d6ff717ea35d64585e4f723544aa0964d7492c10dbf2e27a1ee29a87e5",
73
+ "sizeBytes": 65410
74
+ },
75
+ {
76
+ "name": "tokenizer.json",
77
+ "sha256": "623c34567aebb18582765289fbe23d901c62704d6518d71866e0e58db892b5b7",
78
+ "sizeBytes": 17077484
79
+ },
80
+ {
81
+ "name": "tokenizer_config.json",
82
+ "sha256": "ec380f0a6c0c2e294eb2435f5ec521fb2121cfc970e6ebf023d06829714a4eaa",
83
+ "sizeBytes": 430
84
+ }
85
+ ]
86
+ },
87
+ "minGezelVersion": "1.26227"
88
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "ornith-35b-q4",
5
5
  "name": "Ornith 1.0 (35B, Q4)",
6
- "description": "DeepReinforce's Ornith 1.0 at 35B total parameters (Qwen 3.5 MoE architecture), an agentic-coding model trained with a self-improving reinforcement-learning framework state-of-the-art on SWE-Bench and Terminal-Bench. Native <think> reasoning, OpenAI-style tool calling, 256K context. Q4_K_M quantization for a ~21GB footprint. MIT licensed.",
6
+ "description": "DeepReinforce's Ornith 1.0 at 35B parameters an agentic-coding model built for hands-on software work: reading a codebase, running tools, and seeing a change through. Native reasoning, native tool calling, 256K context. Capable-tier on-device option for machines with 32GB+ memory. MIT licensed.",
7
7
  "tags": [
8
8
  "deepreinforce",
9
9
  "coding",
@@ -18,8 +18,8 @@
18
18
  "name": "DeepReinforce",
19
19
  "url": "https://huggingface.co/deepreinforce-ai"
20
20
  },
21
- "version": "1.0.0",
22
- "updatedAt": "2026-07-01T00:00:00Z",
21
+ "version": "1.0.1",
22
+ "updatedAt": "2026-08-15T00:00:00Z",
23
23
  "license": "MIT",
24
24
  "licenseClass": "open",
25
25
  "licenseShortName": "MIT",
@@ -141,8 +141,7 @@
141
141
  "filename": "ornith-1.0-35b-Q4_K_M.gguf",
142
142
  "sha256": "ff25291b2599fb927a835e624d2b3540106af61761c3fa57ac4264046dbec002",
143
143
  "approxSizeBytes": 21166757760,
144
- "quantization": "Q4_K_M",
145
- "residentBytes": 25400109312
144
+ "quantization": "Q4_K_M"
146
145
  },
147
146
  "mlx": {
148
147
  "huggingfaceRepo": "mlx-community/Ornith-1.0-35B-4bit",
@@ -220,7 +219,6 @@
220
219
  "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
221
220
  "sizeBytes": 6722759
222
221
  }
223
- ],
224
- "residentBytes": 26557921365
222
+ ]
225
223
  }
226
224
  }
@@ -0,0 +1,93 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 21200000000,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "deepreinforce-ai/Ornith-1.0-35B-GGUF",
8
+ "revision": "c2e1703039380de4ce6820e97afd185682d3c16c",
9
+ "filename": "ornith-1.0-35b-Q4_K_M.gguf",
10
+ "sha256": "ff25291b2599fb927a835e624d2b3540106af61761c3fa57ac4264046dbec002",
11
+ "approxSizeBytes": 21166757760,
12
+ "quantization": "Q4_K_M"
13
+ },
14
+ "mlx": {
15
+ "huggingfaceRepo": "mlx-community/Ornith-1.0-35B-4bit",
16
+ "revision": "781f91090809411b7fc07449817f398a99feb188",
17
+ "quantization": "4bit",
18
+ "approxSizeBytes": 20429166971,
19
+ "files": [
20
+ {
21
+ "name": "chat_template.jinja",
22
+ "sha256": "182e77dd83bd8e9ca818b240b82e28f243762cd5dda32e6eef327df7b1cd107e",
23
+ "sizeBytes": 7536
24
+ },
25
+ {
26
+ "name": "config.json",
27
+ "sha256": "550efce0158addbcab424cfc92bdaa297138a949bfc71c724918994b7b692d2f",
28
+ "sizeBytes": 24151
29
+ },
30
+ {
31
+ "name": "generation_config.json",
32
+ "sha256": "896eeba60a1195e034dc6b9a7bbddd64b6174992348f5dc7d75daaa93d0bdd45",
33
+ "sizeBytes": 213
34
+ },
35
+ {
36
+ "name": "model-00001-of-00004.safetensors",
37
+ "sha256": "2a34b0daa08c1decdeb817301ec4927bfdfa5e573559a3f541f73834383b21d0",
38
+ "sizeBytes": 5288196062
39
+ },
40
+ {
41
+ "name": "model-00002-of-00004.safetensors",
42
+ "sha256": "5eab94545fdddd6db8c6d8cd54a3481ba26f2d9fc6d48ee47ea94951c631680b",
43
+ "sizeBytes": 5368472657
44
+ },
45
+ {
46
+ "name": "model-00003-of-00004.safetensors",
47
+ "sha256": "8fc467f4036656f488afc86776757ad3cbd4910ab9031f84bb28c55768a904fb",
48
+ "sizeBytes": 5368324255
49
+ },
50
+ {
51
+ "name": "model-00004-of-00004.safetensors",
52
+ "sha256": "c700f3b3a89d613dfaf5b430f8e3b70e1aeb0e5b7ad4fe3aebf8c64e3644ce17",
53
+ "sizeBytes": 4377211327
54
+ },
55
+ {
56
+ "name": "model.safetensors.index.json",
57
+ "sha256": "0b28df60e33753a14e816d3b31577ae2c93884c58430a4a6de6ae9ea483842ea",
58
+ "sizeBytes": 215755
59
+ },
60
+ {
61
+ "name": "preprocessor_config.json",
62
+ "sha256": "27225450ac9c6529872ee1924fcb0962ff5634834f817040f444118116f4e516",
63
+ "sizeBytes": 390
64
+ },
65
+ {
66
+ "name": "processor_config.json",
67
+ "sha256": "45fc17c8dd2474af6b493b52483c26c0584b0082d368c480f9fa611e73070040",
68
+ "sizeBytes": 991
69
+ },
70
+ {
71
+ "name": "tokenizer.json",
72
+ "sha256": "06b9509352d2af50381ab2247e083b80d32d5c0aba91c272ca9ff729b6a0e523",
73
+ "sizeBytes": 19989325
74
+ },
75
+ {
76
+ "name": "tokenizer_config.json",
77
+ "sha256": "792fa3f0cb88b111e54ef3134c873531008c4df471d108da17903426e308aa7b",
78
+ "sizeBytes": 1165
79
+ },
80
+ {
81
+ "name": "video_preprocessor_config.json",
82
+ "sha256": "7768af27c1fafa9cc9011c1dc20067e03f8915e03b63504550e11d5066986d13",
83
+ "sizeBytes": 385
84
+ },
85
+ {
86
+ "name": "vocab.json",
87
+ "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
88
+ "sizeBytes": 6722759
89
+ }
90
+ ]
91
+ },
92
+ "minGezelVersion": "1.26227"
93
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "ornith-35b-q8",
5
5
  "name": "Ornith 1.0 (35B, Q8)",
6
- "description": "DeepReinforce's Ornith 1.0 at 35B total parameters (Qwen 3.5 MoE architecture), an agentic-coding model trained with a self-improving reinforcement-learning framework state-of-the-art on SWE-Bench and Terminal-Bench. Native <think> reasoning, OpenAI-style tool calling, 256K context. Q8_0 quantization for higher fidelity than the Q4 build, at roughly double the memory footprint (~37GB). MIT licensed.",
6
+ "description": "DeepReinforce's Ornith 1.0 at 35B parameters an agentic-coding model built for hands-on software work: reading a codebase, running tools, and seeing a change through. Native reasoning, native tool calling, 256K context. 8-bit quantization for higher fidelity than the Q4 build, at roughly double the memory footprint (~37GB). MIT licensed.",
7
7
  "tags": [
8
8
  "deepreinforce",
9
9
  "coding",
@@ -18,8 +18,8 @@
18
18
  "name": "DeepReinforce",
19
19
  "url": "https://huggingface.co/deepreinforce-ai"
20
20
  },
21
- "version": "1.0.0",
22
- "updatedAt": "2026-07-01T00:00:00Z",
21
+ "version": "1.0.1",
22
+ "updatedAt": "2026-08-15T00:00:00Z",
23
23
  "license": "MIT",
24
24
  "licenseClass": "open",
25
25
  "licenseShortName": "MIT",
@@ -141,8 +141,7 @@
141
141
  "filename": "ornith-1.0-35b-Q8_0.gguf",
142
142
  "sha256": "cbc992bca07901c1a51f33e65e6fc5d687de179c852a772dfd15e4c3261dbf5c",
143
143
  "approxSizeBytes": 36903138880,
144
- "quantization": "Q8_0",
145
- "residentBytes": 44283766656
144
+ "quantization": "Q8_0"
146
145
  },
147
146
  "mlx": {
148
147
  "huggingfaceRepo": "mlx-community/Ornith-1.0-35B-8bit",
@@ -240,7 +239,6 @@
240
239
  "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
241
240
  "sizeBytes": 6722759
242
241
  }
243
- ],
244
- "residentBytes": 49072879453
242
+ ]
245
243
  }
246
244
  }
@@ -0,0 +1,113 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 37000000000,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "deepreinforce-ai/Ornith-1.0-35B-GGUF",
8
+ "revision": "c2e1703039380de4ce6820e97afd185682d3c16c",
9
+ "filename": "ornith-1.0-35b-Q8_0.gguf",
10
+ "sha256": "cbc992bca07901c1a51f33e65e6fc5d687de179c852a772dfd15e4c3261dbf5c",
11
+ "approxSizeBytes": 36903138880,
12
+ "quantization": "Q8_0"
13
+ },
14
+ "mlx": {
15
+ "huggingfaceRepo": "mlx-community/Ornith-1.0-35B-8bit",
16
+ "revision": "28d10f45a04981989f5a2e53e38f6473e81e815a",
17
+ "quantization": "8bit",
18
+ "approxSizeBytes": 37748365526,
19
+ "files": [
20
+ {
21
+ "name": "chat_template.jinja",
22
+ "sha256": "182e77dd83bd8e9ca818b240b82e28f243762cd5dda32e6eef327df7b1cd107e",
23
+ "sizeBytes": 7536
24
+ },
25
+ {
26
+ "name": "config.json",
27
+ "sha256": "c1cfeef1ed8dc341d400c33d7a2a93b61d01b1a8b70bf8b8992550b09a5dfc07",
28
+ "sizeBytes": 24151
29
+ },
30
+ {
31
+ "name": "generation_config.json",
32
+ "sha256": "896eeba60a1195e034dc6b9a7bbddd64b6174992348f5dc7d75daaa93d0bdd45",
33
+ "sizeBytes": 213
34
+ },
35
+ {
36
+ "name": "model-00001-of-00008.safetensors",
37
+ "sha256": "356cbcbe9244d120e352782e7f8ab582f8a3125a0a82876c0bc43275b73ad217",
38
+ "sizeBytes": 5329916013
39
+ },
40
+ {
41
+ "name": "model-00002-of-00008.safetensors",
42
+ "sha256": "59f16e6cb8bce7a47a5c11458cac47307070c00984a0849e29f1873101f4e102",
43
+ "sizeBytes": 5365573922
44
+ },
45
+ {
46
+ "name": "model-00003-of-00008.safetensors",
47
+ "sha256": "449d965928a225fdb5f1d90e4ed0f718a3733dbe03ecc733d65daaf120fca526",
48
+ "sizeBytes": 5358684668
49
+ },
50
+ {
51
+ "name": "model-00004-of-00008.safetensors",
52
+ "sha256": "d6754fbc66cbc37c953843aeaf074546f8807860adc1ea7c067b3f747bd09f6c",
53
+ "sizeBytes": 5365574194
54
+ },
55
+ {
56
+ "name": "model-00005-of-00008.safetensors",
57
+ "sha256": "d4325c8eb40a2871674ca701340edecc7e753389a3c3ddb11365474a34cf7169",
58
+ "sizeBytes": 5358684644
59
+ },
60
+ {
61
+ "name": "model-00006-of-00008.safetensors",
62
+ "sha256": "43a4bd68352772825dfb79c0bd844031818994e953bbd1adb06f3dbb4d9b1e70",
63
+ "sizeBytes": 5365574174
64
+ },
65
+ {
66
+ "name": "model-00007-of-00008.safetensors",
67
+ "sha256": "1f6b3423dc7c560ae2ad43781b66ab92fe439cd684ab47be051c4bd45a0032b4",
68
+ "sizeBytes": 5037050574
69
+ },
70
+ {
71
+ "name": "model-00008-of-00008.safetensors",
72
+ "sha256": "259f82efaf13be9af40eb427d913a51c8bb340e57bfd8ea2b5cf629a5cb78de6",
73
+ "sizeBytes": 540344667
74
+ },
75
+ {
76
+ "name": "model.safetensors.index.json",
77
+ "sha256": "3db12edeebeb65cab9a6eeb63cd74be4e0c74139a75f672701290b98230501cf",
78
+ "sizeBytes": 215755
79
+ },
80
+ {
81
+ "name": "preprocessor_config.json",
82
+ "sha256": "27225450ac9c6529872ee1924fcb0962ff5634834f817040f444118116f4e516",
83
+ "sizeBytes": 390
84
+ },
85
+ {
86
+ "name": "processor_config.json",
87
+ "sha256": "45fc17c8dd2474af6b493b52483c26c0584b0082d368c480f9fa611e73070040",
88
+ "sizeBytes": 991
89
+ },
90
+ {
91
+ "name": "tokenizer.json",
92
+ "sha256": "06b9509352d2af50381ab2247e083b80d32d5c0aba91c272ca9ff729b6a0e523",
93
+ "sizeBytes": 19989325
94
+ },
95
+ {
96
+ "name": "tokenizer_config.json",
97
+ "sha256": "792fa3f0cb88b111e54ef3134c873531008c4df471d108da17903426e308aa7b",
98
+ "sizeBytes": 1165
99
+ },
100
+ {
101
+ "name": "video_preprocessor_config.json",
102
+ "sha256": "7768af27c1fafa9cc9011c1dc20067e03f8915e03b63504550e11d5066986d13",
103
+ "sizeBytes": 385
104
+ },
105
+ {
106
+ "name": "vocab.json",
107
+ "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
108
+ "sizeBytes": 6722759
109
+ }
110
+ ]
111
+ },
112
+ "minGezelVersion": "1.26227"
113
+ }
@@ -3,7 +3,7 @@
3
3
  "kind": "chat-model",
4
4
  "id": "ornith-9b-q4",
5
5
  "name": "Ornith 1.0 (9B)",
6
- "description": "DeepReinforce's Ornith 1.0 at 9B parameters (dense, built on Qwen 3.5 + Gemma 4), an agentic-coding model trained with a self-improving reinforcement-learning framework. Native <think> reasoning, OpenAI-style tool calling, 256K context. The small-tier pick for tool-heavy work on a 12GB+ inference budget. Q4_K_M quantization. MIT licensed.",
6
+ "description": "DeepReinforce's Ornith 1.0 at 9B parameters an agentic-coding model built for hands-on software work. Native reasoning, native tool calling, 256K context. The small-tier pick for tool-heavy work on a 12GB+ inference budget. MIT licensed.",
7
7
  "tags": [
8
8
  "deepreinforce",
9
9
  "coding",
@@ -17,8 +17,8 @@
17
17
  "name": "DeepReinforce",
18
18
  "url": "https://huggingface.co/deepreinforce-ai"
19
19
  },
20
- "version": "1.0.0",
21
- "updatedAt": "2026-07-01T00:00:00Z",
20
+ "version": "1.0.1",
21
+ "updatedAt": "2026-08-15T00:00:00Z",
22
22
  "license": "MIT",
23
23
  "licenseClass": "open",
24
24
  "licenseShortName": "MIT",
@@ -142,8 +142,7 @@
142
142
  "filename": "ornith-1.0-9b-Q4_K_M.gguf",
143
143
  "sha256": "5720d1f671b4996481274fffe01868c3c36e87c135cc8538471cc7bd6087b106",
144
144
  "approxSizeBytes": 5629108704,
145
- "quantization": "Q4_K_M",
146
- "residentBytes": 6754930445
145
+ "quantization": "Q4_K_M"
147
146
  },
148
147
  "mlx": {
149
148
  "huggingfaceRepo": "mlx-community/Ornith-1.0-9B-4bit",
@@ -211,7 +210,6 @@
211
210
  "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
212
211
  "sizeBytes": 6722759
213
212
  }
214
- ],
215
- "residentBytes": 7770193739
213
+ ]
216
214
  }
217
215
  }
@@ -0,0 +1,83 @@
1
+ {
2
+ "schemaVersion": 1,
3
+ "version": "1.0.1",
4
+ "releasedAt": "2026-08-15T00:00:00Z",
5
+ "approxSizeBytes": 5600000000,
6
+ "llamaCpp": {
7
+ "huggingfaceRepo": "deepreinforce-ai/Ornith-1.0-9B-GGUF",
8
+ "revision": "3296bc7a404871a72ac3f1903f561459c09b5c17",
9
+ "filename": "ornith-1.0-9b-Q4_K_M.gguf",
10
+ "sha256": "5720d1f671b4996481274fffe01868c3c36e87c135cc8538471cc7bd6087b106",
11
+ "approxSizeBytes": 5629108704,
12
+ "quantization": "Q4_K_M"
13
+ },
14
+ "mlx": {
15
+ "huggingfaceRepo": "mlx-community/Ornith-1.0-9B-4bit",
16
+ "revision": "1e980b9742a9e554a4d57e90b4c597811fb2fc4e",
17
+ "quantization": "4bit",
18
+ "approxSizeBytes": 5977069777,
19
+ "files": [
20
+ {
21
+ "name": "chat_template.jinja",
22
+ "sha256": "8b4d21a1e70ccbc8849e5e5e6dd32f3acfb2e2060739475909edc6e9b27c7165",
23
+ "sizeBytes": 7594
24
+ },
25
+ {
26
+ "name": "config.json",
27
+ "sha256": "e661291d14e6c4e239ae430d7a72ab1c947440ca89c94fc09be71ff0acb45c37",
28
+ "sizeBytes": 3876
29
+ },
30
+ {
31
+ "name": "generation_config.json",
32
+ "sha256": "be19d3c48cd249efd6e0327b69916caae8279007dd14c0aad86f7b6b28c5d148",
33
+ "sizeBytes": 137
34
+ },
35
+ {
36
+ "name": "model-00001-of-00002.safetensors",
37
+ "sha256": "60e62b00a2ff10d793aed5fe7efc40137e46c9d4028b14c84f1d170eef964beb",
38
+ "sizeBytes": 5349769710
39
+ },
40
+ {
41
+ "name": "model-00002-of-00002.safetensors",
42
+ "sha256": "736da49643bb8c64fa081f2415ce624f40e983be1fc590ad30e65af75cdd5a5a",
43
+ "sizeBytes": 600449850
44
+ },
45
+ {
46
+ "name": "model.safetensors.index.json",
47
+ "sha256": "4518e4d98baed265cb25c5adb45839d5b69e0b9700f4bd573533392097bbb874",
48
+ "sizeBytes": 123592
49
+ },
50
+ {
51
+ "name": "preprocessor_config.json",
52
+ "sha256": "27225450ac9c6529872ee1924fcb0962ff5634834f817040f444118116f4e516",
53
+ "sizeBytes": 390
54
+ },
55
+ {
56
+ "name": "processor_config.json",
57
+ "sha256": "45fc17c8dd2474af6b493b52483c26c0584b0082d368c480f9fa611e73070040",
58
+ "sizeBytes": 991
59
+ },
60
+ {
61
+ "name": "tokenizer.json",
62
+ "sha256": "06b9509352d2af50381ab2247e083b80d32d5c0aba91c272ca9ff729b6a0e523",
63
+ "sizeBytes": 19989325
64
+ },
65
+ {
66
+ "name": "tokenizer_config.json",
67
+ "sha256": "c908cd42c5e6eac721445fb70841e45845a6a269c6ef2c595e97a578a9724671",
68
+ "sizeBytes": 1168
69
+ },
70
+ {
71
+ "name": "video_preprocessor_config.json",
72
+ "sha256": "7768af27c1fafa9cc9011c1dc20067e03f8915e03b63504550e11d5066986d13",
73
+ "sizeBytes": 385
74
+ },
75
+ {
76
+ "name": "vocab.json",
77
+ "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
78
+ "sizeBytes": 6722759
79
+ }
80
+ ]
81
+ },
82
+ "minGezelVersion": "1.26227"
83
+ }
@@ -20,8 +20,8 @@
20
20
  "name": "Alibaba",
21
21
  "url": "https://huggingface.co/Qwen/Qwen3.5-122B-A10B"
22
22
  },
23
- "version": "1.0.1",
24
- "updatedAt": "2026-07-28T00:00:00Z",
23
+ "version": "1.0.3",
24
+ "updatedAt": "2026-08-15T00:00:00Z",
25
25
  "license": "Apache-2.0",
26
26
  "licenseClass": "open",
27
27
  "licenseShortName": "Apache 2.0",
@@ -178,7 +178,6 @@
178
178
  ],
179
179
  "approxSizeBytes": 78260403200,
180
180
  "quantization": "UD-Q4_K_M",
181
- "residentBytes": 93912483840,
182
181
  "mmproj": {
183
182
  "filename": "mmproj-BF16.gguf",
184
183
  "sha256": "8f2442758a6f5a2bbfbbddb4b160b08ff4e29c3a76cad7627a0fe2beca2325e6",
@@ -311,7 +310,6 @@
311
310
  "sha256": "ce99b4cb2983d118806ce0a8b777a35b093e2000a503ebde25853284c9dfa003",
312
311
  "sizeBytes": 6722759
313
312
  }
314
- ],
315
- "residentBytes": 90506802715
313
+ ]
316
314
  }
317
315
  }