llama_cpp 0.28.0 → 0.28.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
checksums.yaml CHANGED
@@ -1,7 +1,7 @@
1
1
  ---
2
2
  SHA256:
3
- metadata.gz: 002371b1977caa3b67be951da5098f478c540b0b85c02e49e0263579626e983b
4
- data.tar.gz: da1b91e34d7c494f3a4661b85a3c6bda909389b9c40a223aac9675330619132e
3
+ metadata.gz: 53c9355352c9ef5fe64fd761f0ac33ff4966a92e753fa1a60a8c477b2e0f7194
4
+ data.tar.gz: 391826211e106323b684a38ea67bd7c446f8fec5eb1b3f0af02ff110298baf76
5
5
  SHA512:
6
- metadata.gz: 53a2f89d9dbc2e3fe73de60dcd8c09218f9c4b7e49c89916619d74df3b7c245cd0252a3aead4f5caf918e86b21da5eb7a2630a56fe40a2fb6f01567b2a11bc92
7
- data.tar.gz: 3f784cd9cfd6fa24d26ceafd643013b8b70e5c5610366719bea147f62d3febfee24b54ad1099027f279454f8ced4d0b8d0fd0859b54175a2222e311786898f00
6
+ metadata.gz: acd2678b5e508a86909561ae9f7440710e516fa9d241bb746771c990d034dbac31a3de95813b9876861a4459f824c6f4ea89399cbe7c7dc6e6bf8d9ad3a20fac
7
+ data.tar.gz: 05717ebcd77750c112ce1f77edfb2906846f12e0e8b321488e271737c858f3fa7c576da6675bd851cc2ec5af24fd26f35596fe24bb7aae6303e3d2cf05c0cb8d
data/CHANGELOG.md CHANGED
@@ -1,8 +1,16 @@
1
+ ## [[0.28.1](https://github.com/yoshoku/llama_cpp.rb/compare/v0.28.0...v0.28.1)] - 2026-09-05
2
+
3
+ - Change supported llama.cpp version to v0.4.0.
4
+ - Add `LLAMA_LAZY_MODE_OFF` constant value.
5
+ - Add `LLAMA_LAZY_MODE_AUTO` constant value.
6
+ - Add `LLAMA_LAZY_MODE_ON` constant value.
7
+ - Add `max_buf_size` accessor to `LlamaModelQuantizeParams`.
8
+
1
9
  ## [[0.28.0](https://github.com/yoshoku/llama_cpp.rb/compare/v0.27.0...v0.28.0)] - 2026-08-23
2
10
 
3
11
  - Change supported llama.cpp version to v0.2.0.
4
12
  - Add `LLAMA_LOAD_MODE_AUTO` constant value.
5
- - Add `n_outputs_max_per_seq accessor` to `LlamaContextParams`.
13
+ - Add `n_outputs_max_per_seq` accessor to `LlamaContextParams`.
6
14
  - Add `llama_version` module function to `LlamaCpp`.
7
15
  - Add `llama_sampler_copy` module function to `LlamaCpp`.
8
16
 
@@ -1153,6 +1153,17 @@ static VALUE llama_model_quantize_params_set_dry_run(VALUE self, VALUE dry_run)
1153
1153
  return dry_run;
1154
1154
  }
1155
1155
 
1156
+ static VALUE llama_model_quantize_params_get_max_buf_size(VALUE self) {
1157
+ llama_model_quantize_params* data = get_llama_model_quantize_params(self);
1158
+ return SIZET2NUM(data->max_buf_size);
1159
+ }
1160
+
1161
+ static VALUE llama_model_quantize_params_set_max_buf_size(VALUE self, VALUE max_buf_size) {
1162
+ llama_model_quantize_params* data = get_llama_model_quantize_params(self);
1163
+ data->max_buf_size = NUM2SIZET(max_buf_size);
1164
+ return max_buf_size;
1165
+ }
1166
+
1156
1167
  /* llama_logit_bias */
1157
1168
  static void llama_logit_bias_free(void *ptr) {
1158
1169
  if (ptr) {
@@ -4583,6 +4594,11 @@ void Init_llama_cpp(void) {
4583
4594
  rb_define_const(rb_mLlamaCpp, "LLAMA_LOAD_MODE_MLOCK", INT2NUM(LLAMA_LOAD_MODE_MLOCK));
4584
4595
  rb_define_const(rb_mLlamaCpp, "LLAMA_LOAD_MODE_MMAP_MLOCK", INT2NUM(LLAMA_LOAD_MODE_MMAP_MLOCK));
4585
4596
  rb_define_const(rb_mLlamaCpp, "LLAMA_LOAD_MODE_DIRECT_IO", INT2NUM(LLAMA_LOAD_MODE_DIRECT_IO));
4597
+ /* llama_lazy_mode */
4598
+ /* Document-const: LlamaCpp::LLAMA_LAZY_MODE_OFF */
4599
+ rb_define_const(rb_mLlamaCpp, "LLAMA_LAZY_MODE_OFF", INT2NUM(LLAMA_LAZY_MODE_OFF));
4600
+ rb_define_const(rb_mLlamaCpp, "LLAMA_LAZY_MODE_AUTO", INT2NUM(LLAMA_LAZY_MODE_AUTO));
4601
+ rb_define_const(rb_mLlamaCpp, "LLAMA_LAZY_MODE_ON", INT2NUM(LLAMA_LAZY_MODE_ON));
4586
4602
  /* llama_context_type */
4587
4603
  /* Document-const: LlamaCpp::LLAMA_CONTEXT_TYPE_DEFAULT */
4588
4604
  rb_define_const(rb_mLlamaCpp, "LLAMA_CONTEXT_TYPE_DEFAULT", INT2NUM(LLAMA_CONTEXT_TYPE_DEFAULT));
@@ -5352,6 +5368,17 @@ void Init_llama_cpp(void) {
5352
5368
  /* TODO: const struct llama_model_kv_override* kv_overrides */
5353
5369
  /* TODO: const struct llama_model_tensor_override* tt_overrides */
5354
5370
  /* TODO: const int32_t* prune_layers */
5371
+ /**
5372
+ * Document-method: max_buf_size
5373
+ * @return [Integer]
5374
+ */
5375
+ rb_define_method(rb_cLlamaModelQuantizeParams, "max_buf_size", RUBY_METHOD_FUNC(llama_model_quantize_params_get_max_buf_size), 0);
5376
+ /**
5377
+ * Document-method: max_buf_size=
5378
+ * @param [Integer] max_buf_size
5379
+ * @return [Integer]
5380
+ */
5381
+ rb_define_method(rb_cLlamaModelQuantizeParams, "max_buf_size=", RUBY_METHOD_FUNC(llama_model_quantize_params_set_max_buf_size), 1);
5355
5382
 
5356
5383
  /**
5357
5384
  * Document-class: LlamaCpp::LlamaLogitBias
@@ -3,8 +3,8 @@
3
3
  # llama_cpp.rb provides Ruby bindings for the llama.cpp.
4
4
  module LlamaCpp
5
5
  # The version of llama_cpp.rb you install.
6
- VERSION = '0.28.0'
6
+ VERSION = '0.28.1'
7
7
 
8
8
  # The supported version of llama.cpp.
9
- LLAMA_CPP_VERSION = 'v0.2.0'
9
+ LLAMA_CPP_VERSION = 'v0.4.0'
10
10
  end
metadata CHANGED
@@ -1,7 +1,7 @@
1
1
  --- !ruby/object:Gem::Specification
2
2
  name: llama_cpp
3
3
  version: !ruby/object:Gem::Version
4
- version: 0.28.0
4
+ version: 0.28.1
5
5
  platform: ruby
6
6
  authors:
7
7
  - yoshoku
@@ -33,7 +33,7 @@ metadata:
33
33
  homepage_uri: https://github.com/yoshoku/llama_cpp.rb
34
34
  source_code_uri: https://github.com/yoshoku/llama_cpp.rb
35
35
  changelog_uri: https://github.com/yoshoku/llama_cpp.rb/blob/main/CHANGELOG.md
36
- documentation_uri: https://gemdocs.org/gems/llama_cpp/0.28.0/
36
+ documentation_uri: https://gemdocs.org/gems/llama_cpp/0.28.1/
37
37
  rubygems_mfa_required: 'true'
38
38
  rdoc_options: []
39
39
  require_paths: