llama_cpp 0.28.0 → 0.28.1
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- checksums.yaml +4 -4
- data/CHANGELOG.md +9 -1
- data/ext/llama_cpp/llama_cpp.c +27 -0
- data/lib/llama_cpp/version.rb +2 -2
- metadata +2 -2
checksums.yaml
CHANGED
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
---
|
|
2
2
|
SHA256:
|
|
3
|
-
metadata.gz:
|
|
4
|
-
data.tar.gz:
|
|
3
|
+
metadata.gz: 53c9355352c9ef5fe64fd761f0ac33ff4966a92e753fa1a60a8c477b2e0f7194
|
|
4
|
+
data.tar.gz: 391826211e106323b684a38ea67bd7c446f8fec5eb1b3f0af02ff110298baf76
|
|
5
5
|
SHA512:
|
|
6
|
-
metadata.gz:
|
|
7
|
-
data.tar.gz:
|
|
6
|
+
metadata.gz: acd2678b5e508a86909561ae9f7440710e516fa9d241bb746771c990d034dbac31a3de95813b9876861a4459f824c6f4ea89399cbe7c7dc6e6bf8d9ad3a20fac
|
|
7
|
+
data.tar.gz: 05717ebcd77750c112ce1f77edfb2906846f12e0e8b321488e271737c858f3fa7c576da6675bd851cc2ec5af24fd26f35596fe24bb7aae6303e3d2cf05c0cb8d
|
data/CHANGELOG.md
CHANGED
|
@@ -1,8 +1,16 @@
|
|
|
1
|
+
## [[0.28.1](https://github.com/yoshoku/llama_cpp.rb/compare/v0.28.0...v0.28.1)] - 2026-09-05
|
|
2
|
+
|
|
3
|
+
- Change supported llama.cpp version to v0.4.0.
|
|
4
|
+
- Add `LLAMA_LAZY_MODE_OFF` constant value.
|
|
5
|
+
- Add `LLAMA_LAZY_MODE_AUTO` constant value.
|
|
6
|
+
- Add `LLAMA_LAZY_MODE_ON` constant value.
|
|
7
|
+
- Add `max_buf_size` accessor to `LlamaModelQuantizeParams`.
|
|
8
|
+
|
|
1
9
|
## [[0.28.0](https://github.com/yoshoku/llama_cpp.rb/compare/v0.27.0...v0.28.0)] - 2026-08-23
|
|
2
10
|
|
|
3
11
|
- Change supported llama.cpp version to v0.2.0.
|
|
4
12
|
- Add `LLAMA_LOAD_MODE_AUTO` constant value.
|
|
5
|
-
- Add `n_outputs_max_per_seq accessor
|
|
13
|
+
- Add `n_outputs_max_per_seq` accessor to `LlamaContextParams`.
|
|
6
14
|
- Add `llama_version` module function to `LlamaCpp`.
|
|
7
15
|
- Add `llama_sampler_copy` module function to `LlamaCpp`.
|
|
8
16
|
|
data/ext/llama_cpp/llama_cpp.c
CHANGED
|
@@ -1153,6 +1153,17 @@ static VALUE llama_model_quantize_params_set_dry_run(VALUE self, VALUE dry_run)
|
|
|
1153
1153
|
return dry_run;
|
|
1154
1154
|
}
|
|
1155
1155
|
|
|
1156
|
+
static VALUE llama_model_quantize_params_get_max_buf_size(VALUE self) {
|
|
1157
|
+
llama_model_quantize_params* data = get_llama_model_quantize_params(self);
|
|
1158
|
+
return SIZET2NUM(data->max_buf_size);
|
|
1159
|
+
}
|
|
1160
|
+
|
|
1161
|
+
static VALUE llama_model_quantize_params_set_max_buf_size(VALUE self, VALUE max_buf_size) {
|
|
1162
|
+
llama_model_quantize_params* data = get_llama_model_quantize_params(self);
|
|
1163
|
+
data->max_buf_size = NUM2SIZET(max_buf_size);
|
|
1164
|
+
return max_buf_size;
|
|
1165
|
+
}
|
|
1166
|
+
|
|
1156
1167
|
/* llama_logit_bias */
|
|
1157
1168
|
static void llama_logit_bias_free(void *ptr) {
|
|
1158
1169
|
if (ptr) {
|
|
@@ -4583,6 +4594,11 @@ void Init_llama_cpp(void) {
|
|
|
4583
4594
|
rb_define_const(rb_mLlamaCpp, "LLAMA_LOAD_MODE_MLOCK", INT2NUM(LLAMA_LOAD_MODE_MLOCK));
|
|
4584
4595
|
rb_define_const(rb_mLlamaCpp, "LLAMA_LOAD_MODE_MMAP_MLOCK", INT2NUM(LLAMA_LOAD_MODE_MMAP_MLOCK));
|
|
4585
4596
|
rb_define_const(rb_mLlamaCpp, "LLAMA_LOAD_MODE_DIRECT_IO", INT2NUM(LLAMA_LOAD_MODE_DIRECT_IO));
|
|
4597
|
+
/* llama_lazy_mode */
|
|
4598
|
+
/* Document-const: LlamaCpp::LLAMA_LAZY_MODE_OFF */
|
|
4599
|
+
rb_define_const(rb_mLlamaCpp, "LLAMA_LAZY_MODE_OFF", INT2NUM(LLAMA_LAZY_MODE_OFF));
|
|
4600
|
+
rb_define_const(rb_mLlamaCpp, "LLAMA_LAZY_MODE_AUTO", INT2NUM(LLAMA_LAZY_MODE_AUTO));
|
|
4601
|
+
rb_define_const(rb_mLlamaCpp, "LLAMA_LAZY_MODE_ON", INT2NUM(LLAMA_LAZY_MODE_ON));
|
|
4586
4602
|
/* llama_context_type */
|
|
4587
4603
|
/* Document-const: LlamaCpp::LLAMA_CONTEXT_TYPE_DEFAULT */
|
|
4588
4604
|
rb_define_const(rb_mLlamaCpp, "LLAMA_CONTEXT_TYPE_DEFAULT", INT2NUM(LLAMA_CONTEXT_TYPE_DEFAULT));
|
|
@@ -5352,6 +5368,17 @@ void Init_llama_cpp(void) {
|
|
|
5352
5368
|
/* TODO: const struct llama_model_kv_override* kv_overrides */
|
|
5353
5369
|
/* TODO: const struct llama_model_tensor_override* tt_overrides */
|
|
5354
5370
|
/* TODO: const int32_t* prune_layers */
|
|
5371
|
+
/**
|
|
5372
|
+
* Document-method: max_buf_size
|
|
5373
|
+
* @return [Integer]
|
|
5374
|
+
*/
|
|
5375
|
+
rb_define_method(rb_cLlamaModelQuantizeParams, "max_buf_size", RUBY_METHOD_FUNC(llama_model_quantize_params_get_max_buf_size), 0);
|
|
5376
|
+
/**
|
|
5377
|
+
* Document-method: max_buf_size=
|
|
5378
|
+
* @param [Integer] max_buf_size
|
|
5379
|
+
* @return [Integer]
|
|
5380
|
+
*/
|
|
5381
|
+
rb_define_method(rb_cLlamaModelQuantizeParams, "max_buf_size=", RUBY_METHOD_FUNC(llama_model_quantize_params_set_max_buf_size), 1);
|
|
5355
5382
|
|
|
5356
5383
|
/**
|
|
5357
5384
|
* Document-class: LlamaCpp::LlamaLogitBias
|
data/lib/llama_cpp/version.rb
CHANGED
|
@@ -3,8 +3,8 @@
|
|
|
3
3
|
# llama_cpp.rb provides Ruby bindings for the llama.cpp.
|
|
4
4
|
module LlamaCpp
|
|
5
5
|
# The version of llama_cpp.rb you install.
|
|
6
|
-
VERSION = '0.28.
|
|
6
|
+
VERSION = '0.28.1'
|
|
7
7
|
|
|
8
8
|
# The supported version of llama.cpp.
|
|
9
|
-
LLAMA_CPP_VERSION = 'v0.
|
|
9
|
+
LLAMA_CPP_VERSION = 'v0.4.0'
|
|
10
10
|
end
|
metadata
CHANGED
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
--- !ruby/object:Gem::Specification
|
|
2
2
|
name: llama_cpp
|
|
3
3
|
version: !ruby/object:Gem::Version
|
|
4
|
-
version: 0.28.
|
|
4
|
+
version: 0.28.1
|
|
5
5
|
platform: ruby
|
|
6
6
|
authors:
|
|
7
7
|
- yoshoku
|
|
@@ -33,7 +33,7 @@ metadata:
|
|
|
33
33
|
homepage_uri: https://github.com/yoshoku/llama_cpp.rb
|
|
34
34
|
source_code_uri: https://github.com/yoshoku/llama_cpp.rb
|
|
35
35
|
changelog_uri: https://github.com/yoshoku/llama_cpp.rb/blob/main/CHANGELOG.md
|
|
36
|
-
documentation_uri: https://gemdocs.org/gems/llama_cpp/0.28.
|
|
36
|
+
documentation_uri: https://gemdocs.org/gems/llama_cpp/0.28.1/
|
|
37
37
|
rubygems_mfa_required: 'true'
|
|
38
38
|
rdoc_options: []
|
|
39
39
|
require_paths:
|