make_quantized
family
Declared in clika_rt/clika_rt_core.h.
Members
| Name | Description |
|---|---|
make_quantized | ClikaRT::make_quantized <- ClikaRT/compute/q_tensor.h consumes payload (contract §6) optional; NULL = absent; consumes global_scale when present (contract §6) C++ defaults (dropped at this surface): global_scale={} |
make_quantized_affine | ClikaRT::make_quantized_affine <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes scales (contract §6) consumes biases (contract §6) |
make_quantized_awq | ClikaRT::make_quantized_awq <- ClikaRT/compute/q_tensor.h consumes qweight (contract §6) consumes qzeros (contract §6) consumes scales (contract §6) |
make_quantized_bnb4 | ClikaRT::make_quantized_bnb4 <- ClikaRT/compute/q_tensor.h consumes packed (contract §6) consumes absmax (contract §6) optional; NULL = absent; consumes nested_absmax when present (contract §6) optional; NULL = absent; consumes nested_quant_map when present (contract §6) optional; NULL = absent; consumes offset when present (contract §6) optional; NULL = absent; consumes quant_map when present (contract §6) |
make_quantized_ct_pack | ClikaRT::make_quantized_ct_pack <- ClikaRT/compute/q_tensor.h consumes packed (contract §6) consumes scales (contract §6) |
make_quantized_fp8 | ClikaRT::make_quantized_fp8 <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes scale (contract §6) |
make_quantized_fp8_blocked | ClikaRT::make_quantized_fp8_blocked <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes scale (contract §6) |
make_quantized_gptq | ClikaRT::make_quantized_gptq <- ClikaRT/compute/q_tensor.h consumes qweight (contract §6) consumes qzeros (contract §6) consumes scales (contract §6) optional; NULL = absent; consumes g_idx when present (contract §6) |
make_quantized_mxfp4 | ClikaRT::make_quantized_mxfp4 <- ClikaRT/compute/q_tensor.h consumes blocks (contract §6) consumes scales (contract §6) |
make_quantized_nvfp4 | ClikaRT::make_quantized_nvfp4 <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes sub_scales (contract §6) optional; NULL = absent; consumes global_scale when present (contract §6) |
Functions
make_quantized
clika_rt_error*(* make_quantized)(clika_rt_tensor *payload, const char *scheme, size_t scheme_len, const int64_t *logical_shape, size_t logical_shape_count, clika_rt_tensor *global_scale, clika_rt_qtensor **out)
ClikaRT::make_quantized <- ClikaRT/compute/q_tensor.h consumes payload (contract §6) optional; NULL = absent; consumes global_scale when present (contract §6) C++ defaults (dropped at this surface): global_scale={}
Declared in clika_rt/clika_rt_core.h, line 5946
make_quantized_affine
clika_rt_error*(* make_quantized_affine)(clika_rt_tensor *codes, clika_rt_tensor *scales, clika_rt_tensor *biases, int64_t group_size, int64_t bits, const int64_t *logical_shape, size_t logical_shape_count, clika_rt_qtensor **out)
ClikaRT::make_quantized_affine <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes scales (contract §6) consumes biases (contract §6)
Declared in clika_rt/clika_rt_core.h, line 5997
make_quantized_awq
clika_rt_error*(* make_quantized_awq)(clika_rt_tensor *qweight, clika_rt_tensor *qzeros, clika_rt_tensor *scales, int64_t bits, int64_t group_size, clika_rt_qtensor **out)
ClikaRT::make_quantized_awq <- ClikaRT/compute/q_tensor.h consumes qweight (contract §6) consumes qzeros (contract §6) consumes scales (contract §6)
Declared in clika_rt/clika_rt_core.h, line 6051
make_quantized_bnb4
clika_rt_error*(* make_quantized_bnb4)(clika_rt_tensor *packed, clika_rt_tensor *absmax, clika_rt_tensor *nested_absmax, clika_rt_tensor *nested_quant_map, clika_rt_tensor *offset, clika_rt_tensor *quant_map, const char *quant_type, size_t quant_type_len, int64_t blocksize, int64_t nested_blocksize, const int64_t *shape, size_t shape_count, clika_rt_qtensor **out)
ClikaRT::make_quantized_bnb4 <- ClikaRT/compute/q_tensor.h consumes packed (contract §6) consumes absmax (contract §6) optional; NULL = absent; consumes nested_absmax when present (contract §6) optional; NULL = absent; consumes nested_quant_map when present (contract §6) optional; NULL = absent; consumes offset when present (contract §6) optional; NULL = absent; consumes quant_map when present (contract §6)
Declared in clika_rt/clika_rt_core.h, line 6033
make_quantized_ct_pack
clika_rt_error*(* make_quantized_ct_pack)(clika_rt_tensor *packed, clika_rt_tensor *scales, int64_t bits, int64_t group_size, clika_rt_qtensor **out)
ClikaRT::make_quantized_ct_pack <- ClikaRT/compute/q_tensor.h consumes packed (contract §6) consumes scales (contract §6)
Declared in clika_rt/clika_rt_core.h, line 6061
make_quantized_fp8
clika_rt_error*(* make_quantized_fp8)(clika_rt_tensor *codes, clika_rt_tensor *scale, const int64_t *logical_shape, size_t logical_shape_count, clika_rt_qtensor **out)
ClikaRT::make_quantized_fp8 <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes scale (contract §6)
Declared in clika_rt/clika_rt_core.h, line 5977
make_quantized_fp8_blocked
clika_rt_error*(* make_quantized_fp8_blocked)(clika_rt_tensor *codes, clika_rt_tensor *scale, int64_t block_size, const int64_t *logical_shape, size_t logical_shape_count, clika_rt_qtensor **out)
ClikaRT::make_quantized_fp8_blocked <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes scale (contract §6)
Declared in clika_rt/clika_rt_core.h, line 5986
make_quantized_gptq
clika_rt_error*(* make_quantized_gptq)(clika_rt_tensor *qweight, clika_rt_tensor *qzeros, clika_rt_tensor *scales, clika_rt_tensor *g_idx, int64_t bits, int64_t group_size, clika_rt_zeros_convention zeros_convention, clika_rt_qtensor **out)
ClikaRT::make_quantized_gptq <- ClikaRT/compute/q_tensor.h consumes qweight (contract §6) consumes qzeros (contract §6) consumes scales (contract §6) optional; NULL = absent; consumes g_idx when present (contract §6)
Declared in clika_rt/clika_rt_core.h, line 6017
make_quantized_mxfp4
clika_rt_error*(* make_quantized_mxfp4)(clika_rt_tensor *blocks, clika_rt_tensor *scales, const int64_t *logical_shape, size_t logical_shape_count, clika_rt_qtensor **out)
ClikaRT::make_quantized_mxfp4 <- ClikaRT/compute/q_tensor.h consumes blocks (contract §6) consumes scales (contract §6)
Declared in clika_rt/clika_rt_core.h, line 5957
make_quantized_nvfp4
clika_rt_error*(* make_quantized_nvfp4)(clika_rt_tensor *codes, clika_rt_tensor *sub_scales, clika_rt_tensor *global_scale, const int64_t *logical_shape, size_t logical_shape_count, clika_rt_qtensor **out)
ClikaRT::make_quantized_nvfp4 <- ClikaRT/compute/q_tensor.h consumes codes (contract §6) consumes sub_scales (contract §6) optional; NULL = absent; consumes global_scale when present (contract §6)
Declared in clika_rt/clika_rt_core.h, line 5967