| 1085 | int64_t context_ = 0; |
| 1086 | int64_t cache_steps_ = 0; |
| 1087 | int64_t head_dim_ = 0; |
| 1088 | ggml_context * ggml_ctx_ = nullptr; |
| 1089 | ggml_backend_buffer_t params_buffer_ = nullptr; |
| 1090 | ggml_cgraph * graph_ = nullptr; |
| 1091 | ggml_gallocr_t galloc_ = nullptr; |
| 1092 | core::TensorValue input_bct_; |
| 1093 | core::TensorValue positions_; |
| 1094 | core::TensorValue attention_mask_; |
| 1095 | std::vector<core::TensorValue> attention_masks_; |
| 1096 | std::vector<std::vector<float>> attention_mask_values_; |
| 1097 | std::vector<core::TensorValue> prefix_keys_; |
| 1098 | std::vector<core::TensorValue> prefix_values_; |
| 1099 | std::vector<core::TensorValue> work_prefix_keys_; |
| 1100 | std::vector<core::TensorValue> work_prefix_values_; |
| 1101 | std::vector<core::TensorValue> zero_prefix_keys_; |
| 1102 | std::vector<core::TensorValue> zero_prefix_values_; |
| 1103 | std::vector<core::TensorValue> keys_; |
| 1104 | std::vector<core::TensorValue> values_; |
| 1105 | std::vector<int32_t> positions_buffer_; |
| 1106 | std::vector<std::vector<ggml_tensor *>> carry_key_sources_; |
| 1107 | std::vector<std::vector<ggml_tensor *>> carry_value_sources_; |
| 1108 | std::vector<std::vector<ggml_tensor *>> carry_key_destinations_; |
| 1109 | std::vector<std::vector<ggml_tensor *>> carry_value_destinations_; |
| 1110 | std::vector<std::vector<ggml_tensor *>> append_key_sources_; |
| 1111 | std::vector<std::vector<ggml_tensor *>> append_value_sources_; |
| 1112 | std::vector<std::vector<ggml_tensor *>> append_key_destinations_; |
| 1113 | std::vector<std::vector<ggml_tensor *>> append_value_destinations_; |
| 1114 | core::TensorValue output_bct_; |
| 1115 | int64_t current_end_ = 0; |
| 1116 | int64_t runtime_keep_steps_ = 0; |
| 1117 | int64_t current_mask_keep_steps_ = -1; |
no test coverage detected