ADRENO_GPU_GEN adreno_gen = ADRENO_GPU_GEN::ADRENO_UNKNOWN;
std::regex *opfilter = nullptr; // regex of ops to not claim
- std::string opfilter_str; // regex string for opfilter
+ std::string opfilter_str = ""; // regex string for opfilter
size_t global_mem_size = 0;
};
cl_buffer_region region;
- cl_uchar mask_0F = 0x0F;
- cl_uchar mask_F0 = 0xF0;
-
#ifdef GGML_OPENCL_USE_ADRENO_KERNELS
// Adreno MoE Q6_K kernel needs special transposed layout
if (use_adreno_moe_kernels(backend_ctx, tensor)) {
cl_kernel kernel = backend_ctx->kernel_convert_block_q6_k_trans4_ns;
+ cl_uchar mask_0F = 0x0F;
+ cl_uchar mask_F0 = 0xF0;
+
int ne00 = tensor->ne[0];
int ne01 = tensor->ne[1];
int ne02 = tensor->ne[2];
cl_int err;
cl_mem data_device = clCreateBuffer(context, CL_MEM_READ_ONLY | CL_MEM_COPY_HOST_PTR,
- size, (void *) data, &err);
+ size, const_cast<void *>(data), &err);
CL_CHECK(err);
cl_kernel kernel = backend_ctx->kernel_convert_bf16_to_f16;
if (tensor->type == GGML_TYPE_Q6_K) {
ggml_tensor_extra_cl_q6_K * extra = (ggml_tensor_extra_cl_q6_K *)tensor->extra;
- cl_uchar mask_0F = 0x0F;
- cl_uchar mask_F0 = 0xF0;
-
#ifdef GGML_OPENCL_USE_ADRENO_KERNELS
if (use_adreno_moe_kernels(backend_ctx, tensor)) {
cl_int err;
cl_kernel kernel = backend_ctx->kernel_restore_block_q6_k_trans4_ns;
+ cl_uchar mask_0F = 0x0F;
+ cl_uchar mask_F0 = 0xF0;
+
int ne00 = tensor->ne[0];
int ne01 = tensor->ne[1];
int ne02 = tensor->ne[2];
const int ne1 = dst->ne[1];
const int ne2 = dst->ne[2];
+ GGML_UNUSED(ne2);
+
const int r2 = ne12/ne02;
const int r3 = ne13/ne03;
const int dst_rows = ne20*ne21; // ne20 = n_used_experts, ne21 = n_rows
const int n_tile_size = 32;
const int max_post_router_tile = (ne20 * ne21 / n_tile_size) + ne02;
+ GGML_UNUSED(max_post_router_tile);
+
cl_kernel kernel;
// subgroup mat vec