whisper.cpp

Running

ggerganov commited on Oct 2, 2024

Commit

43d5a06

1 Parent(s): c5e24da

metal : reduce command encoding overhead (llama/9698)

Files changed (2) hide show

ggml/include/ggml-metal.h CHANGED Viewed

@@ -25,9 +25,6 @@
 #include <stddef.h>
 #include <stdbool.h>
-// max memory buffers that can be mapped to the device
-#define GGML_METAL_MAX_BUFFERS 64
 struct ggml_tensor;
 struct ggml_cgraph;
@@ -48,8 +45,6 @@ GGML_API bool ggml_backend_is_metal(ggml_backend_t backend);
 GGML_API GGML_CALL ggml_backend_buffer_t ggml_backend_metal_buffer_from_ptr(void * data, size_t size, size_t max_size);
-GGML_API void ggml_backend_metal_set_n_cb(ggml_backend_t backend, int n_cb);
 GGML_API void ggml_backend_metal_set_abort_callback(ggml_backend_t backend, ggml_abort_callback abort_callback, void * user_data);
 GGML_API GGML_CALL ggml_backend_buffer_type_t ggml_backend_metal_buffer_type(void);

 #include <stddef.h>
 #include <stdbool.h>
 struct ggml_tensor;
 struct ggml_cgraph;
 GGML_API GGML_CALL ggml_backend_buffer_t ggml_backend_metal_buffer_from_ptr(void * data, size_t size, size_t max_size);
 GGML_API void ggml_backend_metal_set_abort_callback(ggml_backend_t backend, ggml_abort_callback abort_callback, void * user_data);
 GGML_API GGML_CALL ggml_backend_buffer_type_t ggml_backend_metal_buffer_type(void);

ggml/src/ggml-metal.m CHANGED Viewed

The diff for this file is too large to render. See raw diff