This commit updates the debug example to not create the
base_callback_data.
The motivation for this is when using `--save-logits`, which is used by
examples/model-conversion scripts, we often don't care about the tensor
outputs and they just add noise to the output. This changes is quiet by
default we can always remove --save-logits to get the tensor outputs
when debugging.
#include <vector>
#include <filesystem>
#include <fstream>
+#include <optional>
#include <regex>
static void print_usage(int /*argc*/, char ** argv) {
llama_backend_init();
llama_numa_init(params.numa);
- base_callback_data cb_data(params, params.tensor_filter);
+ std::optional<base_callback_data> cb_data;
+ if (!params.save_logits) {
+ cb_data.emplace(params, params.tensor_filter);
+ }
auto llama_init = common_init_from_params(params);