Explorar o código

context : do not clear output buffer on reserve (#13152)

Co-authored-by: pockers21 <liyang2@uniontech.com>
pockers21 hai 8 meses
pai
achega
fb0471d175
Modificáronse 1 ficheiros con 0 adicións e 2 borrados
  1. 0 2
      src/llama-context.cpp

+ 0 - 2
src/llama-context.cpp

@@ -1536,8 +1536,6 @@ int32_t llama_context::output_reserve(int32_t n_outputs) {
     // set all ids as invalid (negative)
     std::fill(output_ids.begin(), output_ids.end(), -1);
 
-    ggml_backend_buffer_clear(buf_output.get(), 0);
-
     this->n_outputs     = 0;
     this->n_outputs_max = n_outputs_max;