Historial de Commits

Autor SHA1 Mensaje Fecha
  Diego Devesa 27ebfcacba llama : do not crash if there is no CPU backend (#13395) hace 8 meses
  Johannes Gäßler 5c86c9ed3e CUDA: fix crash on large batch size for MoE models (#13384) hace 8 meses
  Bartowski efb8b47eda imatrix : Add --parse-special for enabling parsing of special tokens in imatrix calculation (#13389) hace 8 meses
  R0CKSTAR 0527771dd8 llama-run: add support for downloading models from ModelScope (#13370) hace 8 meses
  Xuan-Son Nguyen 2189fd3b63 mtmd : fix batch_view for m-rope (#13397) hace 8 meses
  Xuan-Son Nguyen 3f96aeff39 llama : one-off chat template fix for Mistral-Small-2503 (#13398) hace 8 meses
  Radoslav Gerganov b486ba05bf rpc : add rpc_msg_set_tensor_hash_req (#13353) hace 8 meses
  Jeff Bolz 02115dcd9a vulkan: Allow up to 4096 elements for mul_mat_id row_ids (#13326) hace 8 meses
  Xuan-Son Nguyen d9c4accaff server : (webui) rename has_multimodal --> modalities (#13393) hace 8 meses
  Diego Devesa 15e03282bb ci : limit write permission to only the release step + fixes (#13392) hace 8 meses
  Matt Clayton f05a6d71a0 mtmd : Expose helper_decode_image_chunk (#13366) hace 8 meses
  Xuan-Son Nguyen ee01d71e58 server : (webui) fix a very small misalignment (#13387) hace 8 meses
  Xuan-Son Nguyen 8c83449cb7 server : (webui) revamp the input area, plus many small UI improvements (#13365) hace 8 meses
  Sigbjørn Skjæret 1a844be132 convert : support rope_scaling type and rope_type (#13349) hace 8 meses
  welix 0ccc121354 mtmd : fix the calculation of n_tokens for smolvlm (#13381) hace 8 meses
  Georgi Gerganov 6562e5a4d6 context : allow cache-less context for embeddings (#13108) hace 8 meses
  Georgi Gerganov 51fb96b1ff context : remove logits_all flag (#13284) hace 8 meses
  Diego Devesa 70a6991edf ci : move release workflow to a separate file (#13362) hace 8 meses
  Diego Devesa f061021206 llama : print size and type of overridden tensors (#13364) hace 8 meses
  Alberto Cabrera Pérez 8733e0cf6e sycl: addressing non-contiguous src1 mul_mats (nc and batched) (#13343) hace 8 meses
  Diego Devesa 814f795e06 docker : disable arm64 and intel images (#13356) hace 8 meses
  Georgi Gerganov d879433824 sync : ggml hace 8 meses
  Daniel Bevenius 13b0a04597 whisper: remove MSVC warnings pragmas (whisper/3090) hace 8 meses
  Jared Tweed bba9d945c1 cmake : removed stdc++fs (whisper/3097) hace 8 meses
  Sigbjørn Skjæret bc4e1128f7 llama : deci : support ffn-free with attention (#13296) hace 8 meses
  Ycros 39e73ae0d6 common : Add a warning when we can't match samplers from a string or char. (#13330) hace 8 meses
  R0CKSTAR 1f73301b63 cuda : remove nrows_x in mul_mat_q_process_tile (#13325) hace 8 meses
  Georgi Gerganov 4773d7a02f examples : remove infill (#13283) hace 8 meses
  piDack 6c7fd67b64 llama : support tie embedding for chatglm models (#13328) hace 8 meses
  Johannes Gäßler 141a908a59 CUDA: mix virt/real CUDA archs for GGML_NATIVE=OFF (#13135) hace 8 meses