SIGN IN SIGN UP

COMMITS

/ examples/llama-bench/llama-bench.cpp
gguf-py
November 25, 2024
November 20, 2024
November 14, 2024
November 8, 2024
G
metal : optimize FA kernels (#10171)
Georgi Gerganov committed
October 30, 2024
October 18, 2024
October 10, 2024
September 17, 2024
September 13, 2024
September 7, 2024
G
llama : refactor sampling v2 (#9294)
Georgi Gerganov committed
September 6, 2024
September 5, 2024
September 4, 2024
September 3, 2024
August 29, 2024
F
Threadpool: take 2 (#8672)
Faisal Zaghloul committed
August 7, 2024
July 27, 2024
July 17, 2024
June 14, 2024
R
llama-bench : fix RPC indication (#7936)
Radoslav Gerganov committed
June 13, 2024
June 11, 2024
June 4, 2024
May 29, 2024
May 22, 2024
May 10, 2024
May 5, 2024
April 30, 2024
G
ggml : add Flash Attention (#5021)
Georgi Gerganov committed
April 16, 2024
J
ggml : add llamafile sgemm (#6414)
Justine Tunney committed
March 26, 2024
March 21, 2024
March 18, 2024
March 15, 2024
March 14, 2024
S
gguf : fix resource leaks (#6061)
Steve Grubb committed
March 13, 2024
March 7, 2024
March 2, 2024
March 1, 2024
P
llama : cleanup unused mmq flags (#5772)
Pierrick Hymbert committed
February 25, 2024
G
code : normalize enum names (#5697)
Georgi Gerganov committed
February 16, 2024
February 3, 2024
February 1, 2024
N
add --no-mmap in llama-bench (#5257)
Neo Zhang Jianyu committed
January 31, 2024
January 28, 2024
January 12, 2024
January 7, 2024