llama : remove shards weight file support (#2000)
* Remove multiple shards * Remove multiple file loaders * Remove llama_load_tensor_shard class * Simplify load logic * Remove dead code guess_n_parts function * Remove vocab_only from constructor of llama_model_loader * Remove alignment_prevents_mmap which is not more needed. * Remove useless check
H
Howard Su committed
b922bc351b69770cec2d35d2aa50fa052b95ca93
Parent: 7f9753f
Committed by GitHub <noreply@github.com>
on 6/28/2023, 5:13:02 PM