SIGN IN SIGN UP

llama : remove shards weight file support (#2000)

* Remove multiple shards

* Remove multiple file loaders

* Remove llama_load_tensor_shard class

* Simplify load logic

* Remove dead code guess_n_parts function

* Remove vocab_only from constructor of llama_model_loader

* Remove alignment_prevents_mmap which is not more needed.

* Remove useless check
H
Howard Su committed
b922bc351b69770cec2d35d2aa50fa052b95ca93
Parent: 7f9753f
Committed by GitHub <noreply@github.com> on 6/28/2023, 5:13:02 PM