Matthias Reso 0920b1a415 Fix quantization for inference před 2 roky
..
__init__.py 207d2f80e9 Make code-llama and hf-tgi inference runnable as module před 3 roky
chat_utils.py 6d9d48d619 Use apply_chat_template instead of custom functions před 2 roky
checkpoint_converter_fsdp_hf.py 0e54f5634a use AutoTokenizer instead of LlamaTokenizer před 2 roky
llm.py eeb45e5f2c Updated model names for OctoAI před 2 roky
model_utils.py 0920b1a415 Fix quantization for inference před 2 roky
prompt_format_utils.py fd9f52f710 Modify prompt_format_utils with changes necessary for Llama Guard 3 (#1) před 2 roky
safety_utils.py f63ba19827 Fixing tokenizer used for llama 3. Changing quantization configs on safety_utils. před 2 roky