neuralmagic
/

Meta-Llama-3.1-70B-quantized.w8a16

Text Generation

text-generation-inference

Inference Endpoints

compressed-tensors

Model card Files Files and versions Community

Meta-Llama-3.1-70B-quantized.w8a16 / generation_config.json

alexmarques's picture

Upload folder using huggingface_hub

4921616 verified 3 months ago

history blame contribute delete

121 Bytes

	{
	"_from_model_config": true,
	"bos_token_id": 128000,
	"eos_token_id": 128001,
	"transformers_version": "4.43.3"
	}