compressa-ai
/

Llama-3-8B-Instruct-OmniQuant

Text Generation

text-generation-inference

Inference Endpoints

4-bit precision

Model card Files Files and versions Community

Llama-3-8B-Instruct-OmniQuant / generation_config.json

Vasily Alexeev

add model weights and stuff

1a27dec 9 months ago

121 Bytes

	{
	"_from_model_config": true,
	"bos_token_id": 128000,
	"eos_token_id": 128001,
	"transformers_version": "4.39.3"
	}