Quantize a model

POST

http://localhost:11434/api/create

Quantize a non-quantized model.

Request

Body Params application/json

Examples

Responses

🟢200Success

application/json

A stream of JSON objects is returned:

Bodyapplication/json

Request Example

Shell

JavaScript

Java

Swift

curl --location 'http://localhost:11434/api/create' \
--header 'Content-Type: application/json' \
--data '{
    "model": "llama3.1:quantized",
    "from": "llama3.1:8b-instruct-fp16",
    "quantize": "q4_K_M"
}'

Response Example

{"status":"quantizing F16 model to Q4_K_M"}
{"status":"creating new layer sha256:667b0c1932bc6ffc593ed1d03f895bf2dc8dc6df21db3042284a6f4416b06a29"}
{"status":"using existing layer sha256:11ce4ee3e170f6adebac9a991c22e22ab3f8530e154ee669954c4bc73061c258"}
{"status":"using existing layer sha256:0ba8f0e314b4264dfd19df045cde9d4c394a52474bf92ed6a3de22a4ca31a177"}
{"status":"using existing layer sha256:56bb8bd477a519ffa694fc449c2413c6f0e1d3b1c88fa7e3c9d88d3ae49d4dcb"}
{"status":"creating new layer sha256:455f34728c9b5dd3376378bfb809ee166c145b0b4c1f1a6feca069055066ef9a"}
{"status":"writing manifest"}
{"status":"success"}

Modified at 2025-03-27 10:20:36

Create a new model

Create a model from GGUF