MiniCPM5-1B-OptiQ-4bit / kv_config.json
codelion's picture
Add kv_config.json (per-layer mixed-precision KV cache, 5.0 BPW target from OptiQ kv-cache sensitivity analysis)
664aaba verified
Raw
History Blame Contribute Delete
1.58 kB
[
{
"layer_idx": 0,
"bits": 8,
"group_size": 64
},
{
"layer_idx": 1,
"bits": 8,
"group_size": 64
},
{
"layer_idx": 2,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 3,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 4,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 5,
"bits": 8,
"group_size": 64
},
{
"layer_idx": 6,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 7,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 8,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 9,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 10,
"bits": 8,
"group_size": 64
},
{
"layer_idx": 11,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 12,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 13,
"bits": 8,
"group_size": 64
},
{
"layer_idx": 14,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 15,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 16,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 17,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 18,
"bits": 8,
"group_size": 64
},
{
"layer_idx": 19,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 20,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 21,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 22,
"bits": 4,
"group_size": 64
},
{
"layer_idx": 23,
"bits": 4,
"group_size": 64
}
]