feat: 调优创建支持模型量化配置

新增训练时量化(QLoRA 4/8bit)与训练后导出量化模型开关,支持 bitsandbytes、GPTQ、AWQ、GGUF 四种方法及对应位数、分组、导出格式配置,命令预览与提交参数同步接入,常量补充三类量化选项。
This commit is contained in:
caoxiaozhu
2026-07-13 10:30:52 +08:00
parent 08a567062d
commit 4dde761348
2 changed files with 137 additions and 1 deletions

View File

@@ -76,6 +76,29 @@ export const LR_SCHEDULER_OPTIONS = [
{ label: 'constant', value: 'constant' },
]
/** 训练时量化位数QLoRA */
export const QUANTIZATION_BIT_OPTIONS = [
{ label: '不量化', value: 0 },
{ label: '8 bit', value: 8 },
{ label: '4 bit (QLoRA)', value: 4 },
]
/** 训练后导出量化方法 */
export const QUANT_METHOD_OPTIONS = [
{ label: 'bitsandbytes', value: 'bnb' },
{ label: 'GPTQ', value: 'gptq' },
{ label: 'AWQ', value: 'awq' },
{ label: 'GGUF (llama.cpp)', value: 'gguf' },
]
/** GGUF 量化格式 */
export const GGUF_FORMAT_OPTIONS = [
{ label: 'Q4_K_M推荐', value: 'Q4_K_M' },
{ label: 'Q5_K_M', value: 'Q5_K_M' },
{ label: 'Q8_0', value: 'Q8_0' },
{ label: 'F16不量化', value: 'F16' },
]
/** 训练模板分组(按模型系列) */
export const TEMPLATE_GROUPS: { label: string; options: { label: string; value: string }[] }[] = [
{