微信扫码
与创始人交个朋友
我要投稿
一、LLaMA-Factory
支持的模型:LLaMA-Factory支持多种大型语言模型,包括但不限于LLaMA、BLOOM、Mistral、Baichuan、Qwen、ChatGLM等。
集成方法:包括(增量)预训练、指令监督微调、奖励模型训练、PPO训练、DPO训练和ORPO训练等多种方法。
运算精度与优化算法:提供32比特全参数微调、16比特冻结微调、16比特LoRA微调和基于AQLM/AWQ/GPTQ/LLM.int8的2/4/8比特QLoRA微调等多种精度选择,以及GaLore、DoRA、LongLoRA、LLaMA Pro、LoRA+、LoftQ和Agent微调等先进算法。
LLaMA-Factory
二、模型微调(Fine-Tuning)
设置语言:进入WebUI后,可以切换到中文(zh)。
配置模型:选择LLaMA3-8B-Chat模型。
配置微调方法:微调方法则保持默认值lora,使用LoRA轻量化微调方法能极大程度地节约显存。
data
目录下。同时也可以自己准备自定义数据集,将数据处理为框架特定的格式,放到指定的data目录下。
学习率+梯度累积:设置学习率为1e-4,梯度累积为2,有利于模型拟合。
计算类型:如果是NVIDIA V100显卡,计算类型保持为fp16;如果使用了AMD A10系列显卡,可以更改计算类型为bf16。
输出目录:将输出目录修改为train_llama3,训练后的LoRA权重将会保存在此目录中。
预览命令:点击「预览命令」可展示所有已配置的参数,如果想通过代码运行微调,可以复制这段命令,在命令行运行。
开始:点击「开始」启动模型微调。
刷新适配器:微调完成后,点击页面顶部的「刷新适配器」
评估模型:选择「Evaluate&Predict」栏,在数据集下拉列表中选择「eval」(验证集)评估模型。
输出目录:更改输出目录为eval_llama3
,模型评估结果将会保存在该目录中。
开始评估:最后点击开始按钮启动模型评估。
评估分数:模型评估大约需要5分钟左右,评估完成后会在界面上显示验证集的分数。
ROUGE分数:其中ROUGE分数衡量了模型输出答案(predict)和验证集中标准答案(label)的相似度,ROUGE分数越高代表模型学习得更好。
train_llama3
,点击「加载模型」即可在Web UI中和微调模型进行对话。卸载模型:点击「卸载模型」,点击“×”号取消适配器路径,再次点击「加载模型」,即可与微调前的原始模型聊天。
53AI,企业落地应用大模型首选服务商
产品:大模型应用平台+智能体定制开发+落地咨询服务
承诺:先做场景POC验证,看到效果再签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2024-10-16
对话姬朋飞:从大厂辞职到 Chat2DB 的诞生
2024-10-16
RD-Agent:助力研发流程自动化的AI创新工具。
2024-10-15
TeleAI 开源星辰语义大模型-TeleChat2!
2024-10-14
开源OCR工具Surya:新增表格识别功能
2024-10-14
LightRAG将GraphRAG落地门槛打下来了!
2024-10-14
实战OpenAI最新开源多智能体框架Swarm
2024-10-13
用 cusor 详细拆解 OpenAI 最新开源智能体框架 swarm
2024-10-13
Pyramid Flow :全新开源高质量 AI 视频生成器
2024-08-13
2024-05-06
2024-06-12
2024-07-25
2024-07-08
2023-07-01
2024-06-16
2024-07-11
2024-07-18
2024-06-15