AI知识库

53AI知识库

学习大模型的前沿技术与行业应用场景


如何进行大模型训练和微调?(实战)
发布日期:2024-09-16 09:30:42 浏览次数: 1548


1、在项目中,如果prompt和function calling足够好,尽量不要微调,节约成本。

以下是针对function calling的slot,评估准确率(识别准确度)、召回率(全面率),F1值。

从中可以看出,训练微调并不能比function calling增强太多。

2、大模型训练和微调工具

https://huggingface.co/ 

分类器示例:https://huggingface.co/datasets/cornell-movie-review-data/rotten_tomatoes 

3、模型训练数据,以开源数据库为例,包含酒店,景点,餐馆等信息。

https://github.com/thu-coai/CrossWOZ/ 

酒店数据库

https://github.com/thu-coai/CrossWOZ/blob/master/data/crosswoz/database/hotel_db.json 

可以通过训练实现下面的对话机器人。

4.数据增强,可以用chatgpt对以上数据库改写,得到增强数据库,更加口语化。

5、模型训练环境

AutoDL的4090云GPU,显存大于20GB

https://www.autodl.com/home 

6、训练、微调代码示例

https://github.com/agiclass/fine-tuning-lab/tree/v4

https://github.com/agiclass/fine-tuning-lab/blob/main/web_demo/web_demo.py 

7、连接租用的容器后即可进行训练、微调。



53AI,企业落地应用大模型首选服务商

产品:大模型应用平台+智能体定制开发+落地咨询服务

承诺:先做场景POC验证,看到效果再签署服务协议。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

与创始人交个朋友

回到顶部

 
扫码咨询