微信扫码
添加专属顾问
我要投稿
1、在项目中,如果prompt和function calling足够好,尽量不要微调,节约成本。
以下是针对function calling的slot,评估准确率(识别准确度)、召回率(全面率),F1值。
从中可以看出,训练微调并不能比function calling增强太多。
2、大模型训练和微调工具
https://huggingface.co/
分类器示例:https://huggingface.co/datasets/cornell-movie-review-data/rotten_tomatoes
3、模型训练数据,以开源数据库为例,包含酒店,景点,餐馆等信息。
https://github.com/thu-coai/CrossWOZ/
酒店数据库
https://github.com/thu-coai/CrossWOZ/blob/master/data/crosswoz/database/hotel_db.json
可以通过训练实现下面的对话机器人。
4.数据增强,可以用chatgpt对以上数据库改写,得到增强数据库,更加口语化。
5、模型训练环境
AutoDL的4090云GPU,显存大于20GB
https://www.autodl.com/home
6、训练、微调代码示例
https://github.com/agiclass/fine-tuning-lab/tree/v4
https://github.com/agiclass/fine-tuning-lab/blob/main/web_demo/web_demo.py
7、连接租用的容器后即可进行训练、微调。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-02-18
DeepSeek R1 671B 完整版本地部署教程来了!!!
2025-02-18
昇腾 910B 部署满血 DeepSeek-R1
2025-02-18
如何训练LLMs像DeepSeek-R1“思考”
2025-02-17
7G显存,训练你自己的DeepSeek-R1
2025-02-17
DeepSeek-R1 如何通过知识蒸馏将推理能力传递给 Qwen
2025-02-16
飞书多维表格+Deepseek王炸组合,最强AI agent工具
2025-02-16
谷歌 AI Agent 白皮书 3/3
2025-02-16
如何在通义灵码里用上 DeepSeek-V3 和 DeepSeek-R1 满血版 671B 模型?
2025-02-04
2025-02-04
2024-09-18
2024-07-11
2024-07-11
2024-07-09
2024-07-26
2025-01-27
2025-02-01
2024-12-29
2025-02-16
2025-02-10
2025-02-10
2025-02-09
2025-02-05
2025-01-24
2025-01-22
2025-01-14