返回顶部
热门问答 更多热门问答
技术文章 更多技术文章

如何进行大模型训练和微调?(实战)

[复制链接]
链载Ai 显示全部楼层 发表于 昨天 23:44 |阅读模式 打印 上一主题 下一主题

1、在项目中,如果prompt和function calling足够好,尽量不要微调,节约成本。

以下是针对function calling的slot,评估准确率(识别准确度)、召回率(全面率),F1值。

从中可以看出,训练微调并不能比function calling增强太多。

2、大模型训练和微调工具

https://huggingface.co/

分类器示例:https://huggingface.co/datasets/cornell-movie-review-data/rotten_tomatoes

3、模型训练数据,以开源数据库为例,包含酒店,景点,餐馆等信息。

https://github.com/thu-coai/CrossWOZ/

酒店数据库

https://github.com/thu-coai/CrossWOZ/blob/master/data/crosswoz/database/hotel_db.json

可以通过训练实现下面的对话机器人。

4.数据增强,可以用chatgpt对以上数据库改写,得到增强数据库,更加口语化。

5、模型训练环境

AutoDL的4090云GPU,显存大于20GB

https://www.autodl.com/home

6、训练、微调代码示例

https://github.com/agiclass/fine-tuning-lab/tree/v4

https://github.com/agiclass/fine-tuning-lab/blob/main/web_demo/web_demo.py

7、连接租用的容器后即可进行训练、微调。


回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

链载AI是专业的生成式人工智能教程平台。提供Stable Diffusion、Midjourney AI绘画教程,Suno AI音乐生成指南,以及Runway、Pika等AI视频制作与动画生成实战案例。从提示词编写到参数调整,手把手助您从入门到精通。
  • 官方手机版

  • 微信公众号

  • 商务合作

  • Powered by Discuz! X3.5 | Copyright © 2025-2025. | 链载Ai
  • 桂ICP备2024021734号 | 营业执照 | |广西笔趣文化传媒有限公司|| QQ