2B2T中国版

 找回密码
 立即注册
查看: 19|回复: 1

[xinllm]由xin服聊天消息训练和微调的大语言模型

[复制链接]

24

主题

98

帖子

2168

积分

等级:金锭

积分
2168
QQ
发表于 昨天 20:24 | 显示全部楼层 |阅读模式
本帖最后由 dishao 于 2026-7-25 20:28 编辑

最近收到了由MCOET提供的xin服务器使用xinbot和xinbls收集的大量日志(见这个帖子) 通过一些数据工程提取出了20.7 万条消息

使用这些数据我分重新别训练和微调了几个大语言模型

一个重新训练的版本 参数规模很小只有29M cpu可以直接跑推理
使用千问1.5b模型lora微调的版本需要大约4GB显存 一般消费级显卡可以跑推理
使用千问14b模型lora微调的版本需要大约32GB显存 4bit量化需要约10GB显存

目前第一个模型已经训练完成并且开源github 除了数据集和数据处理脚本的部分过滤器(因为有敏感词我不想被请喝茶)外的所有复现和推理所需代码已经全部公开在github
使用千问微调的模型暂时还在训练 训练完成后我会开源发布

仓库地址: https://github.com/huangdihd/xinllm


All I need, knowledge and love.
回复

使用道具 举报

27

主题

383

帖子

1961

积分

等级:金锭

积分
1961

阿巴阿巴~老好人海王

发表于 昨天 23:23 | 显示全部楼层
300a核心的2080ti能跑吧
我来自那个高手如云的时代
2k22
已经被踹死
欲买桂花同载酒,终不似,少年游。
回复 支持 反对

使用道具 举报

2B2T.XIN 版权所有

© 2020-2030

快速回复 返回顶部 返回列表