本地同大小 Sakura 肯定是最好的了,毕竟专用语料特训过的。加了官方群,目前新版本在以Qwen1.5 32B为底模继续预训练,数据是当前已发布版本的两倍多,群友们都非常期待(
如果有兴趣帮助提升的话可以去GitHub加群,现在比较缺术语表,需要人工标注,可以贡献自己的一份力量。
本身Qwen1.5 32B 底子就不错,再加上领域数据量大了很多,相当有希望。32B 还支持GQA,同显存能放的上下文大幅增加(当然模型本身确实大了不少)
是的 毕竟专门训练翻译galgame游戏的
登录后回复
本地同大小 Sakura 肯定是最好的了,毕竟专用语料特训过的。加了官方群,目前新版本在以Qwen1.5 32B为底模继续预训练,数据是当前已发布版本的两倍多,群友们都非常期待(
如果有兴趣帮助提升的话可以去GitHub加群,现在比较缺术语表,需要人工标注,可以贡献自己的一份力量。
本身Qwen1.5 32B 底子就不错,再加上领域数据量大了很多,相当有希望。32B 还支持GQA,同显存能放的上下文大幅增加(当然模型本身确实大了不少)
⋯