GGbang (@jocker) 在 小说去除AI,自己微调模型,过朱雀检测 中发帖
昨天看到 echoMe佬的帖子在说微调模型去除AI味,他是针对公众号优化的,目前公众号的数据还要做数据清洗,我没那没多token,看到论坛里的佬们很多在写AI小说,俺也训练了一个模型来做AI小说的味道去除。落笔
原始的章节
[image]
优化章节
[image]
我没有做特定优化,因为我是一台非常mini的设备,只支持小于4k字的输入,每个Linuxdo的账号每天有5次额度,并且单并发可能需要排队。佬们有什么意见可以反馈,我在模型上继续优化一下!
目前的问题
样本量比较少,还没做充分的低质量数据的微调,如果是纯ai生成的可以进行几次迭代,但是可能会破坏语义。