按 Esc 关闭

分类

动态

动态

QWEN-Image 可能是目前开源最强大的中文生图模型

在我的工作中,缺个能够完全支持中文的同时具备文生图能力的高品质模型。在了解到Qwen模型能够通过中文达到指向性的修改的能力,所以在这做一波测试效果对比。我对比的是字节的即梦…

10 分钟阅读
动态

我是如何正确本地部署 Spark-TTS

Spark-TTS太强大了,你能看到的短视频、第一视角的剧情解说基本上都是出自这个开源项目。正好我打算用它来生产音频内容。看到github上那么多人反馈报错问题,确实头大。…

2 分钟阅读
动态

如何从头开始构建 LLM 大模型?

这篇文章面向对神经网络LLM大模型构建感兴趣的人,写这篇文章一方面是作为自己想从头开始了解LLM构建原理,从中有所收获。作为一个应用层面的设计师(我自己),实际上并不需要懂…

4 分钟阅读
动态

分享手动安装搭建Flux-GYM训练工具

哎,其实我更希望分享一些高级一些的东西。天天整这些也不是个事,但是为了能够搭建本地训练环境还是咬着牙踩这个坑。 言归正传,说下基本的配置要求,这个工具要求python版本要…

2 分钟阅读
动态

当把XL训练的repeat提高到100以上

上一期文章分享了扁平插画女孩的LoRa-XL模型,训练的repeat扫描次数在10-20之间,这次我将他们的repeat提高到100-150,在同样的提示词下生成的效果如图…

1 分钟阅读