2 分•作者: tosh•4 个月前
返回首页
最新
14 分•作者: werner•4 个月前
11 分•作者: MediaSquirrel•4 个月前
大约六个月前,我开始着手一个项目,目标是在我的 M2 Ultra Mac Studio 上本地微调 Whisper 模型,但计算资源有限。我全身心投入其中。当时我遇到的问题是,我在 Google Cloud Storage 上有 15,000 小时的音频数据,而我的本地机器根本无法容纳所有音频,所以我构建了一个系统,在训练期间将数据从 GCS 流式传输到我的机器上。
后来,Gemma 3n 发布了,我就把它加了进去。说实话,当时有点疯了。
然后我就把它搁置了。
几天前,Gemma 4 发布后,我把它掸了掸灰,清理了一下,把 Whisper 微调中的 Gemma 部分分离出来,并增加了对 Gemma 4 的支持。
今天我把它展示在这里,供大家试用、fork 和改进。
到目前为止,我学到的一件事是:在较长的序列上进行微调时,很容易出现 OOM(内存溢出)错误!我的本地 Mac Studio 有 64GB 内存,所以我经常会耗尽内存。
总之,鉴于大家对 Gemma 4 的兴趣如此之大,而且坦白说,你实际上无法使用 MLX 进行音频微调,这才是这个项目存在的原因(除了我个人的兴趣)。我本来更希望使用 MLX,这样就不用做这个了,但现在就这样吧。欢迎来到我的小副业。
所以我就做了这个。希望大家用得开心,就像我制作它一样开心。
-Matt
21 分•作者: quaintdev•4 个月前
10 分•作者: joemasilotti•4 个月前
31 分•作者: surprisetalk•4 个月前
1 分•作者: mschrage•4 个月前
1 分•作者: aanet•4 个月前
1 分•作者: mellosouls•4 个月前
3 分•作者: billybuckwheat•4 个月前
1 分•作者: Kikobeats•4 个月前
1 分•作者: techbelly•4 个月前
1 分•作者: nvahalik•4 个月前
2 分•作者: lode•4 个月前
2 分•作者: shmeeny•4 个月前
1 分•作者: WMASTERW•4 个月前
113 分•作者: be7a•4 个月前
43 分•作者: sweis•4 个月前
152 分•作者: Ryan5453•4 个月前
3 分•作者: cousin_it•4 个月前
告诉我你最近的非人工智能项目,我来了解一下。