Show HN:在 CPU 上以每秒 124 个 token 的速度运行 Gemma-4 26B,无需 GPU3 分•作者: arun-prasath•3 个月前我想知道一个 26B 的混合专家模型在没有 GPU 的台式 CPU 上能运行多快。单流(无损)速度约为 40 词元/秒,批量处理速度约为 124 词元/秒。令人惊讶的是字节预算:对于这个模型,你压缩的是输出头(占每个词元字节的 32%),而不是专家(占 16%)。文章中有带宽瓶颈和死胡同;代码库中有可复现的配方。很乐意回答问题。 代码库:https://github.com/arun-prasath2005/gemma4-cpu-moe
哪个AI音乐工具的工作流程最好?1 分•作者: melogen_studio•3 个月前我不太关心哪个模型能创作出“最好”的音乐,而是更关注整体的工作流程——编辑、导出音轨、修改等等。 到目前为止,你最喜欢的是哪个,为什么?
Show HN:Fiwano – WhatsApp、Instagram DM 和 Facebook Messenger 的统一 API1 分•作者: rmnbb•3 个月前大家好!想和大家分享我的项目,这个项目源于我自身的痛点。<p>如果你构建AI助手、CRM系统或任何自动化工具,并且需要通过WhatsApp/Instagram/Facebook私信进行访问,那么你一定知道集成这些渠道是多么痛苦。我试图让这一切变得更简单——通过Fiwano,你只需要构建一次集成,就可以覆盖这三个渠道。你不需要从Meta获取任何令牌,也不需要费力研究Meta开发者仪表板。<p>欢迎查看我们在GitHub上的Cookbook(操作指南)——我努力让文档用户友好且易于通过AI检索。非常期待大家的反馈!
展示 HN:Ekbatan – 面向事件驱动系统的 Java 持久化框架1 分•作者: unikzforce•3 个月前请访问网站了解该框架:https://zyraz-io.github.io/ekbatan/