2 分•作者: sinan_tang•2 个月前
各位 HN 的朋友们, 今年我一直很想开始做播客,需要一种快速编辑视频的方法。我太穷了,付不起 Descript 的费用(而且作为一个喜欢自己动手造轮子的开发者,而不是专注于实际任务),所以我自己构建了一个本地版的 Descript,我称之为 Poddie。 Poddie 可以免费完成端到端的流程:它使用本地的 Whisper 模型生成文字记录,让你通过阅读文字记录并删除词语来进行编辑,自动修剪静音部分,并提供视频/音频/字幕导出功能,还可以选择性地将字幕烧录进去。如果你需要更精确的剪辑,还可以进行波形编辑。 我将它开源,以便其他创作者可以尝试并将其用于自己的工作流程。 非常欢迎任何反馈!
2 分•作者: afpx•2 个月前
仅供参考——如果您从 ChatGPT 导出数据,请务必验证导出数据。我几天前请求从 ChatGPT 导出数据,今天早上收到了 zip 文件,但 zip 文件中缺少消息。 我之所以知道这一点,是因为在请求导出之前,我手动下载了几次对话,手动下载的内容包含消息,但导出的内容却没有。我实际上让 ChatGPT 进行了第二次验证,它也确认了消息丢失。 我让 ChatGPT 生成了一份报告,显示了导出完整性问题的具体证据,而不仅仅是标题或格式上的差异。然后,我尝试通过 help.openai.com 上的聊天提交报告,但聊天完全停止响应。 作为背景信息,丢失的线程内容完全是良性的(关于拉比犹太教历史发展的讨论),因此这似乎是一个技术性数据完整性错误,而不是审核或过滤的选择。其他人是否注意到最近 OpenAI 导出数据中存在丢失的情况?
2 分•作者: baileywickham•2 个月前
这是一个我在学习 Jax 时进行的副项目。我注意到很多神经网络的数学运算在 Lisp 语法中会很奏效,因为大部分数据以“函数式”的方式流经各个层。数据一次只通过一个层,每个层都与前一个层组合。 Jixp 是我为了学习 Jax 而设计的学习工具,可以用来尝试不同形状/风格的模型。我用它在我的 Obsidian 库上训练了一个拥有 400 万参数的模型,看看是否能用于信息检索,结果部分奏效。 ```lisp (let-dim (d 256) (heads 8)<p>(define transformer-block (chain (residual (layernorm d) (attention d heads #:causal)) (residual (layernorm d) (mlp d [4d] d #:bias)))) ``` Jixp 编译器读取(Racket 风格的)DSL 并输出 Python 代码,然后通过你正常的 Python 训练栈进行消费。这样做的好处是,你可以用一个非常简单的接口来描述你的模型,而实现细节则大部分隐藏在生成的 Python 代码中。 我绝对不建议将此用于学习以外的任何用途。 总有一天,我可以看到模型以这种 DSL 的形式进行指定,这将允许不同的推理/训练实现加载相同的模型。你可以编写一个模型定义,然后 vLLM、PyTorch 和你的自定义推理栈都可以使用相同的定义。有点像模型的 `.safetensor` 文件。
2 分•作者: didriksg•2 个月前
我最近买了一台新的 1440p 显示器,并将其连接到我的 Mac 上,但在原生分辨率下,用户界面感觉非常小而且陌生。我对 Mac 整体来说还比较新,所以我检查了缩放选项,但很快了解到(据我所知)外部显示器没有这个功能。我在 BetterDisplay 和 Lunar 中找到了一些选项,但觉得为一个应该包含的功能付费很愚蠢。FreeDisplay 似乎是完美的选项,但当我尝试在我的 Mac 上使用它时,对我来说不起作用。开发似乎停滞不前,所以我没有提交 PR,而是分叉了它并进行了修复。之后,我想做一些更改并添加一些功能,结果却进行了一次完整的重写。 它涵盖了我最初想要的功能,即 HiDPI,但我还希望它看起来像原生一样,所以我添加了一些原生元素。我保留了显示器排列器,并修复了许多问题,例如自动和组合亮度、显示器配置文件、预设等。 可以使用 brew 安装(brew install --cask didriksg/tap/crisp)或使用仓库中 releases 中的 dmg 文件。不过它没有签名,所以你可能会收到一些警告。 我使用它已经一周了,所以我想与任何需要它的人分享。开源且欢迎 PR。