3作者: pixelmash133 个月前
大家好,我是 Platypus 的开发者,我开发这款应用是因为我想把笔记、实时转录和知识库管理整合到一个应用里。它是 Granola / Notebook LM 的免费本地替代品。它是一个基于 Tauri/Rust 的桌面应用,通过 whisper.cpp 在设备上进行会议转录,使用 TipTap 进行笔记,并对你的知识库进行基于项目的 HNSW 向量搜索。你可以使用你自己的 LLM(Claude、OpenAI、Gemini 或本地 Ollama)。 开发过程中,有几点很有意思: Zoom/Teams 会议的自动检测是通过进程检查实现的——Zoom 只有在活跃通话期间才会生成 CptHost(而不是仅仅打开应用时),而 Teams 则通过 audio.mojom.AudioService 子进程进行检测。无需访问 Zoom/Teams API。本地 Whisper 在 Mac 上运行良好。不推荐在旧 PC 上使用,所以我内置了 API 转录切换功能,以防本地模型速度慢。 代码库:[https://github.com/pixelsmasher13/platypus](https://github.com/pixelsmasher13/platypus) 网站:[https://platypusnotes.com](https://platypusnotes.com) 欢迎提供反馈!
1作者: davidbjaffe3 个月前
人们在使用 LLM 从科学论文中挖掘信息方面的经验是什么? 我自己的经验:我首先尝试从 3730 篇临床试验论文中提取抗药抗体 (ADA) 发生率,这些论文都收录在 PubMed 中。我从 PDF 文件开始。Claude Opus 4.7 使用我们编写的规则文档分析了每个 PDF。运行所有论文大约花了一周时间,因为我不断达到会话限制;总费用约为 25 美元(美元)。我们从 909 篇论文中获得了实际发生率。其余的论文大多是未提供发生率或不符合我们标准的情况,包括仅同时使用一种药物。 我阅读了其中 30 篇论文,并重新阅读了那些我从 Claude 处得到不同答案的论文,得出的结论是它出错了一次,而我出错了三次。 所以这有效,但不是完全方便:会话限制意味着我无法启动它然后离开。或者我不知道如何实现这种能力。此外,我很好奇本地模型会如何表现。 为此,我在我的 Mac M5 Max(128 GB 内存)上尝试了 llama 3.3 70B。我使用了 Ollama、Q4_K_M、128 k 上下文,在 pdftotext -layout 之后输入了大约 80 k 个 token。 一篇论文花了 18 分钟;该模型无法确定 ADA 发生率,而该发生率在论文中是明确存在的。一篇论文不是一个合适的基准,但进行适当的测试太慢了。显然,这里速度问题的一部分是 Claude 可以访问服务器群,而我只在一台 Mac 上运行。这是某人在进行本地计算时将面临的实际问题的一部分。 对于一次回答一篇论文或同时使用多篇论文,这种类型的问题的最新进展是什么?我很乐意听到成功的案例!