2 分•作者: yulkor•3 个月前
返回首页
最新
3 分•作者: HieronymusBosch•3 个月前
2 分•作者: abelgvidal•3 个月前
他13岁。他想追踪自己的蚂蚁群落——包括它们的生长、喂食、湿度以及其他指标。他自己构建了整个应用程序,其中一些功能得到了AI工具的帮助;我只是帮他把应用程序部署到了服务器上。非常期待您的反馈!
81 分•作者: minimaxir•3 个月前
68 分•作者: tartoran•3 个月前
2 分•作者: cpard•3 个月前
大家好。我想分享一个对我来说意义重大的项目。fenic 是一个数据框 API,将大型语言模型(LLM)作为一等公民加入,这是一个经典的惰性数据框 API,通过由 LLM 支持的新运算符进行了扩展。
这使您能够在同一上下文中处理结构化和非结构化数据。最重要的是,LLM 不是作为不透明的 UDF 黑盒集成的。它们被暴露为“语义”运算符,规划器可以与经典运算符一起对其进行推理。
(仓库中有示例和代码片段,展示了所有内容如何协同工作)
为什么要做这个项目?我是一名数据基础设施/系统人员。当 LLM 出现时,我看到的是一种新型计算,它改变了我们处理的工作负载的特性。我想尝试一下我们现有的系统如何吸收这些新的工作负载和计算类型,以及如何使开发者体验(DX)尽可能无缝,这就是为什么 UDF + 任意提示感觉过于麻烦。
为了妥善支持这一点,我们引入了一些非常棒的功能:
新的计划运算符。您不仅仅是向 LLM 发送提示。您可以使用诸如语义连接(semantic join)、语义映射和归约(semantic map and reduce)、语义过滤(semantic filter)等运算符。它们与经典运算符混合,并且由于规划器将它们视为真正的运算符而不是黑盒,因此它可以围绕它们重新排序工作。
类型化输出。有一种便捷的方式可以将语义运算符的输出直接转换为类型化数据框列。LLM 输出的 Pydantic 模式会变成一个类型化的结构化列,您可以对其进行解嵌套、展开等操作。
新的数据类型,如 Markdown 数据类型。Markdown 成为了与 LLM 共享信息的重要方式,尽管它最初是为了格式化文本以供展示而设计的。它承载着结构,并且能够像访问结构体或 JSON 类型一样访问这种结构,这增强了我提到的开发者体验。
异步 UDF。LLM 爆炸式增长带来的工作负载中一个更有趣的变化是,需要在管道中放入大量 I/O 密集型步骤:获取 API 响应、爬取网站等。异步 UDF 填补了这一空白,并且实现会为您处理其中的细微差别:并发、重试以及其他一切。
LLM 推理感知规划器和运行时。这是我最兴奋的部分之一,而且还有很多工作要做。目前:批次内的相同提示会折叠成一次模型调用,因此重复的提示成本为零 token;请求会根据每个提供商的 rpm/tpm 限制并发分发,并进行重试和回退;空值和空单元格会完全跳过模型;并且您会获得每个运算符的 token 和成本指标。还有一个可选的持久响应缓存,因此重新运行会跳过模型。
MCP 作为新的目录原语。就像注册视图一样,您可以将数据框管道注册为目录中的 MCP 工具。然后,fenic 会提供一个 MCP 服务器,该服务器以该管道作为工具的逻辑,并在您的数据上执行。
这些只是 fenic 在尝试将 LLM 融入我们的计算基础设施时所做的一些工作。还有更多,并且现有功能还有很多需要完善的地方。
我一直在使用 fenic 处理各种事情。在小型/个人方面,我用它来处理我的播客音频录音,并将它们转换成我可以研究的结构良好的元数据表。在更重型的方面,我将其用作代理工具,用于分析从 Pydantic Logfire 导出的代理跟踪,以发现评估(evals)并将它们转换成数据框管道形式的可重现构件。
```bash
pip install fenic
```
仓库:https://github.com/typedef-ai/fenic
文档:https://docs.fenic.ai
还有一个您可以与 claude code、codex 等一起使用的技能,以便在您最喜欢的代理编码环境中快速开始使用 fenic。
我很想听听您的想法、批评以及任何其他您想到的。
我很乐意回答问题。
12 分•作者: Rochus•3 个月前
77 分•作者: spwa4•3 个月前
2 分•作者: therepanic•3 个月前
77 分•作者: 01-_-•3 个月前
1 分•作者: doener•3 个月前
1 分•作者: NeedMoreCowbell•3 个月前
1 分•作者: felixaschultz•3 个月前
1 分•作者: aniketwattawmar•3 个月前
AI代理的可移植评估。
ECP是一个供应商中立的协议,用于跨框架、模型、评估平台和CI系统测试代理的输出、工具调用以及评估者可见的审计上下文。
1 分•作者: lougarou•3 个月前
各位 HN 的朋友们!我是 Lokhesh,在一家小型初创公司 Kurrent 担任产品和人工智能团队的成员。我们开发了 Capacitor,下面是它的诞生故事:
一天晚上,我们的工程主管 Alexey 让 Claude Code 在后台运行一整夜来完成一项任务。第二天早上,他的电脑自动更新了操作系统,他的会话也随之丢失。没有上下文,没有操作记录,什么都没有。他查阅了 Claude Code 的文档,了解了会话恢复和转录文件,并意识到这些转录文件中隐藏着大量通常看不见的信息:代理是如何推理任务的,每一次文件更改,每一次工具调用,每一个失败的命令和死胡同。这一切都是宝贵的财富!
这时他想到:“如果我的电脑坏了,我把这些都弄丢了怎么办?”然后又想:“如果我能和我的团队分享这些信息呢?” Capacitor 就这样诞生了。
Capacitor 将代理会话(提示、响应、工具调用、代码更改等)记录到一个事件存储(底层是 KurrentDB)中。每个会话都有一个唯一的 ID。你可以在任何代理、任何机器上恢复它,或者将其交给队友,而无需重新解释一切。
以下是我们使用 Capacitor 的一些场景:
* 重启后继续工作
* 出差时将会话从桌面电脑转移到笔记本电脑
* 记住我之前做过的事情(以及为什么和如何做的)
* 寻求第二意见(来自人类或代理)
* 与同事分享知识
* 解释代理编写的代码背后的推理过程
* 在我生病或请假时,将工作交接给他人
我发布这篇文章是希望从 HN 社区获得反馈,了解如何让 Capacitor 变得更好。哪些方面做得好?哪些可以改进?我们应该添加什么功能?
在这里获取:[https://capacitor.kurrent.io/api/auth/start?tier=free](https://capacitor.kurrent.io/api/auth/start?tier=free)
查看文档:[https://capacitor.kurrent.io/docs/getting-started/quickstart/](https://capacitor.kurrent.io/docs/getting-started/quickstart/)
注意:我们将 Capacitor 设计为一项云服务,以便于设置,但我们也乐于接受关于如何最好地打包它的建议。
1 分•作者: sega_sai•3 个月前
2 分•作者: RaSoJo•3 个月前
1 分•作者: BrokenCogs•3 个月前
1 分•作者: busymom0•3 个月前
不确定您是否会将 HN、Reddit 和 YouTube 视为社交媒体,但我想说,我最常使用它们。HN 由于纯文本形式,有一种非常宁静的感觉。
不过,YouTube 最近让我很烦恼,因为我的信息流里充斥着人工智能生成的垃圾内容、随机的短视频和我不感兴趣的频道,而且现在有太多的创作者使用人工智能生成的缩略图,它们看起来都很糟糕。
我不使用 Instagram、TikTok、Snapchat、Pinterest 等。但我知道我的女性朋友们很喜欢 Pinterest。
你们呢?
1 分•作者: jruohonen•3 个月前