1 分•作者: dguioiutrdrtui•4 个月前
返回首页
最新
1 分•作者: ohjeez•4 个月前
2 分•作者: trey-orr•4 个月前
过去几个月我一直在开发 Pyra,现在想开始向公众分享它。<p>目前,它主要集中在核心的包/项目管理工作流程上:Python 安装、初始化、添加/删除、锁文件、环境同步,以及在受管理的env中运行命令。<p>我正在探索的更大方向是,Python 最终是否可以支持一个更具凝聚力的工具链故事,更接近于 Bun 的方向:不仅仅是打包,还可能随着时间的推移,测试、任务、笔记本和其他常见的工作流程工具,感觉像一个统一的系统,而不是一堆独立的部分。<p>现在还处于早期阶段,我当然不会声称它像 uv 那样成熟。我目前分享它,主要是想获得诚实的反馈,看看这个方向是否有趣或误入歧途。
2 分•作者: Locas•4 个月前
2 分•作者: geox•4 个月前
2 分•作者: spenvo•4 个月前
2 分•作者: samspenc•4 个月前
3 分•作者: taubek•4 个月前
2 分•作者: bitkin_dev•4 个月前
8 分•作者: aw1621107•4 个月前
10 分•作者: arjunchint•4 个月前
我们在 rtrvr.ai 中构建了 AI 子程序。只需录制一次浏览器任务,将其保存为可调用的工具,即可实现:零代币成本、零 LLM 推理延迟和零错误。
子程序本身是一个确定性脚本,由发现的网络调用组成,这些调用会命中网站的后端,以及页面交互,如点击/输入/查找。
关键的架构决策是:脚本在网页本身内部执行,而不是通过代理、无头工作者或进程外执行。该脚本从选项卡的执行上下文中分派请求,因此身份验证、CSRF、TLS 会话和签名标头都会被添加到所有请求中,并免费传播。无需安装证书,无需修改 TLS 指纹,也无需维护单独的身份验证堆栈。
在录制过程中,扩展程序会拦截网络请求(MAIN-world fetch/XHR 补丁 + webRequest 备用方案)。我们根据方法、相对于 DOM 事件的时间以及来源,对大约 300 个请求进行评分和修剪,最终保留大约 5 个。检测到易变的 GraphQL 操作 ID 后,会强制使用仅 DOM 备用方案,以防止它们在下次运行时静默中断。
生成的代码通过 rtrvr.* 辅助命名空间,将网络调用与 DOM 操作(点击、输入、查找)组合在同一个函数中。将代理指向一个包含 500 行的电子表格,只需一次 LLM 调用即可分配参数并启动 500 个子程序。
主要用例:
* 录制发送 IG DM 的过程,然后拥有可重用且可调用的例程,以零代币成本发送 DM
* 创建获取网站目录中最新产品的例程,调用它通过直接 graphql 查询获取数千种产品
* 设置例程以根据工具的参数填写 EHR 表格,AI 从当前页面上下文中推断参数并调用工具
* 每天重复使用例程,使用 MCP 服务器将 LinkedIn/Slack/Gmail 上的传出消息同步到 CRM
我们认为浏览器代理尚未普及的根本原因是,对于重复性任务,通过推理循环是多余的。最好只录制一次,并让 LLM 生成一个脚本,利用所有可能的方式与网站和更广泛的网络进行交互,例如直接调用后端 API、与 DOM 交互以及调用第三方工具/API/MCP 服务器。
41 分•作者: breve•4 个月前
1 分•作者: gkamradt_•4 个月前
1 分•作者: RickJWagner•4 个月前
1 分•作者: satvikpendem•4 个月前
1 分•作者: coderlovernine•4 个月前
1 分•作者: kingleopold•4 个月前
2 分•作者: baristaGeek•4 个月前
1 分•作者: kitcar•4 个月前
1 分•作者: lucasduys•4 个月前