2 分•作者: ynac•3 个月前
返回首页
最新
37 分•作者: gumby•3 个月前
12 分•作者: pancomplex•3 个月前
各位 HN 的朋友们!我们构建了一个浏览器内嵌代理,它运行在一个已认证的 Web 应用中,能够观察该应用如何调用自身的 API,并自动将这些调用转化为代理工具。你可以将其理解为一个自动生成的 MCP 服务器,并且会随着宿主应用的变更而自我更新。
最终,这将是一个技能娴熟的 AI 助手,能够以最小的努力深度集成到任何产品中(而不仅仅是聊天和 RAG)。
请查看下面的简短演示,它们展示了该代理在您可能熟悉的一些软件中的应用:
* Jira: https://demo.frigade.com/hn?skill=jira
* Spotify: https://demo.frigade.com/hn?skill=spotify
* Hacker News (哈哈): https://demo.frigade.com/hn?skill=hackernews
* 完整演示: https://demo.frigade.com/hn?skill=full-demo
正如您在示例中看到的,您可以比通常通过点击操作做得更多(也更快)。而且我们甚至没有接触过这些产品的源代码!
为什么要做这个?
理想情况下,每个应用程序都应该有一个 MCP 服务器或一个易于理解的 API,供 AI 代理从中获取信息。实际上,我们发现即使是非常现代化的软件,也往往拥有一个由混乱的 API 和服务组成的“蜘蛛网”,AI 代理根本无法开箱即用。安全性也成为了一个巨大的问题,因为应用程序在如何保护端点方面有不同的(通常是自制的)标准(JWT/Cookie/两者的混合)。最后,让一个实际的浏览器代理代表用户进入并使用应用程序(即计算机使用)是极其脆弱、缓慢且会消耗大量 token 的。
我们利用了我们现有的浏览器代理,它已经能够使用和学习已认证的应用程序,并增加了一个额外的步骤,可以自动将应用程序的已认证 API 转化为“食谱”。一个食谱是以下内容的组合:
* API 端点 + 方法
* 认证方法(以及如何检索刷新认证 token/Cookie)
* 响应模式
* 输入模式(用于 POST/PUT)
* 对工具功能的易于理解的描述
将所有这些整合在一起,它们就成为了 LLM 的可重用工具,而且无需编写或维护任何代码。即使 API 发生变化,我们的代理也能发现并用更新后的版本替换工具的食谱。
通过这种方式,为 AI 代理添加工具变得超级简单:
* 我们的代理学习应用程序并构建食谱。
* 应用程序所有者从我们的仪表板中启用已发现的工具。
* 代理现在可以直接在应用程序内代表用户执行操作。例如,说“邀请我的队友加入我的工作区”将安全地调用现有的用户邀请 API 端点,而无需通过第三方进行代理或中继。
当然,在尝试这样做时会遇到大量的边缘情况——尽管存在许多“标准”,但每个应用程序本质上都是不同的。有趣的事实是:在标准化食谱方面,GraphQL 是迄今为止最难处理的 API。
期待您的反馈/评论!
2 分•作者: wl1973•3 个月前
Aside 是一款辅助思考的工具。它能帮助你捕捉、连接和深入探索你的知识。你还可以选择让 AI 代理在整个过程中为你提供帮助。
2 分•作者: kuberwastaken•3 个月前
5 分•作者: timliu9•3 个月前
6 分•作者: asadeddin•3 个月前
我们今天将开源 Sighthound,这是一个基于规则的静态安全扫描器。它的特别之处在于它使用 Rust 编写,并以 tree-sitter 作为其抽象语法树(AST),因此速度非常快且易于扩展。
为什么要在 2026 年构建另一个扫描器?我们希望改进一些检测结果,但注意到当前开源扫描器(如 Semgrep/Opengrep)存在一些采用上的限制,例如它们是用 OCaml 编写的,添加语言解析器需要大量工作,并且规则集采用不同的许可方式,需要付费才能使用。我们还觉得许可方式在倒退而不是前进。
我们想要一个速度非常快、易于扩展且拥有我们能使用的强大规则集的工具。这促使我们选择了 Rust 和 Tree-sitter,因为它们都速度很快,并且拥有广泛的社区支持,使得扩展 Sighthound 变得自然而然。
我们希望它专注于源代码漏洞类别,如 SQL 注入和 XSS。目前市场上已经有很多优秀的解决方案,所以我们还没有进行任何敏感信息扫描。目前,Sighthound 支持 Python、JS/TS、Java、Go、C#、HTML、PHP 和 Ruby。
我们还有很多工作要做,因此非常欢迎您的反馈和贡献,无论是添加新语言、新规则还是修复错误。
12 分•作者: TheYahiaBakour•3 个月前
大家好,我是 Yahia。
我创建了 Context.dev (<https://www.context.dev/>),旨在让将网络数据集成到您的产品和代理中变得非常容易。
这是演示视频:<https://www.tella.tv/video/build-faster-with-context-dev-apis-2cgl>
由于这是一个 API,以下是文档:<https://docs.context.dev/quickstart>。
您可以向我们发送一个 URL,然后获得干净的 Markdown、渲染后的 HTML、屏幕截图、提取的图像等。您还可以向我们发送一个域名,获取公司或品牌信息:名称、描述、徽标、颜色、字体、社交链接、屏幕截图、样式信息以及相关元数据。对于更定制化的用例,您可以发送一个 URL 和一个 JSON Schema,让我们从中提取结构化数据。例如,您可以要求提取定价计划、产品类别、办公地点、支持链接、集成合作伙伴,或者任何公开网站上可见的信息。
我们的目标是为开发者提供他们真正想要的结果。原始 HTML 很少有用;通常有用的是用于模型的 Markdown、用于应用程序的 JSON、用于 UI 的徽标,或者用于代理的结构化公司资料。
此前,我在 Amazon 和 Sunrun 工作,并联合创办了 StockAlarm.io 和 essense.io,这两家公司均已被收购。我还创建了 knifegeek.io,它抓取了互联网上的折叠刀信息并方便地列出。该项目现在已过时(即将回归),但当时它曾登上 Hacker News 的首页,并且人们似乎很喜欢它:<https://news.ycombinator.com/item?id=34604281>。
在创建 Context.dev 之前,我创建了 Brand.dev。其理念是,当客户使用公司邮箱注册时,您的软件产品应该自动了解您的客户。该 API 从公开网络抓取品牌数据,如徽标、背景图、名称、描述、行业等,并将其呈现给您的产品,作为其入驻体验的一部分。这样做很有价值,因为当您从“输入所有这些信息”转变为“确认所有这些信息”时,入驻转化率会显著提高(而且没有任何隐私问题,所有信息都是公开的)。
这是一个很小的细分市场,但随着客户使用的增多,我发现“品牌数据”只是一个更大需求的一个方面。人们开始要求提供屏幕截图、结构化提取和 LLM 就绪数据等功能。因此,我扩展到了 Context.dev,并申请了 YC(面试后被拒绝),然后继续努力并重新申请,最终以独立创始人身份被录取。
人们使用 Context.dev 的方式多种多样,我无法一一列举,但以下是一些例子:为聊天机器人保持客户网站上的上下文信息最新;为客户构建精美的品牌资产/广告;使用 eve.dev 等代理框架进行数据丰富;将客户网站爬取到聊天机器人知识库中;将 GitHub 仓库转换为品牌文档站点;爬取学术期刊和 PDF。您可以在 <https://www.context.dev/customers> 上找到更多示例。
我们知道许多爬虫的行为并不像“网络好公民”,整个领域因此声名狼藉。同时,客户通常不是在购买“抓取”。他们试图让支持机器人正常工作、个性化入驻流程、丰富 CRM 记录、生成文档、监控潜在客户,或者让代理研究一家公司。有很多合法的用例。我们希望在满足这些需求的同时,尊重所有相关方。
我们维护一个缓存层,并避免过度访问网站。客户可以配置缓存,但如果我们发现我们在一定时间内向某个 URL 发送了过多的请求,我们会介入并放缓速度。网站可以选择退出我们的服务,我们尊重这些请求并将它们添加到我们的阻止列表中。
我们专注于希望为用户构建酷炫事物的客户。丰富入驻流程是一个流行的用例。集成关于他们自己网站的上下文(例如支持机器人)以及构建能够自动推理涉及互联网的复杂任务的代理也是如此。
我们只允许客户使用品牌数据来识别其软件中的特定客户,您不能在您自己的材料中使用它或暗示认可。
我很乐意在评论中听到您对该产品的反馈,谢谢!
86 分•作者: andai•3 个月前
3 分•作者: skyq•3 个月前
3 分•作者: rrotaru•3 个月前
4 分•作者: carlosjimenez1•3 个月前
Show HN:Claude Code、Cursor 和 Codex 的运行时授权
大家好,Fernando 和我开发了 Kastra。Kastra 会拦截 AI 代理的工具调用,并在执行前根据确定性策略进行评估。这主要面向使用 Claude Code、Codex、Cursor 和 OpenClaw 等编码代理的开发者。
我们开发 Kastra 是因为我们有一个 Cursor 代理差点对生产数据库执行了 `DELETE FROM customers WHERE status='test'` 命令。虽然我们在它执行前就阻止了,但这让我们意识到,我们堆栈中没有任何东西能够真正决定代理可以做什么。对我们来说,重要的是我们意识到,如果不是我们主动监控,我们现有的设置将无法阻止这种情况发生。大型语言模型是概率性的,提示会影响行为,但它们并不能确定性地决定代理可以做什么。没有确定性的策略系统,就无法决定它被允许做什么。
Kastra 在操作执行前会推送一个允许、暂缓或拒绝的决策。您可以通过 Web 应用以纯英文构建这些策略。拦截引擎会评估每次操作的工具、目标和参数。我们还发布了许多策略包,涵盖了常见的、高风险的场景,并且每个决策都会被记录在不可变的审计日志中。桌面应用、CLI、仪表板和 Recon 扫描对开发者免费。
如果您经常使用 Claude、Codex、Openclaw 和 Cursor,Kastra 可以运行一个扫描命令,检查您的代理已经执行过的风险操作,并自动构建规则以避免它们再次发生。Recon 是 Kastra 的一项功能,可以扫描您的本地代理历史记录。要运行此扫描,请在您的编码代理中执行以下命令:
```bash
brew install kastra-labs/tap/kastra-edge
kastra-edge scan
```
扫描会读取您本地的代理会话历史记录,并显示您的代理之前已经执行过的所有风险操作、写入受跟踪文件的敏感信息、访问过的生产数据库、强制推送、curl-to-shell 等等。这在您的本地机器上运行,敏感信息绝不会离开。在我们自己的使用案例中,我们不断发现我们忘记的或不知道代理已经做过的事情。
每个发现都可以转换为运行时策略,让您在不信任模型本身的情况下将更多工作委托给 AI。Kastra 在运行时拦截所有工作负载,并确保这些策略评估通常在毫秒内完成。与其信任模型,不如信任控制其操作的确定性规则。
我们仍在努力改进堆栈的一个问题是如何管理具有冲突策略的代理团队。我们非常欢迎任何构建多代理系统的人提供反馈。Fernando 和我将审查评论。我们非常好奇您的第一次扫描会发现什么。请在下方发布结果,以便我们了解最常见的模式,并根据您的反馈调整我们的策略包。
文档:
[https://kastra.ai/docs](https://kastra.ai/docs)
macOS Kastra Edge 下载:
[https://kastra.ai/edge/download.html](https://kastra.ai/edge/download.html)
立即查看 Kastra 的实际运行效果:
[https://www.youtube.com/watch?v=6TUETu5lb3Q&feature=youtu.be](https://www.youtube.com/watch?v=6TUETu5lb3Q&feature=youtu.be)
49 分•作者: mzur•3 个月前
19 分•作者: lwhsiao•3 个月前
16 分•作者: sbrown12•3 个月前
我父亲被诊断出患有 III 期肾癌后,我的家庭陷入了混乱。寻求第二意见、规划手术、确保保险覆盖、应对恐惧。这一切都需要时间来消化。
在处理所有医疗事务的同时,我意识到我们家人竟然没有人能回答以下问题:
- 他是否有医疗指示?
- 如何触发他的寿险保单?
- 他的遗嘱在哪里?谁是遗嘱执行人?
- 存在哪些银行账户和信用卡?
- 哪些账单不是自动支付的?
- 这些账单的到期日是什么时候?如何支付?
这些问题不是密码管理器或预算应用程序能解决的。所以我构建了它。
LastShelf:在紧急情况下自动发现、记录和分发关键生活文件、开支和联系人信息。在此注册:<a href="https://www.lastshelf.ai/" rel="nofollow">https://www.lastshelf.ai/</a>
如果您经历过类似的危机,我非常想听听什么能让这个过程变得更容易。
任何与我分享反馈的人都将获得第一年的免费使用权。请发送邮件至 support [at] lastshelf.ai。
4 分•作者: bjoernm•3 个月前
大家好,我是 FormGrid 的 Björn。我觉得最近的网页变得过于标准化和模板化了,所以我开发了一个工具,可以让你创建更具个性的表单和微型网站。
最终的效果可以多种多样,例如:
* 命令行界面 (CLI):[https://share.formgrid.com/templates/sgNeeDu1AUYn2S5d](https://share.formgrid.com/templates/sgNeeDu1AUYn2S5d)
* 像素艺术:[https://share.formgrid.com/templates/TVsBQkwkg4fx3OW0](https://share.formgrid.com/templates/TVsBQkwkg4fx3OW0)
* GeoCities 风格:[https://share.formgrid.com/templates/TZzJNLkfJqR72N95](https://share.formgrid.com/templates/TZzJNLkfJqR72N95)
* HN 风格:[https://share.formgrid.com/templates/QxO3deyBTnDBI8MW](https://share.formgrid.com/templates/QxO3deyBTnDBI8MW)
这些示例是我自己创建的,但它也可以根据提示生成完全自定义的表单(内容 + 主题 + 逻辑)。
编辑器的工作方式就像写文档一样,支持 Markdown 和斜杠命令。布局是基于块的,并且非常灵活。逻辑块也内联添加。
我使用了 React 进行渲染,Vite 作为构建工具(构建单页应用 SPA),ProseMirror 用于表单编辑器,MobX 用于状态管理。
它是免费的,无需账户/注册。欢迎提问和反馈!
1 分•作者: mjbachhav•3 个月前
1 分•作者: smalltorch•3 个月前
1 分•作者: donatj•3 个月前
1 分•作者: dhimant•3 个月前