1 分•作者: DavidCanHelp•3 个月前
返回首页
最新
2 分•作者: nookeshkarri7•3 个月前
1 分•作者: PaulHoule•3 个月前
2 分•作者: jb_hn•3 个月前
大家好,我是 Justin,我们正在开发 agent-data:一个 CLI 工具,它让 AI 智能体能够访问实时结构化数据,而无需使用浏览器自动化。<p>这个想法源于我们希望让智能体(例如,OpenClaw、Hermes Agent)执行比仅仅整理日历或监控电子邮件更有用的任务。我们希望它们能够回答问题并采取行动,而这些行动依赖于及时的外部数据,例如,“你能帮我找到下个月从纽约到旧金山的往返航班选项吗?”<p>个人助理智能体似乎是维护用户偏好并根据这些信息采取行动的绝佳框架(例如,“Justin 讨厌早班飞机”,“如果中转时间不超过 3 小时,Justin 不介意中转”等),但现有的为助理提供可操作的外部数据的工具却出奇地有限。<p>例如,浏览器自动化可以工作,但通常速度慢、成本高且不稳定 [1]。<p>临时抓取在狭窄的案例中效果很好,但在大规模应用时可能会变得非常昂贵。<p>MCP 服务器可以在每次轮询时将工具模式注入上下文(增加 token 消耗),并且在设计上通常要么过于细粒度,要么过于粗略。<p>因此,我们围绕一个更简单的界面构建了 agent-data:让智能体能够在运行时发现正确的端点,通过 CLI 调用它,并获得紧凑的结构化输出。<p>例如,为了回答我之前的问题,一个智能体可能会使用:`agent-data call search-flights --origin_iata JFK --destination_iata SFO [--params]`<p>我们选择 CLI 设计是因为智能体已经很好地与 bash 配合使用。此外,命令可以组合、管道到文件,并且通常比现成的 MCP 更灵活。我们不想教智能体使用浏览器或学习新的 MCP 工具模式,而是希望给它一个更小、更可预测的界面。<p>当前版本支持:
- 针对航班、餐厅、RSS/博客 feed 和社交媒体 feed 等类别的实时数据端点
- 默认情况下输出结构化 JSON
- 端点发现,因此智能体可以“找到”相关功能,而不是默认情况下将大量工具加载到上下文中
- 专为智能体工作流程设计的 CLI 界面<p>目前还处于早期阶段,某些部分还有些粗糙,但我们每周都会添加新的端点并扩大现有端点的范围。<p>我们很想知道:您希望您的智能体能够访问哪些实时数据源?在您自己的智能体工作流程中,浏览器自动化、抓取、通用网络搜索或 MCP 工具在哪里失败了?<p>[1] <a href="https://news.ycombinator.com/item?id=48024859">https://news.ycombinator.com/item?id=48024859</a>
6 分•作者: pstomi•3 个月前
自 2022 年以来,我一直在开发 Dear ImGui Bundle,但这是我第一次在这里谈论它。它是一个围绕 Dear ImGui 构建的框架,用于在 Python 和 C++ 中构建交互式应用程序。它自带各种实用工具:绘图、图像检查、Markdown、节点编辑器、3D 小控件、旋钮、切换开关等。
[https://imgui-bundle.pages.dev](https://imgui-bundle.pages.dev)
现在,它也可以通过 pyodide 在浏览器中流畅运行:下面的游乐场是一个在您的浏览器中运行的 Python 应用程序(没有服务器,没有 JavaScript)。您可以在左侧编辑代码并单击运行。它甚至可以在移动设备上运行。
[https://imgui-bundle.pages.dev/playground](https://imgui-bundle.pages.dev/playground)
我非常热衷于提供帮助他人表达创造力的工具。这个项目旨在朝这个方向迈出一步,因为它有助于开发代码极具可读性和可修改性的 GUI。
它解决的一些目标包括:
- 将真正的 Immediate Mode GUI 引入 Python 和 C++
- 各种高质量的库:小部件、绘图、图像分析、节点编辑、markdown 渲染
- C++ 中的多平台应用程序:适用于 C++ 中的所有平台(桌面、移动设备、emscripten)
- 将 Python 应用程序部署到 Web
- 始终保持最新的高质量 Python 绑定(因为它们是自动生成的)
- C++ 和 Python 之间的平滑过渡(两者使用相同的 API)
我很乐意回答问题!
46 分•作者: atgctg•3 个月前
71 分•作者: cdrnsf•3 个月前
1 分•作者: surprisetalk•3 个月前
2 分•作者: georgestrakhov•3 个月前
1 分•作者: jeremyjoehewitt•3 个月前
一个长期从事 SaaS GTM(市场拓展)工作,并具备产品前瞻视野的人。刚接触基础设施,正在努力学习,请多多指教。
基于一个观点,即人类的审批最终需要更多地嵌入到有意义的人类/代理工作流程中,而不是完全自主(自从我们的“龙虾朋友”加入对话后,我正在艰难地学习)。我一直在问自己的问题是“我真的授权 ClaudeRod(我的龙虾)做这件事了吗?” 最近的新闻让我更加担忧。
我一直在尝试解决这个问题,但再次强调,我不是开发人员。我知道如何识别痛点并绘制通往解决方案的思维导图——我已经做了 20 年了。但我不知道我是否已经获得了足够的真实反馈来量化这个痛点。从研究中我看到了三种模式,希望得到任何/所有真实的反馈:
1. 运行前确认:代理提出,人类授权(快速手动点击),代理执行。从审计追踪的角度来看似乎合乎逻辑,但会扼杀流程。
2. 事后通知:代理行动,并提供一个短暂的“撤销”窗口,就像 Gmail 一样。摩擦力较低,但不太实用——对于不可逆转的操作毫无用处。
3. 预先授权范围:人类设置护栏——“你本周可以向我的潜在客户列表发送电子邮件”——代理在护栏内自由工作。操作记录会根据最初的授权进行记录。似乎太模糊了...
我的直觉是不为这个问题定义一个“一刀切”的逻辑。根据操作类型进行不同级别的授权。
再说一次,我是一个新手,坦诚地说,你们告诉我这根本不是什么大问题,不值得解决,我也没关系。我一生中有很多疯狂的想法被否决——我的脸皮很厚。
如果这确实是一个问题,你们实际在部署什么?我是否遗漏了失败模式?你们的审批层是什么样的——在代理、基础设施或其他地方?工作流程中的阻力是否值得安心?
感谢任何/所有反馈。我还有很多其他的想法,但这个目前是我的一个心头刺...
1 分•作者: yazgenai•3 个月前
1 分•作者: mfiguiere•3 个月前
2 分•作者: Brajeshwar•3 个月前
1 分•作者: enether•3 个月前
1 分•作者: roschdal•3 个月前
1 分•作者: barishnamazov•3 个月前
1 分•作者: SpyCoder77•3 个月前
4 分•作者: bsuh•3 个月前
2 分•作者: misaelzapata•3 个月前
面向 AI 智能体的本地优先长期记忆引擎 · MCP + HTTP + CLI · SQLite + sqlite-vec + FTS5 · 100% 本地,无云
43 分•作者: speckx•3 个月前