2 分•作者: xwil•大约 2 个月前
我一直在寻找一种方法,可以将 AI 代理添加到我维护的多个系统中。 我有一些要求: * 我使用多种编程语言工作,所以它需要适用于所有这些语言。 * 我可以控制工具如何访问我的系统。 * 我可以覆盖代理循环,尝试不同的模式。 * 我可以迭代代理循环,而无需处理持久性、流式传输以及其他繁琐的细节。 * 我可以在部署前进行本地迭代。 * 我可以自托管。 市面上没有适用于多种编程语言的解决方案,所以我自己构建了一个。 它不是一个 SDK。它是一个服务器,负责处理持久性、流式传输、MCP 连接、LLM 调用以及连接到 Slack 等渠道。 您可以通过处理 Webhook 来覆盖代理循环的每一步。 但您不必覆盖任何内容,甚至不需要处理 Webhook。您可以定义一个 TOML 文件中的代理,并在几分钟内通过 Slack 与您的代理聊天。 将其指向您的后端,以便在每个决策点接收 Webhook。引擎会发送当前步骤和一个建议的下一步。您可以回显建议以执行引擎的意图,或者您可以做其他事情来定制代理循环。 快来看看吧! https://github.com/substructureai/substructure https://substructure.ai/
2 分•作者: cameronnimmo•大约 2 个月前
我们是一家两人产品公司,我和我的联合创始人(他是一名产品设计师)在人工智能改变我们交付产品的方式时,一直在努力优化设计/开发流程。 存在几个相互关联的问题: 1. 随着我们加快速度,前端代码中由 AI 生成的比例越来越高,这意味着会出现更多细微的 UI 错误和不一致。这些通常是可以通过代理(agent)轻松解决的问题,但据我所知,针对现有中等规模代码库的代理编码工具往往以开发者为中心,设计师难以设置/使用。 2. 最初所有设计都在 Figma 中完成,但逐像素调整每个屏幕的感觉越来越冗余。所以理想情况下,我们只想依赖在 Figma 中构建的核心组件,然后通过代码实现它们。但当然,当我们想更改现有组件时,我倾向于直接在代码中实现更改,获得设计批准后就上线:Figma 从未更新,因此它几乎被弃用,而生产环境中实际的组件系统变得笨拙且不一致。 想知道是否有人遇到过这些问题,以及你们是如何解决的?以及更广泛地说,早期团队目前的设计/开发流程是什么样的?
4 分•作者: pcvetkovski•大约 2 个月前
各位 HN 的朋友们, 我是 Maxint 的创始人,我们刚刚推出了 Orca (<a href="https:&#x2F;&#x2F;orca.maxint.com&#x2F;" rel="nofollow">https:&#x2F;&#x2F;orca.maxint.com&#x2F;</a>)。 在将产品部署到 iOS、Android、Linux、MacOS、Windows 和 Web 平台后,我们遇到的一个主要障碍是盈利模式。当时没有标准化的商店、模式或架构来跨平台定义、集成和跟踪订阅、消耗品和非消耗品。 我们尝试了 RevenueCat 和 Adapty,但它们都仅限于移动端和 Web 端,而我们仍然需要在每个商店(Google PlayStore、Apple AppStore 和 Stripe)手动设置所有产品和权限。 这两个提供商都不支持 MacOS、Linux 和 Windows,我们在 GitHub 上提出的问题几个月都没有得到解决,而我们的用户只能在单个平台上使用他们的订阅。 这迫使我们构建了一个支持所有主流操作系统的盈利模式协调平台。我们在内部推出了它,至今已有 12 个多月,并对数千名用户进行了大量测试。今年早些时候,我们实施了一个 MCP 服务器,使我们能够使用内部代理与商店进行交互,设置产品并获得洞察。除了 Dart/Flutter,我们还增加了对 TypeScript、Swift 和 Kotlin 的支持,并且很快将推出更多 SDK。 现在我们向公众发布,您可以免费开始使用。 最后一点。我们取消了收入税,我在我们的博客上对此进行了详细分析,并非常希望您能就 Orca、我们的定价模式以及您在实施订阅方面的经验提供反馈。
2 分•作者: navels•大约 2 个月前
neal 是我在尝试使用 LLM 编码代理(在此案例中为 Codex GPT-5.4)自主完成我们大型前端代码库迁移项目时编写的一个命令行工具。在该项目中,有几个问题促使了 neal 的开发: 1. “持续工作直到遇到阻塞”这种指令在长时间运行时并不能真正奏效。 2. 大型项目应该被分解成更小的任务块。 3. 编码代理应该在每个任务块开始时使用全新的上下文,以防止上下文衰退。 4. 编码代理会受益于有一个不同的代理在过程中进行对抗性审查。 最终我构建了一个编排器,它: * 允许你配置规划者、编码者和审查者角色。我最初使用了 Codex 和 Claude 的 SDK,后来添加了 OpenRouter,并提供了一个兼容模式来验证模型是否能处理编排任务。目前有 44 种兼容的 OpenRouter 模型。 * 执行你通过规划者/审查者循环提供的计划,该循环将工作分解成大小适中的块,并格式化计划文档以便 neal 执行。 * 通过编码者/只读审查者循环执行每个任务块。一旦两个代理都满意,neal 就会继续处理下一个块。所有工作完成后,会进行一次最终的编码者/审查者循环,以确保实现满足整个计划。 * 在每个任务块中重置编码者的上下文以防止上下文漂移,而审查者的上下文则会长期保留。 迁移工作已完成(提交 549 次,添加/修改文件超过 3000 个)。我还通过 neal 运行了 100 个基准测试案例(来自 SWE-bench Pro),这些案例 Codex 无法独立解决。结果显示,在使用 neal 且 Codex 同时担任编码者和审查者角色时解决了 8 个案例,在使用 Claude 作为审查者时解决了 15 个案例。我原本期望有更令人兴奋的基准测试结果,但这至少证明了 neal 的价值,特别是将不同模型用于审查者角色时。 neal 是一个 npm 包,可以通过以下方式安装: ```bash npm install -g @navels/neal ``` 并通过以下方式进行配置: ```bash neal setup ``` 它适用于你的 Codex 和/或 Claude Code 订阅(只要这些 CLI 在本地已通过身份验证),或者通过 OpenAI/Anthropic/OpenRouter API 密钥。 我有一个关于 neal 功能及其由来更详细的介绍,发布在我的博客上:[https://navels.dev/blog/neal/](https://navels.dev/blog/neal/) 鉴于模型能力的快速发展,我不指望这个工具能长期保持非常有用,但我仍在将其作为我的日常工具使用,使用 Claude Fable 作为规划者/编码者,Codex Sol 作为审查者。如果你尝试了 neal,我很想听听你的反馈,特别是如果你有一个不太适用的用例,或者希望有更多可用的模型。
8 分•作者: alex000kim•大约 2 个月前
我能写出的最小的异步强化学习训练器:一个循环,在笔记本电脑上运行 CartPole 的 REINFORCE 算法,并在集群上运行异步 GRPO(例如,8 个 H100 训练器,8 个 vLLM 工作节点,作为 Kubernetes 上的 [SkyPilot 作业组](<a href="https:&#x2F;&#x2F;docs.skypilot.ai&#x2F;en&#x2F;latest&#x2F;examples&#x2F;job-groups.html" rel="nofollow">https:&#x2F;&#x2F;docs.skypilot.ai&#x2F;en&#x2F;latest&#x2F;examples&#x2F;job-groups.html</a>) 运行)。所有这些都不需要 Ray、TRL 或 DeepSpeed 等库,工作节点通过标准库的 HTTP 与训练器通信。
3 分•作者: azatom•大约 2 个月前
为什么它一直在变化,而最基本的问题却被掩盖了?<p>很久以前我就报告过这个问题,它被列入了待办事项或类似列表。这可能看起来是个小问题,但它会非常令人沮丧,而且修复起来很简单。<p>当水平滚动时,看不出字符还在那里,它们只是不可见而已。<p>https:&#x2F;&#x2F;i.postimg.cc&#x2F;C5bN0CQT&#x2F;vscode.jpg
1 分•作者: aurareturn•大约 2 个月前
API 错误:529 服务器过载。这是服务器端问题,通常是暂时的——请稍后再试。如果问题持续存在,请访问 https://status.claude.com 查看状态。