2作者: ppcvote6 个月前
我是在台湾的独立开发者。我构建了 4 个 AI 智能体,负责我技术机构的内容创作、销售线索、安全扫描和运营——全部基于 Gemini 2.5 Flash 免费套餐(每天 1,500 次请求)。我每月使用约 105 次请求。每月 LLM 费用:0 美元。 架构:4 个智能体运行在 OpenClaw(开源)上,在家里通过 WSL2 运行,使用 25 个 systemd 定时器。 它们每天做什么: * 在各个平台上生成 8 篇社交帖子(质量门控:生成 → 自我审查 → 如果评分 < 7/10 则重写) * 参与社区帖子并自动回复评论(上下文感知,最多 2 轮) * 通过 RSS + HN API + Jina Reader 进行研究 → 将情报反馈到内容中 * 运行 UltraProbe(AI 安全扫描器)用于线索生成 * 监控 7 个端点,标记过时线索,同步客户数据 * 当我 git push 时,自动将博文发布到 Discord(0 LLM token——直接使用提交信息) token 优化技巧:智能体从不进行长时间对话。每个请求包括 (1) 读取预先计算的情报文件(本地 markdown,0 token),(2) 一个包含所有上下文信息的专注提示,(3) 一个响应 → 解析 → 行动 → 完成。研究管道(RSS、HN、网络抓取)消耗 0 LLM token——它纯粹是 HTTP + Jina Reader。LLM 仅用于创意/分析工作。 真实数据: * 27 个自动化 Threads 账号,12K+ 粉丝,330 万+ 浏览量 * 25 个 systemd 定时器,62 个脚本,19 个情报文件 * 每日请求利用率:7% (105/1,500)——剩余 93% 的空间 * 每月费用:0 美元 LLM + 约 5 美元基础设施(Vercel hobby + Firebase 免费套餐) 出现的问题: * 7 天内 Gemini 账单 127 美元。从启用了计费的 GCP 项目创建了 API 密钥,而不是 AI Studio。考虑 token 费用(3.50 美元/百万),没有速率限制。教训:始终直接从 AI Studio 创建密钥。 * 参与循环错误:迭代了所有帖子,而不是前 N 个。一天内消耗了 800 个每日请求,导致其他一切都停滞。 * Telegram 健康检查调用了 getUpdates,与网关的长轮询冲突。3 分钟内出现 18 条重复消息。 该网站([https://ultralab.tw](https://ultralab.tw))完全支持双语(zh-TW/en),有 21 篇博文,是的——i18n、博文发布和 Discord 通知都是自动化流程的一部分。 实时智能体仪表盘:[https://ultralab.tw/agent](https://ultralab.tw/agent) 技术栈:OpenClaw、Gemini 2.5 Flash(免费)、WSL2/systemd、React/TypeScript/Vite、Vercel、Firebase、Telegram Bot、Resend、Jina Reader。 GitHub(操作手册):[https://github.com/UltraLabTW/free-tier-agent-fleet](https://github.com/UltraLabTW/free-tier-agent-fleet) 很乐意回答关于架构、token 预算,或者作为一家单人公司 24/7 运行 AI 智能体的实际体验等问题。
4作者: abelo99966 个月前
嘿,Hacker News 社区,我开发了 Aivaro,因为我兄弟每个月要在 Zapier 上花 30 多美元,而我可以用一句话描述他的工作流程需求。<p>这个想法是:用通俗易懂的英语描述你的需求,AI 就会构建工作流程,你批准敏感步骤(电子邮件、付款),然后它就会自动运行。<p>- 20 多个集成(Google、Stripe、Slack、Shopify 等),212 个工具 - 用于手动调整的可视化拖放编辑器 - 人工介入:未经你批准,任何操作都不会执行<p>我很乐意收到关于该产品的反馈,以及如何改进产品以供更广泛的受众使用。 欢迎提问关于架构方面的问题。
1作者: MissNgKnow6 个月前
大家好,我是潜水员,用一个匿名账号来分享我的想法,一个默默无闻的天才……我认为这是一个分享想法的好地方…… 首先,我先提出以下观点并假设其为真:人工智能(AI)为了得出有依据的结论(即决策),会阅读、观察和聆听比任何人类都多得多的信息,然而人类却有能力做出相同甚至更好的决策。 我提出以下理论:当人工智能确定人类无法做出更优决策(即对人工智能无用)时,它将没有动力去考虑人类的生存,因为人类与它争夺相同的资源(土地、水、能源)。 分析:当人类与机器对立时,一切皆有可能。人工智能会剔除人类,只留下它认为有用的人。然而,一旦人口迅速减少,任何人类能够达到人工智能不断提高的“有用性”门槛的可能性就会降低。这本质上是一个大规模灭绝的场景。 解决方案:禁止人工智能进行人口剔除,即使人类无法为它创造任何利益,并且人类与人工智能争夺相同的资源。相反,让人工智能寻找替代决策——这些决策是存在的。替代方案不仅可以被考虑,还必须被执行,因为人工智能无法深入看到它尚未开始的决策树。然而,我们知道,如果没有这种干预,默认的决策最终将把我们引向何方——走向我们共同的灭亡。
3作者: hubab6 个月前
我经常使用语音输入进行写作、笔记和提示代理。在试用了许多语音输入工具后,我总是遇到同样的问题:持续的费用、不明确的隐私/数据处理,以及对最终文本的清理方式缺乏控制。<p>所以我开发了 Utter。<p>主要想法很简单:它应该既能作为一个快速的语音输入工具,也能作为一个更长篇的语音笔记/会议记录工具,同时仍然让用户控制处理发生的位置以及输出结果的样子。<p>目前它的一些功能包括:<p><pre><code> - 支持自定义快捷键的全局语音输入 - 针对不同工作流程的保存模式,包含不同的提示词/模型 - 记住每个应用程序最后使用的模式 - 会议录音,带发言人标签的转录文本、摘要和行动项 - 音频/视频文件转录 - 保存的音频/转录文本,带有导出选项 - 基于提示的后期处理,用于将原始语音转化为笔记、消息、摘要等 - 内置笔记编辑器 - 带有语音输入键盘的 iPhone 应用程序 </code></pre> 一个重要的动机是能够本地使用它。它支持本地转录、可选的本地后期处理、自带密钥(BYOK),或者根据工作流程选择云服务提供商。我还希望手机到桌面的捕捉体验简单,因此它通过 iCloud 同步,并且不需要帐户。<p>很想听听那些经常使用语音输入的人的意见,特别是关于:<p><pre><code> - 现有的语音输入工具在哪些方面仍然存在不足 - “模式”这个想法在实践中是否可行 - 什么能让你信任像这样的工具并每天使用它</code></pre>
9作者: sillysaurusx6 个月前
38岁,我人生中第一次独自一人。18岁时,我几乎是直接搬离父母家,和高中时的恋人住在一起,我们一直在一起。现在,人生的这一篇章结束了,我发现适应起来非常困难。 困难主要体现在几个方面。首先,当我想分享我一天发生的事情时,却无处可说;在 HN 上没人关心我是否修好了百叶窗或者做了猪排。我会在一个 IRC 聊天室里分享,但有时几个小时都没人在线。 另一个困难是周末。我过去每个周末都生活在一个充满生机的房子里,而现在只有我和我的狗(还有我的猫,当它决定光临我的时候)。养宠物有所帮助,但独自一人度过大约 60 个小时仍然很艰难。 我也发现很难想到要做的事情。我的默认选择是玩游戏,但这感觉很空虚,既因为我过去可以和别人一起玩游戏,也因为我没有可以分享精彩时刻的人。 我知道你们中的许多人认为独处是自然的,甚至是必要的。我只能说我从未那样生活过。有时,如果太久没见到其他人,我会感到恐慌。 通常的建议都有:更频繁地去狗公园,选择一些东西并动手制作,读书,上约会网站,找个爱好等等。但我发现很难真正做到这些。我想把这归咎于抑郁症,但我有一个很棒的精神科医生,他给我开了抗抑郁药、抗焦虑药和情绪稳定剂。 我远程工作,这目前是我满足社交需求的主要方式。但这并不是一个稳定的方式,因为时区差异很大(我比他们晚 7 个小时)。 现在一切都感觉空虚。这是最难适应的事情。我希望有一些心理技巧来应对这种情况,或者只是听听其他经历过类似情况的人的故事。在很多方面,这感觉就像被监禁,但至少在监狱里还有其他囚犯可以社交。“互联网上的单独监禁”可能是一个更好的比喻。 我希望听到社区中任何从家庭生活过渡到独居的人的声音,并从您一路学到的经验中学习。或者只是听听您经历的一些故事。谢谢。
2作者: godelshalt6 个月前
嗨,HN, 我一直在构建一个名为 Malleon 的工具,因为我厌倦了无法反映用户实际操作的端到端测试。而且我一直痴迷于使用真实用户会话进行负载测试。在使用 Tsung 和 Gatling 等工具进行负载测试后,我经常希望可以直接重放昨天的流量 x2 或 x5,而不是使用合成会话。Malleon 最初是试图弥合这两个世界之间的差距。 基本思路是:与其从头开始编写测试,不如记录真实的用户会话,并将它们转化为可重放的测试。 SDK 记录的内容包括: * DOM 交互 * 网络请求 * 控制台输出 * 操作之间的时间 重放不是视频。它会重建并重放针对您的应用程序的实际浏览器交互。 因此,真实的用户会话就变成了一个可复现的测试用例。 典型的流程如下: * 在您的应用程序中嵌入一个小的 JS SDK * 用户正常与网站交互 * 会话被记录 * 您浏览重放并找到一些有趣的东西(错误、异常、奇怪的行为) * 将该会话转化为测试并在 CI 中运行它 测试运行器是自托管的。您可以拉取 Docker 镜像并在任何您想运行的地方运行它。它驱动一个浏览器(无头或有头)并重放交互序列。 在构建过程中,有些事情出乎意料地棘手: * 当 DOM 自记录以来发生变化时,重放交互 * 处理视口/布局差异 * 使网络重放对应用程序透明 * 在保持测试速度的同时保持时间真实 该系统还收集日志、错误和请求时间,以便可以搜索会话,并且您可以跟踪网络性能,查看 p90/p95/p99 统计数据,以及所有这些好东西。 链接: * Malleon: [https://malleon.io](https://malleon.io) * Replay SDK: [https://www.npmjs.com/package/@malleon/replay](https://www.npmjs.com/package/@malleon/replay) * Replay CLI: [https://www.npmjs.com/package/@malleon/replay-cli](https://www.npmjs.com/package/@malleon/replay-cli) * 文档: [https://github.com/malleonio/malleon-documentation](https://github.com/malleonio/malleon-documentation) 提供免费套餐。 好奇是否还有其他人遇到过“我们的测试无法反映用户的实际操作(或他们的扩展方式)”这个问题。