2作者: easygenes4 个月前
作为愚人节项目,我做了这个东西。<p>我(讽刺的是,取决于你的喜好)使用了一个 AI 裁判来给 2010 年以来每一篇顶级的 HN 帖子及其顶级评论打分(超过 30 万个独立判断!),并创建了一个带有历史图表的漂亮界面。<p>评分基于帖子和顶级评论表现出的 AI 悲观情绪的程度。你可以使用该分数来只显示(在“末日模式”)或隐藏(在“平静模式”)所有末日言论。<p>这既是玩笑,也部分是为了解答我自己的好奇心,即我感觉评论和帖子在过去一年里对 AI 变得越来越过分消极,并且只关注 AI 带来的最坏结果,这种感觉是否真实。<p>趋势非常明显。我的直觉得到了分析的证实;对 AI 的不满悲观情绪在过去几周达到了历史最高点,并且自 ChatGPT 发布以来,有望继续以每年翻一番的速度增长。<p>历史图表位于页面底部。
1作者: reidgoodbar4 个月前
我开发了 Squire,一个 CLI 工具,用于在干净的远程运行时中运行简短的验证和卸载任务。 主要想法很简单:不要把你的笔记本电脑变成测试平台。 它适用于以下场景: * 跨环境验证 * 测试 / 检查 / 编译循环 * SQL 沙盒检查 * 短时高负载任务,如数据 / 媒体 / 浏览器任务 一个简单的例子: `squire verify --lang bash --targets alpine-3.20,ubuntu-24.04,debian-12 --file script.sh` 安装: `curl -fsSL https://squire.run/install.sh | bash` `squire login` 网站:[https://squire.run/](https://squire.run/)
1作者: aadyachinubhai4 个月前
大多数 CUA 框架要么是黑盒,要么是缺乏结构的原始工具调用。Orbit 则介于两者之间,它通过自然语言控制屏幕,并允许 Python 控制流程。每个步骤都有其自己的模型、预算和类型化输出,但在整个会话中共享上下文。在每个步骤中混合使用廉价和昂贵的模型,从任何屏幕中提取结构化数据到 Pydantic 模型,并在代理遇到困难时在中途引导它。Orbit 基于操作系统辅助功能树构建,而非截图。 <a href="https://github.com/aadya940/orbit" rel="nofollow">https://github.com/aadya940/orbit</a>