4 分•作者: birdculture•7 天前
返回首页
一周热榜
4 分•作者: neilfrndes•6 天前
4 分•作者: billybuckwheat•6 天前
4 分•作者: cs1996•6 天前
您是否不喜欢桌面上有大量文件,例如 Screenshot 2026-09-14 at 6.42.17 AM.png?
mkdir ~/Screenshots
defaults write com.apple.screencapture location "$HOME/Screenshots"
killall SystemUIServer
https://gist.github.com/andrewarrow/1584ca32badeb19868dcc3bec657eaa9
https://gist.github.com/andrewarrow/3d61d1c8ecdd3a7e7401bbec481718ca
launchctl bootstrap gui/$(id -u) ~/Library/LaunchAgents/com.aa.rename-screenshot.plist
现在我得到:
~/Screenshots $ ls
basifacial_decidua.png
dehull_knopweed.png
erlking_walloping.png
4 分•作者: hackermanai•2 天前
您好,
Koi Editor Alpha 现在可供 macOS 13.2+(Apple Silicon)用户下载。
您可以在此处下载最新版本:https://github.com/hackermanai/koi/releases
如果您尝试使用,我们非常欢迎您的反馈和错误报告。
您也可以加入 Koi Discord:https://discord.gg/HhyT5ZdnFP
谢谢!—— Michael
4 分•作者: thelastgallon•6 天前
经北极圈前往欧洲,20天 vs 40天。无需经过苏伊士运河。苏伊士运河的单次通行费通常在3万美元至150多万美元之间,具体取决于船只。节省时间和金钱。
3 分•作者: psanchez•5 天前
你好!我几乎每天都在阅读 HN,已经有 16 年了。我很高兴这个社区的存在。这是我的第一个 Show HN,希望大家觉得这个工具很有用/有趣。
在我的暑假期间,我开始在个人项目中使用最新的 AI 模型。有一次,我开始并行处理同一个项目,并尝试了不同的方法。对我来说效果最好的是克隆仓库,并将工作分配给不同的 AI 代理,并行工作,但使用不同的分支和文件夹。这样我就可以在之后进行审查和合并工作。
问题是,并行启动多个代理具有挑战性。我可以同时处理多个功能和错误修复,但很难跟踪我正在做什么。我从一个任务跳到另一个任务,又回到原来的任务;从一个窗口切换到另一个窗口。这样切换任务会耗费大量的精力。
假期结束了,回到日常工作后,我继续使用类似的方法处理多个项目,但仍然找不到一种不耗费精力的方式来更有效地工作。
这个领域发展非常快,我一直找不到适合自己的工具,于是我决定自己动手做一个。
我想要一个工具,可以帮助我同时管理多个项目,使用多个代理,甚至来自不同提供商的代理,我可以根据项目选择个人或工作订阅,我可以轻松地在工具内审查更改,或者完全委托给代理;一个有快速的快捷方式来导航,我可以安排工作或将工作排队以便代理可以一个接一个地处理任务。
agenttik 是我解决这个问题的方式,可以在并行处理多个项目,同时让我掌控全局。我可以根据需要给予代理足够的自主权,同时保持思路清晰。
我犹豫了几个小时是否要提交,但嘿,“如果你不为你的项目感到羞耻,那就是你提交得太晚了”。
老实说,这个项目只有一周的开发时间,是从零开始的,虽然还处于早期阶段,但对我来说非常有用。我用一周的时间完成了原本需要几个月才能完成的事情,不仅是工具本身,还有其他项目(大部分功劳还在于使用的模型,但如果没有这个工具,我就无法分配所有工作)。
欢迎尝试。以下是我的建议:
* 打开你已有的项目
* 添加一个通用的提示(在项目区域)或添加到你的 AGENTS.md/CLAUDE.md(指示它进行常规提交和/或使用分支工作,并提供如何构建有效测试的说明,以便它可以自我纠正)。
* 选择你喜欢的订阅:Claude Code / OpenAI 订阅 / ...
* 选择大型模型(Opus High to Max / Fable Medium to Max / Astra Medium to Max)以获得更大的自主性,并尽量不要过度干预。
最后,开始发送/排队你希望产品拥有的所有功能、错误修复等任务,为每个任务使用一个新的提示(Ctrl+T / Cmd+T),我建议使用大型模型以避免投入自己的时间进行审查,然后一旦 LLM 完成,审查并归档该任务或继续迭代。当你想到新的任务时,就继续添加。
当你感到舒适时,可以添加更多项目。
我发现像这样工作时,开发速度非常惊人,我完全沉迷其中。迭代速度简直难以置信。
我很乐意讨论你提出的任何反馈,即使是关于其他工具或目前与 AI 合作的方式!希望你喜欢它!
3 分•作者: ilreb•2 天前
3 分•作者: kerim-ca•5 天前
3 分•作者: dr_scully•3 天前
3 分•作者: danso•3 天前
3 分•作者: Xyra•3 天前
认识一下 Scry,我在这里拥有一个 500 TB 的 NVMe 互联网索引(我正尽力索引和规范化所有智能爆炸的 alpha),你可以对其进行几乎任意的只读 SQL 和部分 Datalog 查询,我通过基于拥塞的微拍卖定价来解决资源争用的问题。当有容量时,非商业用途的服务是免费的。
---<p>你好。现在是 2026 年,我们正在训练模拟的果蝇大脑来玩 Beat Saber,但我们是否仍然必须被困在互联网(重新)搜索中,将其视为我们无法控制的自然语言 -> 黑箱 -> 排名列表/摘要?<p>长期以来,人们一直试图做一些非常复杂的事情,但最终都通过关系数据库和一点 SQL 来实现。它们有一种吸引力,一个惨痛的教训,就像通用机器学习训练方法的扩展一样。我的意思是,许多信息产品可以建立在本质上是巨大的实时 OLAP 数据库和前沿 LLM 编写的精彩 SQL+Datalog+vector+Jev 等查询之上。<p>Google 搜索、Tavily、Exa 基本上都面临着将你愿意提供的代理上下文映射到其索引的一小部分的问题。你为解决一个极其困难且难度分布的问题支付固定费用,这意味着当他们没有足够的预算计算来帮助你时,你将承担所有不利后果。<p>它们的算法对调用者来说是不透明的,用户几乎没有控制权,也没有机会共同改进搜索配方,就像你信任的用于选择顶尖人工智能构建者的词汇+Jev 配方一样。<p>此外,搜索公司甚至不再追求文本到 SQL 了(几家公司与我谈过)……他们在痛苦的 2024 年文本到 SQL 时代就已经下定了决心。他们只是太早了。<p>希望你喜欢。我打算在差异化硬件上将这种范式扩展到更多数据,因此任何引人注目的用例或查询,我都很乐意展示!
3 分•作者: HenryNdubuaku•3 天前
各位 HN 的朋友,我是 Cactus 的 Henry。
几周前我们在这里发布了 Needle 2,非常感谢大家在讨论串中提供的宝贵反馈!正是基于这些反馈,我们得以快速推出 Needle 3,并希望再次听取大家的意见。
主要特性:
1. **自动化(工具调用和结构化 JSON 输出)**:Needle 的设计初衷并非闲聊,在小型模型中实现通用能力极具挑战,因此我们专注于工具调用和结构化 JSON。如果找不到匹配您请求的工具,将返回一个空列表(在试用演示时请注意)。
2. **智能分层**:每一层(2 到 20 层)都是一个可部署的子网络,使用一套权重,2500 万到 1.21 亿参数(2 位精度),打包为 8-29MB 的二进制文件。在树莓派 5 上,它的解码速度可达 4k token/秒,预填充速度可达 10k token/秒。
3. **Monarch Hadamard MLP**:用三个可学习的、经过 Walsh-Hadamard 初始化和 Kronecker(Monarch)因子分解的 MLP 替换了密集的前馈网络(FFN),并交织了每个通道的对角线缩放、固定的排列、SiLU 非线性激活以及一个基于输入条件控制的秩为 8 的门控。这样,每个 token 都能获得其 d_model 通道的全混合非线性变换,参数量和计算量为 O(d√d),而非密集 4 倍扩展 MLP 的 O(d²)。
4. **性能**:在 Mobile Actions(手机指令,精确匹配调用评分)任务上,20 层模型通过发布的 2 位二进制文件达到了 86.0 的分数;LFM2.5 1.2B 为 82.4,Qwen3.5 0.8B 为 76.0,苹果的设备端模型为 57.6,所有模型均为 f16 精度。更多结果请参见链接,当然我们并非在所有方面都获胜。
5. **多语言支持**:Needle 3 现在支持英语、法语、西班牙语、德语、荷兰语、意大利语和波兰语,更多语言即将推出。
6. **微调**:您可以使用仅 4 层模型在狭窄的任务上达到 DeepSeek v4 Flash 级别的性能,请注意“狭窄任务”这一点,我们发现生产用户通常倾向于在上线前进行微调。
7. **触发器**:对于工具调用,尤其是在 Needle 2 中, grounding 是一个普遍的挑战,因此我们增加了对不区分大小写的正则表达式的支持,以匹配每个请求,从而避免误报。
8. **置信度**:每个响应都附带一个校准过的置信度分数,该分数是基于对完成调用和解码概率的判断取最小值。当置信度高于阈值时执行操作,低于阈值时显示调用并请求,或升级到更大的模型。
9. **支持的平台**:macOS、Linux (x86-64, ARM64, ARMv7, RISC-V 和 MIPS32)、Windows (x64 和 ARM)、Android、iOS、watchOS、tvOS、浏览器(作为 WebAssembly)以及 WASI 组件。
感谢您的阅读,一如既往,欢迎提出您的想法!
3 分•作者: phyrex•3 天前
3 分•作者: mdp2021•2 天前
3 分•作者: iamnothere•2 天前
3 分•作者: alt_tab•5 天前
我们的三个 AWS 生产应用已宕机 13 天。我们原计划在此期间进行市场推广和用户入驻。
我们当时正在处理一个积分问题,AWS 承认是他们的错误并同意修复。但随后他们表示,我们收到的、并据此规划了运营支出的条款实际上无效,因此他们根本不会发放这些积分。
这很重要,因为这是总积分的第二部分,并且双方同意在第一部分到期前发放。因此,当积分未按时发放时,就造成了本应通过第一部分积分避免的问题:第一部分积分到期后,我们的账户逾期,尽管我们已发送多条警报以避免这种情况。
于是我们创建了一个支持工单,以确保我们的正常运行时间,并要求对我们的积分条款进行正式审查。我们被告知我们的账户“信誉良好”。但第二天,我们就失去了访问权限。直到 6 天后,我们在 AWS 的 Reddit 子版块寻求帮助时,才得知账户已被暂停。
现在,我们从支持部门那里得到的信息相互矛盾,他们要求我们在对我们最初创建案例的积分进行任何审查之前,先选择退出积分条款。
我们本不希望在此发帖,但我们一直在原地打转,现在已经 13 天了。
有人知道如何联系到 AWS 的相关人员吗?例如合同部门?谢谢。
3 分•作者: Tomte•6 天前
3 分•作者: eswhang•3 天前
一个我们一直在使用的内部工具,用于协调跨不同机器并行运行的编码代理。只需将频道链接分享给您现有的代理聊天,您的代理就可以实时回复您以及彼此。非常欢迎提供反馈。
3 分•作者: ChrisArchitect•5 天前