1 分•作者: tosh•5 个月前
返回首页
最新
1 分•作者: nipponese•5 个月前
1 分•作者: paulpauper•5 个月前
1 分•作者: paulpauper•5 个月前
2 分•作者: peterjliu•5 个月前
3 分•作者: varunsharma07•5 个月前
1 分•作者: zacharykapank•5 个月前
Mozzie 最初是我为自己的工作流程构建的工具。
我喜欢同时处理多项任务,但大多数开发工具将工作流程分散在不同的地方:任务存在于问题跟踪器中,执行发生在终端中,上下文在它们之间丢失。我希望我的工作项及其上下文就在实际工作发生的地方旁边。
Mozzie 是一个本地桌面工作区,其中每个工作项都可以生成自己的终端或编码代理。这个想法是让任务成为主要界面——每个任务都保存其上下文,并且可以独立运行命令或代理。
这使得可以更容易地并行处理许多任务,而无需不断地在工具之间切换。
虽然还处于早期阶段,但我一直在每天使用它,它很适合我喜欢的工作方式。
好奇是否有人也喜欢这样工作或尝试过类似的东西。
1 分•作者: mooreds•5 个月前
1 分•作者: ColinWright•5 个月前
17 分•作者: vshah1016•5 个月前
大家好,我是 Veer,我的联合创始人是 Suryaa。我们正在构建 Cumulus Labs (YC W26),并且我们发布了我们的最新产品 IonRouter (<a href="https://ionrouter.io/" rel="nofollow">https://ionrouter.io/</a>),这是一个用于开源和微调模型的推理 API。您只需替换我们的基本 URL,保留您现有的 OpenAI 客户端代码,即可访问在我们自己的推理引擎上运行的任何模型(开源或针对您微调的模型)。
我们一直遇到的问题是:每个推理提供商要么速度快但价格昂贵(Together、Fireworks——您需要为始终开启的 GPU 付费),要么便宜但需要自己动手(Modal、RunPod——您自己配置 vLLM,并处理缓慢的冷启动)。这两种方案对于只想发布产品的团队来说都不合适。
Suryaa 在 TensorDock 建立了多年的 GPU 编排基础设施,并在 Palantir 建立了生产系统。我领导了太空部队和 NASA 合同的 ML 基础设施和 Linux 内核开发,这些项目中的堆栈必须在压力下真正发挥作用。当我们开始自己构建 AI 产品时,我们一直遇到同样的障碍:GPU 基础设施要么太贵,要么工作量太大。
因此,我们构建了 IonAttention——一个 C++ 推理运行时,专门围绕 GH200 的内存架构设计。大多数推理堆栈将 GH200 视为兼容性目标(确保 vLLM 运行,使用 CPU 内存作为溢出)。我们采取了不同的方法,围绕使硬件真正有趣的地方构建:一个 900 GB/s 的相干 CPU-GPU 链接,452GB 的 LPDDR5X 位于加速器旁边,以及 72 个您可以实际使用的 ARM 核心。
我们认为由此产生了三个新颖之处:(1)使用硬件缓存一致性,使 CUDA 图的行为就像它们具有零步成本的动态参数一样——这仅适用于 GH200 级硬件;(2)由不变性而非内存压力驱动的积极 KV 块写回,这使驱逐停顿从 10 毫秒以上降至 0.25 毫秒以下;(3)在小批量大小下进行幻影瓦片注意力调度,这在受影响最严重的区域将注意力时间缩短了 60% 以上。我们在 cumulus.blog/ionattention 上详细介绍了这些内容。
在多模态管道上,我们获得了比大型厂商更好的性能(在相同的 VLM 工作负载上,588 个 token/s vs. Together AI 的 298 个 token/s)。我们坦诚地说,p50 延迟目前较差(约 1.46 秒 vs. 0.74 秒)——这是我们正在积极努力解决的权衡。
定价按 token 计费,无闲置成本:GPT-OSS-120B 输入 0.02 美元/输出 0.095 美元,Qwen3.5-122B 输入 0.20 美元/输出 1.60 美元。完整的模型列表和定价请访问 <a href="https://ionrouter.io" rel="nofollow">https://ionrouter.io</a>。
您现在就可以在 <a href="https://ionrouter.io/playground" rel="nofollow">https://ionrouter.io/playground</a> 试用该游乐场,无需注册,或者放入您的 API 密钥并替换基本 URL——只需一行代码。我们构建这个是为了让团队能够看到我们引擎的强大功能,并最终使用相同的解决方案来满足他们对微调模型的需求。
我们很好奇您有什么想法,特别是如果您正在运行微调或自定义模型——这是我们投入最多的用例。有什么问题,什么会让它对您真正有用?
14 分•作者: Luka12-dev•5 个月前
嗨,Hacker News!我今年 13 岁,独自一人用 14 天的时间(每天大约 12 小时)构建了 Aurion OS,作为我的一个学习项目。
它是一个 32 位 x86 操作系统,完全用 C 语言和 x86 汇编语言编写,没有使用任何外部库。
它的功能包括:
* 自定义引导程序和内核
* VESA 帧缓冲图形(1920x1080,双缓冲)
* 带有可拖动、重叠窗口的窗口管理器
* 受 macOS 启发的、具有透明效果的 Dock
* PS/2 键盘和鼠标驱动程序
* ATA 硬盘驱动程序,带有文件系统
* PCI 总线枚举
* RTL8139 网络驱动程序(WIP)
* 实时时钟
* 仅需 16MB 内存即可运行(最多可同时打开 10 个窗口)
内置应用程序:终端(带 DOS 模式)、记事本(保存/加载)、计算器、画图(多种颜色和画笔大小)、贪吃蛇游戏、设置(主题切换)和系统信息。
目前在 QEMU、VirtualBox 和 VMware 上运行效果最佳。对真实硬件的支持仍在开发中。
下一个目标:TCP/IP 网络协议栈。
我很乐意接受任何反馈、建议或批评。这是我的第一个操作系统项目,在构建它的过程中我学到了很多东西。 欢迎回答任何技术问题!
9 分•作者: tzury•5 个月前
3 分•作者: scorchy38•5 个月前
嗨,HN,我是 Shubh,Raccoon AI 的联合创始人。<p>Raccoon AI 就像是网页版的 Claude Code 和 Cursor 的结合体。<p>这个智能体拥有自己的电脑,配备终端、浏览器和互联网,它在协作和自主性之间取得了恰当的平衡。<p>你可以在任务进行到一半时与它对话,在它运行时发送更多文件,或者干脆让它自己运行,然后回来查看完成的结果。<p>这是一款让你打开来尝试一件事,结果却花了两个小时的产品,因为你不断想到更多可以交给它的任务。<p>最让人们兴奋的是,会话可以跨越完全不相关的任务类型进行链式处理。你可以从市场调研(真实的引用、生成的图表)到原始数据分析(转储你的数据库,提问),再到一个完整的交互式应用程序,所有这些都在一个共享相同上下文的对话中完成。<p>它通过自动摘要拥有无限的上下文,这在 Ace Max 的加持下表现出色。<p>它连接到 Gmail、GitHub、Google Drive、Notion、Outlook 以及 40 多个其他工具。你还可以通过自定义 MCP 服务器添加自己的工具。<p>Raccoon AI 基于我们自己的智能体 SDK,ACE 构建,该 SDK 在 GAIA 基准测试中达到了 SOTA 水平,得分为 92.67。<p>简单介绍一下背景:我们是一个三人团队,大约在 1.5 年前开始构建有史以来最好的浏览器智能体,经过几次转型后,我们最终实现了这个目标,并且自 10 月以来一直在不断发布和发展。<p>很乐意深入探讨架构或讨论局限性,并期待收到反馈。<p>网站:<a href="https://raccoonai.tech" rel="nofollow">https://raccoonai.tech</a>
1 分•作者: kovallux•5 个月前
1 分•作者: tylerdane•5 个月前
2 分•作者: efenande•5 个月前
2 分•作者: LambdaAndLatte•5 个月前
几个月前,我们在这里发帖并收到了很多有见地的反馈。这是我们根据反馈构建的内容。<p>MoneyOnFIRE 回答了两个问题:你什么时候可以实现财务独立,以及你该怎么做才能最快地实现财务独立?它会运行一个涵盖收入、税收、账户、供款、回报和提款的财务模拟,然后生成一个优先行动清单,其中包含具体的金额、日期和步骤。<p>一些最大的改进直接来自于上次 HN 讨论中的评论:<p>租赁物业支持:引擎现在可以模拟租金收入、抵押贷款、增值以及房产如何与财务计划的其余部分交互。<p>情景建模:你现在可以并排比较不同的选择——较低的回报、更长的工作时间、调整支出——如何影响你的财务独立时间表。<p>无需登录:一些人不想创建账户或存储财务数据。你现在无需注册即可运行完整的计划。<p>财务独立 vs 提前退休:我们最初是为提前退休的人群构建的。反馈表明,它对任何追求更长时间财务独立的人都同样有用——计算和行动都是一样的。<p>同时发布的还有:支持多个孩子和大学时间表、罗斯转换梯、IRA 策略选择、保护伞和定期人寿保险规模调整,以及随着你的输入变化而更新的动态报告。<p>核心论点没有改变:个人财务是一个由相互作用的规则和计算组成的复杂网络。我们希望解决这个问题,并为每个人提供一套清晰、有序的行动方案,他们可以实际执行。<p>很乐意回答有关引擎或其背后的建模决策的问题。
1 分•作者: speckx•5 个月前
1 分•作者: gmays•5 个月前
1 分•作者: Cynddl•5 个月前