1作者: CastleOneX5 个月前
我从事机器学习软件开发工作已有四年,很快就遇到了一个反复出现的问题:我总是问自己,“我为什么要把这个函数这样写?”或者“为什么这个代码块在这里?” 我尝试用Obsidian和其他笔记应用来整理我的思路,但说实话,为自己写文档感觉就像一项苦差事。文档总是感觉像是写给“别人”看的。 所以,我决定构建一个VS Code扩展,将我的推理和上下文记忆直接链接到代码片段、标签等。我甚至添加了一个优先任务列表,这样我就能确切地知道第二天需要处理什么。 结果呢?我从没用过它。 几个月后,我感到很失望。我觉得我把所有时间都浪费在了连我自己都觉得没用的东西上。 然后,智能体出现了。 与人工智能智能体一起工作是一次令人大开眼界的经历,但我遇到了一个瓶颈:“冷启动”问题。每次新会话都需要我从头开始解释所有内容。我尝试了MEMORIES.md、AGENTS.md和Claude的项目规则。具有讽刺意味的是,冷启动并没有像承诺的那样得到很大改善。一些基准测试甚至表明,当智能体被迫解析太多静态技能文件时,性能会变差,而另一些则仅显示了10%的微弱提升。 出于好奇,我决定实现一个本地MCP,这样我的智能体就可以自主使用Neurotrace了。 结果令人震惊。我没想到智能体真的会使用这个工具,但它们确实用了。我还没有正式的基准测试,但我可以自信地说,冷启动问题已经大大减少了。由于我使用了来自不同提供商的不同智能体,现在的“下一个”智能体确切地知道我们昨天进行到哪里了。它们决定保存哪些上下文记忆,而且它们做得出奇地好。我的工作流程得到了显著改善。 我很乐意听取您对智能体记忆的看法,或者您是否找到了更好的方法来处理上下文交接。 此致, Irwing Castro (CastleOneX) 您可以在以下市场找到它: ``` VS Code Marketplace: https://marketplace.visualstudio.com/items?itemName=BlackIronTechnologies.neurotrace Open VSX: https://open-vsx.org/extension/BlackIronTechnologies/neurotrace ```
2作者: Bleiglanz5 个月前
我本来对这东西的宣传嗤之以鼻,但 <i>阅读</i> 相关的文章和 <i>亲自体验</i> 之后完全是两码事。如果你手头有旧的代码库,不妨试试,你可能会大吃一惊。<p>我不确定我是否相信它对复杂、遗留的企业系统能长期实现“*提高 90% 的生产力*”,但对于样板代码、库、构建工具和重构来说?收益是巨大的。所有耗时、令人心烦意乱的事情基本上都被解决了。<p>一开始你会像鹰一样检查每一个差异,期望它会搞砸一切,但说实话,很快你就会发现大多数时候根本没必要。你只需保持 IDE 打开,并将“分析代码”的输出反馈给它。在 Java 中,告诉它“<i>添加 checkstyle,运行 mvn verify 并修复</i>”效果很好,你甚至可以去喝杯咖啡,而不是与代码检查器的警告作斗争。<p>理论上,剩下的就只有 <i>逻辑</i> 和 <i>想法</i> 了。当架构变得真正复杂时,我们拭目以待。但就目前而言,让它分支、创建样板代码,并在你迭代规范的同时编写一个简单的测试,效果出奇地好。只有当用纯英语写下规范太烦人时,你才会编写源代码。<p>这引出了一个真正的问题:如果你的竞争对手 Y 为了省钱而解雇了 90% 的开发人员,你会盲目效仿吗?还是你会保留你的团队,利用这个巨大的杠杆,用一个更好的产品来*碾压* Y?
6作者: latand65 个月前
在过去的几个月里,代理技能已经从一个冷门的 Claude Code 功能,变成了每个主要运行时都支持的东西。Anthropic 有一个官方的技能库。OpenAI 在 Codex 中发布了技能,内置了技能创建器。Karpathy 谈到“一切都是技能问题”,并将编写技能描述为代理的课程 [1]。格式正在趋于一致:一个包含 SKILL.md 文件的文件夹,可选脚本,可选参考文件。 改变的是模型已经足够好,能够可靠地遵循书面指令。一个技能只是一个经过测试的 Markdown 工作流程,代理读取并遵循它,而不是即兴发挥。你还可以捆绑代理在工作流程中运行的脚本,这涵盖了大多数人使用轻量级 MCP 服务器的目的,除了代理可以读取脚本源代码并扩展它。 Karpathy 谈到了“代理经济”,并表示我们应该停止为人类编写 HTML 文档,开始为代理编写 Markdown 文档 [1]。Anthropic 刚刚发布了一个技能创建器,可以对模型更新后技能是否仍然有效进行基准测试。GitHub 上已经有数以万计的社区技能。 分发仍然感觉处于早期阶段。大多数有用的技能都很小。一个 Markdown 文件,也许一个脚本。足够有用,可以重复使用,但不是任何人会将其变成一个带有 README 和安装说明的适当的 GitHub 仓库。所以它们仍然停留在单机上。 我一直在为我自己的代理编写技能,并且我一直在遇到这个问题。格式是有效的。但在机器之间移动它们或交给其他人则不行。 好奇其他人是否也遇到了同样的障碍,或者我是否遗漏了什么方法。 [1] <a href="https:&#x2F;&#x2F;www.youtube.com&#x2F;watch?v=kwSVtQ7dziU" rel="nofollow">https:&#x2F;&#x2F;www.youtube.com&#x2F;watch?v=kwSVtQ7dziU</a> (Karpathy 在 No Briars 播客上,关于技能的讨论大约在 1:03:40 处)
3作者: rokgregoric5 个月前
嗨,HN, 我喜欢把活动监视器放在我的程序坞里,但默认图标总感觉不太对劲。虽然它在技术上显示了活动情况,但在视觉上,它感觉不像是 macOS 的一部分——更像是一块原始的画布,而不是一个合适的系统图标。 所以我重新设计了它。 同样的应用程序,同样的数据——只是一个看起来和行为都像原生 macOS 组件的程序坞图标,并带有一个清晰、易读的 CPU 图表。 没有新功能,只是修复了它的外观和感觉。 好奇其他人是否也注意到了这一点,或者这从来没有困扰过你。 <a href="https:&#x2F;&#x2F;x.com&#x2F;rokgregoric&#x2F;status&#x2F;2035638066853908844?s=20" rel="nofollow">https:&#x2F;&#x2F;x.com&#x2F;rokgregoric&#x2F;status&#x2F;2035638066853908844?s=20</a> <a href="https:&#x2F;&#x2F;x.com&#x2F;rokgregoric&#x2F;status&#x2F;2035641264461304028?s=20" rel="nofollow">https:&#x2F;&#x2F;x.com&#x2F;rokgregoric&#x2F;status&#x2F;2035641264461304028?s=20</a>