2作者: pejmanjohn5 个月前
我构建了一个开源技能,它并行运行 N 个实现,每个实现都由一个独立的代理盲审,然后由一个评判者选出获胜者或综合每个实现的最佳部分。<p>每个槽位可以使用不同的技能(例如:CE: 在一个地方工作 vs 超能力:测试驱动开发)和工具(例如:CC vs. Codex)。或者对每个槽位赋予不同的侧重点(例如:功能性 vs. 鲁棒性)。它也适用于非编码任务(例如写作),并且你可以创建自定义的槽机。<p>主要见解很简单:AI 代理是概率性的。相同的规范每次都会产生不同的代码;不同的设计、不同的错误、不同的质量。因此,如果我们可以有效地进行评判,并行运行多个实现可以提高质量。<p>这里确实存在一个为了质量而增加时间和 token 的权衡,但对于生产代码来说,这通常是值得的;尤其是在订阅计划中长时间运行的夜间循环中。这也是一种简单的方法,可以了解哪些技能和工具实际上最适合你的代码库。<p>欢迎任何反馈 / PR。这还处于早期阶段!
1作者: alexchemours5 个月前
我开发 LeaseWitness 的初衷是发现房东们很难找到干净、可定制的租赁协议模板,而又不想订阅付费服务或下载来历不明的 PDF 文件。 它涵盖了 15 种协议类型:按周租赁、按月租赁、转租、商业租赁、室友协议、先租后买、停车位租赁等。 技术栈:Vite + React,部署在 Vercel 上。 完全免费,无需注册账号。 非常欢迎任何处理过租赁协议的人提供反馈——还缺少什么,哪些方面可以改进? https://leasewitness.com