2作者: bhaviav1005 个月前
我的代理重试次数有点超标,导致我的账单蹭蹭往上涨。 我尝试找出原因,但现有的工具帮不上什么忙。 更糟糕的是,所有数据都显示为总使用量。总的Token数、总费用,可能按模型区分一下。 所以我最终在OpenAI前面搭建了一个薄薄的中间层,强制每个请求都携带一些上下文信息(代理、任务、用户、团队),然后记录并计算每次调用的费用,并在其上设置一些基本限制,这样如果出现问题,你就可以阻止它。 它非常简陋,但即使只是看到“这个代理 + 这个任务 = 这个费用”也让我松了一口气。 它使用你自己的OpenAI密钥,所以在执行方面并没有做什么神奇的事情,只是观察和强制执行。 我想知道你们现在是如何处理这个问题的。你们是只关注总使用量并相信它,还是已经构建了一些东西来按代理/任务进行细分? 如果对你有用,这是我正在使用的粗略版本:https://authority.bhaviavelayudhan.com/
1作者: whatarethembits5 个月前
我只考虑每月 20 美元的订阅方案。<p>过去一年我一直订阅 Claude,但实际上最近几个月才开始真正使用 LLM。使用 Opus 时,大约每 5 小时能发 5 条消息(可能是一个 7000 行代码库,相当于是全新的项目);使用 Sonnet 时更多。后来我取消了订阅,因为它几乎无法使用,大约一周前订阅了 ChatGPT。目前使用 5.4 High 版本,我还没有遇到限制问题。但它生成的代码确实“不一样”,我需要提前做更多的规划。它的规划模式也不如 Claude 那么精确(它不会像 Claude 那样列出它计划实现的函数桩等),所以我想我可能需要改变我使用它的方式?最后,对于普通聊天,它会生成更冗长的输出(将个性设置为“高效”),而且速度很快(使用“思考”模式),但通常感觉它不如我希望的那么彻底。<p>我的问题是:这是一种“你用错了”的情况吗,我只需要习惯一种不同的交互模式?还是其他人也注意到了质量上的实质性差异?理想情况下,由于 Anthropic 的限制几乎不实用,我想坚持使用 ChatGPT。