1 分•作者: silahian•3 个月前
返回首页
最新
2 分•作者: Rochus•3 个月前
1 分•作者: latnasm•3 个月前
种族歧视是否在每个国家都存在?未来所有种族的人们是否能够实现平等——人与人之间的平等是否真的能够实现?
2 分•作者: nreece•3 个月前
1 分•作者: malgorithms•3 个月前
3 分•作者: GalaxyNova•3 个月前
2 分•作者: mikeocool•3 个月前
2 分•作者: ashishb•3 个月前
3 分•作者: yolo-auto•3 个月前
各位 HN 的朋友们:
我曾收到过这样的建议:不要将昂贵的尖端模型(如 GPT/Claude 等)的额度浪费在批量处理工作上。应该将枯燥、重复、高并发的任务交给更小的模型,而将昂贵的提示留给真正需要尖端推理能力的时候。我曾抱怨并告诉我的经理,我不应该为特定的编码任务去考虑使用特定的模型,应该有一个模型能处理一切。然而,事实证明我们还是得这么做。
如果您需要一个可以尽情地用高并发任务“虐待” LLM 的地方,欢迎来 <a href="https://yolo-auto.com" rel="nofollow">https://yolo-auto.com</a> 试试我们的服务。
以下是每月 6 美元的套餐详情:
* 模型:Qwen3.6-35B-A3B
* 无限 token / 无请求上限
* FP8 / 128k 上下文
* 兼容 OpenAI 的接口
* 平均约 100 token/秒
* 100% 隐私(零数据保留)
我们还有一个免费套餐,每天提供 500 次请求。
目前我们大约有 100 位活跃用户。如果您对“无限”的说法持怀疑态度,可以加入我们的 Discord,直接询问他们——我们有用户每天消耗数亿 token 来进行代理实验、批量编码、数据处理以及各种各样的“胡闹”。
我们还即将完成我们的第一个 AI 游戏开发活动“SlopJam”,参赛者们有 72 小时的时间来构建他们能想到的最“诅咒”的 AI 生成游戏。这比我们预期的要有趣得多。
欢迎在下方提问或评论,我很乐意回答任何问题!
6 分•作者: odilelof•3 个月前
27 分•作者: mfiguiere•3 个月前
1 分•作者: whiteblossom•3 个月前
1 分•作者: ynac•3 个月前
1 分•作者: doctaj•3 个月前
1 分•作者: eddyflores•3 个月前
2 分•作者: birdculture•3 个月前
2 分•作者: abdelhousni•3 个月前
1 分•作者: impish9208•3 个月前
1 分•作者: ike_usawa•3 个月前
1 分•作者: jleechan2015•3 个月前