2 分•作者: nodezero•大约 1 年前
从空客A400M到比利时巧克力 针对特定领域语境测试大型语言模型,并公开构建以保持实验持续进行
1 分•作者: surrTurr•大约 1 年前
我非常喜欢用 Claude Code 进行自主编码,但如果不是 Max 计划,我发现这很快就会变得很贵,尤其是在使用 Opus 模型时。 由于我经常使用 ChatGPT 进行工作和个人项目,我正在考虑订阅 ChatGPT Pro 或 Claude Max。我已经在 Plus 计划中测试过 ChatGPT Codex(云端),但依我看来,它远不及 Claude 4(即使是非 Opus 版本)的表现。 我听说 ChatGPT Pro 可以让你访问 o3-pro 模型。对于同时试用过这两个模型的人来说,o3-pro 在编码方面的表现与 Claude 4 相比如何?我更喜欢 Codex 的 Web UI,但我追求的是最佳的整体体验。
1 分•作者: berwinsingh•大约 1 年前
大家好,我是 Berwin。<p>我们构建 ExtractQ 的初衷是看到保险行业的朋友们每天都在重新录入 PDF 文件。该服务使用视觉加 LLM 管道(AWS Bedrock + LangChain + CrewAI)将任何传入文档映射到 JSON,无需预先训练。然后,我们通过第三方 API(DMV、VIN)进行验证,然后再将数据导入核心理赔应用程序。<p>在一个中型保险公司投入生产后,我们将平均理赔准备时间从 45 分钟缩短到 19 分钟,并减少了 85% 的下游数据录入错误。<p>我非常希望得到关于扩展文档密集型 AI 工作流程的反馈,尤其是在验证和审计跟踪方面。