1作者: pbs294 个月前
大家好, 我正在搭建一个免费发布招聘信息的网站。如果您正在招聘,您有兴趣发布职位信息吗? 如果感兴趣,请评论并留下您的邮箱。我会亲自联系您,并向您发送一个链接,以便您填写职位详情。 我们会在我们的网站上为您发布。
1作者: cloudkj4 个月前
我翻阅了一些我过去用强化学习捣鼓的个人项目,注意到当时可用的 OpenAI gym 的 REST/HTTP API 已经不再支持了。那个 API 挺有用的,因为当时大多数机器学习和深度学习还没有像今天这样稳定地依赖各种 Python 库。 gymnasium-http-api 尝试重新提供同样类型的与语言无关的支持。它主要封装了被 fork 和支持的 Gymnasium 库,并提供了一些特定的端点,以便更容易地渲染和可视化训练和学习过程。 请查看 README 获取一些示例。希望其他人觉得它有用!
1作者: andrew_zhong4 个月前
HTML转Markdown转换器可以为人类和LLM生成干净、可读的内容,但DOM结构在此过程中会丢失。你总是可以将Markdown输入LLM以提取结构化信息,但这会为每个页面、每次操作消耗token。<p>如果LLM也能看到每个内容片段在DOM中的位置呢?那么它就可以生成强大的抓取代码——稳定的选择器和XPath,无需LLM参与即可运行,从而节省token并提高在长页面或重复页面上的准确性。<p>Scrapedown正是这样做的:它将HTML转换为Markdown,并使用其CSS选择器和/或XPath注释每个元素,因此LLM可以一次性生成精确、可重用的抓取代码。