返回首页

24小时热榜

1作者: StanleySathler大约 13 小时前
大家好! 我每天会在几个 Facebook 页面发帖。 它们都有相同的格式:一种推文风格的帖子——一张图片,包含一个名字、一张照片和正文。 这是我第一次尝试搜索这个模板,但一无所获。我尝试了 Canva,搜索了模板,也找不到。 然后我从零开始在 Canva 上设计了一个。 现在,我希望其他人再也不用自己设计了。 一个简单的应用。一种推文风格的模板。你可以更换照片、名字,添加你的内容,然后将图片下载为 JPG 格式发布到社交媒体。 非常简单。无需登录。没有后端。没有 AI 功能。100% 免费。 这是为我自己开发的,但可能对其他人也有用。请享用!
1作者: GodelNumbering大约 14 小时前
尽管有许多大型语言模型(LLM)的基准测试,但很少有(甚至没有)利用“harness”进行基准测试。我认为构建一个这样的基准测试将是一个非常好的社区项目。 最终目标:在一个多样化的真实世界任务集[1]上,根据底层模型和推理工作量进行分组,展示“harness”性能的排行榜(多维度)。任何人都可以贡献结果。 任务标准、测量方法、底层框架等可以由一个小组而非个人决定。 如果兴趣足够,我将创建一个Discord服务器。 披露:我是名为Dirac(https://github.com/dirac-run/dirac)的编码代理的维护者,因此我不会影响最终基准测试的外观,以避免任何利益冲突。我只是想让这件事发生。 [1] 多样化的真实世界任务是指贡献者遇到的足够复杂的任务,最好来自开源仓库。