1作者: prolly974 个月前
我最初抓取了 CommonCrawl 爬取的所有域名,并制作了自己的私人工具来探索公共网络。 我用它来了解其他人正在制作什么,这帮助我避免了在和朋友们头脑风暴时提出第 100 个基于智能体的营销 SaaS 方案 :) 所以我觉得其他人可能也会喜欢用这种方式探索网站。 我已尽力绕过图片中的 Cookie 弹出窗口,并删除了大多数停放域名、拒绝访问、网关错误等。 我还过滤掉了子域名,因为其中有太多噪音。 如果你还想了解其他信息,请告诉我。 只有前端和两个基本的 pg 表是专门为这个项目制作的。其余部分是其他业余项目的一部分,例如解析 CC 索引(和 WET 数据)、截屏、保存并保持所有内容更新等。
3作者: armanified4 个月前
从零开始构建了一个约 900 万参数的 LLM,目的是为了理解它们是如何运作的。它是一个纯粹的 Transformer 模型,使用了 6 万条合成对话数据,代码量大约 130 行 PyTorch。在免费的 Colab T4 上,训练只需 5 分钟。这个模型认为生命的意义是食物。<p>可以 Fork 它,然后替换掉预设的角色,让它拥有你自己的个性。
2作者: ikessler4 个月前
Gemma Gem 是一款 Chrome 扩展程序,它通过 WebGPU 在一个离屏文档中加载 Google 的 Gemma 4 (2B) 模型,并赋予其与任何网页交互的工具:读取内容、截屏、点击元素、输入文本、滚动和运行 JavaScript。<p>您可以在每个页面上获得一个小的聊天浮窗。向它询问关于页面的问题,它(通常)会确定调用哪些工具。它有一个思考模式,在工作时会显示链式思考推理。<p>它是一个运行在浏览器中的 2B 模型。它适用于简单的页面问题和运行 JavaScript,但多步骤的工具链不稳定,有时它会完全忽略其工具。该代理循环没有任何外部依赖,如果有人想尝试,可以将其提取为独立的库。
1作者: TiaMane4 个月前
我想创建一个交易机器人,这值得我这么费心吗?