1 分•作者: peter_d_sherman•大约 1 个月前
返回首页
最新
1 分•作者: przeslijmi•大约 1 个月前
大家好。
我想向大家介绍一个我过去几个月一直在开发的工具——real-fake-data generator。
https://real-fake-data.com
它的基本功能是提供测试数据,这些数据(1)与真实数据相同但并非真实数据,(2)确保您的管道能够捕捉到真实世界的问题,而不仅仅是开发人员在开发时会想到的那些问题。
首先,现实是不断变化的。您可能有一个包含车辆注册号的提交表单,但您会遇到问题(不同国家,不同规则)。您要么花一个月的时间去挖掘各种场景,要么就放任不管,只设置一个“最大长度为7”,然后走开。您的工具运行良好——但总有一天,某个国家或地区决定车辆牌照的长度为8,然后……您的系统就会失败(用户无法输入新的车辆牌照),而您的测试管道却运行正常,并向您发送绿色的笑脸。
其次,您确实无法预测一切。您面向全球用户?很好,但他们使用不同的字母表。您精美的用户体验/用户界面可能会因为用户姓名变成4到5个字母而崩溃。或者姓名字段太短。它会接受即使在欧洲使用的非拉丁字符吗?
当您创建新软件时,您还需要一些初始数据——这样您就可以(在开发过程中)看到您的工具拥有一些模拟用户、模拟帖子、模拟产品、模拟交易等。同样,您要么花很多时间编写这些数据,即使有 AI 的帮助——要么您就只留下 user1、user2、user3,从而失去以真实用户视角审视您工具的能力。
我的工具——real-fake-data.com——解决了所有这些问题。
- 您想接受德国身份证件、美国车辆号、西班牙 18 岁以上人士、波兰真实存在的地址——我们有超过 300 个真实数据生成器(真实存在,校验和保证,遵循所有规则)。
- 您想创建一个包含 30 个用户、每人几笔订单、每笔订单都有付款详情和日志的种子数据库——具有有意义的真实时间戳——只需定义数据模式——您就搞定了——数据已生成。
- 您想在恶劣的环境中运行测试——我们也能做到——对于每个生成器,您可以从正常模式切换到:EDGE(正确的数据,但处于正确性的边缘——例如,出生日期是昨天,最长的姓氏,波兰最短的车辆号),EXTREME(正确的数据,但故意制造问题,例如未修剪的空格、换行符、隐藏的 UTF 字符等),以及 INVALID(不正确的数据,可用于检查您的表单是否会拒绝它或是否能正常处理)。
- 您想使用相同的数据重新运行测试——这可以通过 SEED 号码实现,您将始终获得相同的随机数据——因此,您可以选择何时需要随机性,何时需要重复的安全性。
- 您希望您的 Claude 以低成本为您提供数据?很高兴听到——MCP 服务器已准备好供您使用。
- 您想轻松编写 Playwright 测试,例如 `const person = await fakeData.plPerson({ sex: 'f' });` 并且您就搞定了。
- 您想使用 VSCode 插件,直接在浏览器中获取数据而无需离开?很酷——Ctrl+Shift+P “生成假 UUID”——您无需离开 VS Code 屏幕即可获得所需数据。
- 您想确保任何数据都不会使您的软件面临风险——很好——确保种子是随机的,打开边缘模式,您就可以确信,一旦真实世界出现新的数据格式,您的管道就会针对它们进行测试。
它的成本是多少?简单使用是免费的。没有隐藏费用,无需信用卡,没有任何形式的月度订阅。每月免费 2000 个 token。
我非常希望收到更多见解,并听到您对该工具的看法。
它还附带 MCP 插件、Playwright 插件和 VS Code 扩展,让您无需离开 IDE 即可获取任何数据。
此致,
Karol Nowakowski
1 分•作者: untiledsource•大约 1 个月前
1 分•作者: bodash•大约 1 个月前
1 分•作者: doubledamio•大约 1 个月前
1 分•作者: shivanshuag•大约 1 个月前
1 分•作者: alex_hirner•大约 1 个月前
1 分•作者: nperson•大约 1 个月前
2 分•作者: raptortech•大约 1 个月前
3 分•作者: 2OEH8eoCRo0•大约 1 个月前
3 分•作者: dafelst•大约 1 个月前
我们和我们的同事现在正以惊人的速度产出由助手辅助编写的代码,其中一些质量相当不错,但也有很多质量不佳。我个人发现,我们项目真正的质量门槛在于,生成代码经过人类评审的彻底程度,以确保它不仅正确,而且在架构上是合理的。
像 Coderabbit 和 Copilot 这样的 AI 代码审查工具,甚至将 Claude 代码指向 PR(Pull Request),通常在查找 bug 和风格问题方面表现不错,但在查找重复代码、模块间耦合、关注点分离不当等方面表现较差,即使被提示这样做。
我发现 GitHub 的 PR 界面对我来说并不太好用,即使在评审规模较小时它就已经有些卡顿,而现在随着规模的增大,它变得难以管理。再加上混合了助手评审的额外噪音,以及人们“肉身代理”(meat-proxying)复制粘贴助手输出的内容,这使得它变得非常嘈杂且难以导航。
大家有什么好的方法来精简对 AI 辅助代码的人工评审吗?工具和流程建议都欢迎。
38 分•作者: brandonb•大约 1 个月前
43 分•作者: nichochar•大约 1 个月前
1 分•作者: startuphubai•大约 1 个月前
1 分•作者: toomuchtodo•大约 1 个月前
1 分•作者: butz•大约 1 个月前
1 分•作者: marcuskaz•大约 1 个月前
3 分•作者: GodelNumbering•大约 1 个月前
1 分•作者: rahulbridge•大约 1 个月前
1 分•作者: ninjahawk1•大约 1 个月前