1 分•作者: jspuri•大约 2 个月前
<a href="https://github.com/purijs/blazerules" rel="nofollow">https://github.com/purijs/blazerules</a><p>我最初想用 C++ 编写一个亚毫秒级的日志解析器,但后来演变成了一个可嵌入的决策引擎,可以对传入数据运行 YAML 定义的规则。
这些规则通过先重新投影为列式格式(如果尚未是列式格式)来以向量化格式在传入数据上执行。根据载荷大小和规则的复杂性,性能从每秒 200,000 条记录到每秒超过一百万条记录不等,吞吐量平均约为每秒 200 MiB 到每秒 3 GiB。</p><p>规则也可以是 SQL 表达式,或者 ONNX 模型(数值型)、窗口操作以及支持的许多其他操作。</p><p>它与 DuckDB 类似,但适用于流式数据和即时决策。</p>