Data Analysis
解码 Parquet thrift footer 并量化谓词下推剪枝:区间图 min/max、split-block 布隆过滤器(XXH64)、字典比率与编码,按行组给出示例 WHERE 子句的剪枝节省估算。
parquet-bloom-filter-zonemap-dictionary-and-column-statistics-pruner-evaluatorData Analysis
Friedman 与 Iman-Davenport 检验(精确 p 值)、平均排名、Nemenyi 临界差与经典 CD 图(含无显著差异 clique),另可叠加对对照模型的 Bonferroni-Dunn。
nemenyi-critical-difference-friedman-rank-plotterData Processing
用 OpenDataLoader 从 PDF 中抽取表格,并导出为结构化 JSON、扁平 CSV 或 HTML 表格
pdf-table-extractor-to-csv-jsonData Processing
使用 lodash _.remove 按条件移除数组元素
remove-by-predicateData Analysis
高级回归分析工具,执行线性回归分析、计算回归统计量和进行预测。完美适用于统计建模、趋势分析、预测和理解变量之间的关系。 功能特点: - 简单线性回归(y = mx + b) - 多元线性回归支持 - 回归系数计算 - 统计显著性检验 - R平方和调整R平方 - 残差分析和诊断 - 预测区间和置信区间 - 回归中的异常值检测 - 模型验证指标 - 可视化回归诊断 - 数据转换支持 常见用途: - 销售预测和趋势分析 - 金融建模和风险评估 - 科学研究和假设检验 - 质量控制和流程优化 - 营销分析和投资回报率分析 - 医学和生物研究
regression-analyzerData Processing
使用 lodash _.pull 从数组中移除指定值
pull-valuesData Processing
扫描文本/日志中的潜在个人身份信息(PII),标注位置和类型以便脱敏和合规检查
pii-finderData Analysis
使用多种统计方法检测数值数据中的异常值,包括IQR、Z-score和修正Z-score
outlier-detectorData Analysis
从CSV/JSON数据生成交互式数据透视表,支持自定义行、列和值字段配置
pivot-table-generatorData Processing
粘贴多组号码后,找出哪些数字在整批组合中重复出现,并显示出现次数和所在组号。
number-combination-duplicate-finderData Processing
使用 lodash _.nth 获取指定索引的元素
nth-itemData Analysis
分析和统计指定区间内的数字数量分布
number-range-statistics