Data Analysis
Decodifica o footer thrift do Parquet e quantifica a poda por predicate pushdown: min/max dos mapas de zonas, filtros bloom split-block (XXH64), razões de dicionário e codificações, com estimativas de economia por grupo de linhas para cláusulas WHERE de exemplo.
parquet-bloom-filter-zonemap-dictionary-and-column-statistics-pruner-evaluatorData Analysis
Testes de Friedman e Iman-Davenport com p-valores exatos, ranks médios, a diferença crítica de Nemenyi e o clássico diagrama CD com cliques — mais uma camada opcional Bonferroni-Dunn contra um modelo de controle.
nemenyi-critical-difference-friedman-rank-plotterData Processing
Extrai tabelas de PDF com OpenDataLoader e exporta em JSON, CSV ou HTML
pdf-table-extractor-to-csv-jsonData Processing
Remove itens por predicado com lodash _.remove
remove-by-predicateData Analysis
Ferramenta avançada de análise de regressão para realizar análise de regressão linear, calcular estatísticas de regressão e fazer previsões. Perfeita para modelagem estatística, análise de tendências, previsão e entendimento de relacionamentos entre variáveis. Recursos: - Regressão linear simples (y = mx + b) - Suporte para regressão linear múltipla - Cálculo de coeficientes de regressão - Testes de significância estatística - R-quadrado e R-quadrado ajustado - Análise de resíduos e diagnósticos - Intervalos de previsão e intervalos de confiança - Detecção de valores atípicos em regressão - Métricas de validação de modelo - Diagnósticos de regressão visual - Suporte para transformação de dados Casos de Uso Comuns: - Previsão de vendas e análise de tendências - Modelagem financeira e avaliação de risco - Pesquisa científica e teste de hipóteses - Controle de qualidade e otimização de processos - Análise de marketing e ROI - Pesquisa médica e biológica
regression-analyzerData Processing
Remove valores especificos do array com lodash _.pull
pull-valuesData Processing
Scaneia texto/logs para informações pessoais identificáveis (PII) e anota posições e tipos para redação e verificação de conformidade
pii-finderData Analysis
Detecte outliers em dados numéricos usando vários métodos estatísticos incluindo IQR, Z-score e Z-score modificado
outlier-detectorData Analysis
Gerar tabelas dinâmicas interativas de dados CSV/JSON com configuração personalizável de campos de linha, coluna e valor
pivot-table-generatorData Processing
Cole varias combinacoes numericas e descubra quais numeros se repetem no conjunto inteiro, com frequencia e grupos.
number-combination-duplicate-finderData Processing
Obtem o item em um indice usando lodash _.nth
nth-itemData Analysis
Analisar e contar números em intervalos ou faixas especificadas
number-range-statistics