Data Analysis
Dekodiert den Parquet-Thrift-Footer und quantifiziert Predicate-Pushdown-Pruning: Zone-Map-Min/Max, Split-Block-Bloomfilter (XXH64), Wörterbuchverhältnisse und Encodings, mit Pruning-Einsparungen je Zeilengruppe für Beispiel-WHERE-Klauseln.
parquet-bloom-filter-zonemap-dictionary-and-column-statistics-pruner-evaluatorData Analysis
Friedman- und Iman-Davenport-Tests mit exakten p-Werten, Durchschnittsränge, die Nemenyi-kritische Differenz und das klassische CD-Diagramm mit Cliquen — plus optionales Bonferroni-Dunn-Overlay gegen ein Kontrollmodell.
nemenyi-critical-difference-friedman-rank-plotterData Processing
Extrahiert Tabellen aus PDFs mit OpenDataLoader und exportiert sie als JSON, CSV oder HTML
pdf-table-extractor-to-csv-jsonData Processing
Entfernt Elemente per Praedikat mit lodash _.remove
remove-by-predicateData Analysis
Fortschrittetes Regressionsanalyse-Werkzeug für lineare Regressionsanalyse, Berechnung von Regressionsstatistiken und Vorhersagen.
regression-analyzerData Processing
Entfernt bestimmte Werte aus dem Array mit lodash _.pull
pull-valuesData Processing
Scannt Texte/Protokolle auf persönlich identifizierbare Informationen (PII) und annotiert Positionen und Typen für Schwärzung und Compliance-Prüfung
pii-finderData Analysis
Erkennt Ausreißer in numerischen Daten mit verschiedenen statistischen Methoden einschließlich IQR, Z-Score und modifiziertem Z-Score
outlier-detectorData Analysis
Interaktive Pivot-Tabellen aus CSV/JSON-Daten generieren mit anpassbarer Konfiguration von Zeilen-, Spalten- und Wertfeldern
pivot-table-generatorData Processing
Fügen Sie mehrere Zahlenkombinationen ein und finden Sie Zahlen, die im gesamten Satz wiederholt auftreten, mit Haeufigkeit und Gruppen.
number-combination-duplicate-finderData Processing
Gibt das Element an einem Index mit lodash _.nth zuruck
nth-itemData Analysis
Zahlen in angegebenen Bereichen oder Intervallen analysieren und zählen
number-range-statistics