Data Analysis
Декодирует thrift-footer Parquet и количественно оценивает обрезку predicate pushdown: min/max zone-карт, split-block bloom-фильтры (XXH64), доли словарей и кодировки, с оценками экономии по группам строк для примерных предложений WHERE.
parquet-bloom-filter-zonemap-dictionary-and-column-statistics-pruner-evaluatorData Analysis
Тесты Фридмана и Имана-Дэвенпорта с точными p-значениями, средние ранги, критическая разность Неймени и классическая CD-диаграмма с кликами — плюс опциональный оверлей Bonferroni-Dunn против контрольной модели.
nemenyi-critical-difference-friedman-rank-plotterData Processing
Извлекает таблицы из PDF через OpenDataLoader и экспортирует в JSON, CSV или HTML
pdf-table-extractor-to-csv-jsonData Processing
Удаляет элементы по предикату с lodash _.remove
remove-by-predicateData Analysis
Продвинутый инструмент регрессионного анализа для выполнения линейного регрессионного анализа, расчета регрессионной статистики и составления прогнозов. Идеально подходит для статистического моделирования, анализа тенденций, прогнозирования и понимания отношений между переменными. Возможности: - Простая линейная регрессия (y = mx + b) - Поддержка множественной линейной регрессии - Расчет коэффициентов регрессии - Проверка статистической значимости - R-квадрат и скорректированный R-квадрат - Анализ остатков и диагностика - Интервалы прогнозирования и доверительные интервалы - Обнаружение выбросов в регрессии - Метрики валидации модели - Визуальная диагностика регрессии - Поддержка преобразования данных Общие случаи использования: - Прогнозирование продаж и анализ тенденций - Финансовое моделирование и оценка рисков - Научные исследования и проверка гипотез - Контроль качества и оптимизация процессов - Маркетинговый анализ и анализ ROI - Медицинские и биологические исследования
regression-analyzerData Processing
Удаляет указанные значения из массива с lodash _.pull
pull-valuesData Processing
Сканирует текст/логи на наличие личной информации (PII) и отмечает позиции и типы для редактирования и проверки соответствия
pii-finderData Analysis
Обнаруживает выбросы в числовых данных с использованием различных статистических методов, включая IQR, Z-score и модифицированный Z-score
outlier-detectorData Analysis
Создание интерактивных сводных таблиц из данных CSV/JSON с настраиваемой конфигурацией полей строк, столбцов и значений
pivot-table-generatorData Processing
Вставьте несколько числовых комбинаций и найдите числа, которые повторяются во всем наборе, с количеством и группами.
number-combination-duplicate-finderData Processing
Получает элемент по индексу с lodash _.nth
nth-itemData Analysis
Анализировать и подсчитывать числа в указанных диапазонах или интервалах
number-range-statistics