Python SDK
fs.analyze()
SDK Reference: comprehensive analysis
python
def analyze( source: object, *, target_column: str | None = None, enabled_rules: list[str] | None = None, rule_config: dict[str, Any] | None = None, max_correlation_columns: int = 100, max_frequency_table_size: int = 1000,) -> RuleResult:Combines loading, profiling, and rules auditing into a single public SDK endpoint.
Arguments
- source:
Dataset|str|DataFrame. Input data or path. - target_column:
str | None(default None). Target column name. Required for target leakage checks. - enabled_rules:
list[str] | None(default None). Explicit rules to evaluate. If empty, runs all defaults. - rule_config:
dict[str, Any] | None. Keyword argument config overrides for specific rules. - max_correlation_columns:
int(default 100). Cap limit for correlation matrix computation. - max_frequency_table_size:
int(default 1000). Frequency table storage cap.
Example
python
import featuresmith as fsresult = fs.analyze( "train.csv", target_column="churn", rule_config={ "quality.missing_value_threshold": {"threshold": 30.0}, "statistical.high_correlation": {"threshold": 0.85}, })print(f"Triggered {len(result.findings)} findings.")