Kalle Saastamoinen

21 papers B 14Journal 1Unranked 5
YearRankTypeTitle / Venue / Authors
2025 B conf
KES
Kalle Saastamoinen, Jussi Nuutinen
2024 B conf
KES
Eetu Ojanen, Kalle Saastamoinen
2024 conf
AIAI (2)
Lauri Vasankari, Kalle Saastamoinen
2023 B conf
KES
Tuomas Hongisto, Kalle Saastamoinen
2021 B conf
KES
Kalle Saastamoinen, Kasper Maunula
2021 B conf
KES
Kalle Saastamoinen, Sari Penttinen
2020 B conf
KES
Kalle Saastamoinen, Tuomas Taipale
2019 B conf
KES
Kalle Saastamoinen
2019 B conf
KES
Kalle Saastamoinen, Antti Rissanen
2019 B conf
KES
Kalle Saastamoinen, Antti Rissanen, Riku Linnervuo
2018 B conf
KES
Kalle Saastamoinen, Antti Rissanen
2017 B conf
KES
Kalle Saastamoinen
2016 conf
KES-IDT (1)
Kalle Saastamoinen
2006 ch.
Integrated Intelligent Systems for Engineering Design
Kalle Saastamoinen
2005 J jnl
J. Adv. Comput. Intell. Intell. Informatics
Kalle Saastamoinen, Jaakko Ketola
2004 conf
SMC (2)
Kalle Saastamoinen, Jaakko Ketola, Esko Turunen
2003 conf
EUSFLAT Conf.
Kalle Saastamoinen, Pasi Luukka
2003 conf
EUSFLAT Conf.
Pasi Luukka, Kalle Saastamoinen
2003 B conf
FUZZ-IEEE
Kalle Saastamoinen, Pasi Luukka
2002 B conf
FUZZ-IEEE
Kalle Saastamoinen, Ville Könönen, Pasi Luukka
2001 B conf
FUZZ-IEEE
Pasi Luukka, Kalle Saastamoinen, Ville Könönen
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None