Jamie Forth

12 papers Misc 2Journal 6Unranked 3
YearRankTypeTitle / Venue / Authors
2025 conf
UbiComp Companion
Mirko Febbo, Jamie Forth, Laura Rai, Hennie Lee, Albane Arthuis, Sonia Abad-Hernando, Daniel C. Richardson, Matthias Sperling, Guido Orgs, Jamie A. Ward
2020 J jnl
Neural Comput. Appl.
Roger T. Dean, Jamie Forth
2019 J jnl
ACM Comput. Surv.
Ping Xiao, Hannu Toivonen, Oskar Gross, Amílcar Cardoso, João Correia, Penousal Machado, Pedro Martins, Hugo Gonçalo Oliveira, Rahul Sharma, Alexandre Miguel Pinto, Alberto Díaz, Virginia Francisco, Pablo Gervás, Raquel Hervás, Carlos León, Jamie Forth, Matthew Purver, Geraint A. Wiggins, Dragana Miljkovic, Vid Podpecan, Senja Pollak, Jan Kralj, Martin Znidarsic, Marko Bohanec, Nada Lavrac, Tanja Urbancic, Frank van der Velde, Stuart Adam Battersby
2018 ch.
The Oxford Handbook of Algorithmic Music
Geraint A. Wiggins, Jamie Forth
2017 J jnl
CoRR
Roger T. Dean, Jamie Forth
2016 J jnl
J. Assoc. Inf. Sci. Technol.
Sheila Pontis, Genovefa Kefalidou, Ann Blandford, Jamie Forth, Stephann Makri, Sarah Sharples, Geraint A. Wiggins, Mel Woods
2016 J jnl
Comput. Entertain.
Kat Agres, Jamie Forth, Geraint A. Wiggins
2015 conf
AIC
Sascha S. Griffiths, Mariano Mora-Mcginity, Jamie Forth, Matthew Purver, Geraint A. Wiggins
2013 conf
EVA
Mel Woods, Hadi Mehrpouya, Jamie Forth
2013 Misc conf
PAAMS
Jamie Forth, Athanasios Giannimaras, Geraint A. Wiggins, Robert J. Stewart, Diana Bental, Ruth Aylett, Deborah Maxwell, Hadi Mehrpouya, Jamie Shek, Mel Woods
2013 Misc conf
PAAMS
Jamie Forth, Thanasis Giannimaras, Geraint A. Wiggins, Robert J. Stewart, Diana Bental, Ruth Aylett, Deborah Maxwell, Hadi Mehrpouya, Jamie Shek, Mel Woods
2010 J jnl
Minds Mach.
Jamie Forth, Geraint A. Wiggins, Alex McLean
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None