Vibha Sazawal

16 papers A* 2A 1C 1Journal 2Unranked 10
YearRankTypeTitle / Venue / Authors
2010 A* conf
CHI
Sureyya Tarkan, Vibha Sazawal, Allison Druin, Evan Golub, Elizabeth M. Bonsignore, Greg Walsh, Zeina Atrash
2009 conf
TFM
Sureyya Tarkan, Vibha Sazawal
2009 C conf
DLS
Yit Phang Khoo, Michael Hicks, Jeffrey S. Foster, Vibha Sazawal
2009 conf
ICSP
Vibha Sazawal, Nikita Sudan
2008 conf
PASTE
Yit Phang Khoo, Jeffrey S. Foster, Michael Hicks, Vibha Sazawal
2006 conf
WSE
Charles Song, Vibha Sazawal
2005 conf
ESEC/SIGSOFT FSE
Miryung Kim, Vibha Sazawal, David Notkin, Gail C. Murphy
2005 J jnl
J. Comput. Sci. Coll.
David Joslin, Ivan Lumala, Catrin Riggs, Vibha Sazawal
2004 conf
IWPSE
Vibha Sazawal, Miryung Kim, David Notkin
2004 conf
OOPSLA Companion
Vibha Sazawal, David Notkin
2003 J jnl
J. Comput. Sci. Coll.
Vibha Sazawal, Sarah E. Schwarm, Barbara Goldner, Ed Gellenbeck, Carol Zander
2003 A conf
ECOOP
Jonathan Aldrich, Vibha Sazawal, Craig Chambers, David Notkin
2002 conf
WOSS
Jonathan Aldrich, Vibha Sazawal, Craig Chambers, David Notkin
2002 conf
CHI Extended Abstracts
Joseph Goldberg, Jennifer Hagman, Vibha Sazawal
2002 conf
Mobile HCI
Vibha Sazawal, Roy Want, Gaetano Borriello
2002 A* conf
UIST
Kurt Partridge, Saurav Chatterjee, Vibha Sazawal, Gaetano Borriello, Roy Want
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None