Haifa Hong

14 papers B 1Journal 1Unranked 12
YearRankTypeTitle / Venue / Authors
2018 conf
CISP-BMEI
Zhirong Tong, Xinxin Yan, Haifa Hong, Juanya Shen, Yangxin Li, Jinlong Liu, Lisheng Qiu, Liwei Hu, Qian Wang
2018 conf
CISP-BMEI
Liping Wang, Mingjie Zhang, Xi Chen, Haifa Hong, Jinlong Liu, Zhuoming Xu, Liwei Hu, Yu-Min Zhong, Qichen Jin, Lijun Chen, Yuqi Zhang
2015 conf
ASCC
Limin Zhu, Jinlong Liu, Weimin Zhang, Qi Sun, Haifa Hong, Zhou Du, Jinfen Liu, Yi Qian, Qian Wang, Mitsuo Umezu
2015 B conf
Image Processing
Prahlad G. Menon, Haifa Hong
2015 conf
ASCC
Le Mao, Weimin Zhang, Haifa Hong, Qi Sun, Junrong Huang, Jinfen Liu, Jinlong Liu, Zhongqun Zhu, Yi Qian, Qian Wang, Mitsuo Umezu
2015 conf
ASCC
Haifa Hong, Jinfen Liu, Lisheng Qiu, Jinlong Liu, Yi Qian, Qian Wang, Mitsuo Umezu
2015 conf
ASCC
Qian Wang, Yi Qian, Haifa Hong, Qi Sun, Yanjun Sun, Jinfen Liu, Jinlong Liu, Mitsuo Umezu
2015 conf
ASCC
Lijun Chen, Jinlong Liu, Haifa Hong, Aimin Sun, Jinfen Liu, Yuqi Zhang, Mitsuo Umezu
2014 conf
BMEI
Jinlong Liu, Qi Sun, Haifa Hong, Zhou Du, Qian Wang, Yanjun Sun, Jinfen Liu, Yi Qian
2014 conf
BMEI
Le Mao, Jinlong Liu, Haifa Hong, Qi Sun, Junrong Huang, Jinfen Liu, Zhongqun Zhu, Qian Wang
2014 conf
BMEI
Weimin Zhang, Jinlong Liu, Qi Sun, Haifa Hong, Qian Wang, Lu Han, Le Mao, Qin Yan, Xiongqi Peng
2013 conf
EMBC
Jinlong Liu, Qi Sun, Yi Qian, Haifa Hong, Jinfen Liu
2013 conf
EMBC
Qi Sun, Jinlong Liu, Yi Qian, Haifa Hong, Jinfen Liu
2008 J jnl
Medical Biol. Eng. Comput.
Qi Sun, Dawei Wan, Jinfen Liu, Haifa Hong, Yingzheng Liu, Ming Zhu
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None