Xiangli Meng

17 papers B 1C 2Journal 11Unranked 3
YearRankTypeTitle / Venue / Authors
2026 J jnl
IEEE Signal Process. Lett.
Xiangli Meng, Yu Yang, Linna Zhou, Jian Li, Bingcun Chen
2025 B conf
SMC
Sheng You, Wang Gang, Yang Yu, Zhou Linna, Xiangli Meng
2024 J jnl
Int. J. Inf. Syst. Chang. Manag.
Xiangli Meng, Na An
2023 J jnl
IEEE Access
Yan Wen, Lei Zhang, Xiangli Meng, Xujiong Ye
2022 J jnl
J. Sensors
Yanyan Guo, Xiangqian Che, Xiangli Meng, Li Bian
2022 J jnl
CoRR
Yan Wen, Lei Zhang, Xiangli Meng, Xujiong Ye
2019 J jnl
Future Internet
Xiangli Meng, Lingda Wu, Shaobo Yu
2019 J jnl
IEEE Access
Wei Ji, Guangyu Chen, Bo Xu, Xiangli Meng, Dean Zhao
2019 J jnl
Remote. Sens.
Xiangli Meng, Lingda Wu, Shaobo Yu
2019 C conf
IGARSS
Xiangli Meng, Lingda Wu, Jiao Jiao, Xiangwu Gong
2019 C conf
IGARSS
Jiao Jiao, Xiangwu Gong, Lingda Wu, Xiangli Meng
2018 conf
SINC
Xiangli Meng, Lingda Wu, Shaobo Yu, Xitao Zhang
2018 conf
SINC
Shaobo Yu, Lingda Wu, Xiangli Meng, Xitao Zhang
2016 J jnl
Int. J. Web Serv. Res.
Xiangli Meng, Pascal Rebreyend
2016 J jnl
J. Comb. Optim.
Kenneth Carling, Xiangli Meng
2015 J jnl
J. Glob. Optim.
Kenneth Carling, Xiangli Meng
2013 conf
WISE Workshops
Xiangli Meng, Kenneth Carling
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None