Nai Zhou

15 papers A* 2Journal 10Unranked 3
YearRankTypeTitle / Venue / Authors
2026 J jnl
Expert Syst. Appl.
Qibin Li, Shengyuan Bai, Nai Zhou, Nianmin Yao
2026 A* conf
AAAI
Qibin Li, Shengyuan Bai, Nai Zhou, Nianmin Yao
2025 conf
PRCV (18)
Qifei Wang, Yuefeng Zhao, Bolin Chen, Nai Zhou, Qianqian Tao, Nannan Hu
2025 conf
BIBM
Qifei Wang, Yuefeng Zhao, Nai Zhou, Nannan Hu
2025 A* conf
AAAI
Shengyuan Bai, Qibin Li, Zhe Wang, Nai Zhou, Nianmin Yao
2025 J jnl
Eng. Appl. Artif. Intell.
Qibin Li, Shengyuan Bai, Nai Zhou, Nianmin Yao
2025 J jnl
Int. J. Autom. Comput.
Qibin Li, Nianmin Yao, Nai Zhou
2025 J jnl
Comput. Speech Lang.
Qibin Li, Nianmin Yao, Nai Zhou, Jian Zhao
2025 J jnl
Mach. Intell. Res.
Nai Zhou, Nianmin Yao, Qibin Li
2024 J jnl
Knowl. Based Syst.
Nai Zhou, Nianmin Yao, Nannan Hu, Jian Zhao, Yanan Zhang
2024 conf
BIBM
Qibin Li, Shengyuan Bai, Nai Zhou, Nianmin Yao
2023 J jnl
ACM Trans. Intell. Syst. Technol.
Qibin Li, Nianmin Yao, Nai Zhou, Jian Zhao, Yanan Zhang
2023 J jnl
Knowl. Based Syst.
Nai Zhou, Nianmin Yao, Qibin Li, Jian Zhao, Yanan Zhang
2022 J jnl
Neural Comput. Appl.
Nai Zhou, Nianmin Yao, Jian Zhao, Yanan Zhang
2017 J jnl
Knowl. Based Syst.
Yan Leng, Nai Zhou, Chengli Sun, Xinyan Xu, Qi Yuan, Chuanfu Cheng, Yunxia Liu, Dengwang Li
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None