Hai Nan

19 papers B 1Journal 13Unranked 5
YearRankTypeTitle / Venue / Authors
2026 J jnl
Vis. Comput.
Hai Nan, Wan Chen, Hongji Chen
2025 J jnl
Neurocomputing
Hai Nan, Hongji Chen, Ping Guo, Chunmei Liao, S. M. Ahanaf Tahmid
2025 B conf
IJCNN
Hai Nan, Chaoyue Li
2025 J jnl
Pattern Anal. Appl.
Hai Nan, Cheng Li
2025 conf
ICANN (2)
Hai Nan, Hongji Chen, Lingcuan Duan, Aijuan Wang, Zeng Tian
2024 J jnl
IET Image Process.
Hai Nan, Qilang Ye, Zitong Yu, Kang An
2024 J jnl
IET Image Process.
Hai Nan, Kai Zhao, Xuefei Han, Dongjie Zhao
2024 J jnl
Image Vis. Comput.
Xuefei Han, Zheng Liu, Hai Nan, Kai Zhao, Dongjie Zhao, Xiaodan Jin
2023 J jnl
IEEE Access
Aijuan Wang, Junyang Li, Hai Nan
2022 J jnl
Appl. Artif. Intell.
Lei Jiao, Xuesong Lin, Kang An, Yaqing Song, Yingyuan Liu, Hui Liu, Hai Nan
2021 conf
AIAM (ACM)
Chunyan Chen, Hai Nan
2018 conf
ICMAI
Wenjun Quan, Qing Zhou, Hai Nan, Yanbin Chen, Ping Wang
2018 conf
CSAE
Wenjun Quan, Qing Zhou, Hai Nan, Ping Wang
2018 conf
SPAC
Hai Nan, Wanping Liu, Chao Liu, Chengyun Song
2018 J jnl
计算机科学
Xiaochuan Zhang, Qin Li, Hai Nan, Lirong Peng
2016 J jnl
Int. J. Comput. Games Technol.
Hai Nan, Bin Fang, Guixin Wang, Weibin Yang, Emily Sarah Carruthers, Yi Liu
2015 J jnl
Signal Process. Image Commun.
Ming Li, Di Xiao, Yushu Zhang, Hai Nan
2015 J jnl
Commun. Nonlinear Sci. Numer. Simul.
Yushu Zhang, Di Xiao, Wenying Wen, Hai Nan, Moting Su
2014 J jnl
Commun. Nonlinear Sci. Numer. Simul.
Yushu Zhang, Di Xiao, Hong Liu, Hai Nan
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None