Nei-Chiung Perng

13 papers B 1C 3Misc 2Journal 5Unranked 2
YearRankTypeTitle / Venue / Authors
2010 J jnl
J. Signal Process. Syst.
Nei-Chiung Perng, Shih-Hao Hung, Chia-Heng Tu
2008 Misc conf
SAC
Nei-Chiung Perng, Jian-Jia Chen, Tei-Wei Kuo
2007 J jnl
Wirel. Networks
Chai-Hien Gan, Phone Lin, Nei-Chiung Perng, Tei-Wei Kuo, Ching-Chi Hsu
2007 C conf
EUC
Nei-Chiung Perng, Shih-Hao Hung
2007 J jnl
IEEE Trans. Veh. Technol.
Chai-Hien Gan, Nei-Chiung Perng, Phone Lin, Tei-Wei Kuo
2006 conf
SEUS/WCCIA
Chuan-Yue Yang, Yu-Kai Huang, Nei-Chiung Perng, Jian-Jia Chen, Yung-Hen Lee, Chia-Mei Hung, Heng-Ruey Hsu, Szu-Wei Huang, Hsueh-Wen Tseng, Ai-Chun Pang, Tei-Wei Kuo
2006 C conf
ISCAS
Nei-Chiung Perng, Jian-Jia Chen, Chuan-Yue Yang, Tei-Wei Kuo
2006 J jnl
J. Inf. Sci. Eng.
Nei-Chiung Perng, Chin-Shuang Liu, Tei-Wei Kuo
2004 Misc conf
International Conference on Computational Science
Chin-Shuang Liu, Nei-Chiung Perng, Tei-Wei Kuo
2004 B conf
WCNC
Phone Lin, Chai-Hien Gan, Nei-Chiung Perng, Tei-Wei Kuo, Ching-Chi Hsu
2003 J jnl
Comput. Stand. Interfaces
Tsun-Yu Hsiao, Nei-Chiung Perng, Winston Lo, Yue-Shan Chang, Shyan-Ming Yuan
2003 C conf
ISORC
Nei-Chiung Perng, Neung-Tsung Tsai, Jen-Wei Hsieh, Tei-Wei Kuo
2001 conf
ISAS-SCI (1)
Tsun-Yu Hsiao, Ruey-Kai Sheu, Kai-Chih Liang, Nei-Chiung Perng, Shyan-Ming Yuan
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None