Manqing Dong

33 papers A* 4A 1B 1Journal 22Unranked 4
YearRankTypeTitle / Venue / Authors
2024 J jnl
CoRR
Manqing Dong, Hao Huang, Longbing Cao
2023 J jnl
Neural Comput. Appl.
Manqing Dong, Lina Yao, Xianzhi Wang, Xiwei Xu, Liming Zhu
2023 J jnl
IEEE Trans. Serv. Comput.
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Shuai Zhang, Quan Z. Sheng
2023 J jnl
CoRR
Manqing Dong, Zhanxiang Zhao, Yitong Geng, Wentao Li, Wei Wang, Huai Jiang
2022 J jnl
Knowl. Based Syst.
Manqing Dong, Feng Yuan, Lina Yao, Xianzhi Wang, Xiwei Xu, Liming Zhu
2021 A* conf
KDD
Zhipeng Luo, Zhixing He, Jin Wang, Manqing Dong, Jianqiang Huang, Mingjian Chen, Bohang Zheng
2021 J jnl
CoRR
Zhipeng Luo, Zhixing He, Jin Wang, Manqing Dong, Jianqiang Huang, Mingjian Chen, Bohang Zheng
2021 conf
EMNLP (1)
Manqing Dong, Chunguang Pan, Zhipeng Luo
2021 J jnl
CoRR
Manqing Dong, Chunguang Pan, Zhipeng Luo
2021 A* conf
ICDM
Manqing Dong, Lina Yao, Xianzhi Wang, Xiwei Xu, Liming Zhu
2020 J jnl
IEEE J. Biomed. Health Informatics
Xiang Zhang, Lina Yao, Manqing Dong, Zhe Liu, Yu Zhang, Yong Li
2020 A* conf
KDD
Manqing Dong, Feng Yuan, Lina Yao, Xiwei Xu, Liming Zhu
2020 J jnl
CoRR
Manqing Dong, Feng Yuan, Lina Yao, Xiwei Xu, Liming Zhu
2020 J jnl
Pattern Recognit. Lett.
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Chaoran Huang, Xiaodong Ning
2020 J jnl
Pattern Recognit. Lett.
Xiaodong Ning, Lina Yao, Xianzhi Wang, Boualem Benatallah, Manqing Dong, Shuai Zhang
2020 J jnl
CoRR
Manqing Dong, Feng Yuan, Lina Yao, Xianzhi Wang, Xiwei Xu, Liming Zhu
2019 J jnl
CoRR
Xiang Zhang, Lina Yao, Manqing Dong, Zhe Liu, Yu Zhang, Yong Li
2019 conf
ICONIP (4)
Xiang Zhang, Xiaocong Chen, Lina Yao, Chang Ge, Manqing Dong
2019 J jnl
CoRR
Xiang Zhang, Xiaocong Chen, Lina Yao, Chang Ge, Manqing Dong
2019 B conf
IJCNN
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Xiang Zhang, Quan Z. Sheng
2019
Manqing Dong
2019 J jnl
Aust. J. Intell. Inf. Process. Syst.
Xiang Zhang, Xiaocong Chen, Manqing Dong, Huan Liu, Chang Ge, Lina Yao
2019 J jnl
CoRR
Xiang Zhang, Xiaocong Chen, Manqing Dong, Huan Liu, Chang Ge, Lina Yao
2019 conf
PAKDD (2)
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Chaoran Huang
2018 J jnl
CoRR
Xianzhi Wang, Chaoran Huang, Lina Yao, Boualem Benatallah, Manqing Dong
2018 J jnl
J. Comput. Sci. Technol.
Xianzhi Wang, Chaoran Huang, Lina Yao, Boualem Benatallah, Manqing Dong
2018 conf
WISE (1)
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Quan Z. Sheng, Hao Huang
2018 A conf
ICSOC
Chaoran Huang, Lina Yao, Xianzhi Wang, Boualem Benatallah, Shuai Zhang, Manqing Dong
2018 J jnl
CoRR
Chaoran Huang, Lina Yao, Xianzhi Wang, Boualem Benatallah, Shuai Zhang, Manqing Dong
2018 J jnl
CoRR
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Shuai Zhang
2018 A* conf
IJCAI
Shuai Zhang, Lina Yao, Aixin Sun, Sen Wang, Guodong Long, Manqing Dong
2018 J jnl
CoRR
Shuai Zhang, Lina Yao, Aixin Sun, Sen Wang, Guodong Long, Manqing Dong
2018 J jnl
CoRR
Manqing Dong, Lina Yao, Xianzhi Wang, Boualem Benatallah, Chaoran Huang, Xiaodong Ning
redb/extractor_registry.py
← Index redb/extractor_registry.py python
"""
Extractor registry with lazy loading by file type.

Groups extractors by file type (pe, elf, macho, apk) and only imports
the relevant group when that file type is first encountered. This avoids
loading heavy dependencies (pefile, lief, androguard, etc.) into workers
that don't need them.
"""
import importlib
import logging

logger = logging.getLogger(__name__)

# Registry: group name -> list of (module_path, class_names)
_REGISTRY = {
    "pe": [
        ("redb.extractors.pe_extractors", [
            "PEFeaturesExtractor",
            "PEImportExtractor",
            "PEResourceExtractor",
            "PEOverlayExtractor",
            "PESectionExtractor",
            "PESignatureExtractor",
            "PEExtraFindings",
            "PEInconstistencyTestsExtractor",
            "PEDotNetExtractor",
        ]),
    ],
    "elf": [
        ("redb.extractors.elf_extractors", [
            "ELFFeaturesExtractor",
            "ELFSegmentExtractor",
            "ELFSectionExtractor",
            "ELFDependencyExtractor",
            "ELFSymbolExtractor",
            "ELFImportExtractor",
            "ELFExportExtractor",
            "ELFRelocationExtractor",
            "ELFNotesExtractor",
        ]),
    ],
    "macho": [
        ("redb.extractors.macho_extractors", [
            "MachOFeaturesExtractor",
            "MachOSegmentExtractor",
            "MachOImportExtractor",
            "MachOExportExtractor",
            "MachODylibExtractor",
            "MachOSignatureExtractor",
        ]),
    ],
    "apk": [
        ("redb.extractors.apk_extractors", [
            "APKFeaturesExtractor",
            "APKManifestExtractor",
            "APKPermissionsExtractor",
            "APKSignatureExtractor",
            "APKDexExtractor",
            "APKResourceExtractor",
            "APKNativeLibExtractor",
            "APKInconsistencyTestsExtractor",
        ]),
        ("redb.extractors.decompiler.DecompileAPK", [
            "DecompileAPK",
        ]),
    ],
    "js": [
        ("redb.extractors.js_extractors", [
            "JSFeaturesExtractor",
            "JSSuspiciousAPIsExtractor",
            "JSStringsExtractor",
            "JSDeobfuscationExtractor",
            "JSContentExtractor",
        ]),
    ],
}

# Map filetype labels (from Magika) to registry group names
FILETYPE_TO_GROUP = {
    "pebin": "pe",
    "elf": "elf",
    "macho": "macho",
    "apk": "apk",
    "javascript": "js",
}

# Cache: group name -> {class_name: class}
_group_cache = {}


def _load_group(group_name):
    """Import all extractors for a group. Cached after first call."""
    if group_name in _group_cache:
        return _group_cache[group_name]

    logger.debug(f"Loading extractor group: {group_name}")

    # Suppress androguard logging before importing APK extractors
    if group_name == "apk":
        from loguru import logger as loguru_logger
        loguru_logger.disable("androguard")

    classes = {}
    for module_path, class_names in _REGISTRY[group_name]:
        mod = importlib.import_module(module_path)
        for name in class_names:
            classes[name] = getattr(mod, name)

    _group_cache[group_name] = classes
    return classes


def get_filetype_modules(filetype):
    """Get the list of format-specific extractor classes for a filetype.

    Returns only analysis extractors (excludes decompilers like DecompileAPK).
    """
    group = FILETYPE_TO_GROUP.get(filetype)
    if not group:
        return []
    classes = _load_group(group)
    return [cls for name, cls in classes.items() if not name.startswith("Decompile")]


def get_extractor_class(name):
    """Look up a single extractor class by name across all groups.

    Checks cached groups first, then loads groups on demand.
    """
    # Check already-loaded groups first
    for group_classes in _group_cache.values():
        if name in group_classes:
            return group_classes[name]

    # Search all groups (triggers lazy loading)
    for group_name in _REGISTRY:
        classes = _load_group(group_name)
        if name in classes:
            return classes[name]

    return None