Nagarajan Prabakar

18 papers B 1C 1Journal 5Unranked 11
YearRankTypeTitle / Venue / Authors
2025 B conf
COMPSAC
Maurice Ngouen, Mohammad Ashiqur Rahman, Alexander Perez-Pons, Nagarajan Prabakar
2024 J jnl
Neural Comput. Appl.
Aris Duani Rojas, Leonel E. Lagos, Himanshu Upadhyay, Jayesh Soni, Nagarajan Prabakar
2023 conf
IHCI (2)
Aurelien Meray, Nagarajan Prabakar
2023 conf
IOTSMS
Maurice Ngouen, Mohammad Ashiqur Rahman, Nagarajan Prabakar, A. Selcuk Uluagac, Laurent Njilla
2023 conf
IHCI (1)
Jayesh Soni, Nagarajan Prabakar, Himanshu Upadhyay
2022 conf
ICHI
Jayesh Soni, Nagarajan Prabakar, Himanshu Upadhyay
2022 conf
CSCI
Jayesh Soni, Nagarajan Prabakar, Himanshu Upadhyay
2021 J jnl
IEEE Trans. Comput. Soc. Syst.
Punit Rathore, Jayesh Soni, Nagarajan Prabakar, Marimuthu Palaniswami, Paolo Santi
2021 conf
ICHI
Jayesh Soni, Nagarajan Prabakar
2019 conf
WiSec
Jayesh Soni, Nagarajan Prabakar, Himanshu Upadhyay
2016 J jnl
Int. J. Next Gener. Comput.
Sevugarajan Sundarapandian, Jong-Hoon Kim, Shadeh Ferris-Francis, Jerry Miller, Nagarajan Prabakar, Christopher Charters, Hunter Michko
2015 J jnl
EURASIP J. Wirel. Commun. Netw.
Jong-Hoon Kim, Gokarna Sharma, Noureddine Boudriga, S. Sitharama Iyengar, Nagarajan Prabakar
2013 conf
ISR
Jong-Hoon Kim, Nagarajan Prabakar, Cynthia Tope
2007 C conf
IPCCC
Raju Rangaswami, Seyed Masoud Sadjadi, Nagarajan Prabakar, Yi Deng
2006 conf
COMPSAC (1)
Yi Deng, Seyed Masoud Sadjadi, Peter J. Clarke, Chi Zhang, Vagelis Hristidis, Raju Rangaswami, Nagarajan Prabakar
2006 conf
CTS
Peter J. Clarke, Vagelis Hristidis, Yingbo Wang, Nagarajan Prabakar, Yi Deng
2006 conf
HIKM
Vagelis Hristidis, Peter J. Clarke, Nagarajan Prabakar, Yi Deng, Jeffrey A. White, Redmond P. Burke
2003 J jnl
IEEE Trans. Knowl. Data Eng.
George Paschos, Ivan Radev, Nagarajan Prabakar
redb/extractors/js_extractors/js_content.py
← Index redb/extractors/js_extractors/js_content.py python
"""Persists raw + normalised text into the generic `code_text_content` table.

Reads the raw source and the deobfuscation result directly from the shared
JSContext so no extra compute happens here — both values are computed once
per sample (the source at JSContext construction, the deobfuscation lazily
on first access) and reused by any extractor that needs them.

`text_normalized` is left NULL when the deobfuscation pass produced no
output, so analysts can distinguish "we tried and got nothing" from
"normalisation succeeded".
"""

import inspect
from datetime import datetime, timezone
from typing import Any

from redb.extractors.enum import Tag
from redb.extractors.js_extractor import JSExtractor


class JSContentExtractor(JSExtractor):

    def __init__(
        self, filepath, log, exporters=None, index_prefix=None,
        known_benign=False, known_malicious=False, source=None, context=None,
    ):
        super().__init__(
            filepath, log, exporters, index_prefix,
            known_benign, known_malicious, source, context=context,
        )
        self.content_row = None
        self.log.debug(inspect.currentframe().f_code.co_name)

    def tag(self):
        return Tag.JS_CONTENT.value

    def extract(self):
        src = self.js_source
        if not src:
            return None

        deobfuscated, normalizer_used = self._context.deobfuscated

        self.content_row = {
            "content_type": self._context.content_type,
            "text_raw": src,
            "text_normalized": deobfuscated,  # may be None
            "normalizer_used": normalizer_used,  # may be None
        }
        return self.content_row

    def prepare_export_data(self, exporter_type: str) -> Any:
        if exporter_type != "ClickHouseExporter":
            return None
        if not self.content_row:
            return None

        r = self.content_row
        data = [[
            self.sha256,
            r["content_type"],
            r["text_raw"],
            r["text_normalized"],
            r["normalizer_used"],
            datetime.now(timezone.utc),
        ]]

        column_names = [
            "sha256",
            "content_type",
            "text_raw",
            "text_normalized",
            "normalizer_used",
            "analysis_date",
        ]

        column_type_names = [
            "FixedString(64)",
            "LowCardinality(String)",
            "String",
            "Nullable(String)",
            "Nullable(String)",
            "DateTime64(3, 'UTC')",
        ]

        return (data, column_names, column_type_names)

    def get_clickhouse_table(self) -> str:
        return "code_text_content"