Ole K. Jensen

14 papers B 1C 1Journal 4Unranked 8
YearRankTypeTitle / Venue / Authors
2023 conf
LASCAS
Jorge Luis González Rios, Diego Vázquez, Robson Luiz Moreno, Juan Carlos Merlano Duncan, Ole K. Jensen, Symeon Chatzinotas, Björn E. Ottersten
2020 C conf
BIBE
Yunfeng Li, Jan H. Mikkelsen, Stanislav Stefanov Zhekov, Ole K. Jensen, Markus W. Frost, SØren Vedding Kold, Gert Frølund Pedersen, Ming Shen
2020 J jnl
IEEE Trans. Veh. Technol.
Wei Fan, Fengchun Zhang, Zhengpeng Wang, Ole K. Jensen, Gert Frølund Pedersen
2019 conf
NORCAS
Feridoon Jalili, Martin H. Nielsen, Ming Shen, Ole K. Jensen, Jan H. Mikkelsen, Gert Frølund Pedersen
2019 conf
NORCAS
Emilio J. Martínez-Pérez, Feridoon Jalili, Ming Shen, Jan H. Mikkelsen, Ole K. Jensen, Gert Frølund Pedersen
2015 J jnl
IEEE Trans. Circuits Syst. II Express Briefs
Ming Shen, Yingzeng Yin, Hao Jiang, Tong Tian, Ole K. Jensen, Jan H. Mikkelsen
2012 conf
ICUWB
Ming Shen, Jan H. Mikkelsen, Hao Jiang, Ole K. Jensen, Torben Larsen
2011 conf
NORCHIP
Yelin Wang, Daniel Sira, Troels Studsgaard Nielsen, Ole K. Jensen, Torben Larsen
2008 conf
VTC Spring
Basuki E. Priyanto, Troels B. Sørensen, Ole K. Jensen
2008 J jnl
IEEE Wirel. Commun.
Chenguang Lu, Frank H. P. Fitzek, Patrick C. F. Eggers, Ole K. Jensen, Gert Frølund Pedersen, Torben Larsen
2007 conf
VTC Fall
Basuki E. Priyanto, Troels B. Sørensen, Ole K. Jensen, Torben Larsen, Troels E. Kolding, Preben E. Mogensen
2006 B conf
PIMRC
Basuki Endah Priyanto, Christian Rom, Carles Navarro Manchón, Troels B. Sørensen, Preben E. Mogensen, Ole K. Jensen
2004 conf
CICC
Jan Hvolgaard Mikkelsen, Ole K. Jensen, Torben Larsen
2002 J jnl
Wirel. Pers. Commun.
Per Madsen, Ole K. Jensen, Torben Amtoft, Ragnar V. Reynisson, Jan H. Mikkelsen, Søren Laursen, Troels E. Kolding, Torben Larsen, Michael Bohl Jenner
redb/extractors/js_extractors/js_content.py
← Index redb/extractors/js_extractors/js_content.py python
"""Persists raw + normalised text into the generic `code_text_content` table.

Reads the raw source and the deobfuscation result directly from the shared
JSContext so no extra compute happens here — both values are computed once
per sample (the source at JSContext construction, the deobfuscation lazily
on first access) and reused by any extractor that needs them.

`text_normalized` is left NULL when the deobfuscation pass produced no
output, so analysts can distinguish "we tried and got nothing" from
"normalisation succeeded".
"""

import inspect
from datetime import datetime, timezone
from typing import Any

from redb.extractors.enum import Tag
from redb.extractors.js_extractor import JSExtractor


class JSContentExtractor(JSExtractor):

    def __init__(
        self, filepath, log, exporters=None, index_prefix=None,
        known_benign=False, known_malicious=False, source=None, context=None,
    ):
        super().__init__(
            filepath, log, exporters, index_prefix,
            known_benign, known_malicious, source, context=context,
        )
        self.content_row = None
        self.log.debug(inspect.currentframe().f_code.co_name)

    def tag(self):
        return Tag.JS_CONTENT.value

    def extract(self):
        src = self.js_source
        if not src:
            return None

        deobfuscated, normalizer_used = self._context.deobfuscated

        self.content_row = {
            "content_type": self._context.content_type,
            "text_raw": src,
            "text_normalized": deobfuscated,  # may be None
            "normalizer_used": normalizer_used,  # may be None
        }
        return self.content_row

    def prepare_export_data(self, exporter_type: str) -> Any:
        if exporter_type != "ClickHouseExporter":
            return None
        if not self.content_row:
            return None

        r = self.content_row
        data = [[
            self.sha256,
            r["content_type"],
            r["text_raw"],
            r["text_normalized"],
            r["normalizer_used"],
            datetime.now(timezone.utc),
        ]]

        column_names = [
            "sha256",
            "content_type",
            "text_raw",
            "text_normalized",
            "normalizer_used",
            "analysis_date",
        ]

        column_type_names = [
            "FixedString(64)",
            "LowCardinality(String)",
            "String",
            "Nullable(String)",
            "Nullable(String)",
            "DateTime64(3, 'UTC')",
        ]

        return (data, column_names, column_type_names)

    def get_clickhouse_table(self) -> str:
        return "code_text_content"