<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0">
  <channel>
    <title>topic Extraction issue with dynamic field names in Splunk Search</title>
    <link>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458108#M129384</link>
    <description>&lt;P&gt;Hello there,&lt;/P&gt;

&lt;P&gt;I am stuck with a dynamic field name extraction.&lt;/P&gt;

&lt;P&gt;The data is partly JSON and sometimes contains nested JSON in the JSON part: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;log-group=abc [2019-05-12 12:23:16,074] - INFO - {"time": "2019-05-12T12:23:16Z", "step": "PRE_REQUEST", "uuid": "abcxyz", "method": "GET", "ip_src": "1.2.3.4", "url": "https://api/abc", "url_params": {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}, "user": "john"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;I am trying to extract each element of the nested 'url_params'.&lt;/P&gt;

&lt;P&gt;To achieve this, I extract url_params as a JSON event and then I extract each of its field/value using dynamic field naming.&lt;/P&gt;

&lt;P&gt;1st step - extracting url_params: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;url_params_extract = {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;2nd step - extracting each element: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;name = aaa
reliability = 90
equipment_name = bbb
element_name= ccc
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;The configuration files look like this:&lt;/P&gt;

&lt;P&gt;transforms.conf&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;[url_params]
FORMAT = url_params_extract::$1
REGEX = url_params\"\:\s(\{.*?\})\,

[url_params_extract]
FORMAT = $1::$2
REGEX = \"(.+?)\"\:\s\"(.+?)\"
SOURCE_KEY = url_params_extract
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;props.conf&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;[test]
REPORT-url_params = url_params
REPORT-url_params_extract = url_params_extract

EVAL-url_params = null
EVAL-url_params_extract = nullif(url_params_extract, "{}")
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;The problem is each last element comes out with a closing curly bracket.&lt;/P&gt;

&lt;P&gt;For instance&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;url_params_extract = {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Result:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;element_name = ccc"} 
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Instead of desired:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;element_name = ccc
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Despite the regex being tested OK on regex101&lt;/P&gt;

&lt;P&gt;Even more weird, if I do extract the nested JSON without curly braces, the issue remains:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;url_params_extract = "name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;I would still have:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;element_name = ccc"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Unfortunately, I am not able to reproduce the issue with this sample event, I am still try to figure out why.&lt;/P&gt;

&lt;P&gt;But I am starting to think that I am missing something on '$1::$2' format usage.&lt;/P&gt;

&lt;P&gt;Any hint ?&lt;/P&gt;</description>
    <pubDate>Mon, 13 May 2019 13:13:40 GMT</pubDate>
    <dc:creator>D2SI</dc:creator>
    <dc:date>2019-05-13T13:13:40Z</dc:date>
    <item>
      <title>Extraction issue with dynamic field names</title>
      <link>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458108#M129384</link>
      <description>&lt;P&gt;Hello there,&lt;/P&gt;

&lt;P&gt;I am stuck with a dynamic field name extraction.&lt;/P&gt;

&lt;P&gt;The data is partly JSON and sometimes contains nested JSON in the JSON part: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;log-group=abc [2019-05-12 12:23:16,074] - INFO - {"time": "2019-05-12T12:23:16Z", "step": "PRE_REQUEST", "uuid": "abcxyz", "method": "GET", "ip_src": "1.2.3.4", "url": "https://api/abc", "url_params": {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}, "user": "john"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;I am trying to extract each element of the nested 'url_params'.&lt;/P&gt;

&lt;P&gt;To achieve this, I extract url_params as a JSON event and then I extract each of its field/value using dynamic field naming.&lt;/P&gt;

&lt;P&gt;1st step - extracting url_params: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;url_params_extract = {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;2nd step - extracting each element: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;name = aaa
reliability = 90
equipment_name = bbb
element_name= ccc
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;The configuration files look like this:&lt;/P&gt;

&lt;P&gt;transforms.conf&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;[url_params]
FORMAT = url_params_extract::$1
REGEX = url_params\"\:\s(\{.*?\})\,

[url_params_extract]
FORMAT = $1::$2
REGEX = \"(.+?)\"\:\s\"(.+?)\"
SOURCE_KEY = url_params_extract
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;props.conf&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;[test]
REPORT-url_params = url_params
REPORT-url_params_extract = url_params_extract

EVAL-url_params = null
EVAL-url_params_extract = nullif(url_params_extract, "{}")
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;The problem is each last element comes out with a closing curly bracket.&lt;/P&gt;

&lt;P&gt;For instance&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;url_params_extract = {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Result:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;element_name = ccc"} 
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Instead of desired:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;element_name = ccc
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Despite the regex being tested OK on regex101&lt;/P&gt;

&lt;P&gt;Even more weird, if I do extract the nested JSON without curly braces, the issue remains:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;url_params_extract = "name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;I would still have:&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;element_name = ccc"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;Unfortunately, I am not able to reproduce the issue with this sample event, I am still try to figure out why.&lt;/P&gt;

&lt;P&gt;But I am starting to think that I am missing something on '$1::$2' format usage.&lt;/P&gt;

&lt;P&gt;Any hint ?&lt;/P&gt;</description>
      <pubDate>Mon, 13 May 2019 13:13:40 GMT</pubDate>
      <guid>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458108#M129384</guid>
      <dc:creator>D2SI</dc:creator>
      <dc:date>2019-05-13T13:13:40Z</dc:date>
    </item>
    <item>
      <title>Re: Extraction issue with dynamic field names</title>
      <link>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458109#M129385</link>
      <description>&lt;P&gt;Give this a try (updates to this transforms.conf entry, rest all will remain same)&lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;[url_params_extract]
 FORMAT = $1::$2
 REGEX = \"(.+?)\"\:\s\"([^\"\}]+)\"
 SOURCE_KEY = url_params_extract
&lt;/CODE&gt;&lt;/PRE&gt;</description>
      <pubDate>Mon, 13 May 2019 13:26:14 GMT</pubDate>
      <guid>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458109#M129385</guid>
      <dc:creator>somesoni2</dc:creator>
      <dc:date>2019-05-13T13:26:14Z</dc:date>
    </item>
    <item>
      <title>Re: Extraction issue with dynamic field names</title>
      <link>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458110#M129386</link>
      <description>&lt;P&gt;Thanks a lot!&lt;/P&gt;

&lt;P&gt;I had already tried something the like so it did not resolve it directly but it helped me put the finger on what was wrong!&lt;/P&gt;

&lt;P&gt;What was wrong was the extraction in place for the whole json part: &lt;/P&gt;

&lt;PRE&gt;&lt;CODE&gt;{"time": "2019-05-12T12:23:16Z", "step": "PRE_REQUEST", "uuid": "abcxyz", "method": "GET", "ip_src": "1.2.3.4", "url": "https://api/abc", "url_params": {"name": "aaa", "reliability": "90", "equipment_name": "bbb", "element_name": "ccc"}, "user": "john"}
&lt;/CODE&gt;&lt;/PRE&gt;

&lt;P&gt;It extracted the element in question - element_name = ccc"} - which was not overridden by what was executed after like I believe it would.&lt;/P&gt;

&lt;P&gt;It even turned out that fixing the extraction following your suggestion allowed to get rid of the need to extract 'url_params' independently!&lt;/P&gt;

&lt;P&gt;Thanks again,&lt;/P&gt;</description>
      <pubDate>Mon, 13 May 2019 14:24:24 GMT</pubDate>
      <guid>https://community.splunk.com/t5/Splunk-Search/Extraction-issue-with-dynamic-field-names/m-p/458110#M129386</guid>
      <dc:creator>D2SI</dc:creator>
      <dc:date>2019-05-13T14:24:24Z</dc:date>
    </item>
  </channel>
</rss>

