Skip to content

Instantly share code, notes, and snippets.

@dvu4
dvu4 / create_pem_file.md
Last active December 23, 2024 22:11
Create certificate .pem file from .pk12

Generate .pem File from .p12 Certificate

This guide explains how to extract a .pem file from a .p12 file using OpenSSL and troubleshoot common errors encountered during the process.

1. Generate the .pem File

Run the following command to extract the .pem file:

openssl pkcs12 -in /Users/dvuiw/Desktop/customer.p12 -nokeys -out /Users/dvuiw/Desktop/certicate.pem -nodes -password pass:123456789
@dvu4
dvu4 / Divide the column containing JSON string into separate columns in PySpark.md
Created August 15, 2024 21:46
Divide the column containing JSON string into separate columns in PySpark

Divide the column containing JSON string into separate columns in PySpark

  • create Dataframe
import pyspark.sql.functions as F
from pyspark.sql import SparkSession
from pyspark.sql.types import StructType, StructField, StringType
 window_spec = Window.partitionBy("rxa_claim_id", "ITEM_PRODUCT_CODE").orderBy(df_idi["EVENT_TIMESTAMP"].desc())
 df_valid_claim = df_valid_claim.withColumn("row_number", F.row_number().over(window_spec))
 df_valid_claim.display()

window_spec_2 = Window.partitionBy("rxa_claim_id", "ITEM_PRODUCT_CODE")
valid_claim =  df_valid_claim.withColumn("row_number_count", F.count("row_number").over(window_spec_2))
df_valid_claim.display()
@dvu4
dvu4 / demo-mermaid.md
Last active October 17, 2024 18:30
Draw Diagrams in Markdown with Mermaid

Convert date in MM/dd/yyyy to yyyy-MM-dd

from pyspark.sql import SparkSession
from pyspark.sql.functions import from_unixtime, unix_timestamp

# Initialize Spark session
spark = SparkSession.builder.appName("date_format_conversion").getOrCreate()

# Example data

Define an array of tuples

tuples=("p-prodfix-ds-psprxp-svcp 52c2496a-3264-4174-8f98-f6cbb5750e6a" "p-qa-ds-psprxp-svcp 07cf00fd-4d8e-41a5-8f7e-a32202b63d91" "p-prod-ds-psprxp-svcp 90e2872c-5cf6-4fce-a7d3-e4de9c7a917b")

Print the tuples

echo $tuples
@dvu4
dvu4 / create_databricks_hive_metastore.md
Last active September 25, 2023 21:32
This script will create Hive metastore table in Databricks Catalog

Create Hive metastore table

# Create database schema
spark.sql("CREATE DATABASE IF NOT EXISTS csgci")


# Create Hive Internal table
df.write.mode("overwrite").option("overwriteSchema", "true").saveAsTable("csgci.drug_ic")
for i in  {"04eb34f2-3778-46e7-a1f5-391291a2bc6c","6af03cc1-8262-4e81-9fc0-bd6131b23996","7eecf3f5-67f0-4792-a9c2-c9f60ff5a96c","c5a71e40-4636-41bb-8232-b8b00fe470fb","026520ce-c449-43e1-ac4f-215db4827af0"}; do az ad sp show --id api://${i} --verbose ; done

from pyspark.dbutils import DBUtils
import pyspark.sql.functions as F
import pyspark
import pandas as pd
from itertools import chain
from functools import reduce


# mapping Walgreens status to RX-Lighting status and substatus
@dvu4
dvu4 / save_multiple_dataframes_into_text_file_in_Pyspark.md
Last active July 21, 2023 18:59
This function save multiple dataframes with different headers into one pipe delimited file (.txt file)
from pyspark.dbutils import DBUtils
import pyspark.sql.functions as F
import pyspark
import pandas as pd
from itertools import chain
from functools import reduce