# Load another dataset
departments_df = spark.read.csv("path/to/departments.csv", header=True, inferSchema=True)
departments_df.createOrReplaceTempView("departments")
# Perform an inner join
joined_df = spark.sql("""
SELECT p.name, p.age, d.dept_name
FROM people p
JOIN departments d ON p.dept_id = d.dept_id
""")
joined_df.show()
#output
+-------+---+----------+
| name|age| dept_name|
+-------+---+----------+
| John| 29| Marketing|
| Anna| 32| Finance |
+-------+---+----------+