# 신장 트리
---

하나의 그래프가 있을 때 모든 노드를 포함하면서 사이클이 존재하지 않는 부분 그래프를 의미한다.

이때 모든 노드가 포함되어 서로 연결되면서 사이클이 존재하지 않는다는 조건은 트리의 성립 조건이기도 하다.


예를 들어 도시 세개를 도로로 연결하는 상황에서 최소한의 도로만 연결하는 상황이 있을 것이다. <br>
이런 최소 비용으로 만들 수 있는 신장 트리를 찾는 알고리즘을 최소 **신장 트리 알고리즘**이라고 한다. 대표적인 최소 신장 트리 알고리즘으로는 **크루스칼 알고리즘**이다.

## 크루스칼 알고리즘

크루스칼 알고리즘을 사용하면 가장 적은 비용으로 모든 노드를 연결할 수 있는데 크루스칼 알고리즘은 그리디 알고리즘으로 분류된다. 먼저 모든 간선에 대하여 정렬을 수행한 뒤에 가장 거리가 짧은 간선부터 집합에 포함시키면 된다. 이때 사이클을 발생시킬 수 있는 간선의 경우, 집합에 포함시키지 않는다.

1. 간선 데이터를 비용에 따라 오름차순으로 정렬한다.


2. 간선을 하나씩 확인하며 현재의 간선이 사이클을 발생시키는지 확인한다.
    1. 사이클이 발생하지 않는 경우 최소 신장 트리에 포함시킨다.
    2. 사이클이 발생하는 경우 최소 신장 트리에 포함시키지 않는다.


3. 모든 간선에 대하여 2번의 과정을 반복한다.

최소 신장 트리는 일종의 트리 자료구조이므로, 최종적으로 신장 트리에 포함되는 간선의 개수가 '노드의 개수 -1'과 같다는 특징이 있다.

따라서 크루스칼 알고리즘의 핵심 원리는 가장 거리가 짧은 간선부터 차례대로 집합에 추가하면 된다는 것이다. 다만 사이클을 발생시키는 간선은 제외하고 연결한다.

In [7]:
def find_parent(parent, x):
    if parent[x] != x:
        parent[x] = find_parent(parent, parent[x])
    return parent[x]

def union_parent(parent, a, b):
    a = find_parent(parent, a)
    b = find_parent(parent, b)
    
    if a < b:
        parent[b] = a
    else:
        parent[a] = b

result = 0
v = 7 # node 개수
parent = [0] * (v + 1) # 부모 노드 리스트

# (비용, 노드1, 노드2)
edges = [
    (29, 1, 2),
    (75, 1, 5),
    (35, 2, 3),
    (34, 2, 6),
    (7, 3, 4),
    (23, 4, 6),
    (13, 4, 7),
    (53, 5, 6),
    (25, 6, 7)
]

# 부모 노드 자기 자신으로 초기화
for i in range(1, v + 1):
    parent[i] = i

# 비용 작은 순으로 정렬
edges.sort()

for edge in edges:
    cost, a, b = edge
    
    # 사이클이 발생하지 않는 경우에만 집합에 포합
    if find_parent(parent, a) != find_parent(parent, b):
        union_parent(parent, a, b)
        result += cost

result

159