Linux v6.18.37 · 개념과 코드 읽기

compaction: 연속 빈 공간을 만들되 실패를 무한 반복하지 않기

이 코드는 어떤 문제를 푸나요?

빈 페이지 수가 충분해도 고차 order의 연속 블록은 없을 수 있습니다. compaction은 이동 가능한 페이지를 옮겨 빈 공간을 모읍니다. 하지만 이동할 수 없는 페이지가 막고 있다면 같은 시도를 계속하는 데 비용만 들 수 있어 재시도를 잠시 미루기도 합니다.

읽을 범위: v6.18.37 · mm/compaction.c · compaction_deferred 141–157행입니다. 아래에 이 범위의 원문과 각 줄의 설명을 실었습니다. 주제 전체의 흐름과 다른 경로는 기존 분석에서 함께 읽으실 수 있습니다.

먼저 알아둘 개념

외부 단편화

총 빈 용량은 충분하지만 요청한 크기의 연속 구간이 없는 상태입니다. 회수로 빈 페이지 수를 늘리는 것과 compaction으로 배치를 바꾸는 것은 다른 일입니다.

defer shift

재시도 간격의 기준을 2의 거듭제곱으로 만드는 값입니다. 시간 단위 sleep 길이가 아니라 판단 횟수를 기반으로 한 지연입니다.

order별 실패 기록

작은 요청은 성공할 수 있는데 큰 요청에서 실패한 것일 수 있습니다. 실패한 크기 이상에만 같은 지연 정책을 적용하는 이유입니다.

처음 읽을 때

8페이지 중 빈 곳이 짝수 위치에만 있는 예를 그려 보세요. 빈 페이지 4개와 연속 4페이지 블록 1개가 다르다는 것을 먼저 확인한 뒤 재시도 조건을 읽으시면 됩니다.

더 깊이 살펴볼 때

compaction_deferred의 true가 실패 결과가 아니라 이번 시도 생략 판단임을 구분하세요. compact_considered의 포화 처리와 order 비교가 서로 다른 목적을 갖습니다.

그림으로 보는 변화

compaction: 연속 빈 공간을 만들되 실패를 무한 반복하지 않기의 단계별 개념 그림
각 단계에 화살표 의미와 생략 범위를 표시했습니다. 주소·숫자 예제는 실제 장치 값을 뜻하지 않습니다.
1단계 설명

1단계 고정

GIF 원본 열기

1. 연속 블록 필요

빈 페이지 수와 연속성 별도 확인

화살표는 정책 판단 순서입니다. 실제 페이지 이동은 compact_zone 등의 다른 함수가 수행합니다.

2. 이전 실패와 요청 크기 비교

작은 order는 지연 대상에서 제외 가능

더 작은 요청까지 같은 실패로 간주하지 않습니다.

3. 시도 횟수 기준으로 재시도

considered가 limit 미만이면 미루고 도달하면 허용

화살표는 호출 사이에 누적되는 카운터 변화를 뜻합니다. 이 함수 안에서 잠드는 타이머가 아닙니다.

compaction_deferred를 한 줄씩 읽기

줄 번호는 v6.18.37 원문 기준입니다. 주석·빈 줄을 포함한 함수 전체를 먼저 보고, 그 아래에서 각 줄을 설명합니다.

static bool compaction_deferred(struct zone *zone, int order)
{
	unsigned long defer_limit = 1UL << zone->compact_defer_shift;

	if (order < zone->compact_order_failed)
		return false;

	/* Avoid possible overflow */
	if (++zone->compact_considered >= defer_limit) {
		zone->compact_considered = defer_limit;
		return false;
	}

	trace_mm_compaction_deferred(zone, order);

	return true;
}
static bool compaction_deferred(struct zone *zone, int order)

zone에서 해당 order 요청의 compaction을 이번에는 미룰지 판단합니다. 반환 true의 의미를 함수 이름과 함께 읽으셔야 합니다.

	unsigned long defer_limit = 1UL << zone->compact_defer_shift;

지연 shift에서 판단 횟수 한도를 계산합니다. shift=3이면 8회이며 8초를 뜻하지 않습니다.

	if (order < zone->compact_order_failed)

이번 요청이 이전에 실패했다고 기록된 최소 order보다 작은지 봅니다.

		return false;

작은 요청은 실패 기록의 지연 대상에서 빼고 지금 시도할 수 있도록 false를 반환합니다.

	if (++zone->compact_considered >= defer_limit) {

고차 요청에 대해 검토 횟수를 하나 늘리고 한도에 도달했는지 확인합니다.

		zone->compact_considered = defer_limit;

한도에 도달한 카운터를 그 값에 고정하여 계속 증가할 때 발생할 수 있는 overflow를 피합니다.

		return false;

기다린 횟수가 충분하므로 이번에는 compaction을 미루지 않습니다.

	trace_mm_compaction_deferred(zone, order);

이번 시도를 지연한 사실을 trace에 남겨 지연 정책의 영향을 관찰할 수 있게 합니다.

	return true;

이번에는 compaction을 생략하도록 true를 반환합니다. 실제 이동 성공 여부를 반환하는 함수가 아닙니다.

함께 생각해 볼 질문

compaction은 전체 빈 페이지 수를 늘리나요?

주목적은 이동을 통해 빈 공간을 연속으로 모으는 것입니다. 사용하지 않는 내용을 버려 공간을 얻는 reclaim과 구분합니다.

true를 반환하면 압축에 성공한 것인가요?

아닙니다. compaction_deferred의 true는 이번 compaction을 미루겠다는 뜻입니다.

작은 order에서 false를 즉시 반환하는 이유는 무엇인가요?

기록된 실패 크기보다 작은 요청은 만족할 수 있으므로 큰 요청의 실패 때문에 같이 지연시키지 않습니다.

출처와 읽은 범위

Linux stable v6.18.37 · mm/compaction.c

해당 버전 원본 파일 · 기존 코드 분석 · 설명 원고

맨 위로 ↑