DB·백업 파일 자동 전송

IT 엔지니어개발자

시작하기

기본 개념

DB 덤프와 백업·아카이브 파일을 지정된 위치로 자동 전송하기

데이터베이스와 백업 프로그램에서는 DB 덤프, 전체 백업 파일, 증분 백업 파일, 로그 아카이브 등 다양한 파일이 생성됩니다.

DB·백업 파일 자동 전달은 생성된 파일을 확인하고, 설정한 조건에 따라 원격 데이터센터나 클라우드 스토리지로 자동 전송하는 방식입니다.

파일이 생성되는 위치와 원격 저장 환경을 연결하면 정기적으로 생성되는 파일을 정해진 흐름에 따라 관리할 수 있습니다.

text
DB · 백업 시스템
       │
       ▼
  파일 생성 확인
       │
       ▼
  전송 조건 확인
       │
       ▼
 원격 저장 환경
       │
       ├── 원격 데이터센터
       │
       └── 클라우드 스토리지

자동화 흐름

백업 파일 생성부터 원격 저장과 결과 확인까지 순서에 따라 연결하기

백업 파일이 생성되거나 백업 작업이 완료되면 설정한 조건에 따라 다음 전송 작업을 실행할 수 있습니다.

지정된 일정에 따라 생성된 파일을 확인하고 원격 저장 환경으로 전송하는 흐름도 구성할 수 있습니다.

① DB 덤프 또는 백업 파일 생성

② 파일 또는 백업 완료 확인

③ 전송 작업 실행

④ 원격 환경에 저장

⑤ 결과 확인

이 흐름을 통해 백업 파일 생성과 원격 저장 작업을 순서에 따라 자동으로 연결할 수 있습니다.

운영 효과

정기적인 백업 파일 전송과 원격 저장을 하나의 흐름으로 관리하기

DB와 백업 환경에서는 파일 생성, 원격 전송, 저장 위치, 실행 결과를 지속적으로 관리합니다.

자동 전송 흐름을 구성하면 정기적으로 생성되는 파일을 지정된 원격 환경으로 전송하고, 실행 결과와 저장 상태를 함께 확인할 수 있습니다.

구분개별 관리자동 전송
파일 확인생성된 파일을 작업마다 확인설정한 조건에 따라 확인
전송 실행파일별로 직접 실행조건과 일정에 따라 자동 실행
저장 위치작업마다 대상 지정파일 유형별 경로 구성
결과 관리작업별 결과 확인실행 기록과 저장 결과 통합 확인

이를 통해 DB 덤프와 백업 파일의 생성부터 원격 저장까지 이어지는 작업을 하나의 운영 흐름으로 구성할 수 있습니다.

IT 엔지니어

원본 연결

데이터베이스와 백업 장비의 파일 생성 위치 연결하기

먼저 DB 덤프와 백업 파일이 생성되는 장비와 폴더를 전송 환경에 연결합니다.

데이터베이스 서버, 백업 서버 또는 스토리지에서 생성되는 파일 경로를 지정해 전송 원본으로 구성할 수 있습니다.

원본 환경생성 파일
데이터베이스 서버DB 덤프와 내보내기 파일
백업 서버전체·증분 백업 파일
로그 서버트랜잭션 로그와 아카이브
스토리지장기 보관 대상 파일

전송 구성

원격 저장 위치와 실행 조건을 하나의 전송 흐름으로 구성하기

원본 파일을 연결한 후에는 원격 데이터센터나 클라우드 스토리지를 전송 대상으로 설정합니다.

파일이 생성될 때, 백업 작업이 완료될 때 또는 지정된 일정에 따라 전송 작업을 시작하도록 구성할 수 있습니다.

설정 항목구성 내용
원격 대상데이터센터 또는 클라우드 스토리지
저장 위치파일 유형별 폴더 또는 버킷 경로
실행 조건파일 생성, 백업 완료, 일정 실행
파일 구분DB Dump, Backup, Archive 등

예를 들어 일일 백업은 클라우드 저장소로 전송하고, 주간 백업과 장기 보관 파일은 별도의 원격 경로로 전송하는 흐름을 구성할 수 있습니다.

text
백업 작업
    │
    ▼
백업 완료
    │
    ▼
파일 확인
    │
    ├── DB Dump ────────────→ 원격 데이터센터
    │
    ├── Daily Backup ───────→ 클라우드 저장소
    │
    └── Archive ────────────→ 장기 보관 경로

자동 전송

생성된 백업 파일을 지정된 원격 환경으로 자동 전송하기

설정한 조건이 충족되면 DB 덤프와 백업 파일을 지정된 원격 환경으로 전송합니다.

파일 유형과 경로에 따라 서로 다른 저장 위치로 분기하거나, 하나의 백업 파일을 여러 원격 환경에 함께 전송하는 방식으로 구성할 수 있습니다.

text
                백업 파일
                    │
                    ▼
                전송 작업
              ╱           ╲
             ▼             ▼
      원격 데이터센터   클라우드 스토리지
             │             │
             ▼             ▼
        백업 저장소      Bucket / Path

결과 관리

전송 상태와 저장 결과를 확인하고 필요한 작업 다시 실행하기

전송 작업이 실행되면 Runs와 작업 상세 정보를 통해 파일 처리 상태와 원격 저장 결과를 확인할 수 있습니다.

특정 작업에서 추가 확인이 필요한 경우에는 Activity Log와 실행 정보를 통해 원본 파일, 장비 연결, 대상 경로와 접근 범위를 확인한 후 필요한 작업을 다시 실행할 수 있습니다.

text
전송 실행
    │
    ▼
작업 상태 확인
    │
    ├── Running
    │      │
    │      └── 진행률 확인
    │
    ├── Completed
    │      │
    │      └── 저장 결과 확인
    │
    └── 확인 필요
           │
           ▼
       상세 기록 확인
           │
           ▼
 원본 · 연결 · 저장 경로 확인
           │
           ▼
       필요한 작업 재실행
           │
           ▼
        결과 다시 확인
확인 항목확인 내용
원본 파일전송된 DB 덤프와 백업 파일
대상 위치원격 서버 또는 클라우드 저장 경로
진행 상태현재 작업 상태와 진행률
처리 결과전송된 파일 수와 전체 용량
실행 기록파일 처리 단계와 작업 결과

개발자

백업 완료 시점에 덤프를 원격으로 전송하고 체크섬으로 검증하기

연동 준비

공통 호출 코드와 경로 표기 준비하기

import os
import requests

BASE_URL = os.getenv("INNORIX_BASE_URL", "https://app.innorix.com").rstrip("/")
TOKEN = os.environ["INNORIX_ACCESS_TOKEN"]
WORKSPACE_ID = os.getenv("INNORIX_WORKSPACE_ID")   # optional; falls back to the current workspace

STATUS_COMPLETE = 2
TERMINAL = {2, 4, 5, 9, 99}          # complete / error / cancelled / partial / failed
NOT_SUCCEEDED = {4, 5, 9, 99}


def api(method, path, body=None, params=None):
    headers = {
        "Content-Type": "application/json",
        "Authorization": f"Bearer {TOKEN}",
    }

    if WORKSPACE_ID:
        headers["x-workspace-id"] = WORKSPACE_ID

    response = requests.request(
        method, BASE_URL + path,
        headers=headers, json=body, params=params, timeout=30,
    )

    payload = response.json() if response.content else {}

    if not response.ok:
        raise RuntimeError(payload.get("message") or f"HTTP {response.status_code}")

    return payload.get("data")


def is_terminal(detail):
    return detail.get("isTerminal", detail.get("status") in TERMINAL)
import base64
import time


def encode_path(device_id, raw_path):
    normalized = str(raw_path or "").replace("\\", "/")
    token = base64.b64encode(normalized.encode("utf-8")).decode("ascii")
    return f"{device_id}_ino_{token}"


def now_iso():
    return time.strftime("%Y-%m-%dT%H:%M:%S.000Z", time.gmtime())

전송 상태는 아래 값으로 판단합니다. 종료 상태는 다섯 개이고 성공에 해당하는 값은 완료(2)입니다.

상태 값의미종료
2완료
4오류
5취소
9부분 완료
99실패
1 · 6 · 12 · 13시작·전송 중·동기화 중·수신 중아니오

백업 완료 후 전송

백업 스크립트 끝에서 전송을 이어 실행하기

백업 프로그램이 파일을 만든 직후에 전송을 호출하면 파일이 준비된 시점을 정확히 맞출 수 있습니다.

파일을 보낼 때는 sourceItemisDir: false로 명시합니다. sourcePaths는 모든 경로를 폴더로 취급하므로, 덤프 파일을 넣으면 서버가 폴더로 스캔하려 해 느려지거나 시간이 초과됩니다.

import glob
import os


def latest_backup(directory, pattern="*.dump"):
    files = glob.glob(os.path.join(directory, pattern))

    if not files:
        raise FileNotFoundError(directory)

    return max(files, key=os.path.getmtime)


def send_backup(source, target, backup_path, target_path):
    transfer = api("POST", "/api/transfers/manual", {
        "sourceDevice": source,
        "targetDevice": target,
        "targetPath": target_path,
        "sourceItem": [{
            "path": backup_path,
            "isDir": False,
            "fileSize": os.path.getsize(backup_path),
        }],
        "sendAllFolder": False,
        "checkIntegrity": True,
        "transferOptions": {"target-action": "numbering"},
    })

    return transfer["monitorId"]

백업 파일은 회차를 남겨야 하므로 도착 정책을 numbering으로 둡니다. overwrite를 쓰면 이전 백업이 사라져 복구 시점을 선택할 수 없습니다.

파일 크기를 함께 넘기면 서버가 항목별 크기를 다시 조회하지 않아 빨라집니다.

손상된 백업은 복구를 시도할 때 처음 드러나므로, checkIntegrity로 전송 단계에서 무결성을 확인합니다.

파일 유형별 분기

덤프와 증분, 아카이브를 서로 다른 위치로 보내기

하나의 전송은 대상 하나를 다룹니다. 유형별로 대상이 다르면 전송을 나눠 만듭니다.

ROUTES = {
    "dump":    ("device-dc-01", "/backup/dump"),
    "daily":   ("device-cloud-01", "/backup/daily"),
    "archive": ("device-archive-01", "/backup/archive"),
}


def classify(filename):
    name = os.path.basename(filename).lower()

    if name.endswith(".dump"):
        return "dump"

    if "archive" in name or name.endswith(".tar.gz"):
        return "archive"

    return "daily"


def dispatch(source, files):
    transfers = {}

    for path in files:
        target, target_path = ROUTES[classify(path)]
        transfers[path] = send_backup(source, target, path, target_path)

    return transfers

하나의 백업 파일을 여러 원격 환경에 함께 보내야 한다면 대상마다 전송을 만들고, 반환된 monitorId를 대상별로 보관해 나중에 각 전송을 조회합니다.

copies = {
    target: send_backup("device-db-01", target, backup_path, path)
    for target, path in [("device-dc-01", "/backup/dump"),
                         ("device-cloud-01", "/backup/mirror")]
}

일정 자동화

정해진 시각에 반복 실행되도록 등록하기

백업 스크립트를 고칠 수 없는 환경이라면 일정 자동화로 구성합니다.

def build_schedule_automation(name, source, source_path, target, target_path,
                              schedule):
    return {
        "name": name,
        "flowName": name,
        "transferType": "normal",
        "timezone": "Asia/Seoul",
        "step": 1,
        "isUpcoming": False,
        "details": [
            {
                "senderId": source,
                "receiverId": target,
                "sourceItem": [
                    {
                        "hash": encode_path(source, source_path),
                        "filePath": source_path,
                        "isDir": True,
                    }
                ],
                "targetPath": encode_path(target, target_path),
                "step": 1,
                "transferOptions": {
                    "noSchedule": False,
                    "target-action": "numbering",
                    "send-fileoption": {},
                },
            }
        ],
        "schedules": [schedule],
    }


DAILY_3AM = {
    "type": "day",
    "startDateType": "now",
    "hour": "03",
    "minute": "00",
    "ampm": "am",
    "startDate": now_iso(),
    "timezone": "Asia/Seoul",
}

MONTHLY = {
    "type": "month",
    "startDateType": "now",
    "day": "1",
    "hour": "04",
    "minute": "00",
    "ampm": "am",
    "startDate": now_iso(),
    "timezone": "Asia/Seoul",
}

api("POST", "/api/automations", build_schedule_automation(
    "daily backup", "device-db-01", "/backup",
    "device-dc-01", "/backup/daily", DAILY_3AM))

자동화 요청에서 반드시 지켜야 하는 항목이 네 개 있습니다.

항목지정 방식
isUpcoming반드시 false. 서버 기본값 true는 요청에 담긴 일정을 무시하고 5분짜리 일회성 일정으로 대체합니다. triggerAutomation이 붙은 단계는 서버가 false로 강제하므로, 트리거가 없는 첫 단계에만 직접 지정하면 됩니다
step최상위와 details 양쪽에 넣습니다. 흐름 안에서의 홉 위치입니다
sourceItemhash(경로 토큰)와 filePath(평문 경로)를 함께 넣습니다
syncTypetransferOptions 안에 넣습니다. 1은 단방향, 2는 양방향입니다

네 항목 모두 누락해도 등록은 성공하고 실행 시점에 동작이 달라집니다. 반복 일정을 등록했는데 한 번만 실행되고 끝났다면 isUpcoming부터 확인합니다.

중복 등록 방지

같은 백업 작업이 두 번 만들어지지 않게 하기

같은 이름의 자동화가 있어도 새로 만들어집니다. 배치가 재시도되면 같은 백업이 두 번 전송되고 도착 정책이 numbering이라 파일도 두 벌 쌓입니다.

def find_automation(name):
    # the name we send is stored as flowName in the response
    # automationName is a server generated id like T4037-8500-1815, not the name we set.
    for page in range(1, 6):
        result = api("GET", "/api/automations",
                     params={"page": page, "size": 100, "search": name}) or {}

        items = [item
                 for flow in result.get("automations") or []
                 for item in flow.get("automations") or []]

        for item in items:
            if item.get("flowName") == name:
                return item

        if len(items) < 100:
            return None

    return None

자동화 목록은 흐름 그룹으로 중첩되어 반환되므로 안쪽 배열까지 순회해야 합니다. 서버 검색은 부분 일치이므로, 받은 결과에서 이름이 정확히 일치하는 항목만 골라냅니다.

무결성 확인

원격에 저장된 백업이 원본과 같은지 확인하기

def verify(monitor_id, timeout=1800, interval=10):
    api("POST", f"/api/transfers/{monitor_id}/verification", {})

    deadline = time.time() + timeout

    while time.time() < deadline:
        result = api("GET", f"/api/transfers/{monitor_id}/verification") or {}

        if result.get("verified"):
            return result

        time.sleep(interval)

    raise TimeoutError(monitor_id)
result = verify(monitor_id)

if not result["checksumMatched"]:
    alert(f"backup integrity failed: {result.get('mismatchedFiles')}")
응답 항목내용
checksumAlgorithm사용된 체크섬 알고리즘
sourceFileCount · targetFileCount원본과 원격의 파일 수
checksumMatched체크섬 일치 여부
mismatchedCount불일치 건수

파일 수가 다르면 전송이 덜 된 것이고, 수는 같은데 불일치가 있으면 내용이 깨진 것입니다. 백업에서는 후자가 더 위험하므로 검증 실패를 즉시 알립니다.

결과 확인과 재전송

전송 결과를 확인하고 실패한 파일 재전송하기

def wait(monitor_id, timeout=3600, interval=3):
    deadline = time.time() + timeout

    while time.time() < deadline:
        detail = api("GET", f"/api/transfers/{monitor_id}")

        if is_terminal(detail):
            return detail

        time.sleep(interval)

    raise TimeoutError(monitor_id)


def failed_files(monitor_id):
    result = api("GET", f"/api/transfers/{monitor_id}/files", params={
        "state": "any", "size": 500,
    }) or {}

    return [r for r in (result.get("children") or [])
            if r.get("status") in NOT_SUCCEEDED]


def retry_failed(monitor_id):
    rows = failed_files(monitor_id)

    if not rows:
        return 0

    api("POST", f"/api/transfers/{monitor_id}/retry", {
        "filesRetry": [
            {"filePath": r["sourceFilePath"], "isDir": bool(r.get("isFolder"))}
            for r in rows
        ]
    })

    return len(rows)
detail = wait(monitor_id, timeout=7200)

if detail["status"] != STATUS_COMPLETE:
    alert(f"backup transfer failed - retried {retry_failed(monitor_id)} files")

매일 실행되는 작업의 직전 회차가 정상 종료됐는지 점검하려면 기간을 지정해 최근 이력을 조회합니다.

from datetime import datetime, timedelta, timezone


def paginate(path, params=None, limit=200, max_pages=50):
    query = dict(params or {})
    query["limit"] = limit
    cursor = None

    for _ in range(max_pages):
        if cursor:
            query["cursor"] = cursor

        result = api("GET", path, params=query) or {}

        for record in result.get("data") or []:
            yield record

        pagination = result.get("pagination") or {}

        if not pagination.get("hasMore"):
            return

        cursor = pagination.get("nextCursor")

        if not cursor:
            return


end = datetime.now(timezone.utc)
fmt = "%Y-%m-%dT%H:%M:%SZ"

rows = list(paginate("/api/transfer-history", params={
    "startDate": (end - timedelta(days=1)).strftime(fmt),
    "endDate": end.strftime(fmt),
}))

failures = [r for r in rows if r.get("status") in NOT_SUCCEEDED]

if failures:
    alert(f"{len(failures)} backup transfers failed yesterday")

감사용으로 전체 이력을 파일로 받아야 한다면 CSV 내보내기를 씁니다.

params = {
    "periodDays": 30,
    "page": 1,
    "size": 10000,
    "filter": "[]",              # the server parses this as a JSON string, so send an empty array
    "sort": "startDate:desc",
}

조건이 없어도 filter에 빈 배열 문자열("[]")을 넣어 보냅니다. 서버가 이 값을 JSON으로 파싱하기 때문입니다. sort에 넣을 수 있는 필드는 status, sourceDeviceName, targetDeviceName, totalSize, sourceFileCount, startDate, endDate, automationName, formattedTransferTime, savedTime입니다.

확인 항목확인 내용
원본전송한 덤프와 백업 파일
대상원격 데이터센터 또는 클라우드 경로
검증파일 수와 체크섬 일치 여부
상태전송 상태와 성공 여부
이력최근 회차의 실행 결과
재전송실패한 파일과 처리 결과