For the complete documentation index, see llms.txt. This page is also available as Markdown.

Migrate từ PostgreSQL Single sang PostgreSQL Cluster

Hướng dẫn này mô tả các bước export dữ liệu từ PostgreSQL Single Node và restore sang PostgreSQL Cluster trên vDB. Tài liệu bao gồm hai tình huống: Phần A cho instance có một database, và Phần B cho instance có nhiều database.

Lưu ý: vDB không hỗ trợ thay đổi Deployment Type của database hiện có. Việc migrate yêu cầu tạo mới một PostgreSQL Cluster và chuyển dữ liệu thủ công theo các bước dưới đây.


Điều kiện tiên quyết

Trước khi bắt đầu, hãy đảm bảo:

  • psql, pg_dump hoặc pg_dumpall, và pg_restore đã được cài đặt trên máy thực hiện migrate (phiên bản khớp với PostgreSQL trên instance nguồn).

  • Bạn có credentials (host, username, password) cho cả PostgreSQL Single Node và PostgreSQL Cluster.


A. Migrate một database (pg_dump)

Sử dụng phần này khi PostgreSQL Single Node của bạn chứa một database cần migrate.

Bước 1 — Kiểm tra kết nối

Trước khi bắt đầu, hãy xác nhận rằng cả PostgreSQL Single Node và PostgreSQL Cluster đều đang chạy và có thể kết nối được.

# Kiểm tra PostgreSQL Single Node
psql -h <IP_single> -U <username_single> -d <database_single> -c "SELECT 1;"

# Kiểm tra PostgreSQL Cluster
psql -h <IP_cluster> -U <username_cluster> -d <database_cluster> -c "SELECT 1;"

Bước 2 — Dừng ghi dữ liệu

Trước khi export, ngăn các thao tác write vào database nguồn để đảm bảo dữ liệu export là nhất quán. Một số cách gợi ý:

Cách 1 — Dừng từ ứng dụng: Tắt hoặc tạm dừng ứng dụng đang write vào database nguồn.

Cách 2 — Set read-only trên database nguồn:

Nhớ tắt lại sau khi restore hoàn tất:


Bước 3 — Xuất dữ liệu

Dùng pg_dump để xuất database nguồn. Chọn định dạng phù hợp với phương thức restore bạn muốn sử dụng.

Tùy chọn A — Custom format (khuyến nghị; dùng với pg_restore):

Tùy chọn B — Plain SQL format (dùng với psql):

Gợi ý — Chọn định dạng phù hợp: Custom format (-Fc) tạo ra file binary được nén và hỗ trợ restore multi-job với pg_restore. Plain SQL format (-Fp) tạo ra file có thể dễ dàng đọc được, dễ kiểm tra hoặc chỉnh sửa trước khi restore. Nên dùng custom format cho database có dung lượng lớn.


Bước 4 — Restore trên PostgreSQL Cluster

Restore dữ liệu lên cluster đích theo đúng định dạng đã export.

Nếu export bằng custom format, dùng pg_restore:

Nếu export bằng plain SQL format, dùng psql:


Bước 5 — Xác minh dữ liệu sau restore

Sau khi restore hoàn tất, hãy kiểm tra dữ liệu trên PostgreSQL Cluster trước khi chuyển traffic sang. Khuyến nghị một số kiểm tra:

  • So sánh số lượng bảng giữa nguồn và đích.

  • So sánh số lượng bản ghi trong các bảng quan trọng.

  • Kiểm tra thủ công một số bản ghi trong các bảng chính.

  • Chạy thử các câu truy vấn của ứng dụng với database vừa restore.


B. Migrate nhiều database (pg_dumpall / pg_dump)

Sử dụng phần này khi PostgreSQL Single Node của bạn chứa nhiều hơn một database.


Bước 1 — Kiểm tra kết nối

Xác nhận cả hai instance đang chạy và có thể kết nối được trước khi tiến hành.


Bước 2 — Dừng ghi dữ liệu

Trước khi export, ngăn các thao tác write vào database nguồn để đảm bảo dữ liệu export là nhất quán. Một số cách gợi ý:

Cách 1 — Dừng từ ứng dụng: Tắt hoặc tạm dừng ứng dụng đang write vào database nguồn.

Cách 2 — Set read-only trên database nguồn:

Nhớ tắt lại sau khi restore hoàn tất:


Bước 3 — Xuất toàn bộ database

Chọn một trong hai cách xuất dữ liệu dưới đây.

Tùy chọn A — pg_dumpall (xuất tất cả database vào một file):

Giới hạn của pg_dumpall: pg_dumpall chỉ tạo output dạng plain SQL, do đó bạn phải restore bằng psql. Lệnh này cũng cố gắng export các global object (role, tablespace) yêu cầu quyền superuser. Lỗi ERROR: must be superuser trong quá trình export là bình thường và có thể bỏ qua. Flag --no-role-passwords bỏ qua các mật khẩu đã được mã hóa vì không thể restore chúng mà không có quyền superuser.

Tùy chọn B — pg_dump theo từng database (khuyến nghị cho hầu hết các trường hợp):

Chạy pg_dump riêng cho từng database. Cách này tránh hoàn toàn các lỗi liên quan đến quyền global và cho bạn kiểm soát tốt hơn trong quá trình restore.

pg_dump không export các global object như role và tablespace. Bạn phải tạo lại chúng thủ công trên PostgreSQL Cluster trước khi restore. Xem Bước 3 để biết thêm chi tiết.


Bước 4 — Tạo lại Role và Tablespace (nếu cần)

Nếu database của bạn phụ thuộc vào các role hoặc tablespace cụ thể, hãy tạo lại chúng trên PostgreSQL Cluster trước khi restore. Các role được tạo ở đây cần đặt mật khẩu thủ công.

Nếu bạn dùng pg_dumpall, file SQL chứa định nghĩa role nhưng một số câu lệnh có thể thất bại do thiếu quyền superuser. Hãy xem qua file và áp dụng thủ công các câu lệnh quản lý role khi cần.


Bước 5 — Restore trên PostgreSQL Cluster

Nếu dùng pg_dumpall (Tùy chọn A), restore bằng psql kết nối vào database mặc định postgres:

Nếu dùng pg_dump theo từng database (Tùy chọn B), restore từng file dump riêng lẻ:


Bước 6 — Xác minh từng database

Sau khi restore, kiểm tra toàn bộ database trên PostgreSQL Cluster. Khuyến nghị một số kiểm tra:

  • Xác nhận tất cả database dự kiến đều hiện diện.

  • Kiểm tra số lượng bảng và số lượng bản ghi trong từng database.

  • Xác minh rằng người dùng ứng dụng có thể kết nối và truy vấn thành công.


Bảng tham khảo nhanh

Tình huống
Công cụ export
Công cụ restore
Khi nào dùng

Một database

pg_dump -Fc

pg_restore

Database lớn, cần restore nhanh (hỗ trợ multi-job)

Một database

pg_dump -Fp

psql

Cần đọc hoặc chỉnh sửa file SQL trước khi restore

Nhiều database

pg_dumpall

psql

Muốn export tất cả database vào một file duy nhất

Nhiều database

pg_dump (từng DB)

pg_restore / psql

Cần kiểm soát riêng từng database, tránh lỗi quyền global


Một số vấn đề thường gặp

ERROR: must be superuser

Lỗi về quyền superuser là bình thường trên cả PostgreSQL Single Node và PostgreSQL Cluster. Bỏ qua chúng. Dùng flag --no-owner--no-privileges với pg_restore để ngăn các lỗi phổ biến nhất.

Lỗi về role hoặc ownership sau khi restore

pg_dumppg_dumpall không mang theo mật khẩu role. Sau khi restore, đặt thủ công mật khẩu cho tất cả role cần xác thực.

Thiếu tablespace

Nếu database nguồn sử dụng custom tablespace, quá trình restore có thể thất bại vì các tablespace đó không tồn tại trên cluster đích. Tạo lại các tablespace cần thiết trên PostgreSQL Cluster trước khi chạy lệnh restore.

Lỗi tạo bảng

Các lỗi không liên quan đến quyền superuser (ví dụ: bảng trùng lặp, không khớp kiểu dữ liệu) cần được điều tra trước khi tiếp tục. Không bỏ qua những lỗi này.

Database dung lượng lớn

Với database rất lớn, dùng pg_restore --jobs <n> để bật chế độ restore multi-job với custom format và giảm thời gian restore tổng thể.


Bước tiếp theo

Sau khi xác minh dữ liệu thành công:

  • Cập nhật connection string trong ứng dụng để trỏ sang PostgreSQL Cluster (host, port, credentials mới).

  • Kiểm tra ứng dụng hoạt động bình thường với database vừa migrate.

  • Xóa PostgreSQL Single Node cũ trên vDB sau khi đã xác nhận không còn cần thiết.

Last updated