Offline-first trong cứu nạn là gì?
Offline-first là nguyên tắc thiết kế trong đó chức năng cốt lõi hoạt động với dữ liệu cục bộ ngay cả khi Internet hoặc máy chủ trung tâm không truy cập được. Ứng dụng không chỉ “mở được” mà phải nhận vị trí từ radio, hiển thị bản đồ đã lưu, tạo cảnh báo, ghi nhật ký và cho phép gửi thông điệp. Đám mây trở thành đích đồng bộ khi backhaul phục hồi.
Trong thảm họa, điện lưới, mạng di động và Internet có thể hỏng đồng thời. Hệ thống vì thế gồm nhiều lớp độc lập: thiết bị hiện trường, mesh LoRa, máy sở chỉ huy, kho dữ liệu cục bộ và dịch vụ đồng bộ tùy chọn. Mỗi lớp có nguồn dự phòng và chế độ suy giảm rõ ràng để một lỗi không làm mất toàn bộ năng lực thông tin.
Nguyên lý store-and-forward và dữ liệu nhất quán
Mọi sự kiện có UUID, nguồn, sequence number, timestamp và version schema. Khi không có đường truyền, sự kiện được ghi vào hàng đợi bền vững. Khi kết nối trở lại, client gửi các bản ghi chưa xác nhận; server xử lý idempotent theo ID rồi trả ack. Cùng một bản tin có thể gửi lại nhiều lần mà không tạo bản ghi trùng.
Xung đột xuất hiện khi nhiều máy sửa cùng đối tượng. Dữ liệu bất biến như event nên chỉ append; cấu hình hoặc geofence cần version, người sửa và chiến lược merge rõ. Không phải gói nào cũng cùng ưu tiên: SOS, thương vong và cảnh báo geofence được giữ; telemetry định kỳ có thể gộp theo khóa hoặc bỏ bản cũ. Hàng đợi có giới hạn và chính sách giảm tải phải được xác định trước.
Hệ thống vận hành khi hạ tầng gián đoạn ra sao?
Trước nhiệm vụ, máy sở chỉ huy tải bản đồ nền, DEM, geofence, danh sách đội, khóa kênh và model AI cần thiết; gói dữ liệu có checksum và version. Tại hiện trường, radio USB hoặc serial đưa MeshPacket vào service cục bộ. Service giải mã, chống trùng, ghi cơ sở dữ liệu rồi phát cập nhật cho dashboard. Nếu ứng dụng giao diện khởi động lại, lịch sử vẫn còn trong kho dữ liệu.
Khi backhaul xuất hiện, sync worker gửi theo ưu tiên và băng thông cho phép. Trạng thái đồng bộ hiển thị công khai thay vì làm người dùng tưởng dữ liệu đã lên máy chủ. Health monitor theo dõi radio, GPS, pin, dung lượng đĩa và tuổi bản đồ. Watchdog có thể khởi động lại dịch vụ lỗi nhưng không xóa hàng đợi. Mọi thao tác vận hành quan trọng đều có audit log.
- Chuẩn bị trước bản đồ, khóa, danh sách đội và cấu hình có checksum.
- Lưu cục bộ trước, đồng bộ sau; chống trùng bằng UUID/sequence.
- Hiển thị tuổi dữ liệu, trạng thái radio và trạng thái đồng bộ cho người chỉ huy.
Ứng dụng, diễn tập lỗi và tiêu chí nghiệm thu
Kiến trúc này phù hợp cho sở chỉ huy cứu nạn dã chiến, cứu hộ vùng núi, chữa cháy rừng, công trường xa và mọi nhiệm vụ có kết nối chập chờn. Nó cũng áp dụng cho bệnh án dã chiến, kiểm kê hiện trường và giám sát công nghiệp. Lợi ích chính là duy trì thông tin và lịch sử khi một nhà cung cấp mạng hoặc dịch vụ đám mây không sẵn sàng.
Nghiệm thu phải chủ động rút Internet, tắt router mesh, tháo USB, làm đầy đĩa, cạn pin một nút và khởi động lại máy sở chỉ huy. Với mỗi lỗi, đo thời gian phát hiện, số gói mất, khả năng phục hồi và tính toàn vẹn lịch sử. Độ bền đến từ kiến trúc, nguồn dự phòng, quy trình vận hành và diễn tập; không thể chứng minh chỉ bằng một demo chạy trong điều kiện mạng tốt.
Ba điểm cần giữ lại
- 01
Offline-first nghĩa là chức năng cốt lõi không phụ thuộc đám mây.
- 02
Đồng bộ cần idempotent, ưu tiên và chính sách hàng đợi.
- 03
Kiểm thử lỗi có chủ đích là cách duy nhất chứng minh tính bền vững.