Bài viết liên quan
Sinh trắc học giọng nói
Voice Biometrics
Sinh trắc học giọng nói là gì?
Voice Biometrics (xác thực sinh trắc học giọng nói) là công nghệ tạo voiceprint - mẫu đặc trưng giọng nói duy nhất của mỗi cá nhân, tương tự như dấu vân tay hay quét mống mắt. Hệ thống phân tích hơn 100 đặc điểm gồm: tần số cơ bản (pitch), formants (âm sắc), cadence (nhịp nói), pronunciation patterns.
Hai phương thức chính
- Text-dependent: Khách hàng đọc một câu cố định ("Tôi xác nhận giao dịch") - độ chính xác cao (FRR <2%, FAR <0,01%)
- Text-independent: Xác thực tự nhiên trong cuộc hội thoại bất kỳ, thuận tiện hơn nhưng độ chính xác thấp hơn (FRR <5%)
Quy trình hoạt động
Bước 1 - Enrollment: Khách hàng đăng ký bằng cách đọc 3-5 câu mẫu, hệ thống tạo voiceprint template lưu trữ mã hóa. Bước 2 - Verification: Khi giao dịch, khách nói câu bất kỳ trong 3-5 giây, AI so khớp với template. Bước 3 - Anti-spoofing: Phát hiện bản ghi âm, giọng tổng hợp (deepfake voice) bằng phân tích micro-pauses và âm thanh nền.
Ứng dụng tại Việt Nam
Tuân thủ Quyết định 2345/QĐ-NHNN ngày 18/12/2023 về triển khai xác thực sinh trắc học khi chuyển tiền trên 10 triệu đồng/lần hoặc tổng >20 triệu/ngày. VietinBank và Vietcombank tích hợp voiceprint trên tổng đài 1900 và app, giảm 60% thời gian xác minh OTP. FPT.AI cung cấp giải pháp cho 20+ ngân hàng với độ chính xác 98,5%.
Ưu điểm và hạn chế
Ưu điểm: Không cần nhớ mật khẩu, xác thực trong 2-3 giây, chống giả mạo tốt, tuân thủ eKYC. Hạn chế: Giọng thay đổi khi ốm/cảm/stress, loa micro kém chất lượng ảnh hưởng độ chính xác, nguy cơ deepfake AI ngày càng tinh vi.