Thuật toán trí tuệ nhân tạo dựng lại chân dung người chỉ bằng giọng nói từ video Youtube

VNR Content · 28/05/2022

Các nhà khoa học tại Học viện Công nghệ Massachusetts (MIT-Mỹ) lần đầu tiên thành công trong việc ứng dụng thuật toán để tái tạo lại chân dung chỉ từ giọng nói.

Thuật toán trí tuệ nhân tạo dựng lại chân dung người chỉ bằng giọng nói từ video Youtube

Thuật toán AI được đặt tên là Speech2Face được các nhà khoa học trí tuệ nhân tạo (AI) tại Phòng thí nghiệm Khoa học máy tính và Trí tuệ nhân tạo (CSAIL) của MIT phát triển, giúp tái tạo lại khuôn mặt một người chỉ bằng một đoạn ghi âm ngắn giọng nói và kết quả rất ấn tượng.
Đầu tiên, các nhà nghiên cứu thiết kế và đào tạo một mạng neuron nhân tạo học sâu, bằng cách sử dụng hàng triệu video từ YouTube và internet lúc mọi người đang nói chuyện.
Trong quá trình đào tạo này, AI đã học được mối tương quan giữa âm thanh của giọng nói và người nói trông như thế nào. Những mối tương quan đó cho phép AI đưa ra những phỏng đoán tốt nhất về độ tuổi, giới tính và quốc tịch của người nói.

Hình ảnh thực tế của người nói (trái) và hình được tái tạo bởi AI từ giọng nói của họ (phải). (Ảnh: Speech2Face).
Không có sự tham gia của con người trong quá trình đào tạo. AI chỉ được cung cấp một lượng lớn video và có nhiệm vụ tìm ra mối tương quan giữa đặc điểm giọng nói và đặc điểm khuôn mặt.
Sau khi được đào tạo, AI đã rất giỏi trong việc tạo ra các bức chân dung chỉ dựa trên các bản ghi âm giọng nói giống với những gì người nói thực sự trông như thế nào.
Để phân tích thêm độ chính xác của việc tái tạo khuôn mặt, các nhà nghiên cứu đã xây dựng "bộ giải mã khuôn mặt". Bộ giải mã sẽ tạo ra một bản tái tạo tiêu chuẩn cho khuôn mặt của một người từ hình ảnh tĩnh của họ khi bỏ qua "các biến thể không liên quan", chẳng hạn như tư thế chụp ảnh và ánh sáng. Điều này cho phép các nhà khoa học dễ dàng so sánh các bản tái tạo giọng nói với các đặc trưng thực tế của người nói.

Một lần nữa, kết quả của AI rất gần với khuôn mặt thật trong rất nhiều các trường hợp được nghiên cứu từ nhiều độ tuổi, giới tính và dân tộc khác nhau.
AI tái tạo chân dung từ giọng nói, có thể tạo ra hình ảnh hoạt hình của một người trên điện thoại hoặc cuộc gọi hội nghị truyền hình khi danh tính của người đó không xác định và họ không muốn chia sẻ khuôn mặt thực của mình.
Các nhà nghiên cứu đã viết trong bài báo được công bố tại một hội thảo về thị giác máy tính và nhận diện mẫu (CVPR): "Các khuôn mặt được tái tạo cũng có thể được sử dụng trực tiếp để gán cho giọng nói do máy tạo ra được sử dụng trong các thiết bị gia đình và trợ lý ảo".

AI tạo chân dung chỉ từ giọng nói. (Ảnh: Nhóm nghiên cứu Speech2Face)
Cơ quan thực thi pháp luật cũng có thể sử dụng AI để tạo ra một bức chân dung của kẻ tình nghi từ bằng chứng duy nhất là một đoạn ghi âm giọng nói. Tuy nhiên, các ứng dụng của chính phủ chắc chắn sẽ là chủ đề của rất nhiều tranh cãi và tranh luận liên quan đến quyền riêng tư và đạo đức.

Tìm kiếm

Có thể bạn quan tâm

Thuật toán trí tuệ nhân tạo dựng lại chân dung người chỉ bằng giọng nói từ video Youtube

VNR Content

Pearl

VNR Content

>> Các nhà khoa học Mỹ đã phát triển thuật toán dự đoán tội phạm với độ chính xác lên đến 90%

Thực hư chuyện các nữ phi hành gia phải sử dụng thuốc tránh thai trước khi lên vũ trụ?

Phát hiện khu định cư 5.000 năm tuổi ở Israel chấn động khoa học

Những kiểu tập luyện người huyết áp cao không nên thực hiện

Máy xúc bất ngờ bị mặt đất "nuốt chửng" trươc sự ngỡ ngàng của nhiều người

Phát hiện khu định cư 5.000 năm tuổi ở Israel chấn động khoa học

Vaio ra mắt bộ đôi laptop mới chạy chip Intel, siêu mỏng nhẹ dành cho dân kinh doanh

Netflix vẫn là ông vua phát trực tuyến

Tăm nước là gì? Có những loại tăm nước nào?

Quentin Tarantino gây tranh cãi khi phát ngôn về "Dune" của Denis Villeneuve

Có thật Snapdragon 8 Elite của Qualcomm bị quá nhiệt hay không?

Apple sắp nâng cấp hàng loạt sản phẩm lên màn hình... 90Hz

Sony kiện đài truyền hình CBS của Mỹ

Đừng vội mua iPhone 16! Năm sau iPhone 17 sẽ trang bị 1 thứ cực giá trị đã có trên điện thoại Android giá rẻ

Toho "bật đèn xanh" cho 1 dự án Godzilla mới, Takashi Yamazaki tiếp tục làm đạo diễn

Đánh giá nổi bật

Có thể bạn quan tâm

Thuật toán trí tuệ nhân tạo dựng lại chân dung người chỉ bằng giọng nói từ video Youtube

Pearl

>> Các nhà khoa học Mỹ đã phát triển thuật toán dự đoán tội phạm với độ chính xác lên đến 90%​

Thực hư chuyện các nữ phi hành gia phải sử dụng thuốc tránh thai trước khi lên vũ trụ?

Phát hiện khu định cư 5.000 năm tuổi ở Israel chấn động khoa học

Những kiểu tập luyện người huyết áp cao không nên thực hiện

Máy xúc bất ngờ bị mặt đất "nuốt chửng" trươc sự ngỡ ngàng của nhiều người

>> Các nhà khoa học Mỹ đã phát triển thuật toán dự đoán tội phạm với độ chính xác lên đến 90%