Chuyển đến nội dung chính
Qwen3.8-LiveTranslate

Qwen3.8-LiveTranslate Đang hoạt động

Qwen3.8-LiveTranslate là mô hình AI phiên dịch đồng thời theo thời gian thực do Qwen của Alibaba phát triển, được tái cấu trúc dựa trên kiến trúc Interleave, giảm độ trễ trung bình trên mỗi ký tự từ 2,8 giây xuống 2,3 giây và hỗ trợ 60 ngôn ngữ.

Qwen3.8-LiveTranslate là mô hình AI phiên dịch đồng thời theo thời gian thực do Qwen của Alibaba phát triển, được tái cấu trúc dựa trên kiến trúc Interleave, giảm độ trễ trung bình trên mỗi ký tự từ 2,8 giây xuống 2,3 giây và hỗ trợ 60 ngôn ngữ.

Qwen3.8-LiveTranslate
Lượt truy cập hàng tháng
0
Giá
Chưa đặt
Được liệt kê
—
Đã cập nhật
2026-09-20

01Qwen3.8-LiveTranslate là gì

Qwen3.8-LiveTranslate là mô hình AI phiên dịch đồng thời theo thời gian thực do Qwen của Alibaba phát triển, được tái cấu trúc dựa trên kiến trúc Interleave, giảm độ trễ trung bình trên mỗi ký tự từ 2,8 giây xuống 2,3 giây và hỗ trợ 60 ngôn ngữ. Mô hình có ba năng lực chính: tách người nói và sao chép giọng nói theo thời gian thực, xuất bản gốc và bản dịch trong cùng một khung hình, khử nhập nhằng bằng ngữ cảnh dài. Mô hình có thể nhận dạng đầu vào video/âm thanh, xuất văn bản song ngữ cùng giọng đọc bản dịch vẫn giữ được chất giọng gốc theo phương thức đầu cuối, phù hợp với các tình huống như hội nghị quốc tế, phát trực tiếp xuyên biên giới và bản địa hóa video. API đã được cung cấp trên nền tảng Qwen AI.

02Các chức năng chính của Qwen3.8-LiveTranslate

Phiên dịch đồng thời theo thời gian thực: Xử lý luồng âm thanh-văn bản đơn dựa trên kiến trúc Interleave, độ trễ trung bình trên mỗi ký tự chỉ 2,3 giây, vừa nghe vừa dịch.
Tách người nói: Tự động phân biệt từng người nói khi nhiều người phát biểu luân phiên, đồng thời sao chép riêng chất giọng của họ để tạo giọng đọc bản dịch.
Xuất song ngữ cùng khung hình: Văn bản gốc và bản dịch hiển thị đồng bộ trên cùng màn hình, thuận tiện cho việc hiểu tức thời và đối chiếu với bản gốc.
Khử nhập nhằng bằng ngữ cảnh dài: Kết hợp ngữ cảnh trước đó để hiểu câu hiện tại, giúp bản dịch tên người, thuật ngữ và đại từ chính xác, nhất quán hơn.
Dịch đa ngôn ngữ: Hỗ trợ nhận dạng đầu vào 60 ngôn ngữ và xuất giọng nói bằng 29 ngôn ngữ.
Hỗ trợ thông tin hình ảnh: Hỗ trợ đầu vào video/hình ảnh, sử dụng nội dung trong khung hình để hỗ trợ khử nhập nhằng khi dịch.

03Nguyên lý kỹ thuật của Qwen3.8-LiveTranslate

Kiến trúc luồng đơn Interleave: Qwen3.8-LiveTranslate tái cấu trúc phiên dịch đồng thời thành một luồng đơn đan xen giữa âm thanh và văn bản. Âm thanh đã nghe và bản dịch đã xuất đều được lưu vào bộ nhớ và tái sử dụng, tránh phải xử lý lại từ đầu cho từng câu. Nhờ đó, chất lượng dịch được nâng cao, đồng thời độ trễ trung bình trên mỗi ký tự giảm từ 2,8 giây xuống 2,3 giây.
Thiết kế hai mô-đun Thinker–Talker: Mô hình sử dụng cấu trúc Thinker–Talker dựa trên Hybrid MoE. Thinker sắp xếp video, âm thanh, văn bản gốc và bản dịch vào cùng một chuỗi nhân quả, xếp xen kẽ theo trình tự thời gian để hoàn tất việc hiểu và dịch theo phương thức đầu cuối; Talker kết hợp bản dịch với âm thanh nguồn để tổng hợp giọng đọc bản dịch vẫn giữ được chất giọng của người nói gốc.
Tách người nói theo thời gian thực: Trong các tình huống nhiều người phát biểu luân phiên, mô hình thực hiện Diarization trước khi dịch, xác định mỗi câu thuộc về người nói cụ thể nào, từ đó hướng dẫn Talker sao chép ổn định chất giọng của người đó, bảo đảm người nghe có thể nhận ra ai đang nói trong giọng đọc bản dịch.
Khử nhập nhằng bằng ngữ cảnh dài: Mô hình đưa các cuộc hội thoại trước đó vào quá trình lập mô hình ngữ cảnh, liên kết thông tin từ các lượt nói trước, tránh tình trạng chỉ dựa vào một câu đơn lẻ dẫn đến nhập nhằng về tên riêng, tên người và đại từ, đồng thời bảo đảm thuật ngữ và cách diễn đạt nhất quán trong các cuộc hội thoại dài có nhiều người tham gia.
Cơ chế xuất song ngữ đồng bộ: Về mặt kiến trúc, văn bản gốc và bản dịch được căn chỉnh và tạo ra trong cùng một chuỗi đan xen, qua đó hỗ trợ tự nhiên việc xuất cùng khung hình. Nhờ vậy, các ứng dụng hạ nguồn như phụ đề song ngữ, biên tập nội dung và tìm kiếm không cần xử lý căn chỉnh bổ sung.

04Cách sử dụng Qwen3.8-LiveTranslate

Mở https://omni.qwen.ai/live-translate.
Cho phép quyền truy cập micro, chọn ngôn ngữ nguồn và ngôn ngữ đích.
Bắt đầu nói trực tiếp để xem phụ đề song ngữ theo thời gian thực và nghe bản dịch được đọc.
Đăng nhập nền tảng Qwen AI để lấy API Key.
Gọi API thời gian thực của mô hình https://www.qianwenai.com/models/qwen3.8-livetranslate-flash-realtime và truyền luồng âm thanh vào.
Tiếp nhận văn bản song ngữ và giọng đọc bản dịch được trả về.

05Ưu điểm cốt lõi của Qwen3.8-LiveTranslate

Độ trễ thấp: Kiến trúc Interleave giảm độ trễ trung bình trên mỗi ký tự từ 2,8 giây xuống 2,3 giây. Âm thanh đã nghe và bản dịch đã xuất có thể được lưu vào bộ nhớ và tái sử dụng, giúp quá trình dịch nhanh và mượt hơn.
Tách người nói + sao chép giọng nói: Phân biệt chính xác từng người nói khi nhiều người phát biểu luân phiên, đồng thời sao chép riêng chất giọng của mỗi người trong giọng đọc bản dịch, giúp xác định rõ nguồn phát ngôn.
Xuất gốc và bản dịch cùng khung hình: Văn bản gốc và bản dịch hiển thị đồng bộ, vừa hỗ trợ hiểu tức thời vừa thuận tiện đối chiếu với bản gốc, phù hợp tự nhiên với phụ đề, biên tập nội dung, tìm kiếm và các tình huống khác.
Khử nhập nhằng bằng ngữ cảnh dài: Liên kết ngữ cảnh lịch sử qua nhiều lượt nói, giải quyết vấn đề nhập nhằng khi chỉ phán đoán từ một câu, giúp bản dịch tên người và thuật ngữ chính xác, nhất quán hơn.
Phủ rộng 60 ngôn ngữ: Hỗ trợ nhận dạng 60 ngôn ngữ và xuất giọng nói bằng 29 ngôn ngữ, đáp ứng nhu cầu giao tiếp đa ngôn ngữ theo thời gian thực.

06Các tình huống ứng dụng của Qwen3.8-LiveTranslate

Hội nghị quốc tế: Tự động phân biệt người nói và sao chép chất giọng trong các cuộc thảo luận nhiều người, sau đó phiên dịch theo thời gian thực, giúp người tham dự có cảm giác như đang giao tiếp cùng một ngôn ngữ.
Phát trực tiếp xuyên biên giới: Cung cấp phụ đề song ngữ đồng bộ và giọng đọc bản dịch cho người dẫn chương trình, giúp nội dung phát trực tiếp tiếp cận khán giả toàn cầu mà không gặp rào cản ngôn ngữ.
Bản địa hóa video: Chỉ cần nhập video để tạo phụ đề song ngữ và lồng tiếng được căn chỉnh, đơn giản hóa đáng kể quy trình dịch và lồng tiếng cho phim ảnh, khóa học.
Triển lãm quốc tế/sự kiện triển lãm: Cung cấp phiên dịch đồng thời với độ trễ thấp cho giao tiếp trực tiếp giữa các bên tham gia, giảm chi phí thuê phiên dịch chuyên nghiệp.
Chăm sóc khách hàng và đào tạo cho doanh nghiệp vươn ra quốc tế: Hỗ trợ tư vấn bằng giọng nói theo thời gian thực cho khách hàng nước ngoài và đào tạo nhân viên đa ngôn ngữ, nâng cao hiệu quả cung cấp dịch vụ toàn cầu.

© Tuyên bố miễn trừ trách nhiệm: tên miền và nội dung được liên kết có thể thay đổi theo thời gian. AIEZZ không kiểm soát các trang web của bên thứ ba. Hãy tự đánh giá nội dung bên ngoài và các rủi ro liên quan.

Đánh giá của người dùng0