Tối ưu hóa tốc độ suy luận mô hình SenseVoice-Small ONNX bằng OpenCL
SenseVoice-Small là một mô hình nhận dạng giọng nói (ASR) đa ngôn ngữ mạnh mẽ, nổi bật với kiến trúc SAN-M giúp đạt được độ chính xác cao và độ trễ thấp. Tuy nhiên, để triển khai mô hình này trên nhiều loại thiết bị phần cứng khác nhau mà vẫn đảm bảo hiệu suất tối ưu, việc sử dụng các framework tính toán song song như OpenCL là một giải pháp th ...
Đăng vào ngày 27 tháng 7 lúc 01:47
Nhập môn Nhận dạng Giọng nói với SenseVoice-small: Mô hình 230MB và Hướng dẫn Sử dụng REST API
1. Giới thiệu về SenseVoice-small
SenseVoice-small là một công cụ nhận dạng giọng nói nhỏ gọn nhưng mạnh mẽ, chỉ có kích thước 230MB. Mô hình này có thể nhận dạng hơn 50 ngôn ngữ, bao gồm tiếng Trung, tiếng Anh, tiếng Nhật, tiếng Hàn, và thậm chí cả tiếng Quảng Đông.
Điểm nổi bật của SenseVoice-small là không cần thiết bị GPU đắt tiền, chỉ cần ...
Đăng vào ngày 12 tháng 6 lúc 06:31
Tối ưu hiệu năng và tích hợp SenseVoice-Small trong dự án C++
Công nghệ nhận dạng giọng nói ngày càng được ứng dụng rộng rãi — từ thiết bị gia đình thông minh, hệ thống xe hơi, đến trợ lý ảo và ghi âm hội nghị. SenseVoice-Small là mô hình nhẹ, phù hợp để triển khai trực tiếp trên thiết bị cục bộ trong các dự án C++.
1. Lợi thế khi sử dụng SenseVoice-Small
Mô hình này được tinh chỉnh để hoạt động tốt trên ...
Đăng vào ngày 16 tháng 5 lúc 06:35