Chuyển âm thanh thành văn bản
Chuyển tệp âm thanh, video hoặc bản ghi âm tại đây thành văn bản có mốc thời gian. Miễn phí trên trình duyệt hoặc dùng AI để phân biệt người nói. Sao chép hoặc tải TXT, phụ đề SRT, VTT.
Xem thử miễn phí: mở bản chép lời mẫu:
Trình chặn quảng cáo đang ngăn chúng tôi hiển thị quảng cáo
MiniWebtool miễn phí nhờ quảng cáo. Nếu công cụ này hữu ích với bạn, hãy ủng hộ chúng tôi bằng cách nâng cấp để duyệt không quảng cáo và có nhiều lượt dùng mỗi ngày hơn, hoặc cho phép MiniWebtool.com rồi tải lại.
- Cho phép quảng cáo cho MiniWebtool.com, rồi tải lại
- Hoặc nâng cấp để không quảng cáo và có giới hạn hằng ngày cao hơn
Giới thiệu về Chuyển âm thanh thành văn bản
Công cụ Chuyển âm thanh thành văn bản chuyển lời nói thành chữ từ ghi chú giọng nói, phỏng vấn, bài giảng, bản ghi cuộc họp, tập podcast, cuộc gọi hoặc phần âm thanh của video. Chọn tệp hoặc ghi âm bằng micrô, bản chép lời sẽ hiện từng dòng kèm mốc thời gian tương ứng.
Hai cách chuyển thành văn bản
| Miễn phí trên trình duyệt | Chuyển bằng AI | |
|---|---|---|
| Chi phí | Miễn phí 10 phút mỗi ngày; không giới hạn với Pro | 3 credit/phút; 3 credit miễn phí mỗi ngày đủ cho 1 phút |
| Nơi xử lý | Trên máy bạn (mô hình nhận dạng giọng nói Whisper) | Gửi theo từng phần, không lưu lại |
| Dấu câu | Cơ bản | Đầy đủ, dùng được ngay |
| Nhãn người nói | Không | Có, bạn có thể đổi tên |
| Ngôn ngữ | Bạn chọn | Tự động nhận diện |
| Phù hợp nhất với | Tiếng Anh rõ, bản ghi riêng tư | Phỏng vấn, cuộc họp, giọng vùng miền, âm thanh nhiều tiếng ồn, ngôn ngữ khác |
Bạn có thể làm gì với bản chép lời?
- Đối chiếu với bản ghi: nhấp vào mốc thời gian bất kỳ để nghe lại đúng đoạn đó, rồi nhấp vào dòng cần sửa.
- Sao chép hoặc tải xuống dưới dạng văn bản thuần, có hoặc không có mốc thời gian và tên người nói.
- Tạo phụ đề: tải phụ đề SRT hoặc VTT, khớp thời gian với lời nói và chia thành các dòng dễ đọc.
- Xử lý tiếp nội dung: dịch, tóm tắt các ý chính hoặc ghép phụ đề cố định vào video.
Mẹo để có bản chép lời chính xác
- Đặt micrô gần người nói, tránh tiếng nhạc và tiếng quạt; tiếng ồn là yếu tố ảnh hưởng nhiều nhất đến độ chính xác.
- Với phỏng vấn và cuộc họp, hãy dùng chế độ AI để mỗi dòng đều có nhãn người nói.
- Nếu video không mở được, hãy dùng công cụ Tách âm thanh để lấy phần âm thanh rồi chuyển tệp MP3 thành văn bản.
Câu hỏi thường gặp
Làm sao để chuyển âm thanh thành văn bản?
Chọn tệp âm thanh hoặc ghi âm bằng micrô, rồi nhấn Chuyển thành văn bản miễn phí hoặc Chuyển thành văn bản bằng AI. Văn bản sẽ hiện từng dòng kèm mốc thời gian. Bạn có thể sao chép, tải tệp TXT hoặc phụ đề SRT, VTT.
Có thực sự miễn phí không?
Có. Chế độ miễn phí chạy mô hình nhận dạng giọng nói Whisper của OpenAI ngay trên trình duyệt của bạn: mỗi người dùng được 10 phút miễn phí mỗi ngày (mỗi tệp được tính tối thiểu 1 phút), và với Pro hoặc Premium thì không giới hạn. Chế độ AI tính 3 credit cho mỗi phút có lời nói. Mỗi người dùng được tặng 3 credit AI miễn phí mỗi ngày, đủ để chuyển miễn phí phút đầu tiên trong ngày.
Chế độ miễn phí và chế độ AI khác nhau thế nào?
Chế độ miễn phí đảm bảo riêng tư (miễn phí 10 phút mỗi ngày, không giới hạn với Pro) và xử lý tốt lời nói rõ trong một ngôn ngữ. Tuy nhiên, độ chính xác thấp hơn với giọng vùng miền, tiếng ồn và các ngôn ngữ ngoài tiếng Anh, đồng thời không phân biệt người nói. Chế độ AI thêm dấu câu phù hợp, tự nhận diện ngôn ngữ, xử lý tốt hơn giọng vùng miền và tiếng ồn nền, đồng thời gắn nhãn từng người nói (Người nói 1, Người nói 2). Bạn có thể đổi các nhãn này thành tên.
Có chuyển video thành văn bản được không?
Có. Chọn tệp video (MP4, MOV, WebM, MKV và các định dạng khác), công cụ sẽ đọc phần âm thanh. Trong chế độ AI, chỉ âm thanh được gửi đi dưới dạng tệp nén nhỏ; video luôn nằm trên máy bạn.
Có tạo phụ đề từ bản chép lời được không?
Có. Tải bản chép lời dưới dạng SRT hoặc VTT: mỗi dòng trở thành một đoạn phụ đề có thời gian bắt đầu và kết thúc. Các dòng dài được chia thành phụ đề hai dòng dễ đọc. Bạn có thể mở tệp bằng YouTube, Premiere, CapCut hoặc VLC, hoặc ghép phụ đề cố định vào video bằng công cụ Thêm phụ đề vào video của chúng tôi.
Công cụ hỗ trợ những ngôn ngữ nào?
Chế độ AI chuyển lời nói thành văn bản cho hơn 100 ngôn ngữ và tự nhận diện ngôn ngữ, gồm tiếng Anh, Tây Ban Nha, Bồ Đào Nha, Pháp, Đức, Trung, Nhật, Hàn, Nga, Ả Rập và Hindi. Chế độ miễn phí cũng hỗ trợ các ngôn ngữ chính này, nhưng bạn cần chọn ngôn ngữ trong bản ghi trước.
Bản ghi có thể dài bao lâu?
Tối đa 3 giờ hoặc 500 MB. Ở chế độ miễn phí, người dùng chưa có gói có thể chuyển 10 phút thành văn bản mỗi ngày; với Pro hoặc Premium thì không có giới hạn hằng ngày. Bản ghi dài được xử lý theo từng phần tối đa hai phút, chia tại khoảng nghỉ để không cắt ngang từ. Văn bản sẽ hiện dần trên màn hình khi từng phần hoàn tất. Bạn có thể dừng bất cứ lúc nào và tiếp tục sau.
Bản ghi của tôi có được giữ riêng tư không?
Ở chế độ miễn phí, không có dữ liệu nào rời khỏi máy bạn. Ở chế độ AI, âm thanh được gửi theo từng phần để chuyển thành văn bản và không được lưu lại; bản chép lời chỉ hiển thị cho bạn và cũng không được lưu giữ.
Độ chính xác ra sao?
Với lời nói rõ, chế độ AI thường nhận đúng hơn 90% số từ, với mốc thời gian từng dòng chính xác đến phần lẻ của giây. Tên riêng, thuật ngữ chuyên ngành, lời nói nhỏ hoặc nhiều người nói cùng lúc dễ gây lỗi. Vì vậy, bạn có thể sửa từng dòng ngay trên trang trước khi tải xuống.
Tham khảo nội dung, trang hoặc công cụ này như sau:
"Chuyển âm thanh thành văn bản" tại https://MiniWebtool.com/vi/chuyen-am-thanh-thanh-van-ban/ từ MiniWebtool, https://MiniWebtool.com/
by miniwebtool team. Cập nhật: 2 thg 10, 2026
Công cụ âm thanh:
- Trình trích xuất âm thanh Phổ biến
- Bộ Chia Âm Thanh Phổ biến
- Bộ lặp MP3 Phổ biến
- Trình đảo ngược MP3
- Đo BPM Bằng Cách Gõ Nhịp Mới
- Công cụ Chuyển Tone Nhạc Mới
- 🔊 Máy Tạo Âm Thanh Mới
- Trình tạo nhịp binaural Mới
- Chuyển âm thanh thành văn bản Mới