> For the complete documentation index, see [llms.txt](https://help.vbee.vn/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://help.vbee.vn/huong-dan-su-dung/du-an/tao-phu-de.md).

# Tạo phụ đề

Tính năng **Tạo phụ đề** cho phép người dùng tải lên các file audio/video để hệ thống tự động nhận diện giọng nói và chuyển đổi thành văn bản phụ đề nhanh chóng. Hệ thống hỗ trợ nhiều định dạng phổ biến như `.mp3`, `.wav`, `.mp4`, `.mov` với thời lượng tối đa lên tới 90 phút.

Tính năng giúp tiết kiệm đáng kể thời gian nhập liệu thủ công, đồng thời nâng cao hiệu quả xử lý nội dung đa phương tiện trên hệ thống.<br>

Để sử dụng tính năng người dùng truy cập website <mark style="color:blue;">vbee.vn</mark>, chọn **Dự án**

<figure><img src="/files/DyaAovPd30SAhUIxmFYg" alt="" width="494"><figcaption></figcaption></figure>

Tại giao diện Dự án, người dùng tiến hành lựa chọn cộng cụ **Tạo phụ đề**

<figure><img src="/files/AgzuiCExFnQCzmfrvRK9" alt=""><figcaption></figcaption></figure>

Trong cửa sổ **Tải tệp video/audio**:

Nhấn vào khu vực tải file hoặc kéo thả file trực tiếp vào hệ thống.

Hệ thống hỗ trợ các định dạng: .mp3, .wav, .mp4, .mov

Giới hạn file: Tối đa **1GB,** thời lượng tối đa **90 phút**

<figure><img src="/files/gJ5jdgEiuPUoAvBuuzRB" alt=""><figcaption></figcaption></figure>

Tại mục **Model**, lựa chọn model phù hợp để xử lý audio/video.

`vbee-transcribe-flash`: tối ưu tốc độ xử lý và nhận diện giọng nói.

Tại mục **Chọn ngôn ngữ audio/video**:

* Chọn đúng ngôn ngữ của nội dung để tăng độ chính xác khi nhận diện.
* Nếu file có nhiều ngôn ngữ hoặc không chắc chắn, có thể chọn **Tự động phát hiện**.
* Hiện tại hệ thống chỉ hỗ trợ nhận diện ngôn ngữ tiếng Anh và tiếng Việt

  <figure><img src="/files/KSOq0M1WmzIcEkckmJdn" alt=""><figcaption></figcaption></figure>

Di chuột vào ô Tiếp tục, lượng điểm tiêu hao khi tạo phụ đề với audio tương ứng sẽ được hiển thị, nếu đồng ý bấm **Tiếp tục.**<br>

<figure><img src="/files/TimKB83enmN7oc5maMuN" alt=""><figcaption></figcaption></figure>

Hệ thống sẽ tự động:

* Nhận diện giọng nói
* Chuyển đổi thành văn bản
* Tạo phụ đề đồng bộ theo thời gian audio/video

<figure><img src="/files/m2TzAfeQQ8GhZgSiFEON" alt=""><figcaption></figcaption></figure>

Sau khi xử lý hoàn tất, người dùng thao tác:

* Kiểm tra và chỉnh sửa nội dung phụ đề trực tiếp trên hệ thống để đảm bảo nội dung văn bản, ngắt nghỉ đúng theo nhu cầu sử dụng.
* Tải xuống file phụ đề để sử dụng cho video (nếu cần).
* **Biên tập Dự án SRT và chuyển đổi thành audio.**

<figure><img src="/files/EivABl5AzJ82atC4gAlJ" alt=""><figcaption></figcaption></figure>

&#x20;**Hướng dẫn tham khảo thêm** [**Tại đây**](https://help.vbee.vn/huong-dan-su-dung/du-an/du-an-srt/bien-tap-du-an-srt)**.**

**⚠️Lưu ý:**

* Chất lượng audio càng rõ ràng thì kết quả nhận diện càng chính xác.
* Nên hạn chế file có nhiều tạp âm hoặc nhiều người nói chồng chéo.
* Với nội dung có giọng địa phương hoặc nhiều ngôn ngữ, thời gian xử lý có thể lâu hơn bình thường.
* Trường hợp đầu vào là file video, hệ thống chỉ hỗ trợ: Tạo phụ đề → Xuất file audio đầu ra định dạng .mp3. Hiện tại hệ thống chưa hỗ trợ ghép file audio đầu ra vào video gốc.
