LÀM ĐƯỢC

Tự tạo giọng đọc cho video, khỏi phải thu âm lại mỗi lần sửa một chữ

Dựng công cụ cho riêng mình · bài 22/27 · ⏱ 5 phút

Xong bài này anh chị sửa một chữ trong lời thoại là có ngay file giọng đọc mới, không phải thu âm lại.

Bảo máy làm thay mìnhViết gì để người ta đọc

Bài này nằm ở đâu — xem bản đồ
100%

👉 Kéo để xem hết, chụm hai ngón để phóng

BÁN ĐỀU MÀKHÔNG KIỆT SỨC VIỆC HƯỚNG RA KHÁCH Để người ta biết đến mình không ai biết thì lấy đâu ra khách Để người ta tin mình biết rồi vẫn chưa mua — vì chưa tin Để người ta chịu trả tiền tin rồi mà vẫn “để em suy nghĩ” Để Google dẫn khách về khách đang tìm mà lại ra người khác VIỆC HƯỚNG VÀO MÌNH Tiền đi đâu bán bấy nhiêu mà cuối tháng không dư Để mình không phải ôm hết bán được rồi thì mình kiệt sức Để một mình làm bằng cả đội việc thì nhiều mà chỉ có một mình BẠN Ở ĐÂY

Chuyện thường gặp

Chị Lan bán khoá học nấu ăn. Quay xong video, thu âm lời dẫn, ghép lại — mất cả buổi.

Đăng lên rồi mới phát hiện đọc nhầm: "học phí một triệu hai" đáng ra là "một triệu tám".

Sai một chữ. Nhưng để sửa thì phải mở micro, chỉnh lại giọng cho giống hôm trước, thu lại cả đoạn, ghép lại cả video.

Hôm đó chị đang ho. Giọng khác hẳn. Đành để nguyên video sai.

Thứ anh chị cần không phải phần mềm đắt tiền

Có nhiều dịch vụ đọc giọng bán theo tháng, tính tiền theo số chữ. Đọc nhiều là hết tiền.

Nhưng có công cụ chạy ngay trên máy tính của anh chị, miễn phí, không giới hạn số chữ — và không gửi lời thoại của mình đi đâu cả.

Đổi lại: máy tính chạy hơi lâu một chút, và giọng chưa mượt bằng người thật.

Đủ dùng cho video giới thiệu, video hướng dẫn, video nhắc việc. Còn video mặt anh chị nói trực tiếp thì vẫn nên tự nói.

Bước 1 — Chuẩn bị

Cần Python trên máy. Vào python.org, tải bản mới nhất, cài bình thường.

⚠️ Ở màn hình cài đặt đầu tiên, nhớ tích vào ô "Add Python to PATH" rồi mới bấm Install. Quên ô này là lát nữa gõ lệnh gì cũng báo lỗi.

Cài xong, mở Command Prompt, gõ:

python --version

Hiện ra một con số là được.

Bước 2 — Cài công cụ đọc

Vẫn trong Command Prompt, gõ:

pip install edge-tts

Chờ nó chạy xong. Đây là công cụ đọc miễn phí, có sẵn giọng tiếng Việt cả nam lẫn nữ.

Thử ngay một câu:

edge-tts --voice vi-VN-HoaiMyNeural --text "Xin chào, đây là giọng đọc thử" --write-media thu.mp3

Vào thư mục đang đứng, mở file thu.mp3 ra nghe.

Hai giọng tiếng Việt hay dùng:

| Tên giọng | Kiểu |

|---|---|

| vi-VN-HoaiMyNeural | Nữ, nhẹ, hợp video hướng dẫn |

| vi-VN-NamMinhNeural | Nam, chắc, hợp video giới thiệu dịch vụ |

Bước 3 — Đọc cả file lời thoại

Gõ tay từng câu thì mệt. Để lời thoại vào một file loi.txt, rồi gõ:

edge-tts --voice vi-VN-NamMinhNeural --file loi.txt --write-media loi-doc.mp3

Xong. Sửa một chữ trong loi.txt, chạy lại lệnh trên, có file mới trong vài giây.

Đó là toàn bộ lý do bài này tồn tại: lời thoại là chữ, không phải là băng thu. Chữ thì sửa lúc nào cũng được.

Bước 4 — Nối vào việc thật

Giờ bảo máy gói nó thành công cụ dùng hằng ngày:

📋 Câu lệnh — chép nguyên cả khối
Tôi đã cài được edge-tts trên máy Windows và đọc được tiếng Việt.
Tôi không biết lập trình, hãy hướng dẫn từng bước rất cụ thể.

Tôi muốn một công cụ làm việc này:
- Đọc file kich-ban.txt, mỗi dòng là một câu
- Tạo ra một file mp3 riêng cho từng câu, đặt tên 01.mp3, 02.mp3, ...
- Đồng thời tạo một file "thoi-luong.txt" ghi mỗi câu dài bao nhiêu giây
  (để tôi dùng canh phụ đề khi ghép video)
- Giọng đọc để thành biến ở đầu file cho tôi tự đổi: [vi-VN-NamMinhNeural]
- Thư mục làm việc cũng để thành biến: [D:\video\bai-01]
- Câu nào đã có file mp3 rồi thì bỏ qua, không đọc lại,
  trừ khi tôi xoá file đó đi

Viết bằng Python, một file duy nhất.
Kèm một file .bat để tôi bấm đúp là chạy.
Nói rõ lưu ở đâu, chạy thế nào.

Có được thứ này rồi thì nối thẳng vào công cụ ghép video ở bài trước: sửa chữ → chạy đọc → chạy ghép → ra video mới.

Bước 5 — Viết lời thoại cho máy đọc nghe xuôi

Máy đọc theo mặt chữ. Muốn nghe tự nhiên thì viết khác một chút:

  • Viết số ra chữ. Gõ "một triệu tám" thay vì "1.800.000" — máy đọc số hay sai cách ngắt.
  • Câu ngắn. Câu dài quá máy đọc một hơi, nghe hụt hơi.
  • Chấm phẩy là chỗ nghỉ. Muốn nó ngừng lâu hơn thì xuống dòng.
  • Đừng viết tắt. "SL" nó đọc là "ét lờ". Viết "số lượng".
  • Tên riêng lạ thì viết theo cách đọc. Ví dụ ghi "Xoa-la" thay vì "Solar".

⛔ Ba điều phải nhớ

Đừng nhại giọng người khác. Có công cụ sao chép giọng từ một đoạn ghi âm. Sao chép giọng người nổi tiếng, giọng đồng nghiệp, giọng khách để đăng công khai là chuyện pháp lý, không phải chuyện kỹ thuật. Dùng giọng có sẵn, hoặc giọng chính anh chị đã đồng ý.

Đừng nạp thông tin khách vào công cụ đọc. Danh sách tên, số điện thoại, địa chỉ khách — không có việc gì phải đưa vào đây.

Việc dính tiền thì nghe lại trước khi đăng. Video nói giá, nói khuyến mãi, nói cam kết bảo hành — bật lên nghe hết một lượt. Máy đọc "một trăm tám" thành "một trăm tám mươi" là lời hứa sai với cả nghìn người.

Ba chỗ hay làm sai

Gõ lệnh báo "edge-tts is not recognized". Quên tích ô "Add Python to PATH" lúc cài. Gỡ Python ra cài lại, nhớ tích ô đó.

File mp3 ra mà im lặng, không có tiếng. File loi.txt lưu sai bảng mã nên máy không đọc được chữ tiếng Việt. Mở Notepad, Lưu thành, chọn UTF-8.

Giọng đọc ngắt sai chỗ, nghe khó chịu. Câu quá dài hoặc dùng dấu ba chấm. Tách thành hai câu ngắn, mỗi câu một dòng.

Sau bài này anh chị có gì

File lời thoại (chữ)          Công cụ đọc              File giọng đọc
   kich-ban.txt        →    (bấm đúp, vài giây)   →     01.mp3 02.mp3...
        ↑                                                     ↓
   sửa 1 chữ, chạy lại  ←────────────────────────  ghép vào video

Lời thoại thành thứ sửa được. Không còn cảnh sai một chữ mà phải bỏ cả video, hoặc phải chờ đến hôm hết ho mới thu lại được.

Làm ngay trong mười phút

Cài công cụ đọc theo bước 2, chạy thử một câu, rồi dùng khối lệnh bước 4 để nối vào việc thật.

Vướng chỗ nào?

Làm theo mà chưa ra thì gọi tôi, vài phút tôi nói luôn. Đây là chỗ khác hẳn khoá học thường — học đến đâu, đỡ đến đó.

📞 Gọi 0828477999💬 Nhắn Zalo

Bài tiếp theo

Đặt lịch cho máy tự làm việc lúc mình đang ngủ

Dựng công cụ cho riêng mình

Học tiếp →