Chuyển văn bản thành giọng nói nghe như người thật

Tạo giọng nói AI

Dán kịch bản, chọn một giọng bạn đã nghe thử, chọn ngôn ngữ và nhận file MP3 tự nhiên chỉ trong vài giây. Hơn 80 giọng ElevenLabs, 18 ngôn ngữ, tối đa 5.000 ký tự mỗi lần tạo.

Hoàn hảo cho
Được nhà sáng tạo tin dùng
trên toàn thế giới
Hình ảnh Tạo giọng nói AI
Cách hoạt động

Từ một kịch bản đến bản lồng tiếng hoàn chỉnh.

Bốn bước, một màn hình. Đây là cùng một dự án, lời dẫn cho một video ngắn về nông trại cà phê, đi từ dòng chữ đầu tiên đến file MP3 đã tải về.

  1. Hình ảnh Tạo giọng nói AI — thẻ kịch bản cho lời dẫn về nông trại cà phê kèm bộ đếm ký tự
    — 01 —
    Kịch bản của bạn

    Nhập hoặc dán nội dung giọng đọc cần nói

    Viết đúng như cách nó cần được nói: dấu phẩy và dấu chấm tạo khoảng ngắt, dấu chấm hỏi lên giọng cuối câu. Mỗi lần tạo nhận tối đa 5.000 ký tự, đủ cho vài phút lời dẫn, và bộ đếm trực tiếp cho bạn biết mình đang ở đâu.

  2. Hình ảnh Tạo giọng nói AI — bộ chọn ngôn ngữ với chế độ tự nhận diện và 18 ngôn ngữ
    — 02 —
    Ngôn ngữ

    Để hệ thống tự nhận diện ngôn ngữ, hoặc cố định nó

    Để ngôn ngữ ở chế độ Tự động và mô hình sẽ nhận diện từ văn bản của bạn. Hãy cố định khi một câu ngắn có thể bị đọc sai giọng. Có 18 ngôn ngữ, từ tiếng Anh, tiếng Tây Ban Nha, tiếng Pháp đến tiếng Nhật, tiếng Hàn, tiếng Hindi, tiếng Ả Rập và tiếng Trung phổ thông.

  3. Hình ảnh Tạo giọng nói AI — danh sách giọng người dẫn chuyện, mỗi giọng có nút phát để nghe thử
    — 03 —
    Giọng đọc

    Chọn một giọng bạn đã nghe thử

    Mọi giọng trong danh sách đều phát bản nghe thử trước khi bạn tốn bất cứ thứ gì. Hơn 80 giọng ElevenLabs, nam và nữ, từ người dẫn chuyện điềm tĩnh đến MC đầy năng lượng. Đã nhân bản giọng của chính mình? Giọng đó nằm trong cùng danh sách, ở mục Giọng nhân bản của tôi.

  4. Hình ảnh Tạo giọng nói AI — lời dẫn hoàn chỉnh trong trình phát dạng sóng với nút Tải MP3
    — 04 —
    Âm thanh của bạn

    Tạo, nghe và tải MP3 về

    Chi phí ước tính hiện ra trước khi bạn nhấn Tạo. Âm thanh trả về trong trình phát dạng sóng, được lưu vào thư viện và tải về dưới dạng MP3, sẵn sàng cho trình dựng video, podcast hay bài thuyết trình.

Vì sao nghe tự nhiên

Không phải giọng đọc máy móc. Một người dẫn chuyện, khi bạn cần.

Công nghệ chuyển văn bản thành giọng nói cũ đọc từng từ một. Công cụ Tạo giọng nói AI của ClipNova chạy trên ElevenLabs Eleven v4, một mô hình giọng nói đọc trọn câu như con người: lấy hơi ở dấu phẩy, chậm lại ở từ quan trọng và lên giọng khi hỏi. Vì vậy chỉ một kịch bản đã cho bạn bản lồng tiếng dùng được ngay, chứ không phải bản nháp phải thu lại.

Thư viện giọng đọc giống với phần còn lại của ClipNova, nên người dẫn chuyện trong video AI và người đọc một file MP3 riêng có thể là cùng một người. Cùng một giọng có thể đọc kịch bản của bạn bằng bất kỳ ngôn ngữ nào trong 18 ngôn ngữ, giúp đăng cùng một kịch bản cho nhiều thị trường thật đơn giản.

Nếu không có giọng có sẵn nào phù hợp, hãy nhân bản giọng của bạn bằng Nhân bản giọng nói AI trong gói trả phí: thu một mẫu ngắn một lần và giọng đó xuất hiện trong danh sách, sẵn sàng đọc bất kỳ kịch bản nào bạn nhập.

Dành cho

Một kịch bản, mọi kiểu lồng tiếng

YouTube và kênh không lộ mặt

Lời dẫn cho mọi video đăng tải

Cho mọi video cùng một người dẫn chuyện ổn định mà không cần thu một lần nào, và đổi ngôn ngữ cho kênh thứ hai.

Quảng cáo và video sản phẩm

Lồng tiếng có thể viết lại

Sửa một dòng trong kịch bản và tạo lại trong vài giây thay vì đặt thêm một buổi thu âm.

Khóa học và video giải thích

Bài học dễ cập nhật

Biến kịch bản bài học thành âm thanh rõ ràng, nhịp đều, rồi sửa một câu sau đó mà không phải thu lại cả học phần.

Người dẫn chuyện AI và nội dung âm thanh

Truyện, phần mở đầu và thông báo

Dùng người dẫn chuyện AI cho truyện ngắn, phần mở đầu podcast, thông báo sản phẩm hoặc âm thanh hỗ trợ tiếp cận.

Câu hỏi về công cụ tạo giọng nói AI.

Công cụ tạo giọng nói AI là gì?+

Là công cụ biến văn bản viết thành âm thanh lời nói với giọng chân thực, còn gọi là chuyển văn bản thành giọng nói bằng AI (AI TTS) hay người dẫn chuyện AI. Trong ClipNova, bạn nhập kịch bản, chọn giọng và ngôn ngữ, rồi tải kết quả về dưới dạng MP3.

Có bao nhiêu giọng và ngôn ngữ?+

Hơn 80 giọng ElevenLabs, nam và nữ, mỗi giọng có bản nghe thử, trong 18 ngôn ngữ: tiếng Anh, Tây Ban Nha, Pháp, Đức, Ý, Bồ Đào Nha, Nga, Nhật, Hàn, Trung phổ thông, Ả Rập, Hindi, Indonesia, Hà Lan, Ba Lan, Thổ Nhĩ Kỳ, Việt và Thụy Điển.

Văn bản của tôi có thể dài bao nhiêu?+

Tối đa 5.000 ký tự mỗi lần tạo, tương đương vài phút lời nói. Với kịch bản dài hơn, hãy chia tại chỗ xuống đoạn và tạo từng phần bằng cùng một giọng.

Tôi có thể dùng giọng của chính mình không?+

Có. Nhân bản giọng bằng Nhân bản giọng nói AI (có trong các gói trả phí) từ một mẫu dài 5 đến 60 giây. Bản nhân bản sẽ xuất hiện trong danh sách giọng của công cụ Tạo giọng nói AI và có thể nói 10 ngôn ngữ.

Tôi nhận được định dạng file nào?+

MP3. File phát ngay trên trình duyệt, được lưu vào thư viện ClipNova của bạn và có thể tải về cho mọi trình dựng, nền tảng podcast hay công cụ thuyết trình.

Chi phí bao nhiêu?+

Tạo giọng nói được tính bằng credit theo độ dài văn bản, và chi phí ước tính hiện ra trước khi tạo. Mọi tài khoản mới đều bắt đầu với 70 credit miễn phí, không cần thẻ; các gói trả phí bắt đầu từ $19 mỗi tháng và bao gồm đầy đủ quyền thương mại.

Làm sao để phát âm và ngắt nghỉ chuẩn?+

Dấu câu quyết định nhịp điệu: dấu phẩy cho khoảng ngắt ngắn, dấu chấm cho khoảng ngắt dài hơn. Viết số theo cách đọc, và cố định ngôn ngữ khi một câu ngắn có thể bị đọc sai giọng.

Bắt đầu sáng tạo ngay hôm nay

Bản lồng tiếng tiếp theo của bạn chỉ cách một kịch bản.

Tham gia cùng các nhà sáng tạo biến ý tưởng thành video khiến người xem dừng lướt, không cần ê-kíp, phần mềm hay thời gian học.

Tạo giọng nói